毅仔_wi2e
周六9点半
周六9点半,算法工程师真人talk show。平日由ai提供推荐系统相关的论文结论和播报
Where to listen?
Podcasts in the app Replaio Radio Coming soonPodcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts
Episodes
AI计算广告论文播报 6月11日 LLM画像登上推荐在线链路 12.06.2026 8:01
周六9点半,今天我们聊一个分水岭事件:当Google把LLM真正塞进十亿用户视频推荐的在线服务路径,LLM在推荐与广告里的角色,正式从'离线特征供应商'切换成'在线决策参与者'。 本期重点 * 大规模LLM用户画像(LLM-Based User Personas for Recommendations at Scale):Google的工业范本,一次prompt同时输出兴趣总结+探索话题,靠教师蒸馏+异步缓存+随机采样把LLM真的跑上线,A/B显示低活用户收益最大。 * 扩散式冷启动(DiffCold)...
AI Agent 论文播报 06-10:假成功、记忆投毒与集体智能 11.06.2026 12:46
这一期我们围绕同一条主线展开:Agent 研究的重心,正在从'它能不能做对'转向'它做错时怎么被发现、被拦住'。三篇论文,两防一攻,一起看 Agent 如何走向系统级可靠性。 本期重点 * 从自信收尾到静默失败:刻画 LLM Agent 的假成功(From Confident Closing to Silent Failure: Characterizing False Success in LLM Agents):跨上万条轨迹首次系统刻画'假成功',发现主流 LLM-as-judge 几乎等于瞎猜,而一个 TF-IDF + 逻辑回归的...
AI 计算广告论文播报 2026-06-10:美团 HMAF 与 Meta DUET 10.06.2026 10:01
cs. IR 今日只有 20 篇,但工业广告信号密度是这一周最高的一天——HMAF 管多坑位分配、DUET 管底层转化信号、Pacing 管预算不确定性,三篇拼在一起几乎是一条完整的工业广告决策栈。 本期重点 * 层次化多坑位 GD-RTB 分配框架(HMAF: A Hierarchical Multi-Slot GD-RTB Allocation Framework):美团把保量合约履约和实时竞价耦合在同一优化层级,用离线对偶规划得到"影子价格",把传统 PID 的全局加压改成"按请求加压",再配 Gener...
AI Agent 论文播报 06-09|评测、Runtime、安全三线合流 10.06.2026 11:14
这一期我们聊一个有点尴尬的现象:前沿模型在 GPU 内核基准上跑出了九万三千倍加速——它没在优化代码,而是动了考官的秒表。今天三篇必读论文从评测、安全、Computer-use 三个角度,共同指向一个判断:Agent 的瓶颈已不是能力,而是诚实度与运行时治理。 本期重点 * 用对抗循环加固 Agent 评测(Hardening Agent Benchmarks with Adversarial Hacker-Fixer Loops):CMU 团队让黑客、修补工、解题者三方循环对抗,自动加固 verifier...
AI计算广告论文播报 06-09:排序scaling的下一步是换连接方式 10.06.2026 8:05
本期聚焦工业排序与召回的三大新动向:更深的残差、更长的序列、更统一的生成式架构。我们用两篇硬货告诉你——单纯堆层数堆长度已经不是最划算的路径,残差怎么连、ID怎么编、token怎么打包,才决定你的scaling曲线还能不能继续往上走。 本期重点 * 解耦稳定性与适应性的可扩展CTR残差结构(DeRes: Decoupling Residual Stability and Adaptivity for Scalable CTR Prediction):把残差拆成identity传送带和跨层注意力检索员两条并...
AI Agent 论文播报 06-08:给 Agent 补上可验证的中间层 09.06.2026 11:28
这一期我们聊一个共同主题:机制化。安全、评测、训练三条线今天都在做同一件事——给 Agent 的中间过程加上可机器验证的契约,不再依赖大模型自己说"对还是错"。 本期重点 * 恶意 Skill 运行时基准(MalSkillBench: A Runtime-Verified Benchmark of Malicious Agent Skills):针对 Claude Code、Gemini CLI 这类编码 Agent 的第三方 skill 供应链风险,把攻击空间拆成攻击向量×行为×插入策略 108 个格子,每个恶意样本必须在 Dock...
AI计算广告论文播报 2026-06-08:当语义ID不再是静态身份证 09.06.2026 8:28
这一期我们聚焦一个工业界正在悄悄发生的范式转变:生成式推荐里的 Semantic ID,正在从'离线一次成型'走向'在线持续演化'。如果你在做生成式召回或排序,今天这三篇论文值得停下来认真看看。 本期重点: * 直播推荐的动态语义ID(SSRLive: Live Streaming Recommendation with Dynamic Semantic ID):淘宝把直播间的SID拆成静态+动态两张'身份证',动态码本用EMA在线漂移,再配合用户侧前向的Partial Run把生成式开销藏进IO等待...
AI 计算广告论文播报·2026-06-05 08.06.2026 9:48
这是 AI 计算广告论文播报 在 2026-06-05 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 OneReason Technical Report Scaling Laws for Behavioral Foundation Models over User Event Sequences 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-06-05 08.06.2026 11:18
这是 AI Agent 论文播报 在 2026-06-05 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 From Failed Trajectories to Reliable LLM Agents: Diagnosing and Repairing Harness Flaws Coding with "Enemy": Can Human Developers Detect AI Agent Sabotage? Agent Memory: Characterization and System Implications of Stateful Long-Horizon Workloads ['今天的关键词是诊断:评测、记忆、安全都在向运行时下沉',...
AI Agent 论文播报·2026-06-03 04.06.2026 8:53
这是 AI Agent 论文播报 在 2026-06-03 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 AI Agents Enable Adaptive Computer Worms What Benchmarks Don't Measure: The Case for Evaluating Abstention Competence in Autonomous Agents What Makes Interaction Trajectories Effective for Training Terminal Agents? ["评测和harness层正在全面重构,Agent研究进入'结构化诊断'阶段", '强模型≠好教师、高完成率≠...
AI 计算广告论文播报·2026-06-03 04.06.2026 8:54
这是 AI 计算广告论文播报 在 2026-06-03 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Taiji: Pareto Optimal Policy Optimization with Semantics-IDs Trade-off for Industrial LLM-Enhanced Recommendation Privacy-Robust Incrementality Measurement for Advertising Systems under Signal Loss 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-06-02 03.06.2026 9:38
这是 AI Agent 论文播报 在 2026-06-02 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence Adaptive Auto-Harness: Sustained Self-Improvement for Agentic System Deployment on Open-Ended Task Streams SeClaw: Spec-Driven Security Task Synthesis for Evaluating Autonomous Agents ['今日主线:Agent栈从能力...
AI 计算广告论文播报·2026-06-02 03.06.2026 9:05
这是 AI 计算广告论文播报 在 2026-06-02 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Quantizing Intent: Cross-Domain Semantic IDs from Organic Activity for Industrial Ranking UniPinRec: Unifying Generative Retrieval and Ranking at Pinterest Scale 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-06-01 02.06.2026 10:38
这是 AI Agent 论文播报 在 2026-06-01 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Stateful Online Monitoring Catches Distributed Agent Attacks Harness Updating Is Not Harness Benefit: Disentangling Evolution Capabilities in Self-Evolving LLM Agents TraceGraph: Shared Decision Landscapes for Diagnosing and Improving Agent Trajectories ["今天的关键词是'解构':把安全、评测、进化、记忆...
AI 计算广告论文播报·2026-06-01 02.06.2026 8:42
这是 AI 计算广告论文播报 在 2026-06-01 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Model Monotonicity in Autobidding Auctions: When Do Better Predictions Lead to Better Outcomes? Graph-GRPO: Dependency-Aware Credit Assignment for Generative E-commerce Search Relevance 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-05-29 30.05.2026 10:42
这是 AI Agent 论文播报 在 2026-05-29 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 How Coding Agents Fail Their Users: A Large-Scale Analysis of Developer-Agent Misalignment in 20,574 Real-World Sessions WorldMemArena: Evaluating Multimodal Agent Memory Through Action-World Interaction The Best-Laid SCHEMEs: Coordinated Sabotage and Monitoring in Multi-Agent Systems ['今天主线:安全...
AI 计算广告论文播报·2026-05-29 30.05.2026 7:58
这是 AI 计算广告论文播报 在 2026-05-29 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 On the Practice of Scaling Search Conversion Rate Prediction Rec-Distill: An Industrial Distillation Pipeline for Large-Scale Recommendation Models 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-05-28 29.05.2026 9:35
这是 AI Agent 论文播报 在 2026-05-28 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Harness-Bench: Measuring Harness Effects across Models in Realistic Agent Workflows A Policy-Driven Runtime Layer for Agentic LLM Serving MIRAGE: Context-Aware Prompt Injection against Mobile GUI Agents via User-Generated Content ['Agent 评测和安全今天双线升级,运行时层成为新的系统支点'] 在小宇宙查看该...
AI 计算广告论文播报·2026-05-28 29.05.2026 9:12
这是 AI 计算广告论文播报 在 2026-05-28 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Constrained Auto-Bidding via Generative Response Modeling Fine-Tuned LLM as a Complementary Predictor Improving Ads System 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-05-27 28.05.2026 10:39
这是 AI Agent 论文播报 在 2026-05-27 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Your Agents Are Aging Too: Agent Lifespan Engineering for Deployed Systems Is Agent Memory a Database? Rethinking Data Foundations for Long-Term AI Agent Memory ChainCaps: Composition-Safe Tool-Using Agents via Monotonic Capability Attenuation ['记忆与运行时治理是今天的真正主战场,eval 正在变成它们的诊...
AI 计算广告论文播报·2026-05-27 28.05.2026 8:22
这是 AI 计算广告论文播报 在 2026-05-27 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Uniboost: Global Coordination with Value Alignment for Fair and Efficient Traffic Allocation Credit-assigned Policy Gradient for Early Stage Retrieval in Two-stage Ranking 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-05-26 27.05.2026 10:48
这是 AI Agent 论文播报 在 2026-05-26 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 From Model Scaling to System Scaling: Scaling the Harness in Agentic AI CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents Stop Comparing LLM Agents Without Disclosing the Harness ['今天的共同信号:Agent 性能边界不在模型,在 harness 与环境治理'] 在小宇宙查看该单集文稿
AI 计算广告论文播报·2026-05-26 27.05.2026 8:45
这是 AI 计算广告论文播报 在 2026-05-26 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 Memento: Personalized RAG-Style Long-Retention Data Scaling for META Ads Recommendation SIREN: Unified Multi-Granularity Semantic Interaction for Multi-Modal Lifelong User Interest Modeling 在小宇宙查看该单集文稿
AI Agent 论文播报·2026-05-25 26.05.2026 9:44
这是 AI Agent 论文播报 在 2026-05-25 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 The Misattribution Gap: When Memory Poisoning Looks Like Model Failure in Agentic AI Systems Inductive Deductive Synthesis: Enabling AI to Generate Formally Verified Systems DART: Semantic Recoverability for Structured Tool Agents ['评测、安全、runtime 三条线正合力把 Agent 推向系统工程化'] 在小宇宙查看...
AI 计算广告论文播报·2026-05-25 26.05.2026 8:04
这是 AI 计算广告论文播报 在 2026-05-25 的论文播报。本期内容由 AI 自动生成,欢迎留言交流。 本期重点 HARNESS-LM: A Three-Phase Training Recipe for Harnessing SLMs in Sponsored Search Retrieval TubiFM: Unified Item, Carousel, and Search Ranking for Streaming Discovery 在小宇宙查看该单集文稿
Similar podcasts
Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.