任雨山
Seventy3
73播客,名字取材于Sheldon最喜欢的数字,内容由NotebookLM生成,每天跟随AI读AI业界论文。
Where to listen?
Podcasts in the app Replaio Radio Coming soonPodcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts
Episodes
【第474期】苹果SALT:如何用笨老师教出顶尖AI 16.01.2026 15:35
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Rethinking JEPA: Compute-Efficient Video SSL with Frozen Teachers Summary 视频联合嵌入预测架构(Video Joint Embedding Predictive Architectures, V-JEPA)通过在潜在空间中预测被遮蔽的区域、并采用指数移动平均(EMA)更新的教师网络,来学习可泛化的现成视频表征。尽管 EMA 能避免表...
【第473期】DeepSeek稀疏注意力提升长上下文效率 15.01.2026 11:02
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: DeepSeek-V3.2-Exp: Boosting Long-Context Efficiency with DeepSeek Sparse Attention Summary 我们介绍 DeepSeek-V3.2,这一模型在高计算效率与卓越的推理及智能体性能之间实现了协调统一。DeepSeek-V3.2 的关键技术突破包括: (1) DeepSeek 稀疏注意力机制(DSA):我们提出 DSA,这是一种...
【第472期】LLM-JEPA:大语言模型联结嵌入预测架构 14.01.2026 17:07
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: LLM-JEPA: Large Language Models Meet Joint Embedding Predictive Architectures Summary 大型语言模型(LLM)的预训练、微调与评测依赖于输入空间的重建与生成能力。然而,在计算机视觉领域已有观察表明,基于嵌入空间的训练目标(例如联合嵌入预测架构,Joint Embedding Predictive Archit...
【第471期】AI当同事:为什么我的AI你不许碰 13.01.2026 17:54
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Collaborative Document Editing with Multiple Users and AI Agents Summary 当前的人工智能写作支持工具主要面向个人设计,这使得协作变得复杂:共同作者需要离开共享写作空间以使用 AI,然后再沟通并重新整合结果。我们提出将 AI 代理直接集成到协同写作环境中。我们的原型通过两个新的共享...
【第470期】上下文学习:脆弱的统计学家 12.01.2026 17:05
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Is In-Context Learning Learning? Summary In-context learning(ICL) 使某些自回归模型能够通过下一 token 预测来解决任务,而无需进一步训练。这导致了一个常见论断:这些模型能够在提示中仅通过少量示例(few-shot exemplars)就解决(学习)未见过的任务。然而,推理能力并不必然意味着...
【第469期】K2-Think:小模型的大推理能力 11.01.2026 15:32
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: K2-Think: A Parameter-Efficient Reasoning System Summary K2-Think 是一个推理系统,在 32B 参数规模下实现了 SOTA 表现,达到或超过诸如 GPT-OSS 120B 和 DeepSeek v3.1 等更大模型的水平。基于 Qwen2.5 基座模型构建,我们的系统展示出:通过结合先进的后训练技术与测试阶段的计算优化,...
【第468期】LiveMCP-101:多步工具调用的基准测试与分析 10.01.2026 21:59
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: LiveMCP-101: Stress Testing and Diagnosing MCP-enabled Agents on Challenging Queries Summary 工具调用已成为 AI 代理与现实世界交互并解决复杂任务的一项关键能力。尽管 Model Context Protocol(MCP)提供了一个强大的标准化工具集成框架,但在基准测试方面仍存在显著缺口:缺乏能够评...
【第467期】强化学习中LLM的层次推理与HICRA 09.01.2026 14:37
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning Summary 强化学习(Reinforcement Learning, RL)已被证明在提升大型语言模型(LLM)的复杂推理能力方面非常有效,但其成功背后的内在机制仍然大多不透明。我们的分析揭示,诸如“顿悟时刻”(aha moments)、“长度扩展...
【第466期】AI自我进化_三定律与活组织 08.01.2026 19:22
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: A Comprehensive Survey of Self-Evolving AI Agents Summary 大型语言模型的最新进展引发了人们对能够解决复杂现实任务的 AI 智能体的广泛兴趣。然而,大多数现有的智能体系统依赖于人工设计的配置,这些配置在部署后保持静态,限制了其在动态和不断演化的环境中进行适应的能力。为此,近期研...
【第465期】AI如何“心算”:隐性推理三大范式 07.01.2026 15:18
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Implicit Reasoning in Large Language Models: A Comprehensive Survey Summary 大型语言模型(LLMs)已经在广泛任务上展现出强大的泛化能力。利用 LLMs 进行推理对于解决多步骤问题和复杂决策至关重要。为了支持高效推理,近期研究已从显式的思维链提示转向隐式推理,在隐式推理中,推理过程...
【第464期】视觉故事写作:可视化编辑叙事文本 06.01.2026 17:20
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Visual Story-Writing: Writing by Manipulating Visual Representations of Stories Summary 我们将“视觉化故事写作”定义为:利用故事要素的视觉表示来支持叙事文本的写作与修改。 为展示这一方法,我们开发了一款文本编辑器,能够自动将实体之间的交互关系、实体在不同地点之间的移动,以及...
【第463期】(NVIDIA)UDR:AI研究告别黑箱_人类制定策略 05.01.2026 13:52
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Universal Deep Research: Bring Your Own Model and Strategy Summary 深度研究工具是当今最具影响力、也最为常见的代理型系统之一。 然而,我们观察到,迄今为止提出的每一种深度研究代理都被硬编码为执行某一种特定的研究策略,并且使用的是固定的一组工具。 我们提出了通用深度研究(Unive...
【第462期】Fhevm:全同态加密机密智能合约协议 04.01.2026 15:18
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Fhevm: A cross-chain protocol for confidential smart contracts Summary Zama 的 fhEVM 是一种跨链协议,利用全同态加密(Fully Homomorphic Encryption,FHE)在任何 L1 和 L2 上实现机密智能合约。它为链上应用提供端到端加密,在保证机密性与隐私性的同时,仍然保持完全的可组合性、可验...
【第461期】AI科学家如何独立完成颠覆性科研发现 03.01.2026 20:48
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: From AI for Science to Agentic Science: A Survey on Autonomous Scientific Discovery Summary 人工智能(AI)正在重塑科学发现的方式,其角色正从专用的计算工具演进为自主的科研合作伙伴。我们将 Agentic Science(具身智能科学/代理型科学) 定位为“科学中的人工智能(AI for Science)”...
【第460期】Memento:无须微调大模型的LLM智能体记忆学习范式 02.01.2026 19:07
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Memento: Fine-tuning LLM Agents without Fine-tuning LLMs Summary 本文提出了一种用于自适应大型语言模型(LLM)智能体的全新学习范式,该范式无需对底层 LLM 进行微调。现有方法往往存在两类局限:要么依赖静态、人工设计的反思工作流,灵活性不足;要么计算成本高昂,需要对 LLM 模型参数...
【第459期】Anemoi:基于A2A通信的半中心化多智能体系统 01.01.2026 20:00
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Anemoi: A Semi-Centralized Multi-agent System Based on Agent-to-Agent Communication MCP server from Coral Protocol Summary 近年来,通用型多智能体系统(Multi-Agent Systems,MAS)的研究进展主要遵循“上下文工程 + 集中式”的范式,即由一个规划智能体通过单向提示传递来协调多个执行...
【第458期】OPENCUA:开放式计算机使用代理框架 31.12.2025 18:54
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: OPENCUA: Open Foundations for Computer-Use Agents Summary 视觉—语言模型已展示出作为计算机使用代理(Computer-Use Agents,CUAs)的卓越能力,能够自动化完成多种计算机任务。随着其商业潜力不断提升,最先进的 CUA 系统的关键技术细节仍然处于封闭状态。鉴于这类代理将日益在数字交互中...
【第457期】清华智谱破壁AI操作电脑三大难题 30.12.2025 18:11
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents Summary 我们提出了 ComputerRL——一个面向自主桌面智能的框架,使智能体能够熟练地操作复杂的数字化工作空间。ComputerRL 引入了 API-GUI 范式,将程序化的 API 调用与直接的 GUI 交互统一起来,从而解...
【第456期】OPPO如何用“智能体链”打败GPT-4 29.12.2025 18:04
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL Summary 近年来,大型语言模型(LLM)和多智能体系统的快速发展,已在深度研究、氛围式编程(vibe coding)以及数学推理等复杂问题求解任务中展现出卓越能力。然而,现有的大多数多智能体系...
【第455期】A1:大语言模型驱动的智能合约漏洞利用系统 28.12.2025 17:18
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: AI Agent Smart Contract Exploit Generation Summary 智能合约漏洞已造成数十亿美元的损失,但发现可实际利用的攻击仍然极具挑战性。传统模糊测试工具依赖僵化的启发式规则,难以应对复杂攻击;而人工审计虽然细致,却效率低下且难以规模化。大型语言模型(LLM)提供了一种颇具潜力的折中方案...
【第454期】面向盈利漏洞的智能合约模糊测试 27.12.2025 18:08
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Smart Contract Fuzzing Towards Profitable Vulnerabilities Summary 数十亿美元通过智能合约进行交易,使得漏洞成为重大的金融风险。在安全攻防竞赛中,一个重要焦点是攻击者可以加以利用的高收益漏洞。模糊测试(Fuzzing)是识别此类漏洞的关键方法。然而,现有解决方案主要面临两方面的限...
【第453期】虚拟智能体经济体的构建与治理 26.12.2025 17:24
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Virtual Agent Economies Summary 自主型 AI 智能体的快速采用正在催生一个新的经济层面,在这一层面中,智能体以超出人类直接监督能力的规模和速度进行交易与协作。我们提出“沙盒经济”(sandbox economy)这一框架,用以分析这一新兴系统,并从两个关键维度对其进行刻画:其起源(自发涌现型...
【第452期】OpenAI:语言模型产生幻觉的统计根源 25.12.2025 15:33
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Why Language Models Hallucinate Summary 就像学生在面对困难的考试题目时一样,大型语言模型在不确定时有时会进行猜测,生成看似合理但实际上错误的陈述,而不是承认自身的不确定性。即便在最先进的系统中,这类“幻觉”现象仍然存在,并削弱了人们对模型的信任。我们认为,语言模型之所以会产...
【第451期】AI有了外置记忆体如何持续进化 24.12.2025 18:46
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Memento: Fine-tuning LLM Agents without Fine-tuning LLMs Summary 该文本介绍了一种名为 Memento 的新型学习范式,它旨在实现 自适应大型语言模型(LLM)代理的持续学习,而无需对底层 LLM 进行成本高昂的微调。 Memento 将代理形式化为 记忆增强型马尔可夫决策过程(M-MDP),利用情节记忆...
【第450期】OPPO智能体链:用低成本造出超级AI 23.12.2025 19:32
Seventy3:借助NotebookLM的能力进行论文解读,专注人工智能、大模型、机器人算法、crypto方向,让大家跟着AI一起进步。 今天的主题是: Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL Summary 该文本摘录自一篇关于**“Chain-of-Agents” (CoA)** 的研究论文,这是一种新型的大型语言模型 (LLM) 推理范式,旨在将多智能体系统的复杂问题解决能力整合到一个模型中。作者提出了...
Similar podcasts
Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.