RayHu

AI智识录

Leisure ZH ↓ 115 episodes

在科技技术狂奔的时代,有一些文章如同行业的 “思想灯塔”—— 它们不沉迷于复杂公式,却能戳中技术演进范式的核心;不追逐短期热点,却能影响数年甚至数十年的研发方向。《AI智识录》,就是为你打捞这些 “AI 领域最新智识” 的播客阵地。不必再对着长文屏幕费力精读,通勤路上、午后小憩时,打开《AI智识录》,让清晰的 AI 主播带你走进 AI 技术的 “思想原典”—— 这里没有碎片化的信息堆砌,只有经得起时间检验的深度认知;没有跟风的观点喧嚣,只有能帮你看懂技术本质的底层逻辑。订阅《AI智识录》,用耳朵 翻阅”AI 行业的 思想年轮,抓住那些真正决定未来的核心智识。本节目由:https://younavi.me 赞助播出

Author

RayHu

Category

Leisure

Podcast website

www.xiaoyuzhoufm.com

Latest episode

Jul 8, 2026

Where to listen?

Podcasts in the app Replaio Radio Coming soon

Podcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts

Get it on Google Play Install for free Android 5M+ downloads · 4.8 rating iOS soon

Episodes

2026 AGI-Next 前沿峰会 | 张钹院士:迈向通用人工智能 14.01.2026

嘉宾介绍:张钹院士是中国人工智能领域奠基者,中国科学院院士,清华大学计算机系教授、人工智能研究院名誉院长。他推动了中国 AI 领域多个 “第一”—— 发表国内首篇 AI 国际论文、创立首个智能机器人实验室、组建首个 AI 国家重点实验室。他曾获人工智能吴文俊最高成就奖、CCF 终身成就奖等重要荣誉,培养了大批 AI 领域顶尖人才,耄耋之年仍深耕科研一线,引领中国 AI 从跟跑迈向并跑、领跑。 在2026 AGI-Next 前沿峰会的压轴演讲...

2026 AGI-Next 前沿峰会 | Qwen技术负责人林俊旸:Towards a Generalist Agent 14.01.2026

在2026 AGI-Next前沿峰会上,Qwen技术负责人林俊旸讲述了阿里Qwen团队在2025年的最新进展,重点介绍了其通用代理(Generalist Agent)的愿景。团队致力于多模态基础模型,旨在提升语言、视觉和音频的理解与生成能力,并通过开源策略推动技术普及和应用。 通用代理的演进 从模型到代理的理念转变 * 将模型视为工具使用者,强调其自主利用工具的能力,类似于人类与动物的区别 * 训练范式从监督学习转向强化学习,通过推理和评估驱动...

2026 AGI-Next 前沿峰会 | 月之暗面杨植麟:Kimi K2的Scaling实践 14.01.2026

在2026 AGI Next 前沿峰会的演讲中,月之暗面(Moonshot AI)创始人兼 CEO 杨植麟深度剖析了 Kimi 模型背后的技术演进与哲学思考: * 他重申 Scaling Law是大模型发展的第一性原理,本质上是将能源高效转化为智能的过程。 * 演讲的核心亮点在于对模型架构与 Agent 智能关系的拆解。杨植麟指出,Transformer 架构之所以取代 LSTM 成为主流,关键在于其在 长上下文(Long Context) 任务中展现出的低位置损失(Position Loss),这正...

腾讯姚顺雨、Qwen林俊旸、智谱唐杰的AGI-Next圆桌对话, 2026 12.01.2026

2026年1月10日在中关村国际创新中心举行的AGI-Next 闭门峰会汇集了中国 AI 行业全明星阵容(三场报告分别来自智谱唐杰、月之暗面杨植麟、Qwen 林俊旸;一场圆桌:智谱唐杰、港科大杨强教授、Qwen林俊旸、腾讯姚顺雨) 以下为其中圆桌讨论的录音内容,主要讨论了四个核心问题:分化、范式、Agent、中国AI的胜算 圆桌嘉宾 * 唐杰:清华大学计算机系教授,智谱AI首席科学家/创始人 * 杨强:前港科大学计算机系主任,加拿大工程院 / 皇...

Thariq Shihipar:官方解构 Claude Agent SDK内核 07.01.2026

在过去的一年中,Anthropic 的 Claude Code 可以算是首个真正意义上被广泛应用的 Agent 产品,它能够自主构建上下文、决策执行路径并在长达数十分钟的交互中持续工作,并且不单单只能完成Coding工作。基于构建与运营 Claude Code 的经验,Anthropic 推出了 Claude Agent SDK。这个SDK 并非一个简单的工具集,而是一套完整的、观点鲜明的 Agent 构建套件,它封装了模型、工具、提示工程、文件系统交互、技能(Skills)和安全沙箱等...

知名AI教育家Sebastian Raschka的2025 年大语言模型发展报告 31.12.2025

知名AI专家、《从零开始构建大语言模型》作者Sebastian Raschka博士的2025年度回顾。文章深入剖析了这一年大语言模型领域的重大突破:DeepSeek R1开启推理模型新纪元,RLVR与GRPO技术革新训练范式,顶尖模型训练成本降至500万美元级别。作者系统梳理了从RLHF到GRPO的技术演进路径,探讨了基准测试困境、AI与人类协作的平衡之道,并预测2026年RLVR将扩展至更多领域、推理时扩展成为关键。文章不仅涵盖技术前沿,更分享了作者作为独...

吴恩达的2025年度AI学习建议&AI行业回顾 30.12.2025

以下内容是吴恩达(Andrew Ng)在deeplearning.ai《The Batch》周刊特别版的全文翻译,内容涵盖了对 AI 学习的建议以及对 2025 年 AI 行业重大事件的回顾。 原文:https://www.deeplearning.ai/the-batch/issue-333/ 在小宇宙查看该单集文稿

英伟达机器人主管Jim Fan的2025年度具身智能总结 29.12.2025

英伟达机器人主管Jim Fan近日在X上对2025年具身智能行业的工作做了年度回顾,表达了机器人领域仍处于蛮荒时代、当前机器人硬件可靠性不足,反而限制了软件的迭代速度,以及主流的VLM→VLA技术范式本身也存在结构性问题等观点。 原文链接:https://x.com/DrJimFan/status/2005340845055340558 以下是全文: 所有人都在为“氛围编码”(vibe coding)而疯狂。趁着节日气氛,也请允许我分享一下我对机器人这个“西部荒野”领域的焦虑。以下...

Google AI的2025年度回顾 24.12.2025

Google官方博客在12月23日更新了2025年的整体回顾,由首席科学家Jeff Dean和DeedMind CEO Demis Hassabis共同执笔。 原文链接:https://blog.google/technology/ai/2025-research-breakthroughs/#ai-models 以下是全文翻译 Google 2025年度回顾:8大领域的研究突破 这一年是 AI 智能体、推理能力和科学发现突飞猛进的一年。 2025年是研究领域取得非凡进展的一年。随着人工智能的发展,我们看到它的轨迹正从一种“工具”转变为一种“公...

Jeff Dean、Noam Shazeer等Google AI 核心人物对谈, 2025 22.12.2025

本次分享内容来自Gemini 3 Flash模型发布后的2025年12月19日,Google AI的几位核心人物——DeepMind研究副总裁Oriol Vinyals、谷歌首席科学家Jeff Dean和Noam Shazeer,以及Google AI Studio产品负责人Logan Kilpatrick的一次同台对谈。地址:x.com 主要内容: 1. Gemini 项目的起源与团队融合 * 统一战线: Jeff Dean 提到 Gemini 起源于对 Google 内部资源碎片化的观察。为了集中算力和顶尖人才,Google 将原有的 Brain 团队和 Dee...

Andrej Karpathy:LLM的2025 年度盘点 20.12.2025

本次内容是Andrej Karpathy对2025年AI行业的年度盘点。 原文地址:https://karpathy.bearblog.dev/year-in-review-2025/ 主要内容: 可验证奖励的强化学习(RLVR) 「召唤幽灵」vs「培育动物」/ 参差不齐的智能 :探讨了即使在所有基准测试都表现出色,也可能未实现 AGI 的情况。 Cursor / LLM 应用的新层级 Claude Code / 住在你电脑里的 AI 氛围编程(Vibe Coding) Nano Banana / LLM 的图形界面 插图: 在小宇宙查看该单集文稿

逆向工程拆解ChatGPT的记忆功能,Manthan Gupta 2025 17.12.2025

看到一位印度的AI工程师Manthan Gupta 通过逆向工程拆解了 ChatGPT 的记忆功能。(原文地址:manthanguptaa.in ) 你会发现大道至简,作为大家公认实现得相对较好的记忆系统,ChatGPT没有用 RAG,而且就几层大家都能想到的信息一起输入: 1.会话元数据:时间、设备、是否付费、活跃度等等 2.当前会话窗口的最新会话和所有历史会话记录(超 token 限制的话截断) 3.跨会话窗口的 15 条左右历史会话摘要,只总结用户提问,不总结模型...

Sam Altman写于OpenAI成立十周年的公开信:Ten Years, 2025 12.12.2025

OpenAI成立十周年之际,Sam Altman 写了一封公开信《 Ten Years 》 原文链接:https://openai.com/index/ten-years/ 在小宇宙查看该单集文稿

Manus关于Agent上下文工程的实践经验分享, 2025 10.12.2025

Manus一直是我们构建AI Agent道路上的好老师,2025年10月Manus的首席科学家Peak Ji(季逸超)和LangChain的创始工程师Lance之间进行了一次深度交流,他们系统性地梳理了上下文工程的核心概念、主流技术框架,并深入分享了Manus AI在构建生产级AI Agent 过程中的前沿实践、创新方法和核心开发哲学。 完整视频链接:bilibili.com 核心要点 * 上下文工程是为解决AI Agent在长时间自主运行中产生的“上下文爆炸”和“上下文腐烂”问题而生...

Claude官方对prompts、Skills、Projects、MCP等概念的辨析, 2025 10.12.2025

从prompt工程、到MCP、到Context 工程、再到最近的subagents和claude skills,这两年AI工程领域的新词新概念频出,有时候不反应一下都不知道对方跟自己在聊的是不是同一件事、同一个概念。 Anthropic(Claude)官方11月出炉的长文:《Skills explained: How Skills compares to prompts, Projects, MCP, and subagents》,可以说非常系统明白地解释了上面提到的大部分概念。 原文链接:claude.com 要点 * 五大组件:Claude的生态系...

DeepMind 联合创始人Demis Hassabis最新访谈:AGI、Gemini 3与AI的未来, 2025 09.12.2025

Google DeepMind 的联合创始人兼 CEO 戴米斯·哈萨比斯(Demis Hassabis)在12月初在旧金山 Axios AI 峰会上进行了一场深度访谈。作为刚刚获得诺贝尔奖的 AI 先驱,他对 AI 的现状、未来以及那些令人兴奋或担忧的议题,有着非常独特的见解。 访谈链接:https://www.youtube.com/watch?v=tDSDR7QILLg 本集内容是基于他核心观点的总结阐述。 在小宇宙查看该单集文稿

DeepSeek 稀疏注意力机制 (NSA & DSA),2025 03.12.2025

了解大模型行业的人应该知道,作为现代LLM基石的Transformer架构,其核心自注意力(Self-Attention)机制的计算复杂度与输入token序列长度(L)呈二次方关系(O(L²)),这构成了严峻的计算和显存瓶颈。当token序列长度加倍时,计算量和显存需求会增长约四倍,极大地限制了模型能够有效处理的上下文长度,成为制约技术发展的关键痛点。 DeepSeek最近发布了最新的V3.2模型及其技术报告,其中有一个非常值得关注的点在于他们将稀疏注...

DeepSeekMath-V2:第一个开源的IMO金牌模型, 2025 28.11.2025

本次将为大家介绍的是 DeepSeek 团队最新开源的数学推理模型 DeepSeekMath-V2。该模型并非浅尝辄止之作,而是参数规模达 6850 亿的超大模型,其核心优势在于具备可自验证的数学推理能力,在复杂逻辑推导领域展现出突破性表现。​ 在性能验证方面,DeepSeekMath-V2 的表现堪称卓越:其在 2025 年国际数学奥林匹克竞赛(IMO 2025)与 2024 年中国数学奥林匹克竞赛(CMO 2024)中均达成金牌级表现。尤为值得关注的是,在难度极高的 202...

NeurIPS 2025最佳论文解读 27.11.2025

NeurIPS 2025 官方博客发布了2025年最佳论文奖(Best Paper Awards)公告。今年共有 7 篇获奖论文,其中包括 4 篇最佳论文(Best Papers,含一篇数据集与基准测试赛道)和 3 篇亚军论文(Runner-ups)。这些论文涵盖了扩散模型理论、自监督强化学习、大语言模型(LLM)的注意力机制、推理能力、在线学习理论、神经缩放定律(Neural Scaling Laws)以及语言模型多样性的基准测试等前沿领域。 原文链接:blog.neurips.cc 最佳论文奖...

Ilya Sutskever:从规模化时代迈向研究时代, 2025 26.11.2025

OpenAI前首席科学家Ilya Sutskever最新访谈(Ilya Sutskever – We're moving from the age of scaling to the age of research,www.youtube.com ) llya认为,AI行业正经历一个关键的转折点,即从依赖资源投入的“规模化时代”回归到寻求根本性创新的“研究时代”。他强调,解决AI的泛化能力不足是当前最核心的挑战,并提出了对未来超级智能形态、安全对齐策略以及行业发展路径的深刻见解。 关键要点 * 行业范式转变: 人工智能行业正...

Llion Jones:“我发明了Transformer,现在我正在取代它”, 2025 26.11.2025

Transformer架构的共同发明者之一 Llion Jones 近期接受了一次访谈( "I Invented the Transformer. Now I'm Replacing It." , www.youtube.com ),他在访谈中明确表达了对该技术领域过度饱和及整个行业可能陷入局部最优陷阱的担忧。当前AI社区对Transformer架构的过度专注,类似于其诞生前RNN时代对渐进式改良的痴迷,这种现象被称为“技术捕获”,它在商业和学术压力下严重侵蚀了研究的自由度,不利于颠覆性创新的产生。 作为回...

Google Research:让大模型拥有类人记忆的新架构(Nested Learning),2025 25.11.2025

Google Research团队在11月7日发表了一篇论文《Nested Learning: The Illusion of Deep Learning Architectures》(《嵌套学习:深度学习架构的幻象》,点击左下角“阅读原文”可获取原文)论文指出了当前的大型语言模型(LLM)所面临的一个根本性缺陷:模型的“静态性”。在预训练完成后,这些模型的知识库就被固化了,除了能在有限的“上下文窗口”内处理短期信息外,它们无法持续获取新知识,也无法形成新的长期记忆。这一现象被形象...

Andrej Karpathy:凡是能被“验证”的,终将被自动化, 2025 17.11.2025

今天的内容来自Andrej Karpathy在2025年11月17日发布在X上的文章,内容可以看作是对他2017年那篇《Software2.0》的进一步阐述。 原文链接:x.com 以下是原文翻译: 想跟大家聊聊最近一个关于 AI 对经济影响的挺有意思的讨论。 大家常听到有人把 AI 比作电力啊、工业革命之类的。但在我看来,最恰当的比喻其实是把 AI 看作一种全新的计算范式——也就是所谓的“软件 2.0”(Software 2.0)。为啥呢?因为说到底,这两者本质上都是在解决...

Google DeepMind发布AlphaProof:基于强化学习的奥林匹克级形式化数学推理, 2025 13.11.2025

谷歌DeepMind的IMO金牌模型最近首次详细公开了背后的技术架构和训练方法的论文:《Olympiad-level formal mathematical reasoning with reinforcement learning》,论文中的模型延续DeepMind的命名传统,这次叫:AlphaProof 论文地址:www.nature.com 作者Tom Zahavy也趁此机会分享了一些开发过程中的细节。这里有个有意思的地方:AlphaProof团队规模并不大,大部分时间里只有大约10个人,临近IMO比赛时才有更多人加入。真正带来突破...

李飞飞:从文字到世界,空间智能是AI的下一个前沿, 2025 11.11.2025

今天我们来聊聊ImageNet发起人、去年刚刚创办名为WorldLabs的空间智能创业公司的李飞飞教授在2025年11月10日的最新文章:《从文字到世界:空间智能是AI的下一个前沿》,这篇文章已经发布就引起了硅谷的热议。 文章里,李飞飞不仅提出了“真正具有空间智能的世界模型”必须具备的三个核心能力: * 生成(Generative):能创造遵守物理定律、空间一致的世界; * 多模态(Multimodal):能处理从图像、视频到动作的多模态输入; * 交互...

Listen to the AI智识录 podcast in Replaio

Radio and podcasts in one app - free, with no sign-up. Install today and do not miss the launch

Get it on Google Play

Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.