BestBlogs.dev

BestBlogs

BestBlogs 早报音频版,精选 AI、技术、产品、设计与商业科技领域值得关注的高质量内容,陪你每天从真正重要的信息开始。

Author

BestBlogs.dev

Category

Technology

Podcast website

www.xiaoyuzhoufm.com

Latest episode

Jul 11, 2026

Where to listen?

Podcasts in the app Replaio Radio Coming soon

Podcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts

Get it on Google Play Install for free Android 5M+ downloads · 4.8 rating iOS soon

Episodes

EP70 · Claude Code 路径、RL 炼模型、工程师蜕变 · 05-28 早报 27.05.2026

精讲一:Anthropic 设计负责人谈 Claude Code:一年拿下 51% 市场份额的产品路径 [视频] 来自 Product School Anthropic 设计负责人 Megan 揭秘:Claude Code 从 12 人 CLI 实验起步,首年拿下 51% 市场份额、$25 亿收入。背后是 AI 原生组织基因——流动 Pod(设计师写生产代码、工程师做 UX 决策)、用运行时行为替代 PRD 做质量门控、Bottom-up 企业采用而非自上而下销售。核心度量从 Token 用量转向用户留存与管道营收,管理层须...

EP69 · 约束 Claude、AgentScope 工程化、上下文卸载 · 05-27 早报 26.05.2026

精讲一:我们如何在多个产品中约束 Claude 来自 Anthropic Engineering Anthropic 首度披露跨产品约束 Claude 的三种工程架构(临时容器 / HITL 沙盒 / 可信工作空间),并揭示关键教训:93% 的权限弹窗被无脑通过,自建代理层是最薄弱环节。核心结论:随 Agent 能力膨胀,靠环境隔离压缩爆炸半径比依赖人工审批更可靠。 精讲二:从透明开发到系统工程:AgentScope 2.0 发布 来自 通义大模型 AgentScope 2.0 从「可见调试」升级为...

EP68 · Claude Code 实践、AI 悖论、百川造医生 · 05-26 早报 26.05.2026

精讲一:Anthropic 内部如何使用 Claude Code:HTML 规格说明、让模型来采访你,以及智能体原生 DOM 验证框架 [视频] 来自 Claude Anthropic Applied AI 架构师 Ara 分享三项反直觉内部实践:① 规格说明从 Markdown 升级为 HTML,提供视觉可检查的结构化基线,避免长上下文代理走偏;② 借鉴《The Bitter Lesson》——让 Claude 用 ask_user_question 主持需求采访,而非人工填写约束;③ 组件主动向 DOM 发布数据契约,Playwright MCP...

EP67 · FDE 驻场大战、Claude 养成揭秘、超级个体破局 · 05-25 早报 24.05.2026

精讲一:脉搏:前场部署工程师再度火热 来自 The Pragmatic Engineer Google 把 FDE 面试从「4-6 轮数周」压缩到「2 天 2 轮」,OpenAI 以 40 亿美元成立独立部署公司(并收购了 150 名 FDE 的 Tomoro),Anthropic 跟进建立同类架构。The Pragmatic Engineer 深度解析:FDE 正从工程师演变为「驻场顾问」,外包化意味着这批人将无缘 OpenAI/Anthropic 股权。更大的信号:AI 的商业竞争主战场已从模型训练转移到企业落地。 精讲二...

EP66 · Claude 护网万漏、快模型慢工程、Skill 反直觉 · 05-24 早报 23.05.2026

精讲一:Claude Mythos 护网计划:一月发现超 1 万个高危漏洞 来自 Anthropic Research Anthropic 联合约 50 家合作伙伴,用 Claude Mythos Preview 在一个月内发现超过 10,000 个高危或严重漏洞——Cloudflare 一家就找到 2,000 个,假阳率低于人工测试员。开源代码扫描超 1,000 个项目,估算 6,202 个高危漏洞。修补瓶颈已从「发现」转移到「修补」:安全 patch 的生产速度正在超过人类的核查与部署能力。 精讲二:快模型需要慢开...

EP65 · Agent 架构分叉、Notion 重新创业、GLM-5.1 · 05-23 早报 23.05.2026

精讲一:AI 智能体的未来:展望 Interrupt 2027 [视频] 来自 LangChain LangChain 在 Interrupt 2027 主题演讲中点名 Agent 生产分裂为两类:长时程知识 Agent(运行数分钟乃至数天,需要沙箱与多 Agent 协调)和亚秒延迟的客户体验 Agent(原生语音、实时交互)。同步发布 Langsmith Fleet——领域专家无需写代码即可用自然语言构建 Agent,内置 200+ 集成、7500 个长尾工具,内测结果显示商机合格率提升 240%、每位 AE 每月节省 40...

EP64 · Agent 记忆原语、Qwen3 基座突围、评委即未来 · 05-22 早报 21.05.2026

精讲一:用于自学习自主 Agents 的 Memory 与 Dreaming [视频] 来自 Claude Anthropic 工程师 Ravi 首次公开「Memory」与「Dreaming」两项平台原语:Memory 把 Agent 经验建模为虚拟文件系统,让 Agent 跨会话保留知识并通过乐观并发控制安全共享;Dreaming 则在后台异步整合碎片记忆、消除多 Agent 团队的重复学习。企业案例惊人——Rakuten 首次执行错误率下降 97%。这是 Anthropic 在「长程自主智能体」上迄今最具体的架构路径。...

EP63 · OpenAI 攻克 Erdős、Claude Code Routines 上云 · 05-21 早报 20.05.2026

精讲一:Erdős 突破:OpenAI 模型首次实现重大 AI 数学发现 [视频] 来自 OpenAI OpenAI 模型首次自主攻克了一个组合几何里的开放难题,被研究团队描述为 AI 从「辅助验证」跨向「原创发现」的分水岭。这道几何问题表面平凡、内部极为精细,需要在数千个微小战术决策之间做穿透式搜索;模型借助代数数论的结构性工具,找到了人类一直认为已是最优的构造之外的更优解。团队最初看到输出时连续几天反复核验,认为「太美好以至于不真实...

EP62 · Google I/O 2026 / Karpathy 加入 Anthropic · 05.20 早报 20.05.2026

今日精讲 Google I/O 2026 开发者主题演讲全览 Google I/O 2026 把过去一年的 AI 押在「智能体」上:Gemini 3.5 系列模型登场,Antigravity 2.0 和全新 Antigravity CLI 让一个开发者就能调度多个子智能体并发处理工作流,内建跨平台终端沙箱、凭据掩码与 Git 策略;Android CLI 把 Android Studio 的能力封装成任意 LLM 都能调用的工具,WebMCP(Chrome 149 起 Origin Trial)让浏览器内智能体直接消费网页结构化能力。比起任何一...

EP61 · Composer 2.5 / 长时间 Agent / AI 生码率 · 05.19 早报 19.05.2026

今日精讲 Cursor 发布 Composer 2.5:基于 Kimi K2.5 的智能升级 Cursor 发布 Composer 2.5,基于 Moonshot Kimi K2.5 开源 checkpoint,引入 textual feedback RL(在 rollout 关键节点插入文本提示作教师信号)+ 25 倍合成任务规模。新模型显著提升长任务持续工作能力和指令遵循度,价格 0.50/2.50 美元每 M token,首周双倍额度。同时联合 SpaceXAI 用 Colossus 2 训练新一代模型 —— 交付节奏正在从产品迭代切换到模型迭代。 来...

P60 · AI 原生初创 / 资深工程师 LLM · 05.18 早报 18.05.2026

今日精讲 创始人手册:打造 AI 原生初创公司 Anthropic 官方从四个阶段(构思、MVP、发布、扩展)重构了 2026 年的创业方法论,宝玉翻译并补充了中文读者视角的注解。核心论点:创始人角色已从「写代码的工程师」转变为「AI 智能体的指挥家」,没有技术背景的人也能发布生产级软件,10 人估值超 10 亿美元的精益独角兽已从传说变为常规操作。文章在每个阶段给出可操作的工具栈(Claude Chat / Cowork / Code)和具体策略,是 2026...

EP59 · ChatGPT 理财 / 智能体控制平面 / 新时代的产品 · 05.17 早报 16.05.2026

今日精讲 ChatGPT 中的全新个人理财体验 OpenAI 面向美国 Pro 用户推出 ChatGPT 个人理财功能:通过 Plaid 安全连接超过 1.2 万家金融机构,自动分类支出并生成可视化仪表盘,涵盖投资组合表现、订阅和待付账单。每月已有逾 2 亿人用 ChatGPT 咨询预算和投资;配合 GPT‑5.5 的推理能力,这次更新将通用建议升级为基于真实账户的个性化财务规划。这是 OpenAI 迄今最明确地向高信任垂直领域进军的一步,也是 ChatGPT 从对话工具向「...

EP58 · AI 思考伙伴 / Abridge 医疗智能层 · Imagen 2.0 · 05.16 早报 15.05.2026

今日精讲 将 AI 用作大规模工程系统的思考伙伴 Google 高级 Staff 工程师 Julie Qiu 在 InfoQ 分享:她带的 gcloud CLI 团队要维护九种语言的客户端库,是个跨多仓库、多语言的复杂工程系统。她把 AI 当成一个能问问题、能一起做实验的伙伴,分三步:先读懂系统、再做实验,最后重新设计。最有用的不是让 AI 写代码,而是把每次「我应该这样改吗」的犹豫时间,从几天压到几小时。一份真正在用 AI 做事的资深工程师实操总结。 来自...

BestBlogs 周刊第 95 期:Agent 工程化的全面落地 15.05.2026

本周亮点 本周没有顶级模型发布,但 Anthropic、OpenAI、阿里、腾讯、淘宝、Kimi 同时把 Agent 真正推向生产。Coding 工具走出 IDE 走向整个计算机、Computer Use 工程化、Windows 沙箱、Agent Skill 开放标准;国内多智能体 Harness 三连发(Kimi×TiDB / 腾讯 / 阿里 Java 1.1);阿里继续追问 AI Native 时代研发组织该往哪走。 时间线 00:00 开场 · 本期主题 + BestBlogs 三步引导 / 邀请 / 老用户赠送 01:41 主题一 · Coding...

EP57 · Claude Code 最佳实践 / GPT-Realtime-2 · 05.15 早报 14.05.2026

BestBlogs Pro 早鸟内测开放:你可以自定义订阅源、配置兴趣标签,每天获得一份属于自己的头条早报。欢迎抢先体验,并把反馈发回给我们:https://bestblogs.dev 今日精讲 Claude Code 在大型代码库中的运作方式:最佳实践与入门指南 | Claude Anthropic 官方深度指南,面向百万行级大型代码库。核心洞察:「Harness 和模型同等重要」——五大扩展点(CLAUDE.md / Hooks / Skills / Plugins / MCP)加上 LSP 与子智能体共同决定实际表...

EP56 · Claude Agent 实战 / Codex 沙箱 · 05.14 早报 13.05.2026

今日精讲 使用 Claude 进行计算机和浏览器操作的最佳实践 Anthropic 针对 Claude 4.6 / Opus 4.7 发布权威最佳实践:点击不准的根本原因是截图超过 API 内部尺寸上限后被静默下采样导致坐标系偏移,解法是发送前主动将截图缩放到 1280×720(Opus 4.7 建议 1080p)。全文覆盖安全架构(必须使用专用虚拟机、绝不暴露敏感主机数据)、Browser Use 与 Computer Use 的场景取舍,以及 Agent 循环中人工确认门控的设计原则,是构建任何...

EP55 · 什么是代码 / ADK 长时间 Agent / Codex Computer Use · 05.13 早报 12.05.2026

今日精讲 什么是代码? Unmesh Joshi(Thoughtworks 首席工程师、《Patterns of Distributed Systems》作者)在 LLM 时代重新追问:代码究竟是什么?他的答案:代码同时承载两个使命——给机器的指令(正在被 LLM 商品化),以及问题域的概念模型(这是真正难以被替代的价值)。当 LLM 将语法生成商品化,稀缺技能从「会写代码」转向「构建精准词汇表和共享理解」。这与 DDD 的「通用语言」和有界上下文一脉相承——在 AI 时代,开发者...

EP54 ·Claude Code 智能体视图上线 / OpenAI 成立部署公司· 05.12 早报 12.05.2026

今日精讲 Claude Code 中的智能体视图 | Claude Claude Code 今日推出「智能体视图」,一块面板统览所有并行会话——哪些在等你决策、哪些仍在运行、哪些已完成。左箭头进入,回复后自动继续,不再需要切换终端标签或 tmux 格子。早期用户最常见的模式:批量下发多个任务配合 skill,等一批 PR 同时就绪再集中审查。以研究预览形式上线 Pro / Max / Team / Enterprise 计划。 来自 Claude Blog OpenAI 推出 OpenAI 部署公司,助力企...

EP54 · Incorruptible / Agent 持久化 / TTS 架构变革 · 05.11 早报 11.05.2026

今日精讲 如何打造能穿越时代的公司 | Eric Ries,Lean Startup 作者 [视频] Eric Ries(《精益创业》作者)在新书《Incorruptible》中指出,公司赢了之后往往走向衰落——根本原因不是贪婪,而是结构性「财务重力」将组织不断拉向短期利益。他提出三种结构性防腐剂:公益公司(PBC)章程、信任型治理(以 Anthropic 独立受托人守护使命为例),以及基金会控股模式(诺和诺德百年不变的范例)。核心洞察:「更难的路反而更容易」——越...

EP53 · AI Native 组织变革 / Claude Code HTML / 语音 AI · 05.10 早报 09.05.2026

今日精讲 AI Native 时代 —— 研发组织何去何从 阿里技术内部访谈与行业研究的深度复盘。核心论断:AI 不是新工具,而是新协作主体,其无沟通衰减、无限注意力的特性正让「人形约束」下设计的组织原则逐步失效。文章提出 Org Chart → Execution Graph 的范式转变,管理重组成本可从季度级压至周级。对工程师和管理者理解 AI 时代组织演进具有极高参考价值。 来自 阿里技术 使用 Claude Code:HTML 难以置信的奇效 Claude Code 核心...

EP52 · OpenAI Codex 集成 Chrome、记忆与梦想机制 · 05.09 早报 08.05.2026

今日精讲 OpenAI Codex 集成 Chrome:Agent 直接进入用户实时浏览器会话 [视频] OpenAI 推出 Codex 的 Chrome 扩展,让 Agent 直接进入用户实时浏览器会话,共享 profile、cookies 和登录态。三大新能力:平行扫描多 tab 汇总信息、自建 Tab Group 在后台滚动推理不打扰用户、用代码执行控制浏览器,告别 screenshot-reason-mouse 循环。演示中 Codex 跨邮箱搜索差旅收据后自动填写报销表单,还能在多 tab 里 spawn 子 Agent 协作...

BestBlogs 第 94 期:语音 AI 突围 08.05.2026

本期内容 00:00 开场:本周关键词「声音」 00:37 OpenAI 三个实时语音模型 — GPT Realtime 2、实时翻译、流式转写 02:53 语音 AI 基础设施 — OpenAI 如何大规模交付低延迟语音服务 04:11 ElevenLabs — 四亿美元年收入背后的组织策略与情绪智能方向 05:39 Anthropic 指数增长 — 八十倍年化增速、SpaceX 300MW 算力合作 07:15 Claude 托管智能体三重升级 — 梦境、成果评估、多智能体编排 08:46 Anthropic NLA — 自然语言自编码器,窥...

EP51 · OpenAI 语音模型、Claude Code 工程实践 · 05.08 早报 08.05.2026

今日精讲 通过 API 新模型推进语音智能 OpenAI 同日发布三款语音模型:GPT-Realtime-2 搭载 GPT-5 级推理能力,上下文窗口从 32K 扩展到 128K,Big Bench Audio 准确率 96.6%;GPT-Realtime-Translate 支持 70+ 种输入语言实时翻译为 13 种输出语言;GPT-Realtime-Whisper 提供低延迟流式语音转文字。三款模型标志着语音 AI 从简单对话迈入能听、能想、能做的智能体时代。 来自 OpenAI Blog 脉搏:AI 负载压垮 GitHub——为何其他供...

EP50 · Claude 托管智能体三大新能力与 SpaceX 算力合作 · 05.07 早报 06.05.2026

今日精讲 Claude 托管智能体新功能:梦境、成果评估与多智能体编排 Claude 在托管智能体上推出三项重要更新:梦境(自动复盘历史会话、提炼记忆规律,让智能体在不运行时也能持续自我优化)、成果评估(用户设定评分标准,独立评分器在独立上下文窗口打分并驱动智能体自我修正,内测任务成功率最高提升 10 分)、以及多智能体编排(主智能体拆解任务后分配给专属子智能体并行处理)。Harvey 法律平台完成率提升约 6 倍,Netflix 日...

EP49 · GPT-5.5 Instant / Wilkinson 自治 CEO · 05.06 早报 05.05.2026

今日精讲 GPT-5.5 Instant 全量推送:高风险问答幻觉减少 52.5%,引入记忆来源 OpenAI 把 ChatGPT 默认模型从 GPT-5.3 Instant 升级到 5.5 Instant,今天起全量推送,API 同步上线 chat-latest。在医疗、法律、金融这类高风险问答上,幻觉减少 52.5%;用户曾标记为有挑战的对话,错误陈述减少 37.3%。同步推出记忆来源功能:用户可看见每条回答用了哪些过往对话和文件做个性化,并能删改。Plus 和 Pro 用户优先开通 Gmail 和文件接...

Listen to the BestBlogs podcast in Replaio

Radio and podcasts in one app - free, with no sign-up. Install today and do not miss the launch

Get it on Google Play

Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.