BestBlogs.dev

BestBlogs

BestBlogs 早报音频版,精选 AI、技术、产品、设计与商业科技领域值得关注的高质量内容,陪你每天从真正重要的信息开始。

Autor

BestBlogs.dev

Kategorie

Technology

Web podcastu

www.xiaoyuzhoufm.com

Nejnovější epizoda

11. čvc 2026

Kde poslouchat?

Podcasty v aplikaci Replaio Radio Už brzy

Podcasty míří do aplikace už brzy. Nainstaluj si ji teď a jako první uvidíš úplně nový pohled na podcasty

Stáhnout z Google Play Nainstaluj zdarma Android téměř 10 mil. stažení · hodnocení 4,8 iOS už brzy

Epizody

EP70 · Claude Code 路径、RL 炼模型、工程师蜕变 · 05-28 早报 27.05.2026

精讲一:Anthropic 设计负责人谈 Claude Code:一年拿下 51% 市场份额的产品路径 [视频] 来自 Product School Anthropic 设计负责人 Megan 揭秘:Claude Code 从 12 人 CLI 实验起步,首年拿下 51% 市场份额、$25 亿收入。背后是 AI 原生组织基因——流动 Pod(设计师写生产代码、工程师做 UX 决策)、用运行时行为替代 PRD 做质量门控、Bottom-up 企业采用而非自上而下销售。核心度量从 Token 用量转向用户留存与管道营收,管理层须...

EP69 · 约束 Claude、AgentScope 工程化、上下文卸载 · 05-27 早报 26.05.2026

精讲一:我们如何在多个产品中约束 Claude 来自 Anthropic Engineering Anthropic 首度披露跨产品约束 Claude 的三种工程架构(临时容器 / HITL 沙盒 / 可信工作空间),并揭示关键教训:93% 的权限弹窗被无脑通过,自建代理层是最薄弱环节。核心结论:随 Agent 能力膨胀,靠环境隔离压缩爆炸半径比依赖人工审批更可靠。 精讲二:从透明开发到系统工程:AgentScope 2.0 发布 来自 通义大模型 AgentScope 2.0 从「可见调试」升级为...

EP68 · Claude Code 实践、AI 悖论、百川造医生 · 05-26 早报 26.05.2026

精讲一:Anthropic 内部如何使用 Claude Code:HTML 规格说明、让模型来采访你,以及智能体原生 DOM 验证框架 [视频] 来自 Claude Anthropic Applied AI 架构师 Ara 分享三项反直觉内部实践:① 规格说明从 Markdown 升级为 HTML,提供视觉可检查的结构化基线,避免长上下文代理走偏;② 借鉴《The Bitter Lesson》——让 Claude 用 ask_user_question 主持需求采访,而非人工填写约束;③ 组件主动向 DOM 发布数据契约,Playwright MCP...

EP67 · FDE 驻场大战、Claude 养成揭秘、超级个体破局 · 05-25 早报 24.05.2026

精讲一:脉搏:前场部署工程师再度火热 来自 The Pragmatic Engineer Google 把 FDE 面试从「4-6 轮数周」压缩到「2 天 2 轮」,OpenAI 以 40 亿美元成立独立部署公司(并收购了 150 名 FDE 的 Tomoro),Anthropic 跟进建立同类架构。The Pragmatic Engineer 深度解析:FDE 正从工程师演变为「驻场顾问」,外包化意味着这批人将无缘 OpenAI/Anthropic 股权。更大的信号:AI 的商业竞争主战场已从模型训练转移到企业落地。 精讲二...

EP66 · Claude 护网万漏、快模型慢工程、Skill 反直觉 · 05-24 早报 23.05.2026

精讲一:Claude Mythos 护网计划:一月发现超 1 万个高危漏洞 来自 Anthropic Research Anthropic 联合约 50 家合作伙伴,用 Claude Mythos Preview 在一个月内发现超过 10,000 个高危或严重漏洞——Cloudflare 一家就找到 2,000 个,假阳率低于人工测试员。开源代码扫描超 1,000 个项目,估算 6,202 个高危漏洞。修补瓶颈已从「发现」转移到「修补」:安全 patch 的生产速度正在超过人类的核查与部署能力。 精讲二:快模型需要慢开...

EP65 · Agent 架构分叉、Notion 重新创业、GLM-5.1 · 05-23 早报 23.05.2026

精讲一:AI 智能体的未来:展望 Interrupt 2027 [视频] 来自 LangChain LangChain 在 Interrupt 2027 主题演讲中点名 Agent 生产分裂为两类:长时程知识 Agent(运行数分钟乃至数天,需要沙箱与多 Agent 协调)和亚秒延迟的客户体验 Agent(原生语音、实时交互)。同步发布 Langsmith Fleet——领域专家无需写代码即可用自然语言构建 Agent,内置 200+ 集成、7500 个长尾工具,内测结果显示商机合格率提升 240%、每位 AE 每月节省 40...

EP64 · Agent 记忆原语、Qwen3 基座突围、评委即未来 · 05-22 早报 21.05.2026

精讲一:用于自学习自主 Agents 的 Memory 与 Dreaming [视频] 来自 Claude Anthropic 工程师 Ravi 首次公开「Memory」与「Dreaming」两项平台原语:Memory 把 Agent 经验建模为虚拟文件系统,让 Agent 跨会话保留知识并通过乐观并发控制安全共享;Dreaming 则在后台异步整合碎片记忆、消除多 Agent 团队的重复学习。企业案例惊人——Rakuten 首次执行错误率下降 97%。这是 Anthropic 在「长程自主智能体」上迄今最具体的架构路径。...

EP63 · OpenAI 攻克 Erdős、Claude Code Routines 上云 · 05-21 早报 20.05.2026

精讲一:Erdős 突破:OpenAI 模型首次实现重大 AI 数学发现 [视频] 来自 OpenAI OpenAI 模型首次自主攻克了一个组合几何里的开放难题,被研究团队描述为 AI 从「辅助验证」跨向「原创发现」的分水岭。这道几何问题表面平凡、内部极为精细,需要在数千个微小战术决策之间做穿透式搜索;模型借助代数数论的结构性工具,找到了人类一直认为已是最优的构造之外的更优解。团队最初看到输出时连续几天反复核验,认为「太美好以至于不真实...

EP62 · Google I/O 2026 / Karpathy 加入 Anthropic · 05.20 早报 20.05.2026

今日精讲 Google I/O 2026 开发者主题演讲全览 Google I/O 2026 把过去一年的 AI 押在「智能体」上:Gemini 3.5 系列模型登场,Antigravity 2.0 和全新 Antigravity CLI 让一个开发者就能调度多个子智能体并发处理工作流,内建跨平台终端沙箱、凭据掩码与 Git 策略;Android CLI 把 Android Studio 的能力封装成任意 LLM 都能调用的工具,WebMCP(Chrome 149 起 Origin Trial)让浏览器内智能体直接消费网页结构化能力。比起任何一...

EP61 · Composer 2.5 / 长时间 Agent / AI 生码率 · 05.19 早报 19.05.2026

今日精讲 Cursor 发布 Composer 2.5:基于 Kimi K2.5 的智能升级 Cursor 发布 Composer 2.5,基于 Moonshot Kimi K2.5 开源 checkpoint,引入 textual feedback RL(在 rollout 关键节点插入文本提示作教师信号)+ 25 倍合成任务规模。新模型显著提升长任务持续工作能力和指令遵循度,价格 0.50/2.50 美元每 M token,首周双倍额度。同时联合 SpaceXAI 用 Colossus 2 训练新一代模型 —— 交付节奏正在从产品迭代切换到模型迭代。 来...

P60 · AI 原生初创 / 资深工程师 LLM · 05.18 早报 18.05.2026

今日精讲 创始人手册:打造 AI 原生初创公司 Anthropic 官方从四个阶段(构思、MVP、发布、扩展)重构了 2026 年的创业方法论,宝玉翻译并补充了中文读者视角的注解。核心论点:创始人角色已从「写代码的工程师」转变为「AI 智能体的指挥家」,没有技术背景的人也能发布生产级软件,10 人估值超 10 亿美元的精益独角兽已从传说变为常规操作。文章在每个阶段给出可操作的工具栈(Claude Chat / Cowork / Code)和具体策略,是 2026...

EP59 · ChatGPT 理财 / 智能体控制平面 / 新时代的产品 · 05.17 早报 16.05.2026

今日精讲 ChatGPT 中的全新个人理财体验 OpenAI 面向美国 Pro 用户推出 ChatGPT 个人理财功能:通过 Plaid 安全连接超过 1.2 万家金融机构,自动分类支出并生成可视化仪表盘,涵盖投资组合表现、订阅和待付账单。每月已有逾 2 亿人用 ChatGPT 咨询预算和投资;配合 GPT‑5.5 的推理能力,这次更新将通用建议升级为基于真实账户的个性化财务规划。这是 OpenAI 迄今最明确地向高信任垂直领域进军的一步,也是 ChatGPT 从对话工具向「...

EP58 · AI 思考伙伴 / Abridge 医疗智能层 · Imagen 2.0 · 05.16 早报 15.05.2026

今日精讲 将 AI 用作大规模工程系统的思考伙伴 Google 高级 Staff 工程师 Julie Qiu 在 InfoQ 分享:她带的 gcloud CLI 团队要维护九种语言的客户端库,是个跨多仓库、多语言的复杂工程系统。她把 AI 当成一个能问问题、能一起做实验的伙伴,分三步:先读懂系统、再做实验,最后重新设计。最有用的不是让 AI 写代码,而是把每次「我应该这样改吗」的犹豫时间,从几天压到几小时。一份真正在用 AI 做事的资深工程师实操总结。 来自...

BestBlogs 周刊第 95 期:Agent 工程化的全面落地 15.05.2026

本周亮点 本周没有顶级模型发布,但 Anthropic、OpenAI、阿里、腾讯、淘宝、Kimi 同时把 Agent 真正推向生产。Coding 工具走出 IDE 走向整个计算机、Computer Use 工程化、Windows 沙箱、Agent Skill 开放标准;国内多智能体 Harness 三连发(Kimi×TiDB / 腾讯 / 阿里 Java 1.1);阿里继续追问 AI Native 时代研发组织该往哪走。 时间线 00:00 开场 · 本期主题 + BestBlogs 三步引导 / 邀请 / 老用户赠送 01:41 主题一 · Coding...

EP57 · Claude Code 最佳实践 / GPT-Realtime-2 · 05.15 早报 14.05.2026

BestBlogs Pro 早鸟内测开放:你可以自定义订阅源、配置兴趣标签,每天获得一份属于自己的头条早报。欢迎抢先体验,并把反馈发回给我们:https://bestblogs.dev 今日精讲 Claude Code 在大型代码库中的运作方式:最佳实践与入门指南 | Claude Anthropic 官方深度指南,面向百万行级大型代码库。核心洞察:「Harness 和模型同等重要」——五大扩展点(CLAUDE.md / Hooks / Skills / Plugins / MCP)加上 LSP 与子智能体共同决定实际表...

EP56 · Claude Agent 实战 / Codex 沙箱 · 05.14 早报 13.05.2026

今日精讲 使用 Claude 进行计算机和浏览器操作的最佳实践 Anthropic 针对 Claude 4.6 / Opus 4.7 发布权威最佳实践:点击不准的根本原因是截图超过 API 内部尺寸上限后被静默下采样导致坐标系偏移,解法是发送前主动将截图缩放到 1280×720(Opus 4.7 建议 1080p)。全文覆盖安全架构(必须使用专用虚拟机、绝不暴露敏感主机数据)、Browser Use 与 Computer Use 的场景取舍,以及 Agent 循环中人工确认门控的设计原则,是构建任何...

EP55 · 什么是代码 / ADK 长时间 Agent / Codex Computer Use · 05.13 早报 12.05.2026

今日精讲 什么是代码? Unmesh Joshi(Thoughtworks 首席工程师、《Patterns of Distributed Systems》作者)在 LLM 时代重新追问:代码究竟是什么?他的答案:代码同时承载两个使命——给机器的指令(正在被 LLM 商品化),以及问题域的概念模型(这是真正难以被替代的价值)。当 LLM 将语法生成商品化,稀缺技能从「会写代码」转向「构建精准词汇表和共享理解」。这与 DDD 的「通用语言」和有界上下文一脉相承——在 AI 时代,开发者...

EP54 ·Claude Code 智能体视图上线 / OpenAI 成立部署公司· 05.12 早报 12.05.2026

今日精讲 Claude Code 中的智能体视图 | Claude Claude Code 今日推出「智能体视图」,一块面板统览所有并行会话——哪些在等你决策、哪些仍在运行、哪些已完成。左箭头进入,回复后自动继续,不再需要切换终端标签或 tmux 格子。早期用户最常见的模式:批量下发多个任务配合 skill,等一批 PR 同时就绪再集中审查。以研究预览形式上线 Pro / Max / Team / Enterprise 计划。 来自 Claude Blog OpenAI 推出 OpenAI 部署公司,助力企...

EP54 · Incorruptible / Agent 持久化 / TTS 架构变革 · 05.11 早报 11.05.2026

今日精讲 如何打造能穿越时代的公司 | Eric Ries,Lean Startup 作者 [视频] Eric Ries(《精益创业》作者)在新书《Incorruptible》中指出,公司赢了之后往往走向衰落——根本原因不是贪婪,而是结构性「财务重力」将组织不断拉向短期利益。他提出三种结构性防腐剂:公益公司(PBC)章程、信任型治理(以 Anthropic 独立受托人守护使命为例),以及基金会控股模式(诺和诺德百年不变的范例)。核心洞察:「更难的路反而更容易」——越...

EP53 · AI Native 组织变革 / Claude Code HTML / 语音 AI · 05.10 早报 09.05.2026

今日精讲 AI Native 时代 —— 研发组织何去何从 阿里技术内部访谈与行业研究的深度复盘。核心论断:AI 不是新工具,而是新协作主体,其无沟通衰减、无限注意力的特性正让「人形约束」下设计的组织原则逐步失效。文章提出 Org Chart → Execution Graph 的范式转变,管理重组成本可从季度级压至周级。对工程师和管理者理解 AI 时代组织演进具有极高参考价值。 来自 阿里技术 使用 Claude Code:HTML 难以置信的奇效 Claude Code 核心...

EP52 · OpenAI Codex 集成 Chrome、记忆与梦想机制 · 05.09 早报 08.05.2026

今日精讲 OpenAI Codex 集成 Chrome:Agent 直接进入用户实时浏览器会话 [视频] OpenAI 推出 Codex 的 Chrome 扩展,让 Agent 直接进入用户实时浏览器会话,共享 profile、cookies 和登录态。三大新能力:平行扫描多 tab 汇总信息、自建 Tab Group 在后台滚动推理不打扰用户、用代码执行控制浏览器,告别 screenshot-reason-mouse 循环。演示中 Codex 跨邮箱搜索差旅收据后自动填写报销表单,还能在多 tab 里 spawn 子 Agent 协作...

BestBlogs 第 94 期:语音 AI 突围 08.05.2026

本期内容 00:00 开场:本周关键词「声音」 00:37 OpenAI 三个实时语音模型 — GPT Realtime 2、实时翻译、流式转写 02:53 语音 AI 基础设施 — OpenAI 如何大规模交付低延迟语音服务 04:11 ElevenLabs — 四亿美元年收入背后的组织策略与情绪智能方向 05:39 Anthropic 指数增长 — 八十倍年化增速、SpaceX 300MW 算力合作 07:15 Claude 托管智能体三重升级 — 梦境、成果评估、多智能体编排 08:46 Anthropic NLA — 自然语言自编码器,窥...

EP51 · OpenAI 语音模型、Claude Code 工程实践 · 05.08 早报 08.05.2026

今日精讲 通过 API 新模型推进语音智能 OpenAI 同日发布三款语音模型:GPT-Realtime-2 搭载 GPT-5 级推理能力,上下文窗口从 32K 扩展到 128K,Big Bench Audio 准确率 96.6%;GPT-Realtime-Translate 支持 70+ 种输入语言实时翻译为 13 种输出语言;GPT-Realtime-Whisper 提供低延迟流式语音转文字。三款模型标志着语音 AI 从简单对话迈入能听、能想、能做的智能体时代。 来自 OpenAI Blog 脉搏:AI 负载压垮 GitHub——为何其他供...

EP50 · Claude 托管智能体三大新能力与 SpaceX 算力合作 · 05.07 早报 06.05.2026

今日精讲 Claude 托管智能体新功能:梦境、成果评估与多智能体编排 Claude 在托管智能体上推出三项重要更新:梦境(自动复盘历史会话、提炼记忆规律,让智能体在不运行时也能持续自我优化)、成果评估(用户设定评分标准,独立评分器在独立上下文窗口打分并驱动智能体自我修正,内测任务成功率最高提升 10 分)、以及多智能体编排(主智能体拆解任务后分配给专属子智能体并行处理)。Harvey 法律平台完成率提升约 6 倍,Netflix 日...

EP49 · GPT-5.5 Instant / Wilkinson 自治 CEO · 05.06 早报 05.05.2026

今日精讲 GPT-5.5 Instant 全量推送:高风险问答幻觉减少 52.5%,引入记忆来源 OpenAI 把 ChatGPT 默认模型从 GPT-5.3 Instant 升级到 5.5 Instant,今天起全量推送,API 同步上线 chat-latest。在医疗、法律、金融这类高风险问答上,幻觉减少 52.5%;用户曾标记为有挑战的对话,错误陈述减少 37.3%。同步推出记忆来源功能:用户可看见每条回答用了哪些过往对话和文件做个性化,并能删改。Plus 和 Pro 用户优先开通 Gmail 和文件接...

Poslouchej podcast BestBlogs v Replaio

Rádio a podcasty v jedné aplikaci - zdarma a bez registrace. Nainstaluj si ji ještě dnes a nepropásni premiéru

Stáhnout z Google Play

Replaio není vydavatelem podcastů; názvy pořadů, obálky a audio patří jejich autorům a šíří se přes veřejné RSS kanály