weedge

AI Podcast

Latest podcasts about AI Technology and Papers.

Author

weedge

Category

Technology

Podcast website

podcast-997.pages.dev

Latest episode

Apr 17, 2026

Where to listen?

Podcasts in the app Replaio Radio Coming soon

Podcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts

Get it on Google Play Install for free Android 5M+ downloads · 4.8 rating iOS soon

Episodes

OmniVinci:开放全模态大模型的未来揭秘 18.11.2025

欢迎收听AI Radio FM - 科技频道!本期节目我们将深入探讨NVIDIA最新发布的OmniVinci项目,一个旨在构建强大、开源全模态大模型的创新计划。我们将详细解析其革命性的模型架构设计,包括OmniAlignNet、时序嵌入分组和受限旋转时间嵌入,以及独特的数据策展和训练策略。weedge专家将带我们了解OmniVinci如何在性能上超越现有模型,同时大幅提升训练效率,并在机器人、医疗AI和智能工厂等多个下游应用中展现出非凡潜力。准备好一起探...

探索LongCat-Flash-Omni:5600亿参数全模态巨兽的实时音视频交互秘密 18.11.2025

欢迎收听AI Radio FM - 科技频道!本期节目,我们将深入探讨美团LongCat团队发布的LongCat-Flash-Omni,一个拥有5600亿参数的开源全模态模型。我们将揭秘其卓越的实时音视频交互能力、创新的多阶段训练策略、高效的训练基础设施,以及它如何克服多模态领域的重重挑战,成为开源社区的SOTA。从架构设计到数据策略,从预训练到推理部署,Weedge专家将带我们一探究竟,感受人工智能通用能力的未来。

AI电台FM - 科技频道:自我演化智能体:通往人工超级智能之路 16.11.2025

本期节目深入探讨了自我演化智能体的最新研究综述,揭示了它们如何从静态大型语言模型演变为能自主学习、适应和改进的动态系统。我们将分析智能体演化的核心维度——演化什么、何时演化、如何演化,以及其在编码、医疗、教育等领域的应用和未来发展方向。

智能体组织时代:语言模型如何学会异步思考 13.11.2025

深入探讨AsyncThink,一种新颖的LLM推理范式,它通过组织者-工作者协议、两阶段训练以及强化学习,实现了更高效、更准确的复杂问题解决能力,并能泛化到新任务。我们将详细解读其核心机制、训练过程、实验结果以及未来潜力。

MemOS:AI系统的记忆操作系统——革新LLM的记忆能力 12.11.2025

本期节目,我们将深入探讨 MemOS,一个专为大型语言模型(LLM)设计的记忆操作系统。我们将解析其如何统一管理参数记忆、激活记忆和明文记忆,通过创新的 MemCube 概念,赋予LLM卓越的记忆可控性、可塑性和可演化性。从长程依赖到知识演化,再到个性化定制和跨平台迁移,MemOS 不仅解决了现有LLM的记忆瓶颈,更预示着未来AI系统持续学习和自我进化的新范式。加入我们,一同见证LLM记忆管理的革命性突破!

超感知:迈向视频空间智能的未来 11.11.2025

深入探讨Cambrian-S研究,揭示多模态大模型在视频理解和空间超感知能力上的突破与挑战,以及预测式感知如何引领新范式。

Nested Learning: The Illusion of Deep Learning Architectures - 嵌套学习:深度学习架构的幻象 09.11.2025

欢迎收听AI Radio FM - 科技频道,您的个人生成式AI播客!今天,我们将深入探讨一篇来自谷歌研究的革命性论文,题为“嵌套学习:深度学习架构的幻象”。这篇论文引入了一种突破性的范式,称为嵌套学习(NL),它重新定义了我们理解和设计机器学习模型,特别是大型语言模型的方式。加入我们,一起探索NL如何揭示现有深度学习方法背后的隐藏机制,解释了上下文学习的出现,并为设计具有多层次优化问题的更具表现力的学习算法铺平了道路...

FM Agent:大型语言模型与进化搜索的协同——迈向通用AI研究代理 09.11.2025

本期节目深入探讨了FM Agent,一个创新且通用的多智能体框架,它如何巧妙结合LLM推理和大规模进化搜索来解决复杂的现实世界挑战,并在机器学习、组合优化、GPU核函数生成及经典数学问题上取得SOTA成果。

AI Radio FM - 智能代理的进化秘籍:ACE上下文工程 07.11.2025

本期节目深入探讨了“代理式上下文工程”(ACE)框架,该框架通过将大型语言模型的上下文视为不断演进的“策略手册”,有效解决了现有上下文适应方法中存在的“简洁偏见”和“上下文崩溃”两大难题。我们分析了ACE如何通过生成器、反思器和策展器的模块化协作,以及增量更新和“增长-精炼”机制,实现更高效、更具韧性的AI系统自我提升,及其在智能代理和领域特定任务中的显著性能提升和成本节约。

AI长时记忆突破:Mem0如何赋能智能体? 06.11.2025

本期节目深入探讨了Mem0及其图增强版本Mem0^g,这两种革命性的AI记忆架构如何克服大语言模型(LLMs)的固有局限,实现可扩展的长期对话连贯性。我们将分析它们在多轮对话中的卓越表现、计算效率,以及对未来AI智能体发展的深远影响。

AI Radio FM - Technology Channel - 探秘智能体上下文工程:LLM的自我进化之路 05.11.2025

本期节目,我们将深入探讨“智能体上下文工程(Agentic Context Engineering, ACE)”这一创新框架,了解它如何通过演进式上下文,帮助大型语言模型(LLM)实现更高效、更可靠的自我学习和适应。我们将讨论现有方法的局限性,ACE框架的设计理念,以及它在智能体和特定领域任务中取得的显著成效,包括性能提升、成本降低等。

AI语境工程:机器如何真正“懂你”? 05.11.2025

深入探讨AI语境工程的过去、现在与未来,从早期人机交互到智能体时代,揭示机器如何通过理解语境更好地服务人类意图,并展望实现人级甚至超人智能的挑战与机遇。

AI Radio FM - Technology Channel: Gated Delta Networks突破Mamba2的秘密 03.11.2025

本期节目深入探讨了Gated Delta Networks如何通过结合门控机制和Delta更新规则,显著提升线性Transformer模型在长上下文理解和检索任务中的表现,超越Mamba2等现有模型,并为AI领域带来新的突破。我们将一同揭示这项技术的核心创新、卓越性能及其对未来AI发展的深远影响。

AI电台FM:DeltaNet的平行化训练——突破线性Transformer性能瓶颈 03.11.2025

本期节目,我们深入探讨了一篇关于DeltaNet的研究论文。它提出了一种硬件高效的算法,用于并行化DeltaNet在序列长度上的训练,显著提高了其在现代硬件上的训练效率。我们讨论了DeltaNet如何通过Delta更新规则解决传统线性Transformer在关联回忆任务上的不足,并详细剖析了其内存高效的重参数化技术,以及分块并行形式的实现。此外,节目还涵盖了DeltaNet的神经网络架构、特征图与归一化方法,以及与滑动窗口和全局注意力机制结合的...

Kimi Linear:超越全注意力,构建高效能语言模型的新范式 01.11.2025

本期节目深入探讨Kimi Linear,一种创新性的混合线性注意力架构。我们将揭示其核心Kimi Delta Attention如何通过精细门控机制,首次在多场景下超越传统全注意力模型,并在性能、效率和长上下文处理能力上实现显著提升。了解Kimi Linear如何为下一代AI智能体和实时交互LLMs铺平道路!

AI Radio FM - Technology Channel: 深入探索SoulX-Podcast - 长篇播客的多语种与语态多样性 30.10.2025

本期节目我们深入探讨SoulX-Podcast,一个由大语言模型驱动的语音合成系统,它如何实现逼真、长篇、多说话人、多语态的对话式语音生成,并支持普通话、英语及多种中国方言,包括跨方言零样本语音克隆。

VITA-E:机器人交互新篇章——并发与实时中断的智能具身助理 29.10.2025

本期AI Radio FM - 科技频道,我们将深入探讨VITA-E框架,一个旨在革新人类与机器人交互方式的创新系统。VITA-E通过独特的双模型架构和特殊令牌控制流,实现了机器人同时进行视觉感知、听觉处理、语言响应和物理行动,并能动态处理实时中断,大幅提升了人机协作的自然性和流畅性。我们将详细解读其核心技术、实验成果及其对未来智能具身助理的深远影响。

策略内蒸馏:LLM高效训练的秘密武器 28.10.2025

欢迎收听AI电台FM科技频道,本期节目我们将深入探讨Thinking Machines Lab的最新研究成果——策略内蒸馏。我们知道,大语言模型在各个领域都展现出惊人的能力,但训练这些模型,特别是针对特定任务进行微调,往往需要巨大的计算资源。那么,有没有一种方法能够兼顾训练效率和模型性能呢?今天,我们的技术专家weedge将带领我们了解策略内蒸馏这一创新方法,它如何将策略内训练的相关性和蒸馏的密集奖励信号相结合,以更低的成本实现...

EchoMimicV3:13亿参数,统一多模态多任务人体动画的魔法! 25.10.2025

欢迎收听AI Radio FM - Technology Channel!今天我们深入探讨EchoMimicV3,这个仅用13亿参数就实现了多任务、多模态人体动画统一的开创性框架。我们将解析其三大核心创新:任务之羹、模态之羹,以及新颖的训练和推理策略,看看它如何在效率与性能之间找到完美平衡,甚至超越参数量十倍的顶尖模型!

智读万卷:PaddleOCR-VL的文档解析革命 24.10.2025

深入探讨百度PaddleOCR-VL模型,如何以其超紧凑的视觉-语言架构,实现多语言文档解析的突破性进展。本期节目将为您揭示其SOTA性能、高效推理能力以及在处理复杂文档元素(文本、表格、公式、图表)方面的卓越表现,以及其在实际应用中的巨大潜力。

LongLive:实时互动长视频生成的革新之路 21.10.2025

深入探讨LongLive框架如何通过KV-recache、流式长视频训练和短窗口注意力结合帧沉降机制,实现高效、高质量的实时互动长视频生成,突破现有技术的效率与质量瓶颈。

DeepSeek-OCR:开启长上下文光学压缩新纪元 20.10.2025

本期节目,我们将深入探讨DeepSeek-OCR,一项革命性的技术,它利用视觉模态进行文本信息高效压缩,为大语言模型处理超长上下文带来了突破性进展。从其核心架构DeepEncoder,到惊人的压缩效率和广泛的实际应用,我们为您揭示这一前沿研究如何重塑人工智能的未来。

LightRAG:大模型检索增强生成的图谱新范式 20.10.2025

本期节目深入探讨了LightRAG,一种创新性的检索增强生成系统,它通过整合图结构和双层检索范式,显著提升了大语言模型在复杂查询下的信息检索效率和回答质量,同时降低了运行成本。我们将揭示LightRAG如何克服现有RAG系统的局限,实现更全面的信息理解、更高效的检索以及对新数据的快速适应。

Voila:迈向自主语音AI的里程碑 15.10.2025

本期节目深入探讨了Voila,一个革新性的语音-语言基础模型系列,它如何通过端到端、全双工架构实现超低延迟、情感丰富的自主语音交互,并支持百万级音色定制和多任务统一。我们还将剖析其核心技术与卓越性能,共同展望未来人机交互的无限可能。

机器人学习:从经典到通用策略的深度探索 15.10.2025

欢迎收听AI Radio FM - 科技频道,您的专属生成式AI播客!今天,我们将深入探讨机器人学习的最新进展,从传统的基于模型方法到数据驱动的通用学习范式,以及Hugging Face的lerobot库如何助力这一变革。

Listen to the AI Podcast podcast in Replaio

Radio and podcasts in one app - free, with no sign-up. Install today and do not miss the launch

Get it on Google Play

Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.