weedge

AI Podcast

Latest podcasts about AI Technology and Papers.

Autor

weedge

Kategorie

Technology

Web podcastu

podcast-997.pages.dev

Nejnovější epizoda

17. dub 2026

Kde poslouchat?

Podcasty v aplikaci Replaio Radio Už brzy

Podcasty míří do aplikace už brzy. Nainstaluj si ji teď a jako první uvidíš úplně nový pohled na podcasty

Stáhnout z Google Play Nainstaluj zdarma Android 5 mil.+ stažení · hodnocení 4,8 iOS už brzy

Epizody

OmniVinci:开放全模态大模型的未来揭秘 18.11.2025

欢迎收听AI Radio FM - 科技频道!本期节目我们将深入探讨NVIDIA最新发布的OmniVinci项目,一个旨在构建强大、开源全模态大模型的创新计划。我们将详细解析其革命性的模型架构设计,包括OmniAlignNet、时序嵌入分组和受限旋转时间嵌入,以及独特的数据策展和训练策略。weedge专家将带我们了解OmniVinci如何在性能上超越现有模型,同时大幅提升训练效率,并在机器人、医疗AI和智能工厂等多个下游应用中展现出非凡潜力。准备好一起探...

探索LongCat-Flash-Omni:5600亿参数全模态巨兽的实时音视频交互秘密 18.11.2025

欢迎收听AI Radio FM - 科技频道!本期节目,我们将深入探讨美团LongCat团队发布的LongCat-Flash-Omni,一个拥有5600亿参数的开源全模态模型。我们将揭秘其卓越的实时音视频交互能力、创新的多阶段训练策略、高效的训练基础设施,以及它如何克服多模态领域的重重挑战,成为开源社区的SOTA。从架构设计到数据策略,从预训练到推理部署,Weedge专家将带我们一探究竟,感受人工智能通用能力的未来。

AI电台FM - 科技频道:自我演化智能体:通往人工超级智能之路 16.11.2025

本期节目深入探讨了自我演化智能体的最新研究综述,揭示了它们如何从静态大型语言模型演变为能自主学习、适应和改进的动态系统。我们将分析智能体演化的核心维度——演化什么、何时演化、如何演化,以及其在编码、医疗、教育等领域的应用和未来发展方向。

智能体组织时代:语言模型如何学会异步思考 13.11.2025

深入探讨AsyncThink,一种新颖的LLM推理范式,它通过组织者-工作者协议、两阶段训练以及强化学习,实现了更高效、更准确的复杂问题解决能力,并能泛化到新任务。我们将详细解读其核心机制、训练过程、实验结果以及未来潜力。

MemOS:AI系统的记忆操作系统——革新LLM的记忆能力 12.11.2025

本期节目,我们将深入探讨 MemOS,一个专为大型语言模型(LLM)设计的记忆操作系统。我们将解析其如何统一管理参数记忆、激活记忆和明文记忆,通过创新的 MemCube 概念,赋予LLM卓越的记忆可控性、可塑性和可演化性。从长程依赖到知识演化,再到个性化定制和跨平台迁移,MemOS 不仅解决了现有LLM的记忆瓶颈,更预示着未来AI系统持续学习和自我进化的新范式。加入我们,一同见证LLM记忆管理的革命性突破!

超感知:迈向视频空间智能的未来 11.11.2025

深入探讨Cambrian-S研究,揭示多模态大模型在视频理解和空间超感知能力上的突破与挑战,以及预测式感知如何引领新范式。

Nested Learning: The Illusion of Deep Learning Architectures - 嵌套学习:深度学习架构的幻象 09.11.2025

欢迎收听AI Radio FM - 科技频道,您的个人生成式AI播客!今天,我们将深入探讨一篇来自谷歌研究的革命性论文,题为“嵌套学习:深度学习架构的幻象”。这篇论文引入了一种突破性的范式,称为嵌套学习(NL),它重新定义了我们理解和设计机器学习模型,特别是大型语言模型的方式。加入我们,一起探索NL如何揭示现有深度学习方法背后的隐藏机制,解释了上下文学习的出现,并为设计具有多层次优化问题的更具表现力的学习算法铺平了道路...

FM Agent:大型语言模型与进化搜索的协同——迈向通用AI研究代理 09.11.2025

本期节目深入探讨了FM Agent,一个创新且通用的多智能体框架,它如何巧妙结合LLM推理和大规模进化搜索来解决复杂的现实世界挑战,并在机器学习、组合优化、GPU核函数生成及经典数学问题上取得SOTA成果。

AI Radio FM - 智能代理的进化秘籍:ACE上下文工程 07.11.2025

本期节目深入探讨了“代理式上下文工程”(ACE)框架,该框架通过将大型语言模型的上下文视为不断演进的“策略手册”,有效解决了现有上下文适应方法中存在的“简洁偏见”和“上下文崩溃”两大难题。我们分析了ACE如何通过生成器、反思器和策展器的模块化协作,以及增量更新和“增长-精炼”机制,实现更高效、更具韧性的AI系统自我提升,及其在智能代理和领域特定任务中的显著性能提升和成本节约。

AI长时记忆突破:Mem0如何赋能智能体? 06.11.2025

本期节目深入探讨了Mem0及其图增强版本Mem0^g,这两种革命性的AI记忆架构如何克服大语言模型(LLMs)的固有局限,实现可扩展的长期对话连贯性。我们将分析它们在多轮对话中的卓越表现、计算效率,以及对未来AI智能体发展的深远影响。

AI Radio FM - Technology Channel - 探秘智能体上下文工程:LLM的自我进化之路 05.11.2025

本期节目,我们将深入探讨“智能体上下文工程(Agentic Context Engineering, ACE)”这一创新框架,了解它如何通过演进式上下文,帮助大型语言模型(LLM)实现更高效、更可靠的自我学习和适应。我们将讨论现有方法的局限性,ACE框架的设计理念,以及它在智能体和特定领域任务中取得的显著成效,包括性能提升、成本降低等。

AI语境工程:机器如何真正“懂你”? 05.11.2025

深入探讨AI语境工程的过去、现在与未来,从早期人机交互到智能体时代,揭示机器如何通过理解语境更好地服务人类意图,并展望实现人级甚至超人智能的挑战与机遇。

AI Radio FM - Technology Channel: Gated Delta Networks突破Mamba2的秘密 03.11.2025

本期节目深入探讨了Gated Delta Networks如何通过结合门控机制和Delta更新规则,显著提升线性Transformer模型在长上下文理解和检索任务中的表现,超越Mamba2等现有模型,并为AI领域带来新的突破。我们将一同揭示这项技术的核心创新、卓越性能及其对未来AI发展的深远影响。

AI电台FM:DeltaNet的平行化训练——突破线性Transformer性能瓶颈 03.11.2025

本期节目,我们深入探讨了一篇关于DeltaNet的研究论文。它提出了一种硬件高效的算法,用于并行化DeltaNet在序列长度上的训练,显著提高了其在现代硬件上的训练效率。我们讨论了DeltaNet如何通过Delta更新规则解决传统线性Transformer在关联回忆任务上的不足,并详细剖析了其内存高效的重参数化技术,以及分块并行形式的实现。此外,节目还涵盖了DeltaNet的神经网络架构、特征图与归一化方法,以及与滑动窗口和全局注意力机制结合的...

Kimi Linear:超越全注意力,构建高效能语言模型的新范式 01.11.2025

本期节目深入探讨Kimi Linear,一种创新性的混合线性注意力架构。我们将揭示其核心Kimi Delta Attention如何通过精细门控机制,首次在多场景下超越传统全注意力模型,并在性能、效率和长上下文处理能力上实现显著提升。了解Kimi Linear如何为下一代AI智能体和实时交互LLMs铺平道路!

AI Radio FM - Technology Channel: 深入探索SoulX-Podcast - 长篇播客的多语种与语态多样性 30.10.2025

本期节目我们深入探讨SoulX-Podcast,一个由大语言模型驱动的语音合成系统,它如何实现逼真、长篇、多说话人、多语态的对话式语音生成,并支持普通话、英语及多种中国方言,包括跨方言零样本语音克隆。

VITA-E:机器人交互新篇章——并发与实时中断的智能具身助理 29.10.2025

本期AI Radio FM - 科技频道,我们将深入探讨VITA-E框架,一个旨在革新人类与机器人交互方式的创新系统。VITA-E通过独特的双模型架构和特殊令牌控制流,实现了机器人同时进行视觉感知、听觉处理、语言响应和物理行动,并能动态处理实时中断,大幅提升了人机协作的自然性和流畅性。我们将详细解读其核心技术、实验成果及其对未来智能具身助理的深远影响。

策略内蒸馏:LLM高效训练的秘密武器 28.10.2025

欢迎收听AI电台FM科技频道,本期节目我们将深入探讨Thinking Machines Lab的最新研究成果——策略内蒸馏。我们知道,大语言模型在各个领域都展现出惊人的能力,但训练这些模型,特别是针对特定任务进行微调,往往需要巨大的计算资源。那么,有没有一种方法能够兼顾训练效率和模型性能呢?今天,我们的技术专家weedge将带领我们了解策略内蒸馏这一创新方法,它如何将策略内训练的相关性和蒸馏的密集奖励信号相结合,以更低的成本实现...

EchoMimicV3:13亿参数,统一多模态多任务人体动画的魔法! 25.10.2025

欢迎收听AI Radio FM - Technology Channel!今天我们深入探讨EchoMimicV3,这个仅用13亿参数就实现了多任务、多模态人体动画统一的开创性框架。我们将解析其三大核心创新:任务之羹、模态之羹,以及新颖的训练和推理策略,看看它如何在效率与性能之间找到完美平衡,甚至超越参数量十倍的顶尖模型!

智读万卷:PaddleOCR-VL的文档解析革命 24.10.2025

深入探讨百度PaddleOCR-VL模型,如何以其超紧凑的视觉-语言架构,实现多语言文档解析的突破性进展。本期节目将为您揭示其SOTA性能、高效推理能力以及在处理复杂文档元素(文本、表格、公式、图表)方面的卓越表现,以及其在实际应用中的巨大潜力。

LongLive:实时互动长视频生成的革新之路 21.10.2025

深入探讨LongLive框架如何通过KV-recache、流式长视频训练和短窗口注意力结合帧沉降机制,实现高效、高质量的实时互动长视频生成,突破现有技术的效率与质量瓶颈。

DeepSeek-OCR:开启长上下文光学压缩新纪元 20.10.2025

本期节目,我们将深入探讨DeepSeek-OCR,一项革命性的技术,它利用视觉模态进行文本信息高效压缩,为大语言模型处理超长上下文带来了突破性进展。从其核心架构DeepEncoder,到惊人的压缩效率和广泛的实际应用,我们为您揭示这一前沿研究如何重塑人工智能的未来。

LightRAG:大模型检索增强生成的图谱新范式 20.10.2025

本期节目深入探讨了LightRAG,一种创新性的检索增强生成系统,它通过整合图结构和双层检索范式,显著提升了大语言模型在复杂查询下的信息检索效率和回答质量,同时降低了运行成本。我们将揭示LightRAG如何克服现有RAG系统的局限,实现更全面的信息理解、更高效的检索以及对新数据的快速适应。

Voila:迈向自主语音AI的里程碑 15.10.2025

本期节目深入探讨了Voila,一个革新性的语音-语言基础模型系列,它如何通过端到端、全双工架构实现超低延迟、情感丰富的自主语音交互,并支持百万级音色定制和多任务统一。我们还将剖析其核心技术与卓越性能,共同展望未来人机交互的无限可能。

机器人学习:从经典到通用策略的深度探索 15.10.2025

欢迎收听AI Radio FM - 科技频道,您的专属生成式AI播客!今天,我们将深入探讨机器人学习的最新进展,从传统的基于模型方法到数据驱动的通用学习范式,以及Hugging Face的lerobot库如何助力这一变革。

Poslouchej podcast AI Podcast v Replaio

Rádio a podcasty v jedné aplikaci - zdarma a bez registrace. Nainstaluj si ji ještě dnes a nepropásni premiéru

Stáhnout z Google Play

Replaio není vydavatelem podcastů; názvy pořadů, obálky a audio patří jejich autorům a šíří se přes veřejné RSS kanály