weedge
AI Podcast
Latest podcasts about AI Technology and Papers.
Where to listen?
Podcasts in the app Replaio Radio Coming soonPodcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts
Episodes
AI Radio FM - 大规模语言模型训练技术 06.03.2025 3:54
本期播客深入探讨了使用 Megatron-LM 在 GPU 集群上进行高效大规模语言模型训练的技术,涵盖了数据并行、流水线并行和张量并行等关键概念,以及如何组合这些技术以实现高性能和可扩展性。
AI Radio FM - Technology Channel 05.03.2025 5:37
深入探讨Sarathi-Serve:LLM推理中吞吐量与延迟权衡的驯服之道
AI Radio FM - 科技频道 03.03.2025 4:09
LLaSA:基于LLaMA的语音合成中训练时和测试时计算的扩展
AI Radio FM - 深入剖析MOONCAKE:为Kimi提供动力的LLM服务平台 03.03.2025 5:34
本期播客深入探讨了Moonshot AI开发的LLM聊天机器人服务Kimi背后的服务平台MOONCAKE。MOONCAKE采用以KVCache为中心的解耦架构,不仅分离了预填充和解码集群,还高效利用GPU集群中未充分利用的CPU、DRAM、SSD和NIC资源,建立了分布式KVCache。该架构的核心是其以KVCache为中心的全局缓存和调度器,旨在最大化吞吐量,同时遵守严格的延迟相关服务水平目标(SLO)。
AI Radio FM - 揭秘Kimi背后的Mooncake架构 03.03.2025 4:28
深入探讨Mooncake,一个以KVCache为中心的LLM服务平台,为Kimi提供支持。了解其独特架构和在处理长上下文及高负载场景下的优势。
AI Radio FM - FlashInfer深度解析 03.03.2025 5:39
本期节目我们深入探讨FlashInfer,一个专为大型语言模型(LLM)推理服务设计的高效且可定制的注意力引擎。
AI Radio FM - Technology Channel 03.03.2025 5:03
深入探讨Mooncake:面向大语言模型服务的以KVCache为中心的解耦架构,特别关注其在长上下文和高负载场景下的性能优化。
AI Radio FM - Technology Channel 03.03.2025 7:12
An introduction to BeeGFS and its basic concepts.
AI Radio FM - Technology Channel 03.03.2025 24:50
An introduction to BeeGFS® and its basic concepts.
AI Radio FM - 深入剖析WEKA软件架构白皮书 03.03.2025 4:33
本期播客将深入探讨WEKA软件架构白皮书,重点关注其分布式并行文件系统。我们将讨论WEKA如何解决常见的云存储挑战,其独特的设计理念,以及在各种环境(包括本地、混合云和公共云)中的灵活部署选项。我们还将通过具体性能数据来验证WEKA的卓越性能。
DAOS存储性能扩展性深度解析 03.03.2025 7:18
本播客深入探讨了DAOS存储系统在不同工作负载下的性能扩展性,包括IOR和mdtest基准测试,以及网络堆栈和数据保护方案对性能的影响。
DAOS:面向存储类内存的扩展型高性能存储栈 03.03.2025 4:08
本次播客讨论了分布式异步对象存储(DAOS)的架构、数据模型、I/O接口以及IO500基准测试的初步性能结果。DAOS是一个开源的、向外扩展的存储系统,专为在用户空间支持存储类内存(SCM)和NVMe存储而设计。
AI Radio FM - 深度解析DeepSeek-V3/R1推理系统 02.03.2025 6:12
深入探讨DeepSeek-V3/R1推理系统的设计原则、大规模跨节点专家并行性(EP)、计算与通信重叠以及负载均衡策略,揭示如何实现高吞吐量和低延迟。
AI Radio FM - Technology Channel 02.03.2025 3:50
RDMA技术:AWS和Azure云网络基础设施的革新
AI Radio FM - 3FS USRBIO API 深入解析 28.02.2025 7:16
本期播客深入探讨了3FS的User Space Ring Based IO (USR বলারBIO) API,这是一个高性能的I/O函数集,允许用户应用程序直接向3FS I/O队列提交请求,绕过了FUSE的某些限制。我们将详细介绍其概念、函数和使用示例。
AI Radio FM - 3FS 文件系统深度解析 28.02.2025 7:25
深入探讨 3FS 文件系统的设计、实现和优化,包括其组件、文件系统接口、元数据存储、块存储系统以及故障检测和数据恢复机制。
Fire-Flyer AI-HPC:深度学习的软硬件协同设计 27.02.2025 3:46
本次播客深入探讨了DeepSeek-AI的Fire-Flyer AI-HPC架构。这是一个专为深度学习设计的,具有成本效益的软硬件协同设计框架。我们讨论了其在硬件选择、网络拓扑、软件优化等方面的创新,以及如何实现高性能、低成本和低能耗。
AI解读Vision Mamba:视觉表示学习新星 26.02.2025 4:13
本期播客深入探讨Vision Mamba (Vim),一种新型通用视觉骨干网络,它采用双向Mamba块进行图像序列标记,并通过双向状态空间模型压缩视觉表示。Vim在ImageNet分类、COCO目标检测和ADE20k语义分割任务中表现出色,同时计算和内存效率显著提高。
AI Radio FM - Fire-Flyer AI-HPC:深度学习的软硬件协同设计 25.02.2025 5:39
本期播客深入探讨了DeepSeek-AI的Fire-Flyer AI-HPC架构,这是一个专为深度学习设计的、具有成本效益的软硬件协同设计框架。讨论涵盖了从硬件选择、网络拓扑到软件优化(如HFReduce和HaiScale)的各个方面,以及如何通过这些创新实现高性能和低成本。
AI Radio FM - 高效人工智能实践 24.02.2025 4:08
本期播客讨论了在工业应用中训练和部署高效大型语言模型(LLMs)的实用方法。主题包括知识蒸馏、模型压缩技术(如量化和剪枝),以及在实际部署中优化硬件和提高推理速度的策略。
AI Radio FM - Muon优化器深度解析 23.02.2025 3:20
本期播客深入探讨了Muon优化器在大规模语言模型训练中的应用。Moonshot AI团队分享了他们如何通过添加权重衰减和调整参数更新尺度,成功将Muon扩展到3B/16B参数的MoE模型Moonlight的训练中。实验表明,与AdamW相比,Muon在计算效率上提高了约2倍。此外,播客还讨论了Muon的分布式实现,以及在预训练和监督微调阶段的表现。
AI Radio FM - Technology Channel 19.02.2025 4:14
深入探讨MoBA(Mixture of Block Attention)技术,这是一种为长上下文LLM设计的新型注意力机制。
AI Radio FM - Technology Channel 19.02.2025 4:12
深度解析MinMo:一款为无缝语音交互打造的多模态大型语言模型
AI解读SyncSpeech:低延迟高效双流文本转语音 19.02.2025 3:35
本期播客深入探讨SyncSpeech,一种基于时间掩码Transformer的新型双流文本转语音(TTS)模型。SyncSpeech能够同步处理流式文本输入并生成语音,实现低延迟和高效率。
AI Radio FM - 深入探索Nomic Embed v2:首款混合专家文本嵌入模型 19.02.2025 5:35
本期节目我们将深入探讨Nomic AI发布的Nomic Embed v2,这是业界首款通用混合专家(MoE)文本嵌入模型。我们将讨论其架构、训练方法、性能表现以及与同类模型的比较,并分析MoE架构在文本嵌入领域的有效性。
Similar podcasts
Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.