weedge

AI Podcast

Latest podcasts about AI Technology and Papers.

Não deixe de visitar o site do podcast e apoiar quem o produz: podcast-997.pages.dev

Autor

weedge

Categoria

Technology

Site do podcast

podcast-997.pages.dev

Último episódio

17 de abr de 2026

Onde ouvir?

Podcasts no app Replaio Radio Em breve

Os podcasts estão chegando ao app. Instale agora e seja o primeiro a descobrir um jeito totalmente novo de curtir podcasts

Baixe no Google Play Instale grátis Android 5 mi+ downloads · nota 4,8 iOS em breve

Episódios

AI Radio FM - 大规模语言模型训练技术 06.03.2025

本期播客深入探讨了使用 Megatron-LM 在 GPU 集群上进行高效大规模语言模型训练的技术,涵盖了数据并行、流水线并行和张量并行等关键概念,以及如何组合这些技术以实现高性能和可扩展性。

AI Radio FM - Technology Channel 05.03.2025

深入探讨Sarathi-Serve:LLM推理中吞吐量与延迟权衡的驯服之道

AI Radio FM - 科技频道 03.03.2025

LLaSA:基于LLaMA的语音合成中训练时和测试时计算的扩展

AI Radio FM - 深入剖析MOONCAKE:为Kimi提供动力的LLM服务平台 03.03.2025

本期播客深入探讨了Moonshot AI开发的LLM聊天机器人服务Kimi背后的服务平台MOONCAKE。MOONCAKE采用以KVCache为中心的解耦架构,不仅分离了预填充和解码集群,还高效利用GPU集群中未充分利用的CPU、DRAM、SSD和NIC资源,建立了分布式KVCache。该架构的核心是其以KVCache为中心的全局缓存和调度器,旨在最大化吞吐量,同时遵守严格的延迟相关服务水平目标(SLO)。

AI Radio FM - 揭秘Kimi背后的Mooncake架构 03.03.2025

深入探讨Mooncake,一个以KVCache为中心的LLM服务平台,为Kimi提供支持。了解其独特架构和在处理长上下文及高负载场景下的优势。

AI Radio FM - FlashInfer深度解析 03.03.2025

本期节目我们深入探讨FlashInfer,一个专为大型语言模型(LLM)推理服务设计的高效且可定制的注意力引擎。

AI Radio FM - Technology Channel 03.03.2025

深入探讨Mooncake:面向大语言模型服务的以KVCache为中心的解耦架构,特别关注其在长上下文和高负载场景下的性能优化。

AI Radio FM - Technology Channel 03.03.2025

An introduction to BeeGFS and its basic concepts.

AI Radio FM - Technology Channel 03.03.2025

An introduction to BeeGFS® and its basic concepts.

AI Radio FM - 深入剖析WEKA软件架构白皮书 03.03.2025

本期播客将深入探讨WEKA软件架构白皮书,重点关注其分布式并行文件系统。我们将讨论WEKA如何解决常见的云存储挑战,其独特的设计理念,以及在各种环境(包括本地、混合云和公共云)中的灵活部署选项。我们还将通过具体性能数据来验证WEKA的卓越性能。

DAOS存储性能扩展性深度解析 03.03.2025

本播客深入探讨了DAOS存储系统在不同工作负载下的性能扩展性,包括IOR和mdtest基准测试,以及网络堆栈和数据保护方案对性能的影响。

DAOS:面向存储类内存的扩展型高性能存储栈 03.03.2025

本次播客讨论了分布式异步对象存储(DAOS)的架构、数据模型、I/O接口以及IO500基准测试的初步性能结果。DAOS是一个开源的、向外扩展的存储系统,专为在用户空间支持存储类内存(SCM)和NVMe存储而设计。

AI Radio FM - 深度解析DeepSeek-V3/R1推理系统 02.03.2025

深入探讨DeepSeek-V3/R1推理系统的设计原则、大规模跨节点专家并行性(EP)、计算与通信重叠以及负载均衡策略,揭示如何实现高吞吐量和低延迟。

AI Radio FM - Technology Channel 02.03.2025

RDMA技术:AWS和Azure云网络基础设施的革新

AI Radio FM - 3FS USRBIO API 深入解析 28.02.2025

本期播客深入探讨了3FS的User Space Ring Based IO (USR বলারBIO) API,这是一个高性能的I/O函数集,允许用户应用程序直接向3FS I/O队列提交请求,绕过了FUSE的某些限制。我们将详细介绍其概念、函数和使用示例。

AI Radio FM - 3FS 文件系统深度解析 28.02.2025

深入探讨 3FS 文件系统的设计、实现和优化,包括其组件、文件系统接口、元数据存储、块存储系统以及故障检测和数据恢复机制。

Fire-Flyer AI-HPC:深度学习的软硬件协同设计 27.02.2025

本次播客深入探讨了DeepSeek-AI的Fire-Flyer AI-HPC架构。这是一个专为深度学习设计的,具有成本效益的软硬件协同设计框架。我们讨论了其在硬件选择、网络拓扑、软件优化等方面的创新,以及如何实现高性能、低成本和低能耗。

AI解读Vision Mamba:视觉表示学习新星 26.02.2025

本期播客深入探讨Vision Mamba (Vim),一种新型通用视觉骨干网络,它采用双向Mamba块进行图像序列标记,并通过双向状态空间模型压缩视觉表示。Vim在ImageNet分类、COCO目标检测和ADE20k语义分割任务中表现出色,同时计算和内存效率显著提高。

AI Radio FM - Fire-Flyer AI-HPC:深度学习的软硬件协同设计 25.02.2025

本期播客深入探讨了DeepSeek-AI的Fire-Flyer AI-HPC架构,这是一个专为深度学习设计的、具有成本效益的软硬件协同设计框架。讨论涵盖了从硬件选择、网络拓扑到软件优化(如HFReduce和HaiScale)的各个方面,以及如何通过这些创新实现高性能和低成本。

AI Radio FM - 高效人工智能实践 24.02.2025

本期播客讨论了在工业应用中训练和部署高效大型语言模型(LLMs)的实用方法。主题包括知识蒸馏、模型压缩技术(如量化和剪枝),以及在实际部署中优化硬件和提高推理速度的策略。

AI Radio FM - Muon优化器深度解析 23.02.2025

本期播客深入探讨了Muon优化器在大规模语言模型训练中的应用。Moonshot AI团队分享了他们如何通过添加权重衰减和调整参数更新尺度,成功将Muon扩展到3B/16B参数的MoE模型Moonlight的训练中。实验表明,与AdamW相比,Muon在计算效率上提高了约2倍。此外,播客还讨论了Muon的分布式实现,以及在预训练和监督微调阶段的表现。

AI Radio FM - Technology Channel 19.02.2025

深入探讨MoBA(Mixture of Block Attention)技术,这是一种为长上下文LLM设计的新型注意力机制。

AI Radio FM - Technology Channel 19.02.2025

深度解析MinMo:一款为无缝语音交互打造的多模态大型语言模型

AI解读SyncSpeech:低延迟高效双流文本转语音 19.02.2025

本期播客深入探讨SyncSpeech,一种基于时间掩码Transformer的新型双流文本转语音(TTS)模型。SyncSpeech能够同步处理流式文本输入并生成语音,实现低延迟和高效率。

AI Radio FM - 深入探索Nomic Embed v2:首款混合专家文本嵌入模型 19.02.2025

本期节目我们将深入探讨Nomic AI发布的Nomic Embed v2,这是业界首款通用混合专家(MoE)文本嵌入模型。我们将讨论其架构、训练方法、性能表现以及与同类模型的比较,并分析MoE架构在文本嵌入领域的有效性。

Ouça o podcast AI Podcast no Replaio

Rádio e podcasts em um só app - grátis e sem cadastro. Instale hoje e não perca o lançamento

Baixe no Google Play

O Replaio não é o publicador dos podcasts; os nomes dos programas, as capas e o áudio pertencem aos seus autores e são distribuídos por feeds RSS públicos