weedge
AI Podcast
Latest podcasts about AI Technology and Papers.
Não deixe de visitar o site do podcast e apoiar quem o produz: podcast-997.pages.dev
Autor
weedge
Categoria
Site do podcast
Último episódio
17 de abr de 2026
Onde ouvir?
Podcasts no app Replaio Radio Em breveOs podcasts estão chegando ao app. Instale agora e seja o primeiro a descobrir um jeito totalmente novo de curtir podcasts
Episódios
PaliGemma 2: A Versatile Vision-Language Model 21.12.2024 7:07
A podcast discussion about PaliGemma 2, a family of versatile vision-language models, and its capabilities in various tasks.
Byte Latent Transformer: Patches Scale Better Than Tokens 21.12.2024 5:36
A podcast discussing the Byte Latent Transformer (BLT), a novel byte-level LLM architecture that matches tokenization-based LLM performance with improvements in inference efficiency and robustness.
AI前沿:POINTS1.5视觉语言模型深度解析 21.12.2024 7:38
本期播客深入探讨了腾讯微信AI团队推出的最新视觉语言模型POINTS1.5,从模型架构、双语支持到训练策略,全面解析其在真实世界应用中的潜力。
ModernBERT: A Deep Dive into Efficient Encoder Models 21.12.2024 5:18
An in-depth discussion of the ModernBERT paper, exploring its architecture, training methodology, and performance across various NLP tasks.
Open-Sora Plan: 开源大型视频生成模型 15.12.2024 6:23
本播客深入探讨了Open-Sora Plan,一个旨在生成高质量、长时视频的开源项目。我们将详细分析其核心模型、辅助策略和数据处理流程。
Wavelet Flow VAE for Latent Video Diffusion Models 15.12.2024 6:04
A podcast discussion about Wavelet Flow VAE (WF-VAE), a novel autoencoder that leverages multi-level wavelet transforms to enhance video encoding efficiency for latent video diffusion models.
AI 广播 FM - 技术频道,您的个人生成式人工智能播客 14.12.2024 5:10
本期节目我们深入探讨了 POINTS1.5,一个在真实世界应用中表现出色的视觉语言模型。
Gemini 2.0 Flash for Developers 12.12.2024 6:24
A podcast discussing the new Gemini 2.0 Flash model and its capabilities for developers.
Gemini 2.0 新纪元:智能体时代的到来 12.12.2024 5:54
谷歌推出了 Gemini 2.0,一款为智能体时代打造的全新 AI 模型。本次播客将深入探讨 Gemini 2.0 的特性、应用以及谷歌在人工智能领域的最新进展。
AI电台FM科技频道:生成对抗网络GANs深度解析 12.12.2024 3:15
本期节目深入探讨Ian Goodfellow等人在2014年提出的生成对抗网络(GANs),揭秘其原理、优势及应用,带你领略AI领域的最新突破。
AI电台FM科技频道:多模态大型语言模型评估的全面综述 12.12.2024 3:03
本期节目深入探讨多模态大型语言模型(MLLMs)的评估方法,涵盖基准测试类型、基准构建流程、评估方法以及未来发展方向。我们将与专家一起,解读MLLMs评估的挑战和机遇。
AI电台FM科技频道:多模态大型语言模型综述 12.12.2024 3:35
本期节目深入探讨多模态大型语言模型(MLLM)的最新进展,涵盖架构、训练策略、数据、评估方法以及未来发展方向。我们将与专家一起,揭秘MLLM如何理解和推理多模态信息,以及如何应对多模态幻觉等挑战。
AI Radio FM - GLM-4-Voice: 人工智能语音聊天机器人 12.12.2024 3:16
深度探讨GLM-4-Voice,一款支持中英双语、具备实时语音对话能力,并根据用户指令调整语音语调、语速和方言等细微差别的智能语音聊天机器人。
AI电台FM科技频道:视频扩散模型综述 10.12.2024 3:32
本期节目深入探讨了AI内容生成领域中视频扩散模型的最新进展,涵盖视频生成、编辑和理解三大方向。
AI电台FM科技频道:高分辨率图像合成与潜在扩散模型 10.12.2024 3:46
本期节目深入探讨高分辨率图像合成技术,特别是潜在扩散模型(LDM)的最新进展。我们将讨论LDM如何通过降低计算复杂度,在高分辨率图像生成领域取得突破性进展,并分析其在图像修复、超分辨率和文本到图像合成等任务中的应用。
AI Radio FM - 视觉Transformer:图像识别的革命 10.12.2024 2:47
深度探讨Vision Transformer (ViT) 如何颠覆图像识别领域,以及其在大型数据集上的卓越表现。
AI电台FM科技频道:Diffusion Transformers 革命性图像生成 10.12.2024 3:31
本期节目深入探讨Diffusion Transformers (DiTs) 如何在图像生成领域取得突破性进展,并超越现有U-Net模型。我们将分析DiTs的可扩展性,以及其在ImageNet 512x512和256x256基准测试中如何达到最先进的FID分数。
AI电台FM科技频道:变分自动编码器深度解析 10.12.2024 3:06
本期节目深入探讨变分自动编码器(Variational Autoencoder,VAE)的原理和应用,带你揭秘高效近似推断和学习的奥秘。我们将一步步拆解VAE的核心概念,包括随机变分推断、SGVB估计器、AEVB算法等,并结合实际案例进行讲解。
AI电台FM科技频道:扩散模型设计基础详解 10.12.2024 4:39
本期节目深入探讨扩散模型的三个核心组件:前向过程、反向过程和采样过程,并分析各种设计选择及其影响。我们将讨论噪声配置、转移链、网络架构、反向均值参数化、优化设计、指导机制和加速技术等关键方面。
AI电台FM科技频道:AGI之路上的里程碑 10.12.2024 3:59
探索人工智能通用智能(AGI)的等级框架,探讨其能力、风险和人机交互。
AI电台FM科技频道:HunyuanVideo大型视频生成模型深度解析 05.12.2024 4:53
欢迎收听AI电台FM科技频道,本期节目将深入探讨腾讯Hunyuuan团队最新发布的开源视频生成模型HunyuanVideo。我们将从数据处理、模型架构、训练策略以及实际应用等多个角度,全面解读这一具有突破性意义的模型。
AI Radio FM - Auto-RAG: 自动迭代检索的未来 04.12.2024 3:02
深度探讨Auto-RAG模型,揭秘其自主迭代检索的机制,以及在知识密集型任务中的卓越表现。
AI电台FM科技频道:生成式AI提示工程技术详解 21.11.2024 4:43
本期节目深入探讨生成式人工智能的提示工程技术,涵盖文本、图像、多模态等多种提示方法,并对提示工程的实际应用、安全性和挑战进行全面分析。
AI电台FM科技频道:超小型多模态AI智能体Octopus v3技术详解 21.11.2024 2:43
本期节目深入探讨Octopus v3,一款参数小于10亿的、可在边缘设备上运行的多模态AI智能体。我们将与专家一起,从技术细节到实际应用,全方位解读这款令人兴奋的AI创新。
AI Radio FM - Machete: Hopper GPU 优化 GEMM 内核 19.11.2024 3:13
深度探讨Neural Magic的Machete内核,专为NVIDIA Hopper GPU上的混合输入量化而优化,显著提升大型语言模型推理性能。
Podcasts parecidos
O Replaio não é o publicador dos podcasts; os nomes dos programas, as capas e o áudio pertencem aos seus autores e são distribuídos por feeds RSS públicos