Jingwen Liang, Gengyu Wang

Daily Paper Cast

Science EN ↓ 2000 episodes

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: dailypapercast.ai@gmail.comCreator:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-cast/id1777620236Cover Image by Kawen Kuang https://kawen.art

Author

Jingwen Liang, Gengyu Wang

Category

Science

Latest episode

Jul 11, 2026

Where to listen?

Podcasts in the app Replaio Radio Coming soon

Podcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts

Get it on Google Play Install for free Android 5M+ downloads · 4.8 rating iOS soon

Episodes

RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework 18.04.2026

🤗 Upvotes: 21 | cs. CV Authors: Hao Gao, Shaoyu Chen, Yifan Zhu, Yuehao Song, Wenyu Liu, Qian Zhang, Xinggang Wang Title: RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework Arxiv: http://arxiv.org/abs/2604.15308v1 Abstract: High-level autonomous driving requires motion planners capable of modeling multimodal future uncertainties while remaining robust in closed-loop inte...

DR$^{3}$-Eval: Towards Realistic and Reproducible Deep Research Evaluation 18.04.2026

🤗 Upvotes: 21 | cs. AI Authors: Qianqian Xie, Qingheng Xiong, He Zhu, Tiantian Xia, Xueming Han, Fanyu Meng, Jiakai Wang, Zhiqi Bai, Chengkang Jiang, Zhaohui Wang, Yubin Guo, Yuqing Wen, Jiayang Mao, Zijie Zhang, Shihao Li, Yanghai Wang, Yuxiang Ren, Junlan Feng, Jiaheng Liu Title: DR$^{3}$-Eval: Towards Realistic and Reproducible Deep Research Evaluation Arxiv: http://arxiv.org/abs/2604.14683v1...

Seedance 2.0: Advancing Video Generation for World Complexity 17.04.2026

🤗 Upvotes: 118 | cs. CV Authors: Team Seedance, De Chen, Liyang Chen, Xin Chen, Ying Chen, Zhuo Chen, Zhuowei Chen, Feng Cheng, Tianheng Cheng, Yufeng Cheng, Mojie Chi, Xuyan Chi, Jian Cong, Qinpeng Cui, Fei Ding, Qide Dong, Yujiao Du, Haojie Duanmu, Junliang Fan, Jiarui Fang, Jing Fang, Zetao Fang, Chengjian Feng, Yu Gao, Diandian Gu, Dong Guo, Hanzhong Guo, Qiushan Guo, Boyang Hao, Hongxiang Ha...

GameWorld: Towards Standardized and Verifiable Evaluation of Multimodal Game Agents 17.04.2026

🤗 Upvotes: 106 | cs. CV, cs. AI, cs. HC Authors: Mingyu Ouyang, Siyuan Hu, Kevin Qinghong Lin, Hwee Tou Ng, Mike Zheng Shou Title: GameWorld: Towards Standardized and Verifiable Evaluation of Multimodal Game Agents Arxiv: http://arxiv.org/abs/2604.07429v1 Abstract: Towards an embodied generalist for real-world interaction, Multimodal Large Language Model (MLLM) agents still suffer from challengin...

RationalRewards: Reasoning Rewards Scale Visual Generation Both Training and Test Time 17.04.2026

🤗 Upvotes: 96 | cs. AI, cs. LG Authors: Haozhe Wang, Cong Wei, Weiming Ren, Jiaming Liu, Fangzhen Lin, Wenhu Chen Title: RationalRewards: Reasoning Rewards Scale Visual Generation Both Training and Test Time Arxiv: http://arxiv.org/abs/2604.11626v2 Abstract: Most reward models for visual generation reduce rich human judgments to a single unexplained score, discarding the reasoning that underlies...

SpatialEvo: Self-Evolving Spatial Intelligence via Deterministic Geometric Environments 17.04.2026

🤗 Upvotes: 60 | cs. CV, cs. CL Authors: Dinging Li, Yingxiu Zhao, Xinrui Cheng, Kangheng Lin, Hongbo Peng, Hongxing Li, Zixuan Wang, Yuhong Dai, Haodong Li, Jia Wang, Yukang Shi, Liang Zhao, Jianjian Sun, Zheng Ge, Xiangyu Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen Title: SpatialEvo: Self-Evolving Spatial Intelligence via Deterministic Geometric Environments Arxiv: http://arxiv.o...

OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language Environment Simulation 17.04.2026

🤗 Upvotes: 50 | cs. CL Authors: Xiaomeng Hu, Yinger Zhang, Fei Huang, Jianhong Tu, Yang Su, Lianghao Deng, Yuxuan Liu, Yantao Liu, Dayiheng Liu, Tsung-Yi Ho Title: OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language Environment Simulation Arxiv: http://arxiv.org/abs/2604.10866v2 Abstract: AI agents are expected to perform professional work across hundreds of occupational...

Memory Transfer Learning: How Memories are Transferred Across Domains in Coding Agents 17.04.2026

🤗 Upvotes: 24 | cs. AI, cs. CL Authors: Kangsan Kim, Minki Kang, Taeil Kim, Yanlai Yang, Mengye Ren, Sung Ju Hwang Title: Memory Transfer Learning: How Memories are Transferred Across Domains in Coding Agents Arxiv: http://arxiv.org/abs/2604.14004v1 Abstract: Memory-based self-evolution has emerged as a promising paradigm for coding agents. However, existing approaches typically restrict memory u...

From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space 17.04.2026

🤗 Upvotes: 23 | cs. LG, cs. AI, cs. CL Authors: Yuqiao Tan, Minzheng Wang, Bo Liu, Zichen Liu, Tian Liang, Shizhu He, Jun Zhao, Kang Liu Title: From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space Arxiv: http://arxiv.org/abs/2604.14142v1 Abstract: While reinforcement learning with verifiable rewards (RLVR) significantly enhances LLM reasoning by optimizing the conditio...

Exploration and Exploitation Errors Are Measurable for Language Model Agents 17.04.2026

🤗 Upvotes: 22 | cs. AI Authors: Jaden Park, Jungtaek Kim, Jongwon Jeong, Robert D. Nowak, Kangwook Lee, Yong Jae Lee Title: Exploration and Exploitation Errors Are Measurable for Language Model Agents Arxiv: http://arxiv.org/abs/2604.13151v1 Abstract: Language Model (LM) agents are increasingly used in complex open-ended decision-making tasks, from AI coding to physical AI. A core requirement in...

ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents 16.04.2026

🤗 Upvotes: 123 | cs. LG, cs. AI, cs. CL, cs. CV Authors: Fei Tang, Zhiqiong Lu, Boxuan Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen Title: ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents Arxiv: http://arxiv.org/abs/2604.11784v1 Abstract: GUI agents drive applications through their visual interfaces instead of programmatic APIs, interacting with arbit...

Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe 16.04.2026

🤗 Upvotes: 62 | cs. LG, cs. AI, cs. CL Authors: Yaxuan Li, Yuxin Zuo, Bingxiang He, Jinqian Zhang, Chaojun Xiao, Cheng Qian, Tianyu Yu, Huan-ang Gao, Wenkai Yang, Zhiyuan Liu, Ning Ding Title: Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe Arxiv: http://arxiv.org/abs/2604.13016v2 Abstract: On-policy distillation (OPD) has become a core technique i...

Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization 16.04.2026

🤗 Upvotes: 27 | cs. AI, cs. LG Authors: Jiachen Zhu, Lingyu Yang, Rong Shan, Congmin Zheng, Zeyu Zheng, Weiwen Liu, Yong Yu, Weinan Zhang, Jianghao Lin Title: Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization Arxiv: http://arxiv.org/abs/2604.09574v1 Abstract: The rise of autonomous GUI agents has triggered adversarial countermeasures from digital platforms, yet existing researc...

SPPO: Sequence-Level PPO for Long-Horizon Reasoning Tasks 16.04.2026

🤗 Upvotes: 26 | cs. AI Authors: Tianyi Wang, Yixia Li, Long Li, Yibiao Chen, Shaohan Huang, Yun Chen, Peng Li, Yang Liu, Guanhua Chen Title: SPPO: Sequence-Level PPO for Long-Horizon Reasoning Tasks Arxiv: http://arxiv.org/abs/2604.08865v1 Abstract: Proximal Policy Optimization (PPO) is central to aligning Large Language Models (LLMs) in reasoning tasks with verifiable rewards. However, standard...

Toward Autonomous Long-Horizon Engineering for ML Research 16.04.2026

🤗 Upvotes: 25 | cs. CL Authors: Guoxin Chen, Jie Chen, Lei Chen, Jiale Zhao, Fanzhe Meng, Wayne Xin Zhao, Ruihua Song, Cheng Chen, Ji-Rong Wen, Kai Jia Title: Toward Autonomous Long-Horizon Engineering for ML Research Arxiv: http://arxiv.org/abs/2604.13018v1 Abstract: Autonomous AI research has advanced rapidly, but long-horizon ML research engineering remains difficult: agents must sustain coher...

BERT-as-a-Judge: A Robust Alternative to Lexical Methods for Efficient Reference-Based LLM Evaluation 16.04.2026

🤗 Upvotes: 21 | cs. CL, cs. AI Authors: Hippolyte Gisserot-Boukhlef, Nicolas Boizard, Emmanuel Malherbe, Céline Hudelot, Pierre Colombo Title: BERT-as-a-Judge: A Robust Alternative to Lexical Methods for Efficient Reference-Based LLM Evaluation Arxiv: http://arxiv.org/abs/2604.09497v1 Abstract: Accurate evaluation is central to the large language model (LLM) ecosystem, guiding model selection and...

QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation 15.04.2026

🤗 Upvotes: 112 | cs. LG, cs. AI, cs. PL, cs. SE, quant-ph Authors: Ali Slim, Haydar Hamieh, Jawad Kotaich, Yehya Ghosn, Mahdi Chehimi, Ammar Mohanna, Hasan Abed Al Kader Hammoud, Bernard Ghanem Title: QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation Arxiv: http://arxiv.org/abs/2604.08570v1 Abstract: Large Language Models (LLMs) are increasingly used for code g...

The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping 15.04.2026

🤗 Upvotes: 83 | cs. LG, cs. AI, cs. CL Authors: Yang Liu, Enxi Wang, Yufei Gao, Weixin Zhang, Bo Wang, Zhiyuan Zeng, Yikai Zhang, Yining Zheng, Xipeng Qiu Title: The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping Arxiv: http://arxiv.org/abs/2604.11297v1 Abstract: Despite the success of reinforcement learning for large language models, a common failure mode is reduced sampling diversity,...

OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation 15.04.2026

🤗 Upvotes: 60 | cs. CV Authors: Donghao Zhou, Guisheng Liu, Hao Yang, Jiatong Li, Jingyu Lin, Xiaohu Huang, Yichen Liu, Xin Gao, Cunjian Chen, Shilei Wen, Chi-Wing Fu, Pheng-Ann Heng Title: OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation Arxiv: http://arxiv.org/abs/2604.11804v1 Abstract: In this work, we study Human-Object Interaction Video Generation (HOIVG...

Attention Sink in Transformers: A Survey on Utilization, Interpretation, and Mitigation 15.04.2026

🤗 Upvotes: 58 | cs. LG Authors: Zunhai Su, Hengyuan Zhang, Wei Wu, Yifan Zhang, Yaxiu Liu, He Xiao, Qingyao Yang, Yuxuan Sun, Rui Yang, Chao Zhang, Keyu Fan, Weihao Ye, Jing Xiong, Hui Shen, Chaofan Tao, Taiqiang Wu, Zhongwei Wan, Yulei Qian, Yuchen Xie, Ngai Wong Title: Attention Sink in Transformers: A Survey on Utilization, Interpretation, and Mitigation Arxiv: http://arxiv.org/abs/2604.10098v...

Strips as Tokens: Artist Mesh Generation with Native UV Segmentation 15.04.2026

🤗 Upvotes: 46 | cs. CV, cs. CG, cs. GR Authors: Rui Xu, Dafei Qin, Kaichun Qiao, Qiujie Dong, Huaijin Pi, Qixuan Zhang, Longwen Zhang, Lan Xu, Jingyi Yu, Wenping Wang, Taku Komura Title: Strips as Tokens: Artist Mesh Generation with Native UV Segmentation Arxiv: http://arxiv.org/abs/2604.09132v1 Abstract: Recent advancements in autoregressive transformers have demonstrated remarkable potential fo...

Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator 15.04.2026

🤗 Upvotes: 39 | cs. CV, cs. AI Authors: Luozheng Qin, Jia Gong, Qian Qiao, Tianjiao Li, Li Xu, Haoyu Pan, Chao Qu, Zhiyu Tan, Hao Li Title: Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator Arxiv: http://arxiv.org/abs/2604.08121v1 Abstract: Unified multimodal models integrating visual understanding and generation face a fundamental challenge: visua...

Pseudo-Unification: Entropy Probing Reveals Divergent Information Patterns in Unified Multimodal Models 15.04.2026

🤗 Upvotes: 36 | cs. CV, cs. AI Authors: Songlin Yang, Xianghao Kong, Anyi Rao Title: Pseudo-Unification: Entropy Probing Reveals Divergent Information Patterns in Unified Multimodal Models Arxiv: http://arxiv.org/abs/2604.10949v1 Abstract: Unified multimodal models (UMMs) were designed to combine the reasoning ability of large language models (LLMs) with the generation capability of vision models...

CocoaBench: Evaluating Unified Digital Agents in the Wild 15.04.2026

🤗 Upvotes: 29 | cs. CL, cs. AI Authors: CocoaBench Team, Shibo Hao, Zhining Zhang, Zhiqi Liang, Tianyang Liu, Yuheng Zha, Qiyue Gao, Jixuan Chen, Zilong Wang, Zhoujun Cheng, Haoxiang Zhang, Junli Wang, Hexi Jin, Boyuan Zheng, Kun Zhou, Yu Wang, Feng Yao, Licheng Liu, Yijiang Li, Zhifei Li, Zhengtao Han, Pracha Promthaw, Tommaso Cerruti, Xiaohan Fu, Ziqiao Ma, Jingbo Shang, Lianhui Qin, Julian McA...

CodeTracer: Towards Traceable Agent States 15.04.2026

🤗 Upvotes: 29 | cs. SE, cs. AI Authors: Han Li, Yifan Yao, Letian Zhu, Rili Feng, Hongyi Ye, Jiaming Wang, Yancheng He, Pengyu Zou, Lehan Zhang, Xinping Lei, Haoyang Huang, Ken Deng, Ming Sun, Zhaoxiang Zhang, He Ye, Jiaheng Liu Title: CodeTracer: Towards Traceable Agent States Arxiv: http://arxiv.org/abs/2604.11641v2 Abstract: Code agents are advancing rapidly, but debugging them is becoming inc...

Listen to the Daily Paper Cast podcast in Replaio

Radio and podcasts in one app - free, with no sign-up. Install today and do not miss the launch

Get it on Google Play

Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.