Jingwen Liang, Gengyu Wang

Daily Paper Cast

Science EN ↓ 2000 episodes

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: dailypapercast.ai@gmail.comCreator:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-cast/id1777620236Cover Image by Kawen Kuang https://kawen.art

Author

Jingwen Liang, Gengyu Wang

Category

Science

Latest episode

Jul 11, 2026

Where to listen?

Podcasts in the app Replaio Radio Coming soon

Podcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts

Get it on Google Play Install for free Android 5M+ downloads · 4.8 rating iOS soon

Episodes

WebWeaver: Structuring Web-Scale Evidence with Dynamic Outlines for Open-Ended Deep Research 18.09.2025

🤗 Upvotes: 77 | cs. CL Authors: Zijian Li, Xin Guan, Bo Zhang, Shen Huang, Houquan Zhou, Shaopeng Lai, Ming Yan, Yong Jiang, Pengjun Xie, Fei Huang, Jun Zhang, Jingren Zhou Title: WebWeaver: Structuring Web-Scale Evidence with Dynamic Outlines for Open-Ended Deep Research Arxiv: http://arxiv.org/abs/2509.13312v1 Abstract: This paper tackles open-ended deep research (OEDR), a complex challenge whe...

Scaling Agents via Continual Pre-training 18.09.2025

🤗 Upvotes: 62 | cs. CL Authors: Liangcai Su, Zhen Zhang, Guangyu Li, Zhuo Chen, Chenxi Wang, Maojia Song, Xinyu Wang, Kuan Li, Jialong Wu, Xuanzhong Chen, Zile Qiao, Zhongwang Zhang, Huifeng Yin, Shihao Cai, Runnan Fang, Zhengwei Tao, Wenbiao Yin, Chenxiong Qian, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou Title: Scaling Agents via Continual Pre-training Arxiv: http://arxiv.org/abs/2509.1331...

WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning 18.09.2025

🤗 Upvotes: 54 | cs. LG, cs. CL Authors: Kuan Li, Zhongwang Zhang, Huifeng Yin, Rui Ye, Yida Zhao, Liwen Zhang, Litu Ou, Dingchu Zhang, Xixi Wu, Jialong Wu, Xinyu Wang, Zile Qiao, Zhen Zhang, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou Title: WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning Arxiv: http://arxiv.org/abs/2509.13305v1 A...

Towards General Agentic Intelligence via Environment Scaling 18.09.2025

🤗 Upvotes: 51 | cs. CL Authors: Runnan Fang, Shihao Cai, Baixuan Li, Jialong Wu, Guangyu Li, Wenbiao Yin, Xinyu Wang, Xiaobin Wang, Liangcai Su, Zhen Zhang, Shibin Wu, Zhengwei Tao, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou Title: Towards General Agentic Intelligence via Environment Scaling Arxiv: http://arxiv.org/abs/2509.13311v1 Abstract: Advanced agentic intelligence is a prerequisite f...

WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents 18.09.2025

🤗 Upvotes: 49 | cs. CL Authors: Zile Qiao, Guoxin Chen, Xuanzhong Chen, Donglei Yu, Wenbiao Yin, Xinyu Wang, Zhen Zhang, Baixuan Li, Huifeng Yin, Kuan Li, Rui Min, Minpeng Liao, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou Title: WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents Arxiv: http://arxiv.org/abs/2509.13309v1 Abstract: Recent advances in deep-research s...

ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization 18.09.2025

🤗 Upvotes: 47 | cs. CL Authors: Xixi Wu, Kuan Li, Yida Zhao, Liwen Zhang, Litu Ou, Huifeng Yin, Zhongwang Zhang, Yong Jiang, Pengjun Xie, Fei Huang, Minhao Cheng, Shuai Wang, Hong Cheng, Jingren Zhou Title: ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization Arxiv: http://arxiv.org/abs/2509.13313v1 Abstract: Large Language Model (LLM)-based web agents demonstrate strong pe...

Single-stream Policy Optimization 18.09.2025

🤗 Upvotes: 24 | cs. LG, cs. AI, stat. ML Authors: Zhongwen Xu, Zihan Ding Title: Single-stream Policy Optimization Arxiv: http://arxiv.org/abs/2509.13232v1 Abstract: We revisit policy-gradient optimization for Large Language Models (LLMs) from a single-stream perspective. Prevailing group-based methods like GRPO reduce variance with on-the-fly baselines but suffer from critical flaws: frequent de...

OmniWorld: A Multi-Domain and Multi-Modal Dataset for 4D World Modeling 17.09.2025

🤗 Upvotes: 75 | cs. CV Authors: Yang Zhou, Yifan Wang, Jianjun Zhou, Wenzheng Chang, Haoyu Guo, Zizun Li, Kaijing Ma, Xinyue Li, Yating Wang, Haoyi Zhu, Mingyu Liu, Dingning Liu, Jiange Yang, Zhoujie Fu, Junyi Chen, Chunhua Shen, Jiangmiao Pang, Kaipeng Zhang, Tong He Title: OmniWorld: A Multi-Domain and Multi-Modal Dataset for 4D World Modeling Arxiv: http://arxiv.org/abs/2509.12201v1 Abstract:...

UI-S1: Advancing GUI Automation via Semi-online Reinforcement Learning 17.09.2025

🤗 Upvotes: 35 | cs. LG, cs. AI Authors: Zhengxi Lu, Jiabo Ye, Fei Tang, Yongliang Shen, Haiyang Xu, Ziwei Zheng, Weiming Lu, Ming Yan, Fei Huang, Jun Xiao, Yueting Zhuang Title: UI-S1: Advancing GUI Automation via Semi-online Reinforcement Learning Arxiv: http://arxiv.org/abs/2509.11543v1 Abstract: Graphical User Interface (GUI) agents have demonstrated remarkable progress in automating complex u...

InternScenes: A Large-scale Simulatable Indoor Scene Dataset with Realistic Layouts 17.09.2025

🤗 Upvotes: 23 | cs. CV, cs. RO Authors: Weipeng Zhong, Peizhou Cao, Yichen Jin, Li Luo, Wenzhe Cai, Jingli Lin, Hanqing Wang, Zhaoyang Lyu, Tai Wang, Bo Dai, Xudong Xu, Jiangmiao Pang Title: InternScenes: A Large-scale Simulatable Indoor Scene Dataset with Realistic Layouts Arxiv: http://arxiv.org/abs/2509.10813v1 Abstract: The advancement of Embodied AI heavily relies on large-scale, simulatable...

IntrEx: A Dataset for Modeling Engagement in Educational Conversations 16.09.2025

🤗 Upvotes: 22 | cs. CL Authors: Xingwei Tan, Mahathi Parvatham, Chiara Gambi, Gabriele Pergola Title: IntrEx: A Dataset for Modeling Engagement in Educational Conversations Arxiv: http://arxiv.org/abs/2509.06652v1 Abstract: Engagement and motivation are crucial for second-language acquisition, yet maintaining learner interest in educational conversations remains a challenge. While prior research...

The Illusion of Diminishing Returns: Measuring Long Horizon Execution in LLMs 16.09.2025

🤗 Upvotes: 21 | cs. AI Authors: Akshit Sinha, Arvindh Arun, Shashwat Goel, Steffen Staab, Jonas Geiping Title: The Illusion of Diminishing Returns: Measuring Long Horizon Execution in LLMs Arxiv: http://arxiv.org/abs/2509.09677v1 Abstract: Does continued scaling of large language models (LLMs) yield diminishing returns? Real-world value often stems from the length of task an agent can complete. W...

VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model 13.09.2025

🤗 Upvotes: 114 | cs. RO Authors: Yihao Wang, Pengxiang Ding, Lingxiao Li, Can Cui, Zirui Ge, Xinyang Tong, Wenxuan Song, Han Zhao, Wei Zhao, Pengxu Hou, Siteng Huang, Yifan Tang, Wenhui Wang, Ru Zhang, Jianyi Liu, Donglin Wang Title: VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model Arxiv: http://arxiv.org/abs/2509.09372v1 Abstract: Vision-Language-Action (VLA) models...

HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning 13.09.2025

🤗 Upvotes: 88 | cs. CV, cs. MM Authors: Liyang Chen, Tianxiang Ma, Jiawei Liu, Bingchuan Li, Zhuowei Chen, Lijie Liu, Xu He, Gen Li, Qian He, Zhiyong Wu Title: HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning Arxiv: http://arxiv.org/abs/2509.08519v1 Abstract: Human-Centric Video Generation (HCVG) methods seek to synthesize human videos from multimodal inputs, includ...

SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning 13.09.2025

🤗 Upvotes: 57 | cs. RO, cs. AI, cs. CL, cs. LG Authors: Haozhan Li, Yuxin Zuo, Jiale Yu, Yuhao Zhang, Zhaohui Yang, Kaiyan Zhang, Xuekai Zhu, Yuchen Zhang, Tianxing Chen, Ganqu Cui, Dehui Wang, Dingxiang Luo, Yuchen Fan, Youbang Sun, Jia Zeng, Jiangmiao Pang, Shanghang Zhang, Yu Wang, Yao Mu, Bowen Zhou, Ning Ding Title: SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning Arxiv: http://...

EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs 13.09.2025

🤗 Upvotes: 52 | cs. CL, cs. AI, cs. SD Authors: Yuhao Zhang, Yuhao Du, Zhanchen Dai, Xiangnan Ma, Kaiqi Kou, Benyou Wang, Haizhou Li Title: EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs Arxiv: http://arxiv.org/abs/2509.09174v1 Abstract: Speech-to-speech large language models (SLLMs) are attracting increasing attention. Derived from text-based large la...

Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents 13.09.2025

🤗 Upvotes: 34 | cs. LG, cs. CL Authors: Jiawei Wang, Jiacai Liu, Yuqian Fu, Yingru Li, Xintao Wang, Yuan Lin, Yu Yue, Lin Zhang, Yang Wang, Ke Wang Title: Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents Arxiv: http://arxiv.org/abs/2509.09265v1 Abstract: In long-horizon tasks, recent agents based on Large Language Models (LLMs) face a significant challenge th...

Kling-Avatar: Grounding Multimodal Instructions for Cascaded Long-Duration Avatar Animation Synthesis 13.09.2025

🤗 Upvotes: 34 | cs. CV Authors: Yikang Ding, Jiwen Liu, Wenyuan Zhang, Zekun Wang, Wentao Hu, Liyuan Cui, Mingming Lao, Yingchao Shao, Hui Liu, Xiaohan Li, Ming Chen, Xiaoqiang Liu, Yu-Shen Liu, Pengfei Wan Title: Kling-Avatar: Grounding Multimodal Instructions for Cascaded Long-Duration Avatar Animation Synthesis Arxiv: http://arxiv.org/abs/2509.09595v1 Abstract: Recent advances in audio-driven...

FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark 13.09.2025

🤗 Upvotes: 28 | cs. CV, cs. CL Authors: Rongyao Fang, Aldrich Yu, Chengqi Duan, Linjiang Huang, Shuai Bai, Yuxuan Cai, Kun Wang, Si Liu, Xihui Liu, Hongsheng Li Title: FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark Arxiv: http://arxiv.org/abs/2509.09680v1 Abstract: The advancement of open-source text-to-image (T2I) models has been hin...

Can Understanding and Generation Truly Benefit Together -- or Just Coexist? 13.09.2025

🤗 Upvotes: 25 | cs. CV Authors: Zhiyuan Yan, Kaiqing Lin, Zongjian Li, Junyan Ye, Hui Han, Zhendong Wang, Hao Liu, Bin Lin, Hao Li, Xue Xu, Xinyan Xiao, Jingdong Wang, Haifeng Wang, Li Yuan Title: Can Understanding and Generation Truly Benefit Together -- or Just Coexist? Arxiv: http://arxiv.org/abs/2509.09666v1 Abstract: In this paper, we introduce an insightful paradigm through the Auto-Encoder...

MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining 13.09.2025

🤗 Upvotes: 22 | cs. CL, cs. AI Authors: Haoyu Dong, Pengkun Zhang, Mingzhe Lu, Yanzhen Shen, Guolin Ke Title: MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining Arxiv: http://arxiv.org/abs/2509.06806v3 Abstract: Large language models (LLMs) possess broad world knowledge and strong general-purpose reasoning ability, yet they struggle to learn from many in-context ex...

A Survey of Reinforcement Learning for Large Reasoning Models 12.09.2025

🤗 Upvotes: 99 | cs. CL, cs. AI, cs. LG Authors: Kaiyan Zhang, Yuxin Zuo, Bingxiang He, Youbang Sun, Runze Liu, Che Jiang, Yuchen Fan, Kai Tian, Guoli Jia, Pengfei Li, Yu Fu, Xingtai Lv, Yuchen Zhang, Sihang Zeng, Shang Qu, Haozhan Li, Shijie Wang, Yuru Wang, Xinwei Long, Fangfu Liu, Xiang Xu, Jiaze Ma, Xuekai Zhu, Ermo Hua, Yihao Liu, Zonglin Li, Huayu Chen, Xiaoye Qu, Yafu Li, Weize Chen, Zhenzh...

RewardDance: Reward Scaling in Visual Generation 12.09.2025

🤗 Upvotes: 50 | cs. CV Authors: Jie Wu, Yu Gao, Zilyu Ye, Ming Li, Liang Li, Hanzhong Guo, Jie Liu, Zeyue Xue, Xiaoxia Hou, Wei Liu, Yan Zeng, Weilin Huang Title: RewardDance: Reward Scaling in Visual Generation Arxiv: http://arxiv.org/abs/2509.08826v1 Abstract: Reward Models (RMs) are critical for improving generation models via Reinforcement Learning (RL), yet the RM scaling paradigm in visual...

3D and 4D World Modeling: A Survey 12.09.2025

🤗 Upvotes: 40 | cs. CV, cs. RO Authors: Lingdong Kong, Wesley Yang, Jianbiao Mei, Youquan Liu, Ao Liang, Dekai Zhu, Dongyue Lu, Wei Yin, Xiaotao Hu, Mingkai Jia, Junyuan Deng, Kaiwen Zhang, Yang Wu, Tianyi Yan, Shenyuan Gao, Song Wang, Linfeng Li, Liang Pan, Yong Liu, Jianke Zhu, Wei Tsang Ooi, Steven C. H. Hoi, Ziwei Liu Title: 3D and 4D World Modeling: A Survey Arxiv: http://arxiv.org/abs/2509....

AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning 12.09.2025

🤗 Upvotes: 21 | cs. LG, cs. AI, cs. CL Authors: Zhiheng Xi, Jixuan Huang, Chenyang Liao, Baodai Huang, Honglin Guo, Jiaqi Liu, Rui Zheng, Junjie Ye, Jiazheng Zhang, Wenxiang Chen, Wei He, Yiwen Ding, Guanyu Li, Zehui Chen, Zhengyin Du, Xuesong Yao, Yufei Xu, Jiecao Chen, Tao Gui, Zuxuan Wu, Qi Zhang, Xuanjing Huang, Yu-Gang Jiang Title: AgentGym-RL: Training LLM Agents for Long-Horizon Decision M...

Listen to the Daily Paper Cast podcast in Replaio

Radio and podcasts in one app - free, with no sign-up. Install today and do not miss the launch

Get it on Google Play

Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.