Jingwen Liang, Gengyu Wang
Daily Paper Cast (Test)
About 10 AI papers every day.
Wo hören?
Podcasts in der App Replaio Radio Bald verfügbarPodcasts kommen bald in die App. Installiere sie jetzt und erlebe als Erster einen ganz neuen Blick auf Podcasts
Folgen
BitStack: Fine-Grained Size Control for Compressed Large Language Models in Variable Memory Environments 03.11.2024 17:57
🤗 Daily Paper Upvotes: 11 Authors: Xinghao Wang, Pengyu Wang, Bo Wang, Dong Zhang, Yunhua Zhou, Xipeng Qiu Categories: cs. CL, cs. AI, cs. CV, cs. LG Arxiv: http://arxiv.org/abs/2410.23918v1 Title: BitStack: Fine-Grained Size Control for Compressed Large Language Models in Variable Memory Environments Abstract: Large language models (LLMs) have revolutionized numerous applications, yet their depl...
SelfCodeAlign: Self-Alignment for Code Generation 03.11.2024 18:51
🤗 Daily Paper Upvotes: 11 Authors: Yuxiang Wei, Federico Cassano, Jiawei Liu, Yifeng Ding, Naman Jain, Zachary Mueller, Harm de Vries, Leandro von Werra, Arjun Guha, Lingming Zhang Categories: cs. CL, cs. LG, cs. SE Arxiv: http://arxiv.org/abs/2410.24198v1 Title: SelfCodeAlign: Self-Alignment for Code Generation Abstract: Instruction tuning is a supervised fine-tuning approach that significantly...
AAAR-1.0: Assessing AI's Potential to Assist Research 03.11.2024 22:23
🤗 Daily Paper Upvotes: 10 Authors: Renze Lou, Hanzi Xu, Sijia Wang, Jiangshu Du, Ryo Kamoi, Xiaoxin Lu, Jian Xie, Yuxuan Sun, Yusen Zhang, Jihyun Janice Ahn, Hongchao Fang, Zhuoyang Zou, Wenchao Ma, Xi Li, Kai Zhang, Congying Xia, Lifu Huang, Wenpeng Yin Categories: cs. CL Arxiv: http://arxiv.org/abs/2410.22394v1 Title: AAAR-1.0: Assessing AI's Potential to Assist Research Abstract: Numerous stud...
Learning Video Representations without Natural Videos 03.11.2024 22:48
🤗 Daily Paper Upvotes: 10 Authors: Xueyang Yu, Xinlei Chen, Yossi Gandelsman Categories: cs. CV Arxiv: http://arxiv.org/abs/2410.24213v1 Title: Learning Video Representations without Natural Videos Abstract: In this paper, we show that useful video representations can be learned from synthetic videos and natural images, without incorporating natural videos in the training. We propose a progressio...
BenchX: A Unified Benchmark Framework for Medical Vision-Language Pretraining on Chest X-Rays 03.11.2024 21:42
🤗 Daily Paper Upvotes: 7 Authors: Yang Zhou, Tan Li Hui Faith, Yanyu Xu, Sicong Leng, Xinxing Xu, Yong Liu, Rick Siow Mong Goh Categories: cs. CV Arxiv: http://arxiv.org/abs/2410.21969v1 Title: BenchX: A Unified Benchmark Framework for Medical Vision-Language Pretraining on Chest X-Rays Abstract: Medical Vision-Language Pretraining (MedVLP) shows promise in learning generalizable and transferable...
What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective 03.11.2024 3:48
🤗 Daily Paper Upvotes: 42 Authors: Ming Li, Yanhong Li, Tianyi Zhou Categories: cs. CL, cs. AI, cs. LG Arxiv: http://arxiv.org/abs/2410.23743v1 Title: What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective Abstract: What makes a difference in the post-training of LLMs? We investigate the training patterns of different layers in large language models (LLMs), t...
Unpacking SDXL Turbo: Interpreting Text-to-Image Models with Sparse Autoencoders 03.11.2024 4:18
🤗 Daily Paper Upvotes: 56 Authors: Viacheslav Surkov, Chris Wendler, Mikhail Terekhov, Justin Deschenaux, Robert West, Caglar Gulcehre Categories: cs. LG, cs. AI, cs. CV Arxiv: http://arxiv.org/abs/2410.22366v1 Title: Unpacking SDXL Turbo: Interpreting Text-to-Image Models with Sparse Autoencoders Abstract: Sparse autoencoders (SAEs) have become a core ingredient in the reverse engineering of lar...
Unpacking SDXL Turbo: Interpreting Text-to-Image Models with Sparse Autoencoders 03.11.2024 4:17
🤗 Daily Paper Upvotes: 56 Authors: Viacheslav Surkov, Chris Wendler, Mikhail Terekhov, Justin Deschenaux, Robert West, Caglar Gulcehre Categories: cs. LG, cs. AI, cs. CV Arxiv: http://arxiv.org/abs/2410.22366v1 Title: Unpacking SDXL Turbo: Interpreting Text-to-Image Models with Sparse Autoencoders Abstract: Sparse autoencoders (SAEs) have become a core ingredient in the reverse engineering of lar...
What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective 03.11.2024 3:14
🤗 Daily Paper Upvotes: 42 Authors: Ming Li, Yanhong Li, Tianyi Zhou Categories: cs. CL, cs. AI, cs. LG Arxiv: http://arxiv.org/abs/2410.23743v1 Title: What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective Abstract: What makes a difference in the post-training of LLMs? We investigate the training patterns of different layers in large language models (LLMs), t...
Unpacking SDXL Turbo: Interpreting Text-to-Image Models with Sparse Autoencoders 03.11.2024 3:16
🤗 Daily Paper Upvotes: 56 Authors: Viacheslav Surkov, Chris Wendler, Mikhail Terekhov, Justin Deschenaux, Robert West, Caglar Gulcehre Categories: cs. LG, cs. AI, cs. CV Arxiv: http://arxiv.org/abs/2410.22366v1 Title: Unpacking SDXL Turbo: Interpreting Text-to-Image Models with Sparse Autoencoders Abstract: Sparse autoencoders (SAEs) have become a core ingredient in the reverse engineering of lar...
What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective 03.11.2024 3:20
🤗 Daily Paper Upvotes: 42 Authors: Ming Li, Yanhong Li, Tianyi Zhou Categories: cs. CL, cs. AI, cs. LG Arxiv: http://arxiv.org/abs/2410.23743v1 Title: What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective Abstract: What makes a difference in the post-training of LLMs? We investigate the training patterns of different layers in large language models (LLMs), t...
ROCKET-1: Master Open-World Interaction with Visual-Temporal Context Prompting 30.10.2024 22:06
Published on Oct 21 2024
CompassJudger-1: All-in-one Judge Model Helps Model Evaluation and Evolution 28.10.2024 24:29
Published on Oct 21
Knowing When to Ask - Bridging Large Language Models and Data 28.10.2024 20:58
A description of my awesome episode
Ähnliche Podcasts
Replaio ist kein Herausgeber von Podcasts; die Namen der Sendungen, Cover und Audioinhalte gehören ihren Autoren und werden über öffentliche RSS-Feeds verbreitet