Skip to content
TrackPodcasts

Daily Paper Cast

Jingwen Liang, Gengyu Wang

EN1777 episodes
sciencetechnology

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: [email protected]:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-...

Episodes (1777)

Video models are zero-shot learners and reasoners

Daily Paper Cast

Sep 26, 202524:55pending

SIM-CoT: Supervised Implicit Chain-of-Thought

Daily Paper Cast

Sep 26, 202524:06pending

Baseer: A Vision-Language Model for Arabic Document-to-Markdown OCR

Daily Paper Cast

Sep 25, 202520:21pending

Reinforcement Learning on Pre-Training Data

Daily Paper Cast

Sep 25, 202520:55pending

Do You Need Proprioceptive States in Visuomotor Policies?

Daily Paper Cast

Sep 25, 202526:01pending

MiniCPM-V 4.5: Cooking Efficient MLLMs via Architecture, Data, and Training Reci...

Daily Paper Cast

Sep 25, 202525:04pending

LIMI: Less is More for Agency

Daily Paper Cast

Sep 24, 202521:27pending

Qwen3-Omni Technical Report

Daily Paper Cast

Sep 24, 202515:18pending

OmniInsert: Mask-Free Video Insertion of Any Reference via Diffusion Transformer...

Daily Paper Cast

Sep 24, 202522:54pending

OnePiece: Bringing Context Engineering and Reasoning to Industrial Cascade Ranki...

Daily Paper Cast

Sep 24, 202523:43pending

TempSamp-R1: Effective Temporal Sampling with Reinforcement Fine-Tuning for Vide...

Daily Paper Cast

Sep 24, 202526:52pending

RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation

Daily Paper Cast

Sep 23, 202528:25pending

MANZANO: A Simple and Scalable Unified Multimodal Model with a Hybrid Vision Tok...

Daily Paper Cast

Sep 23, 202525:40pending

Latent Zoning Network: A Unified Principle for Generative Modeling, Representati...

Daily Paper Cast

Sep 23, 202522:42pending

ScaleCUA: Scaling Open-Source Computer Use Agents with Cross-Platform Data

Daily Paper Cast

Sep 20, 202523:23pending

FlowRL: Matching Reward Distributions for LLM Reasoning

Daily Paper Cast

Sep 20, 202519:46pending

Reasoning over Boundaries: Enhancing Specification Alignment via Test-time Delib...

Daily Paper Cast

Sep 20, 202521:17pending

Evolving Language Models without Labels: Majority Drives Selection, Novelty Prom...

Daily Paper Cast

Sep 20, 202522:31pending

FinSearchComp: Towards a Realistic, Expert-Level Evaluation of Financial Search...

Daily Paper Cast

Sep 20, 202526:05pending

Understand Before You Generate: Self-Guided Training for Autoregressive Image Ge...

Daily Paper Cast

Sep 20, 202521:13pending

Hala Technical Report: Building Arabic-Centric Instruction & Translation Models...

Daily Paper Cast

Sep 19, 202521:36pending

SAIL-VL2 Technical Report

Daily Paper Cast

Sep 19, 202524:30pending

PANORAMA: The Rise of Omnidirectional Vision in the Embodied AI Era

Daily Paper Cast

Sep 19, 202520:16pending

WebWeaver: Structuring Web-Scale Evidence with Dynamic Outlines for Open-Ended D...

Daily Paper Cast

Sep 18, 202519:54pending

Scaling Agents via Continual Pre-training

Daily Paper Cast

Sep 18, 202523:43pending

WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Sc...

Daily Paper Cast

Sep 18, 202522:05pending

Towards General Agentic Intelligence via Environment Scaling

Daily Paper Cast

Sep 18, 202523:04pending

WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents

Daily Paper Cast

Sep 18, 202520:37pending

ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization

Daily Paper Cast

Sep 18, 202519:21pending

Single-stream Policy Optimization

Daily Paper Cast

Sep 18, 202521:45pending

OmniWorld: A Multi-Domain and Multi-Modal Dataset for 4D World Modeling

Daily Paper Cast

Sep 17, 202522:32pending

UI-S1: Advancing GUI Automation via Semi-online Reinforcement Learning

Daily Paper Cast

Sep 17, 202520:22pending

InternScenes: A Large-scale Simulatable Indoor Scene Dataset with Realistic Layo...

Daily Paper Cast

Sep 17, 202521:12pending

IntrEx: A Dataset for Modeling Engagement in Educational Conversations

Daily Paper Cast

Sep 16, 202524:12pending

The Illusion of Diminishing Returns: Measuring Long Horizon Execution in LLMs

Daily Paper Cast

Sep 16, 202524:03pending

VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model

Daily Paper Cast

Sep 13, 202521:33pending

HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning

Daily Paper Cast

Sep 13, 202524:06pending

SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning

Daily Paper Cast

Sep 13, 202524:58pending

EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-...

Daily Paper Cast

Sep 13, 202519:21pending

Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM...

Daily Paper Cast

Sep 13, 202520:50pending

Kling-Avatar: Grounding Multimodal Instructions for Cascaded Long-Duration Avata...

Daily Paper Cast

Sep 13, 202525:00pending

FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset an...

Daily Paper Cast

Sep 13, 202526:55pending

Can Understanding and Generation Truly Benefit Together -- or Just Coexist?

Daily Paper Cast

Sep 13, 202524:24pending

MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraini...

Daily Paper Cast

Sep 13, 202522:59pending

A Survey of Reinforcement Learning for Large Reasoning Models

Daily Paper Cast

Sep 12, 202520:52pending

RewardDance: Reward Scaling in Visual Generation

Daily Paper Cast

Sep 12, 202521:27pending

3D and 4D World Modeling: A Survey

Daily Paper Cast

Sep 12, 202520:25pending

AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-...

Daily Paper Cast

Sep 12, 202524:44pending

Parallel-R1: Towards Parallel Thinking via Reinforcement Learning

Daily Paper Cast

Sep 11, 202523:21pending

Visual Representation Alignment for Multimodal Large Language Models

Daily Paper Cast

Sep 11, 202526:13pending
......
Daily Paper Cast | TrackPodcasts.com