Skip to content
TrackPodcasts

Daily Paper Cast

Jingwen Liang, Gengyu Wang

EN1777 episodes
sciencetechnology

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: [email protected]:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-...

Episodes (1777)

Stabilizing Reinforcement Learning with LLMs: Formulation and Practices

Daily Paper Cast

Dec 3, 202519:41pending

How Far Are We from Genuinely Useful Deep Research Agents?

Daily Paper Cast

Dec 3, 202524:37pending

What about gravity in video generation? Post-Training Newton's Laws with Verifia...

Daily Paper Cast

Dec 3, 202522:15pending

Infinity-RoPE: Action-Controllable Infinite Video Generation Emerges From Autore...

Daily Paper Cast

Dec 3, 202519:09pending

The Consistency Critic: Correcting Inconsistencies in Generated Images via Refer...

Daily Paper Cast

Dec 3, 202524:04pending

TUNA: Taming Unified Visual Representations for Native Unified Multimodal Models

Daily Paper Cast

Dec 3, 202524:58pending

LFM2 Technical Report

Daily Paper Cast

Dec 3, 202522:37pending

Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffu...

Daily Paper Cast

Dec 2, 202524:43pending

REASONEDIT: Towards Reasoning-Enhanced Image Editing Models

Daily Paper Cast

Dec 2, 202521:40pending

Vision Bridge Transformer at Scale

Daily Paper Cast

Dec 2, 202521:48pending

DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning

Daily Paper Cast

Dec 2, 202521:10pending

Architecture Decoupling Is Not All You Need For Unified Multimodal Model

Daily Paper Cast

Dec 2, 202520:55pending

Multimodal Evaluation of Russian-language Architectures

Daily Paper Cast

Nov 28, 202524:48pending

Latent Collaboration in Multi-Agent Systems

Daily Paper Cast

Nov 28, 202526:12pending

Inferix: A Block-Diffusion based Next-Generation Inference Engine for World Simu...

Daily Paper Cast

Nov 28, 202518:26pending

GigaEvo: An Open Source Optimization Framework Powered By LLMs And Evolution Alg...

Daily Paper Cast

Nov 27, 202523:40pending

MedSAM3: Delving into Segment Anything with Medical Concepts

Daily Paper Cast

Nov 27, 202524:21pending

Agent0-VL: Exploring Self-Evolving Agent for Tool-Integrated Vision-Language Rea...

Daily Paper Cast

Nov 27, 202522:42pending

SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Pre...

Daily Paper Cast

Nov 27, 202519:11pending

iMontage: Unified, Versatile, Highly Dynamic Many-to-many Image Generation

Daily Paper Cast

Nov 27, 202525:05pending

Does Understanding Inform Generation in Unified Multimodal Models? From Analysis...

Daily Paper Cast

Nov 27, 202525:10pending

GigaWorld-0: World Models as Data Engine to Empower Embodied AI

Daily Paper Cast

Nov 27, 202522:27pending

SSA: Sparse Sparse Attention by Aligning Full and Sparse Attention Outputs in Fe...

Daily Paper Cast

Nov 27, 202521:32pending

Soft Adaptive Policy Optimization

Daily Paper Cast

Nov 27, 202524:08pending

General Agentic Memory Via Deep Research

Daily Paper Cast

Nov 26, 202525:36pending

AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning

Daily Paper Cast

Nov 26, 202523:00pending

Computer-Use Agents as Judges for Generative User Interface

Daily Paper Cast

Nov 26, 202525:50pending

DeCo: Frequency-Decoupled Pixel Diffusion for End-to-End Image Generation

Daily Paper Cast

Nov 26, 202525:10pending

DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research

Daily Paper Cast

Nov 26, 202520:31pending

UltraFlux: Data-Model Co-Design for High-quality Native 4K Text-to-Image Generat...

Daily Paper Cast

Nov 26, 202522:20pending

In-Video Instructions: Visual Signals as Generative Control

Daily Paper Cast

Nov 26, 202522:26pending

OpenMMReasoner: Pushing the Frontiers for Multimodal Reasoning with an Open and...

Daily Paper Cast

Nov 25, 202521:24pending

Unveiling Intrinsic Dimension of Texts: from Academic Abstract to Creative Story

Daily Paper Cast

Nov 25, 202522:13pending

GeoVista: Web-Augmented Agentic Visual Reasoning for Geolocalization

Daily Paper Cast

Nov 25, 202521:40pending

SAM 3: Segment Anything with Concepts

Daily Paper Cast

Nov 25, 202523:53pending

Reasoning via Video: The First Evaluation of Video Models' Reasoning Abilities t...

Daily Paper Cast

Nov 21, 202525:59pending

Kandinsky 5.0: A Family of Foundation Models for Image and Video Generation

Daily Paper Cast

Nov 21, 202524:57pending

What Does It Take to Be a Good AI Research Agent? Studying the Role of Ideation...

Daily Paper Cast

Nov 21, 202522:40pending

VisPlay: Self-Evolving Vision-Language Models from Images

Daily Paper Cast

Nov 21, 202522:28pending

Instruction-Guided Lesion Segmentation for Chest X-rays with Automatically Gener...

Daily Paper Cast

Nov 21, 202519:22pending

VIDEOP2R: Video Understanding from Perception to Reasoning

Daily Paper Cast

Nov 20, 202525:08pending

Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models

Daily Paper Cast

Nov 20, 202524:58pending

AraLingBench A Human-Annotated Benchmark for Evaluating Arabic Linguistic Capabi...

Daily Paper Cast

Nov 20, 202523:48pending

A Style is Worth One Code: Unlocking Code-to-Style Image Generation with Discret...

Daily Paper Cast

Nov 20, 202523:48pending

Can World Simulators Reason? Gen-ViRe: A Generative Visual Reasoning Benchmark

Daily Paper Cast

Nov 20, 202522:39pending

MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Vis...

Daily Paper Cast

Nov 20, 202524:27pending

REVISOR: Beyond Textual Reflection, Towards Multimodal Introspective Reasoning i...

Daily Paper Cast

Nov 20, 202526:47pending

Uni-MoE-2.0-Omni: Scaling Language-Centric Omnimodal Large Model with Advanced M...

Daily Paper Cast

Nov 19, 202524:24pending

P1: Mastering Physics Olympiads with Reinforcement Learning

Daily Paper Cast

Nov 19, 202522:16pending

MiroThinker: Pushing the Performance Boundaries of Open-Source Research Agents v...

Daily Paper Cast

Nov 19, 202527:44pending
......