Skip to content
TrackPodcasts

Daily Paper Cast

Jingwen Liang, Gengyu Wang

EN1777 episodes
sciencetechnology

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: [email protected]:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-...

Episodes (1777)

MentraSuite: Post-Training Large Language Models for Mental Health Reasoning and...

Daily Paper Cast

Dec 17, 202523:46pending

EgoX: Egocentric Video Generation from a Single Exocentric Video

Daily Paper Cast

Dec 16, 202521:54pending

DentalGPT: Incentivizing Multimodal Complex Reasoning in Dentistry

Daily Paper Cast

Dec 16, 202518:26pending

SVG-T2I: Scaling Up Text-to-Image Latent Diffusion Model Without Variational Aut...

Daily Paper Cast

Dec 16, 202522:17pending

V-RGBX: Video Editing with Accurate Controls over Intrinsic Properties

Daily Paper Cast

Dec 16, 202523:26pending

T-pro 2.0: An Efficient Russian Hybrid-Reasoning Model and Playground

Daily Paper Cast

Dec 13, 202522:52pending

Long-horizon Reasoning Agent for Olympiad-Level Mathematical Problem Solving

Daily Paper Cast

Dec 13, 202523:06pending

Are We Ready for RL in Text-to-3D Generation? A Progressive Investigation

Daily Paper Cast

Dec 13, 202528:53pending

OPV: Outcome-based Process Verifier for Efficient Long Chain-of-Thought Verifica...

Daily Paper Cast

Dec 13, 202524:56pending

Achieving Olympia-Level Geometry Large Language Model Agent via Complexity Boost...

Daily Paper Cast

Dec 13, 202523:41pending

StereoWorld: Geometry-Aware Monocular-to-Stereo Video Generation

Daily Paper Cast

Dec 12, 202521:49pending

BrainExplore: Large-Scale Discovery of Interpretable Visual Representations in t...

Daily Paper Cast

Dec 12, 202522:44pending

OmniPSD: Layered PSD Generation with Diffusion Transformer

Daily Paper Cast

Dec 12, 202526:08pending

Composing Concepts from Images and Videos via Concept-prompt Binding

Daily Paper Cast

Dec 12, 202523:04pending

Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance

Daily Paper Cast

Dec 11, 202523:28pending

Visionary: The World Model Carrier Built on WebGPU-Powered Gaussian Splatting Pl...

Daily Paper Cast

Dec 11, 202525:38pending

Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quali...

Daily Paper Cast

Dec 11, 202523:04pending

OneStory: Coherent Multi-Shot Video Generation with Adaptive Memory

Daily Paper Cast

Dec 11, 202522:37pending

Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcem...

Daily Paper Cast

Dec 10, 202524:05pending

Beyond Real: Imaginary Extension of Rotary Position Embeddings for Long-Context...

Daily Paper Cast

Dec 10, 202521:49pending

Unified Video Editing with Temporal Reasoner

Daily Paper Cast

Dec 10, 202520:34pending

Voxify3D: Pixel Art Meets Volumetric Rendering

Daily Paper Cast

Dec 10, 202522:17pending

Scaling Zero-Shot Reference-to-Video Generation

Daily Paper Cast

Dec 10, 202523:52pending

DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems

Daily Paper Cast

Dec 10, 202524:53pending

TwinFlow: Realizing One-step Generation on Large Models with Self-adversarial Fl...

Daily Paper Cast

Dec 9, 202522:53pending

EditThinker: Unlocking Iterative Reasoning for Any Image Editor

Daily Paper Cast

Dec 9, 202526:31pending

From Imitation to Discrimination: Toward A Generalized Curriculum Advantage Mech...

Daily Paper Cast

Dec 9, 202523:39pending

EMMA: Efficient Multimodal Understanding, Generation, and Editing with a Unified...

Daily Paper Cast

Dec 9, 202524:33pending

DAComp: Benchmarking Data Agents across the Full Data Intelligence Lifecycle

Daily Paper Cast

Dec 6, 202527:25pending

Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Le...

Daily Paper Cast

Dec 6, 202525:15pending

Nex-N1: Agentic Models Trained via a Unified Ecosystem for Large-Scale Environme...

Daily Paper Cast

Dec 6, 202524:40pending

ARM-Thinker: Reinforcing Multimodal Generative Reward Models with Agentic Tool U...

Daily Paper Cast

Dec 6, 202523:40pending

Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution...

Daily Paper Cast

Dec 6, 202521:09pending

Semantics Lead the Way: Harmonizing Semantic and Texture Modeling with Asynchron...

Daily Paper Cast

Dec 6, 202525:40pending

PaperDebugger: A Plugin-Based Multi-Agent System for In-Editor Academic Writing,...

Daily Paper Cast

Dec 6, 202523:24pending

Qwen3-VL Technical Report

Daily Paper Cast

Dec 5, 202527:05pending

Steering Vision-Language-Action Models as Anti-Exploration: A Test-Time Scaling...

Daily Paper Cast

Dec 5, 202522:30pending

PretrainZero: Reinforcement Active Pretraining

Daily Paper Cast

Dec 5, 202522:48pending

ViDiC: Video Difference Captioning

Daily Paper Cast

Dec 5, 202523:33pending

DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models

Daily Paper Cast

Dec 4, 202522:11pending

ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration

Daily Paper Cast

Dec 4, 202521:23pending

MultiShotMaster: A Controllable Multi-Shot Video Generation Framework

Daily Paper Cast

Dec 4, 202527:19pending

MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory

Daily Paper Cast

Dec 4, 202523:42pending

Skywork-R1V4: Toward Agentic Multimodal Intelligence through Interleaved Thinkin...

Daily Paper Cast

Dec 4, 202525:38pending

DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Vi...

Daily Paper Cast

Dec 4, 202520:31pending

Guided Self-Evolving LLMs with Minimal Human Supervision

Daily Paper Cast

Dec 4, 202525:25pending

SimScale: Learning to Drive via Real-World Simulation at Scale

Daily Paper Cast

Dec 4, 202522:38pending

InnoGym: Benchmarking the Innovation Potential of AI Agents

Daily Paper Cast

Dec 4, 202523:37pending

LongVT: Incentivizing "Thinking with Long Videos" via Native Tool Calling

Daily Paper Cast

Dec 3, 202523:00pending

Envision: Benchmarking Unified Understanding & Generation for Causal World Proce...

Daily Paper Cast

Dec 3, 202524:10pending
......
Daily Paper Cast | TrackPodcasts.com