Skip to content
TrackPodcasts

Daily Paper Cast

Jingwen Liang, Gengyu Wang

EN1777 episodes
sciencetechnology

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: [email protected]:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-...

Episodes (1777)

TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times

Daily Paper Cast

Dec 26, 202521:22pending

Learning to Reason in 4D: Dynamic Spatial Understanding for Vision Language Mode...

Daily Paper Cast

Dec 26, 202522:56pending

DreaMontage: Arbitrary Frame-Guided One-Shot Video Generation

Daily Paper Cast

Dec 26, 202521:35pending

T2AV-Compass: Towards Unified Evaluation for Text-to-Audio-Video Generation

Daily Paper Cast

Dec 26, 202520:49pending

SemanticGen: Video Generation in Semantic Space

Daily Paper Cast

Dec 25, 202522:13pending

Bottom-up Policy Optimization: Your Language Model Policy Secretly Contains Inte...

Daily Paper Cast

Dec 25, 202527:28pending

LongVideoAgent: Multi-Agent Reasoning with Long Videos

Daily Paper Cast

Dec 25, 202522:12pending

SpatialTree: How Spatial Abilities Branch Out in MLLMs

Daily Paper Cast

Dec 25, 202522:10pending

DataFlow: An LLM-Driven Framework for Unified Data Preparation and Workflow Auto...

Daily Paper Cast

Dec 24, 202524:05pending

The Prism Hypothesis: Harmonizing Semantic and Pixel Representations via Unified...

Daily Paper Cast

Dec 24, 202526:13pending

Region-Constraint In-Context Generation for Instructional Video Editing

Daily Paper Cast

Dec 24, 202521:07pending

QuCo-RAG: Quantifying Uncertainty from the Pre-training Corpus for Dynamic Retri...

Daily Paper Cast

Dec 24, 202524:14pending

Infinite-Homography as Robust Conditioning for Camera-Controlled Video Generatio...

Daily Paper Cast

Dec 24, 202524:41pending

Can LLMs Estimate Student Struggles? Human-AI Difficulty Alignment with Proficie...

Daily Paper Cast

Dec 24, 202525:57pending

Probing Scientific General Intelligence of LLMs with Scientist-Aligned Workflows

Daily Paper Cast

Dec 23, 202524:01pending

PhysBrain: Human Egocentric Data as a Bridge from Vision Language Models to Phys...

Daily Paper Cast

Dec 23, 202525:33pending

When Reasoning Meets Its Laws

Daily Paper Cast

Dec 23, 202521:45pending

Seed-Prover 1.5: Mastering Undergraduate-Level Theorem Proving via Learning from...

Daily Paper Cast

Dec 23, 202525:34pending

4D-RGPT: Toward Region-level 4D Understanding via Perceptual Distillation

Daily Paper Cast

Dec 23, 202526:30pending

Both Semantics and Reconstruction Matter: Making Representation Encoders Ready f...

Daily Paper Cast

Dec 23, 202523:40pending

Are We on the Right Way to Assessing LLM-as-a-Judge?

Daily Paper Cast

Dec 23, 202523:16pending

Kling-Omni Technical Report

Daily Paper Cast

Dec 20, 202524:17pending

Adaptation of Agentic AI

Daily Paper Cast

Dec 20, 202526:20pending

LLaDA2.0: Scaling Up Diffusion Language Models to 100B

Daily Paper Cast

Dec 20, 202526:32pending

Next-Embedding Prediction Makes Strong Vision Learners

Daily Paper Cast

Dec 20, 202522:00pending

StereoPilot: Learning Unified and Efficient Stereo Conversion via Generative Pri...

Daily Paper Cast

Dec 20, 202524:04pending

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Daily Paper Cast

Dec 20, 202522:14pending

Depth Any Panoramas: A Foundation Model for Panoramic Depth Estimation

Daily Paper Cast

Dec 20, 202521:29pending

Generative Refocusing: Flexible Defocus Control from a Single Image

Daily Paper Cast

Dec 20, 202525:27pending

DeContext as Defense: Safe Image Editing in Diffusion Transformers

Daily Paper Cast

Dec 20, 202523:34pending

Step-GUI Technical Report

Daily Paper Cast

Dec 19, 202526:21pending

DEER: Draft with Diffusion, Verify with Autoregressive Models

Daily Paper Cast

Dec 19, 202525:44pending

Fast and Accurate Causal Parallel Decoding using Jacobi Forcing

Daily Paper Cast

Dec 19, 202521:47pending

HyperVL: An Efficient and Dynamic Multimodal Large Language Model for Edge Devic...

Daily Paper Cast

Dec 19, 202522:07pending

Puzzle Curriculum GRPO for Vision-Centric Reasoning

Daily Paper Cast

Dec 19, 202525:36pending

MMGR: Multi-Modal Generative Reasoning

Daily Paper Cast

Dec 18, 202524:35pending

Video Reality Test: Can AI-Generated ASMR Videos fool VLMs and Humans?

Daily Paper Cast

Dec 18, 202524:20pending

WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive Wor...

Daily Paper Cast

Dec 18, 202521:32pending

Scone: Bridging Composition and Distinction in Subject-Driven Image Generation v...

Daily Paper Cast

Dec 18, 202522:31pending

RoboTracer: Mastering Spatial Trace with Reasoning in Vision-Language Models for...

Daily Paper Cast

Dec 18, 202519:54pending

OpenDataArena: A Fair and Open Arena for Benchmarking Post-Training Dataset Valu...

Daily Paper Cast

Dec 18, 202529:25pending

ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding

Daily Paper Cast

Dec 17, 202526:30pending

Towards Scalable Pre-training of Visual Tokenizers for Generation

Daily Paper Cast

Dec 17, 202521:55pending

Memory in the Age of AI Agents

Daily Paper Cast

Dec 17, 202523:55pending

QwenLong-L1.5: Post-Training Recipe for Long-Context Reasoning and Memory Manage...

Daily Paper Cast

Dec 17, 202524:20pending

LongVie 2: Multimodal Controllable Ultra-Long Video World Model

Daily Paper Cast

Dec 17, 202526:24pending

Finch: Benchmarking Finance & Accounting across Spreadsheet-Centric Enterprise W...

Daily Paper Cast

Dec 17, 202530:53pending

NL2Repo-Bench: Towards Long-Horizon Repository Generation Evaluation of Coding A...

Daily Paper Cast

Dec 17, 202524:52pending

Error-Free Linear Attention is a Free Lunch: Exact Solution from Continuous-Time...

Daily Paper Cast

Dec 17, 202522:42pending

KlingAvatar 2.0 Technical Report

Daily Paper Cast

Dec 17, 202524:12pending
......