Skip to content
TrackPodcasts

Daily Paper Cast

Jingwen Liang, Gengyu Wang

EN1777 episodes
sciencetechnology

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: [email protected]:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-...

Episodes (1777)

Seedance 2.0: Advancing Video Generation for World Complexity

Daily Paper Cast

Apr 17, 202627:40failed

GameWorld: Towards Standardized and Verifiable Evaluation of Multimodal Game Age...

Daily Paper Cast

Apr 17, 202626:00failed

RationalRewards: Reasoning Rewards Scale Visual Generation Both Training and Tes...

Daily Paper Cast

Apr 17, 202624:13failed

SpatialEvo: Self-Evolving Spatial Intelligence via Deterministic Geometric Envir...

Daily Paper Cast

Apr 17, 202624:11failed

OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language En...

Daily Paper Cast

Apr 17, 202627:30failed

Memory Transfer Learning: How Memories are Transferred Across Domains in Coding...

Daily Paper Cast

Apr 17, 202626:27failed

From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space

Daily Paper Cast

Apr 17, 202623:31failed

Exploration and Exploitation Errors Are Measurable for Language Model Agents

Daily Paper Cast

Apr 17, 202622:21failed

ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents

Daily Paper Cast

Apr 16, 202623:59failed

Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mecha...

Daily Paper Cast

Apr 16, 202625:07failed

Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization

Daily Paper Cast

Apr 16, 202621:10failed

SPPO: Sequence-Level PPO for Long-Horizon Reasoning Tasks

Daily Paper Cast

Apr 16, 202622:33failed

Toward Autonomous Long-Horizon Engineering for ML Research

Daily Paper Cast

Apr 16, 202624:05failed

BERT-as-a-Judge: A Robust Alternative to Lexical Methods for Efficient Reference...

Daily Paper Cast

Apr 16, 202621:58failed

QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Gener...

Daily Paper Cast

Apr 15, 202624:54failed

The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping

Daily Paper Cast

Apr 15, 202621:31failed

OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Gene...

Daily Paper Cast

Apr 15, 202621:58failed

Attention Sink in Transformers: A Survey on Utilization, Interpretation, and Mit...

Daily Paper Cast

Apr 15, 202621:34failed

Strips as Tokens: Artist Mesh Generation with Native UV Segmentation

Daily Paper Cast

Apr 15, 202621:33failed

Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Bas...

Daily Paper Cast

Apr 15, 202622:44failed

Pseudo-Unification: Entropy Probing Reveals Divergent Information Patterns in Un...

Daily Paper Cast

Apr 15, 202623:05failed

CocoaBench: Evaluating Unified Digital Agents in the Wild

Daily Paper Cast

Apr 15, 202622:55failed

CodeTracer: Towards Traceable Agent States

Daily Paper Cast

Apr 15, 202623:36failed

WildDet3D: Scaling Promptable 3D Detection in the Wild

Daily Paper Cast

Apr 14, 202625:01failed

FORGE: Fine-grained Multimodal Evaluation for Manufacturing Scenarios

Daily Paper Cast

Apr 14, 202621:57failed

EXAONE 4.5 Technical Report

Daily Paper Cast

Apr 14, 202623:16failed

RefineAnything: Multimodal Region-Specific Refinement for Perfect Local Details

Daily Paper Cast

Apr 14, 202622:22failed

Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horiz...

Daily Paper Cast

Apr 14, 202623:56failed

Rethinking Generalization in Reasoning SFT: A Conditional Analysis on Optimizati...

Daily Paper Cast

Apr 11, 202624:44failed

SkillClaw: Let Skills Evolve Collectively with Agentic Evolver

Daily Paper Cast

Apr 11, 202622:33failed

RAGEN-2: Reasoning Collapse in Agentic RL

Daily Paper Cast

Apr 10, 202625:36failed

MARS: Enabling Autoregressive Models Multi-Token Generation

Daily Paper Cast

Apr 10, 202623:23failed

Combee: Scaling Prompt Learning for Self-Improving Language Model Agents

Daily Paper Cast

Apr 10, 202621:56failed

Video-MME-v2: Towards the Next Stage in Benchmarks for Comprehensive Video Under...

Daily Paper Cast

Apr 9, 202624:54failed

Claw-Eval: Toward Trustworthy Evaluation of Autonomous Agents

Daily Paper Cast

Apr 9, 202622:39failed

Learning to Retrieve from Agent Trajectories

Daily Paper Cast

Apr 9, 202622:27failed

ACES: Who Tests the Tests? Leave-One-Out AUC Consistency for Code Generation

Daily Paper Cast

Apr 9, 202624:22failed

GBQA: A Game Benchmark for Evaluating LLMs as Quality Assurance Engineers

Daily Paper Cast

Apr 9, 202623:50failed

Beyond Accuracy: Unveiling Inefficiency Patterns in Tool-Integrated Reasoning

Daily Paper Cast

Apr 9, 202621:19failed

ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refi...

Daily Paper Cast

Apr 9, 202622:23failed

Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet Supervis...

Daily Paper Cast

Apr 9, 202624:53failed

MegaTrain: Full Precision Training of 100B+ Parameter Large Language Models on a...

Daily Paper Cast

Apr 9, 202625:12failed

Watch Before You Answer: Learning from Visually Grounded Post-Training

Daily Paper Cast

Apr 9, 202620:34failed

OpenWorldLib: A Unified Codebase and Definition of Advanced World Models

Daily Paper Cast

Apr 8, 202623:58failed

MinerU2.5-Pro: Pushing the Limits of Data-Centric Document Parsing at Scale

Daily Paper Cast

Apr 8, 202623:52failed

LIBERO-Para: A Diagnostic Benchmark and Metrics for Paraphrase Robustness in VLA...

Daily Paper Cast

Apr 8, 202622:52failed

TriAttention: Efficient Long Reasoning with Trigonometric KV Compression

Daily Paper Cast

Apr 8, 202621:22failed

Adam's Law: Textual Frequency Law on Large Language Models

Daily Paper Cast

Apr 8, 202622:27failed

AURA: Always-On Understanding and Real-Time Assistance via Video Streams

Daily Paper Cast

Apr 8, 202623:35failed

ClawArena: Benchmarking AI Agents in Evolving Information Environments

Daily Paper Cast

Apr 8, 202621:28failed
...