Skip to content
TrackPodcasts

Daily Paper Cast

Jingwen Liang, Gengyu Wang

EN1777 episodes
sciencetechnology

We update every weekday to discuss highest-voted papers from Huggingface Daily Paper (https://huggingface.co/papers). Both the podcast scripts and audio are generated by AI. Feedback and suggestions are welcome! Email us: [email protected]:Jingwen Liang, 3D ML, https://www.linkedin.com/in/jingwen-liang/Gengyu Wang, LLM ML, http://wanggengyu.comListen on: Spotify: https://open.spotify.com/show/21nrhmdaA8qoBiH8q03NXLApple Podcast: https://podcasts.apple.com/us/podcast/daily-paper-...

Episodes (1777)

DiT360: High-Fidelity Panoramic Image Generation via Hybrid Training

Daily Paper Cast

Oct 15, 202522:13pending

AVoCaDO: An Audiovisual Video Captioner Driven by Temporal Orchestration

Daily Paper Cast

Oct 15, 202524:24pending

InternSVG: Towards Unified SVG Tasks with Multimodal Large Language Models

Daily Paper Cast

Oct 15, 202525:21pending

BrowserAgent: Building Web Agents with Human-Inspired Web Browsing Actions

Daily Paper Cast

Oct 15, 202521:38pending

D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied...

Daily Paper Cast

Oct 14, 202523:49pending

Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understandin...

Daily Paper Cast

Oct 14, 202523:18pending

TAG:Tangential Amplifying Guidance for Hallucination-Resistant Diffusion Samplin...

Daily Paper Cast

Oct 14, 202521:39pending

AutoPR: Let's Automate Your Academic Promotion!

Daily Paper Cast

Oct 14, 202522:35pending

Multimodal Prompt Optimization: Why Not Leverage Multiple Modalities for MLLMs

Daily Paper Cast

Oct 14, 202525:37pending

BEAR: Benchmarking and Enhancing Multimodal Language Models for Atomic Embodied...

Daily Paper Cast

Oct 14, 202526:40pending

StreamingVLM: Real-Time Understanding for Infinite Video Streams

Daily Paper Cast

Oct 14, 202521:22pending

Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels

Daily Paper Cast

Oct 14, 202524:41pending

BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via E...

Daily Paper Cast

Oct 14, 202522:59pending

R-Horizon: How Far Can Your Large Reasoning Model Really Go in Breadth and Depth...

Daily Paper Cast

Oct 14, 202524:42pending

Agent Learning via Early Experience

Daily Paper Cast

Oct 11, 202522:45pending

MM-HELIX: Boosting Multimodal Long-Chain Reflective Reasoning with Holistic Plat...

Daily Paper Cast

Oct 11, 202521:36pending

MemMamba: Rethinking Memory Patterns in State Space Model

Daily Paper Cast

Oct 11, 202524:07pending

UniVideo: Unified Understanding, Generation, and Editing for Videos

Daily Paper Cast

Oct 11, 202526:06pending

From What to Why: A Multi-Agent System for Evidence-based Chemical Reaction Cond...

Daily Paper Cast

Oct 11, 202526:23pending

When Thoughts Meet Facts: Reusable Reasoning for Long-Context LMs

Daily Paper Cast

Oct 11, 202521:23pending

Meta-Awareness Enhances Reasoning Models: Self-Alignment Reinforcement Learning

Daily Paper Cast

Oct 11, 202524:32pending

VideoCanvas: Unified Video Completion from Arbitrary Spatiotemporal Patches via...

Daily Paper Cast

Oct 11, 202524:37pending

The Alignment Waltz: Jointly Training Agents to Collaborate for Safety

Daily Paper Cast

Oct 11, 202524:20pending

Hybrid Reinforcement: When Reward Is Sparse, It's Better to Be Dense

Daily Paper Cast

Oct 11, 202524:18pending

Cache-to-Cache: Direct Semantic Communication Between Large Language Models

Daily Paper Cast

Oct 10, 202524:59pending

Ming-UniVision: Joint Image Understanding and Generation with a Unified Continuo...

Daily Paper Cast

Oct 10, 202526:47pending

Lumina-DiMOO: An Omni Diffusion Large Language Model for Multi-Modal Generation...

Daily Paper Cast

Oct 10, 202521:15pending

SHANKS: Simultaneous Hearing and Thinking for Spoken Language Models

Daily Paper Cast

Oct 10, 202524:34pending

MATRIX: Mask Track Alignment for Interaction-aware Video Generation

Daily Paper Cast

Oct 10, 202523:04pending

RLinf-VLA: A Unified and Efficient Framework for VLA+RL Training

Daily Paper Cast

Oct 10, 202520:18pending

Vibe Checker: Aligning Code Evaluation with Human Preference

Daily Paper Cast

Oct 10, 202523:39pending

Less is More: Recursive Reasoning with Tiny Networks

Daily Paper Cast

Oct 9, 202521:41pending

TaTToo: Tool-Grounded Thinking PRM for Test-Time Scaling in Tabular Reasoning

Daily Paper Cast

Oct 9, 202527:21pending

Fathom-DeepResearch: Unlocking Long Horizon Information Retrieval and Synthesis...

Daily Paper Cast

Oct 9, 202523:46pending

In-the-Flow Agentic System Optimization for Effective Planning and Tool Use

Daily Paper Cast

Oct 9, 202527:45pending

Fast-dLLM v2: Efficient Block-Diffusion LLM

Daily Paper Cast

Oct 9, 202523:35pending

CoDA: Coding LM via Diffusion Adaptation

Daily Paper Cast

Oct 9, 202522:12pending

Drax: Speech Recognition with Discrete Flow Matching

Daily Paper Cast

Oct 9, 202524:54pending

Paper2Video: Automatic Video Generation from Scientific Papers

Daily Paper Cast

Oct 8, 202521:54pending

MITS: Enhanced Tree Search Reasoning for LLMs via Pointwise Mutual Information

Daily Paper Cast

Oct 8, 202525:31pending

Video-LMM Post-Training: A Deep Dive into Video Reasoning with Large Multimodal...

Daily Paper Cast

Oct 8, 202526:25pending

VChain: Chain-of-Visual-Thought for Reasoning in Video Generation

Daily Paper Cast

Oct 8, 202522:20pending

Imperceptible Jailbreaking against Large Language Models

Daily Paper Cast

Oct 8, 202520:49pending

Agentic Context Engineering: Evolving Contexts for Self-Improving Language Model...

Daily Paper Cast

Oct 8, 202526:37pending

Hybrid Architectures for Language Models: Systematic Analysis and Design Insight...

Daily Paper Cast

Oct 8, 202523:07pending

Optimal Scaling Needs Optimal Norm

Daily Paper Cast

Oct 8, 202522:52pending

Apriel-1.5-15b-Thinker

Daily Paper Cast

Oct 7, 202525:25pending

Large Reasoning Models Learn Better Alignment from Flawed Thinking

Daily Paper Cast

Oct 7, 202522:02pending

Efficient Multi-modal Large Language Models via Progressive Consistency Distilla...

Daily Paper Cast

Oct 7, 202521:42pending

LongCodeZip: Compress Long Context for Code Language Models

Daily Paper Cast

Oct 4, 202529:31pending
......