PLAY PODCASTS
Daily Paper Cast

Daily Paper Cast

2,319 episodes — Page 3 of 47

TTPO: Test-Time Policy Optimization

Aug 28, 202620 min

What Makes Good Agentic Data? An ACE Lens on Data Generation for LLM Agents

Aug 28, 202620 min

Self-OPD: On-Policy Distillation for Flow Matching Models without Teacher

Aug 28, 202620 min

UrbanGround: From Local Perception to Spatial Agency in a Real-Scale City

Aug 28, 202622 min

Training Agents to Evolve with Their Harness: TaoLive Digital Avatar Agent Technical Report

Aug 28, 202619 min

GameWAM: A World Action Model for Video Games

Aug 28, 202622 min

PILOT in the Loop: Live Self-Improvement for Long-Horizon Agents

Aug 28, 202621 min

VoiceMem: Streaming Dual-Brain Memory for Real-Time Interaction

Aug 27, 202619 min

FrontierChallenge: Evaluating Scientific Workflow Completion

Aug 27, 202624 min

VGI-Bench: Probing Visual Intelligence in Video Generation Models

Aug 27, 202618 min

WarpSAC: Towards the Pinnacle of Scalable Off-policy RL by Rethinking Exploration and Exploitation

Aug 27, 202619 min

JIT-Agent: Scaling Harness Intelligence via Just-in-Time Harness Evolution

Aug 27, 202620 min

VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning

Aug 27, 202621 min

Towards a Densing Law for User Representation Learning at Billion-Scale Capacity

Aug 26, 202619 min

Beyond Correctness: Benchmarking and Aligning Response Behaviors in Hybrid-Thinking MLLMs

Aug 25, 202618 min

An Empirical Study of Training Pixel-Space Text-to-Image Diffusion Models

Aug 19, 202618 min

Agentic Transaction: Towards ACID-Compliant Agent Systems

Aug 19, 202620 min

Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events? A Systematic Evaluation of Detectors, Generators and Social Dissemination

Aug 18, 202620 min

Self-Supervised Visual On-Policy Distillation

Aug 18, 202621 min

Beyond Final Scores: A Systematic Evaluation of Agents for Long-Horizon AI Research and Development

Aug 18, 202622 min

Intern-S2-Mobius: Foundation Model with Decoupled Knowledge and Reasoning

Aug 18, 202625 min

Apodex Discovery: Reality Benchmarks and Environments for Evaluating and Building Discoverative Artificial Intelligence

Aug 18, 202621 min

Marionette: Predicting World States, Rendering Geometry, Painting Appearance

Aug 18, 202620 min

DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data

Aug 18, 202617 min

Alaya-EVOKE: From Linear-Scaling Supervision to Endless World

Aug 15, 202619 min

DreamX-Phi 1.0: Action-Conditioned Video World Model for Robotic Manipulation

Aug 15, 202622 min

DarwinX: Evolving Agent Harnesses Through Natural Selection

Aug 15, 202620 min

Intern-S2-Preview: Scientific Agentic Foundation Model

Aug 15, 202623 min

How Can Rhetoric Reward-Hack AI Reviewers? Dissecting Rhetorical Sensitivity in AI-Based Peer Review

Aug 15, 202620 min

PlayWorld: Benchmarking World Models with Agent Players over Long-Horizon Objectives

Aug 15, 202621 min

AutoDesign: Meta-Harness Optimization for Long-Horizon Agentic Design

Aug 15, 202622 min

Spatial Memory Agent: Experience-Grounded Procedure Memory for Spatial Intelligence

Aug 15, 202620 min

OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution

Aug 14, 202621 min

Spark-to-Paper: End-to-End Research Paper Generation as a Composable Skill

Aug 14, 202621 min

AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses

Aug 14, 202622 min

Mechanist: AI as a Scientific Instrument for Discovering the Mechanisms of Intelligence

Aug 14, 202622 min

SkillZip: Contract-Preserving Graph Compression for Scalable Agent Skill Libraries

Aug 14, 202618 min

Can LLM Agents Stick to the Script? A Benchmark for Long-Horizon Consistency in Interactive Narratives

Aug 14, 202623 min

StateFlow: Building, Evolving, and Accessing 3D World States for Previsualization

Aug 14, 202619 min

ComBodied Agents: a New Paradigm of Human-Centric Agentic AI

Aug 13, 202622 min

Co-Evolution in Agentic Systems: Toward Self-Directed Evolution Beyond Human Design

Aug 13, 202619 min

Beyond Pixels: From Video Priors to 4D Worlds

Aug 13, 202622 min

Articulated Object Reconstruction from Rest-State Observation

Aug 13, 202620 min

AdvFD: Boosting Visual Generation via Adversarial Fr'echet Distance Loss

Aug 13, 202619 min

Mendel G\"odel Machine: Recursive Self-Improving Coding Agents via Comparative Evolution

Aug 13, 202621 min

Macaron-V1: Towards Open Continual Learning with Self-Improvement and Mixture-of-LoRA

Aug 12, 202621 min

BDH-CQ: In-Context Learning with Recurrent Latent Reasoning

Aug 12, 202622 min

SWE-Bench ProMax: Benchmarking Agents on Large-Scale Multilingual Code Refactoring

Aug 12, 202619 min

On-Policy Self-Distillation without Any Supervision

Aug 12, 202620 min

Ouroboros: A Self-Developing Frontier Coding Agent with Reviewed Core Evolution

Aug 12, 202620 min