HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enchancement Paper • 2607.18217 • Published 9 days ago • 59
Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models Paper • 2606.25041 • Published Jun 23 • 120
Play2Perfect: What Matters in Dexterous Play Pretraining for Precise Assembly? Paper • 2606.26428 • Published Jun 24 • 17
SimFoundry: Modular and Automated Scene Generation for Policy Learning and Evaluation Paper • 2606.28276 • Published Jun 26 • 15
SkillHone: A Harness for Continual Agent Skill Evolution Through Persistent Decision History Paper • 2606.08671 • Published Jun 23 • 46
PhysisForcing: Physics Reinforced World Simulator for Robotic Manipulation Paper • 2606.28128 • Published Jun 26 • 53
AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents Paper • 2607.02255 • Published 27 days ago • 67
RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation Paper • 2607.06559 • Published 22 days ago • 95
PointDiT: Pixel-Space Diffusion for Monocular Geometry Estimation Paper • 2607.02515 • Published 27 days ago • 19
Attending to Multimodal Generation One Token at a Time Paper • 2607.03738 • Published 25 days ago • 10
RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation Paper • 2607.06558 • Published 22 days ago • 79