AREX: Towards a Recursively Self-Improving Agent for Deep Research Paper • 2607.21461 • Published 1 day ago • 115
Streaming Multi-Agent Autoregressive Diffusion Model with World State Registers Paper • 2607.21594 • Published 1 day ago • 9
AgentDebugX: An Open-Source Toolkit for Failure Observability, Attribution, and Recovery in LLM Agents Paper • 2607.18754 • Published 4 days ago • 23
AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report Paper • 2607.18367 • Published 4 days ago • 52
Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing Paper • 2607.19064 • Published 4 days ago • 62
DiFA: Inference-Time Forward-Process Alignment for Diffusion Models Paper • 2607.17972 • Published 5 days ago • 6
JoyNexus: Service-Oriented Multi-Tenant Post-Training for VLA Models Paper • 2607.16074 • Published 8 days ago • 8
TimeLens2: Generalist Video Temporal Grounding with Multimodal LLMs Paper • 2607.17423 • Published 6 days ago • 164
FlashRT: Agent Harness for Guiding Agents to Deploy Real-Time Multimodal Applications Paper • 2607.18171 • Published 5 days ago • 6
GigaChat Audio: Time-aware Large Audio Language Model Paper • 2607.10387 • Published 14 days ago • 36
RynnBrain 1.1: Towards More Capable and Generalizable Embodied Foundation Model Paper • 2607.17977 • Published 5 days ago • 195
From Pixels to States: Rethinking Interactive World Models as Game Engines Paper • 2607.14076 • Published 10 days ago • 35
LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget Paper • 2607.14952 • Published 9 days ago • 197
BadWAM: When World-Action Models Dream Right but Act Wrong Paper • 2607.15207 • Published 9 days ago • 53
VideoChat3: Fully Open Video MLLM for Efficient and Generalist Video Understanding Paper • 2607.14935 • Published 9 days ago • 168