tencent/HunyuanOCR
Image-Text-to-Text • 1B • Updated • 321k • 797
None defined yet.
WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models
When Memory Lies: An Empirical Study of Spatial Memory Staleness in VLM Agents