OpenWight Vault zai-org/GLM-5.1 Text Generation • 754B • Updated May 13 • 79.4k • • 1.84k moonshotai/Kimi-K2.7-Code Image-Text-to-Text • 1.1T • Updated Jun 15 • 658k • • 1.35k
Training Research Language Models Can Learn from Verbal Feedback Without Scalar Rewards Paper • 2509.22638 • Published Sep 26, 2025 • 70 Don't Just Fine-tune the Agent, Tune the Environment Paper • 2510.10197 • Published Oct 11, 2025 • 30 Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation Paper • 2510.08673 • Published Oct 9, 2025 • 128 Agent Learning via Early Experience Paper • 2510.08558 • Published Oct 9, 2025 • 276
Language Models Can Learn from Verbal Feedback Without Scalar Rewards Paper • 2509.22638 • Published Sep 26, 2025 • 70
Don't Just Fine-tune the Agent, Tune the Environment Paper • 2510.10197 • Published Oct 11, 2025 • 30
Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation Paper • 2510.08673 • Published Oct 9, 2025 • 128
OpenWight Vault zai-org/GLM-5.1 Text Generation • 754B • Updated May 13 • 79.4k • • 1.84k moonshotai/Kimi-K2.7-Code Image-Text-to-Text • 1.1T • Updated Jun 15 • 658k • • 1.35k
Training Research Language Models Can Learn from Verbal Feedback Without Scalar Rewards Paper • 2509.22638 • Published Sep 26, 2025 • 70 Don't Just Fine-tune the Agent, Tune the Environment Paper • 2510.10197 • Published Oct 11, 2025 • 30 Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation Paper • 2510.08673 • Published Oct 9, 2025 • 128 Agent Learning via Early Experience Paper • 2510.08558 • Published Oct 9, 2025 • 276
Language Models Can Learn from Verbal Feedback Without Scalar Rewards Paper • 2509.22638 • Published Sep 26, 2025 • 70
Don't Just Fine-tune the Agent, Tune the Environment Paper • 2510.10197 • Published Oct 11, 2025 • 30
Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation Paper • 2510.08673 • Published Oct 9, 2025 • 128