PatronusAI/Qwen3-4B-Instruct-2507-CE-152T-GPT41Tea-notR-L4-M-Ep1-1e-5-Q32-65536-2026Feb21
4B • Updated
LLM Evaluation
Masked Diffusion Language Models are Strong and Steerable Text-Based World Models for Agentic RL
Benchmarking Reward Hack Detection in Code Environments via Contrastive Analysis