Roman Nekrasov
Rob1234567
AI & ML interests
Areas of interest: agentic mid-training, reinforcement learning with reward verification (RLVR), scaling agent environments, interleaved agent reasoning with tools
Recent Activity
updated a collection 3 days ago
Qwen3.5-4B Ariadna — доменный ML/AI-эксперт updated a collection 3 days ago
Qwen3.5-4B Ariadna — доменный ML/AI-эксперт updated a model 3 days ago
Rob1234567/qwen3.5-4b-ariadna-grpo-v1-ggufOrganizations
None yet