A collection for the ReasonXL dataset and models trained with it
Daniil Gurgurov
DGurgurov
AI & ML interests
NLP, AI, EduTech
Recent Activity
updated a model 9 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR published a model 9 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR updated a model 9 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-ESOrganizations
models 135
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR
Reinforcement Learning • 1.0B • Updated • 9
DGurgurov/OpenThinker3-7B-SFT-GRPO-ES
Reinforcement Learning • 1.0B • Updated • 14
DGurgurov/OpenThinker3-7B-SFT-GRPO-IT
Reinforcement Learning • 1.0B • Updated • 13
DGurgurov/OpenThinker3-7B-SFT-GRPO-DE
Reinforcement Learning • 1.0B • Updated • 248
DGurgurov/OpenThinker3-7B-SFT-FR
8B • Updated • 11
DGurgurov/OpenThinker3-7B-SFT-ES
8B • Updated • 13
DGurgurov/OpenThinker3-7B-SFT-IT
8B • Updated • 11
DGurgurov/OpenThinker3-7B-SFT-DE
8B • Updated • 8
DGurgurov/SmolLM3-3B-SFT-GRPO-FR
Reinforcement Learning • 0.4B • Updated • 463
DGurgurov/SmolLM3-3B-SFT-GRPO-ES
Reinforcement Learning • 0.4B • Updated • 15
datasets 52
DGurgurov/CLaS-Bench
Preview • Updated • 811 • 1
DGurgurov/Nemotron-Multilingual-Reasoning
Viewer • Updated • 3.54M • 137
DGurgurov/mgsm_en_it
Viewer • Updated • 250 • 58
DGurgurov/aime_2025_en_it
Viewer • Updated • 30 • 41
DGurgurov/gpqa_diamond_en_it
Viewer • Updated • 198 • 69
DGurgurov/mt_math100_en_it
Viewer • Updated • 99 • 42
DGurgurov/OpenThoughts-10k-DeepSeek-R1
Viewer • Updated • 10k • 14
DGurgurov/DeepSeek-R1-Distill-Qwen-1.5B-lmsys-chat-1m-tokenized
Viewer • Updated • 486k • 24
DGurgurov/urdu_sa
Viewer • Updated • 11k • 29
DGurgurov/danish_sa
Viewer • Updated • 10k • 29