A collection for the ReasonXL dataset and models trained with it
Daniil Gurgurov
DGurgurov
AI & ML interests
NLP, AI, EduTech
Recent Activity
updated a model 22 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR published a model 22 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR updated a model 22 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-ESOrganizations
models 135
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR
Reinforcement Learning • 1.0B • Updated • 11
DGurgurov/OpenThinker3-7B-SFT-GRPO-ES
Reinforcement Learning • 1.0B • Updated • 19
DGurgurov/OpenThinker3-7B-SFT-GRPO-IT
Reinforcement Learning • 1.0B • Updated • 19
DGurgurov/OpenThinker3-7B-SFT-GRPO-DE
Reinforcement Learning • 1.0B • Updated • 4k
DGurgurov/OpenThinker3-7B-SFT-FR
8B • Updated • 16
DGurgurov/OpenThinker3-7B-SFT-ES
8B • Updated • 19
DGurgurov/OpenThinker3-7B-SFT-IT
8B • Updated • 18
DGurgurov/OpenThinker3-7B-SFT-DE
8B • Updated • 11
DGurgurov/SmolLM3-3B-SFT-GRPO-FR
Reinforcement Learning • 0.4B • Updated • 588
DGurgurov/SmolLM3-3B-SFT-GRPO-ES
Reinforcement Learning • 0.4B • Updated • 18
datasets 52
DGurgurov/CLaS-Bench
Preview • Updated • 976 • 1
DGurgurov/Nemotron-Multilingual-Reasoning
Viewer • Updated • 3.54M • 152
DGurgurov/mgsm_en_it
Viewer • Updated • 250 • 24
DGurgurov/aime_2025_en_it
Viewer • Updated • 30 • 42
DGurgurov/gpqa_diamond_en_it
Viewer • Updated • 198 • 43
DGurgurov/mt_math100_en_it
Viewer • Updated • 99 • 21
DGurgurov/OpenThoughts-10k-DeepSeek-R1
Viewer • Updated • 10k • 10
DGurgurov/DeepSeek-R1-Distill-Qwen-1.5B-lmsys-chat-1m-tokenized
Viewer • Updated • 486k • 36
DGurgurov/urdu_sa
Viewer • Updated • 11k • 28
DGurgurov/danish_sa
Viewer • Updated • 10k • 24