RL data nvidia/Nemotron-RL-knowledge-mcqa Viewer • Updated Dec 12, 2025 • 686k • 524 • 12 nvidia/Nemotron-RL-knowledge-openqa Viewer • Updated Dec 12, 2025 • 136k • 116 • 10 nvidia/Nemotron-RL-agent-workplace_assistant Viewer • Updated Feb 26 • 1.8k • 2.31k • 30 nvidia/Nemotron-RL-instruction_following Preview • Updated Jan 12 • 501 • 17
long context MiniMax-01: Scaling Foundation Models with Lightning Attention Paper • 2501.08313 • Published Jan 14, 2025 • 304 Agent-Ark/Toucan-1.5M Viewer • Updated Oct 4, 2025 • 1.65M • 4.2k • 233 facebook/natural_reasoning Viewer • Updated Feb 21, 2025 • 1.15M • 4.01k • 582
MiniMax-01: Scaling Foundation Models with Lightning Attention Paper • 2501.08313 • Published Jan 14, 2025 • 304
data BeyondWeb: Lessons from Scaling Synthetic Data for Trillion-scale Pretraining Paper • 2508.10975 • Published Aug 14, 2025 • 60
BeyondWeb: Lessons from Scaling Synthetic Data for Trillion-scale Pretraining Paper • 2508.10975 • Published Aug 14, 2025 • 60
LLMs TrustLLM: Trustworthiness in Large Language Models Paper • 2401.05561 • Published Jan 10, 2024 • 69 Exponentially Faster Language Modelling Paper • 2311.10770 • Published Nov 15, 2023 • 119
RL data nvidia/Nemotron-RL-knowledge-mcqa Viewer • Updated Dec 12, 2025 • 686k • 524 • 12 nvidia/Nemotron-RL-knowledge-openqa Viewer • Updated Dec 12, 2025 • 136k • 116 • 10 nvidia/Nemotron-RL-agent-workplace_assistant Viewer • Updated Feb 26 • 1.8k • 2.31k • 30 nvidia/Nemotron-RL-instruction_following Preview • Updated Jan 12 • 501 • 17
data BeyondWeb: Lessons from Scaling Synthetic Data for Trillion-scale Pretraining Paper • 2508.10975 • Published Aug 14, 2025 • 60
BeyondWeb: Lessons from Scaling Synthetic Data for Trillion-scale Pretraining Paper • 2508.10975 • Published Aug 14, 2025 • 60
long context MiniMax-01: Scaling Foundation Models with Lightning Attention Paper • 2501.08313 • Published Jan 14, 2025 • 304 Agent-Ark/Toucan-1.5M Viewer • Updated Oct 4, 2025 • 1.65M • 4.2k • 233 facebook/natural_reasoning Viewer • Updated Feb 21, 2025 • 1.15M • 4.01k • 582
MiniMax-01: Scaling Foundation Models with Lightning Attention Paper • 2501.08313 • Published Jan 14, 2025 • 304
LLMs TrustLLM: Trustworthiness in Large Language Models Paper • 2401.05561 • Published Jan 10, 2024 • 69 Exponentially Faster Language Modelling Paper • 2311.10770 • Published Nov 15, 2023 • 119