Inference Providers
Active filters: RL
nvidia/Nemotron-Cascade-2-30B-A3B
Text Generation
• 32B • Updated • 56.7k
• 524
mlx-community/Nemotron-Cascade-2-30B-A3B-4bit
Text Generation
• 32B • Updated • 715
• 22
stelterlab/Nemotron-Cascade-2-30B-A3B-AWQ
Text Generation
• 5B • Updated • 640
• 4
bartowski/nvidia_Nemotron-Cascade-2-30B-A3B-GGUF
Text Generation
• 32B • Updated • 7.14k
• 47
mradermacher/Nemotron-Cascade-2-30B-A3B-heretic-ara-uncensored-i1-GGUF
32B • Updated • 9.17k
• 4
stanfordnlp/SteamSHP-flan-t5-xl
Updated • 449
• 43
stanfordnlp/SteamSHP-flan-t5-large
Updated • 175
• 33
SultanR/SmolTulu-1.7b-Reinforced
Text Generation
• 2B • Updated • 17
• 5
mradermacher/SmolTulu-1.7b-Reinforced-GGUF
2B • Updated • 164
Daemontatox/Llama3.3-70B-CogniLink
Text Generation
• 71B • Updated • 30
• • 3
mradermacher/Llama3.3-70B-CogniLink-GGUF
Text Generation
• 71B • Updated • 108
mradermacher/Llama3.3-70B-CogniLink-i1-GGUF
Text Generation
• 71B • Updated • 575
JHuel/Mistral-Nemo-Instruct-2407_DPO_qlora
Reinforcement Learning
• Updated JHuel/Mistral-Nemo-Instruct-2407_ORPO
Text Generation
• Updated Ihor/Text2Graph-R1-Qwen2.5-0.5b
Text Generation
• 0.5B • Updated • 481
• • 24
Reinforcement Learning
• Updated • 2
mradermacher/Text2Graph-R1-Qwen2.5-0.5b-GGUF
0.5B • Updated • 86
• 1
mradermacher/Text2Graph-R1-Qwen2.5-0.5b-i1-GGUF
0.5B • Updated • 274
• 1
mradermacher/QuadConnect2.5-0.5B-v0.0.3b-GGUF
0.5B • Updated • 144
Text Generation
• 684B • Updated • 76
• 1
mradermacher/QuadConnect2.5-0.5B-v0.0.8b-GGUF
0.5B • Updated • 132
Lyte/QuadConnect2.5-0.5B-v0.0.9b
Text Generation
• 0.5B • Updated • 33
• mradermacher/QuadConnect2.5-0.5B-v0.0.9b-GGUF
0.5B • Updated • 66
Lyte/QuadConnect2.5-1.5B-v0.1.0b
Text Generation
• 2B • Updated • 82
• • 1
mradermacher/QuadConnect2.5-1.5B-v0.1.0b-GGUF
2B • Updated • 147
• 1
mradermacher/Zireal-0-GGUF
mradermacher/Magellanic-Qwen-25B-R999-GGUF
25B • Updated • 85
• 1
mradermacher/Magellanic-Qwen-25B-R999-i1-GGUF
25B • Updated • 191
• 1
VaidikML0508/Shark-Tank-Offer-Evaluator-llama3.2-3B-Instruct-SFT-DPO-4bits-V1
Text Generation
• 3B • Updated • 9
Teen-Different/squiral_maze
Reinforcement Learning
• Updated