Inference Providers
Active filters: rl
tristan-deep/dqn-needle-tracker
Reinforcement Learning
• Updated • 1
tensorblock/archangel_sft-dpo_pythia2-8b-GGUF
tensorblock/archangel_sft_llama7b-GGUF
tensorblock/archangel_sft-kto_llama13b-GGUF
13B • Updated • 62
philschmid/qwen-2.5-3b-r1-countdown
Text Generation
• 3B • Updated • 55
• 8
Pinkstack/Superthoughts-lite-v1
Text Generation
• 2B • Updated • 39
• 3
mradermacher/Superthoughts-lite-v1-GGUF
2B • Updated • 337
• 1
mradermacher/Superthoughts-lite-v1-i1-GGUF
2B • Updated • 769
• 1
ayazfau/GPT2-124M-poetry-RL
Text Generation
• 0.1B • Updated • 55
• 2
mradermacher/GPT2-124-poetry-RLHF-GGUF
Text Generation
• 0.2B • Updated • 227
• 1
Pinkstack/Superthoughts-lite-v1-Q8-mlx
Text Generation
• 2B • Updated • 38
• 1
mradermacher/Superthoughts-mini-v1-3.8b-GGUF
4B • Updated • 322
mradermacher/Superthoughts-mini-v1-3.8b-i1-GGUF
4B • Updated • 646
AdvRahul/Axion-1.5B-Reasoning
2B • Updated • 60
prithivMLmods/Helix-Opus-14B-Exp
Text Generation
• 15B • Updated • 24
• 2
mradermacher/Quasar-3.0-Max-GGUF
8B • Updated • 485
mradermacher/Quasar-3.0-Max-i1-GGUF
8B • Updated • 568
mradermacher/Quasar-3.3-Max-GGUF
8B • Updated • 228
mradermacher/Quasar-3.3-Max-i1-GGUF
8B • Updated • 953
suayptalha/EmojiLlama-3.1-8B
Text Generation
• 8B • Updated • 34
• • 5
matrixportalx/EmojiLlama-3.1-8B-GGUF
Text Generation
• 8B • Updated • 109
mradermacher/EmojiLlama-3.1-8B-GGUF
8B • Updated • 448
• 1
mradermacher/Quasar-3.7-Coding-GGUF
8B • Updated • 292
mradermacher/Quasar-3.7-Coding-i1-GGUF
8B • Updated • 1.57k
• 1
mradermacher/Quasar-3.7-GGUF
8B • Updated • 251
mradermacher/Quasar-3.7-i1-GGUF
8B • Updated • 844
tensorblock/EmojiLlama-3.1-8B-GGUF
Text Generation
• 8B • Updated • 26
tensorblock/Quasar-3.7-GGUF
mradermacher/Quasar-X-GGUF
8B • Updated • 418