electricsheepafrica/africa-ghana-annual-distribution-of-casualties-a4dfb40a Viewer • Updated 1 day ago • 160 • 1
LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget Paper • 2607.14952 • Published 4 days ago • 176
The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning Paper • 2606.29526 • Published 22 days ago • 168
Reflective Prompt Tuning through Language Model Function-Calling Paper • 2605.21781 • Published May 20 • 9
CollectionLoRA: Collecting 50 Effects in 1 LoRA via Multi-Teacher On-Policy Distillation Paper • 2605.25378 • Published May 25 • 62
epispasm/qwen3.5-9b-nsfw-captioning-v5_from_oldhag88_epispasm_trained_v2_overtrained_gguf 9B • Updated May 28 • 600 • 1
Perception or Prejudice: Can MLLMs Go Beyond First Impressions of Personality? Paper • 2605.22109 • Published May 21 • 171