view article Article Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps +1 iamleonie, burtenshaw, sergiopaniego β’ 3 days ago β’ 47
view article Article Training a coding model to paint watercolours with TRL and OpenEnv sergiopaniego β’ 3 days ago β’ 45
Kraken PP-OCRv6 text recognition models Collection Hub mirrors of Benjamin Kiessling's multilingual PP-OCRv6 line-recognition family for Kraken: tiny, small, and medium. β’ 3 items β’ Updated 2 days ago β’ 6
PILOT in the Loop: Live Self-Improvement for Long-Horizon Agents Paper β’ 2608.26530 β’ Published 10 days ago β’ 33
LiquidAI/LFM2.5-1.2B-Instruct-DSpark Text Generation β’ 0.3B β’ Updated 16 days ago β’ 1.87k β’ 32
KRLabsOrg/lettucedect-v2-mmbert-base Token Classification β’ 0.3B β’ Updated 23 days ago β’ 2.06k β’ 4
orcarouter/Qwen3.8-27B-Uncensored-MLX Image-Text-to-Text β’ 27B β’ Updated 9 days ago β’ 139k β’ 1.3k
Agentic Transaction: Towards ACID-Compliant Agent Systems Paper β’ 2608.13900 β’ Published 23 days ago β’ 27
How Do Agents Fail on AutoResearch: End-to-End Diagnostic Evaluation on 100 Real-World Frontier Research Tasks Paper β’ 2608.14905 β’ Published 23 days ago β’ 31