Jina-OCR-v1: Efficient Document Parsing with Speculative Decoding and Dense Verifiable Rewards
Joint Optimization of Tool Creation and Use for Large Language Model Agents
Achieving Gold-Medal-Level Olympiad Reasoning via Simple and Unified Scaling
Co-Evolving Policy Distillation
Self-Distilled RLVR
2 OLMo 2 Furious