Jina-OCR-v1: Efficient Document Parsing with Speculative Decoding and Dense Verifiable Rewards
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models
Autodata: An agentic data scientist to create high quality synthetic data
LongAct Harnessing Intrinsic Activation Patterns for Long-Context Reinforcement Learning
Act Wisely Cultivating Meta-Cognitive Tool Use in Agentic Multimodal Models