讀紙 ReadPaper

由 Claude Code Max 翻譯的 AI 論文繁體中文版 · 101 篇

篩選標籤: 預訓練 2 篇 × 清除
2501.00656v3 CC BY 4.0 MIT

2 OLMo 2 Furious:完全開放的下一代語言模型家族

2 OLMo 2 Furious

OLMo Team(Pete Walsh, Luca Soldaini, Dirk Groeneveld, Kyle Lo, Shane Arora, Akshita Bhagia, ... Ali ...

LLMOLMo開源模型預訓練Mid-trainingRLVRTüluAllen AI
林伯燊 許願
2601.21343v1 arXiv License Meta FAIR

自我改進式預訓練:利用後訓練模型來預訓練更好的模型

Self-Improving Pretraining using post-trained models to pretrain better models

Ellen Xiaoqing Tan, Jack Lanchantin, Shehzaad Dhuliawala, Danwei Li, Thao Nguyen, Jing Xu, Ping Yu, ...

預訓練強化學習安全性事實性推理中期訓練LLM
Liang-Hsun Huang 許願