由 Claude Code Max 翻譯的 AI 論文繁體中文版 · 101 篇
FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models
Xin Guo、Haotian Xia、Zhaowei Liu、Hanyang Cao、Zhi Yang 等 17 人(上海財經大學、UC Irvine、復旦大學、平安科技、騰訊優圖、HSBC Lab...
Agent Seer: Synthesizing Scenarios from Specification Understanding
Harish Karumuri、Mahesh Vemula、David Lopes Pegna(Apple)
Contrastive Decoding Mitigates Score Range Bias in LLM-as-a-Judge
Yoshinari Fujinuma