Amjad Masad
Amjad Masad 在训练国际象棋LLM时意外发现,混合约8%的推理轨迹数据能显著提升效果,在同等预算下超越纯移动数据训练
多源视角
~1500 Elo!<br><br>Consistently beats frontier models and Stockfish level 0.<br><br>Fun seeing an 8b model mogging GPT 5.6 with high reasoning and response chaining. Spends 1-2 seco…
查看这条来源1300 Elo!<br><br>https://qwen-chess.replit.app/<br><img width="1179" height="444" style="" src="https://pbs.twimg.com/media/HOXfgNBbUAA7ozf?format=jpg&name=orig" referrerpolicy…
查看这条来源AI 摘要
Amjad Masad 在训练国际象棋LLM时意外发现,混合约8%的推理轨迹数据能显著提升效果,在同等预算下超越纯移动数据训练。
推荐理由常规快讯,保留列表
原文
无法获取正文,可打开下方原始链接查看。
62/100
讨论
暂无评论。