|
|
跑了几千次实验后发现:AI Agent搭流水线很行,验证自己最薄弱 AI帝国 · 公众号 · · 2 月前 · |
|
|
用小模型参数预测大模型最优数据配比,这篇论文做到了 AI帝国 · 公众号 · · 2 月前 · |
|
|
多轮自进化三轮就崩?LLM Agent经验内化的三个关键选择 AI帝国 · 公众号 · · 2 月前 · |
|
|
后训练推理数据到底怎么用才对? AI帝国 · 公众号 · · 2 月前 · |
|
|
预训练4B token就能上RL? AI帝国 · 公众号 · · 2 月前 · |
|
|
AUTOLAB实测,11家旗舰模型谁能做长程自动科研? AI帝国 · 公众号 · · 2 月前 · |
|
|
开箱即用agent能筛数据,但想超越强基线还得靠脚手架 AI帝国 · 公众号 · · 2 月前 · |
|
|
均匀混合就够用?数据受限和SFT时未必 AI帝国 · 公众号 · · 2 月前 · |
|
|
模型靠自己生成的文本就能进步?前提是这些数据得"配得上"它 AI帝国 · 公众号 · · 3 月前 · |
|
|
给闭源agent装个"外脑":不训练模型,能治好长任务健忘症不 AI帝国 · 公众号 · · 3 月前 · |