|
|
小模型喂再多数据也学不会的任务,大模型凭什么能? AI帝国 · 公众号 · · 2 月前 · |
|
|
数据不够时,遮蔽输入能补多少训练数据? AI帝国 · 公众号 · · 2 月前 · |
|
|
真实行业任务这场考试,前沿Agent为什么平均只过了2.6%? AI帝国 · 公众号 · · 2 月前 · |
|
|
文本CoT不适合机器人?这支团队用「动作草图」替代语言推理 AI帝国 · 公众号 · · 2 月前 · |
|
|
训练刚开始,子空间就锁死了——在线蒸馏的几何秘密 AI帝国 · 公众号 · · 2 月前 · |
|
|
Agent部署前,能不能先用Lean4查逻辑bug? AI帝国 · 公众号 · · 2 月前 · |
|
|
无人机在长指令时,为什么要先想再飞? AI帝国 · 公众号 · · 2 月前 · |
|
|
AI记忆系统为什么常输给最朴素的全上下文? AI帝国 · 公众号 · · 2 月前 · |
|
|
用因果图给LLM做"推理透视",来看看LLM到底是怎么“思考”的 AI帝国 · 公众号 · · 2 月前 · |
|
|
小实验选数据配比,放大后为什么会失灵? AI帝国 · 公众号 · · 2 月前 · |
|
|
10000组近似任务里,agent 是怎么实现快7.5倍的? AI帝国 · 公众号 · · 2 月前 · |