|
|
从数据顺序到拒答误伤:预训练课程如何塑造模型内部回路 AI帝国 · 公众号 · · 1 月前 · |
|
|
Agent轨迹长短不一,GRPO为什么会被最慢样本拖住? AI帝国 · 公众号 · · 1 月前 · |
|
|
微调该复用旧特征,还是继续学习新特征?关键藏在层间尺度里 AI帝国 · 公众号 · · 1 月前 · |
|
|
不写推理过程,大模型能在内部规划多少步? AI帝国 · 公众号 · · 1 月前 · |
|
|
AI能否补上人的短板,取决于双方的错误是否互补 AI帝国 · 公众号 · · 1 月前 · |