|
|
网页Agent为什么一换网站就失忆?问题可能出在它只会看文字 AI帝国 · 公众号 · · 2 月前 · |
|
|
让Agent拥有“肌肉记忆”:PreAct把成功操作编译成可验证状态机 AI帝国 · 公众号 · · 2 月前 · |
|
|
Agent为什么总是反复犯错?新方法让模型学会“边干活边记笔记” AI帝国 · 公众号 · · 2 月前 · |
|
|
混合架构中,高效注意力不决定长文本上限,只改变学习速度 AI帝国 · 公众号 · · 2 月前 · |
|
|
Agent真的会推理吗?新研究发现:复杂规则发现任务几乎全军覆没 AI帝国 · 公众号 · · 2 月前 · |
|
|
不让模型看标准答案,反而学得更好:一种全新的RL训练方法 AI帝国 · 公众号 · · 2 月前 · |
|
|
AI-Newton:让AI像科学家一样,从实验中生成物理概念 AI帝国 · 公众号 · · 2 月前 · |
|
|
不改参数,agent自己改操作规则,未见任务通过率能提升吗 AI帝国 · 公众号 · · 2 月前 · |
|
|
AI辩论的“一致性幻觉”:答案一致了,推理却更分裂? AI帝国 · 公众号 · · 2 月前 · |
|
|
语音LLM的关键,不只是离散token,而是时序轨迹与嵌入几何 AI帝国 · 公众号 · · 2 月前 · |
|
|
每年10倍算力增长,奇点未必如期而至 AI帝国 · 公众号 · · 2 月前 · |
|
|
训练agent,为什么要先造好交互环境? AI帝国 · 公众号 · · 2 月前 · |
|
|
内部指标失灵后,这个AI系统自行反转了搜索策略 AI帝国 · 公众号 · · 2 月前 · |