|
|
两万字长文!从第一性原理理解Diffusion & Flow Matching (SDE、ODE... 青稞AI · 公众号 · AI · 2 周前 · |
|
|
Multi-Agent 的新趋势:从 Agent Team 到 Agent Swarm 青稞AI · 公众号 · AI · 2 周前 · |
|
|
分享一些 insights|我们为什么会做 dLLM,又能否取代 AR? 青稞AI · 公众号 · AI · 2 周前 · |
|
|
从 RL 到蒸馏,再到软蒸馏:Why RL Matters? 青稞AI · 公众号 · AI · 2 周前 · |
|
|
聊聊 World Model in Agentic RL! 青稞AI · 公众号 · AI · 2 周前 · |
|
|
直播预告!聊聊 AI4AI 的前世今生:从进化、自进化与元进化,迈向递归自我改进(RSI) 青稞AI · 公众号 · AI · 2 周前 · |
|
|
Kimi K3、Qwen3.8-Max 官方评测都在用!伯克利硬核测试揭穿 AI 自进化假象 青稞AI · 公众号 · AI · 3 周前 · |
|
|
世界生成模型不仅仅是未来模拟器!上交大 Enfold:把世界模型的“未来计算”折叠进当下 青稞AI · 公众号 · AI · 3 周前 · |
|
|
LLM 何时会撞墙?又为什么 continual learning 的重要性会成为学界共识? 青稞AI · 公众号 · AI · 3 周前 · |
|
|
直播预告!聊聊 Agentic RL 下半场: 无需梯度更新的即时强化学习JitRL 青稞AI · 公众号 · AI · 3 周前 · |
|
|
正向 KL vs 反向 KL!为什么OPD、RLHF在线强化学习用反向KL,SFT离线蒸馏却用正向K... 青稞AI · 公众号 · AI · 3 周前 · |
|
|
不再困于自然语言!中科院自动化所最新推出 PhiZero,用“物理语言”帮助世界模型理解世界 青稞AI · 公众号 · AI · 3 周前 · |
|
|
模型部署后还能越跑越强!淘天 × 华科大最新提出 SERPO,在开放式任务上实现无标注自进化 青稞AI · 公众号 · AI · 3 周前 · |
|
|
长程智能体自我检查与早停行为:Reward Seeking 现象及其缓解措施 青稞AI · 公众号 · AI · 3 周前 · |
|
|
直播预告!与 NTU 博士后研究员操雨康,聊聊新一代具身智能数据范式 ACE-Data-0 青稞AI · 公众号 · AI · 3 周前 · |
|
|
一张全景图!拆解大模型推理性能优化技术的目标 青稞AI · 公众号 · AI · 3 周前 · |
|
|
打假大模型动态评测:你以为的“最新考题”,模型其实早就背过答案? 青稞AI · 公众号 · AI · 4 周前 · |
|
|
当 Agent 失败时,别急着怪模型:HarnessFix 如何从失败轨迹中修复 Harness 青稞AI · 公众号 · AI · 1 月前 · |
|
|
· 公众号 · AI · 1 月前 · |
|
|
· 公众号 · AI · 1 月前 · |