|
|
当 Harness 也能被 AI 自动设计:AI4AI 正在重写小模型变强的方式 青稞AI · 公众号 · AI · 10 小时前 · |
|
|
分级缓存 + 投机解码 + 正交分片:Macaron-V1 的长上下文推理实践 青稞AI · 公众号 · AI · 昨天 · |
|
|
华为 & 港中文最新开源 Lego-RL:让 Coding Agent 的强化学习训练真正"长稳可靠... 青稞AI · 公众号 · AI · 2 天前 · |
|
|
Harness 基座模型 JIT-27B,为每个任务写一套“Claude Code” 青稞AI · 公众号 · AI · 3 天前 · |
|
|
从 Infra 角度看,为什么去掉 Encoder 更好? 青稞AI · 公众号 · AI · 4 天前 · |
|
|
直播预告!到底模型的“什么经验值得被看见”?一起聊聊 LOPD:不再手动设计 OPSD 特权信息 青稞AI · 公众号 · AI · 5 天前 · |
|
|
关于 RSI 的一些思考:Test-Time 沉淀与 Training-Time 演化的架构终局 青稞AI · 公众号 · AI · 5 天前 · |
|
|
聊聊 Agentic RL 中的多轮 rollout、上下文重建与 RL 训练 青稞AI · 公众号 · AI · 6 天前 · |
|
|
Infra 也能自进化?Φ-Bench 深度评测:大模型距离“AI 工程师”还有多远? 青稞AI · 公众号 · AI · 1 周前 · |
|
|
自回归模型写错了就再也改不了?EchoChange 另辟蹊径,把遥感变化描述变成"可以反复修改的填空... 青稞AI · 公众号 · AI · 1 周前 · |
|
|
自进化也能“左脚踩右脚”?Google 最新提出 EnvHarness:环境自进化,倒逼 Agent... 青稞AI · 公众号 · AI · 1 周前 · |
|
|
将 Harness 引入评测领域!HarnessEval 开启评测新时代,让 Agentic Ben... 青稞AI · 公众号 · AI · 1 周前 · |
|
|
直播预告!聊聊 TriAttention:面向长上下文推理的三角级数式 KV Cache 压缩 青稞AI · 公众号 · AI · 1 周前 · |
|
|
唐杰|关于缩放定律的思考:参数不是唯一旋钮 青稞AI · 公众号 · AI · 1 周前 · |
|
|
LLM RL 为什么反直觉地高效?决定 RL 训练效率的,不只是拿到了多少 bits! 青稞AI · 公众号 · AI · 1 周前 · |
|
|
直播预告!不依赖外部信息,聊聊如何在 latent space(隐空间)里实现大语言模型的优化和推理 青稞AI · 公众号 · AI · 1 周前 · |
|
|
为什么复杂 RL 离不开分布式系统,分布式 RL 的核心矛盾又是什么? 青稞AI · 公众号 · AI · 1 周前 · |
|
|
大模型 MoE 负载均衡的 N 种方法 青稞AI · 公众号 · AI · 2 周前 · |
|
|
两万字长文!从第一性原理理解Diffusion & Flow Matching (SDE、ODE... 青稞AI · 公众号 · AI · 2 周前 · |
|
|
Multi-Agent 的新趋势:从 Agent Team 到 Agent Swarm 青稞AI · 公众号 · AI · 2 周前 · |