|
|
让具身智能推理延迟降 65%、token 省 50%!AgenticCache:从 CPU 分支预测... NeuralTalk · 公众号 · · 3 月前 · |
|
|
从"切多大、留什么、按什么顺序跑",重新定义编译器后端计算图调度:MLSys 2026 系统赛 A ... NeuralTalk · 公众号 · · 3 月前 · |
|
|
能效最高达 H100 3.23 倍!MemExplorer 框架重构面向 Agentic NPU 的... NeuralTalk · 公众号 · · 3 月前 · |
|
|
MoE 训练提速最高 38%!字节 Seed 开源 UniEP:首个训练级 MegaKernel 架... NeuralTalk · 公众号 · · 3 月前 · |
|
|
前Google TPU架构师访谈:从批大小经济学到MoE物理布局,从流水线并行陷阱到RL对训练策略颠... NeuralTalk · 公众号 · · 3 月前 · |