|
|
Agent 系统正在重新走一遍 OS 和 Cloud Runtime 的老路 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
超越TurboQuant:Together AI把2-bit KV Cache推向真实服务 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
卷的离谱?花了1个月死磕自动驾驶规控:PID/MPC/A*/Lattice planner(从理论撸... 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
解决大模型训练 Loss Spike!重新设计激活函数 SwiGLU,聊聊蚂蚁 Ling 模型背后的... 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
打破Agent训练瓶颈!人大 & 至知研究院开源Claw Agent数据+训练+评测全链条 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
我眼中的Harness:复杂优化问题,AGI灵魂争夺之战 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
凌晨2点,我在微信里让AI写完了整个项目 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
浅谈AI编译器趋势:从更快的kernel到重新定义执行边界 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
深度学习模型推理部署实战:CUDA开发与TensorRT量化加速 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
Harness 工程及设计模式 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
一文搞懂如何极致的使用Codex「最佳实践」 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
从 KL 的方向看 SFT 与 RL:大模型到底是在”学会做”,还是在”学会选”? 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
重构大模型推理网络:ZCube 如何避免结构性网络拥塞 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
如何合成 Agentic 事实性 SFT / Mid-train 数据? 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
大语言模型为什么能像人一样说话和思考? 吃果冻不吐果冻皮 · 公众号 · · 3 月前 · |
|
|
DSv4放弃MLA了吗? 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |
|
|
OpenAI 翁家翌:“启发式学习”的强化学习新范式 吃果冻不吐果冻皮 · 公众号 · · 4 月前 · |