|
|
AI Infra面试复盘! 吃果冻不吐果冻皮 · 公众号 · · 19 小时前 · |
|
|
终于有人把大模型LLM讲明白了~ 吃果冻不吐果冻皮 · 公众号 · · 2 天前 · |
|
|
2天4个项目!彻底攻克四足机器人VLN真机部署,建议所有机器人人都来参加这场实训! 吃果冻不吐果冻皮 · 公众号 · · 4 天前 · |
|
|
写于AGI的前夜:黎明前的Singularity 吃果冻不吐果冻皮 · 公众号 · · 4 天前 · |
|
|
Agent主流技术总结(架构/上下文/评估/自进化) 吃果冻不吐果冻皮 · 公众号 · · 4 天前 · |
|
|
终局奖励之后:从 Apodex 1.1 看长程 Agentic RL 如何分配 credit 吃果冻不吐果冻皮 · 公众号 · · 5 天前 · |
|
|
GRPO问题排查:训练信号的监控 吃果冻不吐果冻皮 · 公众号 · · 5 天前 · |
|
|
GRPO问题排查:训练信号的监控 吃果冻不吐果冻皮 · 公众号 · · 1 周前 · |
|
|
GRPO如何监控模型多样性? 吃果冻不吐果冻皮 · 公众号 · · 1 周前 · |
|
|
从写代码到写提示词:一个程序员在AI时代的生存手记 吃果冻不吐果冻皮 · 公众号 · · 1 周前 · |
|
|
GRPO训炸了怎么办? 吃果冻不吐果冻皮 · 公众号 · · 1 周前 · |
|
|
2万字详解MoE:模型结构与工程实现 吃果冻不吐果冻皮 · 公众号 · · 1 周前 · |
|
|
1.5万字速通LLM主流模型结构(Llama、Qwen、GLM、Deepseek...) 吃果冻不吐果冻皮 · 公众号 · · 2 周前 · |
|
|
关于 RSI (递归自进化) 的一些思考 吃果冻不吐果冻皮 · 公众号 · · 2 周前 · |
|
|
vLLM如何适配Qwen3.8-Flash-Next? 吃果冻不吐果冻皮 · 公众号 · · 2 周前 · |
|
|
GLM 5.3技术报告看完了,聊点感想~ 吃果冻不吐果冻皮 · 公众号 · · 2 周前 · |
|
|
LLM RL 为什么反直觉地高效?决定 RL 训练效率的,不只是拿到了多少 bits! 吃果冻不吐果冻皮 · 公众号 · · 3 周前 · |
|
|
大模型 MoE 负载均衡的 N 种方法 吃果冻不吐果冻皮 · 公众号 · · 4 周前 · |