专栏 RSS订阅(公众号)
温馨提示:订阅专栏后我们将尽力更新;开通 极速订阅 将快速且稳定更新;无人订阅的专栏有可能不会更新
程序化API访问方法
基础API: 未开通,请先订阅专栏再开通
高级API: 未开通,请先订阅专栏再开通
扩展API接口一: 未开通,请先订阅专栏再开通
专栏 二维码
TodayRss-海外RSS稳定源
他们也喜欢这个专栏
 • 
RSS订阅
今天看啥  ›  专栏  ›  NeuralTalk
关注深度学习框架开发、模型压缩、低比特量化、移动端推理加速性能优化、工程化部署
免责声明:本专栏仅为信息导航参考,不代表原文立场或观点。 原专栏内容版权归原作者所有,如您为原作者并希望删除该专栏,请通过 【版权申诉通道】联系我们处理。
不更新或者更新慢,请开通 RSS极速订阅 可分钟级获得文章
Qwen3-Next 实测性能暴涨!KVBuffer:IO 感知的线性注意力服务机制
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
11倍TTFT提速,零吞吐量损失!Stream2LLM 上下文流式化重构,让 RAG 系统真正实时
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
一行 import 换掉整条编译路径:Numba-CUDA-MLIR 用方言降级重写 Python ...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
34.93 倍加速!MLSys 26 DSA 智能体赛道冠军方案,一套规则手册与三个子智能体替代人类...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
MLSys 26 NVIDIA Blackwell 内核竞赛纯智能体方案 Kernel Design...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
速度:大模型推理的下一个 Scaling Law,深度解析 TileRT 高性能推理引擎及 GLM-...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
把 GPU 编程模型搬上 CPU:解剖 PoCL 的 OpenCL 编译器内核
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
从词法到语义:slang 项目用现代 C++构建最快的 SystemVerilog 编译器前端
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
240 万芯片实现 99%系统正常运行时间,谷歌提出完全异步分布式训练框架 Decoupled Di...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
字节 veRL 团队开源大规模通用 Agent 框架 Uni-Agent,用 model-tool-...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
一条命令把 Codex 桌面应用塞进浏览器,跨 Linux、Windows、Android Term...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
NVIDIA 开源 cuDNN Frontend:用图 API 把底层内核能力封装成可复用、可调优的...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
Claude 实现、Codex 审查、人类决策领航:Humanize 项目用 RLCR 编排长程闭环...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
从形式化推理到 GPU 加速!Lean4 + TileLang 张量程序超优化器,让 Attenti...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
用 Rust 在个人 PC 上构建下一代 AI 算力中枢:KeyCompute 架构浅析
NeuralTalk  ·  公众号  ·  ·  3 月前  ·