专栏 RSS订阅(公众号)
温馨提示:订阅专栏后我们将尽力更新;开通 极速订阅 将快速且稳定更新;无人订阅的专栏有可能不会更新
程序化API访问方法
基础API: 未开通,请先订阅专栏再开通
高级API: 未开通,请先订阅专栏再开通
扩展API接口一: 未开通,请先订阅专栏再开通
专栏 二维码
TodayRss-海外RSS稳定源
他们也喜欢这个专栏
 • 
RSS订阅
今天看啥  ›  专栏  ›  NeuralTalk
关注深度学习框架开发、模型压缩、低比特量化、移动端推理加速性能优化、工程化部署
免责声明:本专栏仅为信息导航参考,不代表原文立场或观点。 原专栏内容版权归原作者所有,如您为原作者并希望删除该专栏,请通过 【版权申诉通道】联系我们处理。
不更新或者更新慢,请开通 RSS极速订阅 可分钟级获得文章
不止算子优化!ncnn Vulkan int8 量化推理后端:全链路架构设计与系统性优化
NeuralTalk  ·  公众号  ·  ·  2 月前  · 
端到端 FP4 训练崩溃真凶,是权重梯度!确定性哈达玛实现端到端 9%-10%提速
NeuralTalk  ·  公众号  ·  ·  2 月前  · 
Helion DSL 赋能 vLLM 实现跨硬件高效推理:Qwen3 模型 FP8 推理加速实践
NeuralTalk  ·  公众号  ·  ·  2 月前  · 
加速GR00T N1.6具身VLA模型训练!LoongForge 开源框架实现三层全链路优化,吞吐提...
NeuralTalk  ·  公众号  ·  ·  2 月前  · 
Albireo 突破阿姆达尔极限:对比 vLLM 与 SGLang,LLM 推理吞吐量最高提升 1....
NeuralTalk  ·  公众号  ·  ·  2 月前  · 
从大规模分布式机器学习系统、AI 编译器到国产算力系统!冯思远课题组长期招收 PhD 与科研实习生
NeuralTalk  ·  公众号  ·  ·  2 月前  · 
骁龙 8 Gen3 预填充 CPU 性能反超 NPU:移动端大模型异构推理能力重估
NeuralTalk  ·  公众号  ·  ·  2 月前  · 
全智能体与人机协同双方案复盘 GPU Kernel 生成与优化:MLSys 2026 FlashIn...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
对标 A100:拆解摩尔线程开源的 GPU 驱动级基准测试 gpu-compute-driver-b...
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
超优化驱动的数值计算库自动学习系统,实现数学原语高效挖掘与最高 2.2× 性能增益
NeuralTalk  ·  公众号  ·  ·  3 月前  · 
RTP-LLM:阿里开源工业级 LLM 推理引擎,模型加载提速 6.3 倍、TTFT 降低 37%,...
NeuralTalk  ·  公众号  ·  ·  3 月前  ·