专栏 RSS订阅(公众号)
温馨提示:订阅专栏后我们将尽力更新;开通 极速订阅 将快速且稳定更新;无人订阅的专栏有可能不会更新
程序化API访问方法
基础API: 未开通,请先订阅专栏再开通
高级API: 未开通,请先订阅专栏再开通
扩展API接口一: 未开通,请先订阅专栏再开通
专栏 二维码
TodayRss-海外RSS稳定源
他们也喜欢这个专栏
 • 
RSS订阅
今天看啥  ›  专栏  ›  NeuralTalk
关注深度学习框架开发、模型压缩、低比特量化、移动端推理加速性能优化、工程化部署
免责声明:本专栏仅为信息导航参考,不代表原文立场或观点。 原专栏内容版权归原作者所有,如您为原作者并希望删除该专栏,请通过 【版权申诉通道】联系我们处理。
不更新或者更新慢,请开通 RSS极速订阅 可分钟级获得文章
Better Harnesses, Smaller LLM!CMU 用自动化 Harness 让小模...
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
Mac 跑大模型还能再快 56%?BaseRT 揭开 Apple Silicon 被低估的推理天花板
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
单请求推理比 vLLM 快 7%!港城大 AgentCompile 用 LLM 引导编译刷新性能
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
Tile-AI 开源 TileFoundry:基于 Tile、面向跨硬件自动生成高性能程序的 Age...
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
89%手写 RTL 效率!首个端到端 DL 模型到 FPGA 硬核的自动化编译流 ATLAS
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
LLM 能写代码却做不好 IR 设计?那就用形式理论重构 MLIR AI 编译底层设计逻辑
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
下一代自进化 Agent 的真正瓶颈不是算法,是系统底座!蚂蚁联合港科大、清华揭开企业级智能体 RL...
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
微软提出 Tile 级激活重叠:H100 专用 SwiGLU 内核达成 79.5%峰值 BF16 算...
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
FlashNormAttention 融合注意力与归一化到 GEMM,最高可掩盖 90%归一化时延
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
从 EDA 软件到硬件 RTL:NVIDIA 仓库级代码自进化智能体框架 HORIZON,重构大模型...
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
Harness 更新 ≠ Harness 获益:解耦自进化 LLM 智能体的两种核心能力
NeuralTalk  ·  公众号  ·  ·  1 月前  · 
多模态时延降 20%、机器人规划提速 12.5 倍!斯坦福提出 M*:面向多模态模型的模块化、可扩展...
NeuralTalk  ·  公众号  ·  ·  1 月前  ·