开发工具·EASYHUB 选读
DeepSeek 开源华为昇腾推理基础组件,FlashMLA 加入稀疏注意力预填充与解码内核

这次有什么变化
DeepSeek 9 月 30 日在 FlashMLA 仓库披露并开源面向华为昇腾平台的推理基础设施与核心组件,其中包括 DeepSeek Sparse Attention 的预填充和解码内核。官方文档称,在典型 DeepSeek V4.1 工作负载下相关内核达到 410/360 TFLOPS,约为硬件理论峰值的 95%/83%;这些性能数字来自 DeepSeek 自测。
- 原文标题
- A Deep Dive Into the Ascend Sparse Attention Forward Kernel
- 来源
- DeepSeek · github.com
- 主题
- 开发工具
- 原文月份
- 2026-09
本页是 EasyHub 根据所列来源整理的简短选读,不是完整报道或原创采访。预览、计划开放与正式可用以摘要及原文说明为准。
本站摘要页面发布 · 更新 · 内容说明