摘要: 9 月 29 日,DeepSeek 最新发布的 DeepSeek-V3.2-Exp 模型引入了自主研发的 DeepSeek Sparse Attention(DSA)稀疏注意力机制,在几乎不影响模型性能的前提下,实现了长文本训练和推理效率的大幅提升。本文旨在深入解析 DSA 的技术原理,并重点探讨中 阅读全文
posted @ 2025-10-11 09:56 中昊芯英 阅读(748) 评论(0) 推荐(0)
摘要: 12月30日,甲子光年智库正式发布《中国AI算力行业发展报告》。中昊芯英受邀参与了该报告的编写工作,并为报告的编写贡献了专业的见解和实践经验。 阅读全文
posted @ 2024-12-31 17:23 中昊芯英 阅读(233) 评论(0) 推荐(0)