寒武纪适配DeepSeek-V3.2,大模型与AI芯片协同创新
来源:陈超月发布时间:2025-09-29986浏览
询问 AI9月29日,深度求索公司正式发布新一代模型架构DeepSeek-V3.2,同时寒武纪宣布完成对该模型的适配,并开源大模型推理引擎vLLM源代码。
此次发布的DeepSeek-V3.2-Exp为实验性版本,作为迈向新一代架构的中间步骤,该模型在V3.1-Terminus基础上引入了DeepSeek Sparse Attention(稀疏注意力机制),针对长文本训练和推理效率进行了优化和验证。目前,DeepSeek官方App、网页端和小程序均已更新至V3.2-Exp版本,同时API价格大幅下调,欢迎用户测试并反馈意见。
寒武纪同步实现了对DeepSeek-V3.2-Exp的适配,并开源了vLLM-MLU源代码。开发者可通过寒武纪软硬件平台第一时间体验新模型的亮点。据行业测算,DeepSeek-V3.2-Exp模型体量达671GB,在理想带宽条件下,仅下载该模型就需要8至10小时。芯片与大模型的适配涉及底层架构优化、算力资源匹配及兼容性调试等复杂工作,通常耗时较长。
据AI行业资深专家分析,寒武纪在DeepSeek-V3.2发布前便已启动适配研发,双方在技术层面的深度协作早已展开。这种低调务实、专注技术的风格,体现了中国顶尖科技企业的典型特征。
在全球AI竞争日益激烈的背景下,中国AI产业要占据国际优势地位,离不开头部企业的协同合作。此次大模型与AI芯片领军企业的快速联动,正是国内高科技企业协同创新的典范。未来,这一深度协同有望显著降低大模型用户在长序列场景下的训练和推理成本,推动AI应用的进一步发展。
[DeepSeek开源模型获取方式](https://huggingface.co/deepseek-ai/DeepSeek-V3.2-Exp)
[vLLM-MLU DeepSeek-V3.2-Exp适配的源码获取方式](https://github.com/Cambricon/vllm-mlu)
新闻来源:陈超月,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。
