寒武纪已适配DeepSeek-V3.2-Exp,同步开源推理引擎vLLM-MLU
IT之家 9 月 30 日消息,DeepSeek 昨日正式发布了 DeepSeek-V3.2-Exp 模型,这是一个实验性(Experimental)的版本。IT之家注意到,寒武纪当天宣布,已同步实现对深度求索公司最新模型 DeepSeek-V3.2-Exp 的适配,并开源大模型推理引擎 vLLM-MLU 源代码。
寒武纪称,一直高度重视大模型软件生态建设,支持以 DeepSeek 为代表的所有主流开源大模型。借助于长期活跃的生态建设和技术积累,寒武纪得以快速实现对 DeepSeek-V3.2-Exp 这一全新实验性模型架构的 day 0 适配和优化。
针对本次的 DeepSeek-V3.2-Exp 新模型架构,寒武纪通过 Triton 算子开发实现了快速适配,利用 BangC 融合算子开发实现了极致性能优化,并基于计算与通信的并行策略,再次达成了业界领先的计算效率水平。依托 DeepSeek-V3.2-Exp 带来的全新 DeepSeek Sparse Attention 机制,叠加寒武纪的极致计算效率,可大幅降低长序列场景下的训推成本,共同为客户提供极具竞争力的软硬件解决方案。
vLLM-MLU DeepSeek-V3.2-Exp 适配的源码:
延伸阅读:
荣耀Power2震撼登场:万元级续航怪兽携三色美学亮相
IT之家 12 月 29 日消息,荣耀开启新一代荣耀 Power2 手机预热,宣布荣耀 Power2 手机将于 1 月 ...
七鲜小厨全国扩张在即:品质快餐新模式加速落地
IT之家 12 月 29 日消息,据京东黑板报今日消息,京东旗下餐饮平台七鲜小厨面向全国招募经营合伙人,七鲜小厨要走向全...
华为发布高性能长寿命SSD:eKitStor Xtreme 201重塑消费级存储标准
IT之家 12 月 29 日消息,华为坤灵 (HUAWEI eKit) 近期推出了 HUAWEI eKitStor Xt...
格科微电子突破影像边界:双款50MP传感器引领手机摄影新纪元
IT之家 12 月 29 日消息,国产 CMOS 厂商格科微电子今日官宣推出两款全新规格的单芯片 5000 万像素图像传...
