寒武纪已适配DeepSeek-V3.2-Exp,同步开源推理引擎vLLM-MLU
IT之家 9 月 30 日消息,DeepSeek 昨日正式发布了 DeepSeek-V3.2-Exp 模型,这是一个实验性(Experimental)的版本。IT之家注意到,寒武纪当天宣布,已同步实现对深度求索公司最新模型 DeepSeek-V3.2-Exp 的适配,并开源大模型推理引擎 vLLM-MLU 源代码。
寒武纪称,一直高度重视大模型软件生态建设,支持以 DeepSeek 为代表的所有主流开源大模型。借助于长期活跃的生态建设和技术积累,寒武纪得以快速实现对 DeepSeek-V3.2-Exp 这一全新实验性模型架构的 day 0 适配和优化。
针对本次的 DeepSeek-V3.2-Exp 新模型架构,寒武纪通过 Triton 算子开发实现了快速适配,利用 BangC 融合算子开发实现了极致性能优化,并基于计算与通信的并行策略,再次达成了业界领先的计算效率水平。依托 DeepSeek-V3.2-Exp 带来的全新 DeepSeek Sparse Attention 机制,叠加寒武纪的极致计算效率,可大幅降低长序列场景下的训推成本,共同为客户提供极具竞争力的软硬件解决方案。
vLLM-MLU DeepSeek-V3.2-Exp 适配的源码:
延伸阅读:
微言 |AI 仿冒明星直播带货?网信部门重拳整治,乱象当止!
有网络账号用 AI 冒充公众人物直播带货,本尊上线竟被拉黑。近期,网信部门重拳出击,从严整治此类利用AI仿冒公众人物开展...
新能源汽车5年狂飙路:年均增长率超75%,智能化“下半场”如何继续领跑?
本文来源:时代周报 作者:刘学小区停车场里的绿牌车,已随处可见;商场地库的快充桩,成了新的“黄金车位”;买车首先要考虑的...
登顶iOS游戏畅销榜,《崩坏:星穹铁道》新角色引争议
Sensor Tower数据显示,11月14日,米哈游推出的RPG手游《崩坏:星穹铁道》位居10月中国出海手游收入榜第1...
