DeepSeek-V4发布,华为云首发适配
4月24日,DeepSeek-V4模型正式发布并开源,华为云首发适配。DeepSeek-V4 拥有百万Token超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。其中,DeepSeek-V4-Flash模型参数下降至284B,推理成本进一步降低,模型参数和激活更小,V4-Flash 能够提供更加快捷、经济的 API 服务,实现百万上下文普惠。当前,华为云MaaS模型即服务平台已为开发者提供免部署、一键调用DeepSeek-V4 -Flash API的Tokens服务。
在此次新模型适配过程中,华为云在系统层、算子层和集群层的关键能力上协同,分别从调度效率、计算效率和数据流转效率三个维度保障新模型快速适配与高性能落地。
针对DeepSeek-V4,华为云首发适配模型分层注意力压缩机制,实现V4注意力机制下 KVCache的高效分配管理,提供TopK、SWA、CFA等10+昇腾高性能融合算子,搭配框架异步调度、MTP多步投机等框架优化,支持原生1M长上下文的高性能推理。
华为云以高效的AI基础设施为核心打造“硅基黑土地”,开放接纳自研和第三方主流大模型和众多智能体,为企业解难题,提升生产效率。 据悉,金山办公、360等企业已通过华为云接入DeepSeek新模型,此外,DeepSeek-V4-Pro版本也将于近日上线。
版权所有,未经授权不得以任何形式转载及使用,违者必究。
- 蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-Flash2026-07-27
- 抢跑!全球化新品牌进入AI时刻,何以定胜负? | 2026全球化新品牌AI竞争力大会实录2026-07-24
- 领克07GT重磅上市,以越级驾趣+全场景拓展生态掀翻旅行车市场2026-07-24
- 从斑马鱼到空天飞行器,一个AI平台正在重写科学发现的规则2026-07-22




