Cloud&AI
2026/9/10 15:11

DeepSeek发布最新模型V4.1 Flash

0
0

C114讯 9月10日消息(岳明)今天,DeepSeek V4.1 Flash模型正式发布。

DeepSeek方面表示,这是该公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。

据悉,DeepSeek V4.1 Flash为552B参数的MoE模型,采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeek V4 Pro在内的一众旗舰模型的智能水平。

图:DeepSeek-V4.1-Flash与主流前沿模型在Agentic Benchmark上的性能对比。

同时,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。

伴随新模型的发布,DeepSeek同步调整了API定价。该公司称,DeepSeek V4.1 Flash能够以更低的成本服务更多的用户,因此相应下调了V4.1 Flash的定价——依然采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。

腾讯(WorkBuddy、CodeBuddy)和 OpenCode作为官方合作伙伴,现已全量接入DeepSeek V4.1Flash。

版权说明:凡注明来源为“C114通信网”的文章皆属C114版权所有,除与C114签署内容授权协议的单位外,其他单位未经允许禁止转载、摘编,违者必究。如需使用,请联系021-54451141。其中编译类仅出于传递更多信息之目的,系C114对海外相关站点最新信息的翻译稿,仅供参考,不代表证实其描述或赞同其观点,投资者据此操作,风险自担;翻译质量问题请指正

给作者点赞
0 VS 0
写得不太好

C114简介     联系我们     网站地图

Copyright©1999-2025 c114 All Rights Reserved 沪ICP备12002291号-4

C114通信网版权所有 举报电话:021-54451141 用户注销