移动平台
2026/9/10 15:11

DeepSeek发布最新模型V4.1 Flash

0
0

C114讯 9月10日消息(岳明)今天,DeepSeek V4.1 Flash模型正式发布。

DeepSeek方面表示,这是该公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。

据悉,DeepSeek V4.1 Flash为552B参数的MoE模型,采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeek V4 Pro在内的一众旗舰模型的智能水平。

图:DeepSeek-V4.1-Flash与主流前沿模型在Agentic Benchmark上的性能对比。

同时,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。

伴随新模型的发布,DeepSeek同步调整了API定价。该公司称,DeepSeek V4.1 Flash能够以更低的成本服务更多的用户,因此相应下调了V4.1 Flash的定价——依然采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。

腾讯(WorkBuddy、CodeBuddy)和 OpenCode作为官方合作伙伴,现已全量接入DeepSeek V4.1Flash。

免责声明:本文仅代表作者个人观点,与C114通信网无关。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。

给作者点赞
0 VS 0
写得不太好

C114简介     联系我们     网站地图

Copyright©1999-2025 c114 All Rights Reserved 沪ICP备12002291号-4

C114通信网版权所有 举报电话:021-54451141 用户注销