VicroCode
让代码创造价值
VicroCode是一个轻量级代码在线发布、交易平台,开箱即用,免部署、免服务器、免备案,支持接入智能体、通用管理系统、游戏等多种项目
稍候片刻,您可先学习AI编程手册
正在加载中...

市场信息

DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调

IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.

www.ithome.com · 2026-09-10T05:50:17+00:00

IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。

新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。

同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比 此外,新一代模型大幅减少了 KV Cache 缓存的大小,与上一代模型相比, 对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8 。

在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。如图展示了 DeepSeek 在减少上下文存储方面的持续进展。

相对于初代模型,KV Cache 是原来的 1/437。 DeepSeek V4.1 Flash 已同步上线 DeepSeek API,原生支持多模态, 将模型名称更改为 deepseek-flash 即可调用最新的 V4.1 Flash 模型 。

旧版本模型 V4 Flash 与 V4 Flash Vision Exp 现已下线,出于兼容考虑,模型名 deepseek-v4-flash、 deepseek-v4-flash-vision-exp 将被暂时路由到 V4.1 Flash。同时,经多方测试, V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro ,因此官方计划有序下线 V4 Pro 模型。

北京时间 2026 年 9 月 14 日 12:00 之后,至未来 V4.1 Pro 上线之前,用户访问 deepseek-v4-pro 的请求将全部路由到 V4.1 Flash,并按 V4.1 Flash 单价计费。腾讯(WorkBuddy、CodeBuddy)和 OpenCode 作为官方合作伙伴,现已全量接入 DeepSeek V4.1 Flash。

得益于模型架构的创新,DeepSeek V4.1 Flash 能够以更低的成本服务更多的用户, 因此官方相应下调了 V4.1 Flash 的定价 。同时,为了更合理地调配资源,DeepSeek V4.1 Flash 仍然采用 峰谷定价 ,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。

新价格于 2026 年 9 月 10 日 12:00 开始生效。 IT之家附模型开源链接: /ai-market-guide/ 论文链接: /ai-market-guide/

返回 AI 市场导读

来源:ithome.com