丁丁打折网 - 网友优惠券分享网站,有688999个用户

京东优惠券 小米有品优惠券

当前位置 : 首页>电脑数码>DeepSeek V4.1 Flash正式上线,具备原生多模态视觉理解能力

DeepSeek V4.1 Flash正式上线,具备原生多模态视觉理解能力

类别:电脑数码 发布时间:2026-09-10 18:34

据 DeepSeek 官方消息,DeepSeek V4.1 Flash 模型今天正式发布。这是 DeepSeek 全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。

DeepSeek 表示,新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。

据介绍,DeepSeek V4.1 Flash 为 552B 参数 MoE 混合专家模型,采用全新 Causal-Encoder-Decoder 非对称架构,输入与输出激活参数并不对等,输入激活仅 8B,输出激活 16B,运行成本相比同规格模型存在明显优势。模型经过全新预训练流程以及更大规模强化学习后训练,基准测试结果显示,综合能力已经超过 DeepSeek V4 Pro 等多款旗舰大模型。

在缓存开销层面,V4.1 Flash 对 KV Cache 占用做了优化。对比上一代产品,HBM 显存需求降至原来的 1/4, 存储需求缩减至 1/8。在 Agent 智能体这类业务场景中,缓存相关开销占比通常较高,KV Cache 压缩优化能够显著降低该类任务的调用成本。

DeepSeek V4.1 Flash 已同步上线 DeepSeek API,开发者调用模型标识 deepseek-flash 即可访问新版本,旧版 V4 Flash 以及 V4 Flash Vision Exp 已经下线。为保障业务平滑过渡,原有模型接口标识会临时路由指向 V4.1 Flash。

因 V4.1 Flash 在性能、调用成本、推理速度、整体耗时等维度全面优于 V4 Pro,官方计划逐步下线 V4 Pro。北京时间 9 月 14 日 12 点起,至 V4.1 Pro 正式发布前,指向 deepseek-v4-pro 的全部请求会自动切换到 V4.1 Flash,并且按照 V4.1 Flash 的单价计费。

腾讯 WorkBuddy、CodeBuddy 以及 OpenCode 作为合作方,已经完成该模型的全量接入。

依托架构层面的优化,V4.1 Flash 实现运行成本下降,官方同步下调对应 API 定价。平台继续沿用峰谷分时计费机制,闲时价格为高峰时段的一半,引导用户错峰使用,新计价规则已于 2026 年 9 月 10 日 12 点生效。

丁丁打折网©版权所有,未经许可严禁复制或镜像 ICP证: 湘ICP备2023003002号-11

Powered by 丁丁打折网本站为非营利性网站,本站内容均来自网络转载或网友提供,如有侵权或夸大不实请及时联系我们删除!本站不承担任何争议和法律责任!
技术支持:丁丁网 dddazhe@hotmail.com & 2010-2020 All rights reserved