首页 > 业界资讯 > 正文

DeepSeek V4.1 Flash正式上线,具备原生多模态视觉理解能力

【太平洋科技快讯】据 DeepSeek 官方消息,DeepSeek V4.1 Flash 模型今天正式发布。这是 DeepSeek 全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。

DeepSeek 表示,新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。

据介绍,DeepSeek V4.1 Flash 为 552B 参数 MoE 混合专家模型,采用全新 Causal-Encoder-Decoder 非对称架构,输入与输出激活参数并不对等,输入激活仅 8B,输出激活 16B,运行成本相比同规格模型存在明显优势。模型经过全新预训练流程以及更大规模强化学习后训练,基准测试结果显示,综合能力已经超过 DeepSeek V4 Pro 等多款旗舰大模型。

在缓存开销层面,V4.1 Flash 对 KV Cache 占用做了优化。对比上一代产品,HBM 显存需求降至原来的 1/4,SSD 存储需求缩减至 1/8。在 Agent 智能体这类业务场景中,缓存相关开销占比通常较高,KV Cache 压缩优化能够显著降低该类任务的调用成本。

DeepSeek V4.1 Flash 已同步上线 DeepSeek API,开发者调用模型标识 deepseek-flash 即可访问新版本,旧版 V4 Flash 以及 V4 Flash Vision Exp 已经下线。为保障业务平滑过渡,原有模型接口标识会临时路由指向 V4.1 Flash。

因 V4.1 Flash 在性能、调用成本、推理速度、整体耗时等维度全面优于 V4 Pro,官方计划逐步下线 V4 Pro。北京时间 9 月 14 日 12 点起,至 V4.1 Pro 正式发布前,指向 deepseek-v4-pro 的全部请求会自动切换到 V4.1 Flash,并且按照 V4.1 Flash 的单价计费。

腾讯 WorkBuddy、CodeBuddy 以及 OpenCode 作为合作方,已经完成该模型的全量接入。

依托架构层面的优化,V4.1 Flash 实现运行成本下降,官方同步下调对应 API 定价。平台继续沿用峰谷分时计费机制,闲时价格为高峰时段的一半,引导用户错峰使用,新计价规则已于 2026 年 9 月 10 日 12 点生效。

网友评论

热门IT产品
  1. ¥1699
    华为畅享90 Pro Max
    ·
  2. ¥4699
    HUAWEI Mate 80
    ·
  3. ¥5999
    苹果iPhone17
    ·
  4. ¥8999
    苹果iPhone17 Pro
    ·
  5. ¥2399
    iQOO Z11 Turbo
    ·
  6. ¥1999
    vivo Y600 Pro
    ·
  7. ¥3599
    荣耀500 Pro
    ·
  8. ¥3499
    一加Ace 6至尊版
    ·
  9. ¥1399
    荣耀X70
    ·
  10. ¥2199
    REDMI Turbo 5 Max
    ·
为您推荐
  • 相关阅读
  • 业界资讯
  • 手机通讯
  • 电脑办公
  • 新奇数码
  • 软件游戏
  • 科学探索