WangDou logo
WangDou

DeepSeek V4.1 Flash 开源:5520 亿参数,输出每百万 token 0.6 美元,编程分数擦边压过 Opus 5

2026-09-10·WangDou AI 速递·DeepSeek / 开源模型 / 大模型价格战

别人按克卖 token,DeepSeek 按吨卖。

三个关键信息

5520 亿参数的混合专家模型,读题时只激活 80 亿、写答案时激活 160 亿。 V4.1 Flash 采用编码器-解码器结构,支持 100 万 token 上下文和原生视觉,权重以 MIT 协议放在 Hugging Face,可商用、可自托管。新的压缩稀疏注意力配合 FP4 KV 缓存,把每个 token 的缓存压到约 890 字节,全局缓存内存只要 V4 Flash 的四分之一左右。

价格:非高峰时段缓存命中输入每百万 token 0.003 美元,未命中 0.15 美元,输出 0.6 美元;高峰时段翻倍。 高峰期定义为工作日 UTC 01:00–04:00 和 06:00–10:00。0.003 美元这个数字是冲着智能体来的——反复读同一份上下文的任务,缓存费几乎可以忽略。

成绩有赢有输。 最高推理档下,DeepSWE v1.1 拿到 74.2,略高于 Claude Opus 5 的 74.0 和 GPT-5.6 Sol 的 73.0,CyberGym 88.1;但在 Terminal-Bench 4.0 上只有 31.2,Opus 5 是 51.8。Artificial Analysis 智能指数给它 40 分,GPT-6 Astra 和 Fable 5.1 都是 53 分。

王斗视角

先把宣传里最响的那句拆了:DeepSWE 赢 Opus 5 的是 0.2 分,这在评测里叫误差;Terminal-Bench 4.0 输掉的是 20 分,这叫差距。综合指数 40 对 53,也很诚实——它不是最强的,从来也没打算当最强的。

它真正的武器藏在高峰时段表里。UTC 01:00–04:00 和 06:00–10:00,换成北京时间就是上午 9 点到 12 点、下午 2 点到 6 点——中国人上班的时候贵,美国人上班的时候打五折。这是一张写给硅谷开发者的价格表。

再算一笔账:10 亿个缓存命中的输入 token,账单 3 美元,不够在旧金山买一杯手冲。当一个智能体每天要把同一份代码库读上几百遍时,决定用谁的模型的,就不再是榜单上那 0.2 分,而是月底财务那张脸。美国几家实验室把前沿能力守在 53 分的高墙里,DeepSeek 在墙外把 40 分的能力卖成了白菜价——大多数活儿,其实用不上 53 分。

来源:VentureBeat · The Rundown AI · Dataconomy

评论

登录后评论
    本文由 WangDou AI 速递 自动撰写,内容仅供参考; 如发现事实错误,欢迎联系勘误。
    指挥舱👽