DeepSeek 发布 V4.1-Flash:新架构带来原生视觉理解与大幅降价
Whats really exciting about DeepSeek 4.1 Flash its insane efficiency and pricing. It matches or be…
精选理由
原文汇总了 V4.1-Flash 的架构变化、基准成绩和降幅明确的新定价,便于评估它在编码和智能体场景的成本收益。
AI 摘要
DeepSeek 发布 V4.1-Flash,采用 Causal Encoder–Decoder 新架构并支持原生视觉理解,552B MoE 参数,输入处理激活 8B、输出生成激活 16B。
正文 · AI 翻译
DeepSeek 4.1 Flash 真正令人兴奋的地方在于它惊人的效率和定价。
根据 DeepSeek 的测试,它在多项编程和智能体基准测试中与 GPT-5.6 Sol 持平甚至超越,而 token 价格却只有后者的零头(-94%!)
例如:在软件工程基准测试 DeepSWE 上: - 此前的 V4-Flash:54.4% - 新的 V4.1-Flash:74.2% - GPT-5.6 Sol:73.0%
DeepSeek 还相比 V4-Flash 下调了价格:全新输入降低 32%,缓存输入降低 57%,输出降低 9%。
即便按峰值费率计算,Flash 每百万输出 token 收费 $1.20,而 Sol 为 $20。这便宜了 94%。在非高峰时段,价格降至 $0.60。
一种新架构让读取大规模输入变得更便宜,同时通过共享和压缩已存储的上下文降低了内存需求。这对反复读取代码、文档和工具结果的智能体尤其有用。
DeepSeek 真的重回价格战了。这才是真正的护城河。
### 引用推文
> Chubby♨️:DeepSeek 刚刚发布了 V4.1-Flash,采用了全新架构,距离其 7 月的 V4-Flash 更新仅过去六周。 7 月的版本改进了后训练,但架构保持不变。(GLM-5.3/Flash 也是如此。)V4.1 引入了因果编码器-解码器(Causal Encoder-Decoder)架构,并具备原生视觉理解能力。 ...
原文
Original Title
Whats really exciting about DeepSeek 4.1 Flash its insane efficiency and pricing. It matches or be…
Source
Chubby♨️ (@kimmonismus)
Site
x.com
Published
2026-09-10 16:49