返回 AI 情报
模型精选 782026-09-10 16:49Chubby♨️ (@kimmonismus)

DeepSeek 发布 V4.1-Flash:新架构带来原生视觉理解与大幅降价

Whats really exciting about DeepSeek 4.1 Flash its insane efficiency and pricing. It matches or be…

精选理由

原文汇总了 V4.1-Flash 的架构变化、基准成绩和降幅明确的新定价,便于评估它在编码和智能体场景的成本收益。

AI 摘要

DeepSeek 发布 V4.1-Flash,采用 Causal Encoder–Decoder 新架构并支持原生视觉理解,552B MoE 参数,输入处理激活 8B、输出生成激活 16B。

正文 · AI 翻译

DeepSeek 4.1 Flash 真正令人兴奋的地方在于它惊人的效率和定价。

根据 DeepSeek 的测试,它在多项编程和智能体基准测试中与 GPT-5.6 Sol 持平甚至超越,而 token 价格却只有后者的零头(-94%!)

例如:在软件工程基准测试 DeepSWE 上: - 此前的 V4-Flash:54.4% - 新的 V4.1-Flash:74.2% - GPT-5.6 Sol:73.0%

DeepSeek 还相比 V4-Flash 下调了价格:全新输入降低 32%,缓存输入降低 57%,输出降低 9%。

即便按峰值费率计算,Flash 每百万输出 token 收费 $1.20,而 Sol 为 $20。这便宜了 94%。在非高峰时段,价格降至 $0.60。

一种新架构让读取大规模输入变得更便宜,同时通过共享和压缩已存储的上下文降低了内存需求。这对反复读取代码、文档和工具结果的智能体尤其有用。

DeepSeek 真的重回价格战了。这才是真正的护城河。

### 引用推文

> Chubby♨️:DeepSeek 刚刚发布了 V4.1-Flash,采用了全新架构,距离其 7 月的 V4-Flash 更新仅过去六周。 7 月的版本改进了后训练,但架构保持不变。(GLM-5.3/Flash 也是如此。)V4.1 引入了因果编码器-解码器(Causal Encoder-Decoder)架构,并具备原生视觉理解能力。 ...

原文

Original Title

Whats really exciting about DeepSeek 4.1 Flash its insane efficiency and pricing. It matches or be…

Source

Chubby♨️ (@kimmonismus)

Site

x.com

Published

2026-09-10 16:49

阅读原文· x.com

继续阅读