
开头:一个让美股AI板块集体变脸的数字
每100万Token,最低收费不到1美分。
这不是哪家初创公司的清仓促销,而是DeepSeek在2026年9月10日发布的V4.1 Flash给出的价格。
消息一出,港股AI板块当天就给出反应:MiniMax和智谱股价下跌超过8%,正在转型AI的阿里巴巴也跌了2%以上。Anthropic和OpenAI正在筹备上市,DeepSeek在这个时间点把价格打到地板上——没有人觉得这是巧合。
AI模型的价格战,已经打到了下一个维度。

一、V4.1 Flash到底是个什么模型?
1.1 核心参数
DeepSeek官方给出的关键信息如下:
| 项目 | V4.1 Flash | 对比对象 |
|---|---|---|
| 总参数量 | 5520亿(MoE架构) | 远低于V4-Pro激活规模 |
| 激活参数 | 每次运行仅激活很小一部分 | 典型MoE稀疏激活 |
| 价格 | 每百万Token最低不到1美分 | 碾压多数主流模型 |
| 性能 | 编程、智能体任务超过V4-Pro | 仍落后OpenAI/Anthropic旗舰 |
官方称其采用”因果编码器-解码器”架构,主打一个思路:不是把所有能力都堆上去,而是用效率换性价比。
1.2 “性能够用就行”的哲学
DeepSeek这次押注的逻辑非常直白:
很多场景根本不需要最强的模型。
- 让Agent连续跑8小时处理数据,用旗舰模型一次要烧掉几十美元
- 批量文本分类、日志分析、代码补全,90%的任务用”够用”的模型就够了
- 开发者真正在意的是:结果不出错,成本降得下来
所以V4.1 Flash在编程和智能体任务上的表现超过V4-Pro,却在价格上低一个数量级。这不是技术倒退,是商业策略的精准落点。
二、”死亡地带”:让对手无路可走的定价
3.1 什么是死亡地带
行业分析机构Artificial Analysis称这个局面为”死亡地带”。
意思是:当中国厂商用”性能够用+价格极低”的模型卡住中间档位时,竞争者只剩两条路——
| 路径 | 做法 | 难度 |
|---|---|---|
| 价格路线 | 在价格上击败DeepSeek和中国同行 | 烧钱,难持续 |
| 能力路线 | 在能力上大幅领先,让用户愿意付高价 | 需要代差优势 |
两条路都不好走。这正是”死亡地带”名字的由来:中间层玩家会被夹死。
3.2 智能体时代的价格敏感度陡增
过去一年,行业关注点已经从”单次对话质量”转向”能连续跑多久”。
现在的AI智能体可以连续运行几个小时,自主调用工具、浏览网页、写代码——整个过程几乎不需要人工干预。
这意味着什么?
成本从”一次一问”变成了”一小时一烧”。模型贵10倍,Agent方案的总成本可能贵100倍。在这种场景下,每百万Token不到1美分的模型,直接改变了开发者做预算的方式。
DeepSeek不是在做慈善,是在抢智能体时代的入口。
三、格局:中美模型的价格战才刚刚开始
3.1 中国模型集体出海打价格牌
V4.1 Flash不是孤例。过去一年,中国开放权重模型一直在用性价比冲击市场:
- 月之暗面Kimi K3是V4.1 Flash的对比基准之一
- MiniMax、智谱等厂商的模型价格同样不断下探
- 电商巨头阿里也在加速AI转型,股价受DeepSeek消息影响
3.2 顶级模型的护城河还稳吗
必须说清楚:论绝对能力,V4.1 Flash仍落后于Anthropic和OpenAI的旗舰。
但问题在于:有多少用户愿意为”更强的能力”付10倍价格?
对普通开发者、中小创业公司来说,答案越来越明显。而大厂也在用另一套逻辑防守——OpenAI的GPT-6 Astra刚发布,Anthropic的Claude刚证明完费马大定理,两家都在押注”能力代差”。
一个拼价格,一个拼能力。2026年下半年的AI战局,大概就是这两个方向的对撞。

本文要点回顾
- DeepSeek V4.1 Flash于9月10日发布,每百万Token最低不到1美分,采用5520亿参数MoE架构
- 模型在编程和智能体任务上超过V4-Pro,但落后于OpenAI/Anthropic旗舰
- 消息引发港股AI板块震荡:MiniMax、智谱跌超8%,阿里跌超2%
- “死亡地带”指中间层厂商被”性能够用+价格极低”夹死,只剩价格战或能力代差两条路
- 智能体长时运行场景使成本敏感性陡增,低价模型正在重塑开发者预算方式
文章摘自:https://www.cnblogs.com/badhope/p/22941543/deepseek-v41-flash-price-war
