值友们好!⚡
9月8日,DeepSeek悄悄上线了一个新模型——V4.1 Flash。没有发布会、没有预热宣传,但上线后立刻引爆了技术社区。
原因很简单:输出速度飙到300-500 tokens/s,比V4 Pro快3-5倍,而价格只和V4 Flash一样。用Flash的价格,够到Pro的能力,这波操作太狠了 🚀

文章目录
一、V4.1 Flash到底是什么?
先说清楚:这是一个限时内测版本,模型ID是 deepseek-v4.1-flash-expires-on-0910(名字里直接带了过期日期),内测期截至9月10日。
但它不是简单的”快版V4″,DeepSeek官方表示:
“经内部、外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。”
翻译成人话:这可能是DeepSeek打算用Flash的成本替代Pro的前奏。官方甚至发了问卷问内测用户:”你觉得这个模型能全面替换线上的DeepSeek V4 Pro么?”
二、核心升级:三大突破
1. 速度:300-500 tokens/s 🏎️
LINUX DO社区实测数据:
- 普通用户实测:平均300+ tokens/s
- 峰值测试:最高达到507 tokens/s
- 对比V4 Pro:快了3-5倍
这是什么概念?写一篇2000字的文章,V4 Pro可能需要30秒,V4.1 Flash不到10秒就能输出完成。对于需要频繁试错的编程场景,这种速度提升比任何跑分数字都更有感知。
2. 原生多模态 🖼️
V4.1 Flash采用了全新的模型结构,原生支持多模态输入。结合此前V4-Flash-Vision的图片输入能力:
- ✅ 图文混合输入(传图片+文字提问)
- ✅ 图片理解与分析
- ⚠️ 具体支持的图片格式和限制,官方未完全公布
注意:虽然官方宣称”原生多模态”,但部分实测反馈图片输入效果不稳定,建议以正式版发布后的文档为准。
3. 价格:与V4 Flash相同 💰
9月10日起执行新定价(空闲时段):
| 项目 | 价格(每百万Token) |
|---|---|
| 输入(缓存命中) | 0.02元 |
| 输入(缓存未命中) | 1元 |
| 输出 | 4元 |
| 高峰时段 | 上述价格×2 |
翻译成白话:如果你的输入能命中缓存,100万token只要2分钱。写一篇3000字文章的输出成本大约0.01-0.02元——基本等于免费。
三、实测体验:到底有多快?

我用V4.1 Flash跑了几个典型场景:
场景1:代码生成
输入一个Python爬虫需求,V4.1 Flash8秒输出完整代码(约500 tokens),V4 Pro需要约25秒。代码质量肉眼观察没有明显差异。
场景2:长文写作
写一篇2000字的产品评测,V4.1 Flash12秒完成输出,V4 Pro需要约40秒。文章结构、用词质量基本一致。
场景3:逻辑推理
一道数学推理题,两者都答对了,但V4.1 Flash的推理链更简洁(可能因为速度快,”思考”时间短)。
场景4:中文表达
让两款模型分别写一段产品介绍文案,V4.1 Flash的中文表达自然度略有下降,偶尔出现”首先””其次”这类AI味较重的连接词。但整体质量仍然在可用范围内。
四、值友该怎么用?
适合的场景
- ✅ 编程辅助:代码生成/补全/调试,速度优势巨大
- ✅ 批量处理:需要大量生成内容的场景(如批量写标题、摘要)
- ✅ 实时交互:需要快速响应的对话场景
- ✅ API集成:对延迟敏感的应用
不太适合的场景
- ⚠️ 深度分析:复杂推理场景可能不如Pro稳定
- ⚠️ 高质量写作:中文表达自然度略有下降
- ⚠️ 多模态:图片支持尚不稳定
接入方式
API调用非常简单,只需把模型名改成:
model = "deepseek-v4.1-flash-expires-on-0910"
其他参数和V4 Flash完全一致,不需要改代码。
五、未来展望:Flash要替代Pro?
从DeepSeek的操作来看,V4.1 Flash的定位非常明确:用Flash的速度和价格,逼近Pro的能力。
官方的问卷已经暗示了意图:如果内测反馈好,V4.1 Flash可能会直接替代V4 Pro成为默认推荐模型。
这对值友们来说是大利好:
- 💰 成本降低:Pro级能力,Flash级价格
- ⚡ 体验提升:响应速度快3-5倍
- 🎯 官方路由:V4 Pro请求已自动路由到V4.1 Flash
六、课代表推荐
🎯 开发者/程序员:强烈推荐,速度优势在编程场景最明显,API兼容性好,直接换模型名即可。
🎯 内容创作者:可以尝试,中文表达略有瑕疵但整体可用,速度优势适合批量生成。
🎯 普通用户:如果你已经在用DeepSeek,可以等正式版发布后再升级。内测版本今天就到期了。
七、总结
DeepSeek V4.1 Flash是一次非常有意义的迭代:用Flash的成本和速度,逼近Pro的能力。虽然内测版本今天就到期了,但它释放的信号很明确——大模型正在进入”又快又好又便宜”的新阶段。
建议值友们:
- 关注正式版发布:DeepSeek很可能会在近期推出V4.1 Flash正式版
- API用户可以先试用:换模型名就行,零成本体验
- 对比Pro再决定:在你的具体场景下跑一遍对比测试
AI大模型的进化速度,真的越来越快了。从GPT-3到GPT-5用了3年,DeepSeek从V4到V4.1 Flash只用了不到一个月。这波卷起来,最终受益的是我们普通用户 😎
值友们,你们用过DeepSeek的API吗?对V4.1 Flash有什么期待?评论区聊聊!
📂 更多推荐
- 查看更多相关文章:https://www.88531.cn
- 关注公众号「实用软技」获取更多软件推荐和实用技巧
- 所有软件均提供夸克网盘下载,公众号回复「软件」一键获取
https://www.88531.cn/?p=55635
创作不易,用心坚持,请喝一怀爱心咖啡!继续坚持创作~~
