9月10日,DeepSeek 发布了V4.1 Flash,这次最有意思的不是 V4.1 Flash 性能提升,而是官方宣布:新模型上线后,所有 V4 Pro 请求都会被转到 V4.1 Flash。一个定位速度和性价比的 Flash,为什么反过来替代了旗舰 Pro?这期视频我们快速讲清楚。
这次升级了什么
全新的模型架构
官方把 V4.1 Flash 定义为“全新模型结构系列中的最小尺寸模型”,并表示新架构的目标包括:
- 更高的能力上限
- 更快的推理速度
- 更大的吞吐量
- 能够继续扩展到更大参数模型
原生支持多模态视觉理解
V4.1 Flash 可以直接接收图片,不再需要单独调用实验性的V4-Flash-Vision-Exp。
目前支持:
- 图片描述和内容理解
- 截图文字识别
- 图表分析
- 网页截图理解
- 结合 Agent 工具完成视觉任务
- JPEG、PNG、GIF、WebP
- Base64、外部 URL、Files API 三种传图方式
- Chat Completions、Responses API 和 Anthropic API
价格
从 9 月10日12时起,Flash 系列新价格为:
| 时段 | 输入 | 输出 | 缓存命中输入 |
|---|---|---|---|
| 空闲时段 | 1元/百万Token | 4元/百万Token | 0.02元/百万Token |
| 高峰时段 | 2元/百万Token | 8元/百万Token | 0.04元/百万Token |
实测
用的是deepseek harness

如果没有的话,指定一下版本就好了
npx @deepseek-ai/dsh@0.1.5-rc.1 web
制作网页版excel
和v4 flash去横向对比
提示词
制作一个网页版的excel
询问的问题都按照最简单方式去做就好了
v4 flash

之前的v4 flash好像还可以
表格基本功能,样式,还有单元表引用求和都做好了

耗时:9m47s 花费:0.47
v4.1 flash

耗时:21m34s 花费:3.68
看图生成网页
验证原生多模态和前端能力。
这是我比较看重的一个能力,如果模型没有多模态的话,有时候出bug了,或者报错
文字还不太好描述
给模型一张完整网页截图,让它从零还原:
- 页面布局和视觉效果
- 响应式适配
- 按钮、弹窗等交互
- 自动运行并检查代码
因为v4 flash 和v4 pro都没有原生多模态
所以和DeepSeek-V4-Flash-Vision-Exp去横向对比
复刻我博客

提示词
复刻图片中的网站,尽可能的还原,要能支持响应式适配
DeepSeek-V4-Flash-Vision-Exp
完成度怎么样呢

耗时:2m54s 花费:0.10
v4.1 flash
完成度怎么样?个人感觉比DeepSeek-V4-Flash-Vision-Exp要好

耗时:8m26s 花费:1.4