9 月 8 日下午,DeepSeek 放出 V4.1 Flash 的中间测试版本开启内测,该版本 9 月 10 日自动下线。此次更新亮点在于换了新架构,速度更快,官方想验证其承接 Pro 业务的能力。
9 月 8 日下午开启内测,窗口仅两天,9 月 10 日自动下线。这并非正式发布,而是让开发者提前试用未定稿的模型。
最大亮点是换了新架构,V4.1 Flash 直接重构,将多模态做成原生能力,实现图文输入一体化,是架构层面的迭代而非参数调优。
调用方式几乎零成本,改模型名即可。计费和 V4 Flash 一致,空闲时段输入(缓存命中)每百万 tokens 0.05 元等。
开发者实测速度提升,最高输出速度达 507 tokens/s。但内测版每账号仅 20 并发,不适合跑线上业务。
目标是验证新一代 Flash 架构综合表现,评估承接 Pro 业务能力,官方还开了相关匿名反馈问卷。
编辑观点:DeepSeek 更新节奏快,V4.1 Flash 内测若效果好,有望吸引大量业务迁移,或开启新一轮更新潮。