国产开源大模型第一次把「原生多模态」和「接近 Pro 的能力」同时塞进 Flash 定价体系。9 月 8 日下午,DeepSeek 在官方交流群悄然启动 V4.1 Flash 中间版本内测,模型 ID 为「deepseek-v4.1-flash-expires-on-0910」,9 月 10 日下线。

一、抛弃外挂 Vision,首次明确「原生多模态」

这版最大的变化是路线调整:抛弃过去「外挂 Vision」的做法,第一次在文档里明确写出「新的模型结构」和「原生多模态支持」,实现图文一体化输入输出,不再需要单独调用 V4-Flash-Vision-Exp。对开发者而言迁移成本极低——只要把模型名换掉、base_url 保持不变即可,计费与正式版 V4-Flash 看齐。

二、20 路并发 + 9/10 到期,分明是「真实反馈」设计

限制也写得很克制:单账号最多 20 路并发,而正式版为 2500 路。官方同步发布匿名调研问卷,其中一项直接询问「V4.1 Flash 能否全面替换线上 V4-Pro」,暗示 Flash 系列产品线正在向上试探。这种「小并发 + 短窗口」的组合,明显是在做开发者侧真实反馈,而非一场营销发布,符合 DeepSeek 一贯「先跑通后宣传」的风格。

三、为什么这件事值得 Agent 圈关注

一旦正式版验证成功,原本被 Pro 高价挡在门外的 Agent 工作流、AI 电商客服、多模态内容工厂等场景,可能集中迁移到 Flash 价位。多模态 Agent 不再需要先调一个语言模型、再调一个视觉模型拼接,而是用同一个底座完成「看图—理解—行动」的闭环,AI 大规模商业化的成本曲线会进一步下压。

四、客观看:窗口短、并发低,仍属验证性质

需要明确的是,这是限时中间版本,9 月 10 日即下线,能力与稳定性尚待正式版检验。它能说明的方向是清晰的——国产开源模型正从「单模态便宜」走向「多模态也能便宜」,而真正决定落地的,是正式版能否把这次内测的架构优势稳定交付。