
{{aisd}}
AI生成 免责声明
9月8日,DeepSeek在官方群宣布,已经开始V4.1 Flash的中间版本内测。

V4.1 Flash采用了新的模型结构,原生多模态支持,能力更强、速度更快、且成本更低。
对开发者而言,目前API调用方式是保持base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910,即可开始调用,每账号限流20并发。
接口、模型名称和价格都已经公开,因此有开发者认为,这次所谓的“内测”,实际更接近一次面向开发者的小范围公开测试。
目前社交平台已经有一些反馈,有的认为这一内测并发限制太大,更适合功能验证和效果测试,而非承接大规模线上业务。且从模型名字来看,此次内测9月10日会自动过期下线,也就是说留给开发者的体验时间只有两天。
“第一感受是太快了。”从首批开发者的反馈来看,V4.1 Flash最直观的变化是更快了。有的开发者提到,同一任务端到端,内测的新模型V4.1 Flash全面碾压 V4 Flash Vision-Exp,例如SVG代码生成快6倍,长上下文检索快5倍多。这一次新模型兼顾了多模态和速度,不是小修小补。
不过,针对官方提到的“成本更低”,有开发者认为并没有直接感受到,“5分钟10块钱”,还有的提到“瞬间几十块没了”。对此,有猜测认为可能是速度更快、相同时间内token消耗也更快的原因。
官方表示,当前内测计费与deepseek-v4-flash相同,即空闲时段,每百万Tokens的缓存命中输入、缓存未命中输入和输出价格,分别为0.05元、1.5元和4.5元;高峰时段则分别为0.1元、3元和9元。
从开发者实际支付的每token价格看,新模型并没有降价。官方所说的成本更低,更可能指底层推理效率提高,或者完成相同任务所需的计算成本和token数量下降。这两项优势是否会转化为开发者账单的减少,还需要更多测试验证。
目前DeepSeek并未更新官方博客正式介绍新模型,更多信息或许还要等内测结束后的正式上线。
近两个月DeepSeek更新迭代明显加快。7月31日,DeepSeek V4 Flash正式版上线;不到两周后的8月13日,V4 Pro正式版发布,DeepSeek同时宣布大幅调整API价格。同一天,DeepSeek Harness开发者预览版开放测试并开源。
8月19日,DeepSeek Harness发布新版本,补充多模态输入、子智能体协作和工具调用等能力。8月21日,V4 Flash Vision-Exp上线API平台,并于8月31日开放模型权重。到9月8日,采用新结构的V4.1 Flash已经进入内测。
不到40天,DeepSeek围绕模型、原生多模态和Agent开发工具连续更新,这种节奏表明,DeepSeek正在补齐从底层模型到Agent基础设施的产品体系。
不过,从模型能力看,DeepSeek今年排名有所回落,暂未在最新一轮模型竞争中占据领先位置。
根据AI基准测试机构Artificial Analysis的数据,DeepSeek模型的智能指数为36分,排在榜单第15位。榜单前两名仍由海外厂商的Claude模型和GPT-6占据;国内模型中,智谱和Kimi分别位居第7和第9位,千问排在第13位。
这也是外界对V4.1 Flash抱有期待的原因。据观察,这次DeepSeek的更新并不是在上一版模型上简单进行后训练,似乎还重做了预训练。开发者期待新架构能带来足够明显的能力跃升,DeepSeek能回到全球模型能力的第一梯队中。