
9月8日,DeepSeek在官方群宣布开放 deepseek-v4.1-flash-expires-on-0910 内测,截止日期9月10日,48小时窗口。新模型采用原生多模态新架构,实测峰值速度507t/s,每账号并发上限20。[[2]][[3]][[4]]

实测峰值速度
507 t/s
开发者社区实测输出速度(9月8日)
内测并发上限
20路
单账号限流,正式版Flash为2500
内测截止日期
9月10日
模型名自带过期标记,到期自动下线
空闲缓存命中价
0.05元
每百万tokens,与V4-Flash计费相同
元股证券:ygzq.hk架构重建:不是接眼睛,是换大脑
旧路线 V4-Flash-Vision-Exp(8月21日)在文本架构外挂视觉编码器(32层、1024隐维),图像与语言两套系统拼接,像"外接眼睛"。[[2]][[5]]
新路线 V4.1-Flash 视觉与文字在同一套架构内联合训练,原生支持文本、图像、音频,无需外挂模块。两者差异体现在两点:①多模态能力与语言能力同源,推理一致性更高;②音频输入是全新能力,旧版本不具备。[[5]][[10]][[20]]
V4.1-Flash 内测关键参数
维度
参数
输出速度
峰值507 t/s,SVG任务实测328 t/s
并发上限
20路/账号(正式版Flash为2500)
计费·空闲缓存命中
0.05元/百万tokens
计费·空闲缓存未命中
1.5元/百万tokens
计费·输出(空闲)
正配配资4.5元/百万tokens
过期日期
2026年9月10日自动下线
Flash vs Pro:四维数据对比
V4.1-Flash(内测)
Flash定价·新架构
· 速度:峰值507 t/s
· 输出定价(高峰):9元/百万token
· 并发:20路(内测限制)
· 多模态:原生文本+图像+音频
V4-Pro(正式版)
旗舰定价·成熟版本
· 速度:响应延迟800ms+
· 输出定价(高峰):27元/百万token
· 并发:2500路/账号
· 多模态:不支持
官方随内测发出问卷直问:"V4.1-Flash能否全面替换V4-Pro?" 从并发数据看,内测版20路 vs 正式版2500路,差距仍大;但定价仅为Pro的1/3,速度显著更快。能力是否够到Pro上限,有待正式版数据验证。[[7]][[13]][[14]]
开发者首批反馈:两极分化
5分钟10块钱,速度快导致相同时间token消耗更多,成本没感受到降低
开发者社区(第一财经)
SVG代码生成快6倍,长上下文检索快5倍多,第一感受是太快了
开发者社区(中华网)
并发限制太大,不适合大规模线上业务,只能做功能验证
开发者社区(东方财富网)
这次内测对谁有实际影响
个人开发者:48小时窗口可零成本切换体验原生多模态,接入门槛极低,仅需改模型名。[[4]][[16]]
企业用户:并发20路无法支撑线上业务,内测阶段明确不适合大规模压测,需等正式版。[[6]][[19]]
AI行业:官方问卷直指"Flash能否替代Pro"——若正式版成立,Flash定价吃掉Pro定价空间的信号意义大于产品本身,但当前仍属内测阶段,结论待定。[[7]][[9]]
内测≠正式发布:普通用户怎么理解
模型名 `expires-on-0910` 不是Bug,是DeepSeek把中间checkpoint放入真实API环境短期测试的常规节奏。截至发稿,DeepSeek官网、API文档及ChangeLog均无V4.1-Flash正式发布记录,公开文档仍列的是V4-Flash-0731和V4-Pro-0813。[[10]][[15]]
内测版 = 收集反馈决定是否上线配资平台是否可查询,不等于可用版,不可用于生产环境长期依赖。[[16]]
优配网提示:本文来自互联网,不代表本网站观点。