9月8日下午,DeepSeek在官方交流群里发了一份内测通知。我把腾讯新闻、IT之家和快科技的几篇报道逐一扒完,最让我留意的不是"能力更强、速度更快、成本更低"这串宣传语,而是那个长得不太寻常的模型名:
deepseek-v4.1-flash-expires-on-0910
到期日,直接写进了模型名里。这个小细节,比整份公告的信息量都大。
"中间版本"是一种什么样的发布
先说事实。据内测通知,V4.1 Flash采用了全新的模型架构,原生支持多模态输入——文本、图像、音频都收;计费与现网的V4 Flash完全一致,单账号限流20并发;调用方式也简单,base_url不用动,只把模型ID替换成上面那个长名字即可。
注意"中间版本"这个词。它不是正式版,也不是预览版,而是卡在两者之间的一次公开试探。模型名里那个"expires-on-0910",等于在提醒所有接入的人:这条内测通道有截止日期,9月10日一到就下线,想用趁早。
这对普通用户其实是个实用启示:API不像手机App会自动更新,你在代码里写下的模型ID,决定了你用的是哪个"大脑"、付的是哪档钱。把到期日写进名字,是API世界里最直白的倒计时钟。
真正的问题,藏在那份问卷里
IT之家披露了一个更有意思的细节:在反馈问卷中,DeepSeek官方问用户——V4.1 Flash中间版本,能否全面替换线上的V4 Pro?
要读懂这个问题,得回顾过去一个多月发生了什么。快科技的复盘提到:7月底上线的V4 Flash当时惊艳了不少人,性能直接追上了第一梯队的大模型;但8月13日发布的V4 Pro正式版表现没达预期,整体比Flash提升有限,之后的涨价更让口碑下滑,用他们的话说,"梁圣变成了梁子"。
现在官方自己发问"Flash能不能替换Pro",翻译过来就是:我们认为便宜的那款,可能已经够用了。这对使用者是个风向标——当Flash级别的模型能干掉大部分活儿,你为Pro多付的钱,买的只是最难那部分任务的最后一点性能。"默认选最贵的"这个习惯,真该改改了。
还有个细节值得留意:8月21日,DeepSeek刚单独上线过一款Vision-Exp视觉理解模型,图片能力是"外挂"上去的;不到20天,V4.1 Flash就把多模态做成了原生,连音频都包含在内。原生的意思是,你不必再为不同任务挑不同模型,一个入口通吃文字、图片和语音。
普通人这几天能做什么
如果你有API开发需求,内测窗口只开到9月10日,把模型ID一换就能试,计费跟现有V4 Flash一致,等于零成本尝鲜。但有一条要记住:试完别把"expires-on-0910"这个内测名写死进正式项目,通道一关,调用就会报错——这是内测版最常见的坑。
如果你不写代码,只是想感受"原生多模态"是什么体验,也有更省事的办法:spark1.cn 的工具区(/tools/)里挑一个现成的多模态工具,直接传图、传语音试效果,不用折腾参数和密钥。
如果你只是想围观,这次内测也给了一个观察视角:过去这一年,大模型的普遍节奏是"贵的立标杆,便宜的走量"。而DeepSeek正在用一份问卷确认——走量的那款,可能快要通吃了。这个趋势的受益者,是每个掏钱用模型的人:模型越卷越强、越卷越便宜,你的选择就可以越来越从容。
💬 评论