DeepSeek V4 Flash正式版性能直逼GPT-4.8
DeepSeek V4 Flash 0731正式开源发布,性能直逼GPT-4.8,成本仅为后者的十分之一。实测显示,该模型能在几分钟内一次性生成商业级跑酷游戏、3D马里奥、3D太阳系等高复杂度交互应用,在代码竞技场中排名第7(1586分),开源模型排名第3。文章通过多组对比测试(vs GPT-4.8、vs GPT-5.6 Lora、vs Gemini 3.6 Flash、vs Kimi K3),展示了V4 Flash在性价比、UI设计、光源效果等方面的优势与不足。此外,Hugging Face上已有免费公共节点可供无需Token直接调用,量化版也支持LLAMA CPP本地部署。

AI大模型的新一轮竞争又开始了。就在昨晚,最新版的DeepSeek V4 Flash 0731正式开源发布,性能直逼OpenAI的GPT-4.8。不仅大幅升级了Agent的能力,基准测试分数更是远远超过V4 Pro预览版。而且官方的V4 Flash版本现在原生支持Responses API格式,并完全适配Codex。
目前DeepSeek V4 Flash High在前端代码竞技场中排名第七,得分是1,586分,而且在开源模型排名中排名第三,在设计数据分析游戏中排名第六。最关键的是它性价比极高,性能无限接近GPT-4.8,但成本确实只有他们的十分之一都不到。当然我们不能只看评分,还是需要实际测下,看效果到底怎么样。
一、实测:商业级跑酷游戏
比如现在可以通过Hermes来对接这个最新版本的DeepSeek V4 Flash 0731模型。这里我就选DeepSeek V4 Flash模型吧。好切换模型以后,然后现在我们来输入要求——比如现在让它帮我编写一个商业级别的跑酷游戏。输入要求,我们点击发送一下,我们一会来看一下效果到底怎么样。啊,他现在开始了。
同时我们可以把同样要求发给Claude。我们再切换一下,把Claude切换到GPT-4.8吧,因为这是目前官方拿来对比的模型。好,输入同样的要求,发送一下,我们一会对比一下两者区别。我就拿这个跟GPT-4.8来进行对比一下,一会看一下实际效果,看两者差距到底有多大。啊,他现在开始了,这个过程代码生成需要几分钟,这里我就加速跳过了。
他现在已经完成了。这个是他最终交付的结果,他已经把这个文件放到桌面上了,文件大小总共是65KB左右,单文件零依赖。
打开来测试一下。通过空格键进行跳跃,然后是滑铲,通过下滑键进行滑铲,按空格第二次的话是第二段跳跃。然后还有角色商店。没想到他还给我设计了个积分系统。来试下效果——我们点击开始奔跑,哎可以啊,没问题啊。来来来,这个……哎呦,立马就撞死了。我再来一次啊,滑铲……哎,这个积分系统没问题啊,可以正常增加的。
大家说我玩游戏很菜呀,确实如此,不太会玩。哎呀,撞死了,不玩了不玩了,它的难度太高了,但功能是没问题的,一次搞定。
那现在来看一下Claude。Claude应该也完成了,这是Claude完成的结果,在这里,它已经放到桌面上了。
我们再试下Claude的,看Claude跟这个DeepSeek V4 Flash模型生成的有什么不一样的。我们点击开始游戏——啊,这是Claude的。Claude明显更好了,更好容易过关一点。再来一局,哎大家觉得是哪个做的更好一点?我觉得在功能方面应该是差不多,但是这个UI设计方面,明显DeepSeek V4 Flash要好一点。但是在游戏控制方面,GPT-4.8还是略胜一筹,因为操作起来更加丝滑,更加流畅。不过它这个没有一个积分系统。
二、进阶测试:3D版超级马里奥
现在我们提升一下难度,让它帮我制作一款3D版的超级马里奥。我们再重新开一个窗口,模型同样选这个DeepSeek V4 Flash。这是我让它帮我编写一个3D版的超级马里奥,我们试一下效果。他现在开始了,这个项目就比较大了,可能需要将近10分钟左右,我稍微等待一下。
好,大概过了将近7分钟左右,他现在已经完成了。他说已经完成,3D超级马里奥已经制作完成,游戏已经准备好了,已经通过全面的自动化验证,文件位置放在桌面上。
我们现在看下效果。他已经放到桌面上了,在这里,打开看一下。3D马里奥就两个文件——一个是HTML,然后另外是JS文件。打开看效果,试一下,我们点击开始冒险,来试一下。哎,还有声音效果的。大家看一下这个3D交互,确实做的非常可以。这还可以直接通过鼠标来进行切换方向的。
掉下去会上来的,可以没问题,可以的。这个3D交互UI做的确实可以,它这里还有个闯关的,跳过去,能做到这种效果已经相当可以了。最关键的是它是一次性搞定的,这个确实非常难能可贵的。不得不说现在的开源大模型进步真的太快了。
三、太阳系:画面感十足
我再来看一下,这是由DeepSeek V4 Flash模型生成的太阳系系统,画面感十足,非常震撼。整体表现远超预期。它不仅完整还原整个太阳系,各大行星的公转轨迹都清晰可见,就连这个星际尘埃、光晕这些细节也渲染得非常真实。整个3D场景丝滑流畅,无论是放大缩小还是自由拖拽,都没有丝毫卡顿。现在看到的这是土星,它外围标志性的光环层次分明,细节拉满。
很难想象,这些复杂的三维效果竟然都是由这个DeepSeek V4 Flash模型一次性生成的。
四、多模型对比
DeepSeek V4 Flash vs GPT-5.6 Lora
同时在使用相同提示下,在使用最高推理模式下来测试,Lora模型跟DeepSeek V4 Flash模型进行对比。GPT-5.6 Lora模型它速度会更快点,不到3分钟就完成了这个游戏设置,而V4 Flash模型的话总耗时是5分钟。但最终生成结果是不一样的。大家看一下,左侧是V4 Flash,右侧是GPT-5.6 Lora模型,大家觉得哪个更好一点?
DeepSeek V4 Flash vs Gemma 3.6 Flash
同时我们也可以拿这个DeepSeek V4 Flash跟这个Gemma 3.6 Flash来进行对比一下。在相同的规划文档和参考图下,生成三个JS和Three.js的模型,这是两个Flash模型的终极对决啊。大家对比一下,你觉得哪个生成效果更好一点?大家可以在视频下方发表你的看法。
发动机效果对比
我们再来看这个,这个是由DeepSeek V4 Flash最新模型,在使用同样的提示词下制作出来的汽车发动机的效果。整体质量和Kimi K3对比的话,我觉得可以达到将近70%到80%的还原度了。虽然在细节方面它还没有Kimi K3做的那么好,但关键是它价格是真的便宜啊,只有Kimi K3的十分之一不到。
光源效果对比
下面再来看这个,这个是由DeepSeek V4 Flash和GPT-5.6 Lora模型进行对比。在使用相同的提示词下生成结果,在执行力和整体质量方面,明显感觉DeepSeek V4 Flash要稍微强一点。但如果是用于测试建模,它们应该差不多。但是对于移动光源效果的表达,明显V4 Flash要更强点。但对于整体亮度而言,Lora模型要略胜一筹。
但是话又说回来,对一个开源模型来说,能不断缩小和闭源模型的差距,就已经是一个巨大的进步了。

五、跳舞机器人:一句话生成的3D动画
你看还有人拿这个DeepSeek V4 Flash生成一个擅长跳舞的机器人。他下的提示词也非常简单——“设计并创建单个HTML文件中的动画3D机械工厂,包含高级照明、齿轮、传送带、活塞、功能性机械臂和曲轴以及跳舞的机器人”。大家看这效果,相当可以。
六、免费公共节点:无需Token也能用
但如果你手里没有DeepSeek V4 Flash的API的话,那么可以通过网上有人为这个DeepSeek V4 Flash 0731版最新版本在Hugging Face上部署了一个公共的免费节点,链接我放在视频下方零度博客上,待会打开以后就可以使用了。任何人都可以使用,不需要Token,可以兼容OpenAI的API。当然这是一个共享的社区实例,所以大家轻度使用就可以了,不要滥用。
打开就会看到,你可以通过不同方式进行调用。想直接对话使用的话,你在下方这里看到有个UI对话,打开就可以。进入以后会看到它上方就会显示最新的0731模型。因为它这个免费的公共实例,所以它速度肯定会比较慢的,要大家自己去测试。
七、性价比之王:成本仅0.07美元
我看还有人拿这个DeepSeek V4 Flash模型跟这个GPT-5.6 Taylor模型进行对比,跑了一个非常流行的提示测试。上面是DeepSeek V4 Flash,然后下方是GPT-5.6 Taylor模型,这对比效果非常明显。
当然这次DeepSeek V4 Flash模型能收到很多人一致性的好评,最关键是它性价比极高。大家看一下,在过去30天内,Humanity Agent在OpenRoad上的使用数据表明,目前的DeepSeek V4 Flash模型仍位居榜首。
比如说我们来看一下这个效果,这个是由DeepSeek V4 Flash 0731模型在Hermes Agent的代理模式下,通过一个简单的提示生成的射击游戏,总耗时33分钟,成本的话只有0.07美元。这个成本几乎可以忽略不计了。但是如果你要通过Claude或者通过OpenAI来生成类似效果的话,那最终所需要成本至少是百倍以上。不信的话大家可以自己测试下。
八、价格战已开打,用户是赢家
所以目前新一轮的AI价格战已经开打了。市场竞争越激烈,对用户来说是好事,因为可以在花费更少的成本下就可以获得更强的模型。虽然目前GPT-5.6 Lora模型降价幅度已经非常高了,但是跟这个DeepSeek V4一比,那真的是小巫见大巫。
而且最关键的是DeepSeek V4 Flash模型它现在已经开源了,目前是可以直接本地部署使用的。到时你可以通过LLAMA CPP进行本地部署,这个模型的量化版我已经放到视频下方和零度博客上,到时大家可以自己下载部署。它现在目前已经远超这个V4 Pro版本的。
九、更多案例:钢铁厂与3D细胞探索器
比如这是由最新版本DeepSeek V4 Flash模型来生成的这个钢铁厂,这个生成效果确实非常可以。这要是搁以前的话,怎么也得雇一个专业的3D设计团队,而且至少需要花费一周时间才可以做出类似效果。但现在AI只需要几分钟就可以搞定,确实非常恐怖。
而且像这个也是由这个DeepSeek V4 Flash构建的一个交互式的3D细胞探索器,模拟切开以后可以环绕细胞核转动,而且在每一个细胞器上都可以阅读真实的生物学知识,这个确实相当可以。
十、选型建议:谁才是最佳性价比?
如果你在纠结该给自己的项目选哪个模型,那么下方这个对比就非常清晰了:
-
Gemini 3.6 Flash:交卷最快,但是生成效果却是一塌糊涂
-
DeepSeek V4 Flash和GPT-4.8:几乎是同时交卷的,但在质感和任务完成度上,GPT-4.8确实要略好一些,但价格却贵很多
-
GLM 5.2:似乎就有点尴尬了,不快不慢,但质量也就那样
所以说如果你追求的是性价比,那么DeepSeek V4 Flash无疑是目前最佳的选择之一。关键是它还是开源的,如果硬件可以的话,那么本地部署会更香。



