DeepSeek V4 Pro实测:赛车输给Kimi,但太阳系把GPT-5.6干懵了 头条

2026-09-07 17:05:50来源:腾讯网
问AI·太阳系模拟反超GPT-5.6,国产模型复杂任务能否持续突破?

从目前公布的信息看,这次更新目标其实很明确,那就是增强agent能力!

DeepSeek 正在从“会回答问题的大模型”,进一步变成“能自己完成任务的 Agent 模型”。


(资料图片)

下图是网上流传很广的一个能力分数,这个不确定是不是真实的,大家参考看看。

从网上这个“路边社”消息来看,各项能力接近顶尖模型Claude的fable 5,但是没有超越。

所以这次又是用几分之一的价格,实现顶尖模型9成能力。虽然不是最强,但是也没掉队。

目前官网上价格为:

  • 输入:3 元 / 百万 Token

  • 输出:6 元 / 百万 Token

  • 缓存命中输入:低至 0.025 元 / 百万 Token

不过 DeepSeek 官方也已经提示,后续 API 价格可能会上调,所以现在这个价格未必会长期维持。

虽然和顶尖模型还是有差距,但如果和自己比,对比之前的预览版来说,DeepSeek v4正式版好多能力都实现了翻倍,甚至翻几倍的提升!进步十分巨大!

具体可以看下图

我把我经常测试AI的几个题目扔给了DeepSeek V4 Pro

首先是赛车小游戏,它首次生成的内容有不少的bug,比如其他赛车没加载看不到,左右按钮效果不对。后来我让其修改了两次,基本上实现了所有功能,可以真的玩一玩了。

但这个效果我觉得是弱于kimi k3的,k3基本上一轮提示词,在修改一次就实现了很高的完成度。

第二个,也是最让我惊喜的,那就是太阳系模拟。

DeepSeek V4 Pro是所有模型,包括GPT-5.6,实现效果最好的!!!

它不仅画出了轨道夹角,小行星带,柯依伯带,还实现了自传角和各个行星的卫星!这是我使用其他模型从没有过的效果!

下图是实现轨道夹角

下图是行星的卫星绘制效果

下图是点击真实比例之后,太阳系各个星球都按照真实比例展示。可以看到其实是很小的,每个星球距离都很远。

虽然效果不错,但是bug也不少,如果追求真实可用,还是需要多轮对话进行修改。

下面是GPT-5.6的效果,可以看到比V4 Pro差很多。虽然页面看着功能丰富。但是轨道夹角没有绘制

我选择真实比例之后,太阳和行星竟然拥挤在一起,笑死我了~

山姆奥特曼把OpenAI上市是推到明年看来是有原因的,目前模型能力真不行啊!

大家对于DeepSeek V4 Pro更新有什么看法?到底是“梁子” ,还是“梁圣”,欢迎大家评论区讨论~

标签: DeepSeek 太阳系 kimi gpt

上一篇:SE公布《最终幻想7》两款官方手办 泳装蒂法十分逼真!|今日播报
下一篇:最后一页