您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [未知机构]:国泰海通计算机DeepSeek-V4-Flash多模态测评 - 发现报告

国泰海通计算机DeepSeek-V4-Flash多模态测评

2026-08-22 未知机构 福肺尖
报告封面

发布时间:2026-08-22 一、AI总结内容 一、核心测评结论 1. DeepSeek-V4-Flash多模态版本对标GPT-4.8,在多模态任务上与Kimi K3表现接近,落后于前沿模型(如豆包、Phi-5),生成PPT等任务存在图片衔接生硬问题,生成3D游戏、火箭发射demo时存在物理规则bug,但相比非多模态版本有一定提升2. 价格方面,DeepSeek-V4-Flash多模态版本的图片输入token按384个换算,单token成本约0.0000001元,成本极低,2亿token花费30元,价格接近V4Pro 二、关键测试案例 1. 多模态识别测试:DeepSeek-V4-Flash多模态版因AI治理规则未识别出梁文峰照片,误将其识别为赵立东;豆包秒出梁文峰照片的身份及所属会议信息,多模态表现更强2. 生成类任务测试:DeepSeek-V4-Flash多模态版生成雅典自驾游PPT耗时1小时,生成SpaceX火箭发射3D demo耗时1.5小时,生成糖豆人游戏存在色彩单一、碰撞逻辑不完善问题3. 长线程任务测试:DeepSeek-V4-Flash多模态版生成可交互骑马开放世界demo,相比非多模态版画面更美观,但仍存在物理bug,性能对标Kimi K3,落后于前沿模型Phi-5 三、行业发展与后续展望 1. DeepSeek核心团队认为多模态是AI的组件而非主线,未来将聚焦语言模型、思维链、Agent等核心能力,推进AGI路线,暂不侧重视觉等动态能力的核心发展2. DeepSeek-V4-Flash发布拉低了大模型性价比,推动了AI产业发展,后续将继续跟进Kimi 3.1、Grme等新模型的测试3. 国泰海通证券后续将举办Agent相关会议,欢迎参会 二、音频原文(转写) 大家好,欢迎参加国泰海通计算机deepseekv4 flash多模态火线测评,目前所有参会者均处于静音状态下面开始播报声明本次电话会议仅服务于国泰海通证券正式签约客户会议音频及文字记录的内容,仅供国泰海通证券客户内部学习。使用不得外发,并且必须经国泰海通证券研究所审核后方可留存国泰海通证券未授权任何媒体转发。此次电话会议相关内容未经允许和授权转载转发均属侵权国泰海通证券将保留追究其法律责任的权利,国泰海通证券不承担因转载转发引起的任何。 和损失及责任市场有风险投资需谨慎提醒广大投资者谨慎做出投资决策。哎,好的嗯,你听到。嗯,我在手机的例会啊,我也想报名。天就这个微视他发了那个啊嗯,看到我这个唉好的,我的。 好,我现在开始啊,今天想给各位领导。今天啊,我刚才那个在那个吃饭了一下午五点发的,然后他的电视停的过一下就对比了它前一版本嘛,现在是一个啊,明显超然后它呃是对标了4.8,有一个就是我们一边是deepswe啊,就是26年新出的一个专专门针对啊agent长线城任务的一个测试吧啊,也是有一个比 较明显的超越啊,它整体下来啊,就这个多模态版本的这个价格和他啊正式版的价格文字部是一样的。 然后多了一个就是图片生成的那个token,就是他把图片输入进去,然后会转化成最多384个token啊,那这个其实啊也其实没有多少钱啊,就是零点几块钱吧,那刚好说到这个价格嗯,之前也是一个deepseeks和pro的那个这个题啊,其中一个就是啊,现在那个拍出有点卡啊。哦,好来了啊,就是我做了这个deepseekv4的这个花费吧,它是啊,之前1亿token,大概是五块钱,这个是涨价之前啊,然后这个v4 pro是11.8亿,然后17块钱啊,参加之后呢? 大概我这个多模态的这个版本,我大概是用了2亿的token是30块钱啊啊,就是有很相当于flash到了一个pro的那个价格吧,然后还贵了一点啊,目前是价格方面是这样的,呃,做了一些测试啊,有一个就是多模态啊,一些比较基础的测试啊,就是我先把这个梁梁峰梁总的这个视频给deepseev4这个多模态版本向他去识别啊,他们其实没有识别出来,但是我觉得它可能不是啊。这个deepseek本身的自己的原因啊,它可能全部大模型都有。 这个问题就是ai治理的原因,他不让这个做这个人脸识别然后他识别的是赵立东啊,因为我之前还弄了一个啊,随缘科技的模型让他去呃判断一下我写的对不对啊,确实这里面其实有一个有一个错误啊,他也找出来了,就一个说明说明说呃,他在这个呃数字问方面,这个识别还是比较准确吧,有一次明显错误就是就是这个刚刚我指出的那个数字是吧,那他我他的这个人物的识别啊,就是大家模型其实都做不到包括我用k3也做了一个这个梁,总的识别它也是做不到,然后像clock也是一样的,那这里面其实我觉得有一个原因吧,他做了识别,但是它啊是除了梁总那个脸啊,他都做了识别,这里面也能看到它其实是有几个关键特征吧,黑框眼镜蓝色西服白衬衫,然后这个啊讲台的麦克风,然后当时正好这个虽然科技的赵立东啊董事长,他正好在这个waic有这个标准的造型,然后就识别出是这个了啊。 那我也测试了其他的,比如说这个最近比较火的这个牛来的这个电影。它确实识别的比较准确啊,确实只是啊,能识别到是牛来的电影,然后我还测试另外一个梁,总的这个这个照片啊,也确实他搞了13分钟也没搞出来啊,就是啊这个问题啊,但是有一个大模型,我觉得非常牛的就是豆包啊,豆包是秒出答案啊,就是这个梁文峰这个这个同样的图片给豆包,然后他就能描述单,而且像第二个图片,他还能把这个后面的背景是什么会议啊给列出来,他说这个豆包在这个多模态领域确实是比较比较强的吧啊。 啊,当然也有一定的这个啊,各个这个ai的这个治理的规则也也不太一样了啊,对吧?那就是这个情况啊,当然我还做了一些,其他的就是他官网给了几个例子吧,就是啊,诶在这儿。做了一个啊,就是旅游的自驾游的ppt嘛对吧?那我也复刻了一下啊,就是他用的是西藏的我,我弄了一个雅典的啊,这个他其实搞了蛮久的啊。 啊啊,这个是日期中的有一个这个嗯,做的还可以啊,但是这个是deepseek flash做的不是多模态版本做的啊,嗯,其实也已经很好了,但是能看出来它很多图片都是一种硬衔接啊,就是非常直接的这种呃两个图片的拼音接可能也没有对这个图片的理解吧,是吧?啊,这个树其实和他这个。啊有些图是啊,没有那么的贴切吧,对吧,那嗯嗯deepseek威威斯那个多模态版本呢,我也做了一个,其实这个应差不太多,但是感觉上还是这个多模态版本更好一点啊。 不知道是不是这种显而为主的显而为主的概念啊,就是它更美观一点,然后它的衔接也更更好吧,然后每个图 片对应的文字也非常的贴切。这个是因为这个维斯这个这个多模态的版本做的这个这个ppt啊,两个都用了超级久啊,一个是一个小时,一一个一个半小时,这个其实在这个查看成任务里,我没想到他做ppt能搞这么久啊啊,有可能它识别图片的时候,嗯识别的比较久吧。啊,那当然还做了一些比较经典的就专门针对多模态的一些呃网站的测试吧,包括呃deepseekv4 flash的这个。 顾客了一个我们国德海通的一个网站,这个是啊,没有多模态外面做的啊,因为它可能没有图片识别吧,它只是把网站后面的一些代码啊,挪过来了,所以说它复制的就比较比较还原啊,这个是我们这个国德海通的官网啊,它几乎是做到了全部的复制。啊,但是如果是多模态呢,它应该是截图,然后再去做另外东西。那这个是这样的,这是deepseekv4多模态做的。啊,其实做得也非常的好,比较成熟了吧。 嗯,就如果说他当初的那种大学课题来做,基本上也是90分以上的一个成绩了。啊,当然,我用这个k米k3也做了一个类似一样的例子啊,因为现在它对标of4.8嘛,但是k3其实也也可以平替open4.8了,所以就拿k3来做了。这是k3做的啊kmik3,它的颜色上也更加的还原吧,但是呃整体上来看,大家都差不太多啊,这就是多模态这个方面的问题。啊,然后在一些长线程任务吧,我们一直之前一直有在做的一个就是这个骑马的这个游戏啊。 原来我做了在在这上桌。呃用deepseekv4 flash做了一个骑马的游戏,可以先给大家看一下之前是一个什么样的情况啊?对这个我我的problem就是你是一个顶级的3d游戏开发者,从零开始创建一个可交互的开放世界的起码。Demo啊,这是这样的啊,然后有房屋有树木,然后可以下雨,大概这个啊dpv4 flash做了一个这样的一个呃游戏吧,其实现在可看可以看到它其实没有那么美观啊而且很多东西,它是没有那么符合物理规律的,比如说这个马马柱的它就没有那么的好啊。 这是这样的就是呃dpc的威斯flash,没有多么太慢做的,那我我这一次呢,又加多么太又重新给他搞了1版确实是有一定的进步啊。啊,这个颜色其实一下子就看得比较好了,当然还是有一些物理上的bug的。啊嗯,这个马马是比比上一次要嗯,更像马了,而且这个大小其实也也像吧,就是,但是这个很多物理规律没有做得很好,这个颜色搞得也不错吧。对吧,这个是多模态加持下的,我觉得他现在这个这个效果其实已经可以对标k3啊,我来给大家看一下k3做的这个啊,幻想大镖客的这个嗯,案例吧。 对这个是k3座的啊,有一定bug,但是其实效果上来看其实已经和啊,威斯弗莱是啊,那个多模态版本差不太多了啊,现在看对吧?颜色上的都是差不多多然然后可以在还还有还有一定的bug对吧?还是比较像的,也是这样的啊,然后再对比一下就是现在前沿的比较,比较前沿的模型嘛,我我也做了一个啊同样的例子,同样的problem给大家看一下菲洛姆,现在和和这个现在和我们的差距大概有多大? 啊,这个是我拿飞波舞做的一个啊。啊,荒野大镖客的一个demo吧,看大家能不能看到对这个这个画面质感上其实就更好一点了,这更丝丝滑对吧?这个前沿的搜塔模型其实还是牛的还是还是有一定差距的,包括这个人?就把这些坑下面。 哦,这个是颜色正午清晨,然后这个太阳,它是可以慢慢升上来的。这个我觉得做得就非常非常丝滑,而且它的这个世界是非常大的啊。这可能也是我们和前沿模型的一些差距吧。啊然后哦,还有我又整了一些其他例子啊,就比如说火箭发射的那个例子,我先给大家看一下。 啊,这个这个v4没有多模态版本做的这个啊,这个是啊,这个是v4大概花了半个小时啊,这个是没有怎么太做的,其实还是比较粗糙的啊,比如我们就是可以把它理解成大模型中的这个蜜雪冰城啊,就是他说的功能都有,就是没有那么的美观啊。啊然后呢?这个是这样的,它其实也没有别的什么东西了啊,然后对比一下现在的版本儿哦,这个是有多模态的,还要做了一个,这个其实就比他没多模态的,好好很多了啊,但是还是有有一些粗糙的,比如说这些物理的bug对吧? 然后发射啊,这个火焰其实有吧,这个是下落时候的火焰啊啊,那其实就是上升之后就没有了,一直上升是吧啊,那其实我还想各位看一下它那个v4 pro其实是已经可以做的,非常好了啊,其实比较超乎我的预期吧,就是没想到他能搞这么好,这个是vis pro做的啊,它其实可以和因为其他有一定对比来给大家看一下发射啊,他做他其实有做一个二级火箭的分离,然后回收的一个过程,这个还是让我比较惊艳的。 包括他的这个格尔瓦还有这个啊我们可以看到这个就是引擎猎鹰发动机的这个30几个发动机,这几个竖条其实也可以清晰可见到很多很多生成很多模型,它做不到那么那什么的。然后等一下就可以看到它的这个啊,二级会员分离,其实我这个prom每个大模型都是一样的,prom就帮我做一个spacex的3d空间啊,复刻spacex的发射场地就是一个这样的它。贝斯pro就是就是会搞很久啊,一般都是一一小时,一个半小时这个市场啊,这个就是我觉得这个搞得不错,如果它后续加上多模态可能会更好1点,但是现在看来已经不需要什么多模态,就是可能优化一下后面的这些。 一些水水对吧,然后等一下再给各位老对比一下这个飞波五啊。然后这个k3其实做的和他的也差不太多啊,我就不在这里就不那么。呃啊,你等下也可以演示一下就是对比下k3对这个是不会写,我觉得这个做的效果还是蛮好的,给各位领导就是看一眼啊啊然后等一下看看还卡不卡,因为我这个是那个麦克啊,它一发热,它就会诶。也延迟就很高,所以可能要缓一