发布时间:2026-09-02 一、AI总结内容 一、核心要点 1. Fable5.1核心提升在长任务与agent能力,能一次性完成投研可视化、打车软件全流程、交互式网球游戏等难任务,短任务与Fable5差距不大,通用智能仅小幅提升 2. 官方数据显示,Fable5.1科研A证从24.7涨至25.26,业务流程自动化涨84%,终端编码涨33%,浏览器最难任务从57%涨至82%3. Fable5.1与Fable5底座未变,核心接口差异为强制工具调用取消、思考块绑定、修改早期历史导致后续思考失效;并行变“懒”,需明确要求才主动联网,高算力模式更可靠二、成本与价格格局 1. Fable5.1价格结构不变:输入每百万token10美元、输出50美元,缓存读从1美元降至0.25美元,仅长对话场景能省成本,短任务无成本优势2. 海内外模型价格格局:Fable5.1输出价为智普5.3的11.4倍、深度思考Pro的12.6倍,海外头部模型靠缓存等折扣微调价格,国产开源模型5美元以内的够用档带来价格压力3. Fable仍以B端收入为主,2026年7月API及企业端收入占650亿营收的80%,推理毛利率达70%,年支出超百万美元客户超千家,Fable5.1或利好B端收入 三、风险与关注 1. Fable5.1难任务表现优异,但速度慢、成本高,短任务能力无明显优势,且需明确指令才联网,存在过时数据风险2. 海外模型或不会官方降价,更多通过结构性折扣应对国产竞争,国内模型价格分层或加剧 二、音频原文(转写) 大家好,欢迎参加华福AI互联网FABLE五点一测评。目前所有参会者均处于静音状态,下面开始播报声明。一起面向华福证券的专业投资机构客户或受邀客户。第三方专家发言内容仅代表其个人观点,所有信息或观点不构成投资建议。 根据监管规定,会议不得交流敏感内幕信息。未经华福证券事先书面许可,任何机构或个人严禁录音、制作纪要、转发。转载、传播、复制、编辑、修改等涉嫌违反上述情形的,我们将保留一切法律权利。感谢您的理解和支持,谢谢。 嗯,各位领导晚上好,我是华普AI互联网组的谢荣路。呃,今天我想来测评一下DOP9月1号发布的这个FIBO5.1。呃,今天主要是想给大家看一下,就这个模型它这一版实测出来,就是我们分场景测一下它效果如何。呃,其次就是这一版相对于FIBO5来说,它到底改了哪些地方? 然后包括当前这个价格格局,海内外的又是什么样的?嗯,以及就是飞过五点一出来之后,他在收入端这一块儿之后,我们该怎么看?就我们先直接来看一下整个测评结果吧。就是我们其实已经做了很多轮测评了,然后基本上用的是同一个测评案例嘛。 哦,我们这边先看一下,就这个。这是当时我们飞吻五点五做出来的。就其实我每次在说。这个投研案例,我当时是为了三表进去,然后让他。 去做一个投研的可视化分析,这个个股的。然后这是飞波五做出来的。当时飞波五做出来之后呢,我在测评每一个案例的时候,每一个模型的时候,我都会拿这个案例作为一个benchmark来进行比较。啊,但是当时呢,就是没有一家模型是可以超过飞哥我做的这个投研的案例的。 然后我们这次再来看一下肺部5.1做的。就这个是飞博5.1做的。那飞科五点一,其实在前面的内容呀,包括还有这个深度呀。和飞梦五是基本上是一样的,然后我们再来看一下这一块,这一块是它亮点部分。 就我们之前其实也有说过,啊,其他模型呢,在做模型假设的时候。只给了三个或者是两个,有的甚至是。即使给了很多,但是你调数的时候是出不来的嘛。然后这个飞波五呢,是给了四,我是当时做的最好的。 啊,飞波五点一是在没有提示他要给几个假设的情况下呢。他给了这么多个。就就是我们可以看到我们去改每一个。划每一个滑块的时候。 啊,其实这个数字包括还有下面的这个矩阵。它都有随着这个东西,随着滑块进行变化。啊,所以可以看出来Fable五点一它在这个运算能力上面确实要比Fable五强嗯。这是第一个。 然后第二个呢,就是这个打出软件的例子。就这个打车软件例子,其实我们也做了很多个,但是我们大家会发现。就是每次我们再去展示这个打车软件的例子呢。永远都是。 啊,比如说我去。手动定位,我去手动定位了。然后呢,我去搜啊,然后我每次测评就是可能停留到这一步。就是我让大家看一下,他给了几种快车型价格算的有没有问题。 包括这上面的图,到底能不能点动?就我们每次去测,只能看到这些。哦,但是飞吻五点一呢,它是真正能实现。一次跑通的。 就什么叫一次跑通呢?比如说这个嗯。我随便搜一个。我搜三里屯。 嗯。三里屯搜出来之后呢。比如说我随便叫一个专车。好,我去呼叫车辆。 就很多模型其实到这一步就已经停了,但是我们会发现FIBO五点一呢,它是做出来了。啊,并且它是真的可以在这上面跑。然后您看它其实这里就在形成。哦,但是因为我是要加快速度嘛,所以我这一块速度会设的比较快。 对,然后他到了。它是一次完整的行程。那也就是说,其实跑了这么多模型,目前有FIBO五点一。他是真正的能够把 我从搜索地点。 啊,到选车到坐上车,然后再到整单完成。包括完成后计价。他是完整的跑下来一趟。这个滴滴的。 然后这是呃,我觉得和飞豹五比起来,包括和其他模型比起来。啊,非常惊艳我的两个点。那除此之外呢,我们还去让飞博五点一尝试着做了一些高难度的案例。一次性跑通的。 就比如说这个。这个是我当时让他去做了一个。啊,网球的回合。就这个其实嗯。 我给的提示词非常简单。就是我们可以看到。我其实只需要动这个左键、右键,包括还有空格。所以我就可以在这上面玩这个游戏了。 然后我当时提示词呢,就说让他去帮我做一个交互式的网球呃游戏。呃。而且我们会发现,其实这个游戏它比较像以前玩的X BOX那种。就是他在一个球赢了或输了之后呢,他会有一个慢动作回放,对。 就基本上是不会卡壳的,而且说实话这个案例我是第一次跑通的,就是我没有说他跑出来卡BUG了,然后我再去啊进行一个好几轮的这种回合。就您看他这边其实是有慢动作回放的,呃,那除了这一点比较优以外,我觉得还有一点就是比较有意思的是,就是他在做这个案例的时候,呃,其实其他几家呢,我我也有去让他们去做一个这个比较长难的案例,但做的时候我就明显发现其他几家要么就是做一半停了,卡住了,跑不动了。 要么就是它可以坐下来,但是按键基本上是交互不了,啊,或者说整个动画也没有那么好。但是飞梦五点一确实是第一个能把这个长案例一次性跑通的。呃,然后这边是我们自己的一些测评结果嘛,呃,但是我们其实去测了一些比较简单的,像类 word 编辑器啊,就是让它去仿照一个做一个 word 编辑器这种东西。哦,像这种。 相对来说较简单的呢,我觉得就是和其他模型看起来。其实大家也做的比较好的,就这种短任务上呢,其实差距没有拉的很大。反倒是飞蛾五点一,它在这种。更长更难的任务上,他又和 啊,飞波五以及其他模型拉开了下一个差距。 那这是我们自己的一个测评体体感,然后我们现在来看一下官方给的这个呃能力上的差异。就官方是这么说的。就是目前来看,提升幅度的这个分层呢。首先就是科研A证,它是从24.7涨到了25.26。 相当于翻了一倍多。然后这个业务流程自动化呢,它也是涨了百分之八十四。这个终端编码呢,它是涨了百分之三十三。就我们也会注意到浏览器最难任务的那一行呢,它是从百分之五十七涨到百分之八十二。 呃,所以我觉得相对这呃飞豹五来说呢,就是飞豹五点一它这一版重新做的是 我a卷到底能跑多久?然后我们进行一个自我验证,就这一点能力。但我们可以看到通用智能上面其实只挪了一点点。那也就是说,飞豹五点一和飞豹五比起来,并不是说是它所有能力边界都往外推了。 哦,他主要还是提。就是在这个agent能力上面,包括长城任务上面。他是有非常大的进步的。然后。 下面我们再来看一下这个对比。就是从接口的这个差异化上来看呢。嗯,就是首先来说一下,就飞豹五和飞豹五点一,其实他们 本身的底座是没有换的,因为它上下文当前还是一样,然后。跟瓷器也是同一套,包括整个的自适应思考也是常开的。 啊,缓存最小也是512token。就这一块其实都是没有改变的。但是接口上面呢,官方就是特意强调接口上的差异。主要是有三点。 第一点就是当前是强制工具,是取嗯调用取消了。就怎么去理解这句话呢?就是以前我可以去给飞波舞下。死命令就是我跟他说,这一轮你必须一个一个联网搜索,或者你必须一个一个打电话查,然后你不能允许你。 凭脑子去回答。但现在我这个命令是下不了了,就如果我下这种命令的话,网页会直接报错。那意思就是说你这个请求我不收。然后程序会当场停住。 然后第二点呢,就是说这个思考块其实跟着模型绑定。然后跨模型切换呢,会禁默丢弃。就这个就这句话该怎么理解呢?这也就是说五点一,他的草稿。 只是他自己能懂的一个暗号写的。如果换其他模型来的话就不懂,也就是说比如说我在跟他对话的时候。我这一轮我用五点一去做。下一轮我换成了O P U组。 或者是。啊,送你四点六,那五点一之前做那些草稿会被他自己悄悄扔掉。那他相当于是我不报错,也不提醒。就是单纯就是没了之前的这一块儿。 然后第三点呢。就接口这一块呢,是 就是说改动思考块之前的这个任何的历史内容呢。就是后面思考块全部失效,就这句话该怎么理解呢?也就是说。 啊,五点一,他写完一个草稿,他会盖一个封条。就相当于这个分条呢,是根据当时我给他喂的所有材料算出来的。如果我说 用了任何一份早期的材料,哎,比如说我给他扔了一份这个呃研报,或者说是这个报表,然后其中我把数字改了,然后我改了系统的提示,或者说我临时加了一个工具,我删了条其中的旧消息,或者我换了一张图这种的,那整个的分条就会对不上,那后面的所有操导就全部作废,那也就是他下次请求会直接报错。 那从这个口径上呢,我觉得就是还是防HACK的机制,它会越做越严,尤其是第二、三条也可以看出来。就尤其是这个草稿,它啊五点一用完之后,它立刻丢弃。呃,其他模型看不懂。然后这是它接口上的一个差异。 那从行为上,FIBO五点一其实还有一个差异,就是它的并行变懒了。就这个怎么去理解呢?也就是说啊,以前比如说FIBO五我要查五个网页,我然后联网搜索五个网页,那它现在呢,FIBO五点一是倾向于我搜完一个网页我再去搜下一个,那结果就是相对来说变得比较慢。嗯,然后这呢我 我就就觉得就是它会意味着低档的这种,就是如果我们在F里面选那个漏的话。 他可能会更爱凭自己的记忆去做。嗯,而不是说我进行一个主动的联网搜索。那如果我把算力档位呢调到了省钱的时候呢?他其实更愿意去用他自己脑子中记住的一些东西来回答。 而不是说去查。那省了是什么?但是可能对我们一个是一个过时的数。那也就是说,如果我们要求新鲜数据的话,就是我得用。 ever比较high,比如说high呀,或者是extra这种。去做 呃,或者说是我明确要求他去查证。让他明确联网搜索。嗯。 啊,那我们可以看到就是飞舞这些。呃,和飞波、飞波五点一和飞波五这些差异化的口径看下来的话。哦,我觉得它是相对来说有些东西是变贵了的。也就是说我改一行代码。 呃,他就需要重写整个文件。就这其实是最贵的一个东西了。哦,因为它这个输出呢是按量计费的,而且也是最贵的。当前是每百万投坑五十美元嘛。 那一个两千行的文件,如果让他重写一遍的话。那账单这一块让他改一下的话,那就是相当于改了。一行那就要几百倍的这个账单。嗯,所以我觉得就像我们自己这种做纪要呀,包括还有做摘要这一类的活呢,其实还是得额外交代,或者说换个模型去做。 就这一块用五点一来说的话,我觉得。啊,可能还是比较偏贵了。那我们下面再看一下第三方口径测出来的一个结果。就我这边是把一些第三方的一些官方口径测出来的结果呢,我以fable五为benchmark量化了一下。 红条是产出册,然后蓝条这一块呢是投入册。就蓝条越长,表示的是他投入越多。哦,那放在一起的话,我觉得第三方测出来有个共同特征,就是说。他的输出其实得得到的更少了。 但是它会变得更准了,但是也同时会变更慢、更贵。像刚才咱们看这个打车软件