Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

Qwen3.8发布了,据官方说仅次于 Fable 5? 简单做个对比测试,给了一张古建筑的各个角度的图,一句提示词用threejs生成3D模型。左边是Qwen3.8-Max-Preview,右边是Fable 5的效果。两个模型均使用Chat模式生成。 Qwen3.8对图像的理解能力还是欠缺了一些,Fable 5明显还原的效果更加好。 当然前端能力不能代表全部,但也是最直观能体现出来的能力。 参考图像和提示词⬇️

56,189 Aufrufe • vor 7 Tagen •via X (Twitter)

0 Kommentare

Keine Kommentare verfügbar

Kommentare vom Original-Post werden hier angezeigt

Ähnliche Videos

早上Claude Fable 5 蹬的一滴都不剩了,模型很强,那为啥消耗这么快呢?到底值不值呢?具体适合什么场景呢? 我在等额度的同时,发现了ZenMux 也上了Claude Fable 5 ,于是做了个与opus 4.8的测评,他家的数据也比较完整便于我后续分析 测评最终效果见视频:opus 4.8 还不错,但是仔细看就会发现Claude Fable 5 的强大,更加生动,自然效果更明显,加分项完成的也更多 再对比模型具体指标: Claude Fable 5 耗时: 110.44s 输入 2798 输出: 10322 Claude Opus 4.8 耗时: 68.36s 输入: 2798 输出: 6100 所以你会发现 Fable 5 输出token 也是两倍 也就是说fable 5 话更多,耗时更长,而token 单价fable 5 也是opuse 的两倍,所以一般任务上整体花费可能远不止两倍了,性价比上还是4.8更高 但是效果上毫无疑问Fable 5 会好一些。 要追求极致的效果和复杂任务可能Fable 5 更好,一般任务还是老老实实Opus 4.8 或者4.6吧 评论区附赠:如何最大限度发挥Fable 5 Fable 5 本身也是针对最艰巨的任务而打造,其他模型搞不定的可以考虑再上Fable 5 ,所以这么看其实按量比较合适 而ZenMux 目前刚好推出限时充值返赠活动: 充 20 美元 送 10 美元 充 50 美元 送 30 美元 活动限时一周,每位用户限享一次,先到先得。 想要尝鲜新模型的朋友,可以考虑下ZenMux 或者6/22 后claude code 订阅不给用 Fable 5 了,那也可试下ZenMux

岚叔

16,616 Aufrufe • vor 1 Monat

MiMo推出1000 Token/s超高速模型|体验测评 MiMo 推出了 MiMo V2.5 Pro UltraSpeed 超高速的模型版本,能够实现每秒输出超过 1,000 Token 的速度。 同时,这应该也是全球第一个达到这个速度的万亿(1T)参数模型。 藏师傅提前试了一下,做了三个测试,确实爽。 第一个跑了一个比较复杂的 3D 采矿小游戏测试。在没有素材的情况下,我让它全部用 Three.js 前端代码来生成素材。整体要求比较完整,虽然第一次实践时出了一些小问题,但在跟他沟通修改建议后,非常完美地实现了任务。 这次测试的各项指标如下:思考的 TPS:804 Token/s,峰值速度:810 Token/s,首次响应时间:4.71 秒。 第二个测试给了一个官网,其头部包含一个相对复杂的 3D 动画。 这次的输出速度快了非常多:峰值达到了 1426 Token/s,首次响应只用了 0.83 秒,在 32 秒内输出了 25624 个 Token,总计生成了 1000 行代码。 第三个测试给了一个更复杂的官网。我要求这个官网的 Header 头部包含以下 3D 效果:地球边缘、轨道上的飞船、星际尘埃、航线图、舷窗的 HUD 样式。 这个效果非常好,整体的视觉样式、状态、SVG 动画和驾驶卡片都非常精细,还有滚动的视差效果 这个输出的 TPS 达到了 1136 tokens/s,首次响应是 4.5 秒 官方测试平台下面有个数据展示,会显示相关信息 在流式输出的情况下,当你看着它只用 20 秒就产生一个非常复杂的 3D 游戏时,那种场景还是比较震撼的 之前的这些(比如说 Groq 之类的)超高速推理方案,在模型能力或者是整体水平上都会有所下降,但是 MiMo 这个在测试的时候,我没有看到这种迹象 最近很多公司都开始推出这种超高速的 API 服务,比如之前 OpenAI 和 Anthropic 都有 Fast 模式 在 Agent 场景下,模型输出效率的提升会直接带动每一步 Agent 操作的效率: 如果一个任务预估一分钟完成,你就会盯着它直到结束,然后立刻投入测试。如果需要五分钟才完成,你可能就会去干别的事,然后再回来看,难免会浪费一些时间 这种效率提升在 Sub-Agent 和并发场景下更加明显。因为它可以更快地产出大量结果,想象一下,如果同时启动一两百个 Sub-Agent,在模型能力没有衰减的前提下,速度提高 10 倍,体验是非常爽的 毕竟这本质上是面向那种对效率有极高要求的 To B 客户所推出的 希望后面大家卷起来,优化一下成本,让普通用户也能放开用这种 UltraSpeed 模型

歸藏(guizang.ai)

26,998 Aufrufe • vor 1 Monat