Загрузка видео...
Не удалось загрузить видео
Qwen-3.8 发布两天,实测体验来了。 第一时间订阅了 Token Plan,并在 Qwen Code 环境下进行了对比测试。 📊 实验对照: 第一次(弱提示):仅给出一句话模糊需求,生成效果较为平庸、模式化。 第二次(强结构):清晰梳理功能模块、交互逻辑、图片规则及页面结构。模型对长任务的指令遵循度表现极佳,最终成功交付了一个完整的可操作系统。 核心体验: 1. 推理与生成速度:即便面对超长 Prompt 和多页面构建,整个生成过程依然流畅,耗时17分钟,等待延迟相比 kimi k3(52分钟)、grok 4.5(26分钟) 小很多。 2. 长任务执行力:后加的交互细节与模块划分,基本都高水准地落到了最终成品中。 最后:还是那句话,模型能力固然重要,但想让模型稳定交付复杂任务,需求本身也得足够清楚。 把目标、模块和规则拆明白,Qwen 3.8 确实能把复杂任务推进得又快又完整。 越来越期待它接下来的开源评测了! 以上。 附上两次生成过程和最终效果👇
78,336 просмотров • 21 дней назад •via X (Twitter)
Комментарии: 0
Нет доступных комментариев
Здесь появятся комментарии из оригинального поста
