Loading video...

Video Failed to Load

Go Home

千问新模型Qwen 3.6 Plus这周末免费,直接冲上Openrouter榜首,官方说是中国最强编程大模型。我刚玩了一下,第一感觉是不花钱可真爽。推荐大家用Starchild试试,不花一分钱体会AI agent带来的快乐

69,416 views • 5 months ago •via X (Twitter)

21 Comments

哀's profile picture
哀5 months ago

用了两天,怎么说呢,比3.5强不少,但是同样的任务,出错概率甚至比晚上的GLM5.1还要高,晚上的GLM还是比中午的要傻的,连分析一下项目中老api和新api相同url和请求方式的方法名映射这么简单的任务都有概率出错,而且一个文件最多10个请求,我只对比了一组就错了5个。不过大部分时间处理简单任务还不错

Babyyan's profile picture
Babyyan5 months ago

用了,简直像个智障一样,做出来的东西BUG满地,要他改7 8次才能改对。完全没有上下文记忆体。一坨屎

X Tan's profile picture
X Tan5 months ago

试试就试试🤝

Jingyuan缘缘's profile picture
Jingyuan缘缘5 months ago

试试🤝

Alex_tu's profile picture
Alex_tu5 months ago

我只说一次。适合做plan模型,尤其是文案策划,活动策划

猫儿这个猫儿(关注必回)'s profile picture
猫儿这个猫儿(关注必回)5 months ago

用了几天,发现还是很笨,跟 Codex 是差很多的,只能用来做一些低价值的任务。

egg capital【挨割资本】(🔴,💊)'s profile picture
egg capital【挨割资本】(🔴,💊)5 months ago

好看

强子手记's profile picture
强子手记5 months ago

Starchild 是个什么神器吗

Hexan Meftehm's profile picture
Hexan Meftehm5 months ago

用起来 气人😡

zizelee's profile picture
zizelee5 months ago

玩一会龙虾就限额了

myfun's profile picture
myfun5 months ago

这模型挺6

JBrider's profile picture
JBrider5 months ago

试试先

Ben's profile picture
Ben5 months ago

怎么总感觉口型跟说话对不上呢

Wt's profile picture
Wt5 months ago

试试,不好用,折腾 1 个多小时,屁事没做,就告诉我,额度没了,要冲费,小米和 minimax 挺好

蓝|目标A9📈's profile picture
蓝|目标A9📈5 months ago

不花钱的快乐谁不爱啊

cybernetcaptain's profile picture
cybernetcaptain5 months ago

部署到 openclaw 上了,感觉又慢又笨,还不如 MiniMax

juxiliu789's profile picture
juxiliu7895 months ago

隐约觉得你长得像李宇春……

xujian's profile picture
xujian5 months ago

不,你打字怎么这么快?

Kevin_Z's profile picture
Kevin_Z5 months ago

请问主播你录视频的设备是什么,清晰度好高

Nomadsoul's profile picture
Nomadsoul5 months ago

啊昨天才在B站刷到Up主的Vlog,今天就在这里看到推了

Arthur.eth's profile picture
Arthur.eth5 months ago

建议改穿曼联的球衣

Related Videos

Qwen3-Next-80B-A3B 实测! 能跟头部模型对打吗? 直接说结论, 能完成我这个大象牙膏测试的一部分, 已经很厉害了, Python 杯子倒水那个测试表现也可圈可点. 来看测试中暴露出来的问题: 首先这个模型生成的样式特别多变, 可以看测试中生成的前端页面的样式和布局, 几乎每次都不一样. 所以实际使用中, 可能会存在稳定性的问题, 建议 prompt 中多做约束, 避免模型过度发挥. 不过这并不全是坏处, 如果拿这个大模型写文, 反而可能会超常发挥, 每次写出来的东西都不一样, 不会呆板. 另外目前发现最大的问题是, 给到模型一大堆数据, 让模型整理一个网页, 结果模型偷懒了, 直接把代码和数据省略掉了, 这个应该还是 GPT-4 时代的问题 (24年上半年) 出现了. 这里猜测可能是高稀疏性专家混合模型或者多词元预测造成的问题, 这两个都会在生成中选择最经济的生成模式, 因此可能会倾向于生成"此处代码省略"这样的代码来替代原本要生成一大堆代码的场景. 召回倒是没太大问题, 鞭炮连锁爆炸那个测试, 虽然模型没有成功写出来, 但是最长的一次还是生成了1100行代码, 我仔细看了下, 基本都考虑到了我 prompt 中要求的逻辑, 只不过实现的代码有 bug 跑不起来而已. 综合来讲, 我觉得这应该是 100B 以内的模型无敌手了, 考虑到定位可能是个新的技术试验模型, 所以期待千问推出更大规模 (例如400B-A15B) 的模型, 带来更好的性能. 测试 prompt: #Qwen3Next #大模型竞技场 #Qwen3

karminski-牙医

30,709 views • 1 year ago