Loading video...
Video Failed to Load
兄弟们,阿里今天直接放了个大招——Qwen3.5-Omni 正式上线了! 这玩意儿不是那种拼凑的多模态, 而是真正原生全模态,文本、图片、音频、视频一股脑儿全吃得下,还能实时吐出自然语音。 看一段手绘界面视频, 它居然能直接“看懂”你的需求, 瞬间生成能跑的代码和移动端效果——Audio-Visual Vibe Coding 能力自然涌现,简直像AI自己开窍了,太离谱! 它支持超长输入: 10小时音频或1小时视频, 上下文256K,还能生成带时间戳、 场景切换、说话人映射的细粒度视频脚本。 语义打断超自然,背景噪音也不怕, 74种语言识别+29种语言生成, 音色克隆、语音控制样样行。 内置WebSearch和复杂Function Call, 真正能自主干活的Agent感拉满。 阿里给了Plus、Flash、Light三个版本, 开发者直接在阿里云上玩,成本和效率都在线。 做视频剪辑、UI原型、跨语言交互的兄弟,这波直接起飞!谁试过了?快来分享你的神操作! #Qwen3.5Omni
10,359 views • 4 months ago •via X (Twitter)
0 Comments
No comments available
Comments from the original post will appear here
