Loading video...
Video Failed to Load
🎉 前两天挖到的基于 Qwen3-4B 微调的 ASR 语音识别模型,今天终于有时间本地部署实测了! 直接拿它和行业标杆 Whisper 做了一次全方位硬核对比 具体高能表现看录屏👇 主打一个低门槛:16G 显存就能直接本地部署,对个人开发者极其友好 用 40 亿参数大模型来做语音识别,完全是降维打击,直接让传统同行无路可走! 但这只是开始。语音识别的终局绝非“听音辨字”,而是“端到端多模态理解”的进化 语音识别的终局绝不是单纯的“听音辩字”,而是向着“端到端多模态理解”演进 未来,声音就是大模型的天然输入口,ASR 会无处不在,却又隐于无形 听到声音的同时就在理解世界,这才是真正的 AI 2.0 时代! 以上。
27,192 views • 9 days ago •via X (Twitter)
0 Comments
No comments available
Comments from the original post will appear here
