Loading video...
Video Failed to Load
DeepMind 公布其正在开发一套创新的音频生成技术细节 也就是NotebookLM背后使用的语音技术 它能够使 AI 能够生成生成高质量、自然的单人或多人对话。 其最新的语音生成模型能够在 3 秒内生成 2 分钟的对话,速度比实时生成快 40 倍。 同时能够保持说话人之间的连贯切换,输出语音中还包括自然的停顿、口头语(如 “嗯”、“啊”)等细节,使得生成的对话更接近真实交流。 详细:
13,458 views • 1 year ago •via X (Twitter)
0 Comments
No comments available
Comments from the original post will appear here
