正在加载视频...

视频加载失败

字节发布了一款端到端同声传译模型:Seed LiveInterpret 2.0,中英双向端到端同传,延迟为2-3秒 从演示效果看,准确性、复杂场景的处理、声音情绪的表达、语音克隆音色转换的效果相对都还可以 性能上,语音到语音翻译,中英互译平均翻译质量到了66.3分,接近专业真人同传水平 延迟上,语音到文本输出首字平均延迟2.21秒,语音到语音输出延时2.53 秒 功能上支持实时声音复刻,复刻不同说话人的音色 擅长多人对话、非流利语音以及长音频场景 对绕口令、诗词、美食文化等可相对自然互译 #AI同传 #SeedLiveInterpret #字节同传

78,545 次观看 • 1 年前 •via X (Twitter)

12 条评论

AIGCLINK 的头像
AIGCLINK1 年前

体验地址: 技术报告:

Winnerineast 的头像
Winnerineast1 年前

以后可以把苹果的logo遮一下,国际惯例。

goodhawk 的头像
goodhawk1 年前

体验后不行. 都没法操作.

DoRaGon 的头像
DoRaGon1 年前

太早期了,像个小demo产品。

哈世链闻 的头像
哈世链闻1 年前

对话神器666

David Wu 的头像
David Wu1 年前

2-3秒?延迟大

OSDev 的头像
OSDev1 年前

rst @readwise save thread

DeepLove 的头像
DeepLove1 年前

emmm

ken lu 的头像
ken lu1 年前

@readwise save thread

Jason傑森 🇭🇰 | 🛠️ 的头像
Jason傑森 🇭🇰 | 🛠️1 年前

这波翻译有点东西啊 @shoutdotfun $ENERGY $SHOUT $FAN $Bane

iCoder 的头像
iCoder1 年前

这个功能,使用最近李沐开源那个模型,就能做到了

Erimus 的头像
Erimus1 年前

笑话这种需要上下文的东西,没有听到后半段,怎么能正确地翻译前半段呢?除非是有些旧笑话一听开头就知道全文。

相关视频