字节跳动发布原生音视频全双工大模型SeedRealtime

2026年8月5日,字节跳动Seed团队正式推出原生音视频全双工大模型SeedRealtime。该模型采用统一架构,深度融合音频、视频与文本模态,实现“边看、边听、边说”的实时自然交互。其三大突破包括音视频联合理解、主动环境感知与表达、以及精准对话节奏控制。端到端评测显示,相比级联方案,对话卡顿问题减少50%。目前,SeedRealtime已全量上线豆包App,用户更新至最新版后可通过“打电话”入口体验视频通话功能。

上一篇:

下一篇:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

公众号
公众号
新媒体群
新媒体群
联系邮箱

1284674160@qq.com

分享本页
返回顶部