字节跳动发布原生音视频全双工大模型SeedRealtime

2026年8月5日,字节跳动Seed团队正式推出原生音视频全双工大模型SeedRealtime。该模型采用统一架构,深度融合音频、视频与文本模态,实现“边看、边听、边说”的实时自然交互。其三大突破包括音视频联合理解、主动环境感知与表达、以及精准对话节奏控制。端到端评测显示,相比级联方案,对话卡顿问题减少50%。目前,SeedRealtime已全量上线豆包App,用户更新至最新版后可通过“打电话”入口体验视频通话功能。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

上一篇:

下一篇: