幻兹快讯
字节跳动发布原生音视频全双工大模型SeedRealtime
幻兹快讯
2026年08月05日
阅读 3 次

2026年8月5日,字节跳动Seed团队正式推出原生音视频全双工大模型SeedRealtime。该模型采用统一架构,深度融合音频、视频与文本模态,实现“边看、边听、边说”的实时自然交互。其三大突破包括音视频联合理解、主动环境感知与表达、以及精准对话节奏控制。端到端评测显示,相比级联方案,对话卡顿问题减少50%。目前,SeedRealtime已全量上线豆包App,用户更新至最新版后可通过“打电话”入口体验视频通话功能。

Copyright © 幻兹网 All Rights Reserved粤ICP备2026034579号粤公网安备44030002012995号