政策解码

字节跳动推出音视频全双工大模型 SeedRealtime提升对话流畅度

Aug 5, 2026 IDOPRESS

字节跳动在2026年8月5日正式发布了原生音视频全双工大模型SeedRealtime。该模型采用统一架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互。

端到端人工评测显示,与级联模型相比,SeedRealtime的音视频对话节奏问题减少了一半。模型在把握说话时机方面更为自然,减少了话未说完被抢断、话音已落却回应迟缓、被背景杂音与闲聊误触发等情况。此外,单次对话完整顺畅交流的概率也显著提升。

目前,SeedRealtime已在豆包App全面上线。

科技信息网是聚焦全球科技创新的垂直门户,实时提供人工智能、半导体、生物医药、新能源等领域的技术突破、产业报告与政策解读,连接科研机构、科技企业与投资机构,打造科技产业决策者的数字智库。

快速搜索

科技信息网 | 全球科技创新动态-人工智能/半导体/生物技术前沿资讯_科技产业数据智库

© 科技信息网 KejiInfo.com

隐私政策