字节跳动在2026年8月5日正式发布了原生音视频全双工大模型SeedRealtime。该模型采用统一架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互。
端到端人工评测显示,与级联模型相比,SeedRealtime的音视频对话节奏问题减少了一半。模型在把握说话时机方面更为自然,减少了话未说完被抢断、话音已落却回应迟缓、被背景杂音与闲聊误触发等情况。此外,单次对话完整顺畅交流的概率也显著提升。
目前,SeedRealtime已在豆包App全面上线。
留学信息网 | 全球留学资讯_院校申请指南_海外生活攻略_权威教育门户
© 留学信息网 liuxueinfo.com 隐私政策 联系我们