该模型采用端到端统一架构,同步接收音视频画面声音直接生成回复,减少模块调度,优化对话节奏,拥有自然停顿等拟人交互效果。该技术完成大规模落地,为全模态实时AI助手提供新的技术路线。
字节 Seed 团队最新推出 SeedRealtime 全双工大模型,依托统一架构把音频、视频、文本做原生融合,实现“边看、边听、边说”的真人式实时交互,目前该能力已经在豆包 App 完成全量上线,推动音视频全双工技术走
本文转载自:码云笔记
原文链接:https://mybj123.com/31957.html
本文由 XZ导师app 自动发布 | 发布时间:2026/8/17 13:42:23