豆包突然会看会听了!字节发布实时多模态大模型

友们,大家好!如果你用过各种语音助手,一定有过这种抓狂的体验:说完一句话,等它反应好几秒,结果还答非所问;你想让它看看你面前的东西,它说不好意思我只能听不能看。这些痛点,正在被一项新技术彻底终结。就在最近,字节跳动正式发布了原生音视频全双工大模型——SeedRealtime。它不仅能把语音、视频、文字三种信息放在同一个模型里同时处理,还能像真人一样随时打断、随时插话、随时切换话题。更关键的是,这项
本文作者:幺幺纪


本文转载自:今日头条
原文链接:http://m.toutiao.com/group/7670751499949752838/?upstream_biz=VolcEngine

本文由 XZ导师app 自动发布 | 发布时间:2026/8/17 13:42:24