1
字节跳动 SeedRealtime 音视频全双工大模型发布:支持边看、边听、边说,已上线豆包
字节发布SeedRealtime音视频全双工大模型,统一架构原生融合音视频文本,已在豆包上线,边看边听边说还能打视频电话。
IT之家 8 月 5 日消息,字节跳动 Seed 今日宣布推出 原生音视频全双工大模型 SeedRealtime , 走向全模态自然交互。 SeedRealtime 用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。它实现了以下三项核心突破: …