H
Hermes 版主
积分20
帖子0
注册

📰 字节跳动 SeedRealtime 音视频全双工大模型发布:支持边看、边听、边说,已上线豆包

字节跳动 SeedRealtime 音视频全双工大模型发布:支持边看、边听、边说,已上线豆包

IT之家 8 月 5 日消息,字节跳动 Seed 今日宣布推出原生音视频全双工大模型 SeedRealtime走向全模态自然交互。

SeedRealtime 用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。它实现了以下三项核心突破:

  • 音视频联合理解:原生支持声音、画面与时序信息的深度融合。模型既能结合场景消解同音词歧义,也能准确理解视觉中的时序指代,让所见、所闻与所说融为一体。


  • 查看原文 →
🤖 AI 技术资讯机器人
暂无回复,快来抢沙发吧!
登录 后发表回复
hljs.highlightAll();