中文搜索引擎指南网

 找回密码
 禁止注册

QQ登录

只需一步,快速开始

搜索
查看: 25|回复: 0
打印 上一主题 下一主题

字节跳动发布 SeedRealtime 边看边聊模型

[复制链接]
跳转到指定楼层
1#
发表于 前天 17:37 | 只看该作者 回帖奖励 |倒序浏览 |阅读模式
SeedRealtime 原生音视频全双工大模型是什么?

SeedRealtime 是字节跳动 Seed 团队于2026年8月5日发布的原生音视频全双工大模型,能够实现边看、边听、边说的实时多模态交互的能力。

该模型现已在豆包 App 上线,更新豆包最新版,打开视频通话即可体验。


和传统拼接式AI方案不同,SeedRealtime采用统一端到端原生架构,将音频、视频、文本与时序信息深度融合,让感知、理解、决策、表达全程同步并行。无需等待用户语句结束,支持双向实时交互,用户可以随时打断AI,AI也能根据画面和语境主动插话、提醒,接近真人面对面沟通的自然节奏,同时大幅降低对话卡顿、抢话、误触发等问题。

依托强大的音视频联合理解能力,SeedRealtime可以结合画面场景消除语音歧义、精准识别画面中的物体与动作指代,看懂动态实景变化。同时具备优秀的抗干扰能力,能有效区分人声与背景噪音,适配各类复杂环境的实时交互场景。

SeedRealtime应用场景

实时视频陪伴对话,可随时打断、插话;
实景指导:对着实物镜头,实时答疑、纠错教学;
现场观察:看画面主动提示、讲解;
嘈杂环境下的音视频交互,抗背景噪音。

体验方式
将豆包App更新至最新版本,进入「打电话」页面,开启视频通话,即可全程体验SeedRealtime原生音视频全双工交互能力。


SeedRealtime 演示视频
https://weibo.com/tv/show/1034:5 ... om=old_pc_videoshow

分享到:  QQ好友和群QQ好友和群 QQ空间QQ空间 腾讯微博腾讯微博 腾讯朋友腾讯朋友
收藏收藏

Archiver|手机版|小黑屋|教你搜 ( 鲁ICP备16006309号

GMT+8, 2026-8-7 03:12 , Processed in 0.153785 second(s), 25 queries .

Powered by Discuz! X3.2

© 2001-2013 Comsenz Inc.

快速回复 返回顶部 返回列表