中关村在线

热点资讯

豆包升级视频通话,首发原生全双工大模型SeedRealtime

今日,豆包正式推出升级版视频通话功能,全面集成自主研发的原生音视频全双工大模型SeedRealtime。该模型专为实时音视频交互场景设计,首次在大规模应用中实现真正意义上的音视频全双工能力。

SeedRealtime具备音视频联合理解能力,可同步处理声音信号、视觉画面与时间序列信息,精准识别当前发言对象,智能判断应倾听、应回应或宜静默的时机,从而支持边看、边听、边说的自然连续对话体验。

在真实动态环境中,该模型显著提升了视频通话的交互自然度与响应连贯性。其技术突破主要体现在三个方面:

一是深度融合多模态信息。模型能将语音、图像及时间维度数据协同建模,在复杂语境下消除同音歧义,并准确解析画面中具有时序指向性的动作或对象,使视觉所见、听觉所闻与语言表达形成有机统一。

二是具备主动交互意识。模型持续感知环境变化,当画面中出现状态切换或关键目标时,可自主发起提示,并灵活调用相关功能模块辅助表达,推动人机交互由单向响应迈向双向协作。

三是优化对话节奏控制。模型实时分析用户语音停顿、语速变化及非语言线索,动态选择最适宜的介入时机,实现自然接话、合理停顿与及时反馈。同时,它对环境干扰具备较强鲁棒性,能有效区分用户主述、他人旁白及背景杂音,大幅降低误触发率,保障沟通全程流畅稳定。

展开全文
人赞过该文
内容纠错

相关电商优惠

评论

更多评论
还没有人评论~ 快来抢沙发吧~

读过此文的还读过

点击加载更多

内容相关产品

说点什么吧~ 0

发评论,赚金豆

收藏 0 分享
首页查报价问答论坛下载手机笔记本游戏硬件数码影音家用电器办公打印 更多

更多频道

频道导航
辅助工具