铭鸿体育资讯网

刚刚!字节发布原生音视频大模型

刚刚!字节发布原生音视频全双工模型 SeedRealtime,已正式接入豆包 App。

此次接入的 SeedRealtime 是字节跳动推出的音视频全双工模型,支持视频画面、语音输入和语音输出同步处理,让 AI 能够实时完成“看、听、说”。

原生多模态融合: 深度融合声音、画面与时序信息,实现对真实场景的综合理解,让 AI 能“看懂、听懂、说清”。

主动智能交互: 持续感知环境变化,能够主动发现关键信息并提醒用户,从被动问答升级为主动协作.

自然流畅沟通: 实时理解交流节奏,精准判断回应时机,同时具备抗噪与抗干扰能力,带来更接近真人交流的连续对话体验。