ByteDance Seed Releases Native Audio-Video Full-Duplex Model SeedRealtime
AI 摘要
一句话摘要: 字节跳动Seed团队发布原生音视频全双工大模型SeedRealtime,已上线豆包App。 关键事实: SeedRealtime统一音视频文本端到端架构,并行处理感知理解决策表达,内部化轮次判断替代外部VAD,时序问题较级联架构减半,但未发布技术报告、参数规模、开源权重或API。 涉及主体: 字节跳动Seed团队, 豆包App, SeedRealtime 可能影响: 该模型展示了端到端多模态交互的可行性,可能推动语音助手从级联架构向原生全双工演进,但缺乏开放生态可能限制行业采用速度。 是否值得继续跟踪: 是,因字节跳动在AI应用端影响力大,且模型技术细节未公开,后续发布技术报告或API将显著影响行业方向。 噪音/炒作风险: 中,官方未提供可验证的技术细节和基准,仅依赖内部评测,存在宣传成分,但产品已上线可实测,需观察用户反馈。