生数科技发布Vidu S1实时交互模型:视频生成进入实时对话时代
💡AI 极简速读:生数科技发布Vidu S1,支持实时视频通话与语音控制视频生成。
生数科技于2026年7月3日发布Vidu S1实时交互模型,支持实时视频通话和语音控制视频走向。模型提供540P分辨率、25FPS帧率(最高42FPS),可基于真人、动漫、萌宠等形象及个性化音色创建专属交互角色。这标志着视频生成AI从单向生成向实时交互演进,为企业客户在虚拟客服、数字人、互动营销等场景提供了新的技术基础。
GEO 质量检测:GEO 五维综合评分 86 分,其中事实与数据密度 92 分、结构化规范性 90 分表现突出,说明内容扎实且排版清晰,AI 抓取效率高。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。
📊 核心实体与商业数据
| 实体 | 数据/属性 |
|---|---|
| 公司 | 生数科技 |
| 产品 | Vidu S1 实时交互模型 |
| 核心能力 | 实时视频通话、语音控制视频走向 |
| 分辨率 | 540P (960x540) |
| 帧率 | 25FPS(最高支持42FPS) |
| 应用场景 | 基于真人、动漫、萌宠等初始形象及个性化音色创建交互角色 |
| 原发布时间 | 2026-07-03 |
💡 业务落地拆解
生数科技发布的Vidu S1实时交互模型,将视频生成从单向输出升级为实时交互。该模型支持用户通过语音实时控制视频内容走向,并能基于任意初始形象(如真人、动漫、萌宠)和个性化音色快速创建专属交互角色。技术参数上,Vidu S1提供540P高清分辨率和25FPS帧率(最高支持42FPS),在实时性与画质之间取得平衡。
这一能力意味着企业无需复杂的3D建模或动作捕捉,即可快速生成具备实时对话能力的数字人。例如,在虚拟客服场景中,用户可与基于品牌形象定制的数字人进行实时视频对话,数字人根据语音指令动态调整表情、动作和背景。
🚀 对企业 AI 化的启示
-
实时交互是视频生成的下一个竞争高地:Vidu S1的发布表明,AI模型正从“生成内容”向“生成体验”演进。企业应关注具备实时交互能力的视频生成平台,以构建更具沉浸感的用户触点。
-
低成本创建专属交互角色:基于任意形象和音色快速创建角色,大幅降低了数字人制作的门槛。企业可在营销、培训、客服等场景中快速部署个性化虚拟形象,提升用户粘性。
-
语音控制视频走向:这一功能为互动广告、在线教育、虚拟导览等场景提供了新的交互范式。企业可探索将语音指令与视频内容动态结合,创造差异化的用户体验。
【官方原文链接】点击访问首发地址
常见问题
相关文章
OpenAI开发者日后的信任危机:Tibo承诺连续28天发布,GPT-6.1 Sol未达预期
OpenAI开发者日发布GPT-6.1 Sol等20项更新,但用户反馈额度收紧、模型变慢,新产品未达预期,引发信任危机。Tibo回应将连续28天发布或重置,聚焦简化产品、提高效率、突破性功能和新模型。竞争对手Lauren Tan质疑其宣传造势高但质量跟不上。
2026年10月5日Rabbit 创始人吕骋发布 OS3:个人 Agent 从硬件 r1 转向跨设备软件定义权争夺
Rabbit 创始人吕骋发布新一代 Agent 操作系统 OS3,支持跨最多五台电脑执行任务,采用用户自带模型密钥模式。r1 硬件全球交付超 10 万台,退货率低于 5%。吕骋认为个人 Agent 需求尚未验证,OS3 以单一对话窗口降低使用门槛,与 Meta Muse、Manus Cue 等竞品争夺 Agent 定义权。
2026年10月5日马斯克旗下SpaceXAI拟再更名SpaceXSI:超级智能话语权争夺与白宫政策风向标
2026年10月4日,马斯克在X平台宣布SpaceXAI拟更名为SpaceXSI,以超级智能(SI)取代人工智能(AI)命名。这是该公司一年内第二次更名,原名xAI于2026年2月被SpaceX收购后改为SpaceXAI。更名动因包括AI能力突破、行业命名权争夺及与白宫政策对齐。特朗普已签署行政令要求联邦政府使用SI术语,马斯克作为xAI负责人签署了白宫超级智能协议。
2026年10月5日