【xAI发布Grok Imagine Video 1.5:支持音画同频生成,速度翻倍】金色财经报道,xAI 正式发布图像与文本生成视频模型 Grok Imagine Video 1.5,并在 API(grok-imagine-video-1.5)、网页端(grok.com/imagine)及移动客户端全量上线。
模型实现音视频一体化同步生成,在单次推理阶段同步产生音效、环境音与角色对话,提高语音清晰度并优化唇形同步。同时,模型改进了物理引擎与运动一致性,提升镜头长周期内物体运动与物理重量的可信度,减少画面扭曲等伪影。在生成速度上,轻量版 Video 1.5 Fast 生成 6 秒 720p 视频的耗时缩短至约 25 秒。
网页端配套工作流同步更新:新增项目管理(Projects)以分类整理素材,支持多智能体并行(Multiple Agents)运行多个提示词,并提供媒体库语义搜索(Search)。数字艺术家 David Thompson 团队使用 Grok Imagine 1.5 制作了完全由 AI 生成的电影预告片《Odyssey》。
原文链接:https://x.com/xai/status/2067092897951109427
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

