All models

grok-imagine-video-1.5:official

xAIVideo
3.024–9.45 Credits
Get your API key
grok-imagine-video-1.5:official

让静态画面成为可控创作起点的短视频模型

Grok Imagine Video 1.5 是 xAI 的视频生成模型,grok-imagine-video-1.5:official 专注以图片为起点的短片创作。上传产品照、人物画面或分镜图,再用文字描述动作与镜头,即可生成 1–15 秒视频,最高支持 1080p,适合已有视觉素材的动态演绎与创意验证。

xAI模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
图生视频,必须提供 image_url
动作引导
可选 prompt,描述动作、镜头与场景变化
视频时长
1–15 秒,默认 6 秒
输出分辨率
480p、720p、1080p;默认 480p
任务交付
支持异步提交、回调与任务查询
调用与结果
POST /grok/videos;完成后返回 video_url

以上为本平台此调用入口的输入输出规格,不将系列原生能力等同于该入口的可用功能。

核心能力

了解 grok-imagine-video-1.5:official 能为你的工作带来什么。

从已有画面开始设计运动

以图片确定创作起点,再用提示词补充主体动作、镜头移动和环境变化。相比从文字重新构思画面,这种方式更适合已有产品照、人物设定或分镜素材的项目,让创作重点落在静态画面如何变成动态镜头。

分阶段验证短片效果

提供不同分辨率和短片时长选择,便于先验证动作方向,再制作交付候选。可以先用默认 480p、6 秒检查镜头是否符合设想,调整图片或动作描述后再选择更高分辨率,而不是一开始就投入完整成片制作。

把生成纳入任务工作流

生成任务可采用异步方式处理,不必一直保持请求连接。提交后保存 task_id,通过任务查询或回调接收结果,再根据状态获取视频链接。这种方式适合素材管理、批量创意测试与需要记录每次生成结果的应用。

适用场景

从具体任务出发,找到模型发挥作用的位置。

产品照片的动态展示

输入已经拍摄好的产品图片,描述缓慢推进、背景变化或展示动作,生成用于评审的短片候选。先检查产品轮廓、标识与镜头运动,再决定是否用于广告剪辑,适合把静态视觉资产扩展为动态创意。

分镜画面的运动预演

将单张分镜或概念图作为输入,补充人物转身、镜头靠近、环境运动等说明,获得可播放的镜头草案。交付重点是讨论动作与节奏,而不是替代最终拍摄;团队可据此判断镜头设计是否值得继续制作。

社交内容的视觉变体

围绕同一张主视觉,分别尝试不同动作与镜头描述,制作多个短视频候选。输入图片应提前考虑目标画幅和主体位置,生成后挑选适合传播的片段,再完成字幕、配乐和剪辑,形成可发布的内容素材。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

有图片素材时优先考虑

如果项目已经有明确的视觉画面,希望围绕它制作最高 1080p 的短片,可以选择 1.5:official。如果只有文字构想、需要直接文生视频,可考虑 grok-imagine-video:official;它支持文生与图生视频,同样覆盖 1–15 秒任务。

按输入方式与时长取舍

需要 15 秒以内的图生短片,可使用本型号;需要更长片段或同时开展文生视频,可考虑 grok-imagine-video-1.5-fast:reverse,其时长范围为 6–30 秒。两者应按素材条件、目标长度和实际画面效果选择,不把版本名称当作所有任务的质量排序。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 本型号必须提供 image_url,不能只发送文字就开始生成。reference_image_urls 不能替代基础输入图片;只有文字创意时,应选择支持文生视频的型号,或先准备适合作为创作起点的画面。
  • 单次生成应控制在 1–15 秒内,不能将其他型号的 30 秒能力直接套用。较长叙事适合拆成独立镜头,分别生成并剪辑;跨镜头的人物、构图与动作衔接仍需要人工检查。
  • 画幅设计应从输入图片开始,提前处理裁切、主体位置和背景空间。输出分辨率提高不等于产品细节或人物动作必然准确;涉及文字、标识与关键展示动作时,应逐段检查后再用于交付。

常见问题

解答使用 grok-imagine-video-1.5:official 时的常见疑问。

1.5:official 可以只用文字生成视频吗?

不可以,此型号采用图生视频方式,必须提交 image_url。文字提示词用于补充图片中的动作、镜头或场景变化。如果尚无图片素材,可改用支持文生视频的 grok-imagine-video:official 或 fast:reverse。

图片之外还需要写提示词吗?

图生视频可以不写提示词,但有明确运动目标时建议补充。描述应集中在主体怎样运动、镜头怎样变化以及场景发生什么,避免同时要求过多互相冲突的动作,让短片目标更容易判断。

可以生成多长、什么分辨率的视频?

此型号支持 1–15 秒,默认 6 秒;分辨率可选 480p、720p 或 1080p,默认 480p。适合先制作短时长草案检查动作,再为满意的创意生成更高分辨率候选,最终仍需检查具体画面。

怎样获取异步生成的视频?

设置 async 为 true 后保存返回的 task_id,再通过 /grok/tasks 查询结果;也可以提供 callback_url 接收完成通知。只有状态达到 succeeded 并取得 video_url 后,才应将该结果视为可下载的视频资产。

怎样确保调用的是这个型号?

向 /grok/videos 提交请求时,明确填写 model 为 grok-imagine-video-1.5:official,并同时提供 image_url。不要省略型号或改用带 preview 的名称;保留 task_id 与 trace_id,方便关联素材、任务状态和生成结果。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 grok-imagine-video-1.5:official 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。