Grok Imagine Image
Grok Imagine Image 可根据文本提示生成图像,并能按照自然语言指令编辑上传的图像。选择适合您使用场景的模型:Grok Imagine Image
用于文生图和图像编辑的标准模型,支持 13 种宽高比和 1K 或 2K 输出
Grok Imagine Image 2.0
基于 Aurora 引擎的最新图像模型,支持清晰短文本渲染和最多 3 张参考图像
Grok Imagine Image Quality
更高保真度的模型,细节更丰富,文本渲染更好,创意控制更强
Grok Imagine Video
Grok Imagine Video 可根据文本提示或图像生成短视频,按照自然语言指令编辑上传的视频素材,无缝扩展片段,并支持在参考图像的引导下创建视频。Grok Imagine Video
标准视频模型:生成、编辑、扩展和参考生视频工作流
Grok Imagine Video 1.5
最新视频模型:支持原生音频的图生视频生成,最高可达 1080p