模型目录
当前上线的图像、视频、音频模型,一把密钥调用。
已与后端 API 同步
共 23 个模型
ByteDance
使用字节跳动 Seedream 4.0 以 1K、2K 或 4K 生成、编辑图片,最多融合 14 张参考图,单次请求最多输出 15 张。
使用字节跳动 Seedream 4.5 基于最多 14 张参考图编辑,比 4.0 更能保留参考细节,密集文字与排版也更稳定。
使用字节跳动 Seedream 5.0 Pro 以 1K、1.5K 或 2K 生成文字密集的图片,或基于单张参考图进行精细编辑。
Alibaba
使用阿里巴巴通义千问 Qwen Image 2.0 生成或编辑一张图片,最多 3 张参考图,1K 与 2K 同价。
使用 Qwen Image 2.0 Pro 生成或编辑一张图片,文字渲染更强、写实质感更细腻,支持 1K 或 2K。
Google
面向高频创作流程的快速图像生成与对话式编辑模型,适合迅速出图、修改和扩展视觉方案。
Gemini 3 Pro Image:擅长文字密集的版式和多参考图编辑,一个提示词即可输出 1K、2K 或 4K 图像。
高效率图像生成与编辑模型,强化迭代速度、文字准确性,并支持 1K、2K 和 4K 输出。
面向高频交互工作流的超低延迟、低成本图像生成与编辑模型。
OpenAI
在同一个 Wizzx Playground 中使用 OpenAI 图像模型生成新图或编辑参考图。
使用 OpenAI GPT Image 2.5 生成或编辑图片,可选更快的 Flare 或画质优先的 Sunburst 版本,两者同价。
通过文字、图片或参考图生成带原生音频的 720p、1080p 或 4K 视频,支持 4、6 或 8 秒时长。
使用字节跳动 Seedance 1.0 Pro Fast,从文本或单张首帧快速生成 5 或 10 秒、最高 1080p 的无声视频,适合低成本高频迭代。
使用字节跳动 Seedance 1.5 Pro,从文本或首尾帧生成 5–12 秒、480p 或 720p 的视频,同步生成对白、音效与音乐。
Kuaishou
可灵 Kling VIDEO 2.6 从文本或单张图片生成 5 秒或 10 秒视频,可选原生音频,包括对白、旁白和音效。
使用 Wan 2.6 Flash 将一张图片生成 2–15 秒、720p 或 1080p 的无声视频,可选单镜头或多镜头。
使用可灵 Kling VIDEO 3.0 从文本或首尾帧生成 3–15 秒、720p 或 1080p 视频,可选原生音频。
使用可灵 Kling VIDEO 3.0 Omni,将最多 7 张参考图或首尾帧组合成一个 720p 或 1080p 视频。
使用字节跳动 Seedance 2.0 Mini,从文本或首尾帧生成 4–15 秒、480p 或 720p 的有声视频。
PixVerse
使用 PixVerse V6,从文本、单张图片、首尾帧或最多 7 张参考图生成 1–15 秒、360p 至 1080p 视频。
xAI
使用 xAI Grok Imagine Video 1.5,从文本或最多 7 张参考图生成 6–15 秒、480p 或 720p 视频。
使用 Google Gemini Omni Flash,从文本、首帧或参考图生成 4–10 秒、720p / 1080p / 4K 视频,按视频计费。
Suno
使用 Suno V6 根据简短描述或自有歌词生成完整歌曲或纯音乐,每次请求通常返回两首。