一个 Key,调用全部生成接口
选择模型,复制示例请求,并通过统一鉴权完成第一次调用。每个模型页都列出可用参数、计费规则和响应方式。
- Omni
Omni 固定 10 秒视频生成与视频编辑模型。
- VEO Omni Flash
固定 10 秒的快速 Omni 视频生成与视频编辑模型。
- VEO Omni Flash 经济版
固定 10 秒的低价 Omni 视频模型,支持最多 6 张公共 URL 参考图,不支持参考视频。
- VEO Omni Flash 视频编辑
固定 10 秒的低成本视频编辑模型,支持一个参考视频和多张人物或商品参考图;适合非口播批量任务,口型同步优先选择 MiniMax-H3。
- Veo 3.1 Fast
Veo 3.1 Fast 视频生成 / 图生视频,固定 8 秒输出,支持 720p/1080p。
- MiniMax H3
MiniMax H3 视频生成模型,支持 768P/2K、4-15 秒和 9:16 竖屏。
- MiniMax H3 经济版
固定 768P 的经济型 MiniMax H3 视频生成,支持 4-15 秒与横竖屏;适合对成本敏感、可接受较长队列的任务。
- Doubao Seedance 2.0 Mini
Seedance 2.0 Mini 多模态视频生成,支持 480p/720p、4-15 秒和最多 9 张参考图。
- Grok Imagine Video
720p 6/10/15 秒创意视频生成模型,适合实验性镜头与社媒内容。
- Grok Imagine 1.0 Video Super 720p
720p Grok 备用视频生成模型,适合高负载时补位和稳定交付。
- Grok Imagine 1.5 Video Super 720p
720p 15 秒 Grok 备用视频生成模型,仅支持单张参考图,适合社媒短视频和电商产品动态展示。
- Kling Video 3.0
可灵 3.0 文生视频模型,支持 3-15 秒视频,适合广告短片和产品演示。
- Kling Video 3.0 Edit
可灵 3.0 视频编辑模型,需要参考视频,适合基于现有素材改写风格和场景。
- Doubao Seedream 5.0
高分辨率图片生成与编辑模型,支持文生图、多参考图和八种固定画幅。
- GPT Image 2.5
新版低成本 1K 图片生成与图生图模型,适合真实人像、商品图、广告素材和社媒图片批量创作。
- GPT Image 2
普通质量图片生成与图生图模型,支持比例和 1K 像素尺寸,适合高频草稿和批量出图。
- GPT Image 2 1K Async
1K 图片异步生成与多参考图任务,适合高峰期稳定交付。
- GPT Image 2 Low
GPT Image 2 低质量图片生成 / 图生图,支持 1K、2K、4K 输出规格。
- Nano Banana 2
轻量图片生成与参考图生成模型,适合快速稳定出图。
- Nano Banana Pro
高质量图片生成模型,适合产品视觉、海报和精细营销素材。
- GPT-5.5
高规格文本对话模型,兼容 OpenAI Chat Completions。适合复杂问答、长文本理解和推理任务。
- Gemini 3.5 Flash
轻量高速文本对话模型,兼容 OpenAI Chat Completions。适合低延迟问答和批量文本任务。
- Gemini 3.1 Pro
Gemini 3.1 Pro 推理文本模型,兼容 OpenAI Chat Completions。适合复杂推理、识图、文档理解和多模态输入任务。
- MiMo V2.5
小米 MiMo 高速文本对话模型,适合中文问答、摘要和批量轻量任务。
- MiMo V2.5 Pro
小米 MiMo Pro 旗舰推理模型,适合复杂问答、代码、Agent 和需要更强推理的文本任务。
- xplaai V2.5 语音识别
面向真实录音场景的语音转写接口,覆盖普通话、英语、常见方言、中英混说、歌词与带噪音频。
- xplaai V2.5 标准配音
xplaai 标准配音提供 9 种内置音色,通过统一语音接口直接返回 MP3、WAV 或 PCM 音频。
- xplaai V2.5 音色克隆
xplaai 音色克隆支持上传已获授权的 MP3 或 WAV 样本,并直接返回对应音色的合成音频。
- xplaai V2.5 音色设计
xplaai 音色设计支持用自然语言描述年龄感、情绪、语速和表达方式,并生成对应风格的音频。
- TikTok Shop Data
TikTok Shop 商品搜索与单商品详情接口,服务端安全代理、按成功实时请求计费。
- Public Video Parse
解析受支持平台的公开视频分享链接,返回视频直链和基础元数据;仅限调用方有权处理的内容。