OpenAI / GPT-5.4-ProAPI ID:openai/gpt-5.4-pro文本编程内容创作多模态理解学术与教育数学与科学GPT-5 Pro 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面进行了重大改进。它针对需要分步推理、遵循指令和高风险用例准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑这个问题”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。
OpenAI / GPT 5.1 Codex MiniAPI ID:openai/gpt-5.1-codex-mini文本编程多模态理解智能代理与数据数学与科学(当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。
OpenAI / GPT-5-CodexAPI ID:openai/gpt-5-codex文本编程GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。
FBlackForestLabs / Flux-kontext-proAPI ID:black-forest-labs/flux-kontext-pro图像生成图像与设计最先进的基于文本的图像编辑模型,可提供高质量的输出,具有出色的及时性和一致的结果,可通过自然语言转换图像
ByteDance / Doubao-Seed-2.0-CodeAPI ID:bytedance/doubao-seed-2-0-code文本编程智能代理与数据多模态理解面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。
Kling / KlingV2.5 TurboAPI ID:kling/kling-v2-5-turbo视频生成视频与3DNo model description is currently available.
Ali / 通义万相2.2-数字人-S2VAPI ID:ali/wan2.2-s2v视频生成视频与3Dwan2.2-s2v 是一款视频生成模型,可基于人物图片和人声音频文件,生成高质量的人物说话/唱歌/表演动态视频。
Ali / 通义万相2.2-文生视频-Fast-LoraAPI ID:ali/wan-2.2-t2v-fast-lora视频生成视频与3D内容创作PrunaAI 开发的 Wan 2.2 A14B 文本转视频优化版本,速度极快且价格低廉。
FBlackForestLabs / Flux-kontext-maxAPI ID:black-forest-labs/flux-kontext-max图像生成图像与设计一种基于文本的高级图像编辑模型,可提供最佳性能和改进的排版生成,通过自然语言提示转换图像
FBlackForestLabs / Flux-kontext-devAPI ID:black-forest-labs/flux-kontext-dev图像生成图像与设计FLUX.1 Kontext 的开源版本
Ali / 通义万相2.2-文生图-LoraAPI ID:ali/wan-2.2-t2i-lora图像生成图像与设计该模型可在 3-4 秒内生成精美的电影级 200 万像素图像,它源自 Wan 2.2 模型,并运用了 pruna 包中的优化技术。
Ali / 通义万相2.2-首尾帧-FlashAPI ID:ali/wan2.2-kf2v-flash视频生成视频与3D全新升级的通义万相2.2-首尾帧生视频,生成速度更快。优化视频动态稳定性与成功率,更强大的指令遵循能力,两张图片生成丝滑过度视频。
Ali / 通义万相2.2-数字人-Animate-图生动作API ID:ali/wan2.2-animate-move视频生成视频与3D多模态理解图像与设计wan2.2-animate-move图生动作是一款角色动画生成模型,用户只需上传一张角色照片和一段参考表演视频,即可将视频中的表情和动作迁移到图片角色上,生成高保真的动画视频。
Ali / 通义万相2.2-数字人-Animate-视频换人API ID:ali/wan2.2-animate-mix视频生成视频与3Dwan2.2-animate-mix视频换人是一款角色替换的模型产品,上传一张角色照片与一段表演视频,即可将原视频中的角色精准替换为照片中的角色,完整保留原始视频的场景、光照和色调等环境细节。
Ali / 通义万相2.2-图生视频-FlashAPI ID:ali/wan2.2-i2v-flash视频生成视频与3D全新升级的通义万相2.2图生视频,生成速度更快。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。
Ali / 通义万相2.2-图生视频-PlusAPI ID:ali/wan2.2-i2v-plus视频生成视频与3D全新升级的通义万相2.2图生视频,视频品质更高。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。
Ali / 通义万相2.2-文生视频-PlusAPI ID:ali/wan2.2-t2v-plus视频生成视频与3D全新升级的通义万相2.2文生视频,视频品质更高。可稳定生成大幅度复杂运动,支持影视级画面表现与控制,更强大的指令遵循能力,实现物理世界还原。
Vidu / Vidu2.0API ID:vidu/vidu2.0视频生成视频与3Dvidu/vidu2.0 是清华与生数科技联合研发的文生视频模型,核心搭载全球首创 U-ViT 架构,10 秒内即可生成 4 秒视频,单秒成本仅 4 分钱。支持 16 秒 1080P 输出,能精准控制多主体动态一致性,内置物理引擎还原毫米级运动细节,还深度适配国风等文化元素
FBlackForestLabs / Flux-1.1-proAPI ID:black-forest-labs/flux-1.1-pro图像生成图像与设计更快、更好的 FLUX Pro。文本转图像模型,具有出色的图像质量、快速的一致性和输出多样性。
Bytedance / Doubao-Seedance-1.0-lite-i2vAPI ID:bytedance/doubao-seedance-1.0-lite-i2v视频生成视频与3DDoubao-Seedance-1.0-lite-i2v,根据首帧图片、尾帧图片(可选)、参考图片(可选)和文本描述(可选)生成视频。是兼顾生成效果与速度的性价比之选。该模型语义理解与指令遵循能力强。运镜专业。支持多种视频风格,可以丝滑兼容各种风格的首图。分辨率支持480P、720P、1080P,时长支持3-12s,帧率24fps
MiniMax / MiniMax M2API ID:minimax/minimax-m2文本编程智能代理与数据MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。
Bytedance / Doubao-Seedance-1.0-lite-t2vAPI ID:bytedance/doubao-seedance-1.0-lite-t2v视频生成视频与3D内容创作bytedance/doubao-seedance-1.0-lite-t2v 是字节跳动轻量级文生视频模型,支持文 / 图生视频,含专业运镜、多艺术风格,输出 480P/720P、24fps。适用于电商营销、影视预演、创意内容制作