GPT-5.4-ProAPI ID:openai/gpt-5.4-pro文本编程内容创作多模态理解学术与教育数学与科学+5文本编程内容创作多模态理解学术与教育数学与科学GPT-5 Pro 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面进行了重大改进。它针对需要分步推理、遵循指令和高风险用例准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑这个问题”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。PriceAttribute-based pricingAttribute-based pricing输入≤272k¥210/M token272k~不限¥420/M token输出≤272k¥1260.001/M token272k~不限¥1890.002/M token
GPT 5.1 Codex MiniAPI ID:openai/gpt-5.1-codex-mini文本编程多模态理解智能代理与数据数学与科学+4文本编程多模态理解智能代理与数据数学与科学(当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。Input¥1.75/MOutput¥14/MContext400K
GPT-5-CodexAPI ID:openai/gpt-5-codex文本编程+1文本编程GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。Input¥8.75/MOutput¥70/MContext400K
Veo3API ID:google/veo3视频生成视频与3D多模态理解内容创作+3视频生成视频与3D多模态理解内容创作谷歌 Veo 3 视频模型的更快、更便宜的版本,带有音频PriceAttribute-based pricingAttribute-based pricing基础单价(无音频)Public price¥1.4/秒含音频单价Public price¥2.8/秒
FFlux-kontext-proAPI ID:black-forest-labs/flux-kontext-pro图像生成图像与设计+1图像生成图像与设计最先进的基于文本的图像编辑模型,可提供高质量的输出,具有出色的及时性和一致的结果,可通过自然语言转换图像PriceAttribute-based pricingAttribute-based pricing每张图片Public price¥0.28/每张图片
Doubao-Seed-2.0-CodeAPI ID:bytedance/doubao-seed-2-0-code文本编程智能代理与数据多模态理解+3文本编程智能代理与数据多模态理解面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥3.2/M token32k~128k¥4.8/M token128k~256k¥9.6/M token输出≤32k¥16/M token32k~128k¥24/M token128k~256k¥48/M token缓存读≤32k¥0.64/M token32k~128k¥0.96/M token128k~256k¥1.92/M token
KlingV2.5 TurboAPI ID:kling/kling-v2-5-turbo视频生成视频与3D+1视频生成视频与3DNo model description is currently available.PriceAttribute-based pricingAttribute-based pricing图像生成视频720p5秒¥1.50/次720p10秒¥3.00/次1080p5秒¥2.50/次1080p10秒¥5.00/次文本生成视频720p5秒¥1.50/次720p10秒¥3.00/次1080p5秒¥2.50/次1080p10秒¥5.00/次
通义万相2.2-数字人-S2VAPI ID:ali/wan2.2-s2v视频生成视频与3D+1视频生成视频与3Dwan2.2-s2v 是一款视频生成模型,可基于人物图片和人声音频文件,生成高质量的人物说话/唱歌/表演动态视频。PriceAttribute-based pricingAttribute-based pricing视频480P¥0.5/次720P¥0.9/次
Grok 4API ID:x-ai/grok-4文本对话与客服内容创作文档与办公编程学术与教育+5文本对话与客服内容创作文档与办公编程学术与教育Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。PriceAttribute-based pricingAttribute-based pricing输入≤128k¥21/M token128k~不限¥42/M token输出≤128k¥105/M token128k~不限¥210/M token缓存读≤128k¥5.25/M token128k~不限¥5.25/M token
通义万相2.2-文生视频-Fast-LoraAPI ID:ali/wan-2.2-t2v-fast-lora视频生成视频与3D内容创作+2视频生成视频与3D内容创作PrunaAI 开发的 Wan 2.2 A14B 文本转视频优化版本,速度极快且价格低廉。PriceAttribute-based pricingAttribute-based pricing每个视频480P¥0.35/秒720P¥0.7/秒
FFlux-kontext-maxAPI ID:black-forest-labs/flux-kontext-max图像生成图像与设计+1图像生成图像与设计一种基于文本的高级图像编辑模型,可提供最佳性能和改进的排版生成,通过自然语言提示转换图像PriceAttribute-based pricingAttribute-based pricing每张图片Public price¥0.56/每张图片
FFlux-kontext-devAPI ID:black-forest-labs/flux-kontext-dev图像生成图像与设计+1图像生成图像与设计FLUX.1 Kontext 的开源版本PriceAttribute-based pricingAttribute-based pricing每张图片Public price¥0.175/每张图片
通义万相2.2-文生图-LoraAPI ID:ali/wan-2.2-t2i-lora图像生成图像与设计+1图像生成图像与设计该模型可在 3-4 秒内生成精美的电影级 200 万像素图像,它源自 Wan 2.2 模型,并运用了 pruna 包中的优化技术。PriceAttribute-based pricingAttribute-based pricing每张图片Public price¥0.14/每张图片
通义万相2.2-首尾帧-FlashAPI ID:ali/wan2.2-kf2v-flash视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2-首尾帧生视频,生成速度更快。优化视频动态稳定性与成功率,更强大的指令遵循能力,两张图片生成丝滑过度视频。PriceAttribute-based pricingAttribute-based pricing视频480P¥0.1/次720P¥0.2/次1080P¥0.48/次
通义万相2.2-数字人-Animate-图生动作API ID:ali/wan2.2-animate-move视频生成视频与3D多模态理解图像与设计+3视频生成视频与3D多模态理解图像与设计wan2.2-animate-move图生动作是一款角色动画生成模型,用户只需上传一张角色照片和一段参考表演视频,即可将视频中的表情和动作迁移到图片角色上,生成高保真的动画视频。PriceAttribute-based pricingAttribute-based pricing每秒视频480P¥0.4/秒720P¥0.6/秒
通义万相2.2-数字人-Animate-视频换人API ID:ali/wan2.2-animate-mix视频生成视频与3D+1视频生成视频与3Dwan2.2-animate-mix视频换人是一款角色替换的模型产品,上传一张角色照片与一段表演视频,即可将原视频中的角色精准替换为照片中的角色,完整保留原始视频的场景、光照和色调等环境细节。PriceAttribute-based pricingAttribute-based pricing每秒视频480P¥0.6/秒720P¥0.9/秒
通义万相2.2-图生视频-FlashAPI ID:ali/wan2.2-i2v-flash视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2图生视频,生成速度更快。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。PriceAttribute-based pricingAttribute-based pricing视频480P¥0.1/次720P¥0.2/次
通义万相2.2-图生视频-PlusAPI ID:ali/wan2.2-i2v-plus视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2图生视频,视频品质更高。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。PriceAttribute-based pricingAttribute-based pricing视频480P¥0.14/次1080P¥0.7/次
通义万相2.2-文生视频-PlusAPI ID:ali/wan2.2-t2v-plus视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2文生视频,视频品质更高。可稳定生成大幅度复杂运动,支持影视级画面表现与控制,更强大的指令遵循能力,实现物理世界还原。PriceAttribute-based pricingAttribute-based pricing视频480P¥0.14/次1080P¥0.7/次
Vidu2.0API ID:vidu/vidu2.0视频生成视频与3D+1视频生成视频与3Dvidu/vidu2.0 是清华与生数科技联合研发的文生视频模型,核心搭载全球首创 U-ViT 架构,10 秒内即可生成 4 秒视频,单秒成本仅 4 分钱。支持 16 秒 1080P 输出,能精准控制多主体动态一致性,内置物理引擎还原毫米级运动细节,还深度适配国风等文化元素PriceAttribute-based pricingAttribute-based pricing图像生成视频720p4秒¥1.25/次720p8秒¥3.13/次1080p4秒¥3.13/次reference2video720p4秒¥2.50/次首尾帧生成视频720p4秒¥1.25/次720p8秒¥3.13/次1080p4秒¥3.13/次
FFlux-1.1-proAPI ID:black-forest-labs/flux-1.1-pro图像生成图像与设计+1图像生成图像与设计更快、更好的 FLUX Pro。文本转图像模型,具有出色的图像质量、快速的一致性和输出多样性。PriceAttribute-based pricingAttribute-based pricing每张图片Public price¥0.28/每张图片
Doubao-Seedance-1.0-lite-i2vAPI ID:bytedance/doubao-seedance-1.0-lite-i2v视频生成视频与3D+1视频生成视频与3DDoubao-Seedance-1.0-lite-i2v,根据首帧图片、尾帧图片(可选)、参考图片(可选)和文本描述(可选)生成视频。是兼顾生成效果与速度的性价比之选。该模型语义理解与指令遵循能力强。运镜专业。支持多种视频风格,可以丝滑兼容各种风格的首图。分辨率支持480P、720P、1080P,时长支持3-12s,帧率24fpsPriceAttribute-based pricingAttribute-based pricing输出Public price¥10/M token
MiniMax M2API ID:minimax/minimax-m2文本编程智能代理与数据+2文本编程智能代理与数据MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥2.625/M token
Doubao-Seedance-1.0-lite-t2vAPI ID:bytedance/doubao-seedance-1.0-lite-t2v视频生成视频与3D内容创作+2视频生成视频与3D内容创作bytedance/doubao-seedance-1.0-lite-t2v 是字节跳动轻量级文生视频模型,支持文 / 图生视频,含专业运镜、多艺术风格,输出 480P/720P、24fps。适用于电商营销、影视预演、创意内容制作PriceAttribute-based pricingAttribute-based pricing输出Public price¥10/M token