Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillBot MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 340 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

187/ 340models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Claude Opus 4.7

    API ID:anthropic/claude-opus-4.7
    文本智能代理与数据编程多模态理解
    +3
    文本智能代理与数据编程多模态理解

    Opus 4.7 是 Anthropic Opus 系列的下一代产品,专为长时间运行的异步代理而设计。它在 Opus 4.6 的编码和代理功能优势基础上,显著提升了复杂多步骤任务的性能,并在扩展工作流中实现了更可靠的代理执行。对于任务随时间展开的异步代理管道(例如大型代码库、多阶段调试和端到端项目编排),Opus 4.7 尤为有效。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-04-17 Listed
  • GLM-5.1

    API ID:bigmodel/glm-5.1
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。 在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。

    Input
    ¥6/M
    Output
    ¥24/M
    Context
    200K
    2026-04-08 Listed
  • Deepseek V3.2

    API ID:deepseek/deepseek-v3.2
    文本数学与科学编程智能代理与数据
    +3
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    Input
    ¥2/M
    Output
    ¥3/M
    Context
    128K
    2025-12-02 Listed
  • Qwen3.6-Plus

    API ID:ali/qwen3.6-plus
    文本编程多模态理解图像与设计
    +3
    文本编程多模态理解图像与设计

    Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤256k¥2/M token
    • 256k~1000k¥8/M token

    输出

    • ≤256k¥12/M token
    • 256k~1000k¥48/M token

    缓存读

    • ≤256k¥0.2/M token
    • 256k~1000k¥0.8/M token

    缓存写(5m)

    • Public price¥10/M token

    缓存写(1h)

    • Public price¥10/M token
    2026-04-02 Listed
  • DeepSeek V3.2 Thinking

    API ID:deepseek/deepseek-v3.2-think
    文本数学与科学编程智能代理与数据
    +3
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    Input
    ¥2/M
    Output
    ¥3/M
    Context
    128K
    2025-12-02 Listed
  • GPT-5.4-Nano

    API ID:openai/gpt-5.4-nano
    文本文档与办公编程智能代理与数据
    +3
    文本文档与办公编程智能代理与数据

    GPT-5.4-nano 是一款轻量化、超高效模型,专为大规模低延迟、低成本任务设计。GPT-5.4-nano 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流以及软件自动化。

    Input
    ¥1.4/M
    Output
    ¥8.75/M
    Context
    400K
    2026-03-19 Listed
  • GPT-5.4-Mini

    API ID:openai/gpt-5.4-mini
    文本编程文档与办公智能代理与数据多模态理解
    +4
    文本编程文档与办公智能代理与数据多模态理解

    GPT-5.4-mini 是一款紧凑、成本效益高的模型,旨在满足高流量日常 AI 工作负载的可靠性能。GPT-5.4-mini 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流程以及软件自动化。

    Input
    ¥5.25/M
    Output
    ¥31.5/M
    Context
    400K
    2026-03-19 Listed
  • GPT 5.1 Codex Max

    API ID:openai/gpt-5.1-codex-max
    文本编程数学与科学智能代理与数据
    +3
    文本编程数学与科学智能代理与数据

    (当前仅支持/v1/responses接口)GPT-5.1-Codex-Max 是 OpenAI 最新的代理编码模型,专为长期运行的高上下文软件开发任务设计。它基于更新版的 5.1 推理堆栈,并基于跨软件工程、数学和研究的代理工作流进行训练。 GPT-5.1-Codex-Max 在整个开发生命周期中实现了更快的性能、更优的推理和更高的代币效率。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-12-11 Listed
  • MiniMax M2.7

    API ID:minimax/minimax-m2.7
    文本编程文档与办公智能代理与数据对话与客服
    +4
    文本编程文档与办公智能代理与数据对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2026-03-18 Listed
  • GLM-5-Turbo

    API ID:bigmodel/glm-5-turbo
    文本智能代理与数据
    +1
    文本智能代理与数据

    GLM-5-Turbo 是面向 OpenClaw 龙虾场景深度优化的基座模型。 其从训练阶段就针对龙虾任务的核心需求进行专项优化,增强如工具调用、指令遵循、定时与持续性任务、长链路执行等核心能力,使其在复杂、动态、长链路的任务中也真正具备可执行性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥5/M token
    • 32k~不限¥7/M token

    输出

    • ≤32k¥22/M token
    • 32k~不限¥26/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~不限¥1.8/M token
    2026-03-16 Listed
  • Qwen3.5-Flash

    API ID:ali/qwen3.5-flash
    文本对话与客服内容创作文档与办公学术与教育编程
    +5
    文本对话与客服内容创作文档与办公学术与教育编程

    Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.2/M token
    • 128k~256k¥0.8/M token
    • 256k~1000k¥1.2/M token

    输出

    • ≤128k¥2/M token
    • 128k~256k¥8/M token
    • 256k~1000k¥12/M token

    缓存读

    • ≤128k¥0.02/M token
    • 128k~256k¥0.08/M token
    • 256k~1000k¥0.12/M token
    2026-03-15 Listed
  • GPT-5.2

    API ID:openai/gpt-5.2
    文本智能代理与数据编程数学与科学多模态理解文档与办公
    +5
    文本智能代理与数据编程数学与科学多模态理解文档与办公

    GPT-5.2 是 GPT-5 系列中最新的前沿级模型,相比 GPT-5.1 提供了更强的代理和长上下文性能。它利用自适应推理动态分配计算,快速响应简单查询,同时在复杂任务上投入更多深度。 GPT-5.2 专为广泛任务覆盖而设计,在数学、编程、科学和工具调用工作负载中持续带来进步,提供更连贯的长篇答案和提升的工具使用可靠性。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2025-12-12 Listed
  • Gemini 3 Flash Preview

    API ID:google/gemini-3-flash
    文本智能代理与数据编程对话与客服多模态理解数学与科学
    +5
    文本智能代理与数据编程对话与客服多模态理解数学与科学

    Gemini 3 Flash Preview 旨在以极高的速度和性价比提供强大的代理功能(接近专业级)。它非常适合进行多轮对话,并能与您的编码代理进行流畅的双向协作。与 2.5 Flash 版本相比,它在各方面都实现了显著提升。 Gemini 3 型号是具有思考能力的模型,能够在做出反应之前进行推理,从而提高性能和准确性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥0.581/M token
    2025-12-18 Listed
  • GLM-4.7

    API ID:bigmodel/glm-4.7
    文本智能代理与数据编程对话与客服多模态理解内容创作
    +5
    文本智能代理与数据编程对话与客服多模态理解内容创作

    最新旗舰模型:通用对话、推理与智能体能力上实现全面升级。回复更简洁自然,写作更具沉浸感,且在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-12-23 Listed
  • MiniMax M2.1

    API ID:minimax/minimax-m2.1
    文本编程
    +1
    文本编程

    MiniMax M2.1,强大多语言编程实力,全面升级编程体验

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2025-12-23 Listed
  • MiniMax M2.1 lightning

    API ID:minimax/minimax-m2.1-lightning
    文本编程
    +1
    文本编程

    MiniMax-M2.1-lightning,强大多语言编程实力,全面升级编程体验,更快的速度。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2025-12-23 Listed
  • GPT-5.4

    API ID:openai/gpt-5.4
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    GPT-5.4 是 OpenAI 最新的前沿模型,将 Codex 和 GPT 系列整合为一个系统。它配备了 1M+令牌上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持同一工作流程中的高上下文推理、编码和多模态分析。该模型在编码、文档理解、工具使用和指令执行方面提供了更好的性能。它被设计为通用任务和软件工程的强默认选项,能够生成生产质量的代码,综合多个来源的信息,并以更少的迭代和更高的令牌效率执行复杂的多步工作流程。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token

    输出

    • ≤272k¥105/M token
    • 272k~不限¥157.5/M token

    缓存读

    • ≤272k¥1.75/M token
    • 272k~不限¥3.5/M token
    2026-03-06 Listed
  • DeepSeek-V4.1-Flash

    API ID:deepseek/deepseek-v4.1-flash
    文本

    No model description is currently available.

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    1M
    2026-09-17 Listed
  • GPT 5.3 Codex

    API ID:openai/gpt-5.3-codex
    文本编程智能代理与数据多模态理解数学与科学
    +4
    文本编程智能代理与数据多模态理解数学与科学

    GPT-5.3-Codex 将先进的编码能力、更广泛的推理和专业问题解决整合在一个专为真实工程工作打造的单一模型中。它将 GPT-5.2-Codex 的前沿编码性能与 GPT5.2 的推理和专业知识能力整合到一个系统中。这使得体验从优化孤立输出转向支持更长时间的开发工作;当仓库庞大、变更跨越多个步骤,且需求不总是在一开始就完全明确时。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2026-03-04 Listed
  • Gemini 3.1 Flash Lite Preview

    API ID:google/gemini-3.1-flash-lite-preview
    文本对话与客服内容创作文档与办公编程数学与科学
    +5
    文本对话与客服内容创作文档与办公编程数学与科学

    Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。

    Input
    ¥1.75/M
    Output
    ¥10.5/M
    Context
    1M
    2026-03-04 Listed
  • Qwen3.5-397B-A17B

    API ID:ali/qwen3.5-397b-a17b
    文本编程多模态理解智能代理与数据数学与科学
    +4
    文本编程多模态理解智能代理与数据数学与科学

    Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥1.2/M token
    • 128k~256k¥3/M token

    输出

    • ≤128k¥7.2/M token
    • 128k~256k¥18/M token
    2026-02-24 Listed
  • Qwen3.5-Plus

    API ID:ali/qwen3.5-plus
    文本多模态理解编程文档与办公内容创作对话与客服
    +5
    文本多模态理解编程文档与办公内容创作对话与客服

    Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.8/M token
    • 128k~256k¥2/M token
    • 256k~1000k¥4/M token

    输出

    • ≤128k¥4.8/M token
    • 128k~256k¥12/M token
    • 256k~1000k¥24/M token
    2026-02-24 Listed
  • Gemini 3.1 Pro Preview

    API ID:google/gemini-3.1-pro-preview
    文本编程智能代理与数据多模态理解文档与办公数学与科学
    +5
    文本编程智能代理与数据多模态理解文档与办公数学与科学

    Gemini 3.1 Pro Preview 专为高级开发和智能体系统而设计,在提升令牌效率的同时,增强了长期稳定性、工具编排能力。它引入了一种新的中间思维模式,以更好地平衡成本、速度和性能。该模型在智能体编码、结构化规划、多模态分析和工作流自动化方面表现出色,因此非常适合自主智能体、金融建模、电子表格自动化和高上下文企业任务。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤200k¥14/M token
    • 200k~不限¥28/M token

    输出

    • ≤200k¥84/M token
    • 200k~不限¥126/M token

    缓存读

    • ≤200k¥1.4/M token
    • 200k~不限¥2.8/M token
    2026-02-21 Listed
  • Claude Sonnet 4.6

    API ID:anthropic/claude-sonnet-4.6
    文本编程智能代理与数据文档与办公
    +3
    文本编程智能代理与数据文档与办公

    Sonnet 4.6 是 Anthropic 迄今为止最强大的 Sonnet 级模型,在编码、代理和专业工作领域表现出色。它擅长迭代开发、复杂的代码库导航、带内存的端到端项目管理、精致的文档创建,以及自信的网页质量保证和工作流程自动化的计算机使用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2026-02-18 Listed

24 / 187 models loaded

←Previous
  1. 1
  2. 2
  3. 3
  4. 4
  5. …
  6. 8
Page 3 of 8Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters