正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillBot 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 340 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

187/ 340个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Claude Opus 4.7

    调用ID:anthropic/claude-opus-4.7
    文本智能代理与数据编程多模态理解
    +3
    文本智能代理与数据编程多模态理解

    Opus 4.7 是 Anthropic Opus 系列的下一代产品,专为长时间运行的异步代理而设计。它在 Opus 4.6 的编码和代理功能优势基础上,显著提升了复杂多步骤任务的性能,并在扩展工作流中实现了更可靠的代理执行。对于任务随时间展开的异步代理管道(例如大型代码库、多阶段调试和端到端项目编排),Opus 4.7 尤为有效。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥43.75/M token

    缓存写(1h)

    • 公开价格¥70/M token
    2026-04-17 上架
  • GLM-5.1

    调用ID:bigmodel/glm-5.1
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。 在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。

    输入
    ¥6/M
    输出
    ¥24/M
    上下文
    200K
    2026-04-08 上架
  • Deepseek V3.2

    调用ID:deepseek/deepseek-v3.2
    文本数学与科学编程智能代理与数据
    +3
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    输入
    ¥2/M
    输出
    ¥3/M
    上下文
    128K
    2025-12-02 上架
  • Qwen3.6-Plus

    调用ID:ali/qwen3.6-plus
    文本编程多模态理解图像与设计
    +3
    文本编程多模态理解图像与设计

    Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤256k¥2/M token
    • 256k~1000k¥8/M token

    输出

    • ≤256k¥12/M token
    • 256k~1000k¥48/M token

    缓存读

    • ≤256k¥0.2/M token
    • 256k~1000k¥0.8/M token

    缓存写(5m)

    • 公开价格¥10/M token

    缓存写(1h)

    • 公开价格¥10/M token
    2026-04-02 上架
  • DeepSeek V3.2 Thinking

    调用ID:deepseek/deepseek-v3.2-think
    文本数学与科学编程智能代理与数据
    +3
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    输入
    ¥2/M
    输出
    ¥3/M
    上下文
    128K
    2025-12-02 上架
  • GPT-5.4-Nano

    调用ID:openai/gpt-5.4-nano
    文本文档与办公编程智能代理与数据
    +3
    文本文档与办公编程智能代理与数据

    GPT-5.4-nano 是一款轻量化、超高效模型,专为大规模低延迟、低成本任务设计。GPT-5.4-nano 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流以及软件自动化。

    输入
    ¥1.4/M
    输出
    ¥8.75/M
    上下文
    400K
    2026-03-19 上架
  • GPT-5.4-Mini

    调用ID:openai/gpt-5.4-mini
    文本编程文档与办公智能代理与数据多模态理解
    +4
    文本编程文档与办公智能代理与数据多模态理解

    GPT-5.4-mini 是一款紧凑、成本效益高的模型,旨在满足高流量日常 AI 工作负载的可靠性能。GPT-5.4-mini 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流程以及软件自动化。

    输入
    ¥5.25/M
    输出
    ¥31.5/M
    上下文
    400K
    2026-03-19 上架
  • GPT 5.1 Codex Max

    调用ID:openai/gpt-5.1-codex-max
    文本编程数学与科学智能代理与数据
    +3
    文本编程数学与科学智能代理与数据

    (当前仅支持/v1/responses接口)GPT-5.1-Codex-Max 是 OpenAI 最新的代理编码模型,专为长期运行的高上下文软件开发任务设计。它基于更新版的 5.1 推理堆栈,并基于跨软件工程、数学和研究的代理工作流进行训练。 GPT-5.1-Codex-Max 在整个开发生命周期中实现了更快的性能、更优的推理和更高的代币效率。

    输入
    ¥8.75/M
    输出
    ¥70/M
    上下文
    400K
    2025-12-11 上架
  • MiniMax M2.7

    调用ID:minimax/minimax-m2.7
    文本编程文档与办公智能代理与数据对话与客服
    +4
    文本编程文档与办公智能代理与数据对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥2.625/M token
    2026-03-18 上架
  • GLM-5-Turbo

    调用ID:bigmodel/glm-5-turbo
    文本智能代理与数据
    +1
    文本智能代理与数据

    GLM-5-Turbo 是面向 OpenClaw 龙虾场景深度优化的基座模型。 其从训练阶段就针对龙虾任务的核心需求进行专项优化,增强如工具调用、指令遵循、定时与持续性任务、长链路执行等核心能力,使其在复杂、动态、长链路的任务中也真正具备可执行性。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥5/M token
    • 32k~不限¥7/M token

    输出

    • ≤32k¥22/M token
    • 32k~不限¥26/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~不限¥1.8/M token
    2026-03-16 上架
  • Qwen3.5-Flash

    调用ID:ali/qwen3.5-flash
    文本对话与客服内容创作文档与办公学术与教育编程
    +5
    文本对话与客服内容创作文档与办公学术与教育编程

    Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥0.2/M token
    • 128k~256k¥0.8/M token
    • 256k~1000k¥1.2/M token

    输出

    • ≤128k¥2/M token
    • 128k~256k¥8/M token
    • 256k~1000k¥12/M token

    缓存读

    • ≤128k¥0.02/M token
    • 128k~256k¥0.08/M token
    • 256k~1000k¥0.12/M token
    2026-03-15 上架
  • GPT-5.2

    调用ID:openai/gpt-5.2
    文本智能代理与数据编程数学与科学多模态理解文档与办公
    +5
    文本智能代理与数据编程数学与科学多模态理解文档与办公

    GPT-5.2 是 GPT-5 系列中最新的前沿级模型,相比 GPT-5.1 提供了更强的代理和长上下文性能。它利用自适应推理动态分配计算,快速响应简单查询,同时在复杂任务上投入更多深度。 GPT-5.2 专为广泛任务覆盖而设计,在数学、编程、科学和工具调用工作负载中持续带来进步,提供更连贯的长篇答案和提升的工具使用可靠性。

    输入
    ¥12.25/M
    输出
    ¥98/M
    上下文
    400K
    2025-12-12 上架
  • Gemini 3 Flash Preview

    调用ID:google/gemini-3-flash
    文本智能代理与数据编程对话与客服多模态理解数学与科学
    +5
    文本智能代理与数据编程对话与客服多模态理解数学与科学

    Gemini 3 Flash Preview 旨在以极高的速度和性价比提供强大的代理功能(接近专业级)。它非常适合进行多轮对话,并能与您的编码代理进行流畅的双向协作。与 2.5 Flash 版本相比,它在各方面都实现了显著提升。 Gemini 3 型号是具有思考能力的模型,能够在做出反应之前进行推理,从而提高性能和准确性。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥0.581/M token
    2025-12-18 上架
  • GLM-4.7

    调用ID:bigmodel/glm-4.7
    文本智能代理与数据编程对话与客服多模态理解内容创作
    +5
    文本智能代理与数据编程对话与客服多模态理解内容创作

    最新旗舰模型:通用对话、推理与智能体能力上实现全面升级。回复更简洁自然,写作更具沉浸感,且在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-12-23 上架
  • MiniMax M2.1

    调用ID:minimax/minimax-m2.1
    文本编程
    +1
    文本编程

    MiniMax M2.1,强大多语言编程实力,全面升级编程体验

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥2.625/M token
    2025-12-23 上架
  • MiniMax M2.1 lightning

    调用ID:minimax/minimax-m2.1-lightning
    文本编程
    +1
    文本编程

    MiniMax-M2.1-lightning,强大多语言编程实力,全面升级编程体验,更快的速度。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥2.625/M token
    2025-12-23 上架
  • GPT-5.4

    调用ID:openai/gpt-5.4
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    GPT-5.4 是 OpenAI 最新的前沿模型,将 Codex 和 GPT 系列整合为一个系统。它配备了 1M+令牌上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持同一工作流程中的高上下文推理、编码和多模态分析。该模型在编码、文档理解、工具使用和指令执行方面提供了更好的性能。它被设计为通用任务和软件工程的强默认选项,能够生成生产质量的代码,综合多个来源的信息,并以更少的迭代和更高的令牌效率执行复杂的多步工作流程。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token

    输出

    • ≤272k¥105/M token
    • 272k~不限¥157.5/M token

    缓存读

    • ≤272k¥1.75/M token
    • 272k~不限¥3.5/M token
    2026-03-06 上架
  • DeepSeek-V4.1-Flash

    调用ID:deepseek/deepseek-v4.1-flash
    文本

    暂未提供模型说明。

    输入
    ¥1/M
    输出
    ¥4/M
    上下文
    1M
    2026-09-17 上架
  • GPT 5.3 Codex

    调用ID:openai/gpt-5.3-codex
    文本编程智能代理与数据多模态理解数学与科学
    +4
    文本编程智能代理与数据多模态理解数学与科学

    GPT-5.3-Codex 将先进的编码能力、更广泛的推理和专业问题解决整合在一个专为真实工程工作打造的单一模型中。它将 GPT-5.2-Codex 的前沿编码性能与 GPT5.2 的推理和专业知识能力整合到一个系统中。这使得体验从优化孤立输出转向支持更长时间的开发工作;当仓库庞大、变更跨越多个步骤,且需求不总是在一开始就完全明确时。

    输入
    ¥12.25/M
    输出
    ¥98/M
    上下文
    400K
    2026-03-04 上架
  • Gemini 3.1 Flash Lite Preview

    调用ID:google/gemini-3.1-flash-lite-preview
    文本对话与客服内容创作文档与办公编程数学与科学
    +5
    文本对话与客服内容创作文档与办公编程数学与科学

    Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。

    输入
    ¥1.75/M
    输出
    ¥10.5/M
    上下文
    1M
    2026-03-04 上架
  • Qwen3.5-397B-A17B

    调用ID:ali/qwen3.5-397b-a17b
    文本编程多模态理解智能代理与数据数学与科学
    +4
    文本编程多模态理解智能代理与数据数学与科学

    Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥1.2/M token
    • 128k~256k¥3/M token

    输出

    • ≤128k¥7.2/M token
    • 128k~256k¥18/M token
    2026-02-24 上架
  • Qwen3.5-Plus

    调用ID:ali/qwen3.5-plus
    文本多模态理解编程文档与办公内容创作对话与客服
    +5
    文本多模态理解编程文档与办公内容创作对话与客服

    Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥0.8/M token
    • 128k~256k¥2/M token
    • 256k~1000k¥4/M token

    输出

    • ≤128k¥4.8/M token
    • 128k~256k¥12/M token
    • 256k~1000k¥24/M token
    2026-02-24 上架
  • Gemini 3.1 Pro Preview

    调用ID:google/gemini-3.1-pro-preview
    文本编程智能代理与数据多模态理解文档与办公数学与科学
    +5
    文本编程智能代理与数据多模态理解文档与办公数学与科学

    Gemini 3.1 Pro Preview 专为高级开发和智能体系统而设计,在提升令牌效率的同时,增强了长期稳定性、工具编排能力。它引入了一种新的中间思维模式,以更好地平衡成本、速度和性能。该模型在智能体编码、结构化规划、多模态分析和工作流自动化方面表现出色,因此非常适合自主智能体、金融建模、电子表格自动化和高上下文企业任务。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤200k¥14/M token
    • 200k~不限¥28/M token

    输出

    • ≤200k¥84/M token
    • 200k~不限¥126/M token

    缓存读

    • ≤200k¥1.4/M token
    • 200k~不限¥2.8/M token
    2026-02-21 上架
  • Claude Sonnet 4.6

    调用ID:anthropic/claude-sonnet-4.6
    文本编程智能代理与数据文档与办公
    +3
    文本编程智能代理与数据文档与办公

    Sonnet 4.6 是 Anthropic 迄今为止最强大的 Sonnet 级模型,在编码、代理和专业工作领域表现出色。它擅长迭代开发、复杂的代码库导航、带内存的端到端项目管理、精致的文档创建,以及自信的网页质量保证和工作流程自动化的计算机使用。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥26.25/M token

    缓存写(1h)

    • 公开价格¥42/M token
    2026-02-18 上架

24 / 187 个模型已加载

←上一页
  1. 1
  2. 2
  3. 3
  4. 4
  5. …
  6. 8
第 3 页,共 8 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选