正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillBot 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 340 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

187/ 340个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Doubao-Seed-Evolving

    调用ID:bytedance/doubao-seed-evolving
    文本

    Doubao-Seed-Evolving 面向 Coding 与 Agent 场景,持续周级升级,以统一模型 ID 提供最新能力,助力复杂任务高效落地。

    输入
    ¥6/M
    输出
    ¥30/M
    上下文
    256K
    2026-06-23 上架
  • Doubao-Seed-2.1-turbo

    调用ID:bytedance/doubao-seed-2-1-turbo
    文本

    效果与成本均衡,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。

    输入
    ¥3/M
    输出
    ¥15/M
    上下文
    256K
    2026-06-23 上架
  • Doubao-Seed-2.1-pro

    调用ID:bytedance/doubao-seed-2-1-pro
    文本

    Doubao-Seed-2.1 是面向 Coding 和 Agent 时代打造的新一代大模型,提供 Pro 和 Turbo 两个版本,分别面向高复杂度任务探索和规模化生产场景。相较上一代版本,Seed 2.1 在 Coding 工程交付、Agent 长链路任务执行和多模态理解三大方向上实现全面升级,以更强的自主规划与动态修复能力,胜任真实研发与高价值生产任务。

    输入
    ¥6/M
    输出
    ¥30/M
    上下文
    256K
    2026-06-23 上架
  • GLM-5.2

    调用ID:bigmodel/glm-5.2
    文本

    GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。一次任务即可完成“从需求到多端可部署产物”的完整开发链路。

    输入
    ¥8/M
    输出
    ¥28/M
    上下文
    1M
    2026-06-17 上架
  • Kimi K2.7 Code

    调用ID:moonshot/kimi-k2.7-code
    文本

    Kimi K2.7 Code 是 Kimi 迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务。同时支持文本、图片与视频输入,仅支持思考模式,对话与 Agent 任务。模型上下文长度 256k,支持长思考擅长深度推理,支持自动上下文缓存功能,ToolCalls、JSON Mode、Partial Mode 等能力

    输入
    ¥6.5/M
    输出
    ¥27/M
    上下文
    256K
    2026-06-15 上架
  • Claude Fable 5

    调用ID:anthropic/claude-fable-5
    文本

    Claude Fable 5 是 Anthropic 下一代智能,专注于最难的知识工作和编程问题。它比以往任何普遍可用的 Claude 模型都能独立运行时间更长:通过代理框架运行,它可以连续工作数天,跨阶段规划,委派给子代理,并检查自身工作。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token
    2026-06-10 上架
  • Qwen3.7-Plus(限时8折)

    调用ID:ali/qwen3.7-plus
    文本

    Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤256k¥1.6/M token
    • 256k~不限¥4.8/M token

    输出

    • ≤256k¥6.4/M token
    • 256k~不限¥19.2/M token

    缓存读

    • ≤256k¥0.32/M token
    • 256k~不限¥0.96/M token

    缓存写(5m)

    • 公开价格¥7.5/M token

    缓存写(1h)

    • 公开价格¥7.5/M token
    2026-06-03 上架
  • MiniMax M3(5折)

    调用ID:minimax/minimax-m3
    文本

    MiniMax M3永久五折,MiniMax M3 在编程和智能体等专业任务上达到了前沿的能力。它使用了我们提出的全新注意力架构 MSA (MiniMax Sparse Attention ),最高支持 1M 超长上下文。

    输入
    ¥2.1/M
    输出
    ¥8.4/M
    上下文
    1M
    2026-06-01 上架
  • Claude Opus 4.8

    调用ID:anthropic/claude-opus-4.8
    文本

    Claude Opus 4.8 是 Anthropic 在 Opus 家族中最强大的通用型号。它支持文本、图片和文件输入,并输出文本,支持推理和 1M 令牌上下文窗口。它适合高度自主的代理、长视野代理工作、知识驱动工作以及在长时间会话中保持一致性的记忆驱动任务。 它在多步推理、复杂编码和端到端项目编排方面尤为强大——大型代码库、多阶段调试和长期运行的异步代理流水线。除了编码,它还处理知识工作,如起草文档、构建演示文稿和分析数据,保持长时间输出的质量。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥43.75/M token

    缓存写(1h)

    • 公开价格¥70/M token
    2026-05-29 上架
  • Gemini 3.5 Flash

    调用ID:google/gemini-3.5-flash
    文本

    Gemini 3.5 Flash 以 Flash 级别的成本和速度提供接近专业级的智能:专业级的编码能力、并行代理执行,所有这些都以更低的价格实现。

    输入
    ¥10.5/M
    输出
    ¥63/M
    上下文
    1M
    2026-05-25 上架
  • Qwen3.7-Max(限时5折)

    调用ID:ali/qwen3.7-max
    文本

    Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥7.5/M token

    缓存写(1h)

    • 公开价格¥7.5/M token
    2026-05-25 上架
  • Gemini 3.1 Flash Lite

    调用ID:google/gemini-3.1-flash-lite
    文本

    Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。

    输入
    ¥1.75/M
    输出
    ¥10.5/M
    上下文
    1M
    2026-05-18 上架
  • MiMo-V2.5

    调用ID:xiaomi/mimo-v2.5
    文本多模态理解智能代理与数据文档与办公
    +3
    文本多模态理解智能代理与数据文档与办公

    MiMo-V2.5 是小米原生的全模态模型。它以约一半的推理成本实现专业级代理性能,同时在图像和视频理解任务中的多模态感知上超越 MiMo-V2-Omni。其 100 万上下文窗口支持完整文档、扩展对话和复杂任务上下文,非常适合与代理框架集成,在需要强大推理、丰富感知和成本效益的环境中。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤256k¥2.8/M token
    • 256k~1000k¥5.6/M token

    输出

    • ≤256k¥14/M token
    • 256k~1000k¥28/M token

    缓存读

    • ≤256k¥0.56/M token
    • 256k~1000k¥1.12/M token
    2026-04-27 上架
  • MiMo-V2.5-Pro

    调用ID:xiaomi/mimo-v2.5-pro
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤256k¥7/M token
    • 256k~1000k¥14/M token

    输出

    • ≤256k¥21/M token
    • 256k~1000k¥42/M token

    缓存读

    • ≤256k¥1.4/M token
    • 256k~1000k¥2.8/M token
    2026-04-27 上架
  • Claude Opus 4.5

    调用ID:anthropic/claude-opus-4.5
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    Anthropic 最智能模型的下一代产品 ——Claude Opus 4.5,在编码、代理、计算机使用以及企业工作流方面处于行业领先地位。应用场景如下: 编码:Opus 4.5 能够自信地在几小时内完成原本需要数天的软件开发项目,它可以独立工作,凭借深厚的技术功底和出色的品味,打造高效且简洁的解决方案。它在各种编程语言上的性能都有所提升,在规划和架构选择方面表现更优,是企业开发者的理想模型。 代理:Claude Opus 4.5 结合我们先进的工具使用能力,能打造出功能更强大、具备新行为模式的代理。 计算机使用:作为我们目前最出色的计算机使用模型,Claude Opus 4.5 能以自信、一致的方式应对新场景,实现更接近人类的浏览体验,从而优化网络问答、工作流自动化以及高级用户体验。 企业工作流:Opus 4.5 可以为代理提供支持,助力其从头到尾管理庞大的专业项目。它能更好地利用内存来保持文件间的上下文连贯性和一致性,同时在创建电子表格、幻灯片和文档方面实现了显著的飞跃式改进。 财务分析:Opus 4.5 能够整合复杂信息系统中的各类数据,包括监管文件、市场报告和内部数据,从而实现复杂的预测建模和主动合规。 cybersecurity(网络安全):Opus 4.5 为安全工作流带来专业级别的分析能力,它能关联日志、漏洞数据库和威胁情报,实现主动威胁检测和自动化事件响应。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥43.75/M token

    缓存写(1h)

    • 公开价格¥70/M token
    2025-11-25 上架
  • KAT-Coder-Pro-V1

    调用ID:streamlake/kat-coder-pro-v1
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥4/M token
    • 32k~128k¥6/M token
    • 128k~不限¥10/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~不限¥40/M token

    缓存读

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2/M token
    2025-11-13 上架
  • GPT-5.5

    调用ID:openai/gpt-5.5
    文本编程多模态理解数学与科学文档与办公智能代理与数据
    +5
    文本编程多模态理解数学与科学文档与办公智能代理与数据

    GPT-5.5 是 OpenAI 为复杂专业工作负载设计的前沿模型,基于 GPT-5.4,具备更强的推理能力、更高的可靠性,处理困难任务。它配备了 1M上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持在单一系统内实现大规模推理、编码和多模态工作流。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token
    2026-04-27 上架
  • GLM-5.3-flash

    调用ID:bigmodel/glm-5.3-flash
    文本

    GLM-5.3

    输入
    ¥0.8/M
    输出
    ¥2.8/M
    上下文
    1M
    2026-09-15 上架
  • DeepSeek-V4-Flash

    调用ID:deepseek/deepseek-v4-flash
    文本数学与科学智能代理与数据文档与办公编程对话与客服
    +5
    文本数学与科学智能代理与数据文档与办公编程对话与客服

    DeepSeek-V4-Flash是深度求索公司于2026年4月24日发布的高效经济版大语言模型。它采用混合专家(MoE)架构,总参数量约2840亿,每次推理仅激活约130亿参数,并原生支持高达100万Token的超长上下文。该版本在推理能力和简单Agent任务上接近性能强大的Pro版本,但凭借更小的参数和激活规模,能提供更快捷、低成本的API服务。适合需要快速响应和追求极致性价比的各类轻量级应用场景。

    输入
    ¥1/M
    输出
    ¥2/M
    上下文
    1M
    2026-04-24 上架
  • Hunyuan-3-preview

    调用ID:tencent/hy3-preview
    文本

    混元 Hy3 preview 面向 Agent 工作负载设计,采用 295B/21B 激活的 MoE 架构。在同一个模型内提供 no_think(极速响应)、think_low(快速思考)、think_high(深度推理)三档模式,适配从高频交互到复杂工程任务的不同延迟与深度需求。在 SWE-bench Verified 等代码基准上接近当前最强水平,256K 上下文支持跨文件代码重构与长文档分析。适合需要可靠任务完成度、同时对推理成本敏感的开发者。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤16k¥1.2/M token
    • 16k~32k¥1.6/M token
    • 32k~不限¥2/M token

    输出

    • ≤16k¥4/M token
    • 16k~32k¥6.4/M token
    • 32k~不限¥8/M token

    缓存读

    • ≤16k¥0.4/M token
    • 16k~32k¥0.6/M token
    • 32k~不限¥0.8/M token
    2026-04-23 上架
  • Step 3.5 Flash-2603

    调用ID:stepfun/step-3.5-flash-2603
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    基于 Step 3.5 Flash 针对高频 Agent 场景优化,在保留旗舰推理与工具调用能力的同时,进一步提升 Token 效率与推理速度,并支持切换低推理模式以降低消耗。对 Coding 与 Agent 框架兼容性也做了专项优化。

    输入
    ¥0.7/M
    输出
    ¥2.1/M
    上下文
    256K
    2026-04-21 上架
  • Step 3.5 Flash

    调用ID:stepfun/step-3.5-flash
    文本编程数学与科学智能代理与数据学术与教育
    +4
    文本编程数学与科学智能代理与数据学术与教育

    阶跃星辰的旗舰语言推理模型。该模型具备顶尖推理能力与快速可靠的执行能力。能够完成对复杂任务的分解、计划,可快速可靠地调用工具执行任务,胜任逻辑推理、数学、软件工程、深度研究等各种复杂任务。上下文长度为256K。

    输入
    ¥0.7/M
    输出
    ¥2.1/M
    上下文
    256K
    2026-04-21 上架
  • GPT-5.1

    调用ID:openai/gpt-5.1
    文本编程数学与科学智能代理与数据对话与客服多模态理解
    +5
    文本编程数学与科学智能代理与数据对话与客服多模态理解

    GPT-5.1 是 GPT-5 系列的最新前沿模型,与 GPT-5 相比,它拥有更强大的通用推理能力、更高的指令遵循度以及更自然的对话风格。它采用自适应推理技术动态分配计算资源,能够快速响应简单查询,同时在处理复杂任务时投入更多精力。该模型能够生成更清晰、更贴近实际的解释,减少专业术语的使用,即使是技术性或多步骤问题也更容易理解。 GPT-5.1 旨在覆盖广泛的任务,在数学、编程和结构化分析等工作负载方面均取得了持续的提升,能够提供更连贯的长篇答案,并提高工具使用的可靠性。它还改进了对话对齐方式,能够在不牺牲准确性的前提下,提供更亲切、更直观的回答。GPT-5.1 是 GPT-5 的主要全功能继任者。

    输入
    ¥8.75/M
    输出
    ¥70/M
    上下文
    400K
    2025-11-19 上架
  • Qwen3.6-Max-Preview

    调用ID:ali/qwen3.6-max-preview
    文本编程智能代理与数据学术与教育
    +3
    文本编程智能代理与数据学术与教育

    Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥9/M token
    • 128k~256k¥15/M token

    输出

    • ≤128k¥54/M token
    • 128k~256k¥90/M token

    缓存读

    • ≤128k¥0.9/M token
    • 128k~256k¥1.5/M token

    缓存写(5m)

    • 公开价格¥18.75/M token

    缓存写(1h)

    • 公开价格¥18.75/M token
    2026-04-21 上架

24 / 187 个模型已加载

←上一页
  1. 1
  2. 2
  3. 3
  4. …
  5. 8
第 2 页,共 8 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选