bigmodel

GLM-4.7

bigmodel/glm-4.7
/v1/chat/completions/v1/messages/v1/responses/v1beta/models/*/v1/models/*

最新旗舰模型:通用对话、推理与智能体能力上实现全面升级。回复更简洁自然,写作更具沉浸感,且在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升

输入 / 输出模态
文本 · 图像 至 文本
参考输入 / 输出价格
输入¥2输出¥8每百万 Token
上下文长度
200K
收录时间
2025年12月23日

供应通道与价格

供应通道输入长度输入 /M输出 /M缓存读取 /M上下文最大输出详情
智谱≤ 32K¥2——200K128K
> 32K¥4——
≤ 2K—¥8—
≥ 2K—¥14—
≥ 0—¥16¥0.4
Ali≤ 32K¥3¥14¥0.6198K16K
≥ 32K¥4¥16¥0.8
Other-A≤ 32K¥2——200K16K
≥ 32K¥4——
≤ 2K—¥8—
≥ 2K—¥14—
≥ 0—¥16¥0.4

智谱

延迟
5.32s
吞吐量
9 tokens/s
上下文
200K

价格

输入
¥2/M tokens
输出
¥8/M tokens
缓存
¥0.4/M tokens

分段价格

按输入 Token 长度分段计费。

0–32K Token

输入阶梯
¥2/M tokens
输入阶梯
¥3/M tokens

32K–∞ Token

输入阶梯
¥4/M tokens

0–2K Token

输出阶梯
¥8/M tokens

2K–∞ Token

输出阶梯
¥14/M tokens

0–∞ Token

输出阶梯
¥16/M tokens
缓存阶梯
¥0.4/M tokens
缓存阶梯
¥0.6/M tokens
缓存阶梯
¥0.8/M tokens

规格

上下文
200K
最大输出
128K
支持的 API
/v1/chat/completions/v1/messages/v1/responses/v1beta/models/*/v1/models/*

Ali

延迟
2.52s
吞吐量
9431 tokens/s
上下文
198K

价格

输入
¥3/M tokens
输出
¥14/M tokens
缓存
¥0/M tokens

分段价格

按输入 Token 长度分段计费。

0–32K Token

输入阶梯
¥3/M tokens
输出阶梯
¥14/M tokens
缓存阶梯
¥0.6/M tokens

32K–∞ Token

输入阶梯
¥4/M tokens
输出阶梯
¥16/M tokens
缓存阶梯
¥0.8/M tokens

规格

上下文
198K
最大输出
16K
支持的 API
/v1/chat/completions/v1/messages/v1/responses/v1beta/models/*/v1/models/*

Other-A

延迟
7.92s
吞吐量
91 tokens/s
上下文
200K

价格

输入
¥2/M tokens
输出
¥8/M tokens
缓存
¥0.4/M tokens

分段价格

按输入 Token 长度分段计费。

0–32K Token

输入阶梯
¥2/M tokens
输入阶梯
¥3/M tokens

32K–∞ Token

输入阶梯
¥4/M tokens

0–2K Token

输出阶梯
¥8/M tokens

2K–∞ Token

输出阶梯
¥14/M tokens

0–∞ Token

输出阶梯
¥16/M tokens
缓存阶梯
¥0.4/M tokens
缓存阶梯
¥0.6/M tokens
缓存阶梯
¥0.8/M tokens

规格

上下文
200K
最大输出
16K
支持的 API
/v1/chat/completions/v1/messages/v1/responses/v1beta/models/*/v1/models/*

GLM-4.7 的示例代码与 API 说明

Modelmesh 会帮你在不同服务提供商之间规范化处理请求和响应,为你统一接口。

Modelmesh 提供了兼容 OpenAI 的 Completion API,可连接 300 多款模型与服务提供商,既可直接调用,也可通过 OpenAI SDK 调用。此外,还提供了一些第三方 SDK。

在以下示例中,Modelmesh 专用的请求头属于可选项。若你配置了这些请求头,你的应用就能出现在 Modelmesh 的排行榜上。

支持的接口点击接口可切换下方示例
/v1/chat/completions
from openai import OpenAI API_KEY = "$SSY_API_KEY" client = OpenAI( base_url="https://router.shengsuanyun.com/api/v1", api_key=API_KEY, ) try: completion = client.chat.completions.create( model="bigmodel/glm-4.7", messages=[{"role": "user", "content": "9.11 和 9.8 哪个数更大?"}], temperature=0.6, top_p=0.7, stream=True, ) response_text = "" for chunk in completion: if chunk.choices and chunk.choices[0].delta.content is not None: content = chunk.choices[0].delta.content print(content, end="", flush=True) response_text += content except Exception as error: print(f"Request failed: {error}")
                
              

应用排行
  1. ClineShengsuan公开模型应用
  2. auto-coder公开模型应用
  3. cline-chinese公开模型应用
  4. Kilo Code Chinese公开模型应用
  5. ClineShengsuan公开模型应用
  6. Cherry Studio公开模型应用
  7. OpenClaw公开模型应用
  8. ClineShengsuan公开模型应用
  9. ClaudeCodeProxy公开模型应用
  10. ClineShengsuan目标地址未通过链接安全策略
  11. Roo Code Chinese公开模型应用
  12. SSY Chatroom公开模型应用
  13. Kilo Code公开模型应用
  14. Xiaohongshu Generator目标地址未通过链接安全策略
  15. Postman公开模型应用
  16. ClineShengsuan目标地址未通过链接安全策略
  17. Xiaohongshu Generator目标地址未通过链接安全策略
  18. cline目标地址未通过链接安全策略
  19. Xiaohongshu Generator目标地址未通过链接安全策略

相关模型