智谱 AI: glm-5

glm-5 的价格、表现、能力和可直接使用的请求示例。
对比模型
glm-5
可用智谱 AI聊天缓存输入便宜 80%
输入 / 输出
$1.00 / $3.20
上下文
200K
最大输出
128K
模态
聊天
能力
工具调用提示词缓存

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    messages原生格式(Messages API)
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "glm-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

Default

每 1M token
官方价格
输入 $1.00 / 输出 $3.20 / 缓存读取 $0.20 / 缓存写入 $0.00 / 文本 输入 $1.00 / 文本 输出 $3.20
TokenLab 价格
输入 $1.00 / 输出 $3.20 / 缓存读取 $0.20 / 缓存写入 $0.00 / 文本 输入 $1.00 / 文本 输出 $3.20
折扣
-
提示词缓存价格

缓存读取

官方价格
$0.20
TokenLab 价格
$0.20
折扣
-

缓存写入

官方价格
$0.00
TokenLab 价格
$0.00
折扣
-

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时

还没有数据

模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

glm-5 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 glm-5 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。

使用场景

01

Agent 与工具

处理推理、客服分流、工具调用和多步任务。

02

编程

在常用工具中生成、评审或调试代码。

03

知识助手

搭聊天、搜索和检索功能,价格和能力都清清楚楚。

04

并排对比

并列比较回复质量、延迟和价格。

提示词示例

写一段简洁的客服回复,把背后的假设列出来。

审查这个 API 设计,指出最主要的三个接入风险。

把一份长更新日志整理成非工程师也能读懂的发布说明。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

glm-5 的费用是多少?

在 TokenLab 上,glm-5 的价格为 输入 $1.00 / 输出 $3.20 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

glm-5 适合做什么?

glm-5 支持 提示词缓存, 工具调用,可以直接在 Create 中打开。

如何测试 glm-5?

在 Create 里打开 glm-5,就能直接用为 /v1/messages 准备的示例。

glm-5 应该使用哪个端点?

glm-5 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。

接入前可以先测试 glm-5 吗?

可以。打开 Console 会为 glm-5 备好一个现成的草稿,登录后提示词还在,上下文不会丢。

glm-5 支持哪些操作?

glm-5 支持 messages。选了操作,上面会显示对应的端点和请求示例。

更多 GLM 模型

相关模型