- 输入 / 输出-70%
- $10.00 / $50.00$3.00 / $15.00
- 上下文
- 1.05M
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
chat_completionResponses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-6-astra", "input": "Hello!" }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
输入 token <= 272K
每 1M token- 官方价格
- 输入 $10.00 / 输出 $50.00 / 缓存读取 $1.00 / 缓存写入 $12.50
- TokenLab 价格
- 输入 $3.00 / 输出 $15.00 / 缓存读取 $0.30 / 缓存写入 $3.75
- 折扣
- -70%
输入 token 272K-1.05M
每 1M token- 官方价格
- 输入 $20.00 / 输出 $75.00 / 缓存读取 $2.00 / 缓存写入 $25.00
- TokenLab 价格
- 输入 $6.00 / 输出 $22.50 / 缓存读取 $0.60 / 缓存写入 $7.50
- 折扣
- -70%
缓存读取
- 官方价格
- $1.00
- TokenLab 价格
- $0.30
- 折扣
- -70%
缓存写入
- 官方价格
- $12.50
- TokenLab 价格
- $3.75
- 折扣
- -70%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 输入 token <= 272K | 输入 $10.00 / 输出 $50.00 / 缓存读取 $1.00 / 缓存写入 $12.50 | 输入 $3.00 / 输出 $15.00 / 缓存读取 $0.30 / 缓存写入 $3.75 | -70% |
| 输入 token 272K-1.05M | 输入 $20.00 / 输出 $75.00 / 缓存读取 $2.00 / 缓存写入 $25.00 | 输入 $6.00 / 输出 $22.50 / 缓存读取 $0.60 / 缓存写入 $7.50 | -70% |
| 缓存读取 | $1.00 | $0.30 | -70% |
| 缓存写入 | $12.50 | $3.75 | -70% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时还没有数据
- 30 天成功率
- 42.8%
- 7 天中位延迟
- 13.1 sn=1,109
- 7 天 P95 延迟
- 43.4 sn=1,109
- 30 天请求数
- 2K+
- 最后活动时间
- 3小时前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
GPT-6 Astra 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 gpt-6-astra 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景代码
编写、评审和调试真实项目中的代码
推理
多步推理、分析和研究型任务
视觉
读取图片、解析文档、回答视觉问题
Agent 与工具
处理推理、客服分流、工具调用和多步任务。
编程
在常用工具中生成、评审或调试代码。
知识助手
搭聊天、搜索和检索功能,价格和能力都清清楚楚。
并排对比
并列比较回复质量、延迟和价格。
提示词示例
写一段简洁的客服回复,把背后的假设列出来。
审查这个 API 设计,指出最主要的三个接入风险。
把一份长更新日志整理成非工程师也能读懂的发布说明。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
GPT-6 Astra 的费用是多少?
在 TokenLab 上,GPT-6 Astra 的价格为 输入 $3.00 / 输出 $15.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
GPT-6 Astra 适合做什么?
GPT-6 Astra 支持 代码, JSON 模式, 提示词缓存,可以直接在 Create 中打开。
如何测试 GPT-6 Astra?
在 Create 里打开 GPT-6 Astra,就能直接用为 /v1/responses 准备的示例。
GPT-6 Astra 应该使用哪个端点?
GPT-6 Astra 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
接入前可以先测试 GPT-6 Astra 吗?
可以。打开 Console 会为 GPT-6 Astra 备好一个现成的草稿,登录后提示词还在,上下文不会丢。
GPT-6 Astra 支持哪些操作?
GPT-6 Astra 支持 chat_completion。选了操作,上面会显示对应的端点和请求示例。