SA
- 输入 / 输出
- $0.05 / $0.08
- 上下文
- 32K
- 最大输出
- 4K
- 模态
- 聊天
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
chat_completion兼容 OpenAIPOST/v1/chat/completionscurl https://api.tokenlab.sh/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "allam-2-7b", "messages": [ {"role": "user", "content": "Hello!"} ] }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
价格
每 1M token- TokenLab 价格
- 输入$0.05输出$0.08每 1M token
- 官方价格
- 输入$0.05输出$0.08每 1M token
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 输入 | $0.05 | $0.05 | - |
| 输出 | $0.08 | $0.08 | - |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时还没有数据
模型表现
达到隐私和数据量阈值后,指标才会显示。
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
allam-2-7b 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 allam-2-7b 发一条简短消息,接口是 /v1/chat/completions。返回回复,附上延迟和费用。
使用场景
01
Agent 与工具
处理推理、客服分流、工具调用和多步任务。
02
编程
在常用工具中生成、评审或调试代码。
03
知识助手
搭聊天、搜索和检索功能,价格和能力都清清楚楚。
04
并排对比
并列比较回复质量、延迟和价格。
提示词示例
写一段简洁的客服回复,把背后的假设列出来。
审查这个 API 设计,指出最主要的三个接入风险。
把一份长更新日志整理成非工程师也能读懂的发布说明。
费用计算器
1 百万 token
0.5 百万 token
预估月度费用$0.09
FAQ
allam-2-7b 的费用是多少?
在 TokenLab 上,allam-2-7b 的价格为 输入 $0.05 / 输出 $0.08 每 1M token。完整明细见上方价格表。
如何测试 allam-2-7b?
在 Create 里打开 allam-2-7b,就能直接用为 /v1/chat/completions 准备的示例。
allam-2-7b 应该使用哪个端点?
allam-2-7b 使用 https://api.tokenlab.sh/v1/chat/completions。代码写法见下方的请求示例。
接入前可以先测试 allam-2-7b 吗?
可以。打开 Console 会为 allam-2-7b 备好一个现成的草稿,登录后提示词还在,上下文不会丢。
allam-2-7b 支持哪些操作?
allam-2-7b 支持 chat_completion。选了操作,上面会显示对应的端点和请求示例。