- 输入 / 输出
- $0.1176 / $0.3971
- 上下文
- 992K
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
messages原生格式(Messages API)POST/v1/messagesAPI 格式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "qwen3.8-flash", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
Beijing Default
每 1M token- 官方价格
- 输入 $0.1176 / 输出 $0.3971 / 缓存读取 $0.0147 / 缓存写入 $0.1838
- TokenLab 价格
- 输入 $0.1176 / 输出 $0.3971 / 缓存读取 $0.0147 / 缓存写入 $0.1838
- 折扣
- -
缓存读取
- 官方价格
- $0.0147
- TokenLab 价格
- $0.0147
- 折扣
- -
缓存写入
- 官方价格
- $0.1838
- TokenLab 价格
- $0.1838
- 折扣
- -
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| Beijing Default | 输入 $0.1176 / 输出 $0.3971 / 缓存读取 $0.0147 / 缓存写入 $0.1838 | 输入 $0.1176 / 输出 $0.3971 / 缓存读取 $0.0147 / 缓存写入 $0.1838 | - |
| 缓存读取 | $0.0147 | $0.0147 | - |
| 缓存写入 | $0.1838 | $0.1838 | - |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时还没有数据
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
qwen3.8-flash 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 qwen3.8-flash 发一条简短消息,接口是 /v1/messages。返回回复,附上延迟和费用。
使用场景
适用场景视觉
读取图片、解析文档、回答视觉问题
Agent 与工具
处理推理、客服分流、工具调用和多步任务。
编程
在常用工具中生成、评审或调试代码。
知识助手
搭聊天、搜索和检索功能,价格和能力都清清楚楚。
并排对比
并列比较回复质量、延迟和价格。
提示词示例
写一段简洁的客服回复,把背后的假设列出来。
审查这个 API 设计,指出最主要的三个接入风险。
把一份长更新日志整理成非工程师也能读懂的发布说明。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
qwen3.8-flash 的费用是多少?
在 TokenLab 上,qwen3.8-flash 的价格为 输入 $0.1176 / 输出 $0.3971 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
qwen3.8-flash 适合做什么?
qwen3.8-flash 支持 JSON 模式, 提示词缓存, 工具调用,可以直接在 Create 中打开。
如何测试 qwen3.8-flash?
在 Create 里打开 qwen3.8-flash,就能直接用为 /v1/messages 准备的示例。
qwen3.8-flash 应该使用哪个端点?
qwen3.8-flash 使用 https://api.tokenlab.sh/v1/messages。代码写法见下方的请求示例。
接入前可以先测试 qwen3.8-flash 吗?
可以。打开 Console 会为 qwen3.8-flash 备好一个现成的草稿,登录后提示词还在,上下文不会丢。
qwen3.8-flash 支持哪些操作?
qwen3.8-flash 支持 messages。选了操作,上面会显示对应的端点和请求示例。