- qwen/qwen3.8-max
qwen/qwen3.8-max
1M 上下文 · $1.2000 / M 输入 Token · $3.6000 / M 输出 Token
Qwen3.8 Max 是 OurToken 上的 Qwen3.8 旗舰路由,适合开发者评估最高能力的 Qwen API 选项,用于聊天、多模态理解、编程、推理、长上下文任务与生产级助手工作流。
历史可用性数据会随时间积累,当前状态反映最近一次健康检查结果。
价格
按量计费
无需预付,仅按实际使用量收费
API 使用
API 接入指南
代码示例
使用 OurToken API 端点调用该模型。下面的示例使用原生 HTTP 请求,并采用该模型家族推荐的接口格式。
curl https://api.ourtoken.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "qwen3.8-max",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"max_tokens": 256
}'Chat Completions API 参考
通过 OpenAI Chat Completions 兼容接口创建聊天响应。SDK 的 Base URL 使用 https://api.ourtoken.ai/v1,接口路径使用 POST /chat/completions。
认证方式
| Content-Type | application/json |
| Authorization | Bearer YOUR_API_KEY |
请求体
| 字段 | 类型 | 是否必填 | 说明 |
|---|---|---|---|
| model | string | 必填 | 要调用的模型 ID。 |
| messages | array<object> | 必填 | 发送给模型的对话消息列表。 |
| max_tokens | integer | 可选 | 最大输出 Token 数。 |
| temperature | number | 可选 | 采样温度。 |
| top_p | number | 可选 | 核采样参数。 |
| stream | boolean | 可选 | 是否返回流式响应。 |
| stream_options | object | 可选 | 流式响应的附加选项。 |
| tools | array<object> | 可选 | 提供给模型使用的工具列表。 |
| tool_choice | string | object | 可选 | 控制模型如何选择工具。 |
| response_format | object | 可选 | 控制结构化输出,例如 JSON object 响应。 |
响应体
| 字段 | 类型 | 是否必填 | 说明 |
|---|---|---|---|
| id | string | 必填 | 唯一的聊天补全响应标识。 |
| object | "chat.completion" | 必填 | Chat Completions API 返回的对象类型。 |
| created | integer | 必填 | 响应创建时的 Unix 时间戳。 |
| model | string | 必填 | 生成响应的模型。 |
| choices | array<object> | 必填 | 模型返回的候选响应列表。 |
| choices[].message.role | string | 必填 | 返回聊天消息的角色。 |
| choices[].message.content | string | 可选 | 返回聊天消息中的文本内容。 |
| choices[].finish_reason | string | 可选 | 生成停止的原因。 |
| usage | object | 可选 | 该聊天补全响应的 Token 用量信息。 |
| usage.prompt_tokens | integer | 可选 | 输入 Token 数。 |
| usage.completion_tokens | integer | 可选 | 输出 Token 数。 |
| usage.total_tokens | integer | 可选 | 总 Token 数。 |
| usage.prompt_tokens_details | object | 可选 | 输入 Token 用量明细。 |
| usage.prompt_tokens_details.cached_tokens | integer | 可选 | 从缓存命中的 Token 数。 |
模型介绍
Qwen qwen3.8-max
Qwen3.8 Max 是 OurToken 上的 Qwen3.8 旗舰路由,适合开发者评估最高能力的 Qwen API 选项,用于聊天、多模态理解、编程、推理、长上下文任务与生产级助手工作流。
Qwen3.8 Max 是 Qwen3.8 代的旗舰模型,据官方资料融合前沿推理、编程能力与原生视觉语言理解,并拥有 1M token 上下文窗口。 当你想用一个端点完成模型测试、价格查看、API key、用量日志、benchmark 验证与生产接入时,可以通过 OurToken 调用 qwen3.8-max api。
亮点说明
- 用于评估与生产测试的 Qwen3.8 旗舰路由。
- 通过 OurToken 端点完成 OpenAI 兼容 chat completions 接入。
- 专页集中展示模型 ID、代码示例与 60% 官方价 pricing 查看。
- 便于把 benchmark 声明与真实提示、日志进行对比。
- 从 Qwen 发现到 API 实施之间的清晰路径。
关键特性
- 模型 ID:qwen3.8-max
- 提供商:Qwen
- OurToken 输入价格:每 1M tokens $1.2000
- OurToken 输出价格:每 1M tokens $3.6000
- OurToken cache read 价格:每 1M tokens $0.1500
- OurToken cache write 价格:每 1M tokens $1.5000
- API 端点:chat completions
- 评估重点:推理、编程、多模态理解与 benchmark 验证
规格参数
面向开发者的 qwen3.8 max api 功能
使用 qwen3.8 max api 查看 60% 官方价的 qwen3.8 max pricing,并测试旗舰 benchmark 声明。
API 访问
通过 OurToken 统一端点和 qwen3.8-max 模型 ID 调用 qwen3.8 max api。开发者可以直接测试 Qwen3.8 旗舰提示,同时把 API key、请求示例和使用记录放在同一处。
价格检查
扩展流量前请查看 qwen3.8 max pricing。OurToken 列出每 1M tokens 输入 $1.2000、输出 $3.6000、cache read $0.1500、cache write $1.5000,官方参考价为 $2.00、$6.00、$0.25 与 $2.50。
多模态理解
在图片与文档理解、STEM 图表以及小时级视频理解上评估 Qwen3.8 Max,同时覆盖文本推理,体现 Qwen3.8 代的原生视觉语言能力。
内置工具
通过 Qwen3.8 Max 路由直接测试 web search、code interpreter、图像搜索等内置工具,减少为智能体式提示单独接入工具集成的工作量。
长上下文任务
利用 1M token 上下文窗口处理仓库级分析、长文档与长程智能体会话,并支持按请求灵活控制思考模式。
Benchmark 测试
用真实代码、推理、检索与 assistant 提示构建自己的 qwen3.8 max benchmark 套件。根据验收标准比较输出,而不是只依赖公开排行榜或单次 provider 示例。
如何在 OurToken 使用 qwen3.8 max api
创建 API key,使用 qwen3.8-max,比较 60% 官方价价格,运行测试并监控使用量。
创建密钥
在 dashboard 创建 OurToken API key,并保存到安全的服务端环境变量。这样后端可以稳定测试 qwen3.8 max api,而不会在浏览器代码中暴露凭据。
01复制模型
在请求体中使用 qwen3.8-max 作为 model 值。把准确模型 ID 放在配置中,有助于开发者在本地测试、staging 和生产部署中比较 Qwen 路由时避免大小写错误。
02调用端点
使用你的 qwen3.8-max 模型 ID 向 OurToken 统一端点发送 chat completions 请求。现有的 OpenAI 兼容客户端模式通常只需修改 base URL、API key 与 model 值即可复用。
03查看价格
扩大使用前,查看 qwen3.8 max pricing:每 1M tokens 输入 $1.2000、输出 $3.6000、cache read $0.1500、cache write $1.5000。请将这些价格行与预期 prompt 大小、输出长度和请求量比较。
04测试 Benchmark
使用真实代码、推理、多模态与 assistant 提示构建自己的 qwen3.8 max benchmark 套件,验证思考深度、工具行为、延迟与成本,而非只依赖公开排行榜。
05监控成本
测试后,在 OurToken history 中查看请求数、token 用量、失败、延迟和 spend。这有助于判断 qwen3.8 max api 应成为默认路由,还是保持为评估选项。
06qwen3.8 max api 常见问题
关于 qwen3.8 max pricing、qwen3.8-max 模型选择、benchmark 测试、模型 ID 和 provider 比较的回答。