Qwen

qwen/qwen3.8-max

1M 上下文 · $1.2000 / M 输入 Token · $3.6000 / M 输出 Token

Qwen3.8 Max 是 OurToken 上的 Qwen3.8 旗舰路由,适合开发者评估最高能力的 Qwen API 选项,用于聊天、多模态理解、编程、推理、长上下文任务与生产级助手工作流。

获取 API Key
24H 状态监控

历史可用性数据会随时间积累,当前状态反映最近一次健康检查结果。

价格

按量计费

无需预付,仅按实际使用量收费

60% of official price
输入$2.00 / M$1.2000 / M Token
输出$6.00 / M$3.6000 / M Token
缓存输入$0.25 / M$0.1500 / M Token
缓存写入$2.50 / M$1.5000 / M Token

API 使用

API 接入指南

基础地址https://api.ourtoken.ai/v1
API 端点chat/completions
完整地址https://api.ourtoken.ai/v1/chat/completions
模型 IDqwen3.8-max
获取 API Key

代码示例

使用 OurToken API 端点调用该模型。下面的示例使用原生 HTTP 请求,并采用该模型家族推荐的接口格式。

curl https://api.ourtoken.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "qwen3.8-max",
    "messages": [
      {
        "role": "user",
        "content": "Hello!"
      }
    ],
    "max_tokens": 256
  }'

Chat Completions API 参考

通过 OpenAI Chat Completions 兼容接口创建聊天响应。SDK 的 Base URL 使用 https://api.ourtoken.ai/v1,接口路径使用 POST /chat/completions。

认证方式

Content-Typeapplication/json
AuthorizationBearer YOUR_API_KEY

请求体

字段类型是否必填说明
modelstring必填要调用的模型 ID。
messagesarray<object>必填发送给模型的对话消息列表。
max_tokensinteger可选最大输出 Token 数。
temperaturenumber可选采样温度。
top_pnumber可选核采样参数。
streamboolean可选是否返回流式响应。
stream_optionsobject可选流式响应的附加选项。
toolsarray<object>可选提供给模型使用的工具列表。
tool_choicestring | object可选控制模型如何选择工具。
response_formatobject可选控制结构化输出,例如 JSON object 响应。

响应体

字段类型是否必填说明
idstring必填唯一的聊天补全响应标识。
object"chat.completion"必填Chat Completions API 返回的对象类型。
createdinteger必填响应创建时的 Unix 时间戳。
modelstring必填生成响应的模型。
choicesarray<object>必填模型返回的候选响应列表。
choices[].message.rolestring必填返回聊天消息的角色。
choices[].message.contentstring可选返回聊天消息中的文本内容。
choices[].finish_reasonstring可选生成停止的原因。
usageobject可选该聊天补全响应的 Token 用量信息。
usage.prompt_tokensinteger可选输入 Token 数。
usage.completion_tokensinteger可选输出 Token 数。
usage.total_tokensinteger可选总 Token 数。
usage.prompt_tokens_detailsobject可选输入 Token 用量明细。
usage.prompt_tokens_details.cached_tokensinteger可选从缓存命中的 Token 数。

模型介绍

Qwen qwen3.8-max

Qwen3.8 Max 是 OurToken 上的 Qwen3.8 旗舰路由,适合开发者评估最高能力的 Qwen API 选项,用于聊天、多模态理解、编程、推理、长上下文任务与生产级助手工作流。

Qwen3.8 Max 是 Qwen3.8 代的旗舰模型,据官方资料融合前沿推理、编程能力与原生视觉语言理解,并拥有 1M token 上下文窗口。 当你想用一个端点完成模型测试、价格查看、API key、用量日志、benchmark 验证与生产接入时,可以通过 OurToken 调用 qwen3.8-max api。

亮点说明

  • 用于评估与生产测试的 Qwen3.8 旗舰路由。
  • 通过 OurToken 端点完成 OpenAI 兼容 chat completions 接入。
  • 专页集中展示模型 ID、代码示例与 60% 官方价 pricing 查看。
  • 便于把 benchmark 声明与真实提示、日志进行对比。
  • 从 Qwen 发现到 API 实施之间的清晰路径。

关键特性

  • 模型 ID:qwen3.8-max
  • 提供商:Qwen
  • OurToken 输入价格:每 1M tokens $1.2000
  • OurToken 输出价格:每 1M tokens $3.6000
  • OurToken cache read 价格:每 1M tokens $0.1500
  • OurToken cache write 价格:每 1M tokens $1.5000
  • API 端点:chat completions
  • 评估重点:推理、编程、多模态理解与 benchmark 验证

规格参数

ProviderQwen
Model IDqwen3.8-max
Model TypeMultimodal Large Model (LLM + VLM)
OurToken Input Price$1.2000 / 1M tokens
OurToken Output Price$3.6000 / 1M tokens
OurToken Cache Read Price$0.1500 / 1M tokens
OurToken Cache Write Price$1.5000 / 1M tokens
Official Input Reference$2.00 / 1M tokens
Official Output Reference$6.00 / 1M tokens
Official Cache Read Reference$0.25 / 1M tokens
Official Cache Write Reference$2.50 / 1M tokens
Context Window1M tokens
API Endpointhttps://api.ourtoken.ai/v1/chat/completions

面向开发者的 qwen3.8 max api 功能

使用 qwen3.8 max api 查看 60% 官方价的 qwen3.8 max pricing,并测试旗舰 benchmark 声明。

API 访问

通过 OurToken 统一端点和 qwen3.8-max 模型 ID 调用 qwen3.8 max api。开发者可以直接测试 Qwen3.8 旗舰提示,同时把 API key、请求示例和使用记录放在同一处。

价格检查

扩展流量前请查看 qwen3.8 max pricing。OurToken 列出每 1M tokens 输入 $1.2000、输出 $3.6000、cache read $0.1500、cache write $1.5000,官方参考价为 $2.00、$6.00、$0.25 与 $2.50。

多模态理解

在图片与文档理解、STEM 图表以及小时级视频理解上评估 Qwen3.8 Max,同时覆盖文本推理,体现 Qwen3.8 代的原生视觉语言能力。

内置工具

通过 Qwen3.8 Max 路由直接测试 web search、code interpreter、图像搜索等内置工具,减少为智能体式提示单独接入工具集成的工作量。

长上下文任务

利用 1M token 上下文窗口处理仓库级分析、长文档与长程智能体会话,并支持按请求灵活控制思考模式。

Benchmark 测试

用真实代码、推理、检索与 assistant 提示构建自己的 qwen3.8 max benchmark 套件。根据验收标准比较输出,而不是只依赖公开排行榜或单次 provider 示例。

如何在 OurToken 使用 qwen3.8 max api

创建 API key,使用 qwen3.8-max,比较 60% 官方价价格,运行测试并监控使用量。

创建密钥

在 dashboard 创建 OurToken API key,并保存到安全的服务端环境变量。这样后端可以稳定测试 qwen3.8 max api,而不会在浏览器代码中暴露凭据。

01

复制模型

在请求体中使用 qwen3.8-max 作为 model 值。把准确模型 ID 放在配置中,有助于开发者在本地测试、staging 和生产部署中比较 Qwen 路由时避免大小写错误。

02

调用端点

使用你的 qwen3.8-max 模型 ID 向 OurToken 统一端点发送 chat completions 请求。现有的 OpenAI 兼容客户端模式通常只需修改 base URL、API key 与 model 值即可复用。

03

查看价格

扩大使用前,查看 qwen3.8 max pricing:每 1M tokens 输入 $1.2000、输出 $3.6000、cache read $0.1500、cache write $1.5000。请将这些价格行与预期 prompt 大小、输出长度和请求量比较。

04

测试 Benchmark

使用真实代码、推理、多模态与 assistant 提示构建自己的 qwen3.8 max benchmark 套件,验证思考深度、工具行为、延迟与成本,而非只依赖公开排行榜。

05

监控成本

测试后,在 OurToken history 中查看请求数、token 用量、失败、延迟和 spend。这有助于判断 qwen3.8 max api 应成为默认路由,还是保持为评估选项。

06

qwen3.8 max api 常见问题

关于 qwen3.8 max pricing、qwen3.8-max 模型选择、benchmark 测试、模型 ID 和 provider 比较的回答。

01

什么是 qwen3.8 max api?

qwen3.8 max api 是 OurToken 上用于通过统一 API 工作流调用 qwen3.8-max 模型的路由页面。开发者可以复制模型 ID、创建 API key、发送 chat completions 请求、查看当前 60% 官方价 pricing,并在选择生产流量前比较真实输出。
02

如何查看 qwen3.8 max pricing?

OurToken 上的 qwen3.8 max pricing 为每 1M input tokens $1.2000、每 1M output tokens $3.6000。Cache read 为每 1M tokens $0.1500,cache write 为每 1M tokens $1.5000。官方参考价为 $2.00 input、$6.00 output、$0.25 cache read 与 $2.50 cache write。
03

Qwen3.8 Max 应使用哪个模型 ID?

通过 OurToken 调用此路由时,请使用 qwen3.8-max 作为 model 值。建议把它放在配置中,而不是硬编码到多个文件里,这样后续比较 qwen3.8 max api 与 Qwen3.8 Flash 或其他 provider 路由会更方便。
04

Qwen3.8 Max 支持多大的上下文窗口?

据官方资料,Qwen3.8 Max 原生支持 1M token 上下文窗口,支持灵活的思考控制、推理力度调节,并内置 web search 与 code interpreter 等工具。
05

Qwen3.8 Max 能理解图片和视频吗?

可以。Qwen3.8 Max 是 Qwen3.8 代的原生视觉语言模型,支持从 STEM 图表、文档到小时级视频的图片与视频理解,同时覆盖文本推理与编程。
06

如何解读 qwen3.8 max benchmark?

qwen3.8 max benchmark 可以帮助决定测试方向,但不应替代你自己的评估。请对代码、多语言聊天、推理、工具使用和延迟运行代表性提示,再根据产品需求比较质量、稳定性、token 用量和成本。