Qwen

qwen/qwen3.8-flash

1M 上下文 · $0.0900 / M 输入 Token · $0.2820 / M 输出 Token

Qwen3.8 Flash 是 OurToken 上的高性价比 Qwen3.8 路由,适合开发者评估接近旗舰级的聊天、编程、多模态理解、长上下文任务与生产级助手工作流,同时享受更低价格。

获取 API Key
24H 状态监控

历史可用性数据会随时间积累,当前状态反映最近一次健康检查结果。

价格

按量计费

无需预付,仅按实际使用量收费

60% of official price
输入$0.15 / M$0.0900 / M Token
输出$0.47 / M$0.2820 / M Token
缓存输入$0.016 / M$0.0096 / M Token
缓存写入$0.20 / M$0.1200 / M Token

API 使用

API 接入指南

基础地址https://api.ourtoken.ai/v1
API 端点chat/completions
完整地址https://api.ourtoken.ai/v1/chat/completions
模型 IDqwen3.8-flash
获取 API Key

代码示例

使用 OurToken API 端点调用该模型。下面的示例使用原生 HTTP 请求,并采用该模型家族推荐的接口格式。

curl https://api.ourtoken.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "qwen3.8-flash",
    "messages": [
      {
        "role": "user",
        "content": "Hello!"
      }
    ],
    "max_tokens": 256
  }'

Chat Completions API 参考

通过 OpenAI Chat Completions 兼容接口创建聊天响应。SDK 的 Base URL 使用 https://api.ourtoken.ai/v1,接口路径使用 POST /chat/completions。

认证方式

Content-Typeapplication/json
AuthorizationBearer YOUR_API_KEY

请求体

字段类型是否必填说明
modelstring必填要调用的模型 ID。
messagesarray<object>必填发送给模型的对话消息列表。
max_tokensinteger可选最大输出 Token 数。
temperaturenumber可选采样温度。
top_pnumber可选核采样参数。
streamboolean可选是否返回流式响应。
stream_optionsobject可选流式响应的附加选项。
toolsarray<object>可选提供给模型使用的工具列表。
tool_choicestring | object可选控制模型如何选择工具。
response_formatobject可选控制结构化输出,例如 JSON object 响应。

响应体

字段类型是否必填说明
idstring必填唯一的聊天补全响应标识。
object"chat.completion"必填Chat Completions API 返回的对象类型。
createdinteger必填响应创建时的 Unix 时间戳。
modelstring必填生成响应的模型。
choicesarray<object>必填模型返回的候选响应列表。
choices[].message.rolestring必填返回聊天消息的角色。
choices[].message.contentstring可选返回聊天消息中的文本内容。
choices[].finish_reasonstring可选生成停止的原因。
usageobject可选该聊天补全响应的 Token 用量信息。
usage.prompt_tokensinteger可选输入 Token 数。
usage.completion_tokensinteger可选输出 Token 数。
usage.total_tokensinteger可选总 Token 数。
usage.prompt_tokens_detailsobject可选输入 Token 用量明细。
usage.prompt_tokens_details.cached_tokensinteger可选从缓存命中的 Token 数。

模型介绍

Qwen qwen3.8-flash

Qwen3.8 Flash 是 OurToken 上的高性价比 Qwen3.8 路由,适合开发者评估接近旗舰级的聊天、编程、多模态理解、长上下文任务与生产级助手工作流,同时享受更低价格。

Qwen3.8 Flash 以更低的推理成本提供接近旗舰的 Qwen3.8 能力,据官方资料融合多模态理解、编程与 1M token 上下文窗口。 当你想用一个端点完成模型测试、价格查看、API key、用量日志与生产接入时,可以通过 OurToken 调用 qwen3.8-flash api。

亮点说明

  • 用于评估与生产测试的高性价比 Qwen3.8 路由。
  • 通过 OurToken 端点完成 OpenAI 兼容 chat completions 接入。
  • 专页集中展示模型 ID、代码示例与 60% 官方价 pricing 查看。
  • 便于把准旗舰质量与更低的 token 成本进行对比。
  • 从 Qwen 发现到 API 实施之间的清晰路径。

关键特性

  • 模型 ID:qwen3.8-flash
  • 提供商:Qwen
  • OurToken 输入价格:每 1M tokens $0.0900
  • OurToken 输出价格:每 1M tokens $0.2820
  • OurToken cache read 价格:每 1M tokens $0.0096
  • OurToken cache write 价格:每 1M tokens $0.1200
  • API 端点:chat completions
  • 评估重点:成本敏感编程、聊天、多模态理解与长上下文任务

规格参数

ProviderQwen
Model IDqwen3.8-flash
Model TypeMultimodal Large Model (LLM + VLM)
OurToken Input Price$0.0900 / 1M tokens
OurToken Output Price$0.2820 / 1M tokens
OurToken Cache Read Price$0.0096 / 1M tokens
OurToken Cache Write Price$0.1200 / 1M tokens
Official Input Reference$0.15 / 1M tokens
Official Output Reference$0.47 / 1M tokens
Official Cache Read Reference$0.016 / 1M tokens
Official Cache Write Reference$0.20 / 1M tokens
Context Window1M tokens
API Endpointhttps://api.ourtoken.ai/v1/chat/completions

面向开发者的 qwen3.8 flash api 功能

使用 qwen3.8 flash api 查看 60% 官方价的 qwen3.8 flash pricing,并测试准旗舰 benchmark 声明。

API 访问

通过 OurToken 统一端点和 qwen3.8-flash 模型 ID 调用 qwen3.8 flash api。开发者可以更低成本直接测试 Qwen3.8 提示,同时把 API key、请求示例和使用记录放在同一处。

价格检查

路由流量前请查看 qwen3.8 flash pricing。OurToken 列出每 1M tokens 输入 $0.0900、输出 $0.2820、cache read $0.0096、cache write $0.1200,官方参考价为 $0.15、$0.47、$0.016 与 $0.20。

准旗舰质量

在编程、聊天、推理与智能体式提示上评估 Qwen3.8 Flash,其表现接近 Qwen3.8 旗舰,同时为高并发工作负载提供更低的 token 成本。

内置工具

通过 Qwen3.8 Flash 路由直接测试 web search、code interpreter、多模态搜索等内置工具,减少为智能体式提示单独接入工具集成的工作量。

长上下文任务

利用 1M token 上下文窗口处理仓库级分析、长文档与长程智能体会话,成本仅为旗舰的一部分。

生产评估

把 qwen3.8 flash benchmark 搜索结果作为测试方向的参考,并在自己的应用工作流中衡量质量、稳定性、延迟与成本后再扩展。

如何在 OurToken 使用 qwen3.8 flash api

创建 API key,使用 qwen3.8-flash,比较 60% 官方价价格,运行测试并监控使用量。

创建密钥

在 dashboard 创建 OurToken API key,并保存到安全的服务端环境变量。这样后端可以稳定测试 qwen3.8 flash api,而不会在浏览器代码中暴露凭据。

01

复制模型

在请求体中使用 qwen3.8-flash 作为 model 值。把准确模型 ID 放在配置中,有助于开发者在本地测试、staging 和生产部署中比较 Qwen 路由时避免命名错误。

02

调用端点

使用你的 qwen3.8-flash 模型 ID 向 OurToken 统一端点发送 chat completions 请求。现有的 OpenAI 兼容客户端模式通常只需修改 base URL、API key 与 model 值即可复用。

03

查看价格

扩大使用前,查看 qwen3.8 flash pricing:每 1M tokens 输入 $0.0900、输出 $0.2820、cache read $0.0096、cache write $0.1200。请将这些价格行与预期 prompt 大小、输出长度和请求量比较。

04

测试工作流

对代码、多语言聊天、推理、检索与 assistant 行为运行代表性提示,再结合生产需求比较输出质量、稳定性、延迟、token 用量和成本。

05

监控成本

测试后,在 OurToken history 中查看请求数、token 用量、失败、延迟和 spend。这有助于判断 qwen3.8 flash api 应成为默认路由,还是保持为评估选项。

06

qwen3.8 flash api 常见问题

关于 qwen3.8 flash pricing、qwen3.8-flash 模型选择、benchmark 测试、模型 ID 和 provider 比较的回答。

01

什么是 qwen3.8 flash api?

qwen3.8 flash api 是 OurToken 上用于通过统一 API 工作流调用 qwen3.8-flash 模型的路由页面。开发者可以复制模型 ID、创建 API key、发送 chat completions 请求、查看当前 60% 官方价 pricing,并在生产上线前比较真实输出。
02

如何查看 qwen3.8 flash pricing?

OurToken 上的 qwen3.8 flash pricing 为每 1M input tokens $0.0900、每 1M output tokens $0.2820。Cache read 为每 1M tokens $0.0096,cache write 为每 1M tokens $0.1200。官方参考价为 $0.15 input、$0.47 output、$0.016 cache read 与 $0.20 cache write。
03

Qwen3.8 Flash 应使用哪个模型 ID?

通过 OurToken 调用此路由时,请使用 qwen3.8-flash 作为 model 值。建议把它放在配置中,而不是硬编码到多个文件里,这样后续比较 qwen3.8 flash api 与 Qwen3.8 Max 或其他 provider 路由会更方便。
04

Qwen3.8 Flash 与 Qwen3.8 Max 如何比较?

Qwen3.8 Flash 以更低的 token 成本提供接近旗舰的能力,而 Qwen3.8 Max 是评估上限最高的旗舰路由。具体选择取决于工作负载的质量、延迟、预算,以及你的提示是否需要最大推理深度。
05

Qwen3.8 Flash 能理解图片和视频吗?

可以。作为 Qwen3.8 代的一部分,Qwen3.8 Flash 是原生视觉语言模型,支持从 STEM 图表、文档到小时级视频的图片与视频理解,同时覆盖文本推理与编程。
06

如何解读 qwen3.8 flash benchmark?

qwen3.8 flash benchmark 有助于决定测试方向,但不应替代你自己的评估。请对代码、推理、检索与 assistant 行为运行代表性提示,再结合生产需求比较质量、稳定性、延迟、token 用量和成本。