DeepSeek

deepseek/deepseek-flash

1M контекст · $0.1800 / M входные токены · $0.7200 / M выходные токены

DeepSeek V4.1 Flash — маршрут модели DeepSeek на OurToken для разработчиков, которым нужно нативное понимание изображений, очень длинный контекст и экономичный production-трафик. Он заменяет снятую с поддержки линейку V4 Flash и вызывается через model ID deepseek-flash.

Получить API-ключ
Монитор статуса 24H

Исторические данные о доступности накапливаются со временем. Текущий статус отражает последнюю проверку.

Цены

Оплата по мере использования

Без предварительных платежей — платите только за то, что используете

60% of official price
Ввод$0.30 / M$0.1800 / M Токены
Вывод$1.20 / M$0.7200 / M Токены
Кэшированный ввод$0.006 / M$0.0036 / M Токены
Запись в кэш$0 / M$0 / M Токены

Использование API

Руководство по доступу к API

Базовый URLhttps://api.ourtoken.ai/v1
Конечная точка APIchat/completions
Полный URLhttps://api.ourtoken.ai/v1/chat/completions
ID моделиdeepseek-flash
Получить API-ключ

Примеры кода

Используйте API endpoint OurToken для этой модели. Примеры ниже используют прямые HTTP-запросы и рекомендуемый endpoint для семейства модели.

curl https://api.ourtoken.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "deepseek-flash",
    "messages": [
      {
        "role": "user",
        "content": "Hello!"
      }
    ],
    "max_tokens": 256
  }'

Справочник Chat Completions API

Создайте ответ чата через endpoint, совместимый с OpenAI Chat Completions. Используйте https://api.ourtoken.ai/v1 как SDK Base URL и POST /chat/completions как endpoint.

Авторизация

Content-Typeapplication/json
AuthorizationBearer YOUR_API_KEY

Тело запроса

ПолеТипОбязательноОписание
modelstringОбязательноModel ID для вызова.
messagesarray<object>ОбязательноСообщения диалога, отправленные модели.
max_tokensintegerНеобязательноМаксимальное число выходных токенов.
temperaturenumberНеобязательноТемпература семплирования.
top_pnumberНеобязательноПараметр nucleus sampling.
streambooleanНеобязательноВозвращать ли потоковый ответ.
stream_optionsobjectНеобязательноДополнительные параметры для потоковых ответов.
toolsarray<object>НеобязательноTools, доступные модели.
tool_choicestring | objectНеобязательноУправляет тем, как модель выбирает tools.
response_formatobjectНеобязательноУправляет структурированным выводом, например ответами в виде JSON object.

Тело ответа

ПолеТипОбязательноОписание
idstringОбязательноУникальный идентификатор chat completion.
object"chat.completion"ОбязательноТип объекта, возвращаемого Chat Completions API.
createdintegerОбязательноUnix timestamp создания ответа.
modelstringОбязательноМодель, создавшая ответ.
choicesarray<object>ОбязательноВарианты ответов, возвращаемые моделью.
choices[].message.rolestringОбязательноРоль возвращенного chat message.
choices[].message.contentstringНеобязательноТекстовое содержимое возвращенного chat message.
choices[].finish_reasonstringНеобязательноПричина остановки генерации.
usageobjectНеобязательноИнформация об использовании токенов для chat completion.
usage.prompt_tokensintegerНеобязательноКоличество входных токенов.
usage.completion_tokensintegerНеобязательноКоличество выходных токенов.
usage.total_tokensintegerНеобязательноОбщее количество токенов.
usage.prompt_tokens_detailsobjectНеобязательноДетализация использования входных токенов.
usage.prompt_tokens_details.cached_tokensintegerНеобязательноТокены, обслуженные из кеша.

Введение в модель

DeepSeek deepseek-flash

DeepSeek V4.1 Flash — маршрут модели DeepSeek на OurToken для разработчиков, которым нужно нативное понимание изображений, очень длинный контекст и экономичный production-трафик. Он заменяет снятую с поддержки линейку V4 Flash и вызывается через model ID deepseek-flash.

DeepSeek V4.1 Flash дает командам более дешевый маршрут DeepSeek с контекстным окном 1M токенов, нативным пониманием изображений и выводом до 384K токенов для прикладных задач, где нужны длинные промпты и предсказуемые цены. Используйте DeepSeek V4.1 Flash API, когда хотите тестировать рабочие процессы DeepSeek через единый API OurToken, сохраняя model IDs, логи использования, стоимость cache и проверку цен в одной панели управления.

Почему это выглядит отлично

  • 60% от официальной справочной пиковой цены DeepSeek V4.1 Flash для входных и выходных токенов.
  • OpenAI-совместимая настройка API через тот же endpoint OurToken, который используется другими поддерживаемыми моделями.
  • Контекстное окно 1M токенов с выводом до 384K токенов для длинных документов, репозиториев и multi-turn агентов.
  • Нативное понимание изображений, поэтому vision- и текстовые промпты могут идти в одном запросе.
  • Логи панели управления и видимость использования помогают командам проверять стоимость запросов после запуска.

Ключевые возможности

  • Model ID: deepseek-flash
  • Цена ввода: $0.1800 за 1M токенов на OurToken
  • Цена вывода: $0.7200 за 1M токенов на OurToken
  • Цена cache read: $0.0036 за 1M токенов на OurToken
  • Цена cache write: $0 за 1M токенов на OurToken
  • Поставщик: DeepSeek

Спецификации

ПоставщикDeepSeek
Тип моделиМультимодальная большая языковая модель Mixture-of-Experts (MoE)
Model IDdeepseek-flash
Всего параметров552B (MoE)
Активных параметров8B на вводе / 16B на выводе
Длина контекста1M токенов
Максимальный вывод384K токенов
Режим рассужденияВключен по умолчанию, non-thinking опционально
Ввод изображенийПоддерживается
Цена ввода OurToken$0.1800 / 1M токенов
Цена вывода OurToken$0.7200 / 1M токенов
Цена cache read OurToken$0.0036 / 1M токенов
Цена cache write OurToken$0 / 1M токенов
Официальный пиковый ориентир ввода$0.30 / 1M токенов
Официальный пиковый ориентир вывода$1.20 / 1M токенов
Официальный пиковый ориентир cache read$0.006 / 1M токенов

Возможности DeepSeek V4.1 Flash API

OurToken охватывает доступ к DeepSeek V4.1 Flash API, цены, model ID, ограничения контекста и рабочий процесс разработчика. Этот маршрут сохраняет один key для chat, программирования и agent-трафика, а логи использования и стоимость остаются видимыми.

Единый доступ к API

Вызывайте DeepSeek V4.1 Flash API через тот же OpenAI-совместимый endpoint, который OurToken использует для каждой поддерживаемой модели. Один API key покрывает chat completions, responses и сообщения в стиле Anthropic, поэтому вы можете сравнивать DeepSeek V4.1 Flash с другими маршрутами, не поддерживая отдельный путь интеграции с провайдером.

Прозрачные цены за токены

OurToken указывает цену DeepSeek V4.1 Flash за миллион токенов для ввода, вывода, cache read и cache write рядом с официальной справочной пиковой ценой. Поскольку модель тарифицирует попадания в cache значительно ниже промахов, а внепиковый трафик ниже пикового, проверка этой таблицы до масштабирования помогает прогнозировать расходы.

Контекстное окно 1M

DeepSeek V4.1 Flash поддерживает контекстное окно 1M токенов с выводом до 384K токенов, что подходит для длинных документов, больших репозиториев и multi-turn агентов. На OurToken вы можете отправлять длинные промпты и наблюдать, как цена cache read меняет стоимость повторяющегося контекста.

Vision и мультимодальный ввод

V4.1 Flash — первая сборка Flash от DeepSeek с нативным пониманием изображений, поэтому один вызов deepseek v4.1 flash api может сочетать скриншоты, отсканированные страницы или диаграммы с текстовыми инструкциями. Комбинируйте это с контекстным окном 1M для review документов и визуального QA.

Рассуждение и вызов инструментов

Модель работает в режиме рассуждения по умолчанию и также поддерживает non-thinking режим, tool calls, вывод JSON и структурированные ответы. Такое сочетание подходит ассистентам, которым нужно обдумать задачу, а затем вернуть машиночитаемые данные, которые ваше приложение может проверить.

Agent- и coding-процессы

Направьте coding-агенты вроде Claude Code, Codex CLI или OpenCode на endpoint OurToken и выберите DeepSeek V4.1 Flash как модель. OurToken публикует руководства по настройке для этих инструментов, а Responses API и Anthropic-совместимый endpoint сохраняют работу существующих agent-интеграций.

Как использовать DeepSeek V4.1 Flash на OurToken

Шесть шагов от нового API key до production-трафика: выберите model ID, отправьте первый запрос, сравните цены DeepSeek V4.1 Flash API, затем отслеживайте использование и стоимость.

Создайте API Key

Войдите в OurToken и создайте key на странице API Keys. Скопируйте его в переменные окружения, а не в систему контроля версий, затем убедитесь, что key активен, прежде чем строить остальную интеграцию вокруг DeepSeek V4.1 Flash.

01

Выберите Model ID

Используйте deepseek-flash как значение model для новых интеграций. Если вы уже используете deepseek-v4-flash или deepseek-v4-flash-vision-exp, эти имена по-прежнему разрешаются и обслуживаются V4.1 Flash, поэтому миграцию можно отложить до следующего релизного цикла.

02

Отправьте первый запрос

Направьте клиент на endpoint chat completions OurToken и отправьте короткий промпт, прежде чем усложнять код. Streaming, system prompt и история multi-turn следуют форме запроса OpenAI, поэтому существующему коду SDK обычно нужно изменить только base URL и модель.

03

Сравните цены и стоимость cache

Проверьте таблицу цен DeepSeek V4.1 Flash для ввода, вывода и cache read и учтите, что внепиковый трафик стоит меньше пиковых часов. Затем оцените собственный набор промптов, поскольку именно доля попаданий в cache определяет большую часть счета в agent-нагрузках.

04

Настройте рассуждение и инструменты

Решите, должна ли каждая нагрузка работать в режиме рассуждения или non-thinking, затем определите инструменты и схему JSON, если ответ передается в другую систему. Протестируйте обе настройки на одних и тех же промптах, прежде чем выбрать значение по умолчанию.

05

Отслеживайте использование и стоимость

После запуска следите за логами запросов, количеством токенов и стоимостью по каждой модели в панели управления OurToken. Сравнивайте задержку и качество с маршрутами, которые вы уже используете, и перепроверяйте цены DeepSeek V4.1 Flash API, когда DeepSeek обновляет официальные тарифы.

06

FAQ по DeepSeek V4.1 Flash

Ответы на вопросы разработчиков перед выбором этого маршрута: что это, сколько стоит, какой model ID использовать, что он поддерживает и как изменение V4 Pro влияет на существующий трафик.

01

Что такое DeepSeek V4.1 Flash API?

DeepSeek V4.1 Flash — модель за именем API deepseek-flash, выпущенная September 10, 2026 как новейшая сборка Flash от DeepSeek. Это mixture-of-experts модель на 552B с 8B активных параметров на вводе и 16B на выводе, контекстным окном 1M токенов, выводом до 384K токенов и нативным пониманием изображений. OurToken открывает к ней доступ через единый endpoint.
02

Сколько стоит DeepSeek V4.1 Flash API?

Официальная пиковая цена — $0.30 за миллион входных токенов без попадания в cache, $1.20 за миллион выходных токенов и $0.006 за миллион входных токенов с попаданием в cache, а внепиковые тарифы вдвое ниже. OurToken указывает этот маршрут DeepSeek V4.1 Flash API по 60% от официальной пиковой цены, поэтому смотрите таблицу цен на этой странице, чтобы увидеть суммы по вводу, выводу, cache read и cache write, которые будут вам выставлены.
03

Какой model ID использовать для DeepSeek V4.1 Flash?

Используйте deepseek-flash для новых интеграций; именно это имя публикует DeepSeek. Провайдеры и блоги часто пишут ту же модель как deepseek-v4.1-flash или deepseek v4.1-flash, поэтому такие написания встречаются в сторонней документации, хотя они не являются официальным значением API. Прежние имена deepseek-v4-flash и deepseek-v4-flash-vision-exp по-прежнему разрешаются и обслуживаются V4.1 Flash.
04

Как вызвать DeepSeek V4.1 Flash API на OurToken?

Создайте API key, направьте клиент на endpoint OurToken и передайте deepseek-flash как значение model. Запросы следуют форме chat completions от OpenAI, а responses и сообщения в стиле Anthropic также доступны, если ваш инструментарий уже их использует. Затем сравните задержку, качество и стоимость с вашим текущим маршрутом, прежде чем переводить на него production-трафик.
05

Подходит ли DeepSeek V4.1 Flash для программирования и agent-процессов?

Это разумный выбор по умолчанию для coding-ассистентов и агентов: модель поддерживает tool calls, вывод JSON, контекст 1M токенов для больших репозиториев и режим рассуждения для многошаговых задач. OurToken публикует руководства по настройке для Claude Code, Codex CLI и OpenCode, поэтому вы можете протестировать модель в инструментах, которые команда уже использует. Измеряйте её на собственных промптах.
06

Перестанет ли deepseek-v4-pro работать September 14?

С 12:00 Beijing time September 14, 2026 запросы к deepseek-v4-pro направляются на V4.1 Flash и тарифицируются по цене Flash, поэтому имя продолжает работать, хотя модель за ним меняется. Если вам нужно стабильное поведение, зафиксируйте конкретный model ID и перепроверьте свои промпты после переключения.