- deepseek/deepseek-flash
deepseek/deepseek-flash
1M контекст · $0.1800 / M входные токены · $0.7200 / M выходные токены
DeepSeek V4.1 Flash — маршрут модели DeepSeek на OurToken для разработчиков, которым нужно нативное понимание изображений, очень длинный контекст и экономичный production-трафик. Он заменяет снятую с поддержки линейку V4 Flash и вызывается через model ID deepseek-flash.
Исторические данные о доступности накапливаются со временем. Текущий статус отражает последнюю проверку.
Цены
Оплата по мере использования
Без предварительных платежей — платите только за то, что используете
Использование API
Руководство по доступу к API
Примеры кода
Используйте API endpoint OurToken для этой модели. Примеры ниже используют прямые HTTP-запросы и рекомендуемый endpoint для семейства модели.
curl https://api.ourtoken.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "deepseek-flash",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"max_tokens": 256
}'Справочник Chat Completions API
Создайте ответ чата через endpoint, совместимый с OpenAI Chat Completions. Используйте https://api.ourtoken.ai/v1 как SDK Base URL и POST /chat/completions как endpoint.
Авторизация
| Content-Type | application/json |
| Authorization | Bearer YOUR_API_KEY |
Тело запроса
| Поле | Тип | Обязательно | Описание |
|---|---|---|---|
| model | string | Обязательно | Model ID для вызова. |
| messages | array<object> | Обязательно | Сообщения диалога, отправленные модели. |
| max_tokens | integer | Необязательно | Максимальное число выходных токенов. |
| temperature | number | Необязательно | Температура семплирования. |
| top_p | number | Необязательно | Параметр nucleus sampling. |
| stream | boolean | Необязательно | Возвращать ли потоковый ответ. |
| stream_options | object | Необязательно | Дополнительные параметры для потоковых ответов. |
| tools | array<object> | Необязательно | Tools, доступные модели. |
| tool_choice | string | object | Необязательно | Управляет тем, как модель выбирает tools. |
| response_format | object | Необязательно | Управляет структурированным выводом, например ответами в виде JSON object. |
Тело ответа
| Поле | Тип | Обязательно | Описание |
|---|---|---|---|
| id | string | Обязательно | Уникальный идентификатор chat completion. |
| object | "chat.completion" | Обязательно | Тип объекта, возвращаемого Chat Completions API. |
| created | integer | Обязательно | Unix timestamp создания ответа. |
| model | string | Обязательно | Модель, создавшая ответ. |
| choices | array<object> | Обязательно | Варианты ответов, возвращаемые моделью. |
| choices[].message.role | string | Обязательно | Роль возвращенного chat message. |
| choices[].message.content | string | Необязательно | Текстовое содержимое возвращенного chat message. |
| choices[].finish_reason | string | Необязательно | Причина остановки генерации. |
| usage | object | Необязательно | Информация об использовании токенов для chat completion. |
| usage.prompt_tokens | integer | Необязательно | Количество входных токенов. |
| usage.completion_tokens | integer | Необязательно | Количество выходных токенов. |
| usage.total_tokens | integer | Необязательно | Общее количество токенов. |
| usage.prompt_tokens_details | object | Необязательно | Детализация использования входных токенов. |
| usage.prompt_tokens_details.cached_tokens | integer | Необязательно | Токены, обслуженные из кеша. |
Введение в модель
DeepSeek deepseek-flash
DeepSeek V4.1 Flash — маршрут модели DeepSeek на OurToken для разработчиков, которым нужно нативное понимание изображений, очень длинный контекст и экономичный production-трафик. Он заменяет снятую с поддержки линейку V4 Flash и вызывается через model ID deepseek-flash.
DeepSeek V4.1 Flash дает командам более дешевый маршрут DeepSeek с контекстным окном 1M токенов, нативным пониманием изображений и выводом до 384K токенов для прикладных задач, где нужны длинные промпты и предсказуемые цены. Используйте DeepSeek V4.1 Flash API, когда хотите тестировать рабочие процессы DeepSeek через единый API OurToken, сохраняя model IDs, логи использования, стоимость cache и проверку цен в одной панели управления.
Почему это выглядит отлично
- 60% от официальной справочной пиковой цены DeepSeek V4.1 Flash для входных и выходных токенов.
- OpenAI-совместимая настройка API через тот же endpoint OurToken, который используется другими поддерживаемыми моделями.
- Контекстное окно 1M токенов с выводом до 384K токенов для длинных документов, репозиториев и multi-turn агентов.
- Нативное понимание изображений, поэтому vision- и текстовые промпты могут идти в одном запросе.
- Логи панели управления и видимость использования помогают командам проверять стоимость запросов после запуска.
Ключевые возможности
- Model ID: deepseek-flash
- Цена ввода: $0.1800 за 1M токенов на OurToken
- Цена вывода: $0.7200 за 1M токенов на OurToken
- Цена cache read: $0.0036 за 1M токенов на OurToken
- Цена cache write: $0 за 1M токенов на OurToken
- Поставщик: DeepSeek
Спецификации
Возможности DeepSeek V4.1 Flash API
OurToken охватывает доступ к DeepSeek V4.1 Flash API, цены, model ID, ограничения контекста и рабочий процесс разработчика. Этот маршрут сохраняет один key для chat, программирования и agent-трафика, а логи использования и стоимость остаются видимыми.
Единый доступ к API
Вызывайте DeepSeek V4.1 Flash API через тот же OpenAI-совместимый endpoint, который OurToken использует для каждой поддерживаемой модели. Один API key покрывает chat completions, responses и сообщения в стиле Anthropic, поэтому вы можете сравнивать DeepSeek V4.1 Flash с другими маршрутами, не поддерживая отдельный путь интеграции с провайдером.
Прозрачные цены за токены
OurToken указывает цену DeepSeek V4.1 Flash за миллион токенов для ввода, вывода, cache read и cache write рядом с официальной справочной пиковой ценой. Поскольку модель тарифицирует попадания в cache значительно ниже промахов, а внепиковый трафик ниже пикового, проверка этой таблицы до масштабирования помогает прогнозировать расходы.
Контекстное окно 1M
DeepSeek V4.1 Flash поддерживает контекстное окно 1M токенов с выводом до 384K токенов, что подходит для длинных документов, больших репозиториев и multi-turn агентов. На OurToken вы можете отправлять длинные промпты и наблюдать, как цена cache read меняет стоимость повторяющегося контекста.
Vision и мультимодальный ввод
V4.1 Flash — первая сборка Flash от DeepSeek с нативным пониманием изображений, поэтому один вызов deepseek v4.1 flash api может сочетать скриншоты, отсканированные страницы или диаграммы с текстовыми инструкциями. Комбинируйте это с контекстным окном 1M для review документов и визуального QA.
Рассуждение и вызов инструментов
Модель работает в режиме рассуждения по умолчанию и также поддерживает non-thinking режим, tool calls, вывод JSON и структурированные ответы. Такое сочетание подходит ассистентам, которым нужно обдумать задачу, а затем вернуть машиночитаемые данные, которые ваше приложение может проверить.
Agent- и coding-процессы
Направьте coding-агенты вроде Claude Code, Codex CLI или OpenCode на endpoint OurToken и выберите DeepSeek V4.1 Flash как модель. OurToken публикует руководства по настройке для этих инструментов, а Responses API и Anthropic-совместимый endpoint сохраняют работу существующих agent-интеграций.
Как использовать DeepSeek V4.1 Flash на OurToken
Шесть шагов от нового API key до production-трафика: выберите model ID, отправьте первый запрос, сравните цены DeepSeek V4.1 Flash API, затем отслеживайте использование и стоимость.
Создайте API Key
Войдите в OurToken и создайте key на странице API Keys. Скопируйте его в переменные окружения, а не в систему контроля версий, затем убедитесь, что key активен, прежде чем строить остальную интеграцию вокруг DeepSeek V4.1 Flash.
01Выберите Model ID
Используйте deepseek-flash как значение model для новых интеграций. Если вы уже используете deepseek-v4-flash или deepseek-v4-flash-vision-exp, эти имена по-прежнему разрешаются и обслуживаются V4.1 Flash, поэтому миграцию можно отложить до следующего релизного цикла.
02Отправьте первый запрос
Направьте клиент на endpoint chat completions OurToken и отправьте короткий промпт, прежде чем усложнять код. Streaming, system prompt и история multi-turn следуют форме запроса OpenAI, поэтому существующему коду SDK обычно нужно изменить только base URL и модель.
03Сравните цены и стоимость cache
Проверьте таблицу цен DeepSeek V4.1 Flash для ввода, вывода и cache read и учтите, что внепиковый трафик стоит меньше пиковых часов. Затем оцените собственный набор промптов, поскольку именно доля попаданий в cache определяет большую часть счета в agent-нагрузках.
04Настройте рассуждение и инструменты
Решите, должна ли каждая нагрузка работать в режиме рассуждения или non-thinking, затем определите инструменты и схему JSON, если ответ передается в другую систему. Протестируйте обе настройки на одних и тех же промптах, прежде чем выбрать значение по умолчанию.
05Отслеживайте использование и стоимость
После запуска следите за логами запросов, количеством токенов и стоимостью по каждой модели в панели управления OurToken. Сравнивайте задержку и качество с маршрутами, которые вы уже используете, и перепроверяйте цены DeepSeek V4.1 Flash API, когда DeepSeek обновляет официальные тарифы.
06FAQ по DeepSeek V4.1 Flash
Ответы на вопросы разработчиков перед выбором этого маршрута: что это, сколько стоит, какой model ID использовать, что он поддерживает и как изменение V4 Pro влияет на существующий трафик.