Claude Opus 5.5 уже доступна в SeedRouter

DeepSeek V4.1 Flash API: как получить ключ и сделать первый вызов

Как пользоваться DeepSeek V4.1 Flash API: ключ, вызов через OpenAI SDK, включение и отключение рассуждения, стриминг, изображения и частые ошибки.

Читать в Markdown

Чтобы вызвать DeepSeek V4.1 Flash, нужен API-ключ от платформы, которая её предоставляет, и запрос с её ID модели. В собственном API DeepSeek модель называется deepseek-flash, а старые имена deepseek-v4-flash и deepseek-v4-flash-vision-exp перенаправляются на неё. В SeedRouter ID модели — deepseek-v4.1-flash, и один ключ вызывает её с оплатой по факту использования в официальном формате запросов: направьте OpenAI SDK на https://api.seedrouter.ai/v1 и оставьте свой код как есть.

В этом руководстве используется SeedRouter; тела запросов такие же, как в собственном API DeepSeek.

Как получить API-ключ DeepSeek V4.1 Flash?

  1. Войдите в SeedRouter и откройте API keys.
  2. Создайте ключ и скопируйте его; он показывается один раз.
  3. Пополняйте баланс, когда нужно. Новые аккаунты начинают с небольшого бесплатного баланса, подписки нет.

Храните ключ в переменной окружения, например SEEDROUTER_API_KEY, и используйте его только в серверном коде.

Как вызвать DeepSeek V4.1 Flash из Python?

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["SEEDROUTER_API_KEY"],
    base_url="https://api.seedrouter.ai/v1",
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)

Рассуждение по умолчанию включено, поэтому сообщение содержит также рассуждение модели в reasoning_content, рядом с ответом в content.

Как вызвать её из Node.js или cURL?

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.SEEDROUTER_API_KEY,
  baseURL: "https://api.seedrouter.ai/v1",
});

const completion = await client.chat.completions.create({
  model: "deepseek-v4.1-flash",
  messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);
curl https://api.seedrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'

Тот же ключ работает и с Responses API (/v1/responses), и с форматом Anthropic Messages (/v1/messages) для deepseek-v4.1-flash.

Как отключить рассуждение или задать уровень рассуждения?

Рассуждение по умолчанию включено с уровнем high. Отключите его через thinking или выберите уровень рассуждения через reasoning_effort. OpenAI SDK передаёт thinking через extra_body. Первый запрос отключает рассуждение ради самого быстрого и дешёвого ответа; второй использует максимальный уровень рассуждения:

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
    extra_body={"thinking": {"type": "disabled"}},
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "How many primes are there below 150?"}],
    reasoning_effort="max",
)
reasoning_effortЭффект
noneРассуждение отключено
lowКороткое рассуждение
high (по умолчанию)Большинство задач
maxСамые сложные задачи

DeepSeek также принимает minimal (работает как low), medium и xhigh (работают как high). В нашем тесте на задаче подсчёта простых чисел без рассуждения было использовано 2 выходных токена, с low — 258, с max — 319. Рассуждение оплачивается как вывод.

Как получать ответ в режиме стриминга?

Добавьте stream=True. При включённом рассуждении сначала приходит рассуждение в delta.reasoning_content, затем ответ в delta.content, а последний чанк содержит расход токенов:

stream = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Write a haiku about latency."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Можно ли отправлять изображения?

Да. DeepSeek V4.1 Flash читает изображения нативно. Отправьте публичный URL или data URI в base64 в части image_url:

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{
        "role": "user",
        "content": [
            {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
            {"type": "text", "text": "What does this chart show?"},
        ],
    }],
)

URL изображения может быть длиной до 8 192 символов и указывать на файл размером до 32 MiB.

Какие ошибки можно встретить?

ОшибкаПричинаРешение
400 на response_formatjson_schema не поддерживаетсяИспользуйте {"type": "json_object"} и опишите структуру в промпте
400 на temperature или top_pБольше 2 или больше 1Держите значения в допустимом диапазоне; при включённом рассуждении они всё равно мало влияют
400 на URL изображенияФайл не удалось загрузить как изображениеПроверьте, что URL публичный и указывает на изображение
401Ключ отсутствует или неверенПроверьте заголовок Authorization

Ошибки возвращаются в виде {"error": {"code": ..., "message": "..."}}, а неудачный запрос не оплачивается.

Часто задаваемые вопросы

Совместим ли DeepSeek V4.1 Flash API с OpenAI?

Да. Он принимает форматы Chat Completions и Responses, поэтому OpenAI SDK работает, если поменять только базовый URL и модель. Также поддерживается формат Anthropic Messages.

Почему ID модели отличается от DeepSeek?

В собственном API DeepSeek модель называется deepseek-flash. SeedRouter использует deepseek-v4.1-flash, чтобы версия была частью имени. В остальном тело запроса такое же.

Сколько стоит запрос к DeepSeek V4.1 Flash?

Оплата идёт за токены, по тарифам часов пик или непиковых часов в зависимости от времени. В руководстве по ценам DeepSeek V4.1 Flash есть актуальные тарифы и расчёты на примерах.

Где полный список параметров?

В справочнике API DeepSeek V4.1 Flash перечислены все поля, а на странице DeepSeek V4.1 Flash есть playground и актуальные цены.

Похожие руководства