Claude Opus 5.5을(를) SeedRouter에서 사용할 수 있습니다

DeepSeek V4.1 Flash API 사용방법: 키 발급과 첫 호출

DeepSeek V4.1 Flash API 사용방법: 키 발급, OpenAI SDK로 호출, 사고 모드 켜기와 끄기, 스트리밍, 이미지 전송, 자주 겪는 오류 해결까지 정리했습니다.

Markdown으로 읽기

DeepSeek V4.1 Flash를 호출하려면 이 모델을 제공하는 플랫폼의 API 키와, 모델 ID를 지정한 요청이 필요합니다. DeepSeek 자체 API에서 모델 이름은 deepseek-flash이며, 이전 이름인 deepseek-v4-flash와 deepseek-v4-flash-vision-exp도 이 모델로 라우팅됩니다. SeedRouter에서는 모델 ID가 deepseek-v4.1-flash이고, 키 하나로 공식 요청 형식 그대로 사용한 만큼 결제하며 호출할 수 있습니다. OpenAI SDK를 https://api.seedrouter.ai/v1로 연결하면 코드는 그대로 쓸 수 있습니다.

이 가이드는 SeedRouter를 사용하며, 요청 본문은 DeepSeek 자체 API와 같습니다.

DeepSeek V4.1 Flash API 키는 어떻게 발급받나요?

  1. SeedRouter에 로그인하고 API keys를 엽니다.
  2. 키를 만들고 복사합니다. 키는 한 번만 표시됩니다.
  3. 필요할 때 크레딧을 충전합니다. 신규 계정에는 소액의 무료 잔액이 제공되며, 구독은 없습니다.

키는 SEEDROUTER_API_KEY 같은 환경 변수에 보관하고, 서버 측 코드에서만 사용하세요.

Python에서 DeepSeek V4.1 Flash를 호출하려면 어떻게 하나요?

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["SEEDROUTER_API_KEY"],
    base_url="https://api.seedrouter.ai/v1",
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)

사고 모드는 기본적으로 켜져 있으므로, 메시지에는 content의 답변 외에 reasoning_content에 모델의 추론도 함께 담깁니다.

Node.js나 cURL로는 어떻게 호출하나요?

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.SEEDROUTER_API_KEY,
  baseURL: "https://api.seedrouter.ai/v1",
});

const completion = await client.chat.completions.create({
  model: "deepseek-v4.1-flash",
  messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);
curl https://api.seedrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'

같은 키로 deepseek-v4.1-flash를 Responses API(/v1/responses)와 Anthropic Messages 형식(/v1/messages)으로도 호출할 수 있습니다.

사고 모드를 끄거나 추론 강도를 설정하려면 어떻게 하나요?

사고 모드는 기본적으로 켜져 있으며 추론 강도는 high입니다. thinking으로 끄거나 reasoning_effort로 추론 강도를 선택합니다. OpenAI SDK에서는 thinking을 extra_body로 전달합니다. 첫 번째 요청은 사고를 꺼서 가장 빠르고 저렴하게 답변하고, 두 번째 요청은 가장 높은 추론 강도를 사용합니다.

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
    extra_body={"thinking": {"type": "disabled"}},
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "How many primes are there below 150?"}],
    reasoning_effort="max",
)
reasoning_effort효과
none사고 끔
low짧은 추론
high(기본값)대부분의 작업
max가장 어려운 문제

DeepSeek는 minimal(low로 실행), medium과 xhigh(high로 실행)도 받습니다. 소수 개수를 세는 문제로 테스트한 결과, 사고를 끄면 출력 토큰 2개, low는 258개, max는 319개를 사용했습니다. 추론은 출력으로 청구됩니다.

답변을 스트리밍하려면 어떻게 하나요?

stream=True를 추가합니다. 사고가 켜져 있으면 추론이 먼저 delta.reasoning_content로 도착하고, 이어서 답변이 delta.content로 도착하며, 마지막 청크에 토큰 사용량이 담깁니다.

stream = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Write a haiku about latency."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

이미지를 보낼 수 있나요?

네. DeepSeek V4.1 Flash는 이미지를 기본적으로 읽을 수 있습니다. image_url 파트에 공개 URL이나 base64 data URI를 넣어 보내세요.

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{
        "role": "user",
        "content": [
            {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
            {"type": "text", "text": "What does this chart show?"},
        ],
    }],
)

이미지 URL은 최대 8,192자까지 가능하며, 최대 32 MiB 크기의 파일을 가리킬 수 있습니다.

어떤 오류가 발생할 수 있나요?

오류원인해결 방법
response_format에서 400json_schema는 지원되지 않음{"type": "json_object"}를 사용하고 구조는 프롬프트에서 설명
temperature 또는 top_p에서 4002 또는 1을 초과함범위 안으로 유지. 사고가 켜져 있으면 어차피 영향이 거의 없음
이미지 URL에서 400파일을 이미지로 다운로드할 수 없음URL이 공개되어 있고 이미지를 가리키는지 확인
401키가 없거나 잘못됨Authorization 헤더 확인

오류는 {"error": {"code": ..., "message": "..."}} 형태로 반환되며, 실패한 요청은 청구되지 않습니다.

자주 묻는 질문

DeepSeek V4.1 Flash API는 OpenAI와 호환되나요?

네. Chat Completions와 Responses 형식을 받으므로, base URL과 모델만 바꾸면 OpenAI SDK가 작동합니다. Anthropic Messages 형식도 받습니다.

모델 ID가 DeepSeek와 다른 이유는 무엇인가요?

DeepSeek는 자체 API에서 이 모델을 deepseek-flash라고 부릅니다. SeedRouter는 버전이 이름에 들어가도록 deepseek-v4.1-flash를 사용합니다. 그 외 요청 본문은 같습니다.

DeepSeek V4.1 Flash 요청 한 번은 얼마인가요?

토큰 단위로 청구되며, 시간대에 따라 피크 시간대 또는 오프피크 시간대 요금이 적용됩니다. DeepSeek V4.1 Flash 요금 가이드에서 실시간 요금과 계산 예시를 확인하세요.

전체 파라미터 목록은 어디에 있나요?

DeepSeek V4.1 Flash API 문서에 모든 필드가 나와 있으며, DeepSeek V4.1 Flash 페이지에서 Playground와 실시간 가격을 확인할 수 있습니다.

관련 가이드