Claude Opus 5.5 が SeedRouter で利用できます

DeepSeek V4.1 Flash API の使い方:キーの取得と最初の呼び出し

DeepSeek V4.1 Flash API の使い方を解説。API キーの取得、OpenAI SDK での呼び出し、思考モードのオン・オフ、ストリーミング、画像の送信、よくあるエラーの対処。

Markdown で読む

DeepSeek V4.1 Flash を呼び出すには、このモデルを提供するプラットフォームの API キーと、モデル ID を指定したリクエストが必要です。DeepSeek 自身の API ではモデル名は deepseek-flash で、旧名称の deepseek-v4-flash と deepseek-v4-flash-vision-exp もこのモデルにルーティングされます。SeedRouter ではモデル ID は deepseek-v4.1-flash で、1 つのキーで公式のリクエスト形式のまま従量課金で呼び出せます。OpenAI SDK の接続先を https://api.seedrouter.ai/v1 に向けるだけで、コードはそのまま使えます。

このガイドでは SeedRouter を使いますが、リクエストボディは DeepSeek 自身の API と同じです。

DeepSeek V4.1 Flash の API キーはどうやって取得する?

  1. SeedRouter にログインし、API keys を開きます。
  2. キーを作成してコピーします。キーは一度しか表示されません。
  3. 必要なときにクレジットを追加します。新規アカウントには少額の無料残高があり、サブスクリプションはありません。

キーは SEEDROUTER_API_KEY などの環境変数に保存し、サーバーサイドのコードからのみ使ってください。

Python から DeepSeek V4.1 Flash を呼び出すには?

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["SEEDROUTER_API_KEY"],
    base_url="https://api.seedrouter.ai/v1",
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)

思考モードはデフォルトでオンなので、メッセージには content の回答に加えて、reasoning_content にモデルの推論も含まれます。

Node.js や cURL から呼び出すには?

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.SEEDROUTER_API_KEY,
  baseURL: "https://api.seedrouter.ai/v1",
});

const completion = await client.chat.completions.create({
  model: "deepseek-v4.1-flash",
  messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);
curl https://api.seedrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'

同じキーで、deepseek-v4.1-flash を Responses API(/v1/responses)や Anthropic Messages 形式(/v1/messages)でも呼び出せます。

思考モードをオフにしたり、推論強度を設定したりするには?

思考モードはデフォルトでオンで、推論強度は high です。thinking でオフにするか、reasoning_effort で推論強度を選びます。OpenAI SDK では thinking を extra_body 経由で渡します。1 つ目のリクエストは思考をオフにして最も速く安く回答させ、2 つ目は最も高い推論強度を使います。

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
    extra_body={"thinking": {"type": "disabled"}},
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "How many primes are there below 150?"}],
    reasoning_effort="max",
)
reasoning_effort効果
none思考オフ
low短い推論
high(デフォルト)ほとんどのタスク向け
max最も難しい問題向け

DeepSeek は minimal(low として実行)、medium と xhigh(high として実行)も受け付けます。素数を数える問題でのテストでは、思考オフで出力 2 トークン、low で 258 トークン、max で 319 トークンでした。推論は出力として課金されます。

回答をストリーミングするには?

stream=True を追加します。思考がオンの場合、まず推論が delta.reasoning_content で届き、続いて回答が delta.content で届きます。最後のチャンクにトークン使用量が含まれます。

stream = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Write a haiku about latency."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

画像は送れる?

送れます。DeepSeek V4.1 Flash はネイティブで画像を読み込めます。image_url パートに公開 URL または base64 の data URI を指定してください。

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{
        "role": "user",
        "content": [
            {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
            {"type": "text", "text": "What does this chart show?"},
        ],
    }],
)

画像 URL は最大 8,192 文字で、指す先のファイルは最大 32 MiB です。

よくあるエラーとその対処法は?

エラー原因対処
response_format で 400json_schema は非対応{"type": "json_object"} を使い、構造はプロンプトで説明する
temperature または top_p で 4002 または 1 を超えている範囲内に収める。思考オンの場合はそもそも効果がほとんどない
画像 URL で 400ファイルを画像としてダウンロードできないURL が公開されていて画像を指しているか確認する
401キーがない、または間違っているAuthorization ヘッダーを確認する

エラーは {"error": {"code": ..., "message": "..."}} の形で返り、失敗したリクエストには課金されません。

よくある質問

DeepSeek V4.1 Flash API は OpenAI 互換?

はい。Chat Completions と Responses の形式に対応しているので、ベース URL とモデルを変えるだけで OpenAI SDK が使えます。Anthropic Messages 形式にも対応しています。

モデル ID が DeepSeek のものと違うのはなぜ?

DeepSeek は自身の API でこのモデルを deepseek-flash と名付けています。SeedRouter では、バージョンが名前に含まれるよう deepseek-v4.1-flash を使っています。それ以外のリクエストボディは同じです。

DeepSeek V4.1 Flash のリクエスト 1 回の料金は?

トークン単位で課金され、時間帯に応じてピーク時間帯またはオフピーク時間帯の料金が適用されます。DeepSeek V4.1 Flash 料金ガイド にリアルタイムの料金と計算例があります。

パラメーターの一覧はどこにある?

DeepSeek V4.1 Flash API リファレンス にすべてのフィールドが載っています。Playground とリアルタイムの料金は DeepSeek V4.1 Flash のページ で確認できます。

関連ガイド