DeepSeek V4.1 Flash API の使い方:キーの取得と最初の呼び出し
DeepSeek V4.1 Flash API の使い方を解説。API キーの取得、OpenAI SDK での呼び出し、思考モードのオン・オフ、ストリーミング、画像の送信、よくあるエラーの対処。
Markdown で読むDeepSeek V4.1 Flash を呼び出すには、このモデルを提供するプラットフォームの API キーと、モデル ID を指定したリクエストが必要です。DeepSeek 自身の API ではモデル名は deepseek-flash で、旧名称の deepseek-v4-flash と deepseek-v4-flash-vision-exp もこのモデルにルーティングされます。SeedRouter ではモデル ID は deepseek-v4.1-flash で、1 つのキーで公式のリクエスト形式のまま従量課金で呼び出せます。OpenAI SDK の接続先を https://api.seedrouter.ai/v1 に向けるだけで、コードはそのまま使えます。
このガイドでは SeedRouter を使いますが、リクエストボディは DeepSeek 自身の API と同じです。
DeepSeek V4.1 Flash の API キーはどうやって取得する?
- SeedRouter にログインし、API keys を開きます。
- キーを作成してコピーします。キーは一度しか表示されません。
- 必要なときにクレジットを追加します。新規アカウントには少額の無料残高があり、サブスクリプションはありません。
キーは SEEDROUTER_API_KEY などの環境変数に保存し、サーバーサイドのコードからのみ使ってください。
Python から DeepSeek V4.1 Flash を呼び出すには?
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["SEEDROUTER_API_KEY"],
base_url="https://api.seedrouter.ai/v1",
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)思考モードはデフォルトでオンなので、メッセージには content の回答に加えて、reasoning_content にモデルの推論も含まれます。
Node.js や cURL から呼び出すには?
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.SEEDROUTER_API_KEY,
baseURL: "https://api.seedrouter.ai/v1",
});
const completion = await client.chat.completions.create({
model: "deepseek-v4.1-flash",
messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);curl https://api.seedrouter.ai/v1/chat/completions \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'同じキーで、deepseek-v4.1-flash を Responses API(/v1/responses)や Anthropic Messages 形式(/v1/messages)でも呼び出せます。
思考モードをオフにしたり、推論強度を設定したりするには?
思考モードはデフォルトでオンで、推論強度は high です。thinking でオフにするか、reasoning_effort で推論強度を選びます。OpenAI SDK では thinking を extra_body 経由で渡します。1 つ目のリクエストは思考をオフにして最も速く安く回答させ、2 つ目は最も高い推論強度を使います。
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
extra_body={"thinking": {"type": "disabled"}},
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "How many primes are there below 150?"}],
reasoning_effort="max",
)reasoning_effort | 効果 |
|---|---|
none | 思考オフ |
low | 短い推論 |
high(デフォルト) | ほとんどのタスク向け |
max | 最も難しい問題向け |
DeepSeek は minimal(low として実行)、medium と xhigh(high として実行)も受け付けます。素数を数える問題でのテストでは、思考オフで出力 2 トークン、low で 258 トークン、max で 319 トークンでした。推論は出力として課金されます。
回答をストリーミングするには?
stream=True を追加します。思考がオンの場合、まず推論が delta.reasoning_content で届き、続いて回答が delta.content で届きます。最後のチャンクにトークン使用量が含まれます。
stream = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Write a haiku about latency."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)画像は送れる?
送れます。DeepSeek V4.1 Flash はネイティブで画像を読み込めます。image_url パートに公開 URL または base64 の data URI を指定してください。
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"},
],
}],
)画像 URL は最大 8,192 文字で、指す先のファイルは最大 32 MiB です。
よくあるエラーとその対処法は?
| エラー | 原因 | 対処 |
|---|---|---|
response_format で 400 | json_schema は非対応 | {"type": "json_object"} を使い、構造はプロンプトで説明する |
temperature または top_p で 400 | 2 または 1 を超えている | 範囲内に収める。思考オンの場合はそもそも効果がほとんどない |
| 画像 URL で 400 | ファイルを画像としてダウンロードできない | URL が公開されていて画像を指しているか確認する |
| 401 | キーがない、または間違っている | Authorization ヘッダーを確認する |
エラーは {"error": {"code": ..., "message": "..."}} の形で返り、失敗したリクエストには課金されません。
よくある質問
DeepSeek V4.1 Flash API は OpenAI 互換?
はい。Chat Completions と Responses の形式に対応しているので、ベース URL とモデルを変えるだけで OpenAI SDK が使えます。Anthropic Messages 形式にも対応しています。
モデル ID が DeepSeek のものと違うのはなぜ?
DeepSeek は自身の API でこのモデルを deepseek-flash と名付けています。SeedRouter では、バージョンが名前に含まれるよう deepseek-v4.1-flash を使っています。それ以外のリクエストボディは同じです。
DeepSeek V4.1 Flash のリクエスト 1 回の料金は?
トークン単位で課金され、時間帯に応じてピーク時間帯またはオフピーク時間帯の料金が適用されます。DeepSeek V4.1 Flash 料金ガイド にリアルタイムの料金と計算例があります。
パラメーターの一覧はどこにある?
DeepSeek V4.1 Flash API リファレンス にすべてのフィールドが載っています。Playground とリアルタイムの料金は DeepSeek V4.1 Flash のページ で確認できます。



