DeepSeek V4.1 Flash — 画像にも対応した高速・低価格の推論
DeepSeek V4.1 Flash は DeepSeek の高速・低価格モデルで、100万トークンのコンテキストと画像入力に対応します。ピーク時間帯は $0.24 / 1M 入力・$0.96 / 1M 出力(100万トークンあたり)、オフピーク時間帯はその半額です。
- 思考のオン/オフ
- 100万トークンコンテキスト
- 画像入力
- オフピーク時間帯の料金
- ストリーミング
DeepSeek V4.1 Flash を試す
DeepSeek V4.1 Flash とチャットし、画像を添付して、各回答のトークン数と料金を確認できます。
deepseek-v4.1-flash$0.24 入力 · $0.96 出力、100万トークンあたり (現在はピーク時間帯)
思考がオンのとき、temperature は効果がなく、0.95 未満の top_p は 0.95 として実行されます。
パラメータは受け付けますが、対数確率は返されません。
DeepSeek V4.1 Flash の実際の出力
1 つのプロンプトを思考オフで DeepSeek V4.1 Flash に送信した結果です。無編集。
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.
2026-09-28 に生成。回答は実行ごとに異なります。
DeepSeek V4.1 Flash の料金
DeepSeek V4.1 Flash は残高からトークン単位で課金され、時間帯に応じてピーク時間帯またはオフピーク時間帯のレートが適用されます。下記のレートはリアルタイムで、あなたのアカウントに実際に請求されるものと同じです。
例のサイズは説明用で、ピーク時間帯のレートで計算しています。請求は各リクエストが報告するトークン数と、実行された時間帯に従います。
| 項目 | カウント方法 | 料金 | 課金単位 |
|---|---|---|---|
| 入力(ピーク時間帯) | キャッシュにヒットしないプロンプトトークン、UTC 月〜金 01:00–04:00 と 06:00–10:00 | $0.24 / 1M | 100万トークンあたり |
| 出力(ピーク時間帯) | ピーク時間帯の回答と推論のトークン | $0.96 / 1M | 100万トークンあたり |
| キャッシュ入力(ピーク時間帯) | ピーク時間帯にキャッシュにヒットしたプロンプトトークン | $0.0048 / 1M | 100万トークンあたり |
| 入力(オフピーク時間帯) | キャッシュにヒットしないプロンプトトークン、それ以外のすべての時間帯(週末を含む) | $0.12 / 1M | 100万トークンあたり |
| 出力(オフピーク時間帯) | オフピーク時間帯の回答と推論のトークン | $0.48 / 1M | 100万トークンあたり |
| キャッシュ入力(オフピーク時間帯) | オフピーク時間帯にキャッシュにヒットしたプロンプトトークン | $0.0024 / 1M | 100万トークンあたり |
| 失敗したリクエスト | エラーを返すリクエスト | 無料 | 課金されません |
DeepSeek V4.1 Flash とは?
DeepSeek V4.1 Flash は DeepSeek の高速・低価格モデルで、2026年9月10日にリリースされました。5,520億パラメータの Mixture of Experts(MoE)モデルで、読み込みに 80億、書き出しに 160億のパラメータをアクティブにし、画像をネイティブに読み取り、最大 100万トークンのコンテキストを受け付けます。
DeepSeek V4.1 Flash はデフォルトで、推論強度 high で考えてから回答します。高速でシンプルなステップには思考をオフにし、難しい問題には推論強度を max に上げてください。DeepSeek 自身の API では、このモデルは deepseek-flash と呼ばれています。
モデル ID:deepseek-v4.1-flash · 入力:テキスト、画像 · 出力:テキスト · 形式:Chat Completions、Responses、Anthropic Messages。
DeepSeek V4.1 Flash の 2 つの使い方
コードから呼び出すか、コーディングエージェントに任せるか。
バックエンドから呼び出す
OpenAI SDK の向き先を SeedRouter に変えるだけで、コードはそのまま使えます。DeepSeek V4.1 Flash は Chat Completions、Responses、Anthropic Messages の各形式に対応します。
- 1API キーを作成
- 2ベース URL を https://api.seedrouter.ai/v1 に設定
- 3モデルとして deepseek-v4.1-flash を送信
コーディングエージェントに任せる
すぐに使えるプロンプトをコピー。費用が発生する前に、エージェントがリクエスト内容と料金を表示します。
- 1プロンプトをコピー
- 2エージェントに貼り付け
- 3実行を承認
DeepSeek V4.1 Flash が得意なこと
DeepSeek V4.1 Flash は、速度と料金が重要な大量処理のためのモデルです。
エージェントループ
DeepSeek V4.1 Flash は安価なステップを大量に実行し、キャッシュされたコンテキストで繰り返しの読み込みも安く抑えます。
日常のコーディング
Codex、Claude Code、または独自のツールで、DeepSeek V4.1 Flash を使ってコードを書き、レビューし、修正します。
プロンプト内の画像
DeepSeek V4.1 Flash は URL または base64 で渡したスクリーンショット、グラフ、写真を読み取ります。
構造化出力
DeepSeek V4.1 Flash に json_object で出力させれば、回答をそのままパースできます。
思考のオン/オフ
素早い回答には DeepSeek V4.1 Flash の推論を省き、難しい問題では強めます。
オフピーク時間帯のレート
ピーク時間帯以外に実行するバッチジョブは、ピーク料金の半額で済みます。
DeepSeek V4.1 Flash でチームが構築しているもの
大規模な分類
思考をオフにした DeepSeek V4.1 Flash で、チケット、レビュー、ログを最も安くタグ付けします。
コーディングエージェント
Codex で DeepSeek V4.1 Flash を実行し、素早く安価な「編集と実行」のループを回します。
スクリーンショットの読み取り
スクリーンショットやグラフをテキストや JSON に変換します。
DeepSeek V4.1 Flash を 4 ステップで使い始める
- 01
キーを作成
ログインして API キーを作成。必要なときにクレジットを追加。サブスクリプションはありません。
- 02
ベース URL を変更
OpenAI SDK の向き先を https://api.seedrouter.ai/v1 に変更。コードはそのままです。
- 03
DeepSeek V4.1 Flash を選択
モデルとして deepseek-v4.1-flash を送信。リクエストごとに思考をオフにしたり、推論強度を設定したりできます。
- 04
請求を確認
各リクエストのトークン数と請求額は、利用履歴で確認できます。
SeedRouter の DeepSeek V4.1 Flash 早見表
今日使えるもの。
| 機能 | DeepSeek V4.1 Flash |
|---|---|
| Chat Completions | はい、公式形式 |
| Responses | はい、Codex で使えます |
| Anthropic Messages | はい、Claude Code で使えます |
| 画像入力 | はい、URL または base64 |
| ストリーミング | はい |
| コンテキストキャッシュ | はい、自動で適用され、キャッシュヒットは低いレートで課金 |
| JSON 出力 | はい、json_object |
| 失敗したリクエスト | 課金されません |
FIM とチャットプレフィックス補完(ベータ)、Files API、対数確率は提供していません。
DeepSeek V4.1 Flash の制限
100万トークンコンテキスト
DeepSeek V4.1 Flash では、プロンプト、画像、履歴が 1 つの 100万トークンのウィンドウを共有します。
最大 384K トークン出力
DeepSeek V4.1 Flash の 1 リクエストは、推論を含めて最大 393,216 トークンを出力します。
思考オン時のサンプリング
思考がオンのとき、temperature は効果がなく、top_p は 0.95 以上に保たれます。
画像サイズ
DeepSeek V4.1 Flash の画像 URL では、最大 32 MiB のファイルを指定できます。
SeedRouter で DeepSeek V4.1 Flash を呼び出す理由
1 本のキー、3 つの形式
DeepSeek V4.1 Flash を Chat Completions、Responses、Anthropic Messages で呼び出せます。すべて同じキーです。
トークン単位で支払い
1 回チャージすれば、どのモデルにも使えます。プランなし、月額料金なし。
失敗は無料
エラーになったリクエストは課金されません。
リアルタイム料金
このページのピーク時間帯・オフピーク時間帯の料金が、あなたのアカウントに実際に適用される料金です。
コンテキストキャッシュ
繰り返し使うプロンプトの先頭部分はキャッシュから読み込まれ、DeepSeek V4.1 Flash の低いレートで課金されます。
回答と一緒に推論を返す
思考がオンのとき、推論は回答と並べて reasoning_content に返されます。
ストリーミング
stream: true で、DeepSeek V4.1 Flash のトークンを生成され次第受け取れます。
関連モデル
同じキーで呼び出せる他のモデル。
Kimi K3 を OpenAI・Anthropic SDK で呼び出し。100万トークンのコンテキスト、常時オンの推論(low・high・max)、トークン単位のリアルタイム料金、Playground。
料金を見るDeepSeek V4.1 Flash ガイド
このモデルの解説と比較。
DeepSeek V4.1 Flash API の使い方を解説。API キーの取得、OpenAI SDK での呼び出し、思考モードのオン・オフ、ストリーミング、画像の送信、よくあるエラーの対処。
DeepSeek V4.1 Flash の API 料金を 100万トークンあたりで解説。ピーク時間帯とオフピーク時間帯の料金、キャッシュヒット、適用時間、課金計算式、リクエストのコスト。
SeedRouter 経由で DeepSeek V4.1 Flash を Claude Code と OpenAI Codex CLI のモデルとして使う方法。環境変数、config.toml の設定と、テスト結果を紹介します。
DeepSeek V4.1 Flash と DeepSeek V4 Pro を、トークン単価、画像入力、同時実行数、DeepSeek 公表のベンチマークで比較。用途ごとにどちらを選ぶべきかも明確に示します。
DeepSeek V4 Flash 0731 から V4.1 Flash への変更点:新アーキテクチャ、ネイティブの画像入力、小さくなったキャッシュ、値下げ、ベンチマーク、旧モデル名の行き先。
DeepSeek V4.1 Flash は無料?ウェイトは無料でダウンロードでき、API はトークン単位の低料金で課金されます。今日ほぼ無料で試す方法も紹介します。
DeepSeek V4.1 Flash のよくある質問
DeepSeek V4.1 Flash とは?+
DeepSeek V4.1 Flash は DeepSeek の高速・低価格モデルで、2026年9月10日にリリースされました。5,520億パラメータの Mixture of Experts(MoE)モデルで、画像入力にネイティブ対応し、100万トークンのコンテキストウィンドウを持ち、思考のオン/オフを切り替えられます。
DeepSeek V4.1 Flash の料金はいくらですか?+
DeepSeek V4.1 Flash は、ピーク時間帯(UTC 月曜〜金曜の 01:00–04:00 と 06:00–10:00)に 100万トークンあたり $0.24 / 1M 入力・$0.96 / 1M 出力で課金されます。それ以外の時間帯はすべてオフピーク時間帯で料金は半額、キャッシュヒットは入力料金のごく一部です。
DeepSeek V4.1 Flash は無料で使えますか?+
SeedRouter の新規アカウントには $0.10 の無料残高が付与され、短いリクエストを多数送って DeepSeek V4.1 Flash を試すのに十分です。その後はトークン単位で支払います。サブスクリプションはなく、失敗したリクエストは課金されません。
DeepSeek V4.1 Flash は画像に対応していますか?+
はい。DeepSeek V4.1 Flash は画像をネイティブに読み取ります。リクエスト内で公開 URL または base64 として送信でき、出力はテキストです。
DeepSeek V4.1 Flash の思考をオフにするには?+
thinking を disabled にするか、reasoning_effort を none に設定します。すると回答がすぐに返り、出力トークンも少なくなります。
DeepSeek V4.1 Flash と DeepSeek V4 Flash は同じですか?+
いいえ。DeepSeek V4.1 Flash は 2026年9月10日に V4 Flash の後継となり、新しいアーキテクチャと画像入力へのネイティブ対応を備えています。DeepSeek は V4 Flash を廃止し、旧モデル名を DeepSeek V4.1 Flash に振り向けています。
DeepSeek V4.1 Flash はローカルで実行できますか?+
重みは Hugging Face で公開されています。5,520億パラメータのため複数 GPU のハードウェアが必要で、ほとんどのチームは API で DeepSeek V4.1 Flash を呼び出しています。
DeepSeek V4.1 Flash のモデル ID と呼び出し方は?+
SeedRouter でのモデル ID は deepseek-v4.1-flash です。SeedRouter の API キーを作成し、OpenAI SDK の向き先を https://api.seedrouter.ai/v1 に変更して、モデルに deepseek-v4.1-flash を指定します。
DeepSeek V4.1 Flash のリクエストが失敗した場合、課金されますか?+
いいえ。エラーを返した DeepSeek V4.1 Flash リクエストは課金されません。支払うのは、完了したリクエストが報告するトークン分だけです。
DeepSeek V4.1 Flash を今すぐ試す
Playground またはあなたのコードから、数分で最初の DeepSeek V4.1 Flash リクエストを送信できます。
