Claude Opus 5.5 đã có trên SeedRouter
DeepSeekTạo văn bản

DeepSeek V4.1 Flash — suy luận nhanh, chi phí thấp, hỗ trợ hình ảnh

DeepSeek V4.1 Flash là mô hình nhanh, chi phí thấp của DeepSeek với ngữ cảnh 1 triệu token và đầu vào hình ảnh. $0.24 / 1M đầu vào, $0.96 / 1M đầu ra mỗi triệu token vào giờ cao điểm; giảm một nửa vào giờ thấp điểm.

Khả dụng$0.24 / 1M đầu vào · $0.96 / 1M đầu ra$0.30 / 1M đầu vào · $1.20 / 1M đầu ra-20%
  • Bật hoặc tắt suy luận
  • Cửa sổ ngữ cảnh 1 triệu token
  • Đầu vào hình ảnh
  • Giá giờ thấp điểm
  • Streaming
Cửa sổ ngữ cảnh
1 triệu token
Đầu ra tối đa
384K token
Các mức suy luận
none, low, high, max
Phát hành
10 thg 9, 2026

Dùng thử DeepSeek V4.1 Flash

Trò chuyện với DeepSeek V4.1 Flash, đính kèm hình ảnh và xem số token cùng chi phí của từng câu trả lời.

Tham số

deepseek-v4.1-flash$0.24 đầu vào · $0.96 đầu ra trên mỗi triệu token (hiện là giờ cao điểm)

Suy luận
Reasoning effort

Khi bật suy luận, temperature không có tác dụng và top_p dưới 0.95 sẽ chạy như 0.95.

Xác suất log

Được chấp nhận, nhưng không trả về xác suất log.

Tổng cộng cuộc trò chuyện$0.000000
Sẵn sàng

Thử một trong những prompt này

Tin nhắn được tính phí từ số dư của bạn theo mức dưới đây, giống như một lệnh gọi API. Yêu cầu thất bại miễn phí.

Đầu ra thực tế của DeepSeek V4.1 Flash

Một prompt, gửi tới DeepSeek V4.1 Flash khi tắt suy luận. Không chỉnh sửa.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.

Được tạo ngày 28/09/2026. Câu trả lời có thể khác nhau giữa các lần chạy.

Giá DeepSeek V4.1 Flash

DeepSeek V4.1 Flash được tính phí theo token từ số dư của bạn, theo mức giá giờ cao điểm hoặc giờ thấp điểm tùy khung giờ. Mức giá dưới đây cập nhật trực tiếp, đúng bằng mức tài khoản của bạn bị tính.

Một yêu cầu điển hình2.000 token đầu vào, 1.000 token đầu ra, giờ cao điểm
$0.0014mỗi yêu cầu
Vào giờ thấp điểm, cùng yêu cầu đó chỉ tốn một nửa.
$20.00 mua được gìToken đầu ra theo mức giá giờ cao điểm
20,833,333token đầu ra
Gấp đôi vào giờ thấp điểm. Đầu vào từ bộ nhớ đệm chỉ tốn một phần nhỏ giá đầu vào.

Kích thước ví dụ chỉ để minh họa và dùng mức giá giờ cao điểm. Hóa đơn của bạn dựa trên số token mà mỗi yêu cầu báo cáo và giờ yêu cầu chạy.

MụcĐược tính làMứcTính phí
Đầu vào, giờ cao điểmToken prompt không trúng bộ nhớ đệm, 01:00–04:00 và 06:00–10:00 UTC, T2–T6$0.24 / 1MMỗi 1 triệu token
Đầu ra, giờ cao điểmToken câu trả lời và suy luận, giờ cao điểm$0.96 / 1MMỗi 1 triệu token
Đầu vào từ bộ nhớ đệm, giờ cao điểmToken prompt trúng bộ nhớ đệm, giờ cao điểm$0.0048 / 1MMỗi 1 triệu token
Đầu vào, giờ thấp điểmToken prompt không trúng bộ nhớ đệm, mọi giờ còn lại, kể cả cuối tuần$0.12 / 1MMỗi 1 triệu token
Đầu ra, giờ thấp điểmToken câu trả lời và suy luận, giờ thấp điểm$0.48 / 1MMỗi 1 triệu token
Đầu vào từ bộ nhớ đệm, giờ thấp điểmToken prompt trúng bộ nhớ đệm, giờ thấp điểm$0.0024 / 1MMỗi 1 triệu token
Yêu cầu thất bạiBất kỳ yêu cầu nào trả về lỗiMiễn phíKhông tính phí

DeepSeek V4.1 Flash là gì?

DeepSeek V4.1 Flash là mô hình nhanh, chi phí thấp của DeepSeek, phát hành ngày 10 tháng 9 năm 2026. Đây là mô hình mixture-of-experts 552B tham số, kích hoạt 8B tham số để đọc và 16B để viết, đọc hình ảnh một cách tự nhiên và nhận tối đa 1 triệu token ngữ cảnh.

Theo mặc định, DeepSeek V4.1 Flash suy luận trước khi trả lời, ở mức high. Tắt suy luận cho các bước nhanh, đơn giản, hoặc nâng lên max cho các vấn đề khó. API của chính DeepSeek gọi mô hình này là deepseek-flash.

ID mô hình: deepseek-v4.1-flash · Đầu vào: văn bản, hình ảnh · Đầu ra: văn bản · Định dạng: Chat Completions, Responses, Anthropic Messages.

ID mô hình
deepseek-v4.1-flash
Cửa sổ ngữ cảnh
1 triệu token
Đầu ra tối đa
384K token
Các mức suy luận
none, low, high, max
Đầu vào
Văn bản, hình ảnh

Hai cách dùng DeepSeek V4.1 Flash

Gọi nó từ mã của bạn, hoặc để agent lập trình của bạn làm điều đó.

API

Gọi nó từ backend của bạn

Tốt nhất cho ứng dụng và dịch vụ

Trỏ OpenAI SDK tới SeedRouter và giữ nguyên mã của bạn. DeepSeek V4.1 Flash hỗ trợ Chat Completions, Responses và Anthropic Messages.

  1. 1Tạo một khóa API
  2. 2Đặt base URL thành https://api.seedrouter.ai/v1
  3. 3Gửi deepseek-v4.1-flash làm mô hình
Agent

Giao cho agent lập trình của bạn

Tốt nhất cho Codex, Claude Code và các agent khác

Sao chép một prompt có sẵn. Agent của bạn hiển thị yêu cầu và chi phí trước khi phát sinh bất kỳ chi phí nào.

  1. 1Sao chép prompt
  2. 2Dán vào agent của bạn
  3. 3Phê duyệt yêu cầu

DeepSeek V4.1 Flash giỏi ở đâu

DeepSeek V4.1 Flash được xây dựng cho khối lượng công việc lớn, nơi tốc độ và chi phí là quan trọng.

Vòng lặp agent

DeepSeek V4.1 Flash chạy nhiều bước giá rẻ, và ngữ cảnh trong bộ nhớ đệm giữ chi phí đọc lặp lại ở mức thấp.

Lập trình hằng ngày

Viết, rà soát và sửa mã với DeepSeek V4.1 Flash trong Codex, Claude Code hoặc công cụ của riêng bạn.

Hình ảnh trong prompt

DeepSeek V4.1 Flash đọc ảnh chụp màn hình, biểu đồ và ảnh qua URL hoặc base64.

Đầu ra có cấu trúc

Yêu cầu DeepSeek V4.1 Flash trả về đầu ra json_object và phân tích câu trả lời trực tiếp.

Bật hoặc tắt suy luận

Bỏ qua suy luận của DeepSeek V4.1 Flash cho câu trả lời nhanh, hoặc tăng lên cho câu hỏi khó.

Giá giờ thấp điểm

Tác vụ hàng loạt chạy ngoài giờ cao điểm chỉ trả một nửa giá cao điểm.

Các nhóm xây dựng gì với DeepSeek V4.1 Flash

Phân loại quy mô lớn

Gắn nhãn ticket, đánh giá và log với DeepSeek V4.1 Flash, tắt suy luận, với chi phí thấp nhất.

Agent lập trình

Chạy DeepSeek V4.1 Flash trong Codex cho các vòng sửa và chạy nhanh, rẻ.

Đọc ảnh chụp màn hình

Chuyển ảnh chụp màn hình và biểu đồ thành văn bản hoặc JSON.

Bắt đầu dùng DeepSeek V4.1 Flash trong bốn bước

  1. 01

    Tạo một khóa

    Đăng nhập và tạo một khóa API. Thêm tín dụng bất cứ khi nào bạn cần; không có đăng ký.

  2. 02

    Thay đổi URL cơ sở

    Trỏ OpenAI SDK tới https://api.seedrouter.ai/v1. Mã của bạn giữ nguyên.

  3. 03

    Chọn DeepSeek V4.1 Flash

    Gửi deepseek-v4.1-flash làm mô hình. Tắt suy luận hoặc đặt mức độ suy luận cho từng yêu cầu.

  4. 04

    Kiểm tra hóa đơn

    Mỗi yêu cầu hiển thị token và phí của nó trong bản ghi sử dụng của bạn.

Lấy một khóa API

Tổng quan DeepSeek V4.1 Flash trên SeedRouter

Điều bạn có thể sử dụng ngày hôm nay.

Tính năngDeepSeek V4.1 Flash
Chat CompletionsCó, định dạng chính thức
ResponsesCó, dùng được với Codex
Anthropic MessagesCó, dùng được với Claude Code
Đầu vào hình ảnhCó, theo URL hoặc base64
StreamingCó
Bộ nhớ đệm ngữ cảnhCó, tự động, lượt trúng bộ nhớ đệm được tính giá thấp hơn
Đầu ra JSONCó, json_object
Yêu cầu thất bạiKhông tính phí

Không hỗ trợ FIM và hoàn thành tiền tố chat (beta), Files API và xác suất log.

Giới hạn của DeepSeek V4.1 Flash

Cửa sổ ngữ cảnh 1 triệu token

Trên DeepSeek V4.1 Flash, prompt, hình ảnh và lịch sử dùng chung một cửa sổ 1 triệu token.

384K token đầu ra

Một yêu cầu DeepSeek V4.1 Flash viết tối đa 393.216 token, bao gồm suy luận.

Lấy mẫu khi bật suy luận

Khi bật suy luận, temperature không có tác dụng và top_p luôn từ 0.95 trở lên.

Kích thước hình ảnh

URL hình ảnh cho DeepSeek V4.1 Flash có thể trỏ tới tệp tối đa 32 MiB.

Vì sao nên gọi DeepSeek V4.1 Flash qua SeedRouter

Một khóa, ba định dạng

Gọi DeepSeek V4.1 Flash bằng Chat Completions, Responses hoặc Anthropic Messages, với cùng một khóa.

Trả theo token

Nạp một lần và sử dụng cho bất kỳ mô hình nào. Không có gói, không có phí hàng tháng.

Lỗi miễn phí

Yêu cầu trả về lỗi không bị tính phí.

Giá trực tiếp

Mức giá trên trang này là mức tài khoản của bạn trả, cả giờ cao điểm lẫn giờ thấp điểm.

Bộ nhớ đệm ngữ cảnh

Các tiền tố prompt lặp lại được đọc từ bộ nhớ đệm với mức giá DeepSeek V4.1 Flash thấp hơn.

Suy luận trả về cùng câu trả lời

Khi bật suy luận, phần suy luận được trả về trong reasoning_content, bên cạnh câu trả lời.

Streaming

Nhận token DeepSeek V4.1 Flash ngay khi chúng được tạo với stream: true.

Mô hình liên quan

Các mô hình khác bạn có thể gọi với cùng một khóa.

Kimi K3
kimi-k3

Gọi Kimi K3 bằng OpenAI SDK hoặc Anthropic SDK. Ngữ cảnh 1 triệu token, suy luận luôn bật với mức low, high hoặc max, giá theo token cập nhật trực tiếp và Playground.

Xem giá
claude-fable-5
claude-fable-5

Anthropic

Xem giá
claude-fable-5-1
claude-fable-5-1

Anthropic

Xem giá
claude-opus-5-5
claude-opus-5-5

Anthropic

Xem giá
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Xem giá
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Xem giá

Hướng dẫn về DeepSeek V4.1 Flash

Hướng dẫn và so sánh cho mô hình này.

API DeepSeek V4.1 Flash: cách lấy key và thực hiện lệnh gọi đầu tiên

Cách dùng API DeepSeek V4.1 Flash: lấy key, gọi bằng OpenAI SDK, bật hoặc tắt chế độ suy nghĩ, streaming, gửi hình ảnh và xử lý các lỗi người mới hay gặp.

Giá API DeepSeek V4.1 Flash: giờ cao điểm, giờ thấp điểm và cache

Giá API DeepSeek V4.1 Flash mỗi triệu token: giá giờ cao điểm và giờ thấp điểm, trúng cache, khung giờ áp dụng, công thức tính phí và chi phí của một yêu cầu.

Dùng DeepSeek V4.1 Flash trong Claude Code và Codex: cấu hình đã kiểm thử

Cách chạy DeepSeek V4.1 Flash làm mô hình trong Claude Code và OpenAI Codex CLI qua SeedRouter: biến môi trường, config.toml và kết quả kiểm thử của chúng tôi.

DeepSeek V4.1 Flash vs V4 Pro: giá, thị giác và benchmark

So sánh DeepSeek V4.1 Flash và DeepSeek V4 Pro về giá mỗi token, đầu vào hình ảnh, giới hạn đồng thời và benchmark do DeepSeek công bố, kèm lựa chọn rõ ràng.

DeepSeek V4.1 Flash vs V4 Flash 0731: điều gì đã thay đổi và vì sao quan trọng

Những thay đổi từ DeepSeek V4 Flash 0731 lên V4.1 Flash: kiến trúc mới, thị giác tự nhiên, bộ nhớ đệm nhỏ hơn, giá thấp hơn, benchmark và nơi các tên cũ chạy.

DeepSeek V4.1 Flash có miễn phí không? Trọng số mở, chi phí API và credit

DeepSeek V4.1 Flash có miễn phí không? Trọng số tải miễn phí, API tính phí theo token với giá thấp, và đây là cách dùng thử gần như không tốn gì hôm nay.

Câu hỏi thường gặp về DeepSeek V4.1 Flash

DeepSeek V4.1 Flash là gì?+

DeepSeek V4.1 Flash là mô hình nhanh, chi phí thấp của DeepSeek, phát hành ngày 10 tháng 9 năm 2026. Đây là mô hình mixture-of-experts 552B tham số với đầu vào hình ảnh gốc, cửa sổ ngữ cảnh 1 triệu token và suy luận có thể bật hoặc tắt.

DeepSeek V4.1 Flash giá bao nhiêu?+

DeepSeek V4.1 Flash được tính phí $0.24 / 1M đầu vào và $0.96 / 1M đầu ra mỗi 1 triệu token vào giờ cao điểm (01:00–04:00 và 06:00–10:00 UTC, thứ Hai đến thứ Sáu). Mọi giờ còn lại là giờ thấp điểm với mức giá bằng một nửa, và lượt trúng bộ nhớ đệm chỉ tốn một phần nhỏ giá đầu vào.

Tôi có thể dùng DeepSeek V4.1 Flash miễn phí không?+

Mỗi tài khoản SeedRouter mới bắt đầu với $0.10 số dư miễn phí, đủ để thử DeepSeek V4.1 Flash với nhiều yêu cầu ngắn. Sau đó bạn trả theo token, không cần gói thuê bao, và yêu cầu thất bại không bị tính phí.

DeepSeek V4.1 Flash có hỗ trợ hình ảnh không?+

Có. DeepSeek V4.1 Flash đọc hình ảnh một cách tự nhiên. Gửi ảnh trong yêu cầu qua URL công khai hoặc dạng base64; mô hình trả về văn bản.

Làm sao để tắt suy luận trong DeepSeek V4.1 Flash?+

Đặt thinking thành disabled, hoặc reasoning_effort thành none. Khi đó câu trả lời đến ngay và dùng ít token đầu ra hơn.

DeepSeek V4.1 Flash có giống DeepSeek V4 Flash không?+

Không. DeepSeek V4.1 Flash đã thay thế V4 Flash vào ngày 10 tháng 9 năm 2026, với kiến trúc mới và đầu vào hình ảnh gốc. DeepSeek đã ngừng V4 Flash và chuyển các tên mô hình cũ sang DeepSeek V4.1 Flash.

Tôi có thể chạy DeepSeek V4.1 Flash cục bộ không?+

Trọng số của mô hình có trên Hugging Face. Với 552B tham số, mô hình cần phần cứng nhiều GPU, nên hầu hết các nhóm gọi DeepSeek V4.1 Flash qua API.

ID mô hình DeepSeek V4.1 Flash là gì và gọi nó thế nào?+

Trên SeedRouter, ID mô hình là deepseek-v4.1-flash. Tạo một khóa API SeedRouter, trỏ OpenAI SDK tới https://api.seedrouter.ai/v1 và gửi deepseek-v4.1-flash làm mô hình.

Tôi có bị tính phí nếu yêu cầu DeepSeek V4.1 Flash thất bại không?+

Không. Yêu cầu DeepSeek V4.1 Flash trả về lỗi sẽ không bị tính phí. Bạn chỉ trả tiền cho số token mà một yêu cầu hoàn tất báo cáo.

Dùng thử DeepSeek V4.1 Flash ngay

Gửi yêu cầu DeepSeek V4.1 Flash đầu tiên từ Playground hoặc từ mã của bạn chỉ trong vài phút.