DeepSeek V4.1 Flash — suy luận nhanh, chi phí thấp, hỗ trợ hình ảnh
DeepSeek V4.1 Flash là mô hình nhanh, chi phí thấp của DeepSeek với ngữ cảnh 1 triệu token và đầu vào hình ảnh. $0.24 / 1M đầu vào, $0.96 / 1M đầu ra mỗi triệu token vào giờ cao điểm; giảm một nửa vào giờ thấp điểm.
- Bật hoặc tắt suy luận
- Cửa sổ ngữ cảnh 1 triệu token
- Đầu vào hình ảnh
- Giá giờ thấp điểm
- Streaming
Dùng thử DeepSeek V4.1 Flash
Trò chuyện với DeepSeek V4.1 Flash, đính kèm hình ảnh và xem số token cùng chi phí của từng câu trả lời.
deepseek-v4.1-flash$0.24 đầu vào · $0.96 đầu ra trên mỗi triệu token (hiện là giờ cao điểm)
Khi bật suy luận, temperature không có tác dụng và top_p dưới 0.95 sẽ chạy như 0.95.
Được chấp nhận, nhưng không trả về xác suất log.
Thử một trong những prompt này
Tin nhắn được tính phí từ số dư của bạn theo mức dưới đây, giống như một lệnh gọi API. Yêu cầu thất bại miễn phí.
Đầu ra thực tế của DeepSeek V4.1 Flash
Một prompt, gửi tới DeepSeek V4.1 Flash khi tắt suy luận. Không chỉnh sửa.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.
Được tạo ngày 28/09/2026. Câu trả lời có thể khác nhau giữa các lần chạy.
Giá DeepSeek V4.1 Flash
DeepSeek V4.1 Flash được tính phí theo token từ số dư của bạn, theo mức giá giờ cao điểm hoặc giờ thấp điểm tùy khung giờ. Mức giá dưới đây cập nhật trực tiếp, đúng bằng mức tài khoản của bạn bị tính.
Kích thước ví dụ chỉ để minh họa và dùng mức giá giờ cao điểm. Hóa đơn của bạn dựa trên số token mà mỗi yêu cầu báo cáo và giờ yêu cầu chạy.
| Mục | Được tính là | Mức | Tính phí |
|---|---|---|---|
| Đầu vào, giờ cao điểm | Token prompt không trúng bộ nhớ đệm, 01:00–04:00 và 06:00–10:00 UTC, T2–T6 | $0.24 / 1M | Mỗi 1 triệu token |
| Đầu ra, giờ cao điểm | Token câu trả lời và suy luận, giờ cao điểm | $0.96 / 1M | Mỗi 1 triệu token |
| Đầu vào từ bộ nhớ đệm, giờ cao điểm | Token prompt trúng bộ nhớ đệm, giờ cao điểm | $0.0048 / 1M | Mỗi 1 triệu token |
| Đầu vào, giờ thấp điểm | Token prompt không trúng bộ nhớ đệm, mọi giờ còn lại, kể cả cuối tuần | $0.12 / 1M | Mỗi 1 triệu token |
| Đầu ra, giờ thấp điểm | Token câu trả lời và suy luận, giờ thấp điểm | $0.48 / 1M | Mỗi 1 triệu token |
| Đầu vào từ bộ nhớ đệm, giờ thấp điểm | Token prompt trúng bộ nhớ đệm, giờ thấp điểm | $0.0024 / 1M | Mỗi 1 triệu token |
| Yêu cầu thất bại | Bất kỳ yêu cầu nào trả về lỗi | Miễn phí | Không tính phí |
DeepSeek V4.1 Flash là gì?
DeepSeek V4.1 Flash là mô hình nhanh, chi phí thấp của DeepSeek, phát hành ngày 10 tháng 9 năm 2026. Đây là mô hình mixture-of-experts 552B tham số, kích hoạt 8B tham số để đọc và 16B để viết, đọc hình ảnh một cách tự nhiên và nhận tối đa 1 triệu token ngữ cảnh.
Theo mặc định, DeepSeek V4.1 Flash suy luận trước khi trả lời, ở mức high. Tắt suy luận cho các bước nhanh, đơn giản, hoặc nâng lên max cho các vấn đề khó. API của chính DeepSeek gọi mô hình này là deepseek-flash.
ID mô hình: deepseek-v4.1-flash · Đầu vào: văn bản, hình ảnh · Đầu ra: văn bản · Định dạng: Chat Completions, Responses, Anthropic Messages.
Hai cách dùng DeepSeek V4.1 Flash
Gọi nó từ mã của bạn, hoặc để agent lập trình của bạn làm điều đó.
Gọi nó từ backend của bạn
Trỏ OpenAI SDK tới SeedRouter và giữ nguyên mã của bạn. DeepSeek V4.1 Flash hỗ trợ Chat Completions, Responses và Anthropic Messages.
- 1Tạo một khóa API
- 2Đặt base URL thành https://api.seedrouter.ai/v1
- 3Gửi deepseek-v4.1-flash làm mô hình
Giao cho agent lập trình của bạn
Sao chép một prompt có sẵn. Agent của bạn hiển thị yêu cầu và chi phí trước khi phát sinh bất kỳ chi phí nào.
- 1Sao chép prompt
- 2Dán vào agent của bạn
- 3Phê duyệt yêu cầu
DeepSeek V4.1 Flash giỏi ở đâu
DeepSeek V4.1 Flash được xây dựng cho khối lượng công việc lớn, nơi tốc độ và chi phí là quan trọng.
Vòng lặp agent
DeepSeek V4.1 Flash chạy nhiều bước giá rẻ, và ngữ cảnh trong bộ nhớ đệm giữ chi phí đọc lặp lại ở mức thấp.
Lập trình hằng ngày
Viết, rà soát và sửa mã với DeepSeek V4.1 Flash trong Codex, Claude Code hoặc công cụ của riêng bạn.
Hình ảnh trong prompt
DeepSeek V4.1 Flash đọc ảnh chụp màn hình, biểu đồ và ảnh qua URL hoặc base64.
Đầu ra có cấu trúc
Yêu cầu DeepSeek V4.1 Flash trả về đầu ra json_object và phân tích câu trả lời trực tiếp.
Bật hoặc tắt suy luận
Bỏ qua suy luận của DeepSeek V4.1 Flash cho câu trả lời nhanh, hoặc tăng lên cho câu hỏi khó.
Giá giờ thấp điểm
Tác vụ hàng loạt chạy ngoài giờ cao điểm chỉ trả một nửa giá cao điểm.
Các nhóm xây dựng gì với DeepSeek V4.1 Flash
Phân loại quy mô lớn
Gắn nhãn ticket, đánh giá và log với DeepSeek V4.1 Flash, tắt suy luận, với chi phí thấp nhất.
Agent lập trình
Chạy DeepSeek V4.1 Flash trong Codex cho các vòng sửa và chạy nhanh, rẻ.
Đọc ảnh chụp màn hình
Chuyển ảnh chụp màn hình và biểu đồ thành văn bản hoặc JSON.
Bắt đầu dùng DeepSeek V4.1 Flash trong bốn bước
- 01
Tạo một khóa
Đăng nhập và tạo một khóa API. Thêm tín dụng bất cứ khi nào bạn cần; không có đăng ký.
- 02
Thay đổi URL cơ sở
Trỏ OpenAI SDK tới https://api.seedrouter.ai/v1. Mã của bạn giữ nguyên.
- 03
Chọn DeepSeek V4.1 Flash
Gửi deepseek-v4.1-flash làm mô hình. Tắt suy luận hoặc đặt mức độ suy luận cho từng yêu cầu.
- 04
Kiểm tra hóa đơn
Mỗi yêu cầu hiển thị token và phí của nó trong bản ghi sử dụng của bạn.
Tổng quan DeepSeek V4.1 Flash trên SeedRouter
Điều bạn có thể sử dụng ngày hôm nay.
| Tính năng | DeepSeek V4.1 Flash |
|---|---|
| Chat Completions | Có, định dạng chính thức |
| Responses | Có, dùng được với Codex |
| Anthropic Messages | Có, dùng được với Claude Code |
| Đầu vào hình ảnh | Có, theo URL hoặc base64 |
| Streaming | Có |
| Bộ nhớ đệm ngữ cảnh | Có, tự động, lượt trúng bộ nhớ đệm được tính giá thấp hơn |
| Đầu ra JSON | Có, json_object |
| Yêu cầu thất bại | Không tính phí |
Không hỗ trợ FIM và hoàn thành tiền tố chat (beta), Files API và xác suất log.
Giới hạn của DeepSeek V4.1 Flash
Cửa sổ ngữ cảnh 1 triệu token
Trên DeepSeek V4.1 Flash, prompt, hình ảnh và lịch sử dùng chung một cửa sổ 1 triệu token.
384K token đầu ra
Một yêu cầu DeepSeek V4.1 Flash viết tối đa 393.216 token, bao gồm suy luận.
Lấy mẫu khi bật suy luận
Khi bật suy luận, temperature không có tác dụng và top_p luôn từ 0.95 trở lên.
Kích thước hình ảnh
URL hình ảnh cho DeepSeek V4.1 Flash có thể trỏ tới tệp tối đa 32 MiB.
Vì sao nên gọi DeepSeek V4.1 Flash qua SeedRouter
Một khóa, ba định dạng
Gọi DeepSeek V4.1 Flash bằng Chat Completions, Responses hoặc Anthropic Messages, với cùng một khóa.
Trả theo token
Nạp một lần và sử dụng cho bất kỳ mô hình nào. Không có gói, không có phí hàng tháng.
Lỗi miễn phí
Yêu cầu trả về lỗi không bị tính phí.
Giá trực tiếp
Mức giá trên trang này là mức tài khoản của bạn trả, cả giờ cao điểm lẫn giờ thấp điểm.
Bộ nhớ đệm ngữ cảnh
Các tiền tố prompt lặp lại được đọc từ bộ nhớ đệm với mức giá DeepSeek V4.1 Flash thấp hơn.
Suy luận trả về cùng câu trả lời
Khi bật suy luận, phần suy luận được trả về trong reasoning_content, bên cạnh câu trả lời.
Streaming
Nhận token DeepSeek V4.1 Flash ngay khi chúng được tạo với stream: true.
Mô hình liên quan
Các mô hình khác bạn có thể gọi với cùng một khóa.
Gọi Kimi K3 bằng OpenAI SDK hoặc Anthropic SDK. Ngữ cảnh 1 triệu token, suy luận luôn bật với mức low, high hoặc max, giá theo token cập nhật trực tiếp và Playground.
Xem giáHướng dẫn về DeepSeek V4.1 Flash
Hướng dẫn và so sánh cho mô hình này.
Cách dùng API DeepSeek V4.1 Flash: lấy key, gọi bằng OpenAI SDK, bật hoặc tắt chế độ suy nghĩ, streaming, gửi hình ảnh và xử lý các lỗi người mới hay gặp.
Giá API DeepSeek V4.1 Flash mỗi triệu token: giá giờ cao điểm và giờ thấp điểm, trúng cache, khung giờ áp dụng, công thức tính phí và chi phí của một yêu cầu.
Cách chạy DeepSeek V4.1 Flash làm mô hình trong Claude Code và OpenAI Codex CLI qua SeedRouter: biến môi trường, config.toml và kết quả kiểm thử của chúng tôi.
So sánh DeepSeek V4.1 Flash và DeepSeek V4 Pro về giá mỗi token, đầu vào hình ảnh, giới hạn đồng thời và benchmark do DeepSeek công bố, kèm lựa chọn rõ ràng.
Những thay đổi từ DeepSeek V4 Flash 0731 lên V4.1 Flash: kiến trúc mới, thị giác tự nhiên, bộ nhớ đệm nhỏ hơn, giá thấp hơn, benchmark và nơi các tên cũ chạy.
DeepSeek V4.1 Flash có miễn phí không? Trọng số tải miễn phí, API tính phí theo token với giá thấp, và đây là cách dùng thử gần như không tốn gì hôm nay.
Câu hỏi thường gặp về DeepSeek V4.1 Flash
DeepSeek V4.1 Flash là gì?+
DeepSeek V4.1 Flash là mô hình nhanh, chi phí thấp của DeepSeek, phát hành ngày 10 tháng 9 năm 2026. Đây là mô hình mixture-of-experts 552B tham số với đầu vào hình ảnh gốc, cửa sổ ngữ cảnh 1 triệu token và suy luận có thể bật hoặc tắt.
DeepSeek V4.1 Flash giá bao nhiêu?+
DeepSeek V4.1 Flash được tính phí $0.24 / 1M đầu vào và $0.96 / 1M đầu ra mỗi 1 triệu token vào giờ cao điểm (01:00–04:00 và 06:00–10:00 UTC, thứ Hai đến thứ Sáu). Mọi giờ còn lại là giờ thấp điểm với mức giá bằng một nửa, và lượt trúng bộ nhớ đệm chỉ tốn một phần nhỏ giá đầu vào.
Tôi có thể dùng DeepSeek V4.1 Flash miễn phí không?+
Mỗi tài khoản SeedRouter mới bắt đầu với $0.10 số dư miễn phí, đủ để thử DeepSeek V4.1 Flash với nhiều yêu cầu ngắn. Sau đó bạn trả theo token, không cần gói thuê bao, và yêu cầu thất bại không bị tính phí.
DeepSeek V4.1 Flash có hỗ trợ hình ảnh không?+
Có. DeepSeek V4.1 Flash đọc hình ảnh một cách tự nhiên. Gửi ảnh trong yêu cầu qua URL công khai hoặc dạng base64; mô hình trả về văn bản.
Làm sao để tắt suy luận trong DeepSeek V4.1 Flash?+
Đặt thinking thành disabled, hoặc reasoning_effort thành none. Khi đó câu trả lời đến ngay và dùng ít token đầu ra hơn.
DeepSeek V4.1 Flash có giống DeepSeek V4 Flash không?+
Không. DeepSeek V4.1 Flash đã thay thế V4 Flash vào ngày 10 tháng 9 năm 2026, với kiến trúc mới và đầu vào hình ảnh gốc. DeepSeek đã ngừng V4 Flash và chuyển các tên mô hình cũ sang DeepSeek V4.1 Flash.
Tôi có thể chạy DeepSeek V4.1 Flash cục bộ không?+
Trọng số của mô hình có trên Hugging Face. Với 552B tham số, mô hình cần phần cứng nhiều GPU, nên hầu hết các nhóm gọi DeepSeek V4.1 Flash qua API.
ID mô hình DeepSeek V4.1 Flash là gì và gọi nó thế nào?+
Trên SeedRouter, ID mô hình là deepseek-v4.1-flash. Tạo một khóa API SeedRouter, trỏ OpenAI SDK tới https://api.seedrouter.ai/v1 và gửi deepseek-v4.1-flash làm mô hình.
Tôi có bị tính phí nếu yêu cầu DeepSeek V4.1 Flash thất bại không?+
Không. Yêu cầu DeepSeek V4.1 Flash trả về lỗi sẽ không bị tính phí. Bạn chỉ trả tiền cho số token mà một yêu cầu hoàn tất báo cáo.
Dùng thử DeepSeek V4.1 Flash ngay
Gửi yêu cầu DeepSeek V4.1 Flash đầu tiên từ Playground hoặc từ mã của bạn chỉ trong vài phút.
