Giá API GPT-6: Astra, Sol và Luna giá bao nhiêu mỗi triệu token
Giá API GPT-6 cho Astra, Sol và Luna mỗi triệu token: đầu vào, đầu ra, đầu vào từ bộ nhớ đệm, ghi cache và giá ngữ cảnh dài trên 272K, kèm ví dụ cụ thể.
Đọc dạng MarkdownGPT-6 Astra, GPT-6 Sol và GPT-6 Luna được tính phí theo token trên SeedRouter, với giá riêng cho đầu vào, đầu ra, đầu vào từ bộ nhớ đệm và ghi cache. GPT-6 Luna rẻ nhất, GPT-6 Astra đắt nhất, còn GPT-6 Sol nằm ở giữa. Một prompt vượt 272K token đầu vào được tính theo giá ngữ cảnh dài cao hơn cho toàn bộ yêu cầu. Không có gói đăng ký, và một yêu cầu thất bại không bị tính phí.
Các bảng dưới đây được đọc từ biểu phí tính tiền tài khoản của bạn, nên chúng cho thấy một yêu cầu hôm nay giá bao nhiêu.
GPT-6 Astra, Sol và Luna giá bao nhiêu mỗi triệu token?
GPT-6 Astra
GPT-6 Astra is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Prompt size | Input | Cached input | Cache write | Output (including reasoning) |
|---|---|---|---|---|---|
gpt-6-astra | Up to 272K input tokens | $8 | $0.8 | $10 | $40 |
gpt-6-astra | Over 272K input tokens | $16 | $1.6 | $20 | $60 |
Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.
GPT-6 Sol
GPT-6 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Prompt size | Input | Cached input | Cache write | Output (including reasoning) |
|---|---|---|---|---|---|
gpt-6-sol | Up to 272K input tokens | $1.6 | $0.16 | $2 | $8 |
gpt-6-sol | Over 272K input tokens | $3.2 | $0.32 | $4 | $12 |
Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.
GPT-6 Luna
GPT-6 Luna is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Prompt size | Input | Cached input | Cache write | Output (including reasoning) |
|---|---|---|---|---|---|
gpt-6-luna | Up to 272K input tokens | $0.08 | $0.008 | $0.1 | $0.4 |
gpt-6-luna | Over 272K input tokens | $0.16 | $0.016 | $0.2 | $0.6 |
Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.00056. A request that fails is not charged.
Mỗi bảng có hai dòng: prompt tới 272K token đầu vào, và prompt vượt mức đó. Đầu ra bao gồm các token suy luận mà mô hình dùng trước khi trả lời.
Giá niêm yết của OpenAI là bao nhiêu?
Để tham khảo, đây là cấu trúc giá Standard của OpenAI, từ trang giá của họ. Mỗi dòng là bội số của giá đầu vào của chính mô hình đó, và ba mô hình có cùng cấu trúc:
| Dòng | GPT-6 Astra | GPT-6 Sol | GPT-6 Luna |
|---|---|---|---|
| Đầu vào | 1× | 1× | 1× |
| Đầu vào từ bộ nhớ đệm | 0.1× | 0.1× | 0.1× |
| Ghi cache | 1.25× | 1.25× | 1.25× |
| Đầu ra | 5× | 5× | 5× |
Giữa các mô hình, giá đầu vào của GPT-6 Astra gấp năm lần GPT-6 Sol, và của GPT-6 Sol gấp hai mươi lần GPT-6 Luna. Trên 272K token đầu vào, OpenAI tính gấp 2 lần giá đầu vào và giá cache, gấp 1,5 lần giá đầu ra "cho toàn bộ yêu cầu". Các bảng trực tiếp ở trên cho thấy giá của SeedRouter cho mọi dòng.
Một yêu cầu GPT-6 được tính phí như thế nào?
Mỗi phản hồi báo số token trong usage, và khoản phí theo đúng các số đó:
input_tokens: toàn bộ prompt, bao gồm cả phần đọc từ cache hoặc ghi vào cache.input_tokens_details.cached_tokens: token prompt đọc từ cache, tính theo giá đầu vào từ bộ nhớ đệm.input_tokens_details.cache_write_tokens: token prompt ghi vào cache, tính theo giá ghi cache.output_tokens: câu trả lời cộng phần suy luận, tính theo giá đầu ra.
Vậy chi phí của một yêu cầu là:
cost = ((input − cached − cache writes) × input rate
+ cached × cached-input rate
+ cache writes × cache-write rate
+ output × output rate) / 1,000,000Nếu prompt vượt 272K token đầu vào, mọi dòng đều dùng giá ngữ cảnh dài.
Một yêu cầu điển hình tốn bao nhiêu?
Lấy một yêu cầu có 2.000 token đầu vào và 1.000 token đầu ra. Chi phí của nó là 2.000 nhân giá đầu vào cộng 1.000 nhân giá đầu ra, chia cho 1.000.000. Vì đầu ra đắt gấp năm lần đầu vào trên cả ba mô hình, phần đầu ra của yêu cầu đó tốn gấp hai lần rưỡi phần đầu vào, dù bạn chọn mô hình nào. Cùng yêu cầu đó trên GPT-6 Sol tốn một phần năm so với GPT-6 Astra và gấp hai mươi lần GPT-6 Luna.
Suy luận thay đổi phần đầu ra nhiều nhất. Mức độ suy luận cao hơn thường tiêu nhiều token suy luận hơn cho cùng một câu hỏi, nên với GPT-6 Sol và GPT-6 Luna hãy thử none hoặc low trước và chỉ nâng mức ở những chỗ câu trả lời cần.
Làm sao để trả ít hơn cho GPT-6?
- Chọn mô hình nhỏ nhất vượt qua bài kiểm thử của bạn. GPT-6 Luna có giá bằng một phần hai mươi GPT-6 Sol, và GPT-6 Sol bằng một phần năm GPT-6 Astra.
- Hạ mức độ suy luận. Token suy luận là token đầu ra. GPT-6 Sol và GPT-6 Luna chấp nhận
none, tức bỏ qua suy luận. - Tái sử dụng phần đầu prompt. Đầu vào từ bộ nhớ đệm có giá bằng 10% giá đầu vào. Giữ hướng dẫn, công cụ và tài liệu tham khảo ở đầu prompt và không đổi giữa các yêu cầu.
- Giữ dưới 272K token đầu vào. Vượt mức đó, toàn bộ yêu cầu, chứ không chỉ phần dư, chuyển sang giá cao hơn.
- Giới hạn đầu ra.
max_output_tokensgiới hạn cả câu trả lời lẫn phần suy luận; giá trị nhỏ nhất được chấp nhận là 16.
GPT-6 có miễn phí không?
Trong API thì không. Trên SeedRouter, mọi tài khoản mới đều bắt đầu với một khoản số dư miễn phí nhỏ, đủ cho vài yêu cầu thử trên GPT-6 Sol hoặc nhiều yêu cầu trên GPT-6 Luna, và một yêu cầu thất bại không bao giờ bị tính phí. Trong ChatGPT, OpenAI cho biết người dùng Free và Go có thể dùng GPT-6 Luna trong ứng dụng desktop; các gói ChatGPT được tính phí riêng với API.
Câu hỏi thường gặp
GPT-6 Astra giá bao nhiêu?
GPT-6 Astra là mô hình GPT-6 đắt nhất: theo bảng giá của OpenAI, giá của nó gấp năm lần GPT-6 Sol ở mọi dòng, với đầu ra gấp năm lần đầu vào. Bảng ở đầu trang này cho thấy mức giá tài khoản SeedRouter của bạn trả.
GPT-6 Sol giá bao nhiêu?
Theo bảng giá của OpenAI, GPT-6 Sol có giá bằng một phần năm GPT-6 Astra và bằng một nửa giá khuyến mãi của GPT-5.6 Sol; bảng ở đầu trang cho thấy mức giá bạn trả. Hướng dẫn GPT-6 vs GPT-5.6 so sánh hai thế hệ theo từng dòng.
Token suy luận có bị tính phí không?
Có, dưới dạng token đầu ra. usage.output_tokens_details.reasoning_tokens cho biết bao nhiêu token đầu ra là phần suy luận.
Có phí hằng tháng không?
Không. Bạn nạp số dư một lần và dùng nó cho từng yêu cầu trên bất kỳ mô hình nào. Số dư không hết hạn.
Kiểm tra chi phí với prompt của chính bạn
Gửi một prompt trong playground GPT-6 Sol, playground GPT-6 Luna hoặc playground GPT-6 Astra. Mỗi câu trả lời hiển thị số token và chi phí, được tính phí đúng như một lệnh gọi API.



