Giá GPT-6.1 Sol: giá mỗi token, bộ nhớ đệm và chi phí yêu cầu thực tế
Giải thích giá GPT-6.1 Sol: giá đầu vào, đầu vào từ bộ nhớ đệm, ghi bộ nhớ đệm và đầu ra, quy tắc ngữ cảnh dài 272K, chi phí yêu cầu mẫu và cách tiết kiệm.
Đọc dạng MarkdownGPT-6.1 Sol được tính phí theo token. Giá niêm yết Standard của OpenAI là $2 mỗi triệu token đầu vào và $10 mỗi triệu token đầu ra, đầu vào từ bộ nhớ đệm là $0,10. Đầu vào và đầu ra chỉ bằng một phần năm mức giá của GPT-6 Astra, còn đầu vào từ bộ nhớ đệm bằng một phần mười. Phần lớn hóa đơn thực tế đến từ đầu ra, vì token suy luận được tính phí như đầu ra, nên mức độ suy luận bạn chọn quan trọng hơn độ dài prompt. Ngữ cảnh dài, lặp lại sẽ rất rẻ để gửi lại khi đã được lưu vào bộ nhớ đệm.
GPT-6.1 Sol giá bao nhiêu mỗi triệu token?
Giá Standard của OpenAI mỗi triệu token, kiểm tra ngày 5 tháng 10 năm 2026 trên trang giá:
| Kích thước prompt | Đầu vào | Đầu vào từ bộ nhớ đệm | Ghi bộ nhớ đệm | Đầu ra |
|---|---|---|---|---|
| Tới 272K token đầu vào | $2,00 | $0,10 | $2,50 | $10,00 |
| Trên 272K token đầu vào | $4,00 | $0,20 | $5,00 | $15,00 |
Các quy tắc đằng sau bảng này lấy từ trang mô hình GPT-6.1 Sol: đầu vào từ bộ nhớ đệm bằng 5% mức giá đầu vào, ghi bộ nhớ đệm bằng 1,25 lần mức giá đầu vào, và prompt trên 272K token đầu vào được tính "gấp 2 lần giá đầu vào và giá bộ nhớ đệm, gấp 1,5 lần giá đầu ra cho toàn bộ yêu cầu".
Mức giá tài khoản SeedRouter của bạn trả, đọc trực tiếp từ hệ thống tính phí:
GPT-6.1 Sol
GPT-6.1 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Prompt size | Input | Cached input | Cache write | Output (including reasoning) |
|---|---|---|---|---|---|
gpt-6.1-sol | Up to 272K input tokens | $1.6 | $0.08 | $2 | $8 |
gpt-6.1-sol | Over 272K input tokens | $3.2 | $0.16 | $4 | $12 |
Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.
Không có gói đăng ký. Bạn nạp tiền vào số dư, số dư không hết hạn, và yêu cầu thất bại không bị tính phí.
Một yêu cầu GPT-6.1 Sol được tính phí như thế nào?
Mỗi phản hồi báo cáo usage của nó, và khoản phí đi theo từng dòng:
- Đầu vào — token prompt không được đọc từ hay ghi vào bộ nhớ đệm.
- Đầu vào từ bộ nhớ đệm —
usage.input_tokens_details.cached_tokens, theo giá đầu vào từ bộ nhớ đệm. - Ghi bộ nhớ đệm —
usage.input_tokens_details.cache_write_tokens, theo giá ghi bộ nhớ đệm. - Đầu ra — câu trả lời cộng toàn bộ token suy luận.
Công thức là (input × input rate + cached × cached rate + cache writes × write rate + output × output rate) / 1,000,000. Nếu prompt có hơn 272K token đầu vào, mọi dòng dùng hàng thứ hai của bảng.
GPT-6.1 Sol có tốn token nhanh không?
Có thể, ở mức độ suy luận cao. GPT-6.1 Sol luôn suy luận, và token suy luận được tính phí như đầu ra dù bạn không bao giờ nhìn thấy chúng. Ba prompt được gửi qua SeedRouter ngày 5 tháng 10 năm 2026 ở từng mức độ suy luận; token đầu ra bao gồm suy luận:
| Prompt | low | medium | high | xhigh | max |
|---|---|---|---|---|---|
| Bài toán đếm | 225 | 187 | 272 | 362 | 574 |
| Bài toán đếm khó hơn | 711 | 1.273 | 1.255 | 1.763 | 2.259 |
| Tìm lỗi trong một hàm 4 dòng | 221 | 194 | 396 | 606 | 1.114 |
Theo giá niêm yết, bài khó hơn tốn khoảng $0,007 ở low và $0,023 ở max. Mức nào cũng cho đáp án đúng. Trên các tác vụ này, max dùng số token gấp hai lần rưỡi đến năm lần low mà không cho kết quả tốt hơn. Hướng dẫn mức độ suy luận có toàn bộ bài thử, gồm cả thời gian đến token đầu tiên.
Một khối lượng công việc điển hình tốn bao nhiêu?
Bốn ví dụ theo giá niêm yết của OpenAI:
| Khối lượng công việc | Token | Chi phí |
|---|---|---|
| Một câu hỏi lập trình | 2.000 đầu vào, 1.000 đầu ra | $0,014 |
| Một lượt agent với bản tóm tắt repository trong bộ nhớ đệm | 50.000 từ bộ nhớ đệm, 2.000 đầu vào mới, 3.000 đầu ra | $0,039 |
| Cùng lượt đó không có bộ nhớ đệm | 52.000 đầu vào, 3.000 đầu ra | $0,134 |
| Một yêu cầu ngữ cảnh dài | 300.000 đầu vào, 4.000 đầu ra | $1,26 |
Với agent, bộ nhớ đệm gánh phần lớn việc tiết kiệm: cùng một lượt rẻ hơn khoảng 70% khi phần tiền tố chung được đọc từ bộ nhớ đệm. Dòng ngữ cảnh dài cho thấy tác động ngược lại. Ở 300K token đầu vào, toàn bộ yêu cầu chuyển sang mức giá cao hơn; cùng yêu cầu đó với 270K đầu vào sẽ chỉ tốn $0,58.
Giá GPT-6.1 Sol so với các mô hình khác thế nào?
Giá niêm yết chính thức mỗi triệu token, kiểm tra ngày 5 tháng 10 năm 2026:
| Mô hình | Đầu vào | Đầu vào từ bộ nhớ đệm | Đầu ra |
|---|---|---|---|
| GPT-6.1 Sol | $2,00 | $0,10 | $10,00 |
| GPT-6 Sol | $2,00 | $0,20 | $10,00 |
| GPT-6 Astra | $10,00 | $1,00 | $50,00 |
| Claude Sonnet 5.5 | $2,00 | $0,20 | $10,00 |
| Claude Opus 5.5 | $4,00 | $0,20 | $20,00 |
Giá OpenAI lấy từ trang giá của họ; giá Claude lấy từ trang mô hình Sonnet 5.5 và Opus 5.5 của Anthropic. GPT-6.1 Sol và Claude Sonnet 5.5 có cùng giá đầu vào và đầu ra, còn GPT-6.1 Sol đọc đầu vào từ bộ nhớ đệm với giá chỉ bằng một nửa. So sánh GPT-6.1 Sol với Claude trình bày phần còn lại.
Làm sao để trả ít hơn cho GPT-6.1 Sol?
- Chọn mức độ suy luận thấp nhất mà vẫn đạt. Bắt đầu ở
medium, thửlowcho các bước đơn giản, và chỉ tăng mức độ suy luận với các tác vụ thất bại. - Đặt phần ổn định của prompt lên đầu. Chỉ dẫn hệ thống, định nghĩa công cụ và tài liệu dài ở đầu prompt có thể được đọc từ bộ nhớ đệm ở các yêu cầu sau với giá bằng 5% mức giá đầu vào.
- Giữ dưới 272K token đầu vào. Cắt bớt hoặc tóm tắt lịch sử trước khi prompt vượt ngưỡng, vì mức giá cao hơn áp dụng cho toàn bộ yêu cầu.
- Giới hạn đầu ra.
max_output_tokensgiới hạn cả suy luận lẫn câu trả lời, nên một yêu cầu chạy quá đà không thể tốn hơn mức bạn cho phép.
Câu hỏi thường gặp
GPT-6.1 Sol giá bao nhiêu?
OpenAI niêm yết GPT-6.1 Sol ở $2 mỗi triệu token đầu vào, $0,10 mỗi triệu token đầu vào từ bộ nhớ đệm, $2,50 mỗi triệu token ghi bộ nhớ đệm và $10 mỗi triệu token đầu ra, cho prompt tới 272K token đầu vào. Prompt lớn hơn được tính theo mức giá ngữ cảnh dài cao hơn cho toàn bộ yêu cầu.
GPT-6.1 Sol có rẻ hơn GPT-6 Sol không?
Chỉ với đầu vào từ bộ nhớ đệm, rẻ bằng một nửa. Đầu vào, đầu ra và ghi bộ nhớ đệm có cùng giá.
Vì sao hóa đơn GPT-6.1 Sol cao hơn so với độ dài prompt?
Token suy luận được tính phí như đầu ra. Ở mức xhigh hoặc max, một prompt ngắn có thể sinh ra hàng nghìn token suy luận. Hãy xem usage.output_tokens_details.reasoning_tokens trong phản hồi.
GPT-6.1 Sol có trong ChatGPT Plus không?
OpenAI cho biết GPT-6.1 Sol có sẵn cho người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex. Dùng qua API được tính phí theo token, tách biệt với mọi gói ChatGPT.
Xem giá mình trả ở đâu?
Trang GPT-6.1 Sol hiển thị mức giá trực tiếp của SeedRouter, và các bản ghi sử dụng của bạn hiển thị khoản phí chính xác cho từng yêu cầu.



