Claude Opus 5.5 đã có trên SeedRouter

Giá GPT-6.1 Sol: giá mỗi token, bộ nhớ đệm và chi phí yêu cầu thực tế

Giải thích giá GPT-6.1 Sol: giá đầu vào, đầu vào từ bộ nhớ đệm, ghi bộ nhớ đệm và đầu ra, quy tắc ngữ cảnh dài 272K, chi phí yêu cầu mẫu và cách tiết kiệm.

Đọc dạng Markdown

GPT-6.1 Sol được tính phí theo token. Giá niêm yết Standard của OpenAI là $2 mỗi triệu token đầu vào và $10 mỗi triệu token đầu ra, đầu vào từ bộ nhớ đệm là $0,10. Đầu vào và đầu ra chỉ bằng một phần năm mức giá của GPT-6 Astra, còn đầu vào từ bộ nhớ đệm bằng một phần mười. Phần lớn hóa đơn thực tế đến từ đầu ra, vì token suy luận được tính phí như đầu ra, nên mức độ suy luận bạn chọn quan trọng hơn độ dài prompt. Ngữ cảnh dài, lặp lại sẽ rất rẻ để gửi lại khi đã được lưu vào bộ nhớ đệm.

GPT-6.1 Sol giá bao nhiêu mỗi triệu token?

Giá Standard của OpenAI mỗi triệu token, kiểm tra ngày 5 tháng 10 năm 2026 trên trang giá:

Kích thước promptĐầu vàoĐầu vào từ bộ nhớ đệmGhi bộ nhớ đệmĐầu ra
Tới 272K token đầu vào$2,00$0,10$2,50$10,00
Trên 272K token đầu vào$4,00$0,20$5,00$15,00

Các quy tắc đằng sau bảng này lấy từ trang mô hình GPT-6.1 Sol: đầu vào từ bộ nhớ đệm bằng 5% mức giá đầu vào, ghi bộ nhớ đệm bằng 1,25 lần mức giá đầu vào, và prompt trên 272K token đầu vào được tính "gấp 2 lần giá đầu vào và giá bộ nhớ đệm, gấp 1,5 lần giá đầu ra cho toàn bộ yêu cầu".

Mức giá tài khoản SeedRouter của bạn trả, đọc trực tiếp từ hệ thống tính phí:

GPT-6.1 Sol

GPT-6.1 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6.1-solUp to 272K input tokens$1.6$0.08$2$8
gpt-6.1-solOver 272K input tokens$3.2$0.16$4$12

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.

Không có gói đăng ký. Bạn nạp tiền vào số dư, số dư không hết hạn, và yêu cầu thất bại không bị tính phí.

Một yêu cầu GPT-6.1 Sol được tính phí như thế nào?

Mỗi phản hồi báo cáo usage của nó, và khoản phí đi theo từng dòng:

  • Đầu vào — token prompt không được đọc từ hay ghi vào bộ nhớ đệm.
  • Đầu vào từ bộ nhớ đệm — usage.input_tokens_details.cached_tokens, theo giá đầu vào từ bộ nhớ đệm.
  • Ghi bộ nhớ đệm — usage.input_tokens_details.cache_write_tokens, theo giá ghi bộ nhớ đệm.
  • Đầu ra — câu trả lời cộng toàn bộ token suy luận.

Công thức là (input × input rate + cached × cached rate + cache writes × write rate + output × output rate) / 1,000,000. Nếu prompt có hơn 272K token đầu vào, mọi dòng dùng hàng thứ hai của bảng.

GPT-6.1 Sol có tốn token nhanh không?

Có thể, ở mức độ suy luận cao. GPT-6.1 Sol luôn suy luận, và token suy luận được tính phí như đầu ra dù bạn không bao giờ nhìn thấy chúng. Ba prompt được gửi qua SeedRouter ngày 5 tháng 10 năm 2026 ở từng mức độ suy luận; token đầu ra bao gồm suy luận:

Promptlowmediumhighxhighmax
Bài toán đếm225187272362574
Bài toán đếm khó hơn7111.2731.2551.7632.259
Tìm lỗi trong một hàm 4 dòng2211943966061.114

Theo giá niêm yết, bài khó hơn tốn khoảng $0,007 ở low và $0,023 ở max. Mức nào cũng cho đáp án đúng. Trên các tác vụ này, max dùng số token gấp hai lần rưỡi đến năm lần low mà không cho kết quả tốt hơn. Hướng dẫn mức độ suy luận có toàn bộ bài thử, gồm cả thời gian đến token đầu tiên.

Một khối lượng công việc điển hình tốn bao nhiêu?

Bốn ví dụ theo giá niêm yết của OpenAI:

Khối lượng công việcTokenChi phí
Một câu hỏi lập trình2.000 đầu vào, 1.000 đầu ra$0,014
Một lượt agent với bản tóm tắt repository trong bộ nhớ đệm50.000 từ bộ nhớ đệm, 2.000 đầu vào mới, 3.000 đầu ra$0,039
Cùng lượt đó không có bộ nhớ đệm52.000 đầu vào, 3.000 đầu ra$0,134
Một yêu cầu ngữ cảnh dài300.000 đầu vào, 4.000 đầu ra$1,26

Với agent, bộ nhớ đệm gánh phần lớn việc tiết kiệm: cùng một lượt rẻ hơn khoảng 70% khi phần tiền tố chung được đọc từ bộ nhớ đệm. Dòng ngữ cảnh dài cho thấy tác động ngược lại. Ở 300K token đầu vào, toàn bộ yêu cầu chuyển sang mức giá cao hơn; cùng yêu cầu đó với 270K đầu vào sẽ chỉ tốn $0,58.

Giá GPT-6.1 Sol so với các mô hình khác thế nào?

Giá niêm yết chính thức mỗi triệu token, kiểm tra ngày 5 tháng 10 năm 2026:

Mô hìnhĐầu vàoĐầu vào từ bộ nhớ đệmĐầu ra
GPT-6.1 Sol$2,00$0,10$10,00
GPT-6 Sol$2,00$0,20$10,00
GPT-6 Astra$10,00$1,00$50,00
Claude Sonnet 5.5$2,00$0,20$10,00
Claude Opus 5.5$4,00$0,20$20,00

Giá OpenAI lấy từ trang giá của họ; giá Claude lấy từ trang mô hình Sonnet 5.5 và Opus 5.5 của Anthropic. GPT-6.1 Sol và Claude Sonnet 5.5 có cùng giá đầu vào và đầu ra, còn GPT-6.1 Sol đọc đầu vào từ bộ nhớ đệm với giá chỉ bằng một nửa. So sánh GPT-6.1 Sol với Claude trình bày phần còn lại.

Làm sao để trả ít hơn cho GPT-6.1 Sol?

  • Chọn mức độ suy luận thấp nhất mà vẫn đạt. Bắt đầu ở medium, thử low cho các bước đơn giản, và chỉ tăng mức độ suy luận với các tác vụ thất bại.
  • Đặt phần ổn định của prompt lên đầu. Chỉ dẫn hệ thống, định nghĩa công cụ và tài liệu dài ở đầu prompt có thể được đọc từ bộ nhớ đệm ở các yêu cầu sau với giá bằng 5% mức giá đầu vào.
  • Giữ dưới 272K token đầu vào. Cắt bớt hoặc tóm tắt lịch sử trước khi prompt vượt ngưỡng, vì mức giá cao hơn áp dụng cho toàn bộ yêu cầu.
  • Giới hạn đầu ra. max_output_tokens giới hạn cả suy luận lẫn câu trả lời, nên một yêu cầu chạy quá đà không thể tốn hơn mức bạn cho phép.

Câu hỏi thường gặp

GPT-6.1 Sol giá bao nhiêu?

OpenAI niêm yết GPT-6.1 Sol ở $2 mỗi triệu token đầu vào, $0,10 mỗi triệu token đầu vào từ bộ nhớ đệm, $2,50 mỗi triệu token ghi bộ nhớ đệm và $10 mỗi triệu token đầu ra, cho prompt tới 272K token đầu vào. Prompt lớn hơn được tính theo mức giá ngữ cảnh dài cao hơn cho toàn bộ yêu cầu.

GPT-6.1 Sol có rẻ hơn GPT-6 Sol không?

Chỉ với đầu vào từ bộ nhớ đệm, rẻ bằng một nửa. Đầu vào, đầu ra và ghi bộ nhớ đệm có cùng giá.

Vì sao hóa đơn GPT-6.1 Sol cao hơn so với độ dài prompt?

Token suy luận được tính phí như đầu ra. Ở mức xhigh hoặc max, một prompt ngắn có thể sinh ra hàng nghìn token suy luận. Hãy xem usage.output_tokens_details.reasoning_tokens trong phản hồi.

GPT-6.1 Sol có trong ChatGPT Plus không?

OpenAI cho biết GPT-6.1 Sol có sẵn cho người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex. Dùng qua API được tính phí theo token, tách biệt với mọi gói ChatGPT.

Xem giá mình trả ở đâu?

Trang GPT-6.1 Sol hiển thị mức giá trực tiếp của SeedRouter, và các bản ghi sử dụng của bạn hiển thị khoản phí chính xác cho từng yêu cầu.

Hướng dẫn liên quan