GPT-6 Luna — GPT-6 giá rẻ cho khối lượng công việc lớn
GPT-6 Luna là mô hình GPT-6 hiệu quả nhất của OpenAI, dành cho các tác vụ chuyên biệt ở quy mô lớn, với ngữ cảnh 1,05 triệu token. $0.08 / 1M đầu vào, $0.40 / 1M đầu ra mỗi triệu token.
- Điều chỉnh mức độ suy luận
- Cửa sổ ngữ cảnh 1,05 triệu token
- Đầu vào hình ảnh
- Prompt caching
- Streaming
Dùng thử GPT-6 Luna
Trò chuyện với GPT-6 Luna, đính kèm hình ảnh và xem số token cùng chi phí của từng câu trả lời.
gpt-6-luna$0.08 đầu vào · $0.40 đầu ra trên mỗi triệu token
Nhiệt độ và Top P chỉ hoạt động khi mức độ suy luận là none.
Thử một trong những prompt này
Tin nhắn được tính phí từ số dư của bạn theo mức dưới đây, giống như một lệnh gọi API. Yêu cầu thất bại miễn phí.
Kết quả thực tế từ GPT-6 Luna
Một prompt, gửi đến GPT-6 Luna với mức độ suy luận thấp. Không chỉnh sửa.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex is a lock that allows only one thread or process at a time to access a shared resource. The thread that locks it is responsible for unlocking it. Use a mutex to protect shared data or a critical section from simultaneous access. A semaphore maintains a count and lets a limited number of threads or processes access a resource at once; it can also signal that an event has occurred. Use a counting semaphore to manage a pool of limited resources, or a binary semaphore for signaling between threads.
Tạo ngày 2026-09-28. Câu trả lời có thể khác nhau giữa các lần chạy.
Giá GPT-6 Luna
GPT-6 Luna tính phí theo token từ số dư của bạn. Mức giá bên dưới được cập nhật trực tiếp, đúng với mức tài khoản của bạn bị tính.
Kích thước ví dụ chỉ để minh họa. Hóa đơn của bạn dựa trên số token mà mỗi yêu cầu báo cáo.
| Mục | Được tính là | Mức | Tính phí |
|---|---|---|---|
| Đầu vào | Token prompt không đọc từ hoặc ghi vào bộ nhớ đệm | $0.08 / 1M | Mỗi 1 triệu token |
| Đầu ra | Token trả lời và suy luận | $0.40 / 1M | Mỗi 1 triệu token |
| Đầu vào từ bộ nhớ đệm | Token prompt được phục vụ từ bộ nhớ đệm prompt | $0.008 / 1M | Mỗi 1 triệu token |
| Ghi bộ nhớ đệm | Token prompt được ghi vào bộ nhớ đệm prompt | $0.10 / 1M | Mỗi 1 triệu token |
| Đầu vào, trên 272K | Đầu vào khi prompt vượt quá 272K token | $0.16 / 1M | Mỗi 1 triệu token |
| Đầu ra, trên 272K | Đầu ra khi prompt vượt quá 272K token | $0.60 / 1M | Mỗi 1 triệu token |
| Đầu vào từ bộ nhớ đệm, trên 272K | Đọc bộ nhớ đệm khi prompt vượt quá 272K token | $0.016 / 1M | Mỗi 1 triệu token |
| Ghi bộ nhớ đệm, trên 272K | Ghi bộ nhớ đệm khi prompt vượt quá 272K token | $0.20 / 1M | Mỗi 1 triệu token |
| Yêu cầu thất bại | Bất kỳ yêu cầu nào trả về lỗi | Miễn phí | Không tính phí |
GPT-6 Luna là gì?
GPT-6 Luna là mô hình GPT-6 hiệu quả nhất của OpenAI, được xây dựng cho các tác vụ chuyên biệt với khối lượng lớn. Đây là mô hình có giá thấp nhất trong dòng GPT-6, thấp hơn GPT-6 Sol và GPT-6 Astra. GPT-6 Luna đọc tối đa 1,05 triệu token ngữ cảnh và viết tối đa 128K token mỗi yêu cầu.
Với GPT-6 Luna, bạn tự chọn mức độ suy nghĩ: mức độ suy luận từ none đến max, mặc định là medium. Ở mức none, mô hình trả lời mà không suy luận và chấp nhận temperature cùng top_p, phù hợp cho phân loại và trích xuất.
ID mô hình: gpt-6-luna · Đầu vào: văn bản, hình ảnh · Đầu ra: văn bản · Định dạng: OpenAI Responses, OpenAI Chat Completions, Anthropic Messages.
Hai cách sử dụng GPT-6 Luna
Gọi nó từ mã của bạn, hoặc để agent lập trình của bạn làm điều đó.
Gọi nó từ backend của bạn
Trỏ OpenAI SDK chính thức đến SeedRouter và giữ nguyên mã của bạn. GPT-6 Luna hỗ trợ cả hai định dạng Responses và Chat Completions.
- 1Tạo một khóa API
- 2Đặt base URL thành https://api.seedrouter.ai/v1
- 3Gửi gpt-6-luna làm mô hình
Giao cho agent lập trình của bạn
Sao chép một prompt có sẵn. Agent của bạn hiển thị yêu cầu và chi phí trước khi phát sinh bất kỳ chi phí nào.
- 1Sao chép prompt
- 2Dán vào agent của bạn
- 3Phê duyệt yêu cầu
GPT-6 Luna làm tốt những việc gì
GPT-6 Luna được tạo ra cho những việc bạn chạy hàng nghìn lần, nơi tốc độ và chi phí mỗi lần gọi là quan trọng.
Phân loại
GPT-6 Luna sắp xếp phiếu hỗ trợ, đánh giá và tin nhắn vào các nhãn bạn định nghĩa.
Trích xuất
Lấy tên, ngày tháng và tổng tiền từ tài liệu vào các trường gọn gàng.
Tóm tắt
Biến các chuỗi thảo luận và báo cáo dài thành ghi chú ngắn, dễ đọc.
Hình ảnh trong prompt
GPT-6 Luna đọc ảnh chụp màn hình và ảnh cùng với văn bản của bạn.
Mức độ suy luận do bạn kiểm soát
None cho câu trả lời nhanh nhất, mức cao hơn khi tác vụ cần suy nghĩ nhiều hơn.
Bộ nhớ đệm prompt rẻ hơn
Đầu vào từ bộ nhớ đệm trên GPT-6 Luna chỉ tốn 10% giá đầu vào.
Các nhóm xây dựng gì với GPT-6 Luna
Phân loại phiếu hỗ trợ
Gắn nhãn và chuyển tiếp mọi yêu cầu hỗ trợ bằng GPT-6 Luna trước khi có người đọc.
Gắn thẻ nội dung
Gắn thẻ danh sách sản phẩm, đánh giá hoặc bài đăng ở quy mô toàn bộ danh mục.
Trích xuất có cấu trúc
Chuyển hóa đơn và biểu mẫu thành JSON với schema text.format.
Bắt đầu dùng GPT-6 Luna trong bốn bước
- 01
Tạo một khóa
Đăng nhập và tạo một khóa API. Thêm tín dụng bất cứ khi nào bạn cần; không có đăng ký.
- 02
Thay đổi URL cơ sở
Trỏ OpenAI SDK tới https://api.seedrouter.ai/v1. Mã của bạn giữ nguyên.
- 03
Chọn GPT-6 Luna
Gửi gpt-6-luna làm mô hình. Giữ mức độ suy luận ở low hoặc none để có chi phí thấp nhất.
- 04
Kiểm tra hóa đơn
Mỗi yêu cầu hiển thị token và phí của nó trong bản ghi sử dụng của bạn.
Tổng quan GPT-6 Luna trên SeedRouter
Điều bạn có thể sử dụng ngày hôm nay.
| Tính năng | GPT-6 Luna |
|---|---|
| OpenAI Responses | Có, định dạng chính thức |
| OpenAI Chat Completions | Có |
| Anthropic Messages | Có |
| Đầu vào hình ảnh | Có, qua URL |
| Streaming | Có |
| Prompt caching | Có, đầu vào từ bộ nhớ đệm và ghi bộ nhớ đệm tính phí riêng |
| Mức độ suy luận none | Có |
| Yêu cầu thất bại | Không tính phí |
Không cung cấp Batch, Flex, chế độ nền (background) và các cấp dịch vụ (service tier).
Giới hạn của GPT-6 Luna
Cửa sổ ngữ cảnh 1,05 triệu token
Trên GPT-6 Luna, prompt, hình ảnh và lịch sử dùng chung một cửa sổ 1,05 triệu token; đầu vào tối đa 922K.
128K token ra
Một yêu cầu GPT-6 Luna có thể trả về tối đa 128K token, bao gồm cả suy luận.
Prompt dài có giá cao hơn
Khi đầu vào vượt quá 272K token, toàn bộ yêu cầu GPT-6 Luna được tính theo mức giá ngữ cảnh dài cao hơn.
Lấy mẫu cần mức suy luận none
GPT-6 Luna chỉ chấp nhận temperature và top_p khi mức độ suy luận là none.
Vì sao nên gọi GPT-6 Luna qua SeedRouter
Một khóa, ba định dạng
Gọi GPT-6 Luna bằng OpenAI Responses, Chat Completions hoặc Anthropic Messages, với cùng một khóa.
Trả theo token
Nạp một lần và sử dụng cho bất kỳ mô hình nào. Không có gói, không có phí hàng tháng.
Lỗi miễn phí
Yêu cầu trả về lỗi không bị tính phí.
Giá trực tiếp
Mức trên trang này là mức tài khoản của bạn trả.
Prompt caching
Các tiền tố prompt lặp lại được đọc từ bộ nhớ đệm với mức giá GPT-6 Luna thấp hơn.
Đầu vào hình ảnh
Gửi ảnh chụp màn hình và ảnh qua URL cùng với prompt của bạn.
Streaming
Nhận token của GPT-6 Luna theo dạng streaming ngay khi được tạo với stream: true.
Mô hình liên quan
Các mô hình khác bạn có thể gọi với cùng một khóa.
Gọi GPT-6 Astra bằng OpenAI SDK. Mô hình mạnh nhất của OpenAI, ngữ cảnh 1,05 triệu token, giá theo token cập nhật thời gian thực và Playground để dùng thử ngay.
Xem giáGọi GPT-6 Sol bằng OpenAI SDK. Cửa sổ ngữ cảnh 1,05 triệu token, mức độ suy luận từ none đến max, giá theo token cập nhật trực tiếp và Playground dùng thử ngay.
Xem giáHướng dẫn GPT-6 Luna
Hướng dẫn và so sánh cho mô hình này.
Cách dùng API GPT-6: lấy key, gọi GPT-6 Astra, Sol hoặc Luna bằng OpenAI SDK, đặt mức độ suy luận, streaming, gửi hình ảnh và tránh các lỗi thường gặp.
Giá API GPT-6 cho Astra, Sol và Luna mỗi triệu token: đầu vào, đầu ra, đầu vào từ bộ nhớ đệm, ghi cache và giá ngữ cảnh dài trên 272K, kèm ví dụ cụ thể.
So sánh GPT-6 Astra vs Sol vs Luna: thông số, giá, kết quả benchmark của OpenAI, mức độ suy luận và lựa chọn rõ ràng cho lập trình, agent và khối lượng lớn.
So sánh GPT-6 Astra, Sol và Luna với Claude Opus 5.5: thông số, giá token, benchmark hai phòng lab công bố, và mô hình nào hợp với lập trình, agent, chi phí.
So sánh GPT-6 vs GPT-5.6: Sol và Luna giá chỉ bằng một nửa, cùng ngữ cảnh 1,05M, kiến thức mới hơn, cải thiện benchmark theo OpenAI và cần sửa gì khi chuyển.
Câu hỏi thường gặp về GPT-6 Luna
GPT-6 Luna là gì?+
GPT-6 Luna là mô hình GPT-6 hiệu quả nhất của OpenAI, được xây dựng cho các tác vụ chuyên biệt với khối lượng lớn. Mô hình có cửa sổ ngữ cảnh 1,05 triệu token, viết tối đa 128K token mỗi yêu cầu và cho phép bạn đặt mức độ suy luận từ none đến max.
Nên dùng GPT-6 Luna hay GPT-6 Sol?+
Dùng GPT-6 Luna cho phân loại, trích xuất, tóm tắt và các việc lặp lại khác mà chi phí là quan trọng nhất. Chuyển sang GPT-6 Sol cho lập trình phức tạp và tác vụ agent, và GPT-6 Astra cho những việc khó nhất.
GPT-6 Luna giá bao nhiêu?+
GPT-6 Luna tính $0.08 / 1M đầu vào và $0.40 / 1M đầu ra mỗi triệu token, mức giá thấp nhất trong dòng GPT-6. Đầu vào từ bộ nhớ đệm có giá bằng 10% giá đầu vào. Prompt trên 272K token áp dụng mức giá ngữ cảnh dài.
Mức độ suy luận mặc định của GPT-6 Luna là gì?+
GPT-6 Luna mặc định là medium. Bạn có thể chọn none, low, medium, high, xhigh hoặc max; none tắt suy luận và là mức duy nhất chấp nhận temperature và top_p.
Mốc kiến thức của GPT-6 Luna là khi nào?+
Mốc kiến thức của GPT-6 Luna là ngày 18/05/2026. Với thông tin mới hơn, hãy đưa vào prompt.
ID mô hình GPT-6 Luna là gì và gọi như thế nào?+
ID mô hình là gpt-6-luna. Tạo khóa API SeedRouter, trỏ OpenAI SDK đến https://api.seedrouter.ai/v1 và gửi gpt-6-luna làm mô hình qua API Responses hoặc Chat Completions.
GPT-6 Luna có đọc được hình ảnh không?+
Có. GPT-6 Luna nhận hình ảnh cùng với văn bản, gửi qua URL trong yêu cầu. Mô hình chỉ trả về văn bản.
Tôi có bị tính phí nếu yêu cầu GPT-6 Luna thất bại không?+
Không. Yêu cầu GPT-6 Luna trả về lỗi sẽ không bị tính phí. Bạn chỉ trả cho số token mà một yêu cầu hoàn tất báo cáo.
Dùng thử GPT-6 Luna ngay
Gửi yêu cầu GPT-6 Luna đầu tiên từ Playground hoặc mã của riêng bạn chỉ trong vài phút.
