Claude Opus 5.5 đã có trên SeedRouter
OpenAITạo văn bản

GPT-6 Luna — GPT-6 giá rẻ cho khối lượng công việc lớn

GPT-6 Luna là mô hình GPT-6 hiệu quả nhất của OpenAI, dành cho các tác vụ chuyên biệt ở quy mô lớn, với ngữ cảnh 1,05 triệu token. $0.08 / 1M đầu vào, $0.40 / 1M đầu ra mỗi triệu token.

Khả dụng$0.08 / 1M đầu vào · $0.40 / 1M đầu ra$0.10 / 1M đầu vào · $0.50 / 1M đầu ra-20%
  • Điều chỉnh mức độ suy luận
  • Cửa sổ ngữ cảnh 1,05 triệu token
  • Đầu vào hình ảnh
  • Prompt caching
  • Streaming
Cửa sổ ngữ cảnh
1,05 triệu token
Đầu ra tối đa
128K token
Các mức suy luận
từ none đến max
Mốc kiến thức
18/05/2026

Dùng thử GPT-6 Luna

Trò chuyện với GPT-6 Luna, đính kèm hình ảnh và xem số token cùng chi phí của từng câu trả lời.

Tham số

gpt-6-luna$0.08 đầu vào · $0.40 đầu ra trên mỗi triệu token

Reasoning effort
Reasoning summary
Reasoning mode
Reasoning context
Verbosity

Nhiệt độ và Top P chỉ hoạt động khi mức độ suy luận là none.

Tổng cộng cuộc trò chuyện$0.000000
Sẵn sàng

Thử một trong những prompt này

Tin nhắn được tính phí từ số dư của bạn theo mức dưới đây, giống như một lệnh gọi API. Yêu cầu thất bại miễn phí.

Kết quả thực tế từ GPT-6 Luna

Một prompt, gửi đến GPT-6 Luna với mức độ suy luận thấp. Không chỉnh sửa.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex is a lock that allows only one thread or process at a time to access a shared resource. The thread that locks it is responsible for unlocking it. Use a mutex to protect shared data or a critical section from simultaneous access. A semaphore maintains a count and lets a limited number of threads or processes access a resource at once; it can also signal that an event has occurred. Use a counting semaphore to manage a pool of limited resources, or a binary semaphore for signaling between threads.

Tạo ngày 2026-09-28. Câu trả lời có thể khác nhau giữa các lần chạy.

Giá GPT-6 Luna

GPT-6 Luna tính phí theo token từ số dư của bạn. Mức giá bên dưới được cập nhật trực tiếp, đúng với mức tài khoản của bạn bị tính.

Một yêu cầu điển hình2.000 token đầu vào, 1.000 token đầu ra
$0.0006mỗi yêu cầu
Token suy luận được tính là đầu ra, nên mức suy luận cao hơn sẽ làm tăng chi phí đầu ra.
$20.00 mua được gìToken đầu ra ở mức hiện tại
50,000,000token đầu ra
Token đầu vào và token từ bộ nhớ đệm có giá mỗi token thấp hơn đầu ra.

Kích thước ví dụ chỉ để minh họa. Hóa đơn của bạn dựa trên số token mà mỗi yêu cầu báo cáo.

MụcĐược tính làMứcTính phí
Đầu vàoToken prompt không đọc từ hoặc ghi vào bộ nhớ đệm$0.08 / 1MMỗi 1 triệu token
Đầu raToken trả lời và suy luận$0.40 / 1MMỗi 1 triệu token
Đầu vào từ bộ nhớ đệmToken prompt được phục vụ từ bộ nhớ đệm prompt$0.008 / 1MMỗi 1 triệu token
Ghi bộ nhớ đệmToken prompt được ghi vào bộ nhớ đệm prompt$0.10 / 1MMỗi 1 triệu token
Đầu vào, trên 272KĐầu vào khi prompt vượt quá 272K token$0.16 / 1MMỗi 1 triệu token
Đầu ra, trên 272KĐầu ra khi prompt vượt quá 272K token$0.60 / 1MMỗi 1 triệu token
Đầu vào từ bộ nhớ đệm, trên 272KĐọc bộ nhớ đệm khi prompt vượt quá 272K token$0.016 / 1MMỗi 1 triệu token
Ghi bộ nhớ đệm, trên 272KGhi bộ nhớ đệm khi prompt vượt quá 272K token$0.20 / 1MMỗi 1 triệu token
Yêu cầu thất bạiBất kỳ yêu cầu nào trả về lỗiMiễn phíKhông tính phí

GPT-6 Luna là gì?

GPT-6 Luna là mô hình GPT-6 hiệu quả nhất của OpenAI, được xây dựng cho các tác vụ chuyên biệt với khối lượng lớn. Đây là mô hình có giá thấp nhất trong dòng GPT-6, thấp hơn GPT-6 Sol và GPT-6 Astra. GPT-6 Luna đọc tối đa 1,05 triệu token ngữ cảnh và viết tối đa 128K token mỗi yêu cầu.

Với GPT-6 Luna, bạn tự chọn mức độ suy nghĩ: mức độ suy luận từ none đến max, mặc định là medium. Ở mức none, mô hình trả lời mà không suy luận và chấp nhận temperature cùng top_p, phù hợp cho phân loại và trích xuất.

ID mô hình: gpt-6-luna · Đầu vào: văn bản, hình ảnh · Đầu ra: văn bản · Định dạng: OpenAI Responses, OpenAI Chat Completions, Anthropic Messages.

ID mô hình
gpt-6-luna
Cửa sổ ngữ cảnh
1,05 triệu token
Đầu ra tối đa
128K token
Các mức suy luận
từ none đến max
Đầu vào
Văn bản, hình ảnh

Hai cách sử dụng GPT-6 Luna

Gọi nó từ mã của bạn, hoặc để agent lập trình của bạn làm điều đó.

API

Gọi nó từ backend của bạn

Tốt nhất cho ứng dụng và dịch vụ

Trỏ OpenAI SDK chính thức đến SeedRouter và giữ nguyên mã của bạn. GPT-6 Luna hỗ trợ cả hai định dạng Responses và Chat Completions.

  1. 1Tạo một khóa API
  2. 2Đặt base URL thành https://api.seedrouter.ai/v1
  3. 3Gửi gpt-6-luna làm mô hình
Agent

Giao cho agent lập trình của bạn

Tốt nhất cho Claude Code, Codex và các agent khác

Sao chép một prompt có sẵn. Agent của bạn hiển thị yêu cầu và chi phí trước khi phát sinh bất kỳ chi phí nào.

  1. 1Sao chép prompt
  2. 2Dán vào agent của bạn
  3. 3Phê duyệt yêu cầu

GPT-6 Luna làm tốt những việc gì

GPT-6 Luna được tạo ra cho những việc bạn chạy hàng nghìn lần, nơi tốc độ và chi phí mỗi lần gọi là quan trọng.

Phân loại

GPT-6 Luna sắp xếp phiếu hỗ trợ, đánh giá và tin nhắn vào các nhãn bạn định nghĩa.

Trích xuất

Lấy tên, ngày tháng và tổng tiền từ tài liệu vào các trường gọn gàng.

Tóm tắt

Biến các chuỗi thảo luận và báo cáo dài thành ghi chú ngắn, dễ đọc.

Hình ảnh trong prompt

GPT-6 Luna đọc ảnh chụp màn hình và ảnh cùng với văn bản của bạn.

Mức độ suy luận do bạn kiểm soát

None cho câu trả lời nhanh nhất, mức cao hơn khi tác vụ cần suy nghĩ nhiều hơn.

Bộ nhớ đệm prompt rẻ hơn

Đầu vào từ bộ nhớ đệm trên GPT-6 Luna chỉ tốn 10% giá đầu vào.

Các nhóm xây dựng gì với GPT-6 Luna

Phân loại phiếu hỗ trợ

Gắn nhãn và chuyển tiếp mọi yêu cầu hỗ trợ bằng GPT-6 Luna trước khi có người đọc.

Gắn thẻ nội dung

Gắn thẻ danh sách sản phẩm, đánh giá hoặc bài đăng ở quy mô toàn bộ danh mục.

Trích xuất có cấu trúc

Chuyển hóa đơn và biểu mẫu thành JSON với schema text.format.

Bắt đầu dùng GPT-6 Luna trong bốn bước

  1. 01

    Tạo một khóa

    Đăng nhập và tạo một khóa API. Thêm tín dụng bất cứ khi nào bạn cần; không có đăng ký.

  2. 02

    Thay đổi URL cơ sở

    Trỏ OpenAI SDK tới https://api.seedrouter.ai/v1. Mã của bạn giữ nguyên.

  3. 03

    Chọn GPT-6 Luna

    Gửi gpt-6-luna làm mô hình. Giữ mức độ suy luận ở low hoặc none để có chi phí thấp nhất.

  4. 04

    Kiểm tra hóa đơn

    Mỗi yêu cầu hiển thị token và phí của nó trong bản ghi sử dụng của bạn.

Lấy một khóa API

Tổng quan GPT-6 Luna trên SeedRouter

Điều bạn có thể sử dụng ngày hôm nay.

Tính năngGPT-6 Luna
OpenAI ResponsesCó, định dạng chính thức
OpenAI Chat CompletionsCó
Anthropic MessagesCó
Đầu vào hình ảnhCó, qua URL
StreamingCó
Prompt cachingCó, đầu vào từ bộ nhớ đệm và ghi bộ nhớ đệm tính phí riêng
Mức độ suy luận noneCó
Yêu cầu thất bạiKhông tính phí

Không cung cấp Batch, Flex, chế độ nền (background) và các cấp dịch vụ (service tier).

Giới hạn của GPT-6 Luna

Cửa sổ ngữ cảnh 1,05 triệu token

Trên GPT-6 Luna, prompt, hình ảnh và lịch sử dùng chung một cửa sổ 1,05 triệu token; đầu vào tối đa 922K.

128K token ra

Một yêu cầu GPT-6 Luna có thể trả về tối đa 128K token, bao gồm cả suy luận.

Prompt dài có giá cao hơn

Khi đầu vào vượt quá 272K token, toàn bộ yêu cầu GPT-6 Luna được tính theo mức giá ngữ cảnh dài cao hơn.

Lấy mẫu cần mức suy luận none

GPT-6 Luna chỉ chấp nhận temperature và top_p khi mức độ suy luận là none.

Vì sao nên gọi GPT-6 Luna qua SeedRouter

Một khóa, ba định dạng

Gọi GPT-6 Luna bằng OpenAI Responses, Chat Completions hoặc Anthropic Messages, với cùng một khóa.

Trả theo token

Nạp một lần và sử dụng cho bất kỳ mô hình nào. Không có gói, không có phí hàng tháng.

Lỗi miễn phí

Yêu cầu trả về lỗi không bị tính phí.

Giá trực tiếp

Mức trên trang này là mức tài khoản của bạn trả.

Prompt caching

Các tiền tố prompt lặp lại được đọc từ bộ nhớ đệm với mức giá GPT-6 Luna thấp hơn.

Đầu vào hình ảnh

Gửi ảnh chụp màn hình và ảnh qua URL cùng với prompt của bạn.

Streaming

Nhận token của GPT-6 Luna theo dạng streaming ngay khi được tạo với stream: true.

Mô hình liên quan

Các mô hình khác bạn có thể gọi với cùng một khóa.

GPT-6 Astra
gpt-6-astra

Gọi GPT-6 Astra bằng OpenAI SDK. Mô hình mạnh nhất của OpenAI, ngữ cảnh 1,05 triệu token, giá theo token cập nhật thời gian thực và Playground để dùng thử ngay.

Xem giá
GPT-6 Sol
gpt-6-sol

Gọi GPT-6 Sol bằng OpenAI SDK. Cửa sổ ngữ cảnh 1,05 triệu token, mức độ suy luận từ none đến max, giá theo token cập nhật trực tiếp và Playground dùng thử ngay.

Xem giá
claude-fable-5
claude-fable-5

Anthropic

Xem giá
claude-fable-5-1
claude-fable-5-1

Anthropic

Xem giá
claude-opus-5-5
claude-opus-5-5

Anthropic

Xem giá
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Xem giá

Câu hỏi thường gặp về GPT-6 Luna

GPT-6 Luna là gì?+

GPT-6 Luna là mô hình GPT-6 hiệu quả nhất của OpenAI, được xây dựng cho các tác vụ chuyên biệt với khối lượng lớn. Mô hình có cửa sổ ngữ cảnh 1,05 triệu token, viết tối đa 128K token mỗi yêu cầu và cho phép bạn đặt mức độ suy luận từ none đến max.

Nên dùng GPT-6 Luna hay GPT-6 Sol?+

Dùng GPT-6 Luna cho phân loại, trích xuất, tóm tắt và các việc lặp lại khác mà chi phí là quan trọng nhất. Chuyển sang GPT-6 Sol cho lập trình phức tạp và tác vụ agent, và GPT-6 Astra cho những việc khó nhất.

GPT-6 Luna giá bao nhiêu?+

GPT-6 Luna tính $0.08 / 1M đầu vào và $0.40 / 1M đầu ra mỗi triệu token, mức giá thấp nhất trong dòng GPT-6. Đầu vào từ bộ nhớ đệm có giá bằng 10% giá đầu vào. Prompt trên 272K token áp dụng mức giá ngữ cảnh dài.

Mức độ suy luận mặc định của GPT-6 Luna là gì?+

GPT-6 Luna mặc định là medium. Bạn có thể chọn none, low, medium, high, xhigh hoặc max; none tắt suy luận và là mức duy nhất chấp nhận temperature và top_p.

Mốc kiến thức của GPT-6 Luna là khi nào?+

Mốc kiến thức của GPT-6 Luna là ngày 18/05/2026. Với thông tin mới hơn, hãy đưa vào prompt.

ID mô hình GPT-6 Luna là gì và gọi như thế nào?+

ID mô hình là gpt-6-luna. Tạo khóa API SeedRouter, trỏ OpenAI SDK đến https://api.seedrouter.ai/v1 và gửi gpt-6-luna làm mô hình qua API Responses hoặc Chat Completions.

GPT-6 Luna có đọc được hình ảnh không?+

Có. GPT-6 Luna nhận hình ảnh cùng với văn bản, gửi qua URL trong yêu cầu. Mô hình chỉ trả về văn bản.

Tôi có bị tính phí nếu yêu cầu GPT-6 Luna thất bại không?+

Không. Yêu cầu GPT-6 Luna trả về lỗi sẽ không bị tính phí. Bạn chỉ trả cho số token mà một yêu cầu hoàn tất báo cáo.

Dùng thử GPT-6 Luna ngay

Gửi yêu cầu GPT-6 Luna đầu tiên từ Playground hoặc mã của riêng bạn chỉ trong vài phút.