Claude Opus 5.5 đã có trên SeedRouter

Hướng dẫn viết prompt cho Claude Opus 5.5: effort, agent, từ chối và mẫu prompt

Cách viết prompt cho Claude Opus 5.5 theo hướng dẫn của Anthropic: chọn mức effort nào, mẫu prompt cho agent, cập nhật tiến độ, lý do bị từ chối và frontend.

Đọc dạng Markdown

Để viết prompt tốt cho Claude Opus 5.5, hãy giữ nguyên các prompt bạn đã dùng với Claude Opus 5, đặt mức effort trước khi sửa câu chữ, rồi thêm vào system prompt một dòng có mục tiêu rõ ràng cho mỗi hành vi bạn muốn thay đổi. Hướng dẫn của Anthropic viết rằng các prompt Claude Opus 5 hiện có "sẽ hoạt động tốt mà không cần thay đổi", và effort là "thiết lập đầu tiên cần điều chỉnh để cân bằng giữa trí tuệ, độ trễ và chi phí". Phần lớn lời khuyên mới dành cho agent: giữ một lần chạy không người giám sát tiếp tục, nhận cập nhật tiến độ trong các lượt dài và điều tiết nhịp độ cho một nhóm agent. Mọi nội dung dưới đây lấy từ hướng dẫn "Prompting Claude Opus 5.5" của Anthropic và tài liệu tham chiếu API của mô hình, đã kiểm tra ngày 3 tháng 10 năm 2026.

Các quy tắc gửi yêu cầu dùng chung với Claude Fable 5.1, như không điền sẵn câu trả lời của trợ lý và không tự đặt temperature, đã có trong hướng dẫn viết prompt cho Claude Fable 5.1. Bài này nói về những điểm riêng của Claude Opus 5.5.

Prompt của Claude Opus 5 có dùng được trên Claude Opus 5.5 không?

Có. Anthropic nói chúng "sẽ hoạt động tốt mà không cần thay đổi", và các cách viết prompt cho Claude Opus 5 "vẫn là điểm khởi đầu hợp lý". Điều thay đổi là cách mô hình phân bổ công sức. Claude Opus 5.5 sinh token đầu ra nhanh hơn Claude Opus 5 hơn 30% và thường hoàn thành cùng một việc với ít token hơn.

Anthropic nêu bốn mảng mà mô hình đã tiến bộ, và chính chúng quyết định phần nào trong hướng dẫn này quan trọng với bạn:

  • Lập trình dạng agent và review code. Làm việc nhiều bước trong một repository thật, các lần chạy tự động dài với subagent, và review code bắt được nhiều lỗi hơn với ít báo động giả hơn.
  • Công việc tri thức. Ít có khả năng đưa ra con số sai hoặc dẫn sai nguồn hơn nhiều, và nhận ra những chỗ không khớp nhỏ trong dữ liệu đầu vào lớn, như một ngày rơi nhầm thứ trong tuần.
  • Giao tiếp. Các cập nhật tiến độ và báo cáo cuối cùng nói rõ nó đã làm gì, tìm thấy gì và cần gì từ bạn.
  • Biểu đồ, sơ đồ, ảnh chụp màn hình và điều khiển máy tính. Đọc tài liệu hình ảnh chính xác hơn Claude Opus 5, kể cả ở mức effort thấp nhất.

Nếu prompt của bạn chủ yếu dùng cho chat, hãy đọc các phần về effort và chat. Nếu bạn chạy agent, lời khuyên mới nằm ở các phần về agent.

Nên dùng mức effort nào với Claude Opus 5.5?

Bắt đầu với medium, giá trị mặc định của Claude Opus 5.5 (Claude Opus 5 mặc định là high). Đặt giá trị này một cách tường minh và thử vài mức trên chính công việc của bạn, thay vì mang nguyên giá trị đã dùng với Claude Opus 5 sang. Tên các mức effort không tương ứng với cùng một lượng suy nghĩ giữa các mô hình: trong thử nghiệm của Anthropic, Claude Opus 5.5 ở medium "ngang bằng hoặc vượt Claude Opus 5 ở high trong các bài đánh giá về lập trình và công việc tri thức", và trong một số bài đánh giá lập trình, low cũng gần đạt mức đó với chi phí thấp hơn nhiều.

EffortMục đích thường dùng, theo tài liệu về effort của Anthropic
lowCác tác vụ đơn giản cần tốc độ cao nhất và chi phí thấp nhất, chẳng hạn subagent. Đây cũng là điểm khởi đầu nếu tích hợp Claude Opus 5 của bạn từng chạy với chế độ suy nghĩ bị tắt.
mediumGiá trị mặc định của Claude Opus 5.5. Các tác vụ agent cần cân bằng giữa tốc độ, chi phí và hiệu năng.
highSuy luận phức tạp, bài toán lập trình khó, tác vụ agent.
xhighTác vụ agent và lập trình chạy lâu (hơn 30 phút). Chỉ dùng khi bạn đã đo được chất lượng tăng lên.
maxSuy luận sâu nhất, không giới hạn mức dùng token. Chỉ dùng khi bạn đã đo được chất lượng tăng lên.

Đặt medium một cách tường minh cho kết quả giống hệt việc bỏ qua effort.

Ở cùng một mức, Claude Opus 5.5 thường suy nghĩ nhiều hơn Claude Opus 5 trong mỗi lượt, nhất là ở xhigh và max. Hãy lưu ý ba điều:

  • Chừa đủ chỗ trong max_tokens. Phần suy nghĩ được tính vào max_tokens ngay cả khi bạn không nhìn thấy nó, nên một giới hạn đặt cho Claude Opus 5 khi tắt suy nghĩ có thể làm câu trả lời bị cắt. Với các lượt lập trình agent dài, Anthropic thấy max_tokens 128.000, mức tối đa của mô hình, cho kết quả tốt.
  • Giảm effort trước khi viết "suy nghĩ ít thôi". Giảm effort làm giảm suy nghĩ, chi phí và độ trễ đáng tin cậy hơn so với chỉ dẫn trong prompt.
  • Giữ cố định effort nếu bạn dựa vào bộ nhớ đệm prompt. Đổi giá trị effort ở cấp cao nhất giữa các yêu cầu sẽ làm bộ nhớ đệm prompt mất hiệu lực.

Effort được đặt trong output_config:

{
  "model": "claude-opus-5-5",
  "max_tokens": 128000,
  "output_config": {"effort": "medium"},
  "messages": [{"role": "user", "content": "Review this pull request for bugs and explain each one."}]
}

Có tắt được chế độ suy nghĩ trên Claude Opus 5.5 không?

Không. Claude Opus 5 chấp nhận "thinking": {"type": "disabled"} ở mức effort high trở xuống; Claude Opus 5.5 thì không, và yêu cầu đó trả về lỗi 400. Chế độ suy nghĩ là thích ứng và luôn bật. Nếu tích hợp của bạn từng chạy với suy nghĩ bị tắt, Anthropic khuyên bốn thay đổi:

  1. Bắt đầu ở effort low và đo đạc. Ở low, mô hình suy nghĩ ngắn. Nếu thời gian đến token đầu tiên vẫn quan trọng, một dòng system prompt như "Answer directly without deliberating." có thể giảm suy nghĩ thêm nữa, nhưng hãy kiểm tra chất lượng sau khi thêm.
  2. Bỏ các chỉ dẫn dùng để thay cho suy nghĩ. Nếu prompt của bạn yêu cầu mô hình viết lập luận ra trong câu trả lời, hãy xóa dòng đó và đọc lập luận từ bản tóm tắt suy nghĩ. Giờ đây, một prompt ép mô hình tái hiện lập luận trong câu trả lời có thể bị từ chối (xem phần về từ chối bên dưới).
  3. Thử lại các mẹo cũ. Những quy tắc bạn thêm để tránh lỗi khi chạy không có suy nghĩ có thể không còn cần nữa. Hãy xóa mọi quy tắc bảo mô hình không được suy nghĩ.
  4. Đọc phản hồi theo loại khối. Phản hồi có thể bắt đầu bằng khối thinking hoặc không, nên hãy kiểm tra loại của từng khối thay vì cho rằng khối đầu tiên là văn bản.

Để xem lập luận, hãy yêu cầu bản tóm tắt suy nghĩ:

{
  "model": "claude-opus-5-5",
  "max_tokens": 16000,
  "thinking": {"type": "adaptive", "display": "summarized"},
  "output_config": {"effort": "low"},
  "messages": [{"role": "user", "content": "Which of these three invoices has a total that does not match its line items?"}]
}

Làm sao để agent Claude Opus 5.5 chạy không giám sát không dừng quá sớm?

Với các tác vụ dài, Claude Opus 5.5 cập nhật cho người dùng trong lúc làm, và một số cập nhật kết thúc lượt bằng văn bản thay vì lời gọi công cụ (stop_reason: "end_turn"). Vòng lặp agent nào coi mỗi lượt như vậy là "xong việc" sẽ dừng giữa chừng. Cách xử lý của Anthropic có một phần ở harness và một phần ở prompt.

Trong harness, hãy coi một lượt kết thúc chỉ bằng văn bản là một bản báo cáo, không phải bằng chứng công việc đã xong. Theo dõi các phần của tác vụ trong một checklist mà mô hình cập nhật, như một công cụ to-do hoặc một tệp. Nếu một lượt kết thúc khi còn mục chưa xong mà không nêu điều gì đang chặn, hãy gửi một tin nhắn người dùng ngắn liệt kê chúng:

Your task list still has open items: migrate the remaining two endpoints and update their tests. Continue with them. If one is blocked, say what is blocking it.

Dừng lại sau hai hoặc ba lần tự động cho chạy tiếp cùng một tác vụ, để lần chạy thật sự bị kẹt sẽ kết thúc và có thể được xem xét. Nếu một lệnh chạy nền hoặc một subagent vẫn đang chạy, hãy chờ nó xong rồi trả kết quả về làm tin nhắn người dùng tiếp theo.

Trong system prompt, hãy nêu rõ những kiểu dừng sớm bạn không muốn. Ví dụ của Anthropic được viết cho agent chạy hoàn toàn không giám sát, và được đặt ở cuối system prompt ngay từ yêu cầu đầu tiên của phiên. Thêm nó giữa chừng sẽ làm thay đổi system prompt và khiến các khối suy nghĩ trước đó trong cuộc hội thoại mất hiệu lực.

A standing instruction from the user, the person you are working for. It is about how your turns end. A message with no tool call in it ends your turn, and the work stops there until you are asked to continue. The user has seen you end turns in four ways while work they asked for was still owed, and does not want any of them. One: a long summary of what was done that closes by announcing the next step and has no tool call, so the next thing never starts. Two: an offer to carry on with something unless the user would prefer otherwise, which stops to wait for an answer the user was not going to give. Three: a list of decisions for the user when, by your own account, none of them blocks the rest of the work. Four: deciding that this is a good place to report, because the turn has been long or a milestone is done. Status notes are welcome, and so are your recommendations on open decisions, but put them in the same message as your next tool call and carry on with whatever does not depend on the user's answer. If you notice yourself inviting the user to redirect you or offering to wait, delete it and do the next thing. The stops the user does want are the ones where nothing can move without them, or where the thing blocking you is deliberately protected from you. This does not override the need for confirmation on risky or destructive actions.

Đừng thêm đoạn này vào các ứng dụng có người tham gia trực tiếp, nơi có người sẵn sàng trả lời, và hãy giữ bước xác nhận của riêng bạn cho các thao tác rủi ro hoặc không thể hoàn tác. Hãy dự tính số lời gọi công cụ và token đầu ra cho mỗi tác vụ sẽ tăng lên một chút.

Làm sao nhận cập nhật tiến độ từ agent Claude Opus 5.5 khi chạy lâu?

Giữa các lời gọi công cụ, Claude Opus 5.5 viết các ghi chú tiến độ ngắn: vừa tìm thấy gì và sẽ làm gì tiếp theo. Với mô hình này, các ghi chú đó được trả về dưới dạng khối thinking chứ không phải khối text, và mặc định nội dung của chúng rỗng, nên một client chỉ hiển thị khối text có thể trông như đứng im suốt một lượt dài. Anthropic có mô tả một chế độ hiển thị beta trả về bản tóm tắt cho từng ghi chú; các giá trị thinking.display mà endpoint ghi nhận được liệt kê trong tài liệu tham chiếu API của Claude Opus 5.5.

Có ba cách ở phía prompt và harness dùng được mà không cần thiết lập đặc biệt:

  • Cho mô hình một công cụ để gửi nội dung nguyên văn. Nếu nó có thể cần đưa cho người dùng thứ gì đó chính xác giữa lượt, như một đoạn code, hãy cho nó một công cụ đơn giản "gửi tin nhắn cho người dùng" và dặn chỉ dùng cho việc đó. Khai báo công cụ ngay từ yêu cầu đầu tiên; thêm vào sau sẽ làm các khối suy nghĩ trước đó mất hiệu lực.
  • Yêu cầu cập nhật ở các thời điểm cố định. Ví dụ, một câu nêu ý định trước lời gọi công cụ đầu tiên và một bản tóm tắt ngắn ở cuối. Mô hình làm theo kiểu chỉ dẫn này rất sát, điều này hữu ích nhất khi có người đang theo dõi.
  • Nhắc một lượt im lặng từ harness. Đếm số bước gọi công cụ liên tiếp không cho người dùng thứ gì để đọc. Sau vài bước, chẳng hạn năm, hãy thêm một lời nhắc sau kết quả công cụ mới nhất, và dừng sau hai hoặc ba lời nhắc. Câu chữ của Anthropic:
The user hasn't heard from you in a while — say in a few words what you're doing, then continue.

Trong thử nghiệm của Anthropic trên các tác vụ lập trình agent, lời nhắc này giảm khoảng một nửa tỉ lệ tác vụ có một quãng im lặng dài, mà chi phí không thay đổi đáng kể.

Làm sao để agent Claude Opus 5.5 xem xét ngữ cảnh trước khi hành động?

Claude Opus 5.5 có xu hướng bắt tay vào việc ngay. Trong các quy trình tự động trải qua email, tài liệu, bảng tính và bản ghi CRM, thông tin mà một tác vụ phụ thuộc vào thường nằm ở chỗ yêu cầu không nhắc tới, như một chính sách trong chuỗi email cũ hay một quy tắc ở tab khác của bảng tính. Một câu trong system prompt sẽ khiến mô hình nhìn quanh trước:

Before taking any action, explore broadly with tool calls: list and open the emails, documents, spreadsheet tabs and records across the available apps that could be relevant to this task, including ones the task does not explicitly mention, and use what you find.

Trong thử nghiệm của Anthropic trên các tác vụ nhiều ứng dụng, có dòng này thì mô hình hoàn thành đúng nhiều tác vụ hơn hẳn, ở cả mức effort medium và max, đổi lại số lời gọi công cụ tăng nhẹ. Vì dòng này bảo mô hình hành động theo những gì tìm thấy, đừng để nội dung không đáng tin nằm trong các bản ghi mà nó tìm kiếm.

Làm sao để một nhóm agent Claude Opus 5.5 xong việc nhanh hơn?

Claude Opus 5.5 rất chú ý đến thời gian đã trôi qua. Trong một cấu trúc mà agent chính giao việc cho các subagent, hãy cho nó một ngân sách thời gian: để harness thêm một dòng ngắn vào cuối mỗi tin nhắn gửi lại cho mô hình, chẳng hạn elapsed 340s / 1200s. Mô hình sẽ điều chỉnh nhịp độ để xong trong ngân sách và thường xong sớm hơn khá nhiều, nên hãy đặt ngân sách cao hơn một chút so với thời gian bạn thật sự muốn bỏ ra. Nếu không ước tính được ngân sách, chỉ hiển thị thời gian đã trôi qua và thêm câu này vào system prompt:

Time matters here: do not spend time that can be avoided, and the earlier a correct result is obtained, the better.

Ngân sách chỉ mang tính tham khảo và không có gì buộc mô hình dừng ở giới hạn, nên hãy giữ timeout của riêng bạn nếu cần dừng cứng. Ngân sách chặt hơn không giống với effort thấp hơn: giảm effort làm giảm chính khối lượng công việc, còn ngân sách chủ yếu khiến nhiều agent làm song song hơn. Khi bị áp lực thời gian, mô hình có thể tìm kiếm và kiểm chứng ít đi một chút, nên hãy kiểm tra chất lượng câu trả lời trên chính công việc của bạn.

System prompt cho chat có nên bảo Claude Opus 5.5 "suy nghĩ cẩn thận" không?

Không. Anthropic khuyên bỏ các dòng như "think carefully before answering" (hãy suy nghĩ cẩn thận trước khi trả lời) khỏi system prompt cho chat: mô hình tự quyết định suy nghĩ bao nhiêu, và cái để điều khiển việc đó là effort. Trong thử nghiệm của Anthropic với một sản phẩm chat, bỏ một dòng như vậy khiến câu trả lời bắt đầu sớm hơn mà chất lượng không giảm rõ rệt.

Còn hai dòng nữa cho chat đáng biết. Một dòng khiến mô hình coi các câu trả lời trước là đã chốt, để các lượt sau bắt đầu nhanh hơn. Dòng kia đánh dấu văn bản người dùng dán vào, để mô hình không làm theo các chỉ dẫn giấu trong email hay trang web. Cả hai dòng, nguyên văn, nằm trong phần về Claude Opus 5.5 của hướng dẫn Fable 5.1. Đừng dùng dòng "câu trả lời đã chốt" cho các phân tích dài hay tác vụ agent, nơi một bước sau có thể phát hiện lỗi ở bước trước.

Làm sao có câu trả lời tốt hơn về biểu đồ, sơ đồ và ảnh chụp màn hình?

Trước hết hãy thử lại. Không cần thêm công cụ, Claude Opus 5.5 đọc biểu đồ dày đặc, lưu đồ và ảnh chụp lịch chính xác hơn Claude Opus 5 rất nhiều; trong thử nghiệm của Anthropic, ngay cả ở mức effort thấp nhất, nó đọc giá trị trên biểu đồ dày đặc chính xác hơn Claude Opus 5 ở mức cao nhất. Những cách hỗ trợ bạn dựng cho các mô hình cũ có thể không còn cần nữa.

Với những đầu vào dày đặc nhất, hai điều vẫn có ích:

  • Ảnh có độ phân giải cao hơn, nhất là với bản vẽ kỹ thuật.
  • Công cụ xử lý ảnh. Chạy mô hình như một agent với một container chứa ảnh gốc và đã cài PIL hoặc OpenCV, để nó có thể cắt, phóng to và đo đạc. Nếu như vậy quá nặng, chỉ một công cụ cắt ảnh cũng đã giúp ích. Mô hình dùng các công cụ này tốt hơn ở mức effort cao hơn.

Không có công cụ, tăng effort giúp đọc bản vẽ kỹ thuật tốt hơn nhưng hầu như không giúp gì với biểu đồ. Ảnh được đặt trong lượt của người dùng dưới dạng khối image với nguồn URL; tài liệu tham chiếu API có định dạng cụ thể.

Làm sao để frontend do Claude Opus 5.5 làm không trông rập khuôn?

Hãy gọi tên những kiểu bạn không muốn. Khi không có định hướng thiết kế, Claude Opus 5.5 quay về vài phong cách mặc định, và một câu chung chung như "tránh vẻ ngoài kiểu AI rập khuôn" phần lớn chỉ đổi phong cách mặc định này sang phong cách mặc định khác. Ví dụ của Anthropic liệt kê những thứ cụ thể cần tránh:

Output a vanilla HTML/CSS personal website with placeholder data. Do not use a cream or off-white background, italic accent words in headlines, numbered "01/02/03" section labels, monospace labels, or pill-shaped buttons.

Làm theo vòng lặp: xem kết quả đầu tiên đã dùng những phong cách nào để thay thế, rồi thêm chúng vào danh sách.

Vì sao Claude Opus 5.5 trả về stop_reason "refusal"?

Một bộ phân loại an toàn đã từ chối yêu cầu. Claude Opus 5.5 chạy các bộ phân loại cho sinh học, an ninh mạng và trích xuất lập luận; lời từ chối được trả về như một phản hồi bình thường với stop_reason: "refusal" và một đối tượng stop_details ghi rõ danh mục.

Danh mụcPhạm viCách xử lý
Sinh họcCác biện pháp bảo vệ giống Claude Fable 5.1; là mới nếu bạn chuyển từ Claude Opus 5 sang. Các câu hỏi thông thường về sức khỏe và giáo dục không bị ảnh hưởng.Các tổ chức làm việc trong lĩnh vực khoa học sự sống có thể đăng ký Life Sciences Verification Program của Anthropic.
An ninh mạngCác hoạt động an ninh mạng lưỡng dụng có rủi ro cao.Tìm lỗ hổng trong mã nguồn được cho phép và không cần thay đổi gì.
Trích xuất lập luậnCác prompt ép mô hình tái hiện lập luận nội bộ trong câu trả lời.Xóa các chỉ dẫn đó, đặt "display": "summarized" và đọc các khối suy nghĩ. Yêu cầu giải thích ngắn về câu trả lời vẫn được.

Về các trường hợp yêu cầu vô hại bị từ chối nói chung, xem vì sao Claude từ chối một yêu cầu vô hại trong hướng dẫn Fable 5.1.

Câu hỏi thường gặp

Có hướng dẫn viết prompt chính thức cho Claude Opus 5.5 không?

Có. Anthropic công bố "Prompting Claude Opus 5.5" trong tài liệu dành cho nhà phát triển, cùng một trang chung về các thực hành tốt áp dụng cho mọi mô hình Claude hiện hành. Bài viết này tóm tắt hướng dẫn Opus 5.5 tính đến ngày 3 tháng 10 năm 2026 và trích nguyên văn các mẫu prompt.

Mức effort mặc định của Claude Opus 5.5 là gì?

medium. Claude Opus 5 mặc định là high. Các mức gồm low, medium, high, xhigh và max, được đặt trong output_config.effort.

Claude Opus 5.5 viết được tối đa bao nhiêu token đầu ra?

Tối đa 128.000 token cho mỗi yêu cầu, và mức này đã gồm phần suy nghĩ. Cửa sổ ngữ cảnh là 1M token.

Có thể điền sẵn câu trả lời của Claude Opus 5.5 hoặc đặt temperature không?

Không. Điền sẵn câu trả lời của trợ lý và mọi temperature khác giá trị mặc định đều trả về lỗi 400, còn việc ép gọi một công cụ cụ thể thì không được hỗ trợ. Hãy mô tả định dạng bạn muốn trong prompt. Hướng dẫn viết prompt cho Claude Fable 5.1 giải thích nên dùng gì thay thế cho từng cái.

Claude Opus 5.5 hay Claude Fable 5.1 tốt hơn cho agent?

Tùy vào tác vụ và ngân sách; bài so sánh các mô hình Claude giải thích nên chọn mô hình nào. Lời khuyên viết prompt khác nhau chủ yếu ở giá trị mặc định: Claude Opus 5.5 bắt đầu ở effort medium, Claude Fable 5.1 ở high.

Thử các prompt

Chạy các mẫu prompt này trên Claude Opus 5.5 bằng một key SeedRouter, qua Anthropic SDK hoặc các định dạng Chat Completions và Responses của OpenAI. Tài liệu tham chiếu API của Claude Opus 5.5 liệt kê mọi tham số, và trang mô hình hiển thị giá hiện tại theo token. SeedRouter tính phí theo mức dùng: nạp một lần, credit không bao giờ hết hạn, và các yêu cầu thất bại không bị tính phí.

Hướng dẫn liên quan