Hướng dẫn viết prompt cho Claude Opus 5.5: Những điều lập trình viên cần biết

Công nghệ28 tháng 9, 2026·6 phút đọc

Anthropic vừa công bố hướng dẫn chi tiết về cách viết prompt cho Claude Opus 5.5 — mô hình mới có tốc độ sinh token nhanh hơn 30% so với Claude Opus 5. Tài liệu tập trung vào các kỹ thuật điều chỉnh mức độ suy luận (effort), quản lý tác vụ agent tự động và tối ưu chi phí khi tích hợp vào sản phẩm.

Hướng dẫn viết prompt cho Claude Opus 5.5: Những điều lập trình viên cần biết

Anthropic vừa phát hành tài liệu hướng dẫn chi tiết về cách viết prompt hiệu quả cho Claude Opus 5.5 — phiên bản mô hình mới nhất của họ. Điểm đáng chú ý nhất: mô hình này sinh token nhanh hơn hơn 30% so với Claude Opus 5 và thường hoàn thành cùng một tác vụ với ít token hơn. Điều đó đồng nghĩa với việc tiết kiệm chi phí đáng kể cho các doanh nghiệp đang vận hành sản phẩm dựa trên API của Anthropic.

Tin tốt cho các nhóm phát triển là những prompt hiện có dành cho Claude Opus 5 vẫn hoạt động tốt mà không cần chỉnh sửa nhiều. Tuy nhiên, có một số thay đổi quan trọng về cơ chế hoạt động mà lập trình viên cần nắm rõ để khai thác tối đa sức mạnh của mô hình mới.

Điểm mạnh nổi bật của Claude Opus 5.5

Theo đánh giá nội bộ của Anthropic, Claude Opus 5.5 thể hiện vượt trội ở nhiều hạng mục:

  • Lập trình agent và review code: Mô hình mạnh nhất khi xử lý các tác vụ nhiều bước trong repository thực tế, chẳng hạn như thực hiện một thay đổi xuyên suốt codebase lớn cho đến khi test pass. Ở mức effort mặc định (medium), nó đạt hoặc vượt Claude Opus 5 ở mức high, với số bước và token ít hơn.
  • Công việc tri thức: Ít mắc lỗi khẳng định sai số liệu hoặc trích dẫn nhầm nguồn. Đặc biệt hiệu quả với các tác vụ mô hình tài chính, phát hiện lỗi trong bảng định giá (valuation workbook).
  • Giao tiếp: Các báo cáo về tiến độ công việc rõ ràng hơn, nói thẳng những gì đã làm, tìm được gì và cần gì ở người dùng.
  • Đọc biểu đồ, sơ đồ và ảnh chụp màn hình: Đọc chính xác hơn Claude Opus 5 ngay cả ở mức effort thấp nhất, đặc biệt với các trường hợp mà ý nghĩa phụ thuộc vào vị trí chứ không phải văn bản — ví dụ mũi tên trong flowchart nối ô nào, hay sự thay đổi giữa hai phiên bản của một sơ đồ.

Điều chỉnh mức effort: Chìa khóa kiểm soát chi phí

Effort là tham số quan trọng nhất để kiểm soát mức độ suy luận của Claude Opus 5.5. Vì cơ chế thinking luôn bật, đây là cài đặt đầu tiên cần điều chỉnh khi cân đối giữa chất lượng, độ trễ và chi phí.

Lưu ý quan trọng: tên các mức effort không tương ứng với cùng lượng suy luận giữa các mô hình. Claude Opus 5.5 ở mức medium có thể ngang hoặc vượt Claude Opus 5 ở mức high trên các bài đánh giá về lập trình và công việc tri thức.

Ba khuyến nghị cụ thể từ Anthropic:

  • Đặt max_tokens đủ cao để chừa chỗ cho token suy luận và câu trả lời. Với các tác vụ lập trình agent dài, con số 128.000 (mức tối đa của mô hình) đã được chứng minh hiệu quả.
  • Chỉ dùng xhigh và max cho những công việc mà bạn đã đo lường được cải thiện chất lượng rõ rệt.
  • Muốn ít suy luận hơn thì giảm effort trước, thay vì thêm câu lệnh vào prompt — cách này giảm chi phí và độ trễ đáng tin cậy hơn.

Một điểm kỹ thuật đáng lưu ý: thay đổi giá trị effort ở cấp cao nhất giữa các request sẽ vô hiệu hóa prompt cache. Nếu cần chạy riêng lẻ từng lượt ở mức khác, hãy dùng tính năng thay đổi effort theo từng message (bản beta) để giữ cache.

Xử lý tác vụ agent không giám sát

Một trong những vấn đề phổ biến nhất với các agent chạy tự động: Claude Opus 5.5 có xu hướng dừng lại giữa chừng để báo cáo tiến độ, với stop_reason: "end_turn". Vòng lặp agent coi đó là kết thúc tác vụ sẽ dừng luôn — trong khi công việc vẫn còn dang dở.

Giải pháp được Anthropic đề xuất:

  • Coi lượt kết thúc chỉ có text là báo cáo, không phải bằng chứng tác vụ đã xong.
  • Duy trì danh sách checklist và nhắc mô hình tiếp tục nếu còn mục chưa hoàn thành.
  • Nếu có tiến trình đang chạy nền (background command, subagent), chờ nó xong rồi trả kết quả về cho mô hình.
  • Thêm hướng dẫn vào system prompt mô tả rõ những kiểu dừng sớm cần tránh.

Điểm cần cân nhắc: thêm hướng dẫn này sẽ khiến mô hình thực hiện nhiều lệnh gọi công cụ và sinh nhiều token hơn mỗi tác vụ. Hãy giữ bước xác nhận của riêng bạn cho các hành động rủi ro hoặc không thể đảo ngược.

Cập nhật tiến độ thân thiện với người dùng

Với các ứng dụng chat hoặc công cụ có giao diện người dùng, Claude Opus 5.5 viết các ghi chú tiến độ ngắn giữa các lệnh gọi công cụ. Tuy nhiên, mặc định các ghi chú này trả về dưới dạng progress-update thinking blocks với nội dung text rỗng.

Để nhận được chúng, cần đặt display: "updates" (bản beta, header thinking-display-updates-2026-08-18). Đây là lưu ý quan trọng cho các nhóm phát triển sản phẩm tại Việt Nam đang xây dựng các ứng dụng AI agent — nếu client chỉ render text block, người dùng sẽ thấy giao diện "im lặng" trong suốt lượt tác vụ dài.

Vấn đề bảo mật và từ chối phục vụ

Claude Opus 5.5 chạy các bộ phân loại an toàn mới, bao gồm:

  • Sinh học: Tương tự Claude Fable 5.1, ảnh hưởng đến một số tác vụ khoa học sự sống.
  • An ninh mạng: Tìm lỗ hổng trong source code được phép; các hoạt động dual-use rủi ro cao thì không.
  • Trích xuất suy luận (reasoning_extraction): Các prompt yêu cầu mô hình viết lại quá trình suy luận nội bộ ra text có thể bị từ chối.

Khi bị từ chối, phản hồi trả về có stop_reason: "refusal" kèm đối tượng stop_details nêu rõ danh mục. Có thể cấu hình tự động thử lại trên mô hình dự phòng, ngoại trừ các trường hợp từ chối do reasoning_extraction.

Tối ưu cho luồng công việc đa ứng dụng

Trong các tác vụ tự động hóa xuyên ứng dụng (email, tài liệu, bảng tính, CRM), thông tin cần thiết thường nằm ở nơi mà yêu cầu không đề cập trực tiếp. Claude Opus 5.5 có xu hướng bắt tay vào việc ngay, nên một câu lệnh trong system prompt yêu cầu mô hình khám phá rộng trước khi hành động sẽ giúp tăng đáng kể tỷ lệ hoàn thành đúng.

Gợi ý cho lập trình viên Việt Nam

Với các nhóm phát triển sản phẩm AI tại Việt Nam đang cân nhắc nâng cấp lên Claude Opus 5.5, đây là thời điểm hợp lý để:

  • Chạy lại bộ đánh giá (eval) nội bộ với mức effort medium làm điểm khởi đầu.
  • Rà soát lại các prompt cũ được viết cho Claude Opus 5, đặc biệt là những prompt giả định thinking đã tắt.
  • Đo lường lại chi phí token thực tế, vì mô hình mới có thể tốn ít token hơn cho cùng khối lượng công việc.

Tài liệu đầy đủ có sẵn tại trang tài liệu chính thức của Anthropic, kèm theo hướng dẫn di chuyển (migration guide) chi tiết cho những ai đang chuyển từ Claude Opus 5.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗