AI-native development⏱ 13 phút đọc · 7 thg 10, 2026

Claude Opus 5.5 có gì mới cho lập trình viên: giá, benchmark và cách dùng

Claude Opus 5.5 rẻ hơn Opus 5, là model mặc định của Claude Code và có trong GitHub Copilot. Bài này tóm tắt giá, benchmark chính thức, breaking change khi gọi API, mẹo dùng và khi nào nên chọn Opus 5.5, Sonnet 5.5, Haiku 5.5 hay Fable 5.1.

HOLETEX · POST
OPUS 5.5
có gì mới

Sáng thứ Hai, bạn chạy claude update, mở lại dự án và thấy header của Claude Code ghi một cái tên mới: Opus 5.5, kèm dòng "with medium effort". Cùng lúc, service nội bộ gọi Claude API mà bạn vừa đổi model ID sang bản mới bắt đầu trả lỗi 400, dù trước đó chạy ổn với Opus 5.

Cả hai chuyện đều đến từ cùng một bản phát hành. Ngày 22/9/2026, Anthropic ra Claude Opus 5.5, model đầu tiên của dòng Claude 5.5. Theo Anthropic, nó đạt mức của Claude Fable 5.1 trên phần lớn công việc, trong khi chi phí chạy thấp hơn khoảng 40% so với Opus 5. Sau đó Sonnet 5.5 (28/9) và Haiku 5.5 (7/10) cũng đã ra, nên câu hỏi "dùng model nào cho việc gì" cần trả lời lại.

Thông số Claude Opus 5.5

MụcClaude Opus 5.5
Ngày phát hành22/9/2026
Model ID (Claude API)claude-opus-5-5 (Bedrock: anthropic.claude-opus-5-5)
Giá API (input / output, mỗi 1M token)$4 / $20
Cache read$0,20 / 1M token (bằng 5% giá input)
Batch APIGiảm 50%: $2 / $10
Context window1M token, cùng đơn giá trên toàn cửa sổ
Output tối đa128K token (300K trên Batch API với beta header)
ThinkingAdaptive, luôn bật, không tắt được
Effort mặc địnhmedium
Kiến thức đáng tin cậy tới6/2026
Nền tảngClaude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, Microsoft Foundry

Opus 5.5 đứng ở đâu trong dòng Claude

Hiện Anthropic có bốn model mở rộng rãi (ngoài Claude Mythos 5.1 chỉ mở giới hạn). Sonnet 5 và Haiku 4.5 đã chuyển sang nhóm legacy, vẫn gọi được. Trang tổng quan model mô tả như sau:

ModelDành choGiá (in / out)Tốc độ tương đốiEffort mặc định
Fable 5.1Reasoning khó, agent chạy rất dài$10 / $50Chậm hơnhigh
Opus 5.5Agentic coding chạy dài, knowledge work$4 / $20Vừa phảimedium
Sonnet 5.5Cân bằng tốc độ và trí tuệ$2 / $10Nhanhhigh
Haiku 5.5Việc khối lượng lớn, cần nhanh: phân loại, trích xuất, routingTừ $0,10 / $0,50Nhanh nhấtmedium

Cả bốn đều có context 1M token và output tối đa 128K. Haiku 5.5 là model duy nhất tính giá theo độ dài prompt: $0,10 / $0,50 với prompt tới 100K token, $0,50 / $2,50 khi dài hơn.

Lời khuyên chính thức trong docs: nếu chưa biết chọn gì, bắt đầu với Opus 5.5. Chỉ chuyển sang Fable 5.1 cho reasoning đòi hỏi cao, task agent rất dài, hoặc khi Opus 5.5 ở effort cao vẫn chưa đạt yêu cầu trong eval của bạn.

Benchmark chính thức và cách đọc cho đúng

Bảng dưới lấy từ trang công bố Opus 5.5, giữ nguyên tên và phiên bản benchmark mà Anthropic dùng:

BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066,4%55,8%52,3%57,9%*
FrontierCode v1.1 (Main)54,4%50,3%48,0%53,3%
CursorBench 4.057,8%51,8%46,6%không có số
OSWorld 2.1 (partial)81,8%80,7%74,0%không có số
GDPval-AA v2.1 (Elo)1846173517081542
AutomationBench40,0%31,4%26,9%41,4%
Terminal-Bench-Science 0.158,7%52,6%29,0%64,6%*

* Số OpenAI tự công bố, Terminal-Bench 4.0 ở effort high.

Trước khi kết luận gì, đọc kỹ phần chú thích của bảng gốc:

  • So sánh đáng tin nhất là giữa các model Claude, vì Anthropic đo chúng trên cùng một setup. Ở Terminal-Bench 4.0 và Terminal-Bench-Science, số của GPT-6 Astra do OpenAI tự công bố, không chạy lại cùng harness, nên đừng so trực tiếp với 66,4% của Opus 5.5. GDPval-AA v2.1 là benchmark của Artificial Analysis, AutomationBench do Zapier chạy.
  • Opus 5.5 không thắng ở mọi nơi, kể cả theo số liệu của chính Anthropic: GPT-6 Astra dẫn ở AutomationBench và Terminal-Bench-Science 0.1. Lưu ý AutomationBench chạy không có model dự phòng nên mỗi lần safeguard can thiệp bị tính là trượt, còn Terminal-Bench-Science có sai số khoảng ±3,5 đến 5 điểm.
  • Kết quả của Opus 5.5 trong bảng chạy ở effort max, riêng Terminal-Bench 4.0 ở xhigh. Ở effort mặc định (medium), Anthropic công bố riêng: CursorBench 4.0 còn 52,5% (vẫn nhỉnh hơn 51,8% của Fable 5.1 ở max), còn FrontierCode v1.1 lại đạt 54,6%, cao hơn cả 54,4% ở max. Effort cao hơn không phải lúc nào cũng cho điểm cao hơn, nên hãy đo trên task của bạn.
  • Chính Anthropic viết rằng ở mức năng lực hiện nay, chênh lệch benchmark ngày càng kém tin cậy để suy ra khác biệt thực tế, và khoảng cách giữa Opus 5.5 và Fable 5.1 hẹp hơn những gì điểm số cho thấy.

Cũng đừng đem các con số này so với Terminal-Bench 2.x hay SWE-bench Verified của model khác: khác phiên bản là khác độ khó. Bài so sánh model AI cho lập trình 2026 giải thích kỹ vì sao.

Chi phí: rẻ hơn và tốn ít token hơn

Với dev dùng API, thay đổi thấy rõ nhất là chi phí:

Loại token (mỗi 1M)Opus 5Opus 5.5Thay đổi
Input$5$4-20%
Output$25$20-20%
Cache write (5 phút)$6,25$5-20%
Cache read$0,50$0,20-60%

Ngoài đơn giá thấp hơn, Opus 5.5 dùng ít token hơn cho mỗi task. Theo thử nghiệm của Anthropic ở cài đặt mặc định, tổng chi phí trên workload điển hình giảm khoảng 40% so với Opus 5, và tốc độ sinh output nhanh hơn trên 30%. Một ví dụ phiên Claude Code trên blog claude.dev của Anthropic cho mức giảm khoảng 31% ($3,50 xuống $2,40), nên con số thực tế tùy workload.

Để hình dung, thử tính một phiên giả định gồm 2M token cache read, 100K token input mới và 150K token output (chỉ tính theo đơn giá):

  • Opus 5: 2 × $0,50 + 0,1 × $5 + 0,15 × $25 = $5,25
  • Opus 5.5: 2 × $0,20 + 0,1 × $4 + 0,15 × $20 = $3,80

Nhìn vào phép tính, cache read chiếm nhiều token nhất nhưng output mới là phần tốn tiền nhất ($3 trên $3,80), vì output đắt gấp 5 lần input và thinking cũng tính là output. Từ đó suy ra vài cách giữ hóa đơn thấp:

  • Viết yêu cầu đủ rõ ngay lượt đầu. Mỗi lượt sửa lại là thêm một lần đọc lại toàn bộ hội thoại cộng thêm output mới.
  • Gom các việc cùng một module vào một phiên liền mạch thay vì mở phiên mới cho từng việc nhỏ, để tận dụng phần context đã cache.
  • Chỉ nâng effort cho bước khó, ví dụ debug race condition, còn việc đổi tên biến hay viết test đơn giản thì để medium hoặc thấp hơn.

Thay số thật của bạn vào: trong Claude Code, chạy /usage khi xong một task để xem token đã dùng, chi phí ước tính và tỉ lệ cache read. Bài What a task costs on Opus 5.5 trên claude.dev phân tích kỹ hơn nếu bạn muốn đào sâu.

Nếu cần nhanh hơn, fast mode (research preview) cho Opus 5.5 chạy nhanh tới 2,5 lần với giá $8 / $40, gấp đôi giá thường. Fast mode chỉ có trên Claude API của Anthropic, không có trên Bedrock, Google Cloud, Foundry hay Claude Platform on AWS.

Dùng Opus 5.5 ở đâu

Claude apps. Opus có trong các gói Pro, Max, Team và Enterprise, gói Free thì không.

Claude Code. Từ v2.1.280, Opus 5.5 là model mặc định cho Pro, Max, Team, Enterprise và tài khoản API. Một thay đổi dễ bị bỏ qua: trước bản này, gói Pro và Team Standard mặc định dùng Sonnet. Từ v2.1.284, alias sonnet trỏ tới Sonnet 5.5 trên Anthropic API, và từ v2.1.293, alias haiku trỏ tới Haiku 5.5.

GitHub Copilot. Theo changelog của GitHub ngày 22/9, Opus 5.5 có cho Copilot Pro+, Max, Business và Enterprise (gói Pro không có), dùng được trên VS Code, Visual Studio, JetBrains, Xcode, Eclipse, Copilot CLI, Copilot coding agent, GitHub Copilot app, github.com và GitHub Mobile. Model tính phí theo giá niêm yết của nhà cung cấp trong cơ chế usage-based billing. Nếu bạn ở gói Pro, Sonnet 5.5 (có trong Copilot từ 28/9) là lựa chọn gần nhất. Chi tiết có ở bài GitHub Copilot là gì.

Trong Claude Code: effort và cách giao việc

Opus 5.5 trong Claude Code bắt đầu ở effort medium, thấp hơn một bậc so với high của Opus 5. Theo công bố của Anthropic, Opus 5.5 ở medium đã vượt Opus 5 ở max trên Terminal-Bench 4.0 với khoảng 1/5 chi phí. Với task khó hoặc chạy dài, hãy chủ động tăng effort.

bash
# Cập nhật lên bản hỗ trợ Opus 5.5 (cần v2.1.280 trở lên)
claude update

# Mở slider chọn effort (Enter = lưu làm mặc định, s = chỉ phiên này),
# hoặc đặt thẳng một mức (được lưu làm mặc định)
/effort
/effort high

# Chỉ chạy phiên này ở xhigh, không đổi mặc định
claude --effort xhigh

# Chuyển sang Sonnet 5.5 cho việc nhẹ (lựa chọn này cũng được lưu làm mặc định)
/model sonnet

# Bật/tắt fast mode (với gói subscription, fast mode trừ vào usage credits)
/fast

Vài điểm cần biết:

  • Các mức effort của Opus 5.5 gồm low, medium, high, xhigh, max. Docs Claude Code lưu ý max có thể giúp ở task khó nhưng dễ "nghĩ quá nhiều", nên thử trước khi dùng rộng rãi.
  • Nếu bạn từng đặt effortLevel ở cấp user trong settings, giá trị đó không áp dụng cho Opus 5.5. Nó vẫn bắt đầu ở medium cho tới khi bạn chọn mức bằng /effort hoặc trong /model.
  • Subagent và skill có thể tự đặt effort trong frontmatter. Cách tổ chức subagent có trong bài Claude Code nâng cao.

Model mới cũng đổi cách giao việc hiệu quả. Bài hướng dẫn dùng Opus 5.5 trên blog claude.dev tóm gọn ý chính trong hai câu ngắn: "Give the whole task in one message. Name the finish line." Vài thói quen nên đổi, kèm ví dụ của mình:

  • Giao trọn task, nói rõ thế nào là xong. Thay vì "sửa giúp mình trang checkout", viết: "Thêm validate mã giảm giá cho trang checkout. Xong khi pnpm test pass, pnpm tsc --noEmit sạch và có test cho mã hết hạn." Model có tiêu chí để tự kiểm tra, bạn bớt phải quay lại nhắc.
  • Bỏ câu "hãy suy nghĩ kỹ". Opus 5.5 luôn thinking, độ sâu do effort quyết định. Muốn nghĩ sâu hơn cho một câu hỏi, dùng từ khóa ultrathink hoặc tăng effort.
  • Ghi quy tắc dừng vào CLAUDE.md. Ví dụ: "Chỉ dừng hỏi khi cần quyết định về schema DB hoặc xóa dữ liệu, còn lại cứ làm tiếp." Giữ permission prompt cho hành động phá hủy.
  • Cho model tự review trước khi bạn review, rồi đọc phần nó ghi là cần bạn quyết định trước tiên.
  • Đặt effort theo vai trò. Subagent chỉ đọc code hay tìm file có thể chạy low qua frontmatter, phiên chính giữ medium hoặc high.

Gọi API: bốn thay đổi có thể làm hỏng code cũ

Đổi model ID là chưa đủ. Trang "What's new" liệt kê bốn breaking change so với Opus 5:

  1. Không tắt được thinking. thinking: {"type": "disabled"} hoặc {"type": "enabled", "budget_tokens": N} trả về lỗi 400. Bỏ trường thinking (hoặc dùng {"type": "adaptive"}) và điều chỉnh độ sâu bằng effort.
  2. Không hỗ trợ ép gọi tool. tool_choice loại any hoặc tool trả về lỗi 400. Dùng auto kèm strict: true trên tool, hoặc structured outputs nếu chỉ cần JSON đúng schema.
  3. Thinking block gắn với model và cuộc hội thoại. Với tài khoản tạo từ 31/8/2026, nếu bạn sửa system prompt, tools hoặc tin nhắn cũ nằm trước một thinking block rồi gửi lại, API trả lỗi 400. Muốn đổi instructions hay tools giữa chừng, dùng mid-conversation system message thay vì sửa lịch sử. Ngoài ra, chuyển hội thoại từ Opus 5.5 lên Fable 5.1 vẫn giữ được reasoning, nhưng chuyển từ Fable ngược về Opus 5.5 thì reasoning cũ bị bỏ qua, không báo lỗi.
  4. Computer use: trên Claude API và Google Cloud, tool computer_20251124 không còn được chấp nhận, phải chuyển sang computer_toolset_20260801.

Ngoài ra, text model viết giữa các lần gọi tool giờ nằm trong thinking block và mặc định để trống. UI nào stream đoạn đó làm "tiến độ" sẽ im lặng, xem thinking.display trong migration guide.

Ví dụ trước và sau khi migrate một request trích xuất dữ liệu:

text
 {
-  "model": "claude-opus-5",
-  "thinking": { "type": "disabled" },
-  "tool_choice": { "type": "tool", "name": "extract_invoice" },
+  "model": "claude-opus-5-5",
+  "output_config": { "effort": "low" },
+  "tool_choice": { "type": "auto" },
   "tools": [
-    { "name": "extract_invoice", "input_schema": { ... } }
+    { "name": "extract_invoice", "strict": true, "input_schema": { ... } }
   ],
   ...
 }

Hai bẫy khi copy diff này:

  • strict: true chỉ chấp nhận một phần JSON Schema, và mọi object trong input_schema phải có "additionalProperties": false. Kiểm tra schema cũ trước khi bật, không thì bạn đổi lỗi này lấy lỗi khác. Với tool_choice: auto, model tự quyết có gọi tool hay không, nên hãy nói rõ trong prompt khi nào cần dùng tool.
  • Request cũ tắt thinking có thể đắt hơn sau khi migrate. Trên Opus 5.5 thinking luôn chạy, thinking token tính giá như output, và max_tokens bao gồm cả thinking. Loại request này có thể tốn output token hơn trước dù đơn giá thấp hơn. Đặt effort low và đo chi phí thật, đừng mặc định là rẻ hơn 40%.

Một lời gọi tối thiểu bằng TypeScript SDK:

ts
import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic(); // đọc ANTHROPIC_API_KEY từ biến môi trường

const response = await client.messages.create({
  model: "claude-opus-5-5",
  max_tokens: 16000, // giới hạn cứng cho cả thinking lẫn câu trả lời
  output_config: { effort: "high" },
  messages: [
    { role: "user", content: "Review hàm debounce sau và chỉ ra bug: ..." },
  ],
});

// Response có thể bắt đầu bằng một hoặc nhiều thinking block,
// nên chọn block theo type thay vì lấy content[0]
for (const block of response.content) {
  if (block.type === "text") console.log(block.text);
}

Một lỗi dễ gặp sau khi migrate là code cũ viết response.content[0].text. Với Opus 5.5, phần tử đầu tiên thường là thinking block, nên luôn lọc theo type.

Nếu codebase lớn, trong Claude Code bạn có thể chạy skill có sẵn: /claude-api migrate this project to claude-opus-5-5. Skill hỏi phạm vi trước khi sửa file, đổi model ID, sửa các tham số bị loại bỏ và đưa ra checklist để bạn kiểm tra tay.

Nên chọn Opus 5.5, Sonnet 5.5, Haiku 5.5 hay Fable 5.1

Sonnet 5.5 được Anthropic định vị là bản bổ sung nhanh và rẻ hơn cho Opus 5.5. Theo công bố, Sonnet 5.5 đạt 55,5% trên CursorBench 4.0 ở effort high (Opus 5.5 đạt 57,8% ở max), với giá API bằng một nửa. Hai con số khác mức effort nên chỉ cho thấy Sonnet 5.5 đã khá gần, không phải so sánh chính xác. Haiku 5.5 hướng tới việc khối lượng lớn như phân loại, trích xuất, routing và subagent.

Tình huốngGợi ýLý do
Refactor nhiều file, migration, debug khó, agent chạy lâuOpus 5.5, effort high hoặc xhighĐúng việc Opus 5.5 được thiết kế cho
Code hằng ngày trong Claude CodeOpus 5.5 ở medium, hoặc Sonnet 5.5 nếu muốn tiết kiệm usageĐủ tốt cho phần lớn việc, tăng effort khi thấy chưa đạt
Sửa nhanh, hỏi đáp, việc cần phản hồi nhanhSonnet 5.5Nhanh hơn, giá API bằng nửa Opus 5.5
Subagent tìm kiếm, đọc log, phân loại, trích xuất khối lượng lớnHaiku 5.5Rẻ nhất, nhanh nhất; giữ prompt dưới 100K token để hưởng giá thấp
Opus 5.5 ở effort cao vẫn không giải đượcFable 5.1Docs xếp Fable vào nhóm mạnh nhất cho task dài, nhưng giá gấp 2,5 lần Opus 5.5
Gói Copilot ProSonnet 5.5Opus 5.5 cần Pro+ trở lên

Một quy tắc thực tế: tăng effort trước, đổi model sau. Chuyển từ medium lên high hoặc xhigh trên Opus 5.5 thường rẻ và ít xáo trộn hơn chuyển sang Fable 5.1. Chỉ lên Fable khi bạn đã thấy Opus 5.5 vấp lặp lại ở loại task đó.

Nếu bạn còn gọi Haiku 4.5 qua API, lên kế hoạch chuyển sớm: docs ghi Haiku 4.5 nghỉ hưu không sớm hơn 15/10/2026. Haiku 5.5 trả lỗi khi gặp budget_tokens, temperature/top_p/top_k khác mặc định hoặc assistant prefill, và cùng một đoạn text tốn khoảng 30% token hơn do tokenizer mới, nên đếm lại token trước khi đổi ID. Còn gọi Sonnet 4.5 thì gấp hơn: model này đã bị deprecate từ 30/9/2026 và nghỉ hưu ngày 30/11/2026, thay bằng claude-sonnet-5-5.

Dù chọn model nào, chất lượng đầu ra vẫn phụ thuộc lớn vào context bạn đưa vào, xem thêm bài Context engineering là gì.

Tóm lại

Với dev, Claude Opus 5.5 thay đổi ba chỗ: đơn giá thấp hơn và dùng ít token hơn Opus 5, effort trở thành núm điều chỉnh chính (mặc định medium), và vài breaking change khi gọi API mà bạn phải sửa trước khi đổi model ID. Trong Claude Code, nếu đã update lên v2.1.280+ và để model mặc định, bạn đang dùng nó. Trong Copilot, bạn cần gói Pro+ trở lên.

Model tốt đến đâu thì người review vẫn là bạn. Để đọc diff React mà AI sinh ra và biết chỗ nào sai, chỗ nào chỉ "chạy được", bạn cần nền tảng vững. Khóa React PRO của HoleTex giúp bạn có nền đó để điều khiển AI thay vì phụ thuộc vào nó.

Bài liên quan

Nguồn tham khảo: Introducing Claude Opus 5.5 (anthropic.com), Introducing Claude Sonnet 5.5 (anthropic.com), Introducing Claude Haiku 5.5 (anthropic.com), Models overview (platform.claude.com), Claude Opus 5.5 (platform.claude.com), What's new in Claude Opus 5.5 (platform.claude.com), Migrating to Claude Opus 5.5 (platform.claude.com), What's new in Claude Haiku 5.5 (platform.claude.com), Effort (platform.claude.com), Thinking (platform.claude.com), Pricing (platform.claude.com), Claude pricing (claude.com), Model configuration (code.claude.com), Fast mode (code.claude.com), Model deprecations (platform.claude.com), Getting the most out of Opus 5.5 in Claude and Claude Code (claude.dev), What a task costs on Opus 5.5 (claude.dev), Claude Opus 5.5 is now available in GitHub Copilot (github.blog). Cập nhật 2026-10-08.

Thấy hay? Chia sẻ