+1

GPT-5.6 Terra với Claude Sonnet 5: So sánh mid-tier mặc định miễn phí

GPT-5.6 Terra và Claude Sonnet 5 là hai mô hình mid-tier miễn phí mặc định của OpenAI và Anthropic, có mức giá input chênh nhau chưa đến 1 USD, nhưng khác biệt rõ rệt ở cách tính phí long-context và định hướng bảo mật mạng.

Tóm tắt các điểm chính

  • Trên SWE-Bench Pro, hai mô hình gần như ngang nhau: Terra đạt 63,4%, Sonnet 5 đạt 63,2%. Nhưng trên Terminal-Bench 2.1, Terra dẫn trước 7 điểm với 87,4% so với 80,4% của Sonnet 5.
  • Terra tính phí long-context surcharge gấp 2 lần input và 1,5 lần output cho toàn bộ request khi input vượt 272K token. Sonnet 5 không công bố surcharge nào, giá giữ nguyên đến hết 1M token.
  • Trên eval phát triển exploit cho Firefox 147, Sonnet 5 đạt 0,0% thành công, trong khi Terra đạt 91,8% trên Capture-the-Flag và 57,7% trên SEC-Bench Pro.
  • Sonnet 5 đã loại bỏ hoàn toàn temperature, top_p và top_k, gọi các tham số này sẽ trả về lỗi 400. Terra giữ bộ tham số rộng hơn, gồm Programmatic Tool Calling và chế độ multi-agent beta.
  • Với khối lượng generation-heavy 1M input/4M output, Terra tốn 50 USD so với 63 USD của Sonnet 5, nhưng nếu mua trước tháng 9/2026 với giá giới thiệu, Sonnet 5 chỉ tốn 42 USD, rẻ hơn Terra 8 USD.

Tổng quan về GPT-5.6 Terra

GPT-5.6 Terra là tầng giữa của dòng GPT-5.6, đạt trạng thái general availability ngày 9/7/2026, cùng với mô hình flagship Sol và tầng rẻ nhất Luna. OpenAI mô tả Terra là lựa chọn cân bằng cho công việc hàng ngày, tương đương tầng mini của các dòng GPT-5 trước đó. Terra có context window 1.050.000 token, giới hạn output 128.000 token, và knowledge cutoff ngày 16/2/2026.

Hai yếu tố khiến Terra đáng chú ý hơn là chỉ rẻ. Thứ nhất, Terra kế thừa Programmatic Tool Calling từ Responses API, cho phép mô hình viết và chạy các chương trình nhỏ trong bộ nhớ để điều phối tool, thay vì phải gửi từng phản hồi tool qua lại với mô hình nhiều lần. Thứ hai, ngày 30/7/2026, OpenAI giảm giá Terra 20%, từ 2,50 USD/15 USD lúc ra mắt xuống còn 2,00 USD/12 USD trên 1M token.

Tổng quan về Claude Sonnet 5

Claude Sonnet 5 là mô hình tầng giữa của Anthropic, ra mắt ngày 30/6/2026, được giới thiệu là Sonnet có tính agentic cao nhất từ trước đến nay. Anthropic khẳng định mô hình này có thể lập kế hoạch, điều khiển trình duyệt và terminal, vận hành tự động ở mức trước đây chỉ mô hình cấp Opus mới làm được, đạt hiệu năng gần tiệm cận Opus 4.8 về reasoning, tool use, coding và knowledge work với mức giá thấp hơn.

Sonnet 5 là mô hình mặc định trên gói Free và Pro, đi kèm một loạt ràng buộc có chủ đích: temperature, top_p và top_k đã bị loại bỏ, gọi manual extended thinking sẽ trả về lỗi 400, và adaptive thinking được bật mặc định. Mô hình cũng dùng một tokenizer mới, tạo ra nhiều hơn khoảng 30% token so với Sonnet 4.6 cho cùng một đoạn văn bản, được Anthropic bù lại bằng giá giới thiệu đến hết 31/8/2026.

So sánh Terra và Sonnet 5: điểm khác biệt ở đâu?

Hai mô hình có context window và output ceiling gần như tương đương, nhưng khác biệt ở cách tính phí long-context và định hướng bảo mật mạng.

Yếu tố GPT-5.6 Terra Claude Sonnet 5
Nhà cung cấp và thời điểm ra mắt OpenAI, GA ngày 9/7/2026 Anthropic, ngày 30/6/2026
Định vị Mid-tier Mid-tier
Context window 1.050.000 token 1M token
Output tối đa 128K token 128K token
Giá trên 1M token 2,00 USD in / 12,00 USD out 3,00 USD in / 15,00 USD out (2,00 USD/10,00 USD đến 31/8/2026)
Phụ phí long-context Gấp 2x input, 1,5x output khi vượt 272K input token Không công bố; giữ nguyên đến 1M
Tính năng đặc trưng Programmatic Tool Calling trong Responses API Adaptive thinking với mức effort tùy chỉnh
Định hướng cyber Được huấn luyện cho cyber; năng lực defensive nằm sau Trusted Access Không huấn luyện cho cyber; safeguard bật mặc định
Gói miễn phí Mặc định για Free và Go trong ChatGPT Work và Codex Mặc định cho Free και Pro
API model ID gpt-5.6-terra claude-sonnet-5

Terra hay Sonnet 5 mạnh hơn cho coding và terminal agent?

Trên SWE-Bench Pro, hai mô hình gần như ngang nhau ở mức 63,4% (Terra) và 63,2% (Sonnet 5), nhưng Terra dẫn trước 7 điểm trên Terminal-Bench 2.1 với 87,4% so với 80,4% của Sonnet 5. Terra thậm chí vượt qua cả Claude Opus 4.8 (78,9%) và Claude Fable 5 (83,1%) trên cùng eval này theo kết quả chạy của OpenAI.

Benchmark GPT-5.6 Terra Claude Sonnet 5 Ghi chú
SWE-Bench Pro 63,4% 63,2% Nhà cung cấp tự công bố trên harness riêng, gần như ngang nhau
Terminal-Bench 2.1 87,4% 80,4% Khoảng cách coding lớn nhất được Terra công bố
Artificial Analysis Coding Agent Index v1.1 77,4 Chưa công bố Chỉ số độc lập, Terra vượt Fable 5 ở mức 77,2

Cách Anthropic định vị Sonnet 5 cũng khớp với sự phân hóa này: câu chuyện coding của Sonnet 5 nằm ở khả năng hoàn thành công việc đến cùng chứ không phải điểm số đỉnh, khi những người thử nghiệm sớm mô tả mô hình hoàn thành các tác vụ mà Sonnet 4.6 dừng lại giữa chừng, và tự kiểm tra output của chính mình mà không cần yêu cầu.

Coding benchmarks

Terra và Sonnet 5 khác biệt thế nào về knowledge work?

Cả hai nhà cung cấp đều công bố GDPval-AA v2, với kết quả đủ gần để coi là ngang nhau: OpenAI ghi nhận Terra đạt 1.593 Elo, Anthropic ghi nhận Sonnet 5 đạt 1.618 Elo. Sự chênh lệch 25 điểm này nằm trong biên độ nhiễu của phương pháp đo, vì OpenAI chấm Claude Opus 4.8 ở mức 1.600 Elo trong khi Anthropic chấm chính mô hình đó ở mức 1.615 Elo trên cùng eval.

Ở Agents' Last Exam, đánh giá các quy trình chuyên nghiệp chạy dài trên 55 lĩnh vực, Terra đạt 50,4%, vượt GPT-5.5 (46,9%), Claude Opus 4.8 (45,2%) và Claude Fable 5 (40,5%). Anthropic không công bố kết quả Sonnet 5 trên eval này, nên đây là sân chơi do OpenAI chọn chứ không phải một kết luận có thể so sánh trực tiếp.

Về computer use, Infinity khuyến nghị không so sánh trực tiếp: OpenAI công bố Terra đạt 50,2% trên OSWorld 2.0, còn Anthropic công bố Sonnet 5 đạt 81,2% trên OSWorld-Verified, đây là hai bộ eval khác nhau với cách chấm điểm khác nhau, và Anthropic đã điều chỉnh lại cách chạy OSWorld-Verified cho phiên bản này.

Terra hay Sonnet 5 an toàn hơn về bảo mật mạng?

Đây là khoảng cách lớn nhất giữa hai mô hình, và là một quyết định thiết kế có chủ đích chứ không phải khác biệt năng lực ngẫu nhiên. OpenAI huấn luyện dòng GPT-5.6 cho công việc cyber: Terra đạt 91,8% trên Capture-the-Flag, 57,7% trên SEC-Bench Pro, 52,9% trên ExploitBench và 23,2% trên ExploitGym.

Anthropic đi theo hướng ngược lại. Sonnet 5 không được chủ đích huấn luyện cho các tác vụ bảo mật mạng, và trên một eval phát triển exploit được xây dựng cùng Mozilla nhắm vào các lỗ hổng Firefox 147, mô hình chưa từng tạo ra được exploit hoạt động nào, đạt 0,0%. Anthropic bật safeguard cyber theo thời gian thực mặc định cho Sonnet 5 và khuyến nghị dùng Opus 4.8 cho công việc cyber cần giảm rào chắn.

Infinity đánh giá đây là một tính năng của Sonnet 5 chứ không phải điểm yếu, đối với phần lớn độc giả. Nếu sản phẩm coi việc mô hình cố tạo exploit là một rủi ro, một mô hình từ chối đáng tin cậy chính là lựa chọn an toàn hơn. Ngược lại, nếu công việc thuộc về bảo mật phòng thủ, Terra nằm trong chương trình Daybreak Trusted Access for Cyber của OpenAI.

Terra và Sonnet 5 xử lý long-context khác nhau ra sao?

Về mặt danh nghĩa, hai mô hình gần như tương đương: Terra công bố context window 1.050.000 token với output tối đa 128.000 token, Sonnet 5 có window 1M với output tối đa 128K. Điểm khác biệt nằm ở điều xảy ra khi thực sự lấp đầy context đó.

Terra công bố điểm retrieval xuyên suốt window: đạt 89,6% ở dải 256K-512K và 72,5% ở dải 512K-1M trên OpenAI MRCR v2 8-needle, gần với mức 91,5% và 73,8% của Sol, vượt xa mức 41,3% của Luna. Anthropic chưa công bố số liệu needle-retrieval tương đương cho Sonnet 5 khi ra mắt.

Điểm khác biệt quan trọng hơn nằm ở cách tính phí. Prompt vượt 272K input token trên Terra bị tính phí gấp 2 lần input và 1,5 lần output cho toàn bộ request, không chỉ phần vượt ngưỡng. Sonnet 5 không công bố phụ phí long-context nào, giá giữ nguyên xuyên suốt toàn bộ window.

Terra và Sonnet 5 khác nhau thế nào về control surface?

Cả hai mô hình đều có nút điều chỉnh reasoning-effort, nhưng khác biệt rõ rệt ở mức độ cho phép người dùng can thiệp sâu hơn. Sonnet 5 loại bỏ hoàn toàn temperature, top_p và top_k, gọi các tham số này sẽ trả về lỗi 400. Manual extended thinking cũng trả về lỗi 400, người dùng chỉ có thể dùng adaptive thinking mặc định hoặc tắt hẳn thinking.

Sonnet 5 cũng không hỗ trợ Priority Tier trên Anthropic platform, điều đáng lưu ý với các đội đang phụ thuộc vào tính năng này để đảm bảo độ trễ trên Opus hoặc Sonnet 4.6.

Terra có control surface rộng hơn theo hướng khác:

  • Programmatic Tool Calling trong Responses API, chạy chương trình điều phối trong bộ nhớ, tương thích Zero Data Retention.
  • Chế độ multi-agent beta trong Responses API, cho phép mô hình chạy nhiều subagent song song và tổng hợp kết quả trong một request.
  • Chế độ max effort, có thể bật bởi bất kỳ người dùng nào có quyền truy cập GPT-5.6 trong ChatGPT Work và Codex.
  • Cache breakpoint tường minh với thời gian cache tối thiểu 30 phút, đọc cache được giảm 90%, ghi cache tính phí bằng 1,25 lần giá input chưa cache.
  • Function calling, structured output, hosted shell, code interpreter và computer use trên Responses API, không hỗ trợ fine-tuning.

Giá của Terra và Sonnet 5 chạy trong thực tế

Terra và Sonnet 5 hiện có mức giá input chênh nhau chưa đến 1 USD, khiến hình dạng khối lượng công việc, chứ không phải mức giá niêm yết, mới là yếu tố quyết định hóa đơn thực tế.

Mức phí GPT-5.6 Terra Claude Sonnet 5
Input, trên 1M token 2,00 USD 3,00 USD (2,00 USD đến 31/8/2026)
Output, trên 1M token 12,00 USD 15,00 USD (10,00 USD đến 31/8/2026)
Phụ phí long-context 2x input, 1,5x output khi vượt 272K input token Không công bố, giữ nguyên đến 1M
Reasoning token Không công bố mức giá riêng Tính theo giá output
Gói miễn phí Mặc định Free và Go trong ChatGPT Work, Codex Mặc định trên Free và Pro

Infinity phân tích ba dạng khối lượng công việc thực tế ở mức giá tiêu chuẩn, mỗi dạng bộc lộ đúng một cơ chế khác biệt giữa hai mô hình:

Khối lượng công việc GPT-5.6 Terra Claude Sonnet 5 Chênh lệch
Generation-heavy: 1M in / 4M out 50 USD 63 USD Sonnet 5 đắt hơn 13 USD (26%)
Retrieval, dưới ngưỡng: 10M in / 1M out, mỗi request dưới 272K 32 USD 45 USD Sonnet 5 đắt hơn 13 USD (41%)
Retrieval, vượt ngưỡng: 10M in / 1M out, mỗi request trên 272K 58 USD 45 USD Terra đắt hơn 13 USD (29%)

Dòng thứ ba là điểm đáng chú ý nhất. Tổng khối lượng giữa dòng hai và dòng ba không đổi, chỉ kích thước từng request thay đổi, và phụ phí 272K của Terra biến một lợi thế chi phí 41% thành một khoản phạt chi phí 29%. Ở dòng generation-heavy, nếu mua trước tháng 9, khối lượng đó chỉ tốn 42 USD với giá giới thiệu 2,00 USD/10,00 USD của Sonnet 5, rẻ hơn Terra 8 USD, cho đến khi giá tiêu chuẩn có hiệu lực từ 1/9/2026.

Cost comparison

Vì sao cùng một tác vụ lại tốn chi phí khác nhau giữa hai mô hình?

Terra và Sonnet 5 dùng tokenizer khác nhau từ hai nhà cung cấp khác nhau, nên cùng một đoạn văn bản sẽ tạo ra số lượng input token khác nhau trước khi mô hình bắt đầu phản hồi. Chưa nhà cung cấp nào công bố số liệu so sánh token trực tiếp giữa hai mô hình. Điều đang có là các tuyên bố riêng lẻ không thể so sánh chéo: Anthropic ghi nhận tokenizer mới của Sonnet 5 tạo ra nhiều hơn khoảng 30% token so với Sonnet 4.6, còn Notion ghi nhận Terra dùng ít hơn 16% token so với GPT-5.5.

Infinity khuyến nghị xem bảng giá trên như một phép so sánh mức phí, không phải một dự báo, và nên đo số lượng token thực tế trên mẫu đại diện của chính doanh nghiệp trước khi cam kết chuyển đổi.

Khi nào nên chọn Terra, khi nào nên chọn Sonnet 5?

Nên chọn Terra cho các agent chạy trong shell hoặc gọi nhiều tool mỗi lượt, và nên chọn Sonnet 5 cho các prompt lớn hoặc khi cần một mô hình từ chối công việc cyber theo thiết kế.

Trường hợp sử dụng Khuyến nghị Lý do
Terminal và CLI coding agent GPT-5.6 Terra 87,4% trên Terminal-Bench 2.1 so với 80,4% của Sonnet 5
Sửa lỗi ở cấp repository Cả hai đều được 63,4% so với 63,2% trên SWE-Bench Pro, gần như ngang nhau
Context rất lớn (300K+ token) Claude Sonnet 5 Không phụ phí long-context, trong khi Terra tính 2x input khi vượt 272K
Pipeline gọi nhiều tool mỗi lượt GPT-5.6 Terra Programmatic Tool Calling giảm 38% prompt token trong quy trình tài liệu của Clio
Bảo mật phòng thủ và phân loại lỗ hổng GPT-5.6 Terra 91,8% trên Capture-the-Flag, truy cập qua Trusted Access for Cyber
Sản phẩm coi việc tạo exploit là rủi ro Claude Sonnet 5 Đạt 0,0% trên eval phát triển exploit Firefox, safeguard cyber bật mặc định
Khối lượng generation-heavy trước tháng 9/2026 Claude Sonnet 5 Giá giới thiệu 2 USD/10 USD rẻ hơn Terra 8 USD trên khối lượng 1M in/4M out mỗi tháng
Cần tùy chỉnh tham số sampling GPT-5.6 Terra Sonnet 5 trả lỗi 400 khi gọi temperature, top_p, top_k

Bắt đầu dùng Terra và Sonnet 5 như thế nào?

Cả hai mô hình đều đã general availability và là mô hình miễn phí mặc định của mỗi nhà cung cấp, nên việc dùng thử không tốn chi phí ngoài thời gian.

Kênh truy cập GPT-5.6 Terra Claude Sonnet 5
Ứng dụng và gói ChatGPT Work: mặc định cho Free và Go; chọn được ở Plus, Pro, Business, Enterprise Claude apps: mặc định trên Free và Pro; khả dụng trên Max, Team, Enterprise
API chính thức OpenAI API, qua Responses và Chat Completions Claude API trên Claude Platform
Cloud platform Amazon Bedrock (GA) và Microsoft Foundry (GA, gồm APAC Data Zone), chưa có trên Google Vertex Claude Platform trên AWS và Claude trong Microsoft Foundry, Google Vertex sắp ra mắt
Coding agent Codex: mặc định cho Free và Go, chọn được từ Plus trở lên Claude Code
API model ID gpt-5.6-terra claude-sonnet-5

Lưu ý: Nếu đang chuyển đổi code hiện có từ Anthropic, cần loại bỏ temperature, top_p, top_k và cấu hình manual extended thinking trước, vì Sonnet 5 trả về lỗi 400 thay vì bỏ qua các tham số này.

Kết luận

Terra là lựa chọn mid-tier tốt hơn cho terminal agent và pipeline dày đặc tool, còn Sonnet 5 là lựa chọn tốt hơn cho prompt lớn và các đội muốn một control surface nhỏ gọn hơn để phải cân nhắc. Điều đáng chú ý nhất là cả hai nhà cung cấp đều chọn tầng mid-tier làm mặc định miễn phí, nhưng lại đặt cược ngược nhau về việc một mô hình mid-tier nên từ chối điều gì. OpenAI huấn luyện Terra cho công việc cyber và đặt năng lực sắc bén nhất sau xác thực danh tính cùng passkey phần cứng. Anthropic huấn luyện Sonnet 5 để không làm việc đó, rồi bổ sung thêm safeguard phía trên. Không cách tiếp cận nào rõ ràng đúng hơn cách còn lại, và cả hai đều tạo ra ma sát thực sự cho các công việc hợp pháp.

Câu hỏi thường gặp

GPT-5.6 Terra hay Claude Sonnet 5 tốt hơn cho coding?

Tùy loại công việc coding. Trên SWE-Bench Pro, hai mô hình gần như ngang nhau ở mức 63,4% (Terra) và 63,2% (Sonnet 5) cho việc sửa lỗi ở cấp repository. Tuy nhiên, Terra dẫn trước rõ rệt trên các quy trình terminal và CLI, đạt 87,4% trên Terminal-Bench 2.1 so với 80,4% của Sonnet 5. Nên chọn Terra nếu agent chạy trong shell, chọn mô hình nào cũng được cho reasoning trên codebase nói chung.

GPT-5.6 Terra và Claude Sonnet 5 có giá bao nhiêu?

GPT-5.6 Terra có giá 2,00 USD trên 1M input token và 12,00 USD trên 1M output token, sau đợt giảm giá 20% ngày 30/7/2026. Claude Sonnet 5 có giá tiêu chuẩn 3,00 USD/15,00 USD, kèm giá giới thiệu 2,00 USD/10,00 USD đến hết 31/8/2026. Terra tính phụ phí long-context (2x input, 1,5x output) cho request vượt 272K input token, còn Sonnet 5 giữ giá cố định đến 1M token.

Context window của GPT-5.6 Terra và Claude Sonnet 5 là bao nhiêu?

GPT-5.6 Terra có context window 1.050.000 token với giới hạn output 128.000 token. Claude Sonnet 5 có context window 1M token với giới hạn output 128K token. Cả hai đều đủ lớn cho phần lớn khối lượng công việc.

Claude Sonnet 5 có làm được công việc bảo mật mạng không?

Claude Sonnet 5 không được chủ đích huấn luyện cho các tác vụ bảo mật mạng. Trên một eval phát triển exploit được xây dựng cùng Mozilla nhắm vào các lỗ hổng Firefox 147, mô hình đạt 0,0%. Anthropic bật safeguard cyber theo thời gian thực mặc định cho mô hình này. Với phần lớn đội sản phẩm, đây là một tính năng chứ không phải điểm yếu, vì một mô hình từ chối đáng tin cậy trong việc tạo exploit là một phụ thuộc an toàn hơn. Nếu cần năng lực cyber phòng thủ, GPT-5.6 Terra đạt 91,8% trên Capture-the-Flag và 57,7% trên SEC-Bench Pro.

Mô hình nào rẻ hơn cho prompt lớn trên 300K token?

Dù GPT-5.6 Terra là mô hình rẻ hơn nhìn chung cho phần lớn quy trình, Claude Sonnet 5 lại rẻ hơn cho prompt lớn. GPT-5.6 Terra áp dụng phụ phí long-context gấp 2 lần input và 1,5 lần output cho toàn bộ request khi input vượt 272K token. Sonnet 5 không công bố phụ phí long-context, giá giữ nguyên đến 1M token.

Nguồn: Infinity - đơn vị cung cấp giải pháp Digital Marketing tích hợp cho doanh nghiệp — từ thiết kế website chuẩn SEO & UX/UI, dịch vụ AI SEO (GEO/AEO), PR Digital, sáng tạo nội dung số, quảng cáo trực tuyến (SEM/Ads) đến phân tích dữ liệu Marketing. Với nền tảng nghiên cứu và dữ liệu thực chiến, chúng tôi giúp doanh nghiệp xây dựng chiến lược thương hiệu bền vững và tăng trưởng có hệ thống trong kỷ nguyên AI.


All Rights Reserved

Viblo
Let's register a Viblo Account to get more interesting posts.