Anthropic phát hành Opus 5 vào ngày 24 tháng 7 năm 2026

Claude Opus 5cho công việc đứng vững trước kiểm chứng

Kể từ khi ra mắt, người dùng Felo PRO có thể dùng thử Claude Opus 5 miễn phí trong 7 ngày.

Anthropic Claude Opus 5 official illustration framed in Felo blue
Nguồn hình ảnh: Anthropic; Felo chỉ thêm khung và không thay đổi các yếu tố gốc.

Hiện có trong Felo Search

Hãy hỏi những câu khó hơn. Nhận câu trả lời tìm kiếm có thể kiểm chứng.

Claude Opus 5 hiện có trong Felo Search cho những câu hỏi cần điều tra sâu hơn, tổng hợp nguồn mạnh hơn và câu trả lời cuối cùng được kiểm tra theo bằng chứng.

Dùng thử Opus 5 trong Felo Search

01

Lần theo câu hỏi thực sự

Làm rõ các ràng buộc phía sau một yêu cầu mơ hồ thay vì dừng lại ở cách diễn giải có vẻ hợp lý đầu tiên.

02

Cân nhắc các bằng chứng mâu thuẫn

Đưa các nguồn và tuyên bố cạnh tranh vào một cuộc điều tra, rồi xác định nơi bằng chứng thống nhất và nơi không thống nhất.

03

Trở lại với ít điểm còn bỏ ngỏ hơn

Dùng câu trả lời như điểm khởi đầu sẵn sàng cho quyết định, đồng thời giữ rõ lập luận, lưu ý và các câu hỏi mở.

Hướng dẫn nhanh

Chuyển sang Claude Opus 5 trong Felo

Mở bộ chọn model, chọn Claude Opus 5, rồi bắt đầu tác vụ trong cùng không gian làm việc.

24 Thg 7

phát hành năm 2026

Model Opus mới nhất của Anthropic

$5 / $25

API input / output

Mỗi 1 triệu token, cùng giá cơ bản với Opus 4.8

~2,5x

tốc độ Fast mode

Có trên nền tảng Anthropic với giá gấp 2 lần giá cơ bản

Kiểm chứng + chỉnh sửa

Công việc dài hạn

Lập kế hoạch, dùng công cụ, kiểm tra và lặp lại

Điểm khác biệt của Opus

Đừng dừng lại ở thứ đầu tiên hoạt động.

Anthropic định vị Opus 5 cho công việc cần phán đoán bền bỉ: xác định vấn đề nền tảng, xác thực kết quả và xem lại công việc khi bằng chứng không đủ vững.

01

Lần theo vấn đề nền tảng

Với lỗi khó và nhiệm vụ mơ hồ, hãy bắt đầu từ bằng chứng, ràng buộc và nguyên nhân gốc thực sự, không phải một bản vá bề mặt.

02

Kiểm tra công việc trước khi bàn giao

Dùng model có thể xem xét đầu ra của chính nó, kiểm thử giả định và phát hiện vấn đề trước khi con người phải tìm ra sau đó.

03

Giữ mạch xuyên qua các lần sửa đổi

Đưa mã, tài liệu nguồn, kết quả công cụ và ràng buộc mới vào một nhiệm vụ dài hơn thay vì biến công việc thành các prompt rời rạc.

Chọn model

So sánh chi phí một token với chi phí của việc sai.

Các mức giá dưới đây là giá API công khai chính thức, không phải giá thuê bao hoặc sử dụng Felo. Chúng làm rõ đánh đổi mà không giả vờ rằng các thử nghiệm latency không liên quan giữa những nhà cung cấp có thể so sánh trực tiếp.

Yếu tố quyết định
Claude Opus 5
GPT-5.6 Sol
Kimi K3
Claude Opus 4.8
Giá API / 1M token
$5 input / $25 output
$5 input / $0,50 cached / $30 output
$3 input / $0,30 cached / $15 output
$5 input / $25 output
Tốc độ và dung lượng
Tốc độ mặc định hoặc Fast mode nhanh khoảng 2,5x với giá gấp 2 lần cơ bản.
OpenAI gọi Sol là Fast; cửa sổ ngữ cảnh 1,05M token.
Ngữ cảnh 1.048.576 token; throughput thay đổi theo cấp rate limit của tài khoản.
Mốc Opus thế hệ trước. Hãy so sánh khả dụng và latency thực tế trong workflow của bạn.
Phù hợp nhất cho
Công việc dài hạn, hệ quả cao cần kiểm chứng và lặp lại cẩn trọng.
Công việc chuyên môn phức tạp cần phản hồi flagship nhanh và cửa sổ ngữ cảnh rất lớn.
Coding dài hạn và công việc tri thức end-to-end với giá token công khai thấp hơn.
Workflow Opus hiện có khi tính liên tục quan trọng hơn việc chuyển ngay lập tức.
Chọn khi
Nhiệm vụ phải được hoàn thành, kiểm tra và có thể bảo vệ được, không chỉ là bản nháp.
Bạn muốn tầng flagship của OpenAI và cấu hình tốc độ/ngữ cảnh phù hợp nhiệm vụ.
Bạn cần ngữ cảnh 1M token và muốn kiểm soát chi phí qua caching cùng reasoning effort.
Bạn đang đánh giá một đợt migration có kiểm soát từ baseline thế hệ trước đã ổn định.

Giá API công khai chính thức được kiểm tra vào ngày 25 tháng 7 năm 2026. Tổng chi phí nhiệm vụ còn phụ thuộc độ dài output, input cached, thiết lập effort, lệnh gọi công cụ, thử lại và đánh giá của con người.

Biểu đồ benchmark chính thức

Các biểu đồ chi phí so với hiệu năng của Anthropic cho thấy điều gì

Các biểu đồ chính thức này đặt hiệu năng model cạnh chi phí đánh giá được báo cáo ở các mức effort khác nhau. Đây là ngữ cảnh hữu ích cho quyết định về chi phí, nhưng là kết quả do nhà cung cấp công bố chứ không phải thử nghiệm độc lập của Felo.

Tổng quan năng lực benchmark Claude Opus 5 chính thức của Anthropic so sánh Opus 5, Fable 5, Opus 4.8 và GPT-5.6 Sol trong coding, công việc tri thức, tìm kiếm, sử dụng máy tính, workflow doanh nghiệp, y tế và sinh học

Tổng quan năng lực chính thức qua các nhóm benchmark

Ma trận đa nhiệm của Anthropic so sánh kết quả được công bố của Opus 5, Fable 5, Opus 4.8 và GPT-5.6 Sol trong coding, công việc tri thức, tìm kiếm, sử dụng máy tính, workflow doanh nghiệp và hơn thế nữa.

Biểu đồ Anthropic chính thức về coding agentic theo mức effort, so sánh Opus 5, Fable 5, Opus 4.8 và GPT-5.6 Sol theo chi phí mỗi tác vụ

Coding agentic theo mức effort

Artificial Analysis Coding Agent Index: biểu đồ chính thức so sánh điểm số với chi phí mỗi tác vụ được báo cáo ở các cài đặt effort hiện có.

Biểu đồ Anthropic chính thức về hiệu năng sử dụng máy tính agentic theo mức effort, so sánh Opus 5, Fable 5, Opus 4.8 và GPT-5.6 Sol theo chi phí mỗi tác vụ

Sử dụng máy tính agentic theo mức effort

OSWorld 2.0: biểu đồ chính thức so sánh hiệu năng sử dụng máy tính với chi phí mỗi tác vụ được báo cáo ở các cài đặt effort.

Biểu đồ Anthropic chính thức về tác vụ tri thức thực tế theo mức effort, so sánh Opus 5, Fable 5, Opus 4.8 và GPT-5.6 Sol theo chi phí benchmark

Tác vụ tri thức thực tế theo mức effort

GDPval-AA v2: biểu đồ chính thức so sánh điểm Elo với chi phí benchmark đầy đủ được báo cáo ở các cài đặt effort.

Biểu đồ Anthropic chính thức về tìm kiếm agentic DeepSearchQA theo mức effort, so sánh Opus 5, Fable 5 và Opus 4.8 theo chi phí mỗi tác vụ

Tìm kiếm agentic theo mức effort

DeepSearchQA: biểu đồ chính thức so sánh tỷ lệ vượt qua tác vụ tìm kiếm với chi phí mỗi tác vụ được báo cáo ở các cài đặt effort hiện có.

Biểu đồ và nhãn benchmark lấy từ thông báo Claude Opus 5 của Anthropic. Felo chỉ thêm khung trình bày bên ngoài; nội dung biểu đồ được giữ nguyên như đã công bố.

Điểm khởi đầu tốt hơn

Hãy giao cho Opus 5 những việc đáng được xem lại lần hai.

Model này xứng đáng khi việc kiểm chứng làm thay đổi kết quả. Đây không phải prompt chat chung chung; đây là công việc nhiều bước, nơi dependency bị bỏ sót, tuyên bố không có cơ sở hoặc edge case chưa kiểm thử sẽ tốn thời gian về sau.

Mã production và QA

Điều tra regression, tái tạo nó, kiểm tra mã xung quanh, triển khai bản sửa có trọng tâm và thử các đường đi mà bản vá nhanh thường bỏ qua.

Phân tích tài chính và tài liệu

Đối chiếu bảng biểu, kiểm tra giả định, so sánh tài liệu nguồn và đưa ra khuyến nghị vẫn giữ nguyên bằng chứng cùng lưu ý.

Nghiên cứu cần được xem xét kỹ

Đọc các nguồn cạnh tranh, nêu rõ câu hỏi mở, cân nhắc bằng chứng và phân biệt câu trả lời tự tin với câu trả lời thực sự có cơ sở.

Tác vụ agent dài hạn

Dùng công cụ, giữ các ràng buộc của nhiệm vụ, phục hồi từ kết quả một phần và tiến hành một nhiệm vụ lớn hơn với các điểm kiểm tra có chủ ý.

Hãy thử một nhiệm vụ có hệ quả

01

Đưa vào ngữ cảnh thật

Thêm mã, tài liệu, yêu cầu và bằng chứng mà một câu trả lời hữu ích phải tính đến.

02

Yêu cầu kế hoạch kiểm chứng

Nêu rõ điều gì phải được kiểm tra trước khi coi công việc hoàn thành, không chỉ điều gì cần tạo ra.

03

So sánh sản phẩm cuối

Dùng cùng một nhiệm vụ với các model hàng đầu trong Felo. Đừng chỉ xem câu trả lời mà hãy xem cả thử nghiệm, lưu ý và phán đoán phía sau nó.

Chọn Claude Opus 5 khi model xuất hiện trong bộ chọn model trực tiếp của tài khoản bạn.

Mở Felo LLM Playground

FAQ Claude Opus 5

Claude Opus 5 là model cấp Opus của Anthropic, phát hành ngày 24 tháng 7 năm 2026. Anthropic định vị model này cho agents dài hạn, kỹ thuật phần mềm phức tạp, công việc tri thức chuyên nghiệp và các nhiệm vụ hưởng lợi từ kiểm chứng cùng lặp lại cẩn trọng.

Dùng model kiểm tra công việc.

Đặt Claude Opus 5 cạnh các model hàng đầu khác trong Felo, rồi thử nó với nhiệm vụ mà câu trả lời đầu tiên có vẻ hợp lý vẫn chưa đủ.

Dùng thử Opus 5 trong Felo

Bắt đầu trong Felo AI Search và chọn model khi có sẵn.