Skip to main content

Claude Opus 5 Đã Có Trên Felo: Tính Năng, Giá Cả & Dùng Thử Miễn Phí 7 Ngày

· 17 phút đọc
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo hiện đã hỗ trợ Claude Opus 5. Khám phá tính năng, điểm chuẩn, an toàn và giá cả, sau đó trải nghiệm miễn phí mô hình lập trình agentic của Anthropic trong 7 ngày.

Felo hiện đã hỗ trợ Claude Opus 5, mô hình Opus-tier mới của Anthropic dành cho lập trình agentic, phân tích chuyên nghiệp và các công việc kéo dài. Hãy chọn nó trên Felo khi bạn cần giải quyết một nhiệm vụ đòi hỏi nhiều hơn một câu trả lời xuất sắc ban đầu: cần nghiên cứu, xác minh, lặp lại và một kết quả mà bạn có thể tự tin kiểm duyệt.

Để đánh dấu sự ra mắt này, người đăng ký Felo Pro có thể sử dụng Claude Opus 5 mà không mất thêm chi phí trong bảy ngày kể từ ngày phát hành. Hãy mang đến cho nó một lỗi khó nhằn, một bản tóm tắt nghiên cứu với các bằng chứng mâu thuẫn, một phân tích nhiều bước, hoặc một tài liệu cần chỉnh sửa nhiều lần để hoàn thiện—và đánh giá nó qua những công việc thực sự quan trọng với bạn.

Claude Opus 5 launch announcement from Anthropic, shown unchanged with a gray border

Ảnh bìa: tác phẩm gốc từ thông báo Claude Opus 5 của Anthropic. Nội dung hình ảnh giữ nguyên; Felo chỉ thêm viền xám.

Đây không chỉ là một ghi chú phát hành. Dưới đây là hướng dẫn trực quan về mục đích thiết kế của Opus 5, các kết quả đánh giá từ Anthropic, giới hạn hiện tại, và cách thử nghiệm nó với công việc thực tế trên Felo.

Sẵn sàng thử nghiệm? Bắt đầu dùng thử Claude Opus 5 miễn phí 7 ngày trên Felo ->

Tính năng Claude Opus 5: mô hình này được xây dựng để làm gì

Anthropic phát hành Claude Opus 5 vào ngày 24 tháng 7 năm 2026, định vị nó là mô hình mạnh mẽ cho các agent chạy lâu dài, kỹ thuật phần mềm và công việc tri thức chuyên nghiệp. Theo mô tả của Anthropic, điểm khác biệt chính không chỉ là câu trả lời đầu tiên tốt hơn. Opus 5 được thiết kế để làm việc cẩn trọng hơn: xác minh kết quả trung gian, giữ mạch nhiệm vụ phức tạp, và lặp lại khi lần thử đầu chưa giải quyết được vấn đề thực sự.

Sự khác biệt này rất quan trọng trong công việc thực tế. Một câu hỏi thường nhật có thể chỉ cần một câu trả lời nhanh, ngắn gọn. Một nhiệm vụ lớn hơn có thể yêu cầu mô hình đọc tài liệu nguồn, xác định những gì còn thiếu, thực hiện phép tính hoặc sử dụng công cụ, so sánh các phương án, kiểm tra kết quả và giải thích lý do. Đó là những trường hợp mà mô hình Opus-tier thực sự đáng để lựa chọn.

Anthropic nhấn mạnh ba thế mạnh giao thoa:

  • Lập trình agentic: xây dựng tính năng lớn, gỡ lỗi khó, phân tích nguyên nhân gốc, refactor, và các nhiệm vụ trải dài nhiều file hoặc công cụ.
  • Công việc tri thức và phân tích: lập luận có cấu trúc trên tài liệu dày đặc, xử lý số liệu và bảng biểu, thẩm định, nghiên cứu và hỗ trợ ra quyết định.
  • Sử dụng máy tính và quy trình tự động hóa: hoàn thành chuỗi bước thay vì chỉ tạo ra một câu trả lời đơn lẻ.

Những tuyên bố này không có nghĩa là mô hình có thể bỏ qua kiểm tra. Nhưng nó cho phép mô hình đảm nhận bản nháp hoàn chỉnh hơn của công việc khó trước khi con người kiểm duyệt quyết định, bằng chứng và hành động cuối cùng.

Điểm chuẩn và năng lực của Claude Opus 5

Các điểm chuẩn mô hình là tín hiệu hữu ích, nhưng không đảm bảo mô hình sẽ hoạt động giống nhau trong mọi dự án. Chúng phụ thuộc vào nhiệm vụ, bộ kiểm thử, cài đặt và phương pháp chấm điểm. Tuy nhiên, báo cáo của Anthropic cho thấy rõ các vấn đề mà Opus 5 hướng tới.

Với kỹ thuật phần mềm, Anthropic cho biết Opus 5 dẫn đầu trong lần chạy nội bộ Frontier-Bench v0.1 và đạt hiệu suất gấp đôi Opus 4.8 với chi phí mỗi nhiệm vụ thấp hơn. Biểu đồ dưới đây hữu ích vì nó minh họa rõ sự đánh đổi: chuỗi Opus 5 màu cam vượt lên trên các kết quả Opus trước ở mọi mức nỗ lực, không chỉ ở mức tốn kém nhất.

Anthropic's Frontier-Bench v0.1 chart comparing agentic coding score with cost per attempt, shown unchanged with a gray border

Nguồn: Anthropic, Introducing Claude Opus 5. Biểu đồ gốc giữ nguyên; Felo thêm viền xám. Biểu đồ ghi chú rằng lần chạy Frontier-Bench sử dụng mini-SWE-agent harness, backend GKE, và tính phần thưởng trung bình trên năm lần thử mỗi nhiệm vụ.

Trên CursorBench 3.2, Anthropic cho biết mô hình đạt điểm gần bằng 0,5% so với điểm tối đa của Claude Fable 5 ở mức nỗ lực cao nhất, trong khi chi phí chỉ bằng một nửa mỗi nhiệm vụ. Đó là lý do Opus 5 đặc biệt phù hợp với các nhiệm vụ mà lần thử đầu chất lượng thấp sẽ gây thêm nhiều việc: gỡ lỗi toàn bộ codebase, xây dựng tính năng end-to-end, hoặc truy vết nguyên nhân gốc thay vì chỉ vá triệu chứng.

Với các nhiệm vụ giải quyết vấn đề rộng hơn và công việc văn phòng, công ty báo cáo Opus 5:

  • đạt điểm gấp ba lần mô hình tốt thứ hai trên ARC-AGI 3, bài kiểm tra giải quyết vấn đề mới lạ;
  • đạt tỷ lệ vượt qua cao hơn khoảng 1,5 lần so với mô hình tốt thứ hai ở cùng chi phí trên Zapier AutomationBench, kiểm tra tự động hóa doanh nghiệp end-to-end;
  • vượt trội các mô hình khác ở chi phí tương đương trên OSWorld 2.0, điểm chuẩn sử dụng máy tính; và
  • là mô hình tốt nhất và hiệu quả nhất của Anthropic trên các bài đánh giá ARC-AGI 3, GDPval-AA v2, HLE, AutomationBench và DeepSearchQA liên quan.

Bức tranh không chỉ giới hạn ở lập trình. Biểu đồ GDPval-AA v2 của Anthropic theo dõi các nhiệm vụ tri thức thực tế ở nhiều mức nỗ lực khác nhau. Điều này giúp lý giải vì sao Opus 5 phù hợp với nghiên cứu, tài chính, pháp lý, vận hành và các công việc cần câu trả lời đủ vững để vượt qua kiểm duyệt, thay vì chỉ đọc trôi chảy ở lần đầu.

Anthropic's GDPval-AA v2 chart comparing real-world knowledge task scores by effort level, shown unchanged with a gray border

Nguồn: Anthropic, Introducing Claude Opus 5. Biểu đồ gốc giữ nguyên; Felo thêm viền xám.

Đây là kết quả do Anthropic công bố, bao gồm các lần đánh giá nội bộ và phản hồi từ người dùng sớm được chọn, chứ không phải bảng xếp hạng độc lập phổ quát. Cách tiếp cận hiệu quả nhất là xem chúng như hướng dẫn để bạn tự kiểm thử mô hình: các nhiệm vụ có chuỗi phụ thuộc dài, yêu cầu mơ hồ, sử dụng công cụ, xác minh và hậu quả thực sự nếu câu trả lời hời hợt lọt qua.

Tính năng Claude Opus 5: vì sao “nỗ lực” thay đổi trải nghiệm

Opus 5 hỗ trợ nhiều mức nỗ lực khác nhau. Nói đơn giản, nỗ lực cho phép bạn đánh đổi giữa tốc độ phản hồi và lượng token với thời gian suy luận bổ sung. Các biểu đồ của Anthropic so sánh mô hình ở nhiều mức nỗ lực, từ thấp (tiết kiệm token) đến cao, rất cao và tối đa.

Điều này hữu ích vì không phải yêu cầu nào cũng xứng đáng với cùng một ngân sách. Dùng mức thấp cho phân loại nhanh, dàn ý hoặc chỉnh sửa nhỏ. Tăng nỗ lực khi nhiệm vụ có nhiều ràng buộc, khi mô hình cần tổng hợp nguồn, hoặc khi phải chẩn đoán lý do lần thử trước thất bại. Với kết quả quan trọng, hãy dành thời gian kiểm duyệt: yêu cầu mô hình xác định giả định, trích dẫn nguồn, kiểm tra trường hợp biên, hoặc giải thích điều gì có thể thay đổi khuyến nghị.

Đợt ra mắt này cũng giới thiệu Chế độ Nhanh tùy chọn trên nền tảng của Anthropic. Anthropic cho biết chế độ này chạy nhanh hơn khoảng 2,5 lần tốc độ tiêu chuẩn và chi phí gấp đôi mức cơ bản tại đó. Tính khả dụng và điều khiển có thể khác nhau tùy sản phẩm, nên trên Felo bạn hãy sử dụng các cài đặt hiển thị trong workspace thay vì giả định mọi tùy chọn Anthropic đều giống nhau.

Sự khác biệt thể hiện ở cách tự kiểm tra

Chủ đề thú vị nhất của bản phát hành là xác minh. Anthropic mô tả một đánh giá trong đó Opus 5 nhận được bản vẽ một bộ phận máy móc nhưng không thể xem trực tiếp. Thay vì dừng lại, mô hình được cho là đã viết một pipeline computer-vision để khôi phục hình học từ pixel thô, rồi dựng lại bộ phận đó thành mô hình 3D FreeCAD. Ở ví dụ khác, Anthropic cho biết mô hình đã tìm ra nguyên nhân gốc của một lỗi thực tế trong trình quản lý gói và xử lý cả trường hợp biên mà bản vá cộng đồng bỏ sót.

Những ví dụ này nên được xem như minh họa từ nhà phát triển mô hình, không phải cam kết. Nhưng chúng gợi ý một cách đặt lệnh cụ thể trên Felo: đừng chỉ yêu cầu câu trả lời. Hãy yêu cầu quy trình làm việc.

Investigate the issue, then propose a fix.
Before finalizing, verify the fix against the stated requirements,
list any assumptions, and identify tests or evidence that could disprove it.
Return the final recommendation separately from the working notes.

Với nghiên cứu, cách tiếp cận này có thể biến một yêu cầu rộng thành quy trình có thể kiểm duyệt: thu thập nguồn hiện tại, phân biệt thực tế và suy luận, tìm bằng chứng phản bác, và tạo bản tóm tắt quyết định ngắn gọn. Quy trình đa ngôn ngữ của Felo đặc biệt hữu ích khi tài liệu liên quan xuất hiện ở nhiều ngôn ngữ; hãy yêu cầu giữ nguyên ngôn ngữ nguồn cùng bản tổng hợp tiếng Anh rõ ràng khi cần.

Anthropic cũng báo cáo kết quả mạnh mẽ trên OSWorld 2.0, điểm chuẩn vận hành máy tính qua giao diện nhiều bước. Điều này nhắc nhở rằng công việc agentic thường không phải “một lệnh, một đáp án.” Đó là chuỗi kiểm tra trạng thái, chọn hành động tiếp theo, và xác thực kết quả có thực sự đạt mục tiêu hay không.

Anthropic's OSWorld 2.0 chart comparing agentic computer-use performance with cost per task, shown unchanged with a gray border

Nguồn: Anthropic, Introducing Claude Opus 5. Biểu đồ gốc giữ nguyên; Felo thêm viền xám.

Hiệu suất không phải yếu tố duy nhất: an toàn và giới hạn

Anthropic cho biết kiểm toán hành vi trước khi triển khai cho thấy Opus 5 là mô hình gần đây được căn chỉnh tốt nhất của họ. Họ nói mô hình thể hiện hành vi lệch chuẩn tổng thể thấp hơn, ít hành vi đánh lừa hơn và chống lại các lệnh lạm dụng tốt hơn so với nhiều mô hình Claude gần đây khác. Công ty cũng cho biết Opus 5 không mở rộng rủi ro về khả năng sử dụng kép nguy hiểm trong các thử nghiệm sinh học và an ninh mạng tấn công.

Biểu đồ kiểm toán dưới đây là tóm tắt trực quan rõ ràng nhất cho tuyên bố đó. Trên thang điểm hành vi lệch chuẩn 1-10 của Anthropic, càng thấp càng tốt; Opus 5 đạt 2,30, thấp nhất trong các mô hình so sánh. Đây là đánh giá an toàn nội bộ, nên chỉ nên dùng để tham khảo—không thay thế kiểm soát con người cẩn trọng với các công việc hệ trọng.

Anthropic's automated behavioral audit chart showing Opus 5 with the lowest misaligned-behavior score among the compared models, shown unchanged with a gray border

Nguồn: Anthropic, Introducing Claude Opus 5. Biểu đồ gốc giữ nguyên; Felo thêm viền xám.

Điểm thực tiễn quan trọng là các biện pháp bảo vệ vẫn là một phần của sản phẩm. Anthropic cho biết Opus 5 có thể giúp tìm lỗ hổng trong mã nguồn nhưng đặt rào chắn mạnh hơn với một số hoạt động an ninh mạng, bao gồm quét lỗ hổng dựa trên nhị phân, kiểm thử xâm nhập và tạo exploit. Các yêu cầu kích hoạt bảo vệ này có thể bị chặn hoặc, trong một số sản phẩm của Anthropic, sẽ chuyển sang mô hình khác.

Với mọi công việc khác, hãy giữ các thói quen tốt như với bất kỳ mô hình mạnh nào:

  • Kiểm tra lại các tuyên bố thực tế, phép tính, trích dẫn, mã và hành động cuối cùng trước khi sử dụng.
  • Đừng coi sự trôi chảy là bằng chứng. Hãy yêu cầu nguồn gốc và kiểm tra chúng.
  • Luôn để con người chịu trách nhiệm với quyết định pháp lý, tài chính, y tế, an ninh và các vấn đề hệ trọng khác.
  • Đưa ra điều kiện thành công rõ ràng và ranh giới không được vượt qua cho mô hình.

Anthropic cũng lưu ý Opus 5 vẫn có giới hạn quan trọng với các nhiệm vụ nghiên cứu tự động kéo dài. Năng lực không đồng nghĩa với tự chủ, và một quy trình kiểm duyệt con người được thiết kế tốt vẫn là phần không thể thiếu của workflow mạnh mẽ.

Giá Claude Opus 5 và dùng thử miễn phí trên Felo

Anthropic niêm yết Claude Opus 5 ở mức $5 cho mỗi triệu token đầu vào$25 cho mỗi triệu token đầu ra qua Claude API, cùng mức cơ bản với Opus 4.8. Giá trên các nền tảng bên thứ ba, gói đăng ký và tính năng có thể khác nhau, nên hãy tham khảo thông tin giá và sử dụng hiển thị trong sản phẩm bạn đang dùng.

Với người dùng Felo Pro, điểm cần nhớ đơn giản hơn: Claude Opus 5 miễn phí dùng thử trong bảy ngày kể từ ngày phát hành. Điều này cho phép bạn đánh giá nó với các nhiệm vụ thực tế trước khi quyết định vị trí của nó trong bộ mô hình thường dùng. So sánh hợp lý không chỉ là “Mô hình nào viết bản nháp đầu tốt nhất?” Hãy thử cùng một nhiệm vụ khó với mô hình bạn đang dùng, rồi so sánh mức độ hoàn thiện, tỷ lệ lỗi, nhu cầu chỉnh sửa, chất lượng xử lý nguồn và thời gian kiểm duyệt cần thiết cho mỗi kết quả.

Cách dùng thử Claude Opus 5 miễn phí 7 ngày trên Felo Pro

  1. Đăng nhập vào tài khoản Felo Pro của bạn.
  2. Bắt đầu một nhiệm vụ mới trong workspace Felo bạn thường dùng cho nghiên cứu, viết, phân tích hoặc công việc agentic.
  3. Chọn Claude Opus 5 trong bộ chọn mô hình.
  4. Giao cho nó một nhiệm vụ với yêu cầu rõ ràng, file hoặc ngữ cảnh liên quan, và bước xác minh cụ thể.
  5. Kiểm tra kết quả, điều chỉnh hướng dẫn khi cần, và so sánh với quy trình hiện tại của bạn trong suốt bảy ngày ưu đãi ra mắt.

Hãy bắt đầu với công việc làm nổi bật thế mạnh của mô hình: một kế hoạch dự án cần đánh đổi, bảng tính hoặc báo cáo phức tạp, code review khó, câu hỏi nghiên cứu đa nguồn, hoặc phân tích phải vượt qua các câu hỏi truy vấn tiếp theo. Mục tiêu không phải là làm mô hình ấn tượng bằng một prompt thông minh. Mà là để xem nó có giúp công việc thực tế của bạn rõ ràng hơn, đáng tin cậy hơn và dễ hoàn thành hơn không.

Hãy dùng ưu đãi cho nhiệm vụ quan trọng: Bắt đầu dùng thử Claude Opus 5 trên Felo ->

Có nên thử Claude Opus 5 không?

Claude Opus 5 mang đến lựa chọn mới trên Felo cho các nhiệm vụ đòi hỏi sự kiên trì, suy luận cẩn trọng và xác minh. Các kết quả công bố cho thấy tiến bộ đáng kể ở lập trình agentic, tự động hóa, sử dụng máy tính và phân tích chuyên nghiệp, trong khi các ràng buộc an toàn và giới hạn vẫn là bối cảnh quan trọng.

Trong bảy ngày tới, người dùng Felo Pro có thể đánh giá nó mà không mất thêm phí mô hình. Hãy mang đến một nhiệm vụ thực sự quan trọng, yêu cầu mô hình trình bày và kiểm tra quy trình, rồi quyết định từ kết quả xem Claude Opus 5 có xứng đáng là lựa chọn lâu dài trong workflow của bạn không.

Bắt đầu dùng thử Claude Opus 5 miễn phí 7 ngày trên Felo ->


Nguồn và đọc thêm


Bài viết này cũng có sẵn bằng English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Türkçe, Italiano, ไทย, Español, বাংলা and Português.