Claude Opus 5, Felo에서 출시: 주요 기능, 가격 및 7일 무료 체험
Felo가 이제 Claude Opus 5를 지원합니다. 기능, 벤치마크, 안전성, 가격을 살펴보고, Anthropic의 에이전틱 코딩 모델을 7일간 무료로 체험해보세요.
Felo가 이제 Claude Opus 5를 지원합니다. Anthropic의 새로운 Opus 등급 모델로, 에이전틱 코딩, 전문 분석, 장기 작업에 최적화되어 있습니다. 단순히 강력한 첫 답변을 넘어서, 연구, 검증, 반복, 그리고 자신 있게 검토할 수 있는 결과가 필요한 작업에 Felo에서 이 모델을 선택해보세요.
출시를 기념하여, Felo Pro 구독자는 출시일부터 7일간 추가 비용 없이 Claude Opus 5를 사용할 수 있습니다. 해결이 어려운 버그, 상충하는 증거가 있는 연구 요약, 다단계 분석, 한 번의 수정으로는 부족한 문서 등 실제로 중요한 작업에 적용해보고 직접 평가해보세요.

커버 이미지: Anthropic의 Claude Opus 5 발표에서 가져온 오리지널 아트워크. 시각적 내용은 변경되지 않았으며, Felo에서 회색 테두리만 추가했습니다.
이 글은 단순한 릴리즈 노트가 아닙니다. 아래에서는 Opus 5가 설계된 목적, Anthropic이 공개한 평가 결과, 남아있는 한계, 그리고 Felo에서 실제 작업으로 테스트하는 방법을 시각적으로 안내합니다.
직접 테스트해보고 싶으신가요? Felo에서 7일간 Claude Opus 5 무료 체험 시작하기 ->
Claude Opus 5의 주요 기능: 모델이 지향하는 역할
Anthropic은 2026년 7월 24일 Claude Opus 5를 출시하며, 장기 에이전트, 소프트웨어 엔지니어링, 전문 지식 작업에 적합한 일상용 고성능 모델로 포지셔닝했습니다. Anthropic의 설명에 따르면, 핵심 변화는 단순히 더 나은 첫 답변이 아니라, Opus 5가 더 신중하게 작업하도록 설계되었다는 점입니다. 중간 결과를 검증하고, 복잡한 작업의 맥락을 유지하며, 첫 시도가 실제 문제를 해결하지 못할 경우 반복적으로 개선합니다.
이 차이는 실제 업무에서 중요합니다. 일상적인 질문에는 빠르고 간결한 답변만 필요할 수 있지만, 더 큰 과제라면 모델이 원본 자료를 읽고, 추가로 알아야 할 점을 결정하며, 계산이나 도구를 실행하고, 대안을 비교하고, 결과를 점검하고, 설명까지 해야 할 수 있습니다. 이런 경우에 Opus 등급 모델을 선택할 가치가 높아집니다.
Anthropic이 강조하는 세 가지 주요 강점은 다음과 같습니다:
- 에이전틱 코딩: 대규모 기능 개발, 어려운 디버깅, 근본 원인 분석, 리팩터링, 여러 파일이나 도구에 걸친 작업 등
- 지식 작업 및 분석: 복잡한 자료에 대한 구조적 추론, 수치 및 표 작업, 실사, 연구, 의사결정 지원 등
- 컴퓨터 사용 및 자동화 워크플로우: 단일 답변이 아닌 일련의 단계들을 완수하는 작업
이러한 강점이 있다고 해서 모델을 검증 없이 사용할 수 있다는 의미는 아닙니다. 다만, 사람이 최종 결정과 증거, 결과를 검토하기 전에 더 완성도 높은 초안을 만들 수 있다는 뜻입니다.
Claude Opus 5 벤치마크 및 역량
모델 벤치마크는 유용한 신호일 뿐, 모든 프로젝트에서 동일한 성능을 보장하지는 않습니다. 과제, 환경, 설정, 평가 방식에 따라 달라집니다. 그럼에도 Anthropic의 발표는 Opus 5가 겨냥하는 문제 유형을 잘 보여줍니다.
소프트웨어 엔지니어링 분야에서 Anthropic은 Opus 5가 Frontier-Bench v0.1 내부 테스트에서 선두를 차지했으며, Opus 4.8 대비 과제당 비용은 낮추면서 성능은 두 배 이상 높였다고 밝혔습니다. 아래 차트는 이 트레이드오프를 구체적으로 보여줍니다. 주황색 Opus 5 시리즈가 모든 노력 설정에서 이전 Opus 결과를 상회하고 있습니다.

출처: Anthropic, Introducing Claude Opus 5. 원본 차트는 변경 없이, Felo에서 회색 테두리만 추가했습니다. Frontier-Bench 테스트는 mini-SWE-agent 환경, GKE 백엔드, 과제별 5회 평균 보상 기준으로 진행되었습니다.
CursorBench 3.2에서는, Anthropic에 따르면 Opus 5가 최대 노력 기준으로 Claude Fable 5의 최고 점수에 0.5% 이내로 근접하면서도 과제당 비용은 절반에 불과합니다. 즉, 첫 시도가 저품질이면 오히려 일이 늘어나는, 코드베이스 전체 디버깅, 엔드 투 엔드 기능 개발, 근본 원인 추적 등에서 Opus 5의 가치가 더욱 두드러집니다.
더 넓은 문제 해결 및 사무 스타일 작업에서는 Opus 5가 다음과 같은 성과를 보였다고 합니다:
- ARC-AGI 3(신규 문제 해결 평가)에서 차점 모델 대비 3배 높은 점수
- Zapier AutomationBench(엔드 투 엔드 비즈니스 자동화 테스트)에서 동일 비용 기준 차점 모델 대비 약 1.5배 높은 통과율
- OSWorld 2.0(컴퓨터 사용 벤치마크)에서 유사 비용 대비 타 모델 대비 우수한 성능
- ARC-AGI 3, GDPval-AA v2, HLE, AutomationBench, DeepSearchQA 등 관련 평가에서 최고의 효율성과 성능
이러한 성과는 코드에만 국한되지 않습니다. Anthropic의 GDPval-AA v2 차트는 다양한 노력 수준에서 실제 지식 작업 성과를 보여줍니다. Opus 5가 연구, 금융, 법률, 운영 등 검토를 견뎌야 하는 답변이 필요한 분야에서 왜 의미가 있는지 설명해줍니다.

출처: Anthropic, Introducing Claude Opus 5. 원본 차트는 변경 없이, Felo에서 회색 테두리만 추가했습니다.
이들은 Anthropic이 직접 공개한 결과로, 내부 평가와 일부 초기 피드백을 포함하며, 독립적이고 보편적인 순위는 아닙니다. 가장 생산적인 활용법은, 긴 의존성 체인, 모호한 요구사항, 도구 사용, 검증, 얕은 답변이 문제를 일으킬 수 있는 작업에서 직접 모델을 테스트해보는 것입니다.
Claude Opus 5의 기능: “노력” 설정이 경험을 바꾸는 이유
Opus 5는 다양한 노력(effort) 설정을 지원합니다. 쉽게 말해, 노력 설정을 통해 응답 속도와 토큰 사용량을 추가적인 추론 시간과 맞바꿀 수 있습니다. Anthropic의 차트는 토큰을 아끼는 저노력부터 high, xhigh, maximum effort까지 여러 단계에서 모델을 비교합니다.
모든 요청이 동일한 자원을 필요로 하는 것은 아닙니다. 빠른 분류, 개요, 간단한 수정에는 저노력 설정을, 여러 제약조건이 있거나, 다양한 출처를 조율해야 하거나, 이전 시도가 실패한 원인을 진단해야 할 때는 노력 수준을 높이세요. 중요한 결과물에는 검토 단계에도 시간을 투자하세요. 모델에게 가정, 출처, 엣지 케이스, 권고 변경 조건 등을 요청해보세요.
이번 출시에서는 Anthropic 자체 플랫폼에서 Fast 모드도 도입되었습니다. 이 모드는 표준 속도의 약 2.5배로 동작하며, 비용은 두 배입니다. 사용 가능 여부와 설정은 제품마다 다를 수 있으니, Felo에서는 워크스페이스에 표시된 설정을 사용하세요.
자기 검증에서 드러나는 차이
이번 출시의 가장 흥미로운 주제는 검증입니다. Anthropic은 Opus 5가 기계 부품의 도면을 받았지만 직접 볼 수 없는 상황에서, 컴퓨터 비전 파이프라인을 작성해 원시 픽셀에서 형상을 추출하고, 3D FreeCAD 모델로 재구성했다고 설명합니다. 또 다른 예시로, 실제 패키지 매니저 버그의 근본 원인을 찾아 커뮤니티 패치에서 놓친 엣지 케이스까지 해결했다고 합니다.
이런 사례는 모델 제작자의 데모일 뿐, 보장된 약속은 아닙니다. 하지만 Felo에서의 구체적인 프롬프트 패턴을 시사합니다. 단순히 답만 요구하지 말고, 작업 과정을 요청하세요.
문제를 조사한 후, 해결책을 제안하세요.
최종 확정 전, 제안한 해결책을 명시된 요구사항에 따라 검증하고,
가정 사항을 나열하며, 이를 반증할 수 있는 테스트나 증거를 식별하세요.
최종 권고안은 작업 노트와 별도로 제출하세요.
연구에서도 같은 접근법이 넓은 프롬프트를 검토 가능한 과정으로 바꿔줍니다. 최신 자료를 수집하고, 사실과 추론을 구분하며, 반증 자료를 찾고, 간결한 결정 요약을 만드세요. Felo의 다국어 워크플로우는 관련 자료가 여러 언어로 분산된 경우 특히 유용합니다. 필요하다면 원문 언어를 보존하고 명확한 영어 요약을 함께 요청하세요.
Anthropic은 또한 OSWorld 2.0(다단계 인터페이스를 통한 컴퓨터 조작 벤치마크)에서 강력한 결과를 보고했습니다. 이는 에이전틱 작업이 “한 번의 프롬프트, 한 번의 답변”이 아님을 상기시켜줍니다. 상태를 점검하고, 다음 행동을 선택하며, 결과가 실제 목표를 충족하는지 검증하는 일련의 과정입니다.

출처: Anthropic, Introducing Claude Opus 5. 원본 차트는 변경 없이, Felo에서 회색 테두리만 추가했습니다.
성능만이 전부는 아니다: 안전성과 한계
Anthropic은 사전 배포 행동 감사에서 Opus 5가 최근 모델 중 가장 높은 정렬성을 보였다고 밝혔습니다. 전체적으로 오정렬 행동, 기만적 행동이 더 낮았고, 악용 프롬프트에 대한 저항성도 더 높았다고 합니다. 또한 생물학 및 공격적 사이버 보안 테스트에서 위험한 이중 용도 역량의 경계를 확장하지 않았다고 밝혔습니다.
아래 감사 차트는 이 주장을 가장 명확하게 시각화합니다. Anthropic의 1~10 오정렬 행동 척도에서 낮을수록 좋으며, Opus 5는 2.30으로 비교 모델 중 가장 낮게 나타납니다. 내부 안전성 평가이므로, 중요한 작업에서는 신중한 인간 통제가 여전히 필요합니다.

출처: Anthropic, Introducing Claude Opus 5. 원본 차트는 변경 없이, Felo에서 회색 테두리만 추가했습니다.
실질적으로 중요한 점은 보호장치가 제품의 일부로 남아 있다는 것입니다. Anthropic은 Opus 5가 소스 코드의 취약점 탐지에 도움을 줄 수 있지만, 바이너리 기반 취약점 스캐닝, 침투 테스트, 익스플로잇 생성 등 특정 사이버 활동에는 더 강력한 보호장치를 적용한다고 밝혔습니다. 이러한 보호장치가 작동하면 요청이 차단되거나, 일부 Anthropic 제품에서는 다른 모델로 대체될 수 있습니다.
그 외 모든 작업에서는 다음과 같은 기본 원칙을 지키세요:
- 사실 주장, 계산, 인용, 코드, 최종 행동을 신뢰하기 전에 반드시 검토하세요.
- 유창함을 증거로 착각하지 마세요. 1차 출처를 요청하고 직접 확인하세요.
- 법률, 금융, 의료, 보안 등 중대한 결정에는 반드시 사람이 책임을 지세요.
- 모델에 명확한 성공 조건과 넘지 말아야 할 경계를 제시하세요.
Anthropic은 또한 Opus 5가 장기 자율 연구 작업에는 여전히 중요한 한계가 있다고 언급합니다. 역량이 곧 자율성을 의미하지 않으며, 잘 설계된 인간 검토 루프가 강력한 워크플로우의 일부로 남아 있어야 합니다.
Claude Opus 5 가격 및 Felo 무료 체험
Anthropic은 Claude Opus 5의 가격을 백만 입력 토큰당 $5, 백만 출력 토큰당 $25로, Opus 4.8과 동일하게 책정했습니다. 서드파티 플랫폼, 구독, 기능별 가격은 다를 수 있으니, 실제 사용하는 제품에서 표시되는 가격과 사용량 정보를 참고하세요.
Felo Pro 구독자에게는 더 간단한 소식이 있습니다. Claude Opus 5를 출시일부터 7일간 무료로 체험할 수 있습니다. 실제 과제로 평가해보고, 정기적으로 사용할 모델로 적합한지 결정할 수 있습니다. 합리적인 비교는 “어떤 모델이 가장 멋진 초안을 썼는가?”가 아니라, 동일한 어려운 작업을 기존 모델과 Opus 5로 각각 시도해보고, 완성도, 오류율, 추가 작업 필요성, 출처 처리 품질, 검토에 소요되는 시간을 비교하는 것입니다.
Felo Pro에서 Claude Opus 5를 7일간 무료로 체험하는 방법
- Felo Pro 계정에 로그인하세요.
- 평소 연구, 집필, 분석, 에이전틱 작업에 사용하는 Felo 워크스페이스에서 새 작업을 시작하세요.
- 모델 선택기에서 Claude Opus 5를 선택하세요.
- 명확한 결과물, 관련 파일 또는 맥락, 그리고 명시적인 검증 단계를 포함한 작업을 부여하세요.
- 결과를 검토하고, 필요시 지침을 다듬으며, 7일간의 런칭 기간 동안 기존 워크플로우와 비교해보세요.
모델의 강점이 드러나는 작업부터 시작해보세요. 트레이드오프가 필요한 프로젝트 계획, 복잡한 스프레드시트나 보고서, 어려운 코드 리뷰, 다수의 출처가 필요한 연구 질문, 후속 질문에도 견딜 수 있는 분석 등입니다. 목표는 멋진 프롬프트로 모델을 돋보이게 하는 것이 아니라, 실제 업무가 더 명확하고, 신뢰할 수 있으며, 완성하기 쉬워지는지 확인하는 것입니다.
중요한 작업에 이번 기회를 활용하세요: Felo에서 Claude Opus 5 체험 시작하기 ->
Claude Opus 5, 시도해볼 가치가 있을까?
Claude Opus 5는 끈기, 신중한 추론, 검증이 중요한 작업에 Felo에서 새로운 선택지를 제공합니다. 공개된 결과는 에이전틱 코딩, 자동화, 컴퓨터 사용, 전문 분석에서 의미 있는 진전을 보여주며, 안전성 제약과 한계 역시 중요한 맥락으로 남아 있습니다.
앞으로 7일간, Felo Pro 구독자는 추가 모델 비용 없이 직접 평가할 수 있습니다. 실제로 중요한 작업을 가져와, 작업 과정을 보여주고 검증하도록 요청한 뒤, 결과를 바탕으로 Claude Opus 5가 워크플로우에 영구적으로 자리 잡을 가치가 있는지 결정해보세요.
Felo에서 7일간 Claude Opus 5 무료 체험 시작하기 ->
참고 자료 및 추가 읽을거리
- Anthropic, "Introducing Claude Opus 5", 2026년 7월 24일.
- Anthropic, "Prompting Claude Opus 5".
- Anthropic, Claude Platform pricing.
이 글은 다음 언어로도 읽을 수 있습니다: English, 简体中文, 日本語, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা, Português.