앤트로픽 Claude Opus 5 출시, ‘가장 비싼 AI’보다 현실적인 선택이 될까

앤트로픽 Claude Opus 5 출시, ‘가장 비싼 AI’보다 현실적인 선택이 될까

AI 모델 경쟁이 단순히 “누가 더 높은 점수를 받았는가”에서 새로운 단계로 넘어가고 있습니다. 이제 기업과 개발자들이 묻는 질문은 분명합니다. 얼마나 똑똑한가뿐 아니라, 실제 업무를 끝까지 수행하면서 비용까지 줄일 수 있는가입니다.

앤트로픽이 2026년 7월 24일 공개한 Claude Opus 5는 바로 이 지점을 겨냥한 모델입니다. 최상위 모델인 Claude Fable 5에 가까운 성능을 제공하면서 가격은 절반으로 낮췄고, 코딩과 기업 업무, 장시간 이어지는 AI 에이전트 작업을 핵심 영역으로 내세웠습니다.

Claude Opus 5는 어떤 AI 모델인가

Claude Opus 5는 앤트로픽의 고성능 Opus 제품군을 잇는 최신 플래그십급 모델입니다. 회사의 공식 분류상 가장 강력한 일반 공개 모델은 여전히 Claude Fable 5지만, 앤트로픽은 복잡한 코딩과 기업 업무를 시작할 때 Opus 5를 우선 고려하도록 안내하고 있습니다.

쉽게 비유하면 Fable 5가 모든 옵션을 갖춘 최고급 슈퍼컴퓨터라면, Opus 5는 실제 회사에서 매일 돌리기 좋은 고성능 워크스테이션에 가깝습니다. 최고 성능만 놓고 보면 Fable이 앞서지만, 속도와 비용, 이용 제한까지 종합하면 Opus 5가 더 실용적인 선택이 될 수 있다는 의미입니다.

Opus 5는 Claude Max 요금제의 기본 모델이 됐으며, Claude Pro에서 사용할 수 있는 가장 강력한 모델로 제공됩니다. 개발자는 Claude API뿐 아니라 Amazon Bedrock, Google Cloud, Microsoft Foundry에서도 이용할 수 있습니다.

가장 큰 변화는 ‘답변’보다 ‘업무 완성 능력’

기존 생성형 AI는 코드를 작성하거나 보고서 초안을 만드는 데는 능숙했지만, 중간에 문제가 생기면 잘못된 방향으로 계속 진행하거나 완료되지 않은 작업을 성공했다고 보고하는 경우가 있었습니다.

Opus 5가 강조하는 변화는 답변 한 번의 화려함보다 자신의 결과를 다시 확인하고, 오류가 있으면 수정하며, 작업이 끝날 때까지 반복하는 능력입니다.

앤트로픽은 시험 과정에서 Opus 5가 불완전한 지시를 받았을 때 필요한 도구를 스스로 만들어 문제를 해결한 사례를 공개했습니다. 예를 들어 기계 부품의 그림을 직접 볼 수 없는 조건에서 자체 컴퓨터 비전 처리 과정을 만든 뒤, 이미지의 픽셀 정보를 분석해 FreeCAD용 3D 모델을 재구성했습니다. 오픈소스 프로그램의 실제 버그를 고치는 시험에서는 겉으로 나타난 증상만 수정하지 않고 근본 원인과 기존 패치가 놓친 예외까지 찾아냈다고 설명했습니다.

이는 AI가 단순히 “코드를 대신 써주는 도구”에서 벗어나, 계획을 세우고 필요한 도구를 사용하며 결과를 검증하는 에이전트형 AI로 발전하고 있다는 신호입니다.

Opus 5 성능은 얼마나 향상됐나

앤트로픽이 공개한 결과에 따르면 Opus 5는 소프트웨어 엔지니어링 평가인 Frontier-Bench v0.1에서 Opus 4.8보다 두 배 이상 높은 성능을 기록하면서 작업당 비용은 더 낮았습니다. CursorBench 3.2에서는 최대 추론 설정 기준으로 Fable 5 최고 점수와 약 0.5% 차이까지 접근했다고 합니다.

컴퓨터를 직접 조작하는 능력을 측정하는 OSWorld 2.0에서는 Fable 5의 최고 결과보다 높은 점수를 약 3분의 1 수준의 비용으로 기록했으며, 자동화 업무 평가에서는 낮은 추론 설정에서도 다른 비교 모델보다 많은 작업을 완료했다고 앤트로픽은 설명합니다.

과학 분야에서도 개선이 있었습니다. 분광 데이터를 이용해 분자 구조를 추론하는 내부 평가에서는 Opus 4.8보다 10.2%포인트 높았고, 단백질 서열 변화가 기능에 미치는 영향을 예측하는 시험에서는 7.7%포인트 상승했습니다.

다만 이러한 숫자의 상당수는 앤트로픽이 선정한 평가와 초기 고객 사례를 기반으로 합니다. 벤치마크에서 좋은 성적을 거뒀다고 해서 모든 회사의 코드와 문서, 실제 운영 환경에서 같은 차이가 나타난다고 보기는 어렵습니다. 특히 장시간 에이전트 작업은 사용하는 도구와 프롬프트, 데이터 품질에 따라 결과 차이가 크게 발생할 수 있습니다.

Claude Opus 5 가격은 얼마인가

Opus 5의 API 가격은 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러입니다. 이전 모델인 Opus 4.8과 같은 가격이며, 입력 10달러·출력 50달러인 Fable 5의 절반 수준입니다.

모델입력 100만 토큰출력 100만 토큰주요 용도
Claude Fable 5$10$50최고 성능, 장시간 고난도 에이전트
Claude Opus 5$5$25복잡한 코딩, 분석, 기업 업무
Claude Sonnet 5$3*$15*속도와 성능의 균형
Claude Haiku 4.5$1$5빠른 응답과 대량 처리

*Sonnet 5는 2026년 8월 31일까지 입력 $2, 출력 $10의 출시 기념 가격이 적용됩니다.

가격이 같다고 해서 Opus 4.8에서 Opus 5로 바꿀 때 비용이 반드시 동일한 것은 아닙니다. Opus 5는 새로운 토크나이저와 적응형 추론을 사용하기 때문에 같은 문장도 처리되는 토큰 수와 추론량이 달라질 수 있습니다. 따라서 기업에서는 모델 가격표보다 실제 업무 한 건을 완료하는 데 발생하는 총비용을 비교하는 것이 중요합니다.

100만 토큰 문맥과 12만8천 토큰 출력 지원

Claude Opus 5는 최대 100만 토큰의 컨텍스트 창과 최대 12만8천 토큰 출력을 지원합니다. 매우 큰 코드 저장소나 수백 페이지 분량의 문서, 장시간 이어진 에이전트 작업 기록을 한 번에 다룰 수 있는 규모입니다. 공식 문서상 신뢰도 높은 지식 기준일과 학습 데이터 기준일은 2026년 5월입니다.

하지만 100만 토큰을 지원한다는 말이 100만 토큰 전체를 항상 완벽하게 기억한다는 뜻은 아닙니다. 긴 문서에서는 중요한 정보를 어디에 배치했는지, 검색 도구를 함께 사용했는지, 문서를 어떻게 나눴는지에 따라 정확도가 달라질 수 있습니다.

필요한 만큼만 생각하는 ‘Adaptive Thinking’

Opus 5에는 **적응형 추론(Adaptive Thinking)**이 기본으로 적용됩니다. 단순한 질문에는 적은 연산을 사용하고, 복잡한 코딩이나 다단계 분석에는 더 많은 추론을 사용하도록 설계된 방식입니다.

개발자는 low, medium, high, xhigh, max의 다섯 가지 effort 수준을 선택할 수 있습니다. 기본값은 high이며, 복잡한 코딩이나 에이전트 작업에는 xhigh, 비용과 응답 시간이 중요한 업무에는 low 또는 medium을 사용할 수 있습니다.

이는 자동차에서 주행 모드를 고르는 것과 비슷합니다. 간단한 이메일 정리에 항상 스포츠 모드를 사용할 필요는 없지만, 복잡한 프로그램을 수정하거나 대규모 자료를 분석할 때는 더 많은 연산을 투입할 수 있습니다.

Fable 5보다 이용 제한이 적은 이유

Fable 5와 Mythos 5는 생물학과 사이버보안처럼 위험하게 활용될 수 있는 영역에서 더 높은 능력을 가진 만큼, 강한 실시간 보호 장치와 특별한 데이터 보관 정책이 적용됩니다. Mythos 계열 트래픽에는 30일 보관이 의무적으로 적용됩니다.

Opus 5에도 사이버 공격과 악성코드 생성 등을 막는 보호 장치는 남아 있습니다. 다만 Fable 5보다 위험 능력이 낮다고 평가돼 보호 분류기가 작동하는 빈도가 약 85% 적을 것으로 앤트로픽은 예상합니다. 예를 들어 방어 목적의 소스코드 취약점 분석은 가능하지만, 실행 파일을 대규모로 스캔하거나 실제 공격으로 연결하는 요청은 제한될 수 있습니다.

여기서 “Opus 5는 데이터를 보관하지 않는다”고 이해해서는 안 됩니다. Fable·Mythos에 적용되는 별도의 의무 보관 정책 대상이 아니라는 의미이며, Claude 서비스와 API의 일반적인 개인정보 및 데이터 보관 정책은 별도로 적용됩니다.

일반 사용자는 무엇이 달라질까

프로그래머에게는 대규모 코드 수정, 버그 원인 분석, 테스트와 검증까지 이어지는 업무에서 가장 큰 변화가 나타날 가능성이 있습니다. 단순히 코드 조각을 받아 복사하는 방식이 아니라, AI가 저장소 전체를 확인하고 여러 파일을 수정한 뒤 실행 결과까지 점검하는 작업에 적합합니다.

직장인에게는 긴 보고서 작성, 계약서 검토, 재무자료 분석, 프레젠테이션 제작처럼 여러 단계를 연결해야 하는 업무에서 장점이 나타날 수 있습니다. 초기 사용 기업들은 데이터 분석과 실사, 법률 문서 수정, 재무 모델링, 프레젠테이션 제작에서 Opus 4.8보다 향상된 결과를 보고했습니다. 다만 이는 각 기업의 내부 평가이므로 실제 사용자에게 같은 개선 폭이 보장되는 것은 아닙니다.

간단한 질문과 번역, 짧은 문서 작성만 주로 한다면 비용이 저렴하고 빠른 Sonnet 또는 Haiku 모델이 더 효율적일 수 있습니다. Opus 5의 진가는 한 번의 답변보다 몇십 분 또는 몇 시간 동안 이어지는 복잡한 작업을 맡길 때 드러날 가능성이 큽니다.

Claude Opus 5가 보여주는 AI 경쟁의 다음 단계

Opus 5의 중요한 의미는 벤치마크 1위라는 문구에만 있지 않습니다. 최고 성능 모델을 무조건 크게 만드는 대신, 더 저렴한 모델이 최상위 모델에 가까운 업무 능력을 제공하도록 만든 점이 핵심입니다.

앞으로 AI 시장에서는 “가장 똑똑한 모델”보다 작업을 실수 없이 끝내는 모델, 비용 대비 성공률이 높은 모델, 사람의 감독을 덜 필요로 하는 모델이 더 큰 경쟁력을 갖게 될 수 있습니다.

Claude Opus 5는 모든 면에서 Fable 5를 뛰어넘은 모델은 아닙니다. 고위험 생물학과 공격적 사이버보안 능력에서는 Mythos와 Fable 계열이 여전히 앞섭니다. 그러나 일반 기업과 개발자가 매일 사용하는 코딩, 분석, 자동화 업무에서는 가격과 성능의 균형이 더 좋아졌습니다.

결국 Opus 5는 AI가 질문에 답하는 챗봇에서 벗어나, 스스로 계획하고 도구를 사용하며 결과를 검토하는 디지털 업무 파트너로 이동하고 있음을 보여주는 모델입니다.