앤트로픽이 7월 24일 클로드 오퍼스 5를 전 플랫폼에 출시했다. 최상위 공개 모델 페이블 5에 근접한 지능을 그 절반 가격(입력 100만 토큰당 $5, 출력 $25 — 이전 오퍼스 4.8과 동일)에 제공하는 것이 핵심이다. 코딩·지식노동 벤치마크에서 새 최고점을 세웠고, 사내 자동 행동 감사에서는 '역대 가장 정렬된 모델'로 평가됐다. 다만 사이버·생물 위험 역량은 상위 모델 미소스 5보다 여전히 낮게 설계됐다.

앤트로픽이 오퍼스 계열의 새 세대인 클로드 오퍼스 5를 공개했다. 회사는 이 모델을 "매일, 요금 걱정 없이 기본으로 집어드는 모델"로 포지셔닝했다. 가장 어려운 작업에만 아껴 쓰던 최상위 티어를 일상 업무용으로 끌어내리겠다는 메시지다.

무엇이 바뀌었나

핵심은 '지능 대비 가격'이다. 오퍼스 5는 앤트로픽의 최상위 공개 모델인 페이블 5에 근접한 성능을 내면서 가격은 그 절반이다. 절대 가격은 직전 오퍼스 4.8과 동일한 입력 100만 토큰당 $5, 출력 $25로 묶어, 같은 비용에 성능만 끌어올렸다.

요청마다 저·중·고로 조절하는 '노력(effort) 설정'을 두어 지능과 토큰 비용을 사용자가 직접 저울질할 수 있게 했다. 앤트로픽에 따르면 오퍼스 5는 코딩·지식노동 평가인 프론티어벤치(Frontier-Bench)와 GDPval-AA에서 새 최고 성적을 기록했다.

출시일 2026년 7월 24일 (전 플랫폼)
가격 입력 $5 / 출력 $25 (100만 토큰, 오퍼스 4.8과 동일 · 페이블 5의 절반)
패스트 모드 기본 대비 약 2.5배 속도, 2배 가격 ($10 / $50)
정렬 점수 오정렬 행동 2.3 — 최근 모델 중 최저
사이버 분류기 개입 페이블 5 대비 약 85% 감소

벤치마크에서 드러난 성격

앤트로픽이 공개한 그래프는 성능을 '노력 설정별'로 보여준다. 대표적으로 프론티어벤치 v0.1에서 오퍼스 5는 모든 경쟁 모델을 앞섰고, 오퍼스 4.8 대비 성능을 두 배 이상으로 끌어올리면서 작업당 비용은 더 낮췄다. 커서벤치(CursorBench) 3.2 최대 노력 구간에서는 페이블 5 최고점과 0.5% 이내로 붙되 작업당 비용은 절반이었다.

새로운 문제를 푸는 ARC-AGI 3에서는 오퍼스 5 점수가 차순위 모델의 세 배에 달했다. 컴퓨터 사용 벤치마크 OSWorld 2.0에서는 같은 비용 기준으로 모든 모델을 앞섰고, 페이블 5의 최고 성적을 3분의 1 남짓한 비용으로 넘어섰다.

평가 오퍼스 5 성과
프론티어벤치 v0.1 전 모델 1위 · 오퍼스 4.8의 2배 이상, 비용은↓
커서벤치 3.2 (최대 노력) 페이블 5 최고점과 0.5% 이내, 비용 절반
ARC-AGI 3 차순위 모델의 약 3배 점수
OSWorld 2.0 (컴퓨터 사용) 동일 비용 기준 전 모델 상회

앤트로픽은 초기 접근 고객 사례도 함께 공개했다. 커서(Cursor)는 "오퍼스 속도·비용으로 페이블 5에 근접한 지능"이라 평했고, 데빈(Devin)을 만드는 코그니션은 "프론티어코드 1.1에서 절반 비용에 페이블급에 근접"한다고 전했다. 재피어(Zapier)는 오퍼스 5가 오토메이션벤치 리더보드 정상에 오르며 이전 모델이 통과하지 못한 업무를 100% 완수했다고 밝혔다.

정렬과 안전

앤트로픽은 배포 전 자동 행동 감사에서 오퍼스 5가 '역대 가장 정렬된 모델'로 나타났다고 했다. 오정렬 행동 종합 점수는 2.3으로 최근 모델 중 가장 낮았고, 기만 행동 비율과 오용 유도에 대한 취약성도 오퍼스 4.8·소네트 5·페이블 5보다 낮았다.

안전 측면에서 오퍼스 5는 이중용도 위험 역량의 최전선을 밀어붙이지 않도록 설계됐다. 생물 연구와 공격적 사이버 보안 모두에서 상위 모델 미소스 5보다 뒤처지도록 의도적으로 조정됐고, 사이버 과제는 아예 학습에서 배제했다. 오퍼스 5는 취약점을 '찾는' 능력은 미소스 5에 근접했지만, 이를 실제 위협으로 바꾸는 '익스플로잇 개발'에서는 크게 뒤처진다.

사이버 분류기는 페이블 5보다 완화돼, 소스코드 취약점 탐색은 허용하되 바이너리 기반 스캔·침투 테스트·익스플로잇 생성은 차단한다. 앤트로픽은 분류기 개입 빈도가 페이블 5 대비 약 85% 낮을 것으로 추정하며, Claude.ai·Claude Code·Claude Cowork에서 차단된 요청은 기본적으로 오퍼스 4.8로 폴백된다.

함께 풀린 베타 기능

출시와 함께 두 가지 베타 기능도 열렸다. 하나는 대화 도중 사용할 수 있는 도구 목록을 바꿔도 프롬프트 캐시를 무효화하지 않는 '대화 중 도구 변경'이고, 다른 하나는 안전 분류기에 걸린 요청을 차단 대신 다른 모델로 자동 라우팅하는 'API 자동 폴백'이다. 후자를 켜면 요청이 막히는 대신 항상 이용 가능한 최선의 모델로 흘러간다.

의미와 전망

오퍼스 5의 진짜 메시지는 벤치마크 숫자보다 가격표에 있다. 최상위급 지능을 최상위급 요금이 아니라 '일상 요금'에 묶으면서, 앤트로픽은 프론티어 모델을 특별한 순간이 아닌 매일의 기본값으로 밀어넣으려 한다. 오퍼스 4.8과 같은 가격에 성능만 크게 올린 구조는, 경쟁이 격화된 프론티어 시장에서 '동일 비용·상위 성능'을 압박 카드로 쓰겠다는 신호이기도 하다.

  • 클로드 오퍼스 5, 7월 24일 전 플랫폼 출시 — 페이블 5급 지능을 절반 가격($5/$25 입력·출력)에 제공.
  • 프론티어벤치·GDPval-AA 등 코딩·지식노동 벤치마크 새 최고점, ARC-AGI 3에서 차순위의 약 3배.
  • 자동 행동 감사에서 '역대 가장 정렬된 모델'(오정렬 2.3), 사이버·생물 위험 역량은 미소스 5보다 낮게 설계.
  • 패스트 모드(2.5배 속도·2배 가격), 대화 중 도구 변경·API 자동 폴백 베타 동시 출시.
관련 자료 · 공식 출처
앤트로픽 공식 발표 — Introducing Claude Opus 5
클로드 오퍼스 5 시스템 카드
클로드 오퍼스 5 프롬프팅 가이드 (Claude Platform 공식 문서)