
인공지능(AI) 모델 시장의 경쟁 축이 순수 지능 대결에서 실질적인 '운영 가성비'와 '에이전트 실행 효율'로 빠르게 옮겨가고 있다. 개발 현장에서 대규모 코드베이스를 다루거나 장시간 연속 작동하는 에이전틱 워크플로가 일반화되면서, 천문학적으로 치솟는 토큰 비용과 지연 시간이 기업들의 걸림돌로 떠올랐기 때문이다.
앤트로픽이 Claude 5.5 제품군의 첫 시작을 알리는 플래그십 모델 ‘Claude Opus 5.5’를 전격 공개했다. 기존 최상위 플래그십이었던 Opus 5보다 전반적인 운영 비용을 40%나 줄이면서도 대부분의 고난도 작업에서 Claude Fable 5.1 수준의 강력한 성능을 내도록 설계된 모델이다.
가격 구조부터 대폭 개편됐다. Standard 설정 기준 토큰 단가는 100만 개당 입력 4달러, 출력 20달러로 책정되어 Opus 5 대비 각각 20% 낮아졌다. 특히 복잡한 코드베이스 전체를 올려두고 반복 조율해야 하는 에이전트 작업에서 비용의 가장 큰 비중을 차지하는 '캐시 읽기(Cache read)' 요금을 100만 토큰당 0.20달러로 60% 떨어뜨렸다. 기본 설정에서 보여주는 출력 생성 속도도 Opus 5보다 30% 이상 빠르다.
실시간성이 중요한 작업이나 대화형 개발 환경을 고려한 'Fast mode'도 선보였다. Claude Code와 Claude Platform에서 최대 2.5배 빠른 처리 속도를 제공하는 모드로, 100만 토큰당 입력 8달러, 출력 40달러 수준이다. 이와 함께 앤트로픽은 Pro, Max, Team, 그리고 좌석 기반 Enterprise 요금제 사용자의 5시간당 이용 한도를 일괄 늘려 기업 고객의 작업 연속성을 보장하기로 했다.
개발 현장 중심의 성능 개선 수치도 눈길을 끈다. 수십만 줄 규모의 거대 프로젝트를 한 번에 검토하고 수정하는 장시간 코드베이스 마이그레이션과 오디팅 작업이 핵심 사용처로 꼽힌다. 초기 비공개 테스트에서는 20만 줄 분량의 시스템 코드베이스 전체를 오직 3시간 이내에 완전히 감사하고 수정해 내는 성과를 보였다. 이전 모델인 Opus 5가 동일한 작업에 20시간 이상을 소요하며 2.5배 이상의 토큰을 소모했던 점을 감안하면 격차가 크다.
실제 C 언어로 작성된 HAProxy 핵심 모듈을 Rust로 리팩토링해 재구축하는 내부 시험에서도 확연한 차이가 드러났다. Opus 5.5는 작업 완성까지 9.5시간이 걸린 반면 Fable 5.1은 12시간이 소요됐으며, 전체 소모 비용 면에서 Opus 5.5가 51% 절감된 결과를 나타냈다.
보안과 정렬(Alignment) 안전장치도 한층 촘촘해졌다. 각 동작이 실행되기 직전 위협 요소를 감지하고 통제하는 내부 분류기(Classifier)를 전면 배치하는 한편, 보안 전담 팀이 상시 감사할 수 있는 오픈소스 샌드박스 환경과 시스템 병합 전 취약점을 식별하는 자동 코드 리뷰 체계를 구축했다.
약 2천여 개 우회 및 공격 시나리오로 구성된 자체 자동 행동 감사 결과, 최근 출시된 Claude 제품군 중 대부분의 부적절·부정렬 행동 지표에서 가장 높은 안전 점수를 기록했다는 게 회사의 설명이다. 배포 전 외부 검증 단계에서는 프론티어 디자인(Frontier Design), METR 등 저명한 외부 안전 평가 기관의 종합 테스트 역시 통과했다.
새로운 모델은 Claude Platform API와 개발자 도구인 Claude Code를 통해 곧바로 이용할 수 있다. 단, 민감도가 높은 생물학 연구 분야 활용의 경우 '라이프 사이언스 검증 프로그램(Life Sciences Verification Program)'을 거쳐 검증을 완료한 기관에 한해 승인된 절차로만 제공된다. 회사는 수주 내에 사이버 보안 검증 프로그램(Cyber Verification Program) 접근권도 순차 확대한다는 방침이다. 후속 라인업인 Claude Sonnet 5.5와 Claude Haiku 5.5 역시 수주 안에 차례로 시장에 모습을 드러낼 예정이다.





