앤트로픽이 9월 22일(현지시간) Claude 5.5 계열의 첫 모델인 Claude Opus 5.5를 공개했다. 회사는 대부분의 작업에서 Claude Fable 5.1과 비슷한 성능을 낸다고 설명했다. 이번 변화의 핵심은 긴 작업을 처리하는 효율이다. 코딩이나 스스로 일을 처리하는 AI(에이전트) 작업에서 이전 모델보다 적은 분량의 글을 처리한다. 답을 내놓는 속도도 높였다는 설명이다.
30% 빨라진 속도, 어디까지 빨라지나
Claude Opus 5.5는 작업에 따라 생각하는 데 들이는 노력을 스스로 조절한다. 다만 이 기능을 완전히 끄고 쓸 수는 없다. 앤트로픽은 답을 만들어 내는 속도가 Opus 5보다 30% 이상 빠르다고 밝혔다. 이는 답변이 나오는 속도에 관한 수치다. 긴 업무 하나가 처음부터 끝까지 얼마나 빨리 끝나는지는 실제로 써 보며 따로 살펴봐야 한다.
회사가 직접 잰 성능 시험에서도 이전 모델보다 점수가 올랐다. Terminal-Bench 4.0에서는 66.4%를 기록해 Opus 5의 52.3%보다 14.1%포인트 높았다. GDPval-AA v2.1 점수는 1708에서 1846 Elo로 올랐다. 모두 발표에 명시된 조건에서 얻은 결과다. 업무에 적용할 때는 이 점수와 함께 자신이 맡길 작업의 완성도를 직접 확인하는 편이 좋다.
비용 40% 절감, 내 요금도 그만큼 줄까
앤트로픽은 일반적인 작업의 총비용이 Opus 5보다 약 40% 낮다고 추정했다. 일부 매체는 이를 가격 인하로 부각했다. 하지만 공식 설명의 기준은 작업 하나에 드는 총비용이다. 모델이 처리하는 글의 분량이 줄어드는 효과까지 포함한 수치다. 모든 이용자의 청구액이 일률적으로 40% 줄어든다는 뜻은 아니다.
개발자가 서비스에 붙여 쓰는 기본 요금은 입력 100만 토큰당 4달러, 출력 100만 토큰당 20달러다. 토큰은 글을 잘게 나눈 조각 단위로, 요금을 매기는 기준이다. 저장해 둔 입력을 다시 읽을 때는 100만 토큰당 0.20달러다. 속도를 최대 2.5배까지 올리는 Fast 모드는 입력 100만 토큰당 8달러, 출력 100만 토큰당 40달러다. 속도와 비용을 함께 따져 고르면 된다.
어디서 바로 쓸 수 있나
쓰던 도구에서 새 모델을 바로 부를 수 있게 하는 작업도 이어졌다. 앤트로픽의 코딩 도구 Claude Code는 새 버전에서 Claude Opus 5.5를 기본 Opus 모델로 채택했다. AI 앱을 만드는 도구인 LangChain을 비롯한 외부 도구에도 새 모델 정보가 추가됐다.
발표 시점부터 Claude의 Pro, Max, Team, Enterprise 요금제에서 쓸 수 있다. Claude Platform과 개발자용 연결 방식 외에 아마존웹서비스(AWS), 구글 클라우드, 마이크로소프트 Azure에도 공급된다. AWS는 Amazon Bedrock과 자사 클라우드의 Claude Platform에서 이용할 수 있다고 따로 밝혔다. 개인용 앱과 기업용 클라우드 양쪽으로 이용 경로를 넓힌 셈이다.
그래서 믿고 써도 될까
점수가 올랐다고 모든 용도에서 결과가 좋아지는 것은 아니다. 더 디코더는 앤트로픽 직원의 설명을 소개하며, 기술 작업에 맞춘 최적화가 사람이 읽는 글을 지나치게 빽빽하게 만들 수 있다고 전했다. 국내 매체 AI타임스는 활용 가이드 보도에서 프롬프트, 즉 AI에게 주는 지시문에 목표와 완료 조건을 분명히 적으라고 강조했다. 점수뿐 아니라 결과물이 읽기 쉬운지, 지시를 제대로 내렸는지도 함께 봐야 한다는 뜻이다.
쓸 수 있는 범위에도 제한이 있다. 대부분의 사이버보안 작업은 Opus 4.8로 넘어간다. 생명과학 연구를 위한 폭넓은 접근은 검증된 기관이 따로 신청해야 한다. 앤트로픽은 출시 전 평가만으로 실제 환경의 모든 실패를 찾아낼 수는 없다고 밝혔다. 이번 공개의 의미는 긴 작업의 성능, 속도, 비용을 한꺼번에 개선하려 했다는 데 있다. 국내 이용자가 앞으로 확인할 지점은 한국어 업무의 결과 품질과 작업 하나당 실제 비용이다.
