무엇이 바뀌었나

앤트로픽이 9월 22일 Claude Opus 5.5를 공개했다. 새 Claude 5.5 제품군의 첫 모델로 여러 단계에 걸쳐 진행되는 코딩과 지식 업무를 주요 용도로 내세운다. 회사는 대부분의 업무에서 Claude Fable 5.1 수준의 성능을 제공하면서 Opus 5보다 일반적인 작업 비용은 40% 낮아졌다고 설명했다.

Claude Opus 5.5를 상징하는 코딩·연구 에이전트 일러스트

Opus 5.5의 초점은 짧은 질문에 빠르게 답하는 데 있기보다 큰 코드베이스를 살피고 여러 파일을 수정하거나 자료를 조사해 결과물까지 만드는 긴 작업에 있다. 앤트로픽은 초기 사용자가 68만 줄 규모의 코드 마이그레이션을 하루 안에 끝냈고 20만 줄 코드베이스의 감사와 수정은 3시간 안에 마쳤다고 소개했다. 후자의 작업은 Opus 5에서 20시간 넘게 걸렸다는 비교도 함께 공개했다.

왜 지금 중요한가

AI 에이전트가 한 번의 응답을 넘어 코드와 문서, 업무 도구를 오가며 일하기 시작하면서 모델의 작업당 비용이 중요해지고 있다. 출력 토큰 단가뿐 아니라 같은 문맥을 반복해서 읽는 비용, 작업에 걸리는 시간, 사람이 중간에 다시 지시해야 하는 횟수도 실제 운영비를 좌우한다.

앤스로픽은 Opus 5.5의 기본 설정에서 출력 속도가 Opus 5보다 30% 이상 빠르며 일반적인 작업 비용은 40% 낮다고 밝혔다. 이 절감률은 회사가 말하는 일반 작업을 기준으로 한 것이므로 모든 요청에서 비용이 동일한 비율로 줄어든다는 뜻은 아니다.

실제 사용 방식과 작동 원리

개발자는 저장소 전체의 성능 병목을 찾아 수정하고 테스트를 실행해 동작이 바뀌지 않았는지 확인하는 작업을 맡길 수 있다. 앤스로픽은 웹 애플리케이션의 페이지 로딩 시간을 줄이는 내부 시험에서 Opus 5.5가 40회 중 39회 성공했다고 보고했다. 보고서 작성 시험에서는 웹 자료를 바탕으로 작성한 18건 중 16건이 수치와 인용의 정확성 기준을 통과했다고 밝혔다.

이런 사례는 모델이 여러 단계의 분석과 도구 호출을 이어 가는 방식의 가능성을 보여준다. 그러나 공개된 결과는 앤스로픽이 수행하거나 초기 사용자에게서 수집한 평가다. 실제 조직의 코드 품질, 테스트 구성, 자료 접근성에 따라 결과와 작업 시간이 달라질 수 있다.

Opus 5와 비교하면

API 표준 가격은 입력 토큰 100만 개당 4달러, 출력 토큰 100만 개당 20달러다. Opus 5의 입력 5달러, 출력 25달러보다 각각 20% 낮다. 캐시 읽기는 100만 토큰당 0.20달러로 책정됐다. 배치 처리는 표준 가격의 절반이다. 캐시와 배치 여부, 요청 길이와 모델이 생성하는 토큰 수에 따라 실제 청구액은 달라진다. 세부 요금과 기능은 플랫폼 문서를 참고할 수 있다.

성능 면에서 앤스로픽은 에이전트 코딩, 컴퓨터 사용, 지식 업무 평가에서 Opus 5.5가 자사 모델과 여러 경쟁 모델보다 앞선다고 발표했다. 회사 스스로도 이 수준의 벤치마크 점수는 실제 업무 차이를 완벽하게 설명하지 못한다고 덧붙였다. 도입을 결정할 때는 공개 점수보다 실제 작업에서 완료율, 재시도 횟수, 토큰 사용량을 비교하는 편이 유용하다.

안전장치와 사용 범위

앤스로픽은 Opus 5.5가 자사 자동 행동 평가에서 지금까지 시험한 모델 중 가장 좋은 결과를 냈고 Opus 5보다 프롬프트 인젝션에 강해졌다고 밝혔다. 되돌리기 어려운 행동을 하거나 정해진 작업 범위를 벗어나는 가능성도 낮췄다는 설명이다.

한편 생물학과 사이버 보안 분야의 역량이 크게 향상돼 관련 안전장치도 강화됐다. 일반적인 소프트웨어 개발과 코드 버그 수정은 가능하지만 다수의 사이버 보안 요청은 다른 모델로 전달될 수 있다. 생명과학 연구에서 안전장치가 작업을 제한하는 기관은 앤스로픽의 검증 프로그램을 신청해야 할 수 있다.

사용자·개발자·기업에 미치는 영향

개발자에게 Opus 5.5는 코드베이스 단위의 마이그레이션, 코드 리뷰, 성능 개선처럼 여러 차례 읽고 고치는 작업을 낮은 비용으로 시도할 기회를 준다. 기업의 지식 업무에서는 여러 자료를 수집해 숫자를 교차 확인하고 보고서나 재무 분석 초안을 만드는 데 활용할 수 있다.

현재 API 모델 ID는 claude-opus-5-5다. Claude API 외에도 Amazon Bedrock, Google Cloud, Microsoft Foundry에서 사용할 수 있다. 기존 Opus 5 API 통합을 마이그레이션할 때는 추론 설정이 항상 활성화되는 점, 도구 호출 사이 진행 상황 메시지의 반환 형식, 컴퓨터 사용 도구의 호환성 변경을 확인해야 한다.

한계와 주의할 점

장시간 작업을 맡길 수 있다는 점은 편리하지만 잘못된 가정도 여러 단계에 걸쳐 누적될 수 있다. 저장소 전체 수정이나 재무 분석처럼 결과에 영향이 큰 작업은 변경 내역과 출처를 확인하고 실제 반영 전 승인 단계를 두는 편이 안전하다.

또한 가격 인하가 모든 사용자의 지출 감소로 이어지는 것은 아니다. 높은 추론 수준을 오래 사용하거나 출력이 길어지면 총비용이 커질 수 있다. 현재 프롬프트와 도구 구성을 그대로 옮기기보다 대표적인 작업으로 Opus 5와 Opus 5.5를 나란히 비교할 필요가 있다.

앞으로의 관전 포인트

첫째는 공개된 대규모 코드 작업 사례가 다양한 실제 저장소에서도 재현되는지다. 마이그레이션의 완료 여부뿐 아니라 테스트 품질, 수정 범위, 검토자가 손봐야 하는 분량이 중요하다. 둘째는 입력 단가 인하와 캐시 개선이 실제 장기 에이전트 운영비를 얼마나 줄이는지다.

안전장치가 생물학·사이버 보안처럼 민감한 업무에서 어떤 요청을 허용하고 어디서 다른 모델로 넘기는지도 지켜볼 만하다. 고성능 모델을 도입하는 조직에는 모델 선택과 함께 작업 권한, 승인 절차, 오류 복구 방식을 설계하는 일이 계속 중요하다.

자주 묻는 질문

Claude Opus 5.5는 언제 공개됐나요?

앤스로픽은 2026년 9월 22일 Claude Opus 5.5를 공개했다. 새 Claude 5.5 제품군의 첫 모델이다.

Opus 5.5 API 가격은 얼마인가요?

표준 가격은 입력 토큰 100만 개당 4달러, 출력 토큰 100만 개당 20달러다. 캐시 읽기와 배치 처리, 긴 입력에는 별도 요금 조건이 적용될 수 있다.

Opus 5.5는 코딩 전용 모델인가요?

아니다. 코딩과 에이전트 작업에 강점을 두지만 자료 조사, 문서 작성, 재무 분석 등 지식 업무도 대상으로 한다. PDF와 이미지 입력, 도구 호출도 지원한다.

Opus 5.5를 기존 API 코드에서 바로 쓸 수 있나요?

모델 ID를 claude-opus-5-5로 바꾸는 것만으로 끝나지 않을 수 있다. 추론 설정 방식과 도구 호출 응답 구조, 컴퓨터 사용 도구의 변경 사항을 플랫폼 문서에서 확인해야 한다.

사이버 보안 업무에도 사용할 수 있나요?

일반적인 소프트웨어 개발과 버그 수정은 지원하지만 여러 사이버 보안 요청에는 안전장치가 적용되고 다른 모델로 전달될 수 있다. 전문 방어 업무의 접근 조건은 앤스로픽의 검증 프로그램을 확인해야 한다.

한눈에 정리

Claude Opus 5.5는 코딩과 지식 업무를 길게 이어 가는 에이전트 작업을 겨냥한 앤스로픽의 새 최상위 모델이다. Opus 5보다 API 입력·출력 단가가 각각 20% 낮고 앤스로픽은 일반 작업 비용이 40% 줄었다고 설명한다.

대규모 코드 수정이나 조사 업무에서 기대를 모으지만 공개 성과는 실제 환경에서 다시 확인해야 한다. 도입할 때는 대표 작업의 완료율과 검토 시간, 재시도 및 토큰 비용을 함께 비교하고 민감한 작업에는 권한과 승인 절차를 설정하는 것이 좋다.