앤스로픽(Anthropic)이 자사 신형 인공지능 모델 '오퍼스 5.5(Opus 5.5)'를 출시했다고 IT전문매체인 테크크런치가 22일(화) 보도했다. 회사 측에 따르면 이 모델은 코딩과 지식노동 작업 성능에서 새로운 최고 수준을 기록했다.
오퍼스는 앤스로픽의 3단계 클로드(Claude) 제품군 가운데 가장 성능이 뛰어나고 가격도 비싼 최상위 등급이다. 중간 등급은 소네트(Sonnet), 가장 빠르고 저렴한 등급은 하이쿠(Haiku)가 맡고 있다. 앤스로픽은 이번 오퍼스 5.5가 자사의 더 큰 모델인 페이블(Fable)보다 다수의 벤치마크에서 앞섰으며, 페이블이 완수하지 못한 여러 비공식 과제도 성공적으로 처리했다고 밝혔다.
가격 면에서도 눈에 띄는 변화가 있다. 오퍼스 5.5의 출력 토큰 요금은 100만 토큰당 20달러로, 이전 모델의 25달러보다 낮아졌다. 다른 과금 항목들도 비슷한 폭으로 인하됐다. 서비스에 필요한 연산량이 전반적으로 줄어들면서 모델 실행 속도 역시 빨라졌다고 회사는 설명했다.
이번 신모델은 소통 방식에서도 상당한 변화를 보인다. 오퍼스 5.5는 전문용어 사용 빈도가 줄었고, 메시지 서두에 핵심 정보를 배치하는 경향이 강해졌다.
이번 출시는 지난 7월 24일 공개된 오퍼스 5 이후 불과 두 달 만에 이뤄졌다. 앤스로픽은 공식 발표를 통해 제품군의 다음 등급인 소네트 5.5와 하이쿠 5.5도 "향후 수 주 내"에 출시할 예정이며, 유사한 수준의 성능 개선이 이뤄질 것이라고 밝혔다.
한편 앤스로픽은 오퍼스 5.5가 생물학 및 사이버보안 능력 면에서 자사의 미토스(Mythos) 모델과 유사한 수준이라고 밝히며, 이에 따라 페이블 모델과 동일한 수준의 안전장치를 적용받는다고 설명했다. 이 안전장치는 컴파일된 프로그램에서 취약점을 찾아내거나 식별 가능한 생물무기를 개발하는 데 모델이 악용되는 것을 제한하는 등의 조치를 포함한다.
오퍼스 5.5는 다리오 아모데이(Dario Amodei) 앤스로픽 최고경영자(CEO)가 이른바 '최전선 속도 조절(pace the frontier)' 요구를 받아들인 이후 처음 나온 모델 출시이기도 하다. 아모데이는 AI 역량 발전 속도를 의도적으로 늦춰 정합성(alignment) 연구 속도에 맞추겠다는 입장을 밝힌 바 있다. 그는 이달 초 게시한 글에서 "위험을 완전히 해결하려면 더 큰 신중함이 필요하다는 확신이 들었다"며 "위험 예방에 투자하는 것뿐 아니라, 위험 예방이 따라잡을 시간을 가질 수 있도록 역량 발전 속도 자체를 조절해야 한다"고 밝혔다.
오퍼스 5.5의 안전성 훈련 체계는 정합성 테스트와 METR, 프런티어 디자인(Frontier Design) 등 외부 기관의 출시 전 평가를 거쳤다는 점에서 이전 모델들과 대체로 유사한 방식을 따랐다. 다만 앤스로픽은 향후 출시될 모델들을 위해 개선된 보안·모니터링 체계를 포함한 더 진전된 훈련 및 평가 시스템을 이미 준비 중이라고 강조했다.
앤스로픽은 공식 블로그 게시물을 통해 "AI가 더 유능해질수록 사람들이 의존하는 시스템의 안전을 보장하는 데 있어 공공정책이 더 큰 역할을 해야 한다"며 "그런 역량을 갖추는 데는 시간이 걸리며, 우리는 이를 뒷받침할 인프라를 구축하기 시작했다"고 밝혔다. 이어 "이러한 노력에 대한 세부 내용을 조만간 더 공유할 예정"이라고 덧붙였다.







