Anthropic, Claude Opus 5.5 공개…평균 비용 40% 낮춰

디플릭 Editorial

🗓️ 2026.09.29

⏱️ 4분

Hero Image
©Anthropic

AI 에이전트가 사람의 지시를 한 번 받고 긴 작업을 이어가는 일이 늘수록, 모델 평가는 정답률만으로 끝나지 않습니다. 중간에 실패했을 때 얼마나 빨리 알아차릴 수 있는지와, 긴 실행을 감당할 비용이 함께 중요해집니다.

Anthropic은 9월 22일 Claude Opus 5.5를 공개하며 이 두 조건을 동시에 내세웠습니다. 복잡한 업무와 코딩 작업의 성능을 높이는 한편, Opus 5보다 평균 40% 낮은 비용을 제시했습니다.

Opus 5.5, 평균 비용 40% 절감

Hero Image
© AI Image

Anthropic은 Opus 5.5를 새 Claude 5.5 제품군의 첫 모델로 소개했습니다. 회사는 외부 평가자를 통한 출시 전 테스트와 자체 행동 감사를 거쳤다고 밝혔습니다.

발표에는 초기 사용자가 약 68만 줄 규모의 코드 마이그레이션을 하루 이내에 마쳤다는 사례도 담겼습니다. 이는 Anthropic이 소개한 개별 사례이며 모든 작업에서 같은 속도를 보장하지는 않습니다.

Opus 5.5는 여러 번의 도구 호출과 중간 판단이 필요한 장기 작업을 겨냥합니다. 긴 작업에서는 현재 단계, 변경한 파일, 실패 지점을 기록해야 결과를 확인하고 다시 시작할 수 있습니다.

장시간 코딩 작업과 도구 호출 강화

Hero Image
© AI Image

장시간 에이전트의 비용이 낮아지면 제품은 더 큰 작업 단위를 자동화하려 합니다. 하지만 여러 파일과 도구를 넘나드는 작업은 작은 오류가 누적될 때 결과를 되돌리기 어려워질 수 있습니다.

따라서 제품에서 중요한 질문은 모델이 얼마나 오래 혼자 일할 수 있는지가 아닙니다. 어느 시점에 초안, 변경 사항, 권한 요청을 사람에게 보여줄지와 실패 신호를 어떻게 남길지가 함께 설계돼야 합니다.

비용이 낮아졌다는 정보는 더 많은 시도를 가능하게 하지만, 긴 작업의 모든 비용이 줄었다는 뜻은 아닙니다. 모델 호출 뒤에 사람이 확인하고 수정하는 시간이 남는다면, 제품은 그 과정까지 함께 줄일 방법을 찾아야 합니다.

긴 작업에는 중간 기록과 복구 기능 필요

Hero Image
© AI Image

모델이 여러 시간 동안 코드를 수정한다면 사용자는 변경한 파일과 실행한 명령, 실패한 단계를 확인할 수 있어야 합니다. 중간 저장과 재시작 기능이 있으면 처음부터 작업을 반복하는 비용도 줄어듭니다.

비용 절감도 토큰 가격만으로 평가할 수 없습니다. 검토, 재시도, 권한 관리에 드는 시간을 함께 기록해야 어떤 과업을 더 맡기고 어떤 과업은 사람에게 남길지 현실적인 기준을 세울 수 있습니다.

장기 실행 에이전트*의 품질은 한 번의 성공 사례보다 반복 가능한 운영 방식에서 드러납니다. 시작 전 목표와 권한을 확인하고, 진행 중 중간 산출물을 남기며, 종료 뒤 변경 범위를 요약하는 흐름이 기본이 되어야 합니다.

이 기준이 있어야 장기 실행의 성능이 실제 업무의 신뢰로 이어질 수 있습니다.

D.Flick Perspective

D.Flick Note

Opus 5.5는 Opus 5보다 평균 비용을 40% 낮추고 장시간 코딩 작업을 강화했습니다. 실제 도입에서는 작업 기록과 중간 저장, 실패 후 재시작 기능을 함께 확인해야 합니다.

References

  • 장기 실행 에이전트: 여러 단계의 도구 사용과 판단을 거쳐 비교적 긴 시간 동안 과업을 수행하는 AI 시스템입니다.



다양한 아티클을 확인해보세요