뉴스 AI 뉴스

Claude Sonnet 5.5, 오퍼스 절반 가격에 코딩 에이전트 점수는 더 높았다

EVUELA 2026년 09월 29일 26회 1시간 전
Claude Sonnet 5.5, 오퍼스 절반 가격에 코딩 에이전트 점수는 더 높았다

앤트로픽이 2026년 9월 28일 Claude Sonnet 5.5를 내놓았습니다. 소네트는 앤트로픽 모델 중 가운데 등급으로, 일상적인 코딩·문서 작업에 가장 많이 쓰이는 모델입니다. 결론부터 말하면 가격은 소네트 5와 같고, 속도는 30% 넘게 빨라졌다고 발표했습니다. 제작사가 공개한 코딩 에이전트 점수(Terminal-Bench 4.0)에서는 가격이 두 배인 Opus 5.5보다도 높았습니다. 이 글의 성능 수치는 모두 앤트로픽이 직접 발표한 값이고, 저희가 잰 값이 아닙니다.

한눈에 보기

항목내용
출시일2026년 9월 28일
API 모델 이름claude-sonnet-5-5
가격 (100만 토큰당)입력 $2, 출력 $10, 캐시 읽기 $0.20, 캐시 쓰기 $2.50
쓸 수 있는 곳Claude.ai와 Claude 앱, Claude API, AWS, Google Cloud, Microsoft Azure
제작사가 밝힌 개선소네트 5보다 출력 속도 30% 이상 빠름, 작업 하나의 비용 최대 30% 감소

토큰 가격은 소네트 5와 그대로입니다. 그런데도 "작업 비용이 최대 30% 줄었다"고 한 것은, 같은 일을 끝내는 데 토큰과 도구 호출을 덜 쓰기 때문이라고 앤트로픽은 설명합니다. 즉 가격표가 아니라 일하는 방식이 바뀌어서 싸진 것입니다.

무엇이 달라졌나

  • 속도와 효율: 소네트 5보다 출력이 30% 넘게 빠르고, 같은 일을 하는 데 토큰을 훨씬 적게 쓴다고 밝혔습니다. 초기 사용자들은 코드베이스를 빨리 파악하고 도구 호출을 한꺼번에 묶어 처리한다고 평가했습니다.
  • 글쓰기와 디자인: 이전 세대보다 글을 더 명확하게 쓰고, 화면(UI)을 다듬는 디자인 감각이 좋아졌다고 합니다. 문서·슬라이드·스프레드시트를 템플릿에 맞춰 만들어, 손볼 곳이 적다고 소개했습니다.
  • 생각 정도 조절: 사용자가 노력 수준(effort)을 고를 수 있습니다. 낮게 두면 간단한 작업을 빨리 끝내고, 높게 두면 더 길게 생각하고 스스로 검토합니다.

제작사가 발표한 벤치마크

앤트로픽 발표 페이지에 실린 점수입니다. 같은 가격대인 GPT-6 Sol 점수도 앤트로픽이 함께 적었습니다. 빈칸(-)은 발표에 값이 없는 항목입니다.

벤치마크 (무엇을 보나)Sonnet 5.5Sonnet 5Opus 5.5GPT-6 Sol
Terminal-Bench 4.0 (터미널에서 일하는 코딩 에이전트)70.6%10.3%66.4%-
FrontierCode 1.1 Main (어려운 코딩)46.2%42.4%54.4%49.3%
CursorBench 4.0 (코드 편집기 안 작업)55.5%34.1%57.8%-
OSWorld 2.1 (컴퓨터 화면 조작)80.1%57.0%81.8%-
Humanity's Last Exam, 도구 사용 (어려운 지식 문제)64.5%54.9%67.7%-
Chartography, 도구 없음 (차트 읽기)61.6%15.6%64.4%53.6%
GDPval-AA v2.1 (실무 작업, 점수)1844144918461487

이 표가 뜻하는 것은 두 가지입니다. 첫째, 대부분의 항목에서 Opus 5.5에 거의 붙었고, 터미널 코딩 에이전트 점수는 오히려 앞섰습니다. 둘째, 가장 어려운 코딩(FrontierCode)에서는 Opus 5.5와 GPT-6 Sol보다 낮았습니다. 소네트 5의 Terminal-Bench 점수(10.3%)가 유난히 낮은데, 앤트로픽 발표 그대로 옮긴 값입니다. 모두 제작사 측정이라 다른 기관의 검증은 아직 없습니다.

가격 비교: 같은 가격의 GPT-6 Sol, 두 배인 Opus 5.5

지난 API 가격 비교 글에 소네트 5.5를 더했습니다. 모두 100만 토큰당 공식 가격입니다.

모델입력출력캐시 읽기
Claude Sonnet 5.5$2$10$0.20
Claude Opus 5.5$4$20$0.20
GPT-6 Sol$2$10$0.20
GPT-6 Luna$0.10$0.50$0.01

소네트 5.5는 GPT-6 Sol과 토큰 가격이 완전히 같고, Opus 5.5의 절반입니다. 같은 가격이라면 실제 비용은 작업 하나에 토큰을 얼마나 쓰느냐로 갈립니다. 앤트로픽이 토큰 효율을 강조한 이유도 여기에 있습니다. 가격만 보고 고르기보다, 자주 하는 작업을 두 모델에 한 번씩 맡겨 청구된 비용을 비교해 보는 편이 정확합니다.

안전장치: 사이버 보안 요청은 소네트 5로 넘어간다

소네트 5.5는 소네트 가운데 처음으로 최상위 모델급 사이버 보안 안전장치를 달고 나왔습니다. 앤트로픽은 이 모델의 사이버 보안 능력이 상위 모델과 비슷해졌다고 보고, Opus 5.5와 비슷한 안전장치를 적용했습니다.

  • 위험도가 높은 사이버 보안 작업은 소네트 5로 넘겨 처리하고, 넘겼다는 사실이 보입니다. 평범한 디버깅은 영향을 받지 않는다고 밝혔습니다.
  • 보안 업무에 더 넓게 써야 한다면 앤트로픽의 사이버 검증 프로그램(Cyber Verification Program)에 신청할 수 있습니다.
  • 모델의 생각 과정을 빼내 다른 모델 학습에 쓰는 것(증류)을 막는 분류기도 소네트 중 처음 들어갔습니다.
  • 생물학 관련 안전장치는 소네트 5와 같습니다. 정렬(alignment) 시험은 약 1,850개 상황에서 했다고 밝혔습니다.

API로 옮길 때 확인할 것

모델 이름을 claude-sonnet-5-5로 바꾸면 됩니다. 다만 앤트로픽은 생각(thinking)을 끄고 쓰던 개발자는 소네트 5.5로 옮기기 전에 새 설정인 between_tools로 바꿔야 한다고 안내했습니다. 자세한 방법은 앤트로픽의 이전 안내 문서에 있습니다.

로컬 AI와 비교하면

이 블로그에서는 집 PC로 돌리는 모델도 함께 재고 있습니다. 같은 날 RTX 5090에서 잰 Qwen3.8 27B는 API 비용이 들지 않는 대신, VRAM이 약 19.7GB 필요했고 생각 설정을 잘못 두면 답을 내지 못했습니다. 코딩 에이전트처럼 긴 작업을 맡길 때는 소네트 5.5 같은 API 모델이 여전히 편하고, 짧은 질문이나 민감한 문서는 로컬 모델이 알맞습니다. 내 그래픽카드로 어떤 모델이 돌아가는지는 GPU 체험에서 확인할 수 있습니다.

정리

  • 가격은 그대로, 속도는 30% 이상 빨라졌다고 발표했습니다. 100만 토큰당 입력 $2, 출력 $10입니다.
  • 비용 절감은 토큰을 덜 써서 생깁니다. 작업 하나의 비용이 최대 30% 줄었다는 것이 앤트로픽 설명입니다.
  • 제작사 벤치마크로는 Opus 5.5에 거의 붙었습니다. 터미널 코딩 에이전트 점수는 70.6%로 Opus 5.5(66.4%)보다 높았고, 가장 어려운 코딩 점수는 낮았습니다.
  • 보안 관련 요청은 막히거나 소네트 5로 넘어갈 수 있습니다. 보안 업무에 쓴다면 이 점을 먼저 확인하세요.

이전 소네트·오퍼스 세대의 흐름은 Claude Opus 5 출시 글에서 볼 수 있습니다. (출처: 앤트로픽 Claude Sonnet 5.5 발표, SiliconANGLE, VentureBeat)

자주 묻는 질문

Claude Sonnet 5.5 가격은 얼마인가요?

100만 토큰당 입력 $2, 출력 $10, 캐시 읽기 $0.20, 캐시 쓰기 $2.50입니다. 소네트 5와 같은 가격이고, Opus 5.5(입력 $4, 출력 $20)의 절반입니다.

Sonnet 5.5는 Opus 5.5보다 좋은가요?

앤트로픽 발표 기준으로 터미널 코딩 에이전트 점수(Terminal-Bench 4.0)는 Sonnet 5.5가 70.6%로 Opus 5.5(66.4%)보다 높았습니다. 하지만 어려운 코딩(FrontierCode 1.1), 화면 조작(OSWorld 2.1), 지식 문제(Humanity's Last Exam)에서는 Opus 5.5가 조금 더 높았습니다. 모두 제작사가 잰 값입니다.

Sonnet 5.5는 어디에서 쓸 수 있나요?

Claude.ai와 Claude 앱, Claude API(claude-sonnet-5-5), 그리고 AWS, Google Cloud, Microsoft Azure에서 쓸 수 있습니다.

보안 관련 질문을 하면 왜 소네트 5가 답하나요?

Sonnet 5.5에는 최상위 모델급 사이버 보안 안전장치가 들어 있어서, 위험도가 높은 사이버 보안 작업은 소네트 5로 넘겨 처리합니다. 넘겼다는 사실은 화면에 보입니다. 보안 업무에 더 넓게 써야 한다면 앤트로픽의 사이버 검증 프로그램에 신청할 수 있습니다.

관련 게시글

댓글 0개