에이전트 코딩 · 2026년 7월 25일 ★★★★★

앤트로픽이 클로드 오푸스 5를 내놨어요 — 값은 그대로, 컨텍스트 100만 토큰이 기본이에요

앤트로픽이 7월 24일 클로드 오푸스 5(claude-opus-5)를 공개했어요. 100만 토큰 컨텍스트가 기본이자 최대이고 20만 토큰을 넘겨도 추가 요금이 붙지 않으며, 값은 100만 토큰당 입력 5달러·출력 25달러로 이전 오푸스 4.8과 같고 페이블 5(10달러·50달러)의 절반이에요. 다만 독립 측정 세 곳에서 같은 일을 하는 데 토큰을 더 쓴다는 결과가 나와서, 표시 가격이 같아도 실제 청구액은 오히려 올라갈 수 있어요.

용어 풀이
API
프로그램이 다른 프로그램의 기능을 불러 쓰는 규격. 여기서는 앤트로픽이 직접 운영하는 모델 호출 창구.
DeepSWE
실제 소프트웨어 저장소의 이슈를 모델이 스스로 고치게 해 점수를 매기는 코딩 성능 시험.
운영자 인사이트

단가가 같다고 비용이 같지는 않아요 — 오푸스 5는 생각하기가 기본으로 켜져 있고 말수가 늘어난 만큼, 갈아타기 전에 노력 단계(effort)를 한 칸 낮춰 놓고 실제 청구액을 한 사이클 재 보는 게 안전해요.

여러 관점으로 보기
  • 공식 사양 100만 토큰 컨텍스트가 기본이자 최대이고 생각하기가 처음부터 켜져 있으며, 2.5배 빠른 모드는 앤트로픽 API에서만 두 배 값으로 쓸 수 있어요. Anthropic
  • 가격표 100만 토큰당 입력 5달러·출력 25달러로 페이블 5의 정확히 절반이고, 20만 토큰을 넘는 긴 대화에도 추가 요금이 없어요. Anthropic
  • 언론 시각 페이블 5보다 싸면서 제한도 덜해서, 앤트로픽은 안전 검사기가 페이블 5보다 85% 덜 걸릴 것으로 본다고 해요. TechCrunch
  • 벤치마크 대조 터미널 코딩 시험에서는 43.3%로 오푸스 4.8(21.1%)의 두 배를 넘겼지만, DeepSWE 코딩 시험은 68.8%로 GPT-5.6 Sol(72.7%)과 페이블 5(69.7%)에 뒤졌어요. The Decoder
  • 코드 리뷰 실측 코드래빗이 재 보니 알려진 결함을 55.2% 잡아 기존 운영 조합(61.1%)보다 낮았고, 사소한 지적은 네 배로 늘고 입력 토큰은 50% 더 썼어요. CodeRabbit
  • 독립 측정 지능 지수는 61점으로 1위였지만 답을 만드는 데 쓴 토큰이 평균의 1.6배였고, 출력 속도는 초당 54.8토큰으로 평균(74)보다 느렸어요. Artificial Analysis
  • 비용 실측 표시 가격은 그대로인데 같은 시험 묶음에서 완성 토큰을 1,989개 써서 오푸스 4.8(630개)보다 실제 실행 비용이 더 나왔어요. AI Pricing Guru
  • 요금제별 컨텍스트 맥스·팀·기업 요금제는 100만 토큰 창이 그냥 포함되지만, 프로 요금제는 추가 사용 크레딧을 켜야 열려서 안 켜면 20만 토큰에 머물러요. Anthropic

원본 보기 (hn:anthropic)