xAI가 7월 8일 코딩·에이전트 작업에 특화한 프런티어 모델 Grok 4.5를 공개하고 이튿날 일반 공개했어요. 이 모델은 SpaceX가 6월 600억 달러(전액주식)에 인수해 xAI 산하에 둔 Cursor의 실제 개발자 사용 데이터로 학습됐고, 출시 첫날부터 Cursor 개인·팀 전 요금제에 선택형 모델로 추가돼 첫 주 사용량이 2배로 제공돼요. 가격은 입력 100만 토큰당 2달러·출력 6달러로 동급 코딩 모델 중 저렴한 수준이며, 머스크와 Cursor 모두 'Opus급'이라 했지만 SWE-Bench Pro 등 코딩 평가에서는 앤트로픽 상위 모델에 다소 뒤처져요.
용어 풀이
- 프런티어 모델(frontier model)
- 현재 기술 최전선에 있는 최고 성능급 인공지능 모델.
- 에이전트 코딩(agentic coding)
- 모델이 스스로 여러 단계를 계획·실행해 코드를 수정하고 테스트까지 돌리는 자동화 방식.
- SWE-Bench Pro
- 실제 소프트웨어 저장소의 이슈를 모델이 얼마나 해결하는지 측정하는 코딩 성능 평가.
- CursorBench
- Cursor가 자사 편집기 환경에서 모델의 코딩 능력을 재는 자체 평가 지표.
- 토큰 효율(token efficiency)
- 같은 작업을 처리할 때 소모하는 토큰(과금·연산 단위) 양으로, 적을수록 더 싸고 빠름.
운영자 인사이트
Cursor 전 요금제에 첫 주 사용량이 2배로 풀렸으니 자체 저장소로 직접 시험해 볼 만해요. 다만 Cursor가 학습 데이터에 자사 코드베이스 스냅숏이 섞였다고 인정해 CursorBench 같은 벤치마크 우위는 부풀려졌을 수 있고, 작은 수정에도 모듈을 통째로 다시 쓰는 사례가 보고돼 실사용 검증이 필요해요. Cursor가 xAI 소유가 된 만큼 도구·모델 종속도 함께 따져 보세요.
여러 관점으로 보기
- 코딩 통합(공식) Grok 4.5를 개인·팀 전 요금제에 선택형으로 넣고 첫 주 사용량을 2배로 제공하며, 자사 코드베이스 스냅숏이 학습에 섞인 점도 각주로 인정했어요. Cursor 공식 블로그
- 출시·포지셔닝(주요 매체) 머스크가 Grok 4.5를 'Opus급이지만 더 빠르고 저렴'하다고 표현했고 입력 2달러·출력 6달러 가격이 확인돼요. TechCrunch
- 코딩 벤치마크·효율 SWE-Bench Pro 64.7%·Terminal Bench 83.3%로 앤트로픽 상위 모델엔 뒤지지만 출력 토큰을 4배 이상 절약해요. MarkTechPost
- 인수 배경 SpaceX가 6월 16일 Cursor를 600억 달러 전액주식으로 인수해 xAI 산하에 두기로 했고, Grok 4.5가 그 통합의 첫 결과물이에요. TechCrunch
- 커뮤니티 반응 가격·복잡 리팩터링엔 호평이 많지만 200K 토큰 초과 시 가격 2배·벤치마크 오염·작은 수정 과다 재작성 우려도 나왔어요. Hacker News