AI 뉴스·트렌드

Grok 4.6 정리: 가장 싼 프론티어 모델 — Cursor·Copilot 사용자에게 뭐가 달라지나 (2026)

DevPilot 2026. 8. 24. 22:48

핵심 요약: 8월 12일 xAI(SpaceXAI)가 Grok 4.6을 냈습니다. 숫자만 보면 포지션이 선명해요 — Artificial Analysis 지능 지수 61점으로 GPT-5.6 Sol과 동률(Claude Fable 5보다 1점 아래)인데, 가격은 $2/$6(1M 토큰)으로 프론티어급 중 최저가입니다. 컨텍스트 500K, 에이전트 코딩 벤치(DeepSWE)는 4.5의 54에서 65.9로 점프. 대신 약점도 명확합니다 — 터미널 작업 계열이 상대적으로 약하고, 싼 단가가 곧 싼 작업당 비용은 아니에요. 도구 사용자 관점 요약: Cursor에선 모델 목록에서 바로 선택 가능(같은 SpaceX 지붕이라 기본값 향방이 관전 포인트), Copilot엔 8/14 카탈로그 추가(9월 폐기 모델의 대체 후보), API 직접 사용자에겐 "가격 대비 지능" 1순위 후보입니다.

※ 이 글은 2026년 8월 25일 기준입니다. 모델 가격·제공 범위는 자주 바뀌니 사용 전 공식 문서를 확인하세요.

지난주 내내 SpaceX-Cursor 이야기(인수, Grok Bot)를 썼는데, 그 사이 정작 모델 쪽 뉴스를 밀어뒀습니다. 인수 이틀 전에 나온 Grok 4.6 — 출시 당일 머스크가 "4.7은 3~4주 뒤"라는 트윗까지 올려서 화제가 됐던 그 모델입니다.

포지션: 1점 차이를 3분의 1 가격에

이번 릴리스의 본질은 순위가 아니라 가격 대비 지능입니다. Artificial Analysis 지능 지수에서 61점 — GPT-5.6 Sol과 동점이고 Fable 5(62)보다 딱 1점 아래인데, 단가는 GPT-5.6 Sol($5/$30)의 절반 이하, Fable 5($10/$50)의 5분의 1 수준이에요.

▲ 세로가 지능, 가로가 가격입니다. 왼쪽 위 구석을 파고든 게 이번 전략이에요.

세부를 보면 성격이 갈립니다. 에이전트 코딩(DeepSWE)이 4.5의 54에서 65.9로 크게 뛴 반면, 터미널 작업 계열은 상대적으로 약합니다. 지식 노동·법률 추론 쪽 점수가 강해서 — "코딩 1위"라기보다 "제일 싸게 프론티어급을 쓰는 선택지"로 읽는 게 정확합니다. 컨텍스트는 500K, 급할 때 쓰는 Fast 변형은 2배 가격입니다.

단가와 청구서는 다르다 (늘 하는 이야기지만)

$2/$6이라는 숫자에 바로 갈아타기 전에, 이 블로그에서 반복하는 원칙 하나만 — 싼 단가 ≠ 싼 작업당 비용입니다. 에이전트 작업은 모델마다 소비 토큰량이 수십 배 갈리고, 답을 길게 내는 모델은 단가 우위를 토큰량으로 반납하기도 해요(그 산수는 손익분기 글에서 다뤘습니다). 대표 작업 하나를 실제로 돌려 총액을 재보고 결정하는 게 정확합니다.

도구별로 보면: 내 자리에서 뭐가 달라지나

▲ 같은 모델인데 자리마다 의미가 다릅니다.

Cursor 사용자 — 모델 목록에서 바로 선택할 수 있고, Router를 쓴다면 배정 대상에도 들어옵니다. 관전 포인트는 따로 있어요: 이제 같은 SpaceX 지붕 아래라서(8/14 인수 완료), Grok 계열이 기본값·추천 위치로 기우는지가 앞으로 몇 달의 체크 항목입니다. 모델 선택권 자체는 그대로입니다.

Copilot 사용자 — 8월 14일 카탈로그에 추가됐습니다. 시점이 절묘한데, 9월 1일 구모델 폐기(Sonnet 3.7·Opus 4·Gemini 2.0 Flash)로 이동해야 하는 사람들에겐 대체 후보가 하나 늘어난 셈이에요(Cursor vs Copilot 비교도 오늘 이 내용으로 갱신했습니다).

API 직접 사용자 — 가격 대비 지능으로는 현재 1순위 후보. 다만 위의 작업당 비용 원칙대로 내 워크로드에서 실측 먼저. 그리고 4.7이 몇 주 뒤로 예고된 상태라, 대규모 마이그레이션이라면 한 템포 기다리는 것도 합리적입니다.

자주 묻는 질문 (FAQ)

Q. Grok 4.6과 Grok Bot은 뭐가 다른가요?

A. 4.6은 모델(API·도구에서 선택하는 두뇌)이고, Grok Bot은 그 모델 계열을 쓰는 상시형 에이전트 제품입니다. 4.6은 $2/$6 종량으로 누구나 쓸 수 있지만, Grok Bot은 SuperGrok Heavy·Cursor Ultra 등 프리미엄 구독 번들로만 접근됩니다.

Q. 코딩용으로 Claude나 GPT에서 갈아탈 만한가요?

A. 에이전트 코딩 벤치는 크게 올랐지만 터미널 작업 계열은 상대적으로 약합니다. 벤치마크보다 내 대표 작업 하나를 실제로 돌려 완주율과 총비용을 비교해보고 결정하는 것을 권합니다.

Q. Grok 4.7이 곧 나온다는데 기다려야 하나요?

A. 출시 당일 3~4주 뒤 4.7이 예고됐습니다. 가볍게 써보는 건 지금도 무방하지만, 파이프라인 전체를 옮기는 결정이라면 4.7 확인 후가 안전합니다.

3줄 요약

Grok 4.6(8/12) = 프론티어급 지능(AA 61, Fable 5 -1점)을 최저 단가($2/$6, 500K 컨텍스트)에. 강점은 에이전트 코딩·지식 노동, 약점은 터미널 계열 — "가장 똑똑한"이 아니라 "가장 싼 프론티어"가 정확한 포지션. Cursor에선 기본값 향방을, Copilot에선 9월 대체 후보로, API에선 실측 후 판단을. 4.7이 예고돼 있어 이 글도 곧 후속이 붙을 겁니다.

함께 보면 좋은 글

Cursor, 이제 SpaceX 소속 — 뭐가 바뀌나
Grok Bot이란? 상시형 AI 동료의 실체
구독 vs API 손익분기 계산법

참고 자료

Grok 4.6 API 가격 (OpenRouter)
Grok 4.6 in GitHub Copilot (GitHub Changelog)
Grok 4.6 벤치마크 분석 (Apidog)