
Dots vs Grok 4.6: 스스로 회의를 예약하는 에이전트 대 답변하는 모델
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 349 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAINEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 210 tok/s
- OrcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- xAISpaceXAI: Grok 4.62026-08-1244지능77코딩
dot에 전화번호를 쓰려고 하면 실패할 것이고, 그 실패가 이 조합의 가장 유용한 점이다. Dots는 회사의 항상 켜져 있는 에이전트로, 2026년 9월 29일 DevDay에서 발표되었다: 각 dot은 자체 클라우드 컴퓨터와 브라우저를 가지며, 4,000개 이상의 앱에 연결되고, ChatGPT, Slack, Teams 내에서 접근할 수 있으며, GPT-6 Astra에서 실행되고 Pro 및 Business Premium에 별도 요금 없이 포함된다. Grok 4.6은 SpaceXAI의 프런티어 모델로, 2026년 8월 12일에 공개되었으며, 완전히 다른 종류의 객체이다: 50만 토큰 컨텍스트 창, 텍스트, 이미지 및 파일 입력과 텍스트 출력, 구성 가능한 추론 노력, 네이티브 도구 호출 및 구조화된 출력을 제공하며, 20만 토큰 프롬프트 이하에서는 백만 입력 토큰당 $2.00, 백만 출력 토큰당 $6.00이고 그 이상에서는 두 배이다. 이 중 하나는 일정이 있는 동료이다. 다른 하나는 당신이 호출하는 함수이다.
둘 다 에이전트형 작업에서 진정으로 강력하며, 바로 그 때문에 혼동이 흔해진다. Grok 4.6은 Terminal-Bench 2.1에서 88.4점, τ-banking 도구 사용 부분에서 50.7점을 기록한다. 이런 수치는 모델을 "에이전트"라고 묘사하게 만드는 종류의 점수다. 하지만 Grok 4.6은 에이전트가 아니다. 그것은 당신이 에이전트를 만들 때 기반으로 삼게 되는 추론 엔진이다.
각각이 실제로 무엇인지
• 아이덴티티 — 주소로 지정할 수 있는 모델 식별자가 없는 호스팅 제품(Dots) 대 구성 파일에 넣을 수 있는 안정적인 문자열이 있는, 이름이 지정되고 라우팅 가능한 모델(Grok 4.6)
• 실행이 일어나는 위치 — OpenAI의 클라우드 컴퓨터에서, 자체 브라우저를 사용하며, 연결하지 않는 한 사용자의 머신과 격리됩니다 (Dots). 이는 호출을 실행하는 위치 — 사용자가 제어하는 컨테이너, 큐 워커, 크론 작업 (Grok 4.6) — 와 대비됩니다
• 도달 범위 — OpenAI의 커넥터(Dots)를 통한 4,000개 이상의 앱 vs. 직접 연결하는 모든 도구. 도구 호출은 디렉터리가 아니라 프로토콜이기 때문입니다 (Grok 4.6)
• 과업의 기억 — 500,000토큰 창과 당신이 스스로 지속하는 모든 것(Grok 4.6)에 맞서, 제품이 며칠에 걸쳐, 앱을 넘어, 새로운 스레드(Dots)를 넘어 운반하는 것
• 비용 — 구독에 포함됨, 허용량은 비공개(Dots)인 반면, 백만 토큰당 $2.00 및 $6.00이고 입력 토큰 200,000개를 초과하면 두 배가 되며, 캐시된 읽기는 $0.50(Grok 4.6)
• 증거 — 공급업체 시연 및 역량 진술, 독립 벤치마크 없음(Dots) 대비 Artificial Analysis Coding Index 76.8, 측정된 138개 모델 중 5위, GPQA Diamond 94.9(Grok 4.6)
대부분의 질문을 결정하는 숫자: 허용량
OpenAI는 dots에 대해 하나의 가격을 공개했으며, 그것은 작업을 측정할 수 있는 어떤 단위로 표시된 가격도 아니다. 첫 번째 dot은 Pro 또는 Business Premium에 포함되어 있고, 그것과의 대화는 ChatGPT 사용 한도를 차감하지 않으며, 확장된 한도가 첫 달에 적용된다. 이것이 공개된 비용 구조의 전부다. 허용량 수치도, 두 번째 dot 가격도, 작업당 요율도, 내부 테스트 중인 것으로 알려진 specialist dots에 대한 엔터프라이즈 가격도 없다. CNBC의 기조연설 보도에 따르면 재무 책임자 Sarah Friar는 월 500달러의 Pro 500 등급을 dot당 요율이 아니라 사용 허용량과 새로운 Ultrafast mode로 책정했다. 이는 OpenAI의 요금표에서 가장 비싼 요금제조차도 에이전트 작업 단위당 비용을 산출하지 못한다는 뜻이다.
Grok 4.6은 반대 방향으로 가서, 아픈 부분까지 포함해 모든 것을 공개한다. 200,000 입력 토큰의 티어 경계는 절벽이다: 199,000 토큰의 요청은 201,000 토큰의 요청 요율의 절반으로 청구된다. 그것은 숨겨진 함정이 아니라 요금표에 있는 숫자이며, 장문 컨텍스트 작업을 설계하는 방식을 바꾼다. 경계에서 청크로 나누거나, 두 번째 티어를 알면서 받아들여야 한다.

이 두 제품이 비교되는 동안 후속 제품이 출시되었습니다
Grok 4.7은 2026년 9월 21일에 공개되었으며 이제 Grok 라인의 플래그십입니다. 동일한 500,000토큰 컨텍스트, 동일한 입력 표면, 동일한 기본 가격, 그리고 훨씬 더 큰 450,000토큰 최대 출력을 갖추고 있습니다. Grok 4.6도 계속 사용할 수 있고 여전히 현재 모델로 등록되어 있습니다. 버전이 올라간다고 해서 은퇴하는 것은 아니지만, 오늘 Grok 모델을 선택하는 사람이라면 4.6이 최첨단이라고 가정하기보다 4.6과 4.7 사이에서 선택해야 합니다. 이렇게 분명히 말하는 이유는, 지금 읽고 계신 글이 그 전환에도 여전히 유효한 비교에 관한 것이기 때문입니다. 다음 분기에 Grok 라인의 최상위 모델이 무엇으로 불리든, 그것은 여전히 요금표가 있는 종량제 모델이며, Dot은 여전히 공개되지 않은 허용량을 가진 구독입니다.
이는 모델 호출을 특정 벤더에 하드코딩하는 대신 추상화를 통해 라우팅해야 하는 이유이기도 합니다. 후속 모델이 출시되면 모델을 바꾸는 일은 마이그레이션이 아니라 한 줄 수정으로 끝납니다.

에이전트를 빌리는 대신 직접 구축하기
이 조합의 흥미로운 결과는 Grok 4.6을 사용하면 Dots가 판매하는 것을 형편없이, 그리고 나서 더 잘 만들 수 있다는 점입니다. 큐를 읽고, 도구가 연결된 모델을 호출하고, 결과를 쓰고, 실패 시 재시도하는 루프는 어렵지 않습니다. 어려운 것은 dot이 무료로 제공하는 부분들입니다 — 사람처럼 동작하는 브라우저, 앱 공급업체가 작성한 커넥터, 승인 흐름 및 활동 로그. 그것들은 바로 지루하기 때문에 구독할 가치가 있습니다.
종량제 쪽이 승리하는 순간은 작업이 더 이상 범용적이지 않게 되는 바로 그때입니다. 다음 분기에 동일한 호출을 다른 벤더에 대해 실행해야 하거나, 로그에서 재생해야 하거나, 센트 단위까지 가격이 산정되어야 하거나, 업스트림 제공자가 흔들릴 때 더 저렴한 형제 모델로 비행 중간에 페일오버해야 하는 순간입니다. OrcaRouter에서 Grok 4.6은 grok/grok-4.6로 SpaceXAI의 정가에 0% 마크업을 더해 — 제공자 자체 요율을 그대로 전달하므로 벤더 가격 인하가 같은 날 청구서에 반영됩니다 — 하나의 키 뒤에 있는 200개 이상의 다른 모델과 동일한 카탈로그에서 제공되며, 자동 페일오버와 라우팅 DSL을 통해 여러 모델을 하나의 호출로 구성할 수 있습니다. 점(dot)에는 이에 상응하는 것이 없습니다: 엔드포인트도, 식별자도, 페일오버해 나올 대상도 없습니다.
적용할 테스트
그 작업이 아무도 들여다보지 않아도 여전히 존재할지 물어보세요. 답이 그렇다면 — 일정에 따라, 여러 도구에 걸쳐, 사람이 채팅 창을 열지 않고도 수행되어야 한다면 — dot은 그것에 맞게 만들어진 제품이고, 종량제 모델은 당신이 무엇을 구축하든 그 안의 구성 요소입니다. 답이 아니라면, 누군가 출력을 기다리고 있고 그 출력에 형식과 마감이 있다면, 종량제 모델이 올바른 구매이며 에이전트는 값비싼 우회로입니다.
피해야 할 실수는 더 나은 답을 얻기 위해 점 하나를 사는 것이다. 점은 더 똑똑한 모델이 아니라, 모델에 채워진 더 긴 목줄일 뿐이다. 그리고 두 번째 실수는, 요금표가 이미 토큰 단위로 팔고 있고 그 계산이 미리 눈에 보이는데도, 구독료를 내고 그 기능을 사려는 것이다.

이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
