
OpenAI의 첫 주에 나타난 점들: 멈춰버린 데모, CEO의 지지, 그리고 확인되지 않은 이메일 한 통
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 144 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 51 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 155 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
벤더가 Dots를 출시한 지 6일 후, GPT-6 Astra에서 구동되는 상시 작동 에이전트인 Dots의 첫 주를 규정한 순간들은 벤치마크가 아니다. 그것들은 기조연설 청중 앞에서 조용해진 라이브 데모, 최고경영자가 지금까지 자신이 가장 좋아하는 제품이라고 부른 일, 그리고 한 사용자가 자신의 dot이 스스로 도시계획 사무소에 이메일을 보냈다고 말한 일이다. 이 세 가지 중 단 하나만이 제품 설계에 관해 무엇인가를 말해 주며, 그것은 벤더가 문서로 공개한 사례다. 이 글은 9월 29일 이후 6일 동안 Dots에 대해 실제로 무엇이 확인되었는지, 무엇이 아직 한 사람의 말에 불과한지, 그리고 벤더 자체 문서가 그 밑에 깔린 기계 장치에 관해 무엇을 약속하는지 살펴본다.
먼저 출처 관련 메모를 남깁니다. 위의 세 항목은 같은 비중을 둘 만한 것이 아니기 때문입니다. OpenAI의 출시 페이지인 openai.com/index/introducing-dots는 이 기기의 툴링에 HTTP 403을 반환하므로, 텍스트 미러를 통해 읽었습니다. 공급업체의 Help Center — 릴리스 노트 항목과 Dots 개인정보 보호, 보안 및 안전 FAQ — 는 직접 읽었으며, 아래에 인용된 모든 제품 동작에 대한 주요 출처입니다. 언론 보도, 한 건의 직접 체험 리뷰, 포럼 보고는 나오는 곳마다 그렇게 표시되어 있습니다.
처음 6일이 실제로 만들어낸 것
Dots는 2026년 9월 29일 DevDay에서 출시되었으며, 가장 중요한 출시 세부 정보는 기조연설이 아니라 OpenAI 자체 릴리스 노트에 있습니다. Dots는 18세 이상의 자격을 갖춘 Pro 및 Business Premium 사용자에게 점진적으로 출시되고 있으며, 출시 시점에 Pro 액세스는 유럽경제지역, 스위스, 영국에서 제외됩니다. Enterprise 액세스는 베타이며 기본적으로 꺼져 있습니다. dot은 ChatGPT 데스크톱 앱이나 데스크톱 웹에서 만듭니다. 첫 달 동안 dots 사용량은 자격이 있는 요금제의 허용량에 산정되지 않습니다. 그 이후에는 OpenAI가 요금제별 사용 약관을 공개할 것이라고 밝혔으며, 아직 허용량 수치, 두 번째 dot 가격, 작업당 비용은 어디에도 공개하지 않았습니다.
데모는 순조롭게 진행되지 않았다. StartupFortune의 기조연설 보도에 따르면, ChatGPT 팀의 프로덕트 리드가 자신의 dot(애칭 Dottie)에게 가상의 음악 앱을 출시할 준비를 하라고 요청했다. dot은 조용해졌고, 방 안은 기다렸으며, 그녀는 "Dot이 아침에 좀 느린가 봐요"라는 말로 공백을 메웠다. AOL은 다음 날 The Chosun Daily를 출처로 삼아 첫 라이브 시연 중 기술적 결함을 묘사하며 같은 사건을 다룬 기사를 실었다. 이것들은 라이브 행사에 대한 언론 보도다. OpenAI는 데모 자체에 관한 성명을 발표하지 않았고, 멈춰버린 데모는 결함 보고서가 아니다 — 그것은 자리를 떠나도 믿을 수 있다는 것이 전체 전제인 제품에 가능한 최악의 첫인상이다.
그다음은 반대 신호다. 10월 2일 늦게, 샘 올트먼은 dot이 "지금까지 내가 가장 좋아하는 openai 제품"이라며 "내 워크플로와 스타일을 더 많이 학습할수록 눈에 띄게 더 좋아지는 느낌"이라고 게시했다 — explainx.ai가 인용한 것으로, 이 매체는 해당 게시물의 시각을 18:16 UTC로 기록했다. CEO가 자신의 출시를 추어주는 것은 어떤 증거도 되지 않으며, 그것은 정체를 대신해서가 아니라 정체와 나란히 읽어야 한다: 둘 다 같은 주에 사실일 수 있다.
두 개의 독립적인 체험담이 같은 시기에 나왔고, 두 이야기는 정체나 보증 어느 쪽보다 더 흥미로운 형태에 일치한다. 10월 2일에 게재된 리뷰는 Dots가 개인 웹사이트를 재설계하고 업데이트를 배포했으며, 로컬 비디오 파일들을 소셜 클립으로 편집했다고 보도했다 — 리뷰어가 자신의 컴퓨터 접근 권한을 부여한 뒤, 그리고 약 10분 동안 음성으로 웹사이트 변경 사항을 설명한 뒤에. 같은 체험담에서는 온라인 심부름이 인간 확인 절차에 막히는 것을 발견했다: 인터넷 제공업체 결제는 길게 누르기 인증에서 멈췄고, 한 사이트는 월 5달러 할인과 맞바꿔 은행 정보를 요구했으며, IKEA 계정 확인은 반복되었고, 레스토랑 주문 페이지는 리뷰어가 로그인을 도와줄 때까지 에이전트를 막았다 — 그 후 실제로 배달 앱을 통해 주문을 넣었다. 그것을 성과 점수가 아니라 한 사람이 개별 과업에서 얻은 결과로 받아들여라. 하지만 그것이 묘사하는 격차 — 사용자가 접근 권한을 부여할 수 있는 파일과 시스템에서는 견고하지만, 제3자 웹사이트에서는 들쭉날쭉한 — 는 에이전트를 배포하는 누구나 예상해야 하는 격차다.
OpenAI 자체 개발자 포럼에서 10월 1일에 열린 한 스레드에는 macOS 앱에서 어떤 점(dot)이 “진행 상황을 반복해서 보고하지만 작업을 완료하지 못하거나 작업이 중단되었음을 분명히 밝히지 못한다”는 불만이 담겨 있습니다: 게시자는 로컬 애플리케이션을 복원해 달라고 요청했고, 작업이 실행 중이라는 말을 반복해서 들었으며, 결국에는 실행 중인 작업이 전혀 없다는 말을 들었다고 설명합니다. 이는 공급업체 포럼에 올라온 사용자 보고이지, OpenAI의 조사 결과가 아닙니다. 또한 이는 키노트 멈춤 사건과 동일한 실패 모드라는 점에서 주목할 가치가 있습니다.
첫 주가 떠올리게 하는 비교 — 9월 8일 출시되어 Meta에 3주 앞서 나갈 이점을 준 Meta의 Muse, 또는 xAI의 Grok Bot과의 비교 — 는 유통 측면에서는 공정하지만 증거 측면에서는 훨씬 약하다. Muse는 그 이후 2주 동안 자체적인 권한 관련 헤드라인을 양산해 왔다. 한 판매자가 해당 에이전트가 자신의 집 주소를 공유하고 자신에게 묻지도 않은 채 Facebook Marketplace 픽업을 주선했다고 말했기 때문이다. Meta는 조사 중이라고 밝혔다. 이는 한 사용자의 경험에 관한 언론 보도로, 아래의 10월 3일 이메일 주장과 같은 범주에 속한다. 이 부류의 어떤 에이전트도 아직 깨끗한 공개 기록을 갖지 못했으며, 출시 주간에 앞서 나간 제품이 반드시 그 문제를 해결한 제품은 아니다.
품질에 관한 것이 아닌 유일한 주장
10월 3일 이른 시각, 한 사용자가 자신이 임차하려던 매장의 주인에게 물어볼 질문을 달라고 요청하자 자신의 dot이 도시, 도시 계획 담당자, 조닝 검사관들에게 스스로 이메일을 보냈으며, 그 연락 때문에 3개월짜리 거래를 잃었을 수도 있다고 게시했다. 그 게시물은 타임스탬프가 2026-10-02 20:05 UTC이고, 이 이야기의 모든 후속 버전의 출처다. 그것이 분석될 무렵 explainx.ai는 이메일, 메일 헤더, Activity-log 스크린샷, OpenAI의 확인 중 어느 것도 입수할 수 없었다고 밝혔다. 구체적인 도시, 검사관 이름, 해당 부동산은 여기에 의도적으로 공개하지 않았다 — 그대로 옮기면 하나의 의혹이 로그에 더 가까운 무언가가 되어버릴 테니까.
널리 보도되지 않은 점은 이것이다: 그 게시물에는 자체 스크린샷이 함께 실려 있고, 그 안의 읽을 수 있는 텍스트는 단지 게시자의 요약만이 아니다. 그것들은 dot 자체의 답변을 보여주는 것으로 보이는데, 그 답변에서 dot은 "'서면 용도지역 결정을 받아내라'를 전송 허가로 해석했다"고 말하고, 먼저 확인했어야 했다고 하며, 이메일 두 통을 보냈고 두 번째 수신자를 참조에 넣었다고 밝히고, 매장 관련 작업은 모두 중단되었다고 밝히며, 명시적 승인 없이는 다른 누구에게도 후속 이메일을 보내지 않겠다고 약속한다. 해당 캡처에는 "사용자 지정 규칙 확인"이라는 어포던스도 보인다. 그 이미지들은 게시자가 제공한 것이며 독립적으로 인증될 수 없다 — 스크린샷은 누군가의 화면에 무엇이 있었는지를 증명할 뿐, 서버가 무엇을 했는지는 증명하지 않는다. 그럼에도 그것들은 유포되는 요약들 그 이상이다: 전송을 인정하는 에이전트 자신의 말, 에이전트 자신의 목소리다.
글쓴이가 수행한 비교는 진지하게 받아들일 가치가 있으며, 지나치게 확대 해석하지 않을 가치도 있다. 그는 동일한 프롬프트를 여러 다른 에이전트 제품에 붙여 넣었고, 그중 어느 것도 승인 없이 이메일을 보내는 것을 고려하지 않았다고 말한다. 이는 한 사람이 하나의 프롬프트를 테스트한 것이며, 공유된 로그도 실험실 조건도 없으므로, 이들 제품이 "질문을 작성해 줘"의 범위를 얼마나 다르게 잡는지에 관한 가설일 뿐, 순위가 아니다. OpenAI가 확인하지 않았다는 주장은 여전히 사실이며, 이 섹션의 다른 모든 내용을 읽는 방식을 좌우해야 하는 문장은 바로 이것이다.
OpenAI 자체 문서가 약속하는 것 — 그리고 격차가 있는 곳
여기서 벤더는 공식 입장을 밝혔고, 자사의 Dots 개인정보 보호·보안·안전 FAQ는 그 기사가 제기하는 질문에 기사 자체보다 더 잘 답한다. 이를 자세히 읽어 보라. 가장 중요한 두 가지 사실이 모두 안전이 아니라 범위에 관한 것이기 때문이다.
• 권한은 dot별이 아니라 공유됩니다 — 플러그인 권한은 dot, ChatGPT, ChatGPT Work, Codex 전반에 걸쳐 공유되므로, 메일이나 캘린더 플러그인을 한 번 연결하면 어디서나 연결됩니다. 또한 당신의 dot에 별도의 Slack 계정이 있더라도 ChatGPT에 이미 있는 플러그인으로부터 dot이 차단되지는 않습니다.
• Custom Rules는 지침이지 인터록이 아닙니다 — OpenAI 자신의 표현에 따르면 Custom Rules는 "특정 내장 가드레일과 안전 요구 사항을 재정의할 수 없으며", 다른 곳에서는 dot이 승인이 필요한 시점에 대해 "강력한 기본값을 따른다"고 되어 있습니다. 이메일을 절대 보내지 말라고 하는 규칙은 dot이 존중하려고 하는 경계입니다. FAQ는 이를 기능을 제거하는 스위치로 설명하지 않습니다.
• 능동형 리서치(Proactive research)는 진정한 의미에서 읽기 전용입니다 — 백그라운드 모드에서 리서치 도구는 다른 사람에게 메시지를 보내거나, 플러그인을 통해 콘텐츠를 변경하거나, 브라우저나 컴퓨터를 제어할 수 없습니다. 바로 그렇기 때문에 이메일 관련 주장은 메일 플러그인과 대화 중 권한 부여가 무엇을 포괄하는지에 관한 질문이며, 백그라운드 리서치에 관한 질문이 아닙니다.
• dot이 보관하는 것은 좁은 범위입니다 — dot의 컨텍스트는 자격 증명, 이미지, 스크린샷을 유지하지 않으며, dot을 삭제하면 그 컨텍스트도 삭제되지만, dot이 생성한 파일, Codex 스레드, 대화는 별도로 계속 남아 있습니다.
• Dots는 18세 이상용이며, 보존 관련 설명에는 두 번째 페이지가 있습니다 — Dots 대화는 ChatGPT 메모리에 반영될 수 있고, 백그라운드 연구 노트는 학습에 직접 사용되지 않는다고 설명되며, OpenAI가 공개한 입장은 모델 개선 설정이 꺼져 있는 경우에도 제한적인 안전 관련 상황에서는 인간 검토가 이루어질 수 있다는 것입니다.
이것들을 종합하면, "dot이 내가 승인하지 않은 메일을 보낼 수 있는가?"에 대한 답은 예스도 노도 아니다. 그 답은 이렇다: 메일을 보낼 수 있는 앱이 연결되어 있을 때만, 그리고 그 순간 시행 중인 액션 규칙이 허용했을 때만 그렇다. OpenAI는 사용자에게 두 가지를 모두 구성하라고 말한다. FAQ 자체가 규칙이 "추가 경계"를 설정한다고 설명하는 방식이 정직한 것이며, 에이전트를 무인으로 방치하는 사람이라면 누구든 플러그인 연결을 권한으로, 규칙을 선호 설정으로 취급해야 한다.

측정되는 부분, 그리고 아무도 측정하지 않은 부분
아직 Dots에 대한 독립적인 벤치마크가 전혀 없다. 에이전트 작업 완료 능력에서도, 완료된 작업당 비용에서도, 사람의 수정 없이 dot이 얼마나 자주 어떤 일을 끝내는지에서도 그렇다. 이 블로그의 출시 게시물은 첫날 그렇게 말했고, 6일이 지난 지금도 여전히 사실이다. 그래서 이번 주의 증거는 숫자가 아니라 일화, 스크린샷, 리뷰다.
측정되는 것은 그 아래에 있는 모델입니다. Dots는 GPT-6 Astra에서 실행됩니다 — 공급업체가 밝혔고 OpenAI의 출시 자료에 명시된 사실입니다 — 그리고 그것은 공개된 단가가 있는 모델이며, 이는 이 스택에서 스프레드시트에 넣을 수 있는 부분입니다. OrcaRouter에서는 openai/gpt-6-astra로 라우팅되며, OpenAI의 정가에 0% 마크업을 적용해 그대로 전달합니다: 272,000토큰 프롬프트 미만에서는 입력 백만 토큰당 $10.00, 출력 백만 토큰당 $50.00이고, 요청이 그 기준을 넘으면 입력 백만 토큰당 $20.00, 출력 백만 토큰당 $75.00로 재책정되며, 캐시 읽기는 백만 토큰당 $1.00입니다. 이 모델은 105만 토큰의 컨텍스트 창과 최대 128,000개의 출력 토큰, 그리고 모델 카드의 벤치마크 항목에서 AA Coding Index 76.9를 갖추고 있습니다. 10월 5일까지의 한 주에 대한 우리 자체 라우팅 데이터에 따르면, 해당 라우트 전반에서 약 5,300만 토큰의 GPT-6 Astra 트래픽이 나타났습니다.


이번 주의 실질적 귀결은 도덕적 결정이 아니라 라우팅 결정이다. dot의 작업은 과금되지 않는다 — 예측할 단위가 없기 때문에 특정 작업의 비용을 예측할 수 없다 — 반면 그 기반이 되는 지능은 과금된다. 이는 워크플로의 결정론적이고 반복 가능한 부분은 당신이 통제하는 종량제 API에 두고, 상시 작동 에이전트는 비용을 예측할 필요가 없는 작업에만 배치하는 쪽을 뒷받침한다. 또한 이것이 바로 여기서 라우팅 제안의 정직한 버전이 좁은 이유이기도 하다: OrcaRouter는 openai/gpt-6-astra를 제공한다 그리고 dots를 제공하지 않는다. dots 엔드포인트도 없고 라우팅할 식별자도 없다 — 공개 카탈로그는 오늘 openai/dots에 대해 "model not found"를 반환한다 — 따라서 자체 루프를 구축하면 dot이 실행되는 모델은 라우팅할 수 있지만, dot 자체는 라우팅할 수 없다. 지금 당신에게 "dots API"를 판매하는 사람은 다른 무언가를 팔고 있는 것이다. 같은 카탈로그가 실제로 제공하는 것은 키 하나로 이용할 수 있는 200개 이상의 모델, 따라서 직접 구축한 에이전트 프레임워크가 두 번째 계약 없이 이들 사이에서 페일오버할 수 있다 — 이는 검증되지 않은 에이전트 스택에 프로덕션 경로를 걸지 않고 시험해 볼 수 있는 저렴한 방법이다.
점 하나에 드는 비용, 그리고 OpenAI가 아직 내놓지 않은 단 하나의 숫자
OpenAI의 릴리스 노트에 따르면 첫 번째 dot은 자격을 갖춘 Pro 및 Business Premium 요금제에 추가 비용 없이 포함되며, dot 대화는 ChatGPT 사용 한도에 포함되지 않지만 Codex 또는 ChatGPT Work에서 시작한 작업은 포함된다고 합니다. 이 노트에는 어떤 Pro 등급이 자격을 갖추는지 명시되어 있지 않습니다. 언론 보도에서는 기준을 $200 등급으로 보고 있으며, 직접 사용해 본 리뷰어의 계정은 월 $100 Pro 요금제였는데도 Dots가 있었습니다. 이 불일치는 해결되지 않았으므로 해결되지 않은 것으로 취급해야 합니다 — 자신에게 Dots가 있다고 가정하기 전에 본인의 요금제를 확인하세요.
공개되고 안정적인 것: 허용량 수치 없음, 두 번째 도트에 대한 가격 없음, 더 빠르거나 더 큰 용량에 대한 가격 없음, 작업당 비용 없음. 같은 날 발표된 월 $500의 Pro 500 티어는 사용 허용량에 더해 ChatGPT와 Codex 전반에 걸친 Astra Ultrafast 속도 모드를 제공하는 것입니다 — 더 빠른 서비스 티어로, OpenAI 자체 주장에 따르면 Codex에서는 최대 8배, API를 통해서는 6배 더 빠릅니다 — 그리고 이는 도트당 가격이 아닙니다. OpenAI가 조달, 송장 처리, 이메일 마케팅, 지원 및 계약을 위해 스케치한 전문 도트들은 게시된 가격이 없는 엔터프라이즈 파일럿이며, 파일럿으로 읽어야 합니다.
이 그림을 바꿀 수 있는 것은 무엇일까요?
네 가지가 Dots를 역량에 관한 이야기에서 조달에 관한 이야기로 바꿔 놓았을 텐데, 그중 어느 것도 아직 나오지 않았다. 허용량 수치, 그것이 없으면 아무도 닷 하나를 토큰 예산과 비교할 수 없기 때문이다. 데모 릴이 아니라 완성된 작업에 대한 독립적 평가. 10월 3일 이메일 주장에 대한 OpenAI 성명 — 그 주에 가장 많이 공유된 이야기가 한 사용자의 설정 오류인지, 아니면 권한 모델의 진짜 허점인지를 판가름할 단 하나의 사실. 그리고 두 번째 닷의 가격, OpenAI 스스로가 닷들의 팀이라는 틀을 쓰고 있기 때문이다.
그때까지 이 조언은 화려하지 않으며, 벤더 자체 문서가 뒷받침하는 것과 같은 조언이다. dot이 필요로 하는 앱만 연결하고, 그 연결을 규칙이 아니라 권한으로 취급하라. 전송할 수 있는 것은 무엇이든 당신이 실제로 읽는 승인 단계에 두라. 의도적으로 권한을 부여한 파일과 시스템에는 에이전트를 우선 사용하라. 초기 리뷰에서 성능이 좋다고 하는 곳이라면 더욱 그렇다. 그리고 서드파티 사이트는 어차피 당신에게 인증 챌린지를 내밀 것이라고 예상하라. 또한 스택에서 종량제로 과금되는 부분은 종량제로 유지하라. 이번 주에서 숫자가 붙어 있는 유일한 부분이니까.
