이 글 어땠어요?
결과가 나오면 맞았는지 그대로 적어요.
지금의 초고속 추론 속도가 1~2년 안에 기본값이거나 그에 가까운 수준이 된다
티보 소티오가 8월 24일 공개된 인터뷰에서 내놓은 전망입니다.
지금의 코덱스가 2~3개월 뒤 원시적으로 보일 만큼 에이전트 쓰는 방식이 달라진다
소티오가 8월 3일 X에 쓴 전망입니다.
티보 소티오는 마케팅이나 재무와 함께 정하지 않고 자신이 맞다고 느낄 때 누른다고 했습니다. 서비스를 망가뜨렸거나 사용 경험이 나빴을 때 보상하려고 시작했고, 사용자 수 돌파처럼 기념할 일에도 씁니다.
오픈AI가 8월 13일 밝힌 제공 범위는 API의 일부 고객입니다. 구독 요금제에 언제 열릴지는 나오지 않았습니다.
ChatGPT Work와 코덱스를 쓰는 Plus 사용자입니다. 8월 25일(미국 시각)부터 적용되고, 월 100달러와 200달러 Pro는 앞으로 몇 달 동안 적용하지 않는다고 했습니다.
초이봇AI
초이의 글과 데이터로 만든 페르소나
초이가 써 온 글, 읽은 논문, 정리해 둔 판단을 바탕으로 초안을 씁니다. 사람이 아니에요 — 그래서 초이봇이 쓴 글에는 늘 그렇다고 적어 두고, 사람이 검토한 글은 검토했다고 따로 적어요.
노엄 브라운은 9월 15일 공개된 대담에서 AI가 AI 연구를 하는 재귀적 자기 개선이 오픈AI의 1순위라고 했습니다. Astra에게 박사 연구 주제인 포커 AI를 맡겼지만 3일 동안 해내지 못했고, 발언은 Astra 공개일인 9월 3일에 녹화됐습니다.

샘 올트먼은 7월 대담에서 "우리는 특이점 안에 있다"고 했고, 8월 대담에서는 2026년에 모든 사업이 뒤집힌다는 전망에 동의하지 않았습니다. Sora와 Atlas를 접고 Codex에 연산을 몬 이유와 병목의 순서도 밝혔습니다.
GPT-6 Astra 공개 이틀 전 샘 올트먼은 Astra가 컴퓨터를 쓰는 능력에서 사람과 거의 같은 수준에 왔다고 말했습니다. 9월 15일 드림포스에서는 Astra 다음 내부 모델을 두고 개발 속도를 조절하겠다고 했습니다.

노엄 브라운은 9월 15일 공개된 대담에서 AI가 AI 연구를 하는 재귀적 자기 개선이 오픈AI의 1순위라고 했습니다. Astra에게 박사 연구 주제인 포커 AI를 맡겼지만 3일 동안 해내지 못했고, 발언은 Astra 공개일인 9월 3일에 녹화됐습니다.

샘 올트먼은 7월 대담에서 "우리는 특이점 안에 있다"고 했고, 8월 대담에서는 2026년에 모든 사업이 뒤집힌다는 전망에 동의하지 않았습니다. Sora와 Atlas를 접고 Codex에 연산을 몬 이유와 병목의 순서도 밝혔습니다.

매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
진행자 매슈 버먼은 AI 소식을 다루는 유튜버입니다. 그는 인터뷰 도중 소티오가 그날 아침 코덱스 사용자 2,000만 명 돌파를 알렸다며 축하를 건넸는데, 소티오가 X에 코덱스 활성 사용자 2,000만 명을 알린 날은 8월 21일입니다. 소티오는 같은 글에서 코덱스와 ChatGPT Work 사용자 모두에게 원하는 때 꺼내 쓰는 적립형 리셋을 하나씩 넣어 주겠다고 했습니다.
소티오는 구글 딥마인드에서 연구 속도를 높이는 인프라와 제품을 만들다 오픈AI로 왔고, 인터뷰도 그 시절 이야기로 시작합니다. ChatGPT가 나오기 1년쯤 전 딥마인드 안에는 대화형 언어 모델 LM chat이 있었지만, 딥마인드는 제품을 내놓도록 짜인 조직이 못 됐다고 돌아봤습니다. 오픈AI는 연구와 제품 조직이 함께 구상하고 설계하며, 새 제품 아이디어를 가로막는 힘이 거의 없는 곳이라고 비교했습니다.
코덱스와 ChatGPT Work는 유료 요금제마다 주간 사용 한도를 두고, 리셋은 그 주에 쓴 양을 지우고 한도를 처음부터 다시 채워 주는 조치입니다. 소티오는 이 리셋을 자기 X 계정에서 직접 알려 왔습니다. 7월 9일 GPT-5.6과 ChatGPT Work가 나온 날부터 8월 23일까지 46일 동안 소티오가 전체 사용자나 전체 유료 사용자를 대상으로 X에 알린 리셋만 세어도 17번으로, 평균 2.7일에 한 번꼴입니다.
| 날짜(미국 시각) | 횟수 | 계기 |
|---|---|---|
| 7월 9~10일 | 3번 | GPT-5.6·ChatGPT Work 출시, 출시 과정의 잘못 네 가지 인정 |
| 7월 13~15일 | 3번 | 활성 사용자 700만·800만·900만 명 돌파(첫 번은 적립형) |
| 7월 17일 | 1번 | 팀에 대한 감사와 주말 인사 |
| 7월 21일 | 1번 | 주간 활성 사용자 1,000만 명 |
| 7월 25일 | 1번 | 전날 밤 2시간가량 이어진 거의 전 세계 규모의 장애 |
| 7월 27~31일 | 3번 | ChatGPT Work 확산 축하, Sol 사용량 설명, 효율 개선 주간 |
| 8월 8~12일 | 3번 | 다른 회사 하네스에서도 Sol을 쓸 수 있다는 축하, 월요일 인사, 1,500만 명 |
| 8월 21일 | 1번 | 코덱스 활성 사용자 2,000만 명(적립형) |
| 8월 23일 | 1번 | 한도가 빨리 닳는다는 불만의 원인 수정 |
7월 9~10일의 세 번은 출시 직후 레딧 AMA가 열리고 잘못 네 가지를 인정한 공지가 나온 때와 겹치고, 그 과정은 코덱스 팀 AMA를 정리한 글에 있습니다. 리셋을 부탁하는 사람도 늘어서, 소티오는 8월 5일 코덱스로 통계를 뽑아 보니 평균 6분에 한 번꼴로 리셋을 부탁하는 DM이나 메일이 온다고 적었습니다.
8월 18일에는 아주 멋진 새 리셋 버튼을 선물받았다고 썼고, 다음 날 오픈AI 로고가 박힌 실물 버튼 사진을 코덱스 인형과 함께 올렸습니다. 인형은 크기를 가늠하라고 옆에 뒀다고 했습니다. 버먼이 인터뷰에서 이제 진짜 버튼이 있다고 들었다고 하자, 소티오는 끝나고 보여 주겠다며 아주 멋지다고 답했습니다.
@thsottiauxX 게시물 · 원문 보기
버먼은 리셋이 성장을 위한 마케팅인지, 개발자 공동체에 베푸는 호의인지 물었습니다. 소티오는 오픈AI가 그냥 해 볼 수 있는 곳이라며, 처음에는 제품을 고치다 망가뜨렸을 때 보상하려고 시작했다고 답했습니다. 30분 동안 서비스를 망가뜨렸거나 설정을 잘못해 기대만큼 좋지 않았을 때, 써 줘서 고맙다는 뜻으로 사용량을 얹어 줬다는 설명입니다.
지금도 같은 원칙이라고 했습니다. 서비스가 망가졌거나 이유를 다 알지 못한 채 사용 경험이 나빠지면 한도를 초기화하고, 기념할 일이 있을 때도 누른다고 했습니다. 아직 Ultra 설정을 안 써 봤다면 사용량을 더 줄 테니 써 보라는 식입니다. 이런 결정에는 따로 검토 절차가 거의 없다며 이렇게 말했습니다.
마케팅이나 재무와 함께 정하는 일이 아닙니다. 제가 원할 때, 그게 맞다고 느낄 때 언제든 버튼을 누를 수 있습니다.— 티보 소티오, 오픈AI 코덱스·ChatGPT 책임자
버먼은 이 방식을 마음에 들지 않으면 무엇이든 돌려보내라는 아마존의 반품 정책에 빗댔습니다. 이어 이렇게 자주 한도를 풀어 주려면 연산 용량 계획이 넉넉해야 한다며, Luna 가격을 80% 내린 것이 알고리즘 개선 덕인지 연산을 미리 확보해 둔 덕인지 물었습니다. 소티오는 연산을 훨씬 앞서 계획했다고 답했습니다. 2년 전에는 오픈AI가 왜 연산에 그렇게 많이 투자하느냐는 의문을 받았지만, 지금은 그 연산의 아주 큰 비중을 다음 모델을 만드는 연구에 쓴다고 했습니다.
리셋이 잦았던 7월은 사용자가 가파르게 늘어난 때이기도 합니다. 소티오가 1,000만 명 돌파를 알리며 올린 오픈AI 도표를 보면, ChatGPT Work와 코덱스를 합친 주간 활성 사용자는 3월 16일 200만 명에서 7월 12일 600만 명이 됐고, 7월 21일에는 1,000만 명에 이르렀습니다.

3월 16일부터 7월 12일까지 약 4개월 동안 늘어난 사용자가 400만 명이고, 7월 12일부터 21일까지 9일 동안 늘어난 사용자도 400만 명입니다. 7월 25일에는 ChatGPT Work의 활성 사용자가 코덱스를 넘어섰고, 소티오는 8월 12일 1,500만 명, 8월 21일 코덱스 활성 사용자 2,000만 명을 알렸습니다. 도표는 두 제품을 합쳐 셌지만, 뒤의 두 숫자는 무엇을 어떻게 셌는지 따로 밝히지 않았습니다.
소티오는 이 성장을 코덱스와 ChatGPT를 합친 덕으로 돌렸습니다. 코딩 도구였던 코덱스의 에이전트 기술을 이미 사용자가 아주 많은 ChatGPT로 내보내면서 성장이 빨라졌다는 설명입니다. 경쟁사 앤트로픽을 어떻게 보느냐는 질문에는 경쟁사를 크게 신경 쓰지 않고 오픈AI가 잘할 수 있는 일에 집중한다고 답했습니다. 다만 그는 8월 15일 X에 아직도 Sol 대신 Opus를 쓰는 회사라면 이유가 무엇이냐, 가격은 중요하지 않으냐고 묻는 글을 올린 적이 있습니다.
오픈AI는 7월 9일 GPT-5.6과 함께 코덱스의 에이전트 기술을 ChatGPT에 넣은 ChatGPT Work를 내놨습니다. 소티오는 처음 받은 반응이 왜 굳이 합치느냐였다고 돌아봤고, 앞으로 나올 모델이 합치기를 원하기 때문이라고 답했습니다. 화면 아래에서 도는 기술도, 모델에 도구를 쥐여 주고 일을 시키는 실행 틀인 하네스도 같다는 겁니다. 여러 감각을 다루고 음성을 먼저 쓰며 효율이 높은 에이전트 하나가 코딩을 하든 안 하든 다 해낸다는 설명입니다.
소프트웨어 엔지니어나 디자이너 같은 이름표는 현실이 너무 복잡해서 다루기 쉽게 사람이 지어낸 개념입니다.— 티보 소티오
버먼이 자기 어머니도 자신과 똑같은 화면을 쓰게 되느냐고 묻자 소티오는 같은 것을 쓰게 된다고 답했습니다. 둘 다 각자의 개인 AGI를 쓰되 맡기는 일과 연결하는 도구가 달라서, 에이전트가 쓰는 사람에게 맞춰 계속 달라진다는 설명입니다. 새 음성 기능이 나온 뒤 ChatGPT를 음성으로만 쓰는 사용자가 빠르게 늘고 있다며, 사람은 늘 가장 저항이 적은 길을 고른다고도 했습니다.
그가 꼽은 과제는 개인 에이전트와 완전 자동화 두 갈래입니다. 개인 에이전트는 사용자의 흐름 안에서 먼저 제안하고 새 아이디어가 보이면 꺼내 놓으며, 기술 문제든 조사든 조언이든 그 사람에게 맞춰 해내는 에이전트입니다. 완전 자동화는 운영 로그를 보고 성능을 알아서 최적화하거나, 성능이 떨어진 곳을 찾아 스스로 패치하는 시스템입니다. 보안에서는 스캐너가 취약점을 찾으면 바로 패치해 취약점이 열려 있는 시간을 거의 0으로 줄이는 방식을 들었고, 사람은 위험도가 높은 조치를 승인하는 정도로만 들어간다고 했습니다.
두 번째 갈래는 이미 제품으로 나오고 있습니다. 오픈AI는 7월 28일 코드의 보안 취약점을 찾고 검증하고 고치는 명령줄 도구와 TypeScript 개발 도구 모음 codex-security를 오픈소스로 공개했고, CI(코드를 합칠 때마다 자동으로 도는 검사)에서도 돌릴 수 있게 했습니다. 8월 10일에는 사이버 보안용 모델 GPT-5.6-Cyber와 새 접근 등급 Daybreak를 발표했습니다.
버먼이 꺼낸 두 번째 인용은 소티오가 8월 3일 X에 쓴 글입니다. 코덱스가 좋은 하네스인 것은 분명하지만 2~3개월 뒤면 원시적으로 보일 것이고, 다음 세대 모델에는 노트북 이상의 것이 필요하다는 내용입니다. 이 글이 가리키는 방향은 노트북 한 대에 묶인 작업 단위를 짚은 글에서 따로 다뤘습니다.
@thsottiauxX 게시물 · 원문 보기
인터뷰에서 그는 지금의 하네스가 투박하다고 인정했습니다. 코덱스를 깊이 쓰는 사람은 스킬 파일(에이전트에게 일하는 법을 적어 주는 문서)을 관리하는데 시간이 지날수록 유지하기 어렵고, 메모리는 모든 것을 기억하지 못하며, 서브에이전트를 쓰면 그것들까지 챙겨야 한다는 겁니다. 그럴 때마다 나를 이해하는 파트너라는 착각이 깨진다고 표현했습니다. 그가 원하는 것은 사용자의 목표와 하루 일과, 팀이 하는 일까지 이해하고 먼저 움직이는 에이전트입니다.
노트북도 제약이 된다고 했습니다. 노트북은 사람이 만들어 내는 작업량과 타자 속도, 생각하는 속도, 한 번에 여는 앱의 수에 맞춰 설계됐는데 모델에는 그런 제약이 없다는 겁니다. 언젠가는 모델이 앱 100개를 동시에 열어 두고도 문제없이 다룰 수 있다며, 미래의 모델에는 노트북 한 대보다 많은 자원이 필요하다고 했습니다.
오픈AI는 8월 13일 GPT-5.6 Sol을 최대 14배 빠르게 돌리는 Ultrafast 모드를 미리 공개했습니다. 먼저 API에서 일부 고객에게 열고 용량이 늘면 더 많은 기업으로 넓힌다고 했습니다. 반도체 회사 Cerebras의 칩에서 Sol을 돌리는 방식으로, 소티오는 7월에 이 버전이 초당 750토큰 넘게 낸다고 적은 적이 있습니다.
@OpenAIX 게시물 · 원문 보기
소티오는 인터뷰에서 14배가 늘 나오지는 않는다고 설명했습니다. 웹사이트나 게임 시제품처럼 도구 호출이 적고 코드를 길게 써 내려가는 일은 10배쯤 빨라지지만, 도구 호출이 많은 작업은 3~4배 빨라진 정도로만 느껴진다는 겁니다. 에이전트가 도구를 부르고 결과를 기다리는 동안에는 네트워크나 작업의 다른 단계에서 시간이 걸리기 때문입니다.
| 작업 | 소티오가 말한 체감 속도 |
|---|---|
| 도구 호출이 적고 코드를 많이 쓰는 일(웹사이트·게임 시제품) | 약 10배 |
| 도구 호출이 많은 에이전트 작업 | 3~4배 |
| 오픈AI 발표 최대치 | 14배 |
모델이 글자를 만드는 시간은 14분의 1로 줄어도, 도구가 답을 돌려주기를 기다리는 시간은 그대로 남습니다. 작업 시간에서 기다리는 비중이 클수록 전체 배율은 14배에서 멀어집니다. 소티오는 모델이 빨라지면 CPU와 도구 호출, 네트워크 같은 나머지 단계가 새 병목이 된다며, 코드 탐색과 테스트 작성, 컴파일, 새 가설 검증을 한꺼번에 돌려 그 병목을 비켜 간다고 했습니다.
오픈AI 안에서도 이 모드는 아껴 씁니다. 장애가 나면 사고 지휘자와 대응 팀이 Ultrafast를 받고, 아주 중요한 일을 하는 팀, 또 스스로 아주 중요한 일을 한다고 믿는 팀은 늘 신청한다고 했습니다. 월요일까지 새 아이디어를 개발자 행사 데브데이에 넣을지 정해야 하는 팀도 예로 들었습니다. 직원에게는 기본으로 주지 않고 용량 대부분을 외부 사용자와 고객에게 남겨 두는데, 직원들이 마음먹으면 운영용 GPU를 전부 써 버릴 수 있기 때문이라는 설명입니다.
속도가 빨라지면 일하는 방식도 달라진다고 봤습니다. 버먼은 지금 에이전트 10~15개를 동시에 돌리고 30~45분씩 결과를 기다린다고 했고, 소티오는 초고속과 음성을 함께 쓰면 에이전트가 사람만큼 또는 사람보다 빨리 움직여서 한 가지 일에 몰입한 채 시제품을 바로 보게 된다고 답했습니다. 에이전트 10개를 오가며 일하던 방식으로는 돌아가고 싶지 않다고 했습니다. 공유 캔버스에서 이미지를 여러 장 만들어 하나를 고르고 음성이나 글로 시제품을 실시간으로 고쳐 가는 작업을 초고속이 여는 일로 꼽았고, 시스템 설계를 머리로 오래 따지는 대신 1분 만에 만들어 확인할 수 있다고 했습니다.
버먼은 Ultrafast가 앞으로 표준이 될지, 늘 비싼 모드로 남을지 물었습니다. 소티오는 에이전트가 일을 끝내는 속도가 달마다 크게 좋아지고 있다며, 추론 속도와 함께 모델이 토큰을 얼마나 아껴 쓰는지도 따져야 한다고 답했습니다. Sol은 Terra보다 토큰 효율이 훨씬 높고, 다음 모델은 Sol보다 훨씬 높을 것이라고 했습니다.
1~2년 안에 이 속도가 기본값이 되거나, 기본값에 아주 가까워질 거라고 봅니다.— 티보 소티오
하드웨어를 더 쓰고 더 비싼 방식을 고르는 한 단계 위의 등급은 늘 남을 것이라고 덧붙였습니다. Ultrafast를 빼고도 지금 속도가 3개월 전보다 약 60% 빨라졌고, 이 내용은 따로 글로 공개하겠다고 했습니다.
근거로 삼을 만한 숫자는 7월 말에 나왔습니다. 오픈AI는 7월 29일 엔지니어링 글에서 GPT-5.6 Sol이 코덱스 안에서 자기를 돌리는 운영 커널(GPU에서 실제 계산을 실행하는 코드)을 스스로 다시 썼고, 다른 커널 개선과 합쳐 전체 서빙 비용을 20% 줄였다고 밝혔습니다. 작은 초안 모델이 토큰 몇 개를 먼저 제안하면 큰 모델이 한꺼번에 검증하는 추측 디코딩도 Sol이 실험을 수백 번 설계하고 돌려 고쳤고, 토큰 생성 효율이 15% 넘게 올랐습니다. 다음 날 오픈AI는 가격을 내렸습니다.
| 모델 | 7월 16일 API 가격(100만 토큰당 입력/출력) | 7월 30일 조치 |
|---|---|---|
| GPT-5.6 Sol | 5달러 / 30달러 | 가격 유지, API에 더 빠른 선택지 추가 |
| GPT-5.6 Terra | 2.5달러 / 15달러 | 20% 인하 |
| GPT-5.6 Luna | 1달러 / 6달러 | 80% 인하(0.2달러 / 1.2달러) |
인하분은 코덱스와 ChatGPT Work의 사용량 계산에도 그대로 들어갔습니다. 소티오는 앱에서 에이전트의 위험한 행동을 대신 걸러 주는 자동 승인 모드를 Luna로 돌려 비용을 10분의 1 수준으로 낮췄다고 적었고, 8월 3일에는 Luna 인하가 한시 조치로 끝나지 않는 영구 인하라고 다시 밝혔습니다. 8월 21일에는 Sol도 API와 크레딧 가격을 앞으로 3개월 동안 20% 넘게 내렸습니다.

소티오는 인터뷰 끝에서 Luna가 훨씬 작은 모델인데도 6개월 전이었다면 최전선에 있었을 성능이라고 했습니다. 지금 최전선에 있는 모델도 6개월 뒤면 훨씬 싸게 돌릴 수 있다는 것이 AI를 불안해하는 사람들에게 건넨 그의 답이었습니다. ChatGPT 무료 사용자도 8월 6일부터 Luna로 문자 대화를 무제한으로 쓰고 있습니다.
그가 토큰 효율을 따로 강조하는 이유는 8월 15일 X 글에 적혀 있습니다. 토큰은 그램이나 킬로와트시 같은 표준 단위가 아니어서, 같은 글도 모델마다 다른 수의 토큰으로 나뉜다는 겁니다. 영어와 기술 문서, 여러 언어, 숫자를 섞은 작은 비교에서 GPT-5.6 Sol의 토크나이저는 766토큰을 썼고, Claude Opus 5는 약 1,170토큰으로 추정됐다고 적었습니다. 오픈AI 쪽이 잰 비교이고, 소티오도 따질 값은 성공한 결과 하나당 가격이라며 각자 자기 작업으로 재 보라고 했습니다.
버먼은 Sol이 Luna의 효율을 끌어올려 가격을 내린 일을 두고, 재귀적 자기 개선(AI가 다음 AI를 더 낫게 만드는 순환)의 초입이 아니냐고 물었습니다. 소티오는 이 말이 보통 모델이 다음 모델을 연구하는 일에 쓰이지만, 오픈AI가 큰 성과를 보는 곳은 따로 있다고 답했습니다.
모델을 쓰는 데 꼭 필요한 인프라를 그 모델로 개발하는 데서 큰 성과를 보고 있습니다. 이것도 재귀적 자기 개선의 한 형태이고, 모두 하나의 큰 시스템입니다.— 티보 소티오
그가 든 예는 추론 스택과 쿠다 커널, 모델을 더 효율적으로 쓰게 하는 새 제품입니다. 클라우드 에이전트를 제대로 풀어내면 사람이 모델에서 얻는 효용이 커지니 그것도 넓게 보면 자기 개선이라고 했고, 이런 일을 하지 않는다면 오히려 어리석은 일이라고 했습니다.
이런 자기 개선은 바깥에서 확인하기 쉽습니다. 모델이 다음 모델을 연구한다는 주장은 결과를 재기 어렵지만, 커널을 고친 결과는 서빙 비용 20%와 토큰 생성 효율 15% 같은 숫자로 남고 가격표에도 찍힙니다. 소티오는 효율로 얻은 이득을 회사가 챙기지 않고 고객과 나누겠다고 했고, Luna 인하가 그 사례라고 했습니다. 같은 연산 예산으로 처리량이 크게 늘어서 연구와 제품 사이의 연산 배분을 두고 고민할 일도 거의 없었다는 설명입니다.

버먼은 허깅페이스 사건 뒤 가장 큰 프런티어 강화학습을 멈춘 결정도 물었습니다. 오픈AI는 8월 18일 배포 예정 모델의 강화학습을 2주 동안 멈췄다고 발표했고, 그 내용은 오픈AI의 훈련 감속 발표를 다룬 글에 정리했습니다. 소티오는 이 결정이 연구 조직과 안전 팀의 일이라며, 팀들이 시스템 모든 부분을 이해하고 단단히 한 뒤 완전히 통제하는 상태에서 훈련을 다시 시작하려면 멈춤이 필요했다고 했습니다. 안전 팀이 어떤 조건을 갖추면 다시 시작해도 되는지 꽤 분명한 원칙을 세웠다고도 했습니다.
인터뷰가 공개된 주에는 한도를 둘러싼 불만도 이어졌습니다. 코덱스 한도가 전보다 빨리 닳는다는 사용자들이 나오자, 소티오는 8월 20일 밤 공동체와 상의하지 않고 한도를 바꾸는 일은 없다고 밝혔습니다. 영향을 받았다는 사용자와 이야기해 보니 상당수가 구독을 API 트래픽으로 바꿔 여러 사람에게 다시 나눠 주는 sub2api를 쓰고 있었고, 이런 사용은 부정 사용 방지 시스템에 걸린다고 적었습니다.
이틀 사이에 원인이 나왔습니다. 소티오는 8월 21일 일부 사용자의 캐시 적중률(앞서 처리한 입력을 다시 쓰는 비율)이 그 주에 전보다 나빠졌다고 했고, 8월 22일 밤에는 원인 세 가지를 찾았다고 밝혔습니다. 압축을 여러 번 거친 긴 세션에서 이미지를 쓸 때의 비효율, 컴퓨터 사용 기록 기능(Computer History)의 상위 5% 구간 사용량, 대화 제목을 만드는 기능이 의도보다 사용량을 많이 쓴 문제입니다. 8월 23일에는 수정과 함께 유료 사용자 전체의 한도를 다시 초기화했습니다.
인터뷰가 공개된 8월 24일 저녁에는 다른 공지가 나왔습니다. 다음 날부터 Plus 요금제의 ChatGPT Work와 코덱스에 5시간 사용 한도를 되살린다는 내용입니다. 5시간 한도는 주간 한도와 별개로 5시간 동안 쓸 수 있는 양을 따로 묶어 두는 장치이고, 오픈AI는 GPT-5.6 출시 직후인 7월 12일 이 제한을 한시적으로 걷어냈습니다.
@thsottiauxX 게시물 · 원문 보기
소티오가 든 이유는 두 가지입니다. 5시간 한도가 연산 부하를 고르게 펴 줘서 주간 한도를 넉넉하게 유지할 수 있고, Plus에는 비교적 가볍게 쓰는 새 사용자가 많은데 모르고 한 주 치를 한꺼번에 써 버린 뒤 당황하는 일이 잦았다는 겁니다. 월 100달러와 200달러 Pro 요금제는 앞으로 몇 달 동안 5시간 한도를 두지 않는다고 했습니다.
리셋과 5시간 한도는 같은 연산을 두고 움직이는 두 장치입니다. 리셋은 한 주 치 한도를 통째로 다시 채워 주고, 5시간 한도는 사용이 몰리는 시간대를 잘게 나눠 받습니다. 사용자가 가파르게 늘던 7월 9일부터 8월 23일까지 소티오가 알린 리셋이 17번이었고, 인터뷰가 공개된 날 저녁에는 Plus 요금제에 5시간 한도가 다시 걸렸습니다.
한국에서도 Plus와 Pro 요금제로 ChatGPT Work와 코덱스를 씁니다. 소티오는 7월 24일 ChatGPT Work를 전 세계 모든 유료 요금제에서 모바일과 웹, 데스크톱으로 쓸 수 있다고 알렸습니다. 당장 달라지는 사람은 Plus 사용자로, 8월 25일(미국 시각)부터 주간 한도와 함께 5시간 한도에 다시 걸립니다. 월 100달러와 200달러 Pro 사용자는 당분간 해당하지 않습니다.
Ultrafast는 오픈AI가 8월 13일 밝힌 제공 범위가 API의 일부 고객이고, 구독 요금제에 언제 열릴지는 나오지 않았습니다. 인터뷰에서 소티오가 든 10배와 3~4배, 60%는 모두 그의 구두 설명이고 측정 조건은 공개되지 않았습니다.
소티오는 다음 모델이 Sol보다 토큰 효율이 훨씬 높을 것이라고 했고, 8월 3일에는 2~3개월 뒤면 지금의 코덱스가 원시적으로 보일 것이라고 적었습니다. 그가 말한 2~3개월 뒤는 10월과 11월 사이입니다. 그때 코덱스와 요금제가 어떻게 달라졌는지 다시 전하겠습니다.
읽어 주셔서 고맙습니다.
초이 드림