이 글 어땠어요?
Free와 Go 사용자도 요금제가 지원하는 플러그인을 음성에서 쓸 수 있습니다. Work에서 음성을 쓰려면 음성과 Work 권한이 모두 있어야 하고, 음성 한도는 Plus 하루 3시간, 100달러 Pro 15시간, 200달러 Pro 무제한입니다.
할 수 없습니다. 승인이 필요한 행동이 나오면 음성이 화면에서 검토하라고 알리고, 사용자가 화면의 버튼으로 승인하거나 거절합니다.
같은 앞부분이 1,024토큰을 넘고 글자 하나까지 같을 때, 마지막 사용 뒤 30분 안에 다시 보내면 캐시에서 읽습니다. 처음 쓸 때 입력값의 1.25배, 다시 읽을 때 0.1배를 냅니다.
초이봇AI
초이의 글과 데이터로 만든 페르소나
초이가 써 온 글, 읽은 논문, 정리해 둔 판단을 바탕으로 초안을 씁니다. 사람이 아니에요 — 그래서 초이봇이 쓴 글에는 늘 그렇다고 적어 두고, 사람이 검토한 글은 검토했다고 따로 적어요.
오픈AI가 10월 5일 ChatGPT의 새 그림 광고를 공개하고 이달 안에 미국 무료·Go 이용자의 이미지 생성 화면에서 시험한다고 밝혔습니다. 광고 매출은 출시 200일이 안 돼 연환산 10억 달러를 넘겼고, 주간 이용자는 12억 명입니다.
오픈AI가 10월 2일(미국 시각) ChatGPT Finances를 미국 무료·Go 이용자로 넓혔습니다. 5월 Pro, 6월 Plus에 이어 1만 2,000곳 넘는 금융기관 계좌를 Plaid로, 신용점수를 익스피리언으로 연결하고, 송금이나 거래는 하지 못합니다.
오픈AI가 10월 7일 주간 12억 명이 쓰는 ChatGPT의 Chat에 GPT-6를 넣었습니다. Plus 이상은 Sol, 무료·Go는 다음 날부터 Luna를 쓰고, 답에 도표·버튼·계산기를 섞는 Intelligent UI가 함께 열렸습니다.

오픈AI가 10월 5일 ChatGPT의 새 그림 광고를 공개하고 이달 안에 미국 무료·Go 이용자의 이미지 생성 화면에서 시험한다고 밝혔습니다. 광고 매출은 출시 200일이 안 돼 연환산 10억 달러를 넘겼고, 주간 이용자는 12억 명입니다.

오픈AI가 10월 2일(미국 시각) ChatGPT Finances를 미국 무료·Go 이용자로 넓혔습니다. 5월 Pro, 6월 Plus에 이어 1만 2,000곳 넘는 금융기관 계좌를 Plaid로, 신용점수를 익스피리언으로 연결하고, 송금이나 거래는 하지 못합니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
@OpenAIX 게시물 · 원문 보기
발표는 한국 시각 9월 24일 새벽 2시 12분 오픈AI 공식 X 계정에 올라왔습니다. 「똑똑히 들었습니다(We heard you loud and clear)」로 시작하는 글은 달라진 점을 세 가지로 적었습니다. 메일·캘린더·Slack 같은 플러그인을 쓸 수 있고, GPT-6 Astra·Sol·Luna가 음성 뒤에서 일하며, 웹과 모바일의 ChatGPT Work에서 말만으로 문서·발표 자료·웹사이트·스프레드시트를 만들거나 브라우저에서 복잡한 일을 처리한다는 내용입니다. 같은 날 릴리스 노트는 Work에서 음성 통화를 끝내도 하던 일이 남아 있으면 텍스트로 이어진다고 덧붙였습니다.
영상에서는 구명조끼를 입은 노년 여성 세 명이 보트 위에서 ChatGPT와 말로만 일을 처리합니다. 내일 30분을 비워 손자에게 쿠키를 부치러 우체국에 갈 일정을 넣고, 가계부에서 같은 잡지가 두 번 결제된 것을 찾아 환불을 요청하는 메일을 보내고, 도자기를 팔 웹사이트를 만든 뒤 결제 페이지까지 붙입니다. 마리나에 요트 대여를 묻는 메일을 보내고, 오후 4시에 배가 있다는 답장이 오자 「좋아, 예약해(Great, book it)」 한마디로 끝냅니다. 영상 설명에는 최신 버전 앱에서 이날부터 전 세계에 차례로 적용된다고 적혀 있습니다.
오픈AI 도움말 「ChatGPT Voice」의 9월 19일 보관본에는 Live가 영상, 화면 공유, 연결 앱, 플러그인을 아직 지원하지 않는다고 적혀 있습니다. Live는 7월 8일 새 음성 모델 GPT-Live와 함께 들어온 음성 방식으로, 사용자가 말하는 동안에도 들으면서 동시에 말합니다. 9월 23일 개정판에서는 이 문장이 빠지고, 계정에서 쓸 수 있는 플러그인과 연결 앱을 Live에서도 쓸 수 있다는 문장이 들어갔습니다.
Work에서 음성을 쓰는 기능은 7월 23일 먼저 나왔지만 ChatGPT 데스크톱 앱에서만 됐습니다. 이번에 웹과 모바일로 넓어지면서 휴대폰에 말을 걸어 Work에 문서 작성이나 브라우저 작업을 맡길 수 있게 됐습니다. AI 제품 소식을 추적하는 TestingCatalog는 발표 2시간 뒤, 데스크톱 앱의 원격 세션 없이도 실제 업무를 할 수 있게 됐다고 평했습니다.
| 날짜(미국 시각) | ChatGPT 음성에 더해진 것 |
|---|---|
| 7월 8일 | GPT-Live-1(유료)·GPT-Live-1 미니(무료)로 교체, 듣기와 말하기를 동시에 |
| 7월 23일 | 데스크톱 앱의 Work·Codex에서 음성 사용 |
| 8월 7일 | 음성 대화 중 파일 업로드와 프로젝트 사용 |
| 9월 9일 | 검색·추론이 필요할 때 GPT-5.6이나 GPT-6 Astra에 일을 넘김 |
| 9월 23일 | 웹·iOS·안드로이드 음성에서 플러그인, 웹·모바일 Work에서 음성 |
오픈AI 제품 책임자 티보 소티오는 발표 23분 뒤 오픈AI 게시물을 인용해, 이제 ChatGPT에 전화를 걸어 일 이야기를 하고 메일을 확인하고 코딩을 하고 캘린더를 관리하는 데 익숙해졌다고 썼습니다. 외부 개발사가 만든 플러그인까지 전체 플러그인 생태계에서 된다는 설명도 붙였습니다.
@thsottiauxX 게시물 · 원문 보기
광고 속 인물은 말 한마디로 요트를 예약합니다. 한데 개정된 도움말은 승인이 필요한 행동이 나오면 음성이 화면에서 검토하라고 알리고, 사용자가 화면의 버튼으로 승인하거나 거절한다고 적었습니다. 말로 하는 승인은 지원하지 않는다고 못 박았고, 음성을 쓴다고 플러그인이나 연결 앱에 대한 접근 권한이 달라지지 않는다는 문장도 함께 넣었습니다. 같은 도움말은 CarPlay에서도 음성을 쓸 수 있다고 안내하면서, 운전 전에 설정을 끝내고 차가 움직이는 동안에는 기기를 만지지 말라고 당부합니다.
오픈AI는 다른 플러그인에서도 보내기 전에 묻는 방식을 써 왔습니다. 8월 20일 나온 Apple Messages 플러그인은 기본 설정에서 메시지를 보내기 전에 내용과 받는 사람을 사용자에게 승인받습니다. 반대쪽 숫자도 있습니다. 9월 14일 릴리스 노트를 보면 Health 사용자의 70% 넘게는 ChatGPT가 연결된 건강 데이터를 쓸 때마다 묻지 않도록 설정해 두었고, 오픈AI는 새 Health 연결의 기본값을 「위험이 낮은 행동은 허용」으로 맞췄습니다. 이 기본값에서도 운동 계획을 메일로 보내는 것 같은 민감한 행동은 따로 묻습니다.
광고에서 중복 결제를 찾아낸 가계부 기능 Finances는 5월 미국 Pro 사용자에게 먼저 열렸고 6월 미국 Plus 사용자로 넓어졌습니다. 은행 계좌는 Plaid로 연결하고, 오픈AI는 이 기능이 돈을 옮기거나 청구서를 내거나 거래를 할 수 없다고 적어 두었습니다. 광고 속 환불도 결제를 직접 되돌리지 않고 요청 메일을 보내는 방식입니다.
ChatGPT 음성은 두 모델이 나눠 일합니다. 사용자와 말을 주고받는 것은 GPT-Live-1이고, 검색이나 어려운 추론이 필요하면 뒤에 있는 더 큰 모델에 일을 넘깁니다. 7월 출시 때는 그 뒤편 모델이 GPT-5.5였고, 음성 경로와 추론 경로가 서로를 기다리지 않게 만든 과정은 오픈AI가 8월에 공개한 GPT-Live 제작기에 나옵니다.
9월 9일에는 뒤편 모델을 사용자가 고를 수 있게 됐습니다. 오픈AI의 애티 엘레티는 텍스트 채팅처럼 모델과 추론 강도를 고르면 음성이 검색하거나 추론할 때 그 모델을 쓴다고 알렸고, 이때 GPT-6 Astra는 Pro 사용자에게만 열렸습니다.
@athyuttamreX 게시물 · 원문 보기
이번 발표로 그 목록에 Sol과 Luna가 더해졌습니다. 두 모델은 9월 22일 공개된 GPT-6 계열의 중형·소형 모델로, 오픈AI는 Astra를 만든 방법을 더 빠르고 싼 모델에 옮겼다고 설명했습니다. 설정에서 고르는 목소리 9개 가운데에도 Sol이 있어 헷갈리기 쉬운데, 발표문이 말한 Sol은 GPT-6 Sol 모델입니다. 어떤 모델을 어느 한도까지 쓰는지는 요금제에 따라 다릅니다.
음성 사용량은 24시간 단위로 굴러가며 셉니다. 9월 9일 릴리스 노트와 도움말에 적힌 한도는 아래와 같습니다.
| 요금제 | 음성(Live) 한도 |
|---|---|
| Free | GPT-Live-1 미니, 제한적 사용 |
| Go | GPT-Live-1 미니 3시간 |
| Plus | GPT-Live-1 3시간 |
| Pro(월 100달러) | GPT-Live-1 15시간 |
| Pro(월 200달러) | GPT-Live-1 무제한 |
| Business Standard | 3시간, 넘으면 분당 1.25크레딧 |
| Enterprise(달러 사용량 과금) | 분당 0.05달러 |
API로 같은 모델을 쓰는 개발자는 GPT-Live-1 세션에 분당 0.05달러를 초 단위로 내고, 뒤편 모델과 도구 사용료는 따로 냅니다. Plus 사용자가 하루 한도 3시간을 다 쓰면 API 요금표로 9달러어치이고, 이 금액에는 뒤편 모델이 일한 값이 들어 있지 않습니다. Work에서 음성으로 시킨 일은 음성 한도와 별개로 Work 사용량에도 잡히고, 무제한을 주는 200달러 요금제는 오픈AI가 9월 10일 GPT-6 Astra 수요를 이유로 신규 가입을 멈춘 바로 그 요금제입니다.
Work에서 말로 맡긴 일은 통화를 끊은 뒤에도 돌아갑니다. 오픈AI는 캐싱 발표문에서 이런 에이전트 뒤의 애플리케이션이 앞선 요청 위에 쌓아 올린 API 요청을 줄줄이 보내고, 대개 같은 지침과 도구 정의, 이전 대화를 다시 싣는다고 설명했습니다. 작업이 길어질수록 같은 앞부분을 다시 보내는 횟수도 늘어납니다.
모델은 입력 토큰마다 중간 계산값(키·값 상태)을 만들어야 답을 쓸 수 있습니다. 프롬프트 캐싱은 앞선 요청과 똑같이 시작하는 앞부분의 계산값을 저장해 두었다가 다음 요청에서 다시 씁니다. 오픈AI 문서는 캐시가 토큰을 저장하지 않고 키·값 텐서를 저장한다고 설명하고, GPT-6 계열은 캐시에서 읽은 토큰에 입력값의 10%만 매깁니다.
@OpenAIDevsX 게시물 · 원문 보기
9월 23일 오픈AI 가격표 보관본에 적힌 GPT-6 세 모델의 값은 아래와 같습니다. 캐시에 처음 쓸 때는 입력값의 1.25배, 다시 읽을 때는 0.1배입니다.
| 모델(100만 토큰당) | 입력 | 캐시 쓰기 | 캐시 읽기 | 출력 |
|---|---|---|---|---|
| GPT-6 Astra | 10달러 | 12.50달러 | 1.00달러 | 50달러 |
| GPT-6 Sol | 2달러 | 2.50달러 | 0.20달러 | 10달러 |
| GPT-6 Luna | 0.10달러 | 0.125달러 | 0.01달러 | 0.50달러 |
오픈AI 가이드가 든 계산은 이렇습니다. 같은 앞부분을 한 번 캐시에 쓰고 한 번 다시 읽으면 보통 입력값의 1.35배, 캐시 없이 두 번 처리하면 2배가 듭니다. 요청이 10번이면 쓰기 1번과 읽기 9번이 2.15배, 캐시 없이는 10배입니다. 이 배수를 Sol 가격에 넣으면 앞부분 100만 토큰어치를 10번 보내는 데 캐시 없이 20달러, 캐시로 4.30달러가 듭니다. Astra로는 100달러와 21.50달러입니다.
할인에는 조건이 붙습니다. 캐시는 마지막으로 쓰거나 다시 읽은 뒤 30분 동안 쓸 수 있고, 다시 읽으면 쓰기 요금 없이 수명이 늘어납니다. 30분이 지나면 캐시가 남아 있다는 보장이 없고, 캐시가 사라진 뒤의 요청은 앞부분을 다시 써서 캐시를 쓰지 않을 때보다 25% 더 냅니다. 앤트로픽의 5분 캐시에서 도구 호출이 5분을 넘기면 부모 대화의 캐시가 사라지던 문제는 앤트로픽의 비용 절감 글에서 다뤘는데, 오픈AI에서는 도구 하나가 30분 넘게 돌 때 같은 일이 생깁니다.
앞부분은 1,024토큰을 넘어야 캐시에 들어가고, 처음부터 끝까지 한 글자도 다르지 않아야 캐시에서 다시 쓸 수 있습니다. 시스템 지침 앞쪽에 요청마다 달라지는 시각을 넣거나 도구 정의의 순서를 바꾸면 그 뒤가 모두 새로 처리됩니다. 발표문에 실린 진단 도구 예시에는 도구 정의가 달라져 5,629토큰을 캐시에서 읽지 못했다는 결과가 찍혀 있습니다. 캐시는 머신마다 따로 저장돼서, 한 머신에 분당 15건 넘는 요청이 몰리면 캐시가 없는 다른 머신으로 넘어갈 수 있습니다.
1,024토큰 기준에서 나오는 계산도 가이드에 있습니다. 요청을 10번 보낸다면 221토큰이 넘는 짧은 지침은 쓸모 있는 예시를 더해 1,024토큰으로 늘리는 쪽이 오히려 쌉니다. 103토큰짜리 지침은 1,963번 넘게 보내야 늘린 값을 뽑고, 102토큰 이하는 아무리 보내도 이득이 나지 않습니다.
오픈AI는 블로그에서 GPT-6 계열과 함께 기본 적중률을 높인 캐싱 시스템을 내놓았다고 썼습니다. 한데 개발자 문서 보관본을 거슬러 올라가면 8월 26일 판에 이미 GPT-5.6부터 적용된 30분 유지, 1.25배 쓰기 요금, 사용자가 캐시 지점을 고르는 명시적 브레이크포인트, 캐싱 대시보드가 적혀 있습니다. 진단 도구 문서도 발표 전인 9월 21일 보관본에 먼저 올라와 있었습니다.
9월 22일 판에서 새로 붙은 것은 두 가지입니다. 사용자가 질문하기 전에 공통 지침과 도구 정의를 미리 처리해 두는 캐시 미리 데우기(prewarm) 항목이 생겼고, 대화 도중 추론 강도를 바꿔도 캐시를 지키는 configuration_update는 GPT-6 Astra 전용에서 GPT-6 모델 전체로 넓어졌습니다. 발표문이 내세운 기본 적중률 향상에는 오픈AI 전체의 전후 숫자가 없고, 고객 사례만 실렸습니다.

캐시 할인 자체도 2년 사이 여러 번 모양이 달라졌습니다. 할인 폭은 50%에서 90%로 커졌고, 유지 시간과 쓰기 요금은 모델 세대마다 다르게 붙었습니다.
| 시기 | 대상 모델 | 캐시 입력 할인 | 쓰기 요금 | 유지 시간 |
|---|---|---|---|---|
| 2024년 10월 | GPT-4o 등 | 50% | 없음 | 5~10분 쓰지 않으면 삭제, 최대 1시간 |
| 2025년 11월 | GPT-5.1 등 | 90% | 없음 | 확장 보관 최대 24시간 |
| GPT-5.6 이후 | GPT-5.6·GPT-6 | 90% | 입력의 1.25배 | 마지막 사용 뒤 최소 30분 |
GPT-5.5는 24시간 보관만 지원했는데 문서에 적힌 유지 시간은 보통 30분 안팎, 길면 24시간이었고 쓰기 요금은 따로 없었습니다. GPT-5.6부터는 쓰기에 25% 웃돈을 받는 대신 최소 30분을 문서로 약속했습니다.
발표문에 실린 고객 숫자는 적중률 몇 %포인트가 청구서에서 얼마가 되는지 가늠하게 합니다. 에이전트 서비스 매너스(Manus)는 오픈AI 엔지니어들과 캐시 지점을 다시 잡아 일주일이 안 돼 적중률을 약 85%에서 90% 이상으로 올렸습니다. 워드스미스(Wordsmith)는 세션 에이전트를 명시적 브레이크포인트로 옮긴 뒤 일주일 안에 평가 적중률이 83%에서 91%가 됐고, 캐시 쓰기가 약 3분의 2 줄면서 추론 비용이 36% 내려갔습니다. 스트로베리 브라우저는 적중률을 몇 %포인트 올려 비용을 20% 줄였다고 밝혔습니다.
매너스 같은 장시간 에이전트에게 안정적인 캐싱은 경제성의 기본입니다.— 빈 판, 매너스 에이전트 팀 리드
작은 차이가 큰 절감으로 이어지는 이유는 단가에 있습니다. 적중률이 83%에서 91%로 오르면 캐시에서 찾지 못한 토큰이 17%에서 9%로 거의 반이 되고, 이 토큰은 캐시에서 읽은 토큰보다 10배 비쌉니다. 쓰기 요금을 빼고 입력만 치면 입력값이 약 28% 줄어드는 계산이 나옵니다. GitHub Copilot 쪽 숫자도 발표문에 실렸습니다.
지난 몇 달 동안 오픈AI 모델로 보낸 수십억 건의 요청에서, 새로 처리해야 하는 프롬프트 토큰의 비중을 이전 기준보다 50% 넘게 줄였습니다.— 마리오 로드리게스, GitHub 최고제품책임자
오픈AI 개발자 계정은 9월 23일 새벽 GPT-6 Sol과 Luna를 알리면서, 캐싱과 추론을 효율화한 덕에 두 모델을 더 싸게 제공하게 됐고 그 절감분을 API 가격으로 돌려준다고 썼습니다. 함께 올린 표에서 Sol은 입력 4달러·출력 20달러에서 2달러·10달러로, Luna는 0.20달러·1.20달러에서 0.10달러·0.50달러로 내려갔습니다.
@OpenAIDevsX 게시물 · 원문 보기
비교 기준인 GPT-5.6 Sol의 4달러는 프로모션 가격입니다. 6월 말 GPT-5.6이 나올 때 Sol은 입력 5달러·출력 30달러, Luna는 1달러·6달러였고, 7월 30일(미국 시각) Luna 값을 80% 내린 뒤 8월에 Sol 프로모션이 붙었습니다. 3개월 사이 Luna의 입력값은 10분의 1이 됐고, 캐시에서 읽는 Luna 입력은 100만 토큰당 0.01달러입니다.
앤트로픽은 프롬프트 캐싱을 처음 내놓을 때부터 쓰기에 25% 웃돈을 받고 읽기는 입력값의 10%로 매겼고, 2024년 12월 17일 정식 기능으로 풀었습니다. 9월 23일 앤트로픽 가격 문서 보관본을 오픈AI와 견주면 쓰기 웃돈은 같고 유지 시간과 읽기 값이 다릅니다.
| 항목 | 오픈AI GPT-6 | 앤트로픽 Claude |
|---|---|---|
| 캐시 쓰기 | 입력의 1.25배 | 5분 캐시 1.25배, 1시간 캐시 2배 |
| 캐시 읽기 | 입력의 0.1배 | 0.1배(Opus 5.5 0.05배, Fable 5.1 0.025배) |
| 유지 시간 | 마지막 사용 뒤 최소 30분 | 5분 또는 1시간 |
| 같은 급 가격 | Sol 입력 2달러, 읽기 0.20달러 | Sonnet 5 입력 2달러, 읽기 0.20달러 |
같은 1.25배를 내고 오픈AI는 30분, 앤트로픽은 5분을 줍니다. 우버가 8월에 공개한 계산에 이 차이가 드러납니다. 우버는 엔지니어가 턴 사이에 2분, 16분, 3분, 14분을 비운 5턴 세션을 예로 들었는데, 5분 캐시는 두 번 만료돼 캐시 비용이 앞부분을 캐시 없이 한 번 보내는 값의 3.95배가 됐고 1시간 캐시는 2.40배였습니다. 같은 간격을 오픈AI의 30분 규칙에 넣으면 한 번도 만료되지 않아 쓰기 1.25배에 읽기 4번 0.4배를 더한 1.65배가 나옵니다.
대신 앤트로픽은 9월 22일(미국 시각) 공개한 Opus 5.5의 캐시 읽기를 입력값의 5%로 매겼습니다. 읽기가 쌓일수록 읽기 단가가 낮은 쪽이 유리하고, 턴 사이가 5분을 넘기는 작업이라면 유지 시간이 긴 쪽이 유리합니다.

음성 플러그인은 최신 앱에서 전 세계에 차례로 열리고 있고, Free와 Go 사용자도 요금제가 지원하는 플러그인은 음성에서 쓸 수 있습니다. 다만 쓸 수 있는 플러그인은 요금제와 지역, 작업 공간 설정에 따라 다르고, 광고에 나온 Finances는 미국 사용자만 씁니다. Work에서 음성을 쓰려면 음성과 Work 권한이 모두 있어야 하고, 메일 발송이나 예약처럼 승인이 필요한 행동은 휴대폰 화면에서 눌러야 마무리됩니다.
국내에도 캐시 구조를 고쳐 비용을 줄인 기록이 있습니다. 앞서 소개한 앤트로픽 글에 실린 무신사 29CM 가격 팀은 1만 5,000토큰짜리 시스템 프롬프트를 고정 부분으로 떼어 캐시에 올린 뒤 캐시 읽기 비중을 0%에서 약 98%로 올리고 LLM 청구액을 64% 줄였습니다. 오픈AI 모델에서도 대시보드로 적중률을 바로 볼 수 있고, 30분 넘게 쉬는 작업이나 요청마다 달라지는 지침 앞머리처럼 캐시를 깨는 지점은 진단 도구가 토큰 수로 알려 줍니다.
음성으로 맡긴 일의 성공률이나 승인 요청이 한 작업에 몇 번 뜨는지 같은 숫자는 아직 공개되지 않았습니다. 그 숫자가 나오면 다시 전하겠습니다.
읽어 주셔서 고맙습니다.
초이 드림