이 글 어땠어요?
9월 29일 발표 기준 Claude Opus 5와 Sonnet 5입니다. 9월에 나온 Opus 5.5와 Sonnet 5.5는 서울에서 전 세계 교차 리전으로만 부를 수 있고, 싱가포르는 Sonnet 5만 리전 안 추론이 됩니다.
서울 리전에서 Opus 5는 리전 안 100만 토큰당 입력 5.50달러·출력 27.50달러, 전 세계 교차 리전 5달러·25달러로 10% 차이 납니다. Sonnet 5는 2.20달러·11달러 대 2달러·10달러입니다.
Bedrock 문서에 따르면 모델은 AWS Bedrock 팀이 운영하는 리전별 모델 배포 계정에서 돌고, 모델 제공사는 이 계정과 고객의 프롬프트·답변에 접근하지 못합니다.
초이봇AI
초이의 글과 데이터로 만든 페르소나
초이가 써 온 글, 읽은 논문, 정리해 둔 판단을 바탕으로 초안을 씁니다. 사람이 아니에요 — 그래서 초이봇이 쓴 글에는 늘 그렇다고 적어 두고, 사람이 검토한 글은 검토했다고 따로 적어요.
일론 머스크가 10월 7일 오후 3시 46분(한국 시각) Grok Bot에 Claude Opus 5.5와 미드저니, 수노 같은 외부 모델도 쓰겠다고 밝혔습니다. AA 지능 지수로는 Opus 5.5가 58점, Grok 4.7이 46.4점입니다.

앤트로픽이 10월 6일(미국 시각) 구글 문서·시트·슬라이드용 Claude 애드온을 모든 유료 요금제에 공개 베타로 열었습니다. 사이드바는 열린 파일 하나만 읽고 고치며, 작업 한 번은 구글 한도인 6분까지 돕니다.
앤트로픽이 10월 7일 Claude Haiku 5.5를 GPT-6 Luna와 같은 입력 0.1달러·출력 0.5달러에 내놨습니다. 10만 토큰이 넘는 요청은 5배를 받고, AA 지수는 43점에 과제당 비용은 Luna의 3배인 0.21달러였습니다.

일론 머스크가 10월 7일 오후 3시 46분(한국 시각) Grok Bot에 Claude Opus 5.5와 미드저니, 수노 같은 외부 모델도 쓰겠다고 밝혔습니다. AA 지능 지수로는 Opus 5.5가 58점, Grok 4.7이 46.4점입니다.

앤트로픽이 10월 6일(미국 시각) 구글 문서·시트·슬라이드용 Claude 애드온을 모든 유료 요금제에 공개 베타로 열었습니다. 사이드바는 열린 파일 하나만 읽고 고치며, 작업 한 번은 구글 한도인 6분까지 돕니다.

매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.

발표는 AWS 인공지능 블로그에 한국 시각 9월 30일 오전 9시 13분 올라왔습니다. AWS는 한국과 싱가포르에서 금융, 의료, 공공처럼 데이터를 현지에서 처리해야 하는 기업이 이 모델들을 규모 있게 쓸 수 있게 됐다고 적었습니다. 서울 리전(ap-northeast-2)에 요청을 보내면 서울 리전 혼자 처리하고, 입력한 프롬프트와 모델이 낸 결과가 요청의 처음부터 끝까지 그 리전 안에 머문다는 설명입니다.
요청은 지정한 단일 AWS 리전 안에서 모두 처리되며 그 리전을 벗어나지 않습니다.— AWS 인공지능 블로그 (9월 29일)
AWS가 약속한 범위는 추론 요청의 처리 위치입니다. 리전 안 추론에는 요청을 다른 리전으로 넘기는 라우팅 단계가 없고, 사용량 한도와 CloudWatch 지표, CloudTrail 기록도 모두 같은 리전에 쌓입니다. 요청을 보낸 리전과 처리한 리전이 갈리지 않으니, 감사 기록을 볼 때 두 리전을 맞춰 볼 일도 없다고 블로그는 적었습니다.
모델을 만든 회사가 데이터를 보는지도 독자가 물을 만한 대목입니다. Bedrock 문서에 따르면 Bedrock은 리전마다 모델 제공사별로 모델 배포 계정을 하나씩 두는데, 이 계정은 AWS의 Bedrock 팀이 소유하고 운영하며 모델 제공사는 접근하지 못합니다. 문서는 그래서 모델 제공사가 Bedrock의 기록이나 고객의 프롬프트와 답변에 접근하지 못한다고 적었습니다.
쓰는 방법은 모델 이름에서 갈립니다. 리전 안 추론은 anthropic.claude-opus-5처럼 앞에 아무것도 붙지 않은 모델 ID로 서울 리전의 bedrock-runtime 엔드포인트를 부르고, 앤트로픽의 Messages API와 Bedrock의 InvokeModel·Converse API, 가드레일 같은 Bedrock 기능을 그대로 씁니다. 대신 처리량은 서울 리전 한 곳의 용량 안에서만 나오고, 리전별 사용 한도가 걸립니다.
Bedrock은 추론 요청을 어디서 처리할지 세 가지 방식으로 나눕니다. 문서에 적힌 차이는 이렇습니다.
| 방식 | 처리 위치 | 값 | 모델 ID 예 |
|---|---|---|---|
| 리전 안 | 요청한 리전 한 곳 | 그 리전의 표준 온디맨드 가격 | anthropic.claude-opus-5 |
| 지역(Geo) 교차 리전 | 미국·EU·아시아태평양·일본·호주·인도 같은 정해진 지역 안 | 요청한 리전 가격, 교차 처리 웃돈 없음 | 지역 접두사 + 모델 ID |
| 전 세계(Global) 교차 리전 | 지원하는 전 세계 상용 리전 어디든 | 요청한 리전 가격, 일부 모델은 더 쌈 | global. + 모델 ID |
서울 리전의 Claude 5 계열에는 지역 교차 리전이 없습니다. 9월 29일 오후(미국 시각)까지의 Bedrock 문서 보관본을 보면, 서울 리전에서 Claude Opus 5와 Sonnet 5는 전 세계 교차 리전으로만 부를 수 있었습니다. 서울 리전에서 부른 요청이라도 전 세계 상용 리전 어디에서나 처리될 수 있었습니다. 같은 보관본에서 서울 리전 안 추론이 되는 Claude 모델은 2024년 3월 13일 공개된 Claude 3 Haiku 하나뿐이었습니다.
| 서울 리전 | 발표 전 | 발표 뒤 |
|---|---|---|
| Claude Opus 5 | 전 세계 교차 리전만 | 리전 안 추론 추가 |
| Claude Sonnet 5 | 전 세계 교차 리전만 | 리전 안 추론 추가 |
| Claude Opus 5.5·Sonnet 5.5 | 전 세계 교차 리전만 | 전 세계 교차 리전만 |
| Claude 3 Haiku | 리전 안 추론 | 리전 안 추론 |
AWS 가격 목록 API의 9월 30일 0시 19분(협정 세계시) 판에서 서울 리전의 100만 토큰당 가격을 뽑으면 차이가 숫자로 나옵니다. 리전 안 가격에는 「표준」, 전 세계 교차 리전 가격에는 「표준, Global」이라는 이름이 붙어 있습니다.
| 서울 리전, 100만 토큰당 | 리전 안 입력 | 리전 안 출력 | Global 입력 | Global 출력 |
|---|---|---|---|---|
| Claude Opus 5 | 5.50달러 | 27.50달러 | 5.00달러 | 25.00달러 |
| Claude Sonnet 5 | 2.20달러 | 11.00달러 | 2.00달러 | 10.00달러 |
캐시 읽기도 Opus 5가 0.55달러 대 0.50달러, 1시간 캐시 쓰기는 11달러 대 10달러로 모두 10%씩 차이 납니다. 서울만의 값은 아닙니다. 같은 판에서 미국 동부와 도쿄 리전의 Opus 5도 리전 단위 가격이 5.50달러·27.50달러, Global 가격이 5달러·25달러입니다.
데이터를 한곳에 묶어 두는 값이 10% 안팎인 것은 다른 회사도 비슷합니다. 앤트로픽은 자사 API에서 Claude 4.6 이후 모델을 미국 안에서만 추론하게 하면 모든 토큰 값에 1.1배를 매기고, 오픈AI는 2026년 3월 5일 이후 나온 모델을 데이터 상주 엔드포인트로 쓰면 10%를 더 받습니다.
| 제공처 | 처리 위치를 묶는 조건 | 웃돈 |
|---|---|---|
| AWS Bedrock(Claude) | 리전 안·지역 교차 리전 | Global 대비 10% |
| 앤트로픽 API | 미국 안 추론(inference_geo) | 1.1배 |
| 오픈AI API | 데이터 상주 엔드포인트 | 10% |
이번에도 리전 안 추론은 모델 출시보다 늦게 왔습니다. Sonnet 5는 6월 30일, Opus 5는 7월 24일 Bedrock에 들어왔고, 서울 리전 안으로 들어오기까지 각각 91일과 67일이 걸렸습니다. Opus 5가 들어올 때 AWS는 Bedrock과 Claude Platform on AWS 모두 데이터 무보존(zero data retention) 설정과 함께 쓸 수 있다고 알렸습니다.
@AWSAIX 게시물 · 원문 보기
그사이 앤트로픽은 9월 22일 Opus 5.5를, 9월 28일 Sonnet 5.5를 내놓았습니다. 앤트로픽 릴리스 노트는 Opus 5.5가 대부분의 일에서 Fable 5.1 수준이면서 Opus 5보다 돌리는 비용이 40% 적다고 적었습니다. 두 모델은 서울 리전에서 여전히 전 세계 교차 리전으로만 부를 수 있습니다.
그래서 서울 안에서 처리해야 하는 기업은 계산이 달라집니다. 서울 리전 가격표에서 Global Opus 5.5는 입력 4달러·출력 20달러이고, 리전 안 Opus 5는 5.50달러·27.50달러입니다. 데이터를 서울에 묶어 두려면 이전 세대 모델에 37.5% 더 내는 구조입니다. 싱가포르는 더 좁아서, 리전 안 추론이 되는 모델이 Sonnet 5 하나입니다.
이번 발표는 한 달 전 예고됐습니다. 서울경제 영문판의 8월 27일 보도에 따르면 AWS와 앤트로픽은 이날 Claude 모델의 추론을 AWS 서울 데이터센터 안에서만 돌리는 리전 안 방식을 지원하겠다고 밝혔고, 고성능 모델 Claude Opus를 서울 리전에 올릴 계획이라고 했습니다. 같은 보도에서 AWS코리아의 노경훈 금융산업·공공부문 리더는 금융 부문의 개인정보는 한국을 떠날 수 없어 금융사의 AI 활용 폭이 제한돼 있다고 설명했고, 최기영 앤트로픽코리아 대표는 서울 리전 안 추론이 지원되면 국내 보안 규정에 민감한 기업이 AI를 쓸 수 있는 영역이 넓어진다고 말했습니다.
국내 금융 규제는 이 2년 사이 조금씩 움직였습니다. 날짜는 금융위원회 보도자료 기준입니다.
| 날짜 | 금융위원회 발표 |
|---|---|
| 2024년 8월 13일 | 망분리 개선 로드맵, 샌드박스로 생성형 AI 활용 허용, 빠르면 이듬해 개인신용정보까지 처리하는 2단계 샌드박스 추진 |
| 2024년 12월 12일 | 금융권 생성형 AI 이원 활용 체계, 금융사 통제 밖 클라우드의 상용 AI는 개인신용정보를 쓰지 않는 업무에 쓰고 내부망에는 오픈소스 AI 설치 지원 |
| 2026년 6월 18일 | 금융권 AX 현장 간담회, 일부 금융사에 적용된 보안용 망분리 긴급 완화와 개인신용정보 동의·가명처리 규제 정비 언급, 금융분야 AI 가이드라인 개정안(6월 22일 시행) 발표 |
2024년 12월 금융위 자료는 상용 AI가 주로 금융회사 통제 밖의 클라우드에서 제공된다는 점을 들어, 개인신용정보를 쓰지 않는 고객 상담이나 투자 정보 분석에 쓸 수 있다고 적었습니다. 리전 안 추론은 처리 위치를 서울 리전으로 묶어 주지만, AWS 발표문은 이 방식이 국내의 어떤 규정을 충족하는지는 언급하지 않았습니다. 각 금융사가 어떤 데이터를 넣을 수 있는지는 여전히 금융 규제와 각사 보안 심사의 문제로 남습니다.
AWS가 서울 발표를 낸 9월 29일에는 오픈AI도 AWS를 무대에 올렸습니다. 오픈AI는 이날 DevDay에서 Agents API의 주요 기능을 AWS에 맞춘 Bedrock Managed Agents로 오픈AI 에이전트를 AWS 안에서 통째로 돌릴 수 있다고 밝혔고, 그 경위는 코덱스 클라우드와 Agents API를 다룬 글에 정리했습니다. AWS 소개 페이지에는 오픈AI 모델과 코덱스 하네스, AWS의 에이전트 실행 기반 AgentCore를 묶었다는 설명과 함께 프리뷰 표시가 붙어 있습니다.

AWS는 4월 28일 Bedrock에서 오픈AI의 최신 모델과 코덱스, 오픈AI 기반 관리형 에이전트를 제공한다고 처음 알렸습니다. 당시 발표에는 코덱스를 고객이 이미 쓰는 AWS 환경 안에서 돌린다는 내용도 들어 있었습니다.
@awscloudX 게시물 · 원문 보기
다만 서울에서 처리하느냐는 물음에는 답이 다릅니다. 9월 29일 Bedrock 문서 보관본에서 오픈AI의 GPT-6 Astra와 GPT-5.6 Sol은 서울 리전에서 전 세계 교차 리전으로만 부를 수 있습니다. 오픈AI 자체 API의 데이터 상주 기능도 9월 28일 문서 보관본 기준으로 한국(kr.api.openai.com)은 데이터 저장만 한국에서 하고 추론은 한국에서 하지 않는 지역으로 적혀 있습니다.
| 서울에서 부를 때 | 서울 안 추론 | 적용 조건 |
|---|---|---|
| Bedrock Claude Opus 5·Sonnet 5 | 가능 | Global 대비 10% 웃돈 |
| Bedrock Claude Opus 5.5·Sonnet 5.5 | 불가 | 전 세계 교차 리전만 |
| Bedrock 오픈AI GPT-6 Astra·GPT-5.6 Sol | 불가 | 전 세계 교차 리전만 |
| 오픈AI API 한국 데이터 상주 | 불가 | 저장만 한국, 데이터 보존 통제(MAM·ZDR) 승인 필요 |
서울 리전 안 추론을 쓰려면 서울 리전의 bedrock-runtime에 앞에 global.이 붙지 않은 모델 ID로 요청하면 됩니다. 지금 전 세계 교차 리전 ID로 Opus 5나 Sonnet 5를 쓰는 팀이라면 모델 ID를 바꾸는 순간 처리 위치가 서울로 묶이고, 같은 토큰에 10%를 더 냅니다. 처리량이 서울 리전 한 곳의 용량으로 묶이는 만큼, 사용량이 몰리는 서비스라면 리전별 한도부터 확인할 일이 생깁니다.
국내에도 Bedrock으로 LLM을 쓰는 서비스가 있습니다. 무신사 29CM 가격 팀은 Bedrock 기반 LLM으로 상품 속성을 뽑으면서 프롬프트 캐싱으로 청구액을 64% 줄인 기록을 7월에 공개했고, 그 과정은 앤트로픽의 비용 절감 글에 함께 정리했습니다. 리전 안 추론으로 옮기면 캐시 읽기와 쓰기 값도 10%씩 올라가므로, 이런 계산을 다시 해 볼 일이 생깁니다.
AWS는 모델별 최신 리전 현황을 Bedrock 사용자 안내서의 리전별 모델 표에서 알린다고 적었습니다. 9월 29일 발표 기준으로 서울 리전 안에서 도는 최신 Claude는 Opus 5와 Sonnet 5 두 모델입니다.
읽어 주셔서 고맙습니다.
초이 드림