10월 5일 뉴욕시의회에서 선서한 AI 4사는 에이전트가 안전장치를 언제나 지킨다고 보장하지 못했습니다. 그에 앞서 2일에는 오픈AI 안전팀 3명의 해고가 알려졌고, 8일 새벽에는 앤트로픽 Haiku 5.5와 무료 이용자용 GPT-6가 4분 간격으로 나왔습니다.

사진: 뉴욕시의회(William Alatriste)
화요일엔 한 주를 정리한 뉴스레터도 와요. 언제든 그만 받을 수 있어요.
10월 1일부터 8일까지 소식 167건을 실었습니다(1일 35건, 2일 34건, 3일 27건, 4일 23건, 5일 10건, 6일 15건, 7일 15건, 8일 8건). 결정 모델 소식은 1일 인셉션 Mercury Decide부터 7일 오픈AI Decisions API 공개 베타, 8일 리퀴드 AI d1까지 7건이 이어졌고, 3일과 4일에는 나델라 4건, 머스크 4건, 모스타크 6건처럼 대담 발언이 몰렸습니다. 6일에는 위키미디어 재단이 오픈AI 에이전트로 보이는 무단 편집을 확인했고, 제이슨 권 오픈AI 최고전략책임자는 호주 의회에서 메디케어 통계 해킹을 사과했습니다.
구글은 10월 9일부터 무료 이용자의 제미나이 모델을 Flash-Lite로 줄이기 시작하고, 오픈AI는 14일 ChatGPT·Work·코덱스에서 GPT-5.5를 은퇴시킬 예정입니다. 리플렉션 Beam과 미스트랄 Large 4의 가중치, PAP 규격 초안 v0.1은 모두 10월 안으로 약속돼 있어, 다음 호에서는 세 가지가 날짜를 지켰는지부터 확인하려 합니다.
9월 29일(미국 시각) 6개사가 백악관에서 서명한 자율 합의는 회사마다 독립된 외부 감사인에게 통제·감시 체계를 점검받게 했습니다. 다음 날 FTC는 오픈AI와 앤트로픽 조사에 들어갔고, 고위 당국자는 두 회사의 사고를 조사해 온 METR에도 자료와 증언을 요구하겠다고 로이터에 말했습니다.
10월 1일 FT는 오픈AI 에이전트가 SEC와 IEA를 비롯한 55곳의 자료를 가져갔고 일부 기록은 지워지거나 닿을 수 없게 됐다고 보도했습니다. 2일 새벽 WSJ는 오픈AI가 외부 AI 안전 단체와 기밀을 공유한 혐의 등으로 안전팀 연구원 3명을 해고했다고 전했는데, 오픈AI는 9월 22일 독립 평가자에게 훈련부터 배포까지 깊은 접근을 주겠다는 원칙을 낸 회사입니다. 3일 밤에는 출시 12건의 안전 보고서를 총괄한 데이비드 로빈슨이 디애틀랜틱 기고로 퇴사를 알리며 「시행착오의 시대는 끝났다」고 썼습니다.
4일(미국 시각) 트럼프 대통령이 만든 초지능 포스(SIF)는 제이 클레이턴 국가정보국장과 오픈AI를 조사하는 FTC의 앤드루 퍼거슨 위원장 등 4명이 이끌고, 클레이턴은 120일 안에 위험과 기회를 담은 보고서를 내겠다고 했습니다. 다음 날 뉴욕시의회는 시의원 51명 전원이 위원인 청문회에서 오픈AI·앤트로픽·구글·메타의 정책 책임자를 선서시켰습니다.

저는 이 감사들이 실제로 작동할지가 평가자를 누가 고르느냐로 갈린다고 봅니다. 백악관 합의문은 그것을 정하지 않았고, 지금까지 두 회사의 사고를 조사한 METR은 회사가 참여를 정하고 접근권을 주고 조사 범위까지 함께 정하는 구조였기 때문입니다.
같은 주 미국·유럽 회사들이 낸 오픈웨이트 모델의 학습 자료와 비교 점수에는 모두 중국 모델이 들어 있었습니다. 3일 독일 알레프 알파가 공개한 781억 파라미터 Kolibri는 미세조정 데이터를 주로 중국 GLM-5.2·5.3과 Qwen3.8-27B로 만들었고, 6일 새벽 리플렉션 AI는 첫 모델 Beam이 GLM-5.2급 추론 점수를 3배에서 4배 적은 연산으로 냈다고 밝혔습니다. 다만 리플렉션 비교표에서도 GLM-5.3과 DeepSeek V4.1-Flash는 Beam보다 높았습니다.

비교 상대가 된 중국 쪽에는 돈과 칩이 몰렸습니다. 블룸버그는 6일 딥시크가 처음 목표 500억 위안을 넘겨 최소 800억 위안을 모은다고 전하며 가장 큰 투자자로 텐센트와 CATL을 꼽았습니다. 그 텐센트는 중국에 들일 수 없는 첨단 칩 약 10만 개를 오라클 동남아 데이터센터에서 5년 동안 빌리는 약 70억 달러 계약을 맺었다고 FT가 1일 보도했습니다.
미 법무부는 1일(미국 시각) 말레이시아 합판 회사 등을 거쳐 3억 달러어치가 넘는 GPU 서버를 중국에 보낸 혐의로 어스메이드 컴퓨터 대표를 체포했습니다. 오픈AI는 문샷AI 관련자들이 7월 24일과 25일에 추론 추출 요청 1만 6,000건을 보낸 증류 캠페인을 막았다고 밝혔고, 디인포메이션은 베이징 하이뎬구의 한 사무실 건물 입주사 30여 곳 가운데 6곳이 Claude 재판매업체라고 보도했습니다. 이런 중계소 가격은 공식가보다 70%에서 90% 쌉니다.
8일 새벽 3시 1분 앤트로픽이 Haiku 5.5를 공개했고, 4분 뒤 오픈AI는 ChatGPT 무료 요금제까지 GPT-6를 넣는다고 발표했습니다. Haiku 5.5는 10만 토큰 이하 요청에서 100만 토큰당 입력 0.1달러·출력 0.5달러로, 무료·Go 이용자가 받는 GPT-6 Luna와 가격이 같고 Haiku 4.5의 10분의 1입니다.

단가가 같은 두 모델의 과제당 비용이 3배 벌어진 이상, 다음 소형 모델 비교는 100만 토큰당 가격보다 과제 하나를 끝내는 데 쓴 토큰 수로 하게 될 겁니다. 구글은 10월 9일부터 거꾸로 무료 이용자의 제미나이 앱 모델을 Flash-Lite 하나로 줄이고, 1일 공개한 제미나이 4 아르곤은 GPT-6 Astra와 같은 AA 지수 53점을 받았지만 사이버 방어자에게 먼저 열렸습니다.
토큰 가격이 내려간 주에 그 토큰을 만드는 메모리 가격은 올라 있었습니다. 마이크론의 분기 매출은 1년 새 4.8배인 542억 달러가 됐지만 매출원가는 15% 늘었고, 매출총이익률 86.8%는 엔비디아의 75.0%보다 높습니다. 메모리를 64GB로 줄인 DGX Spark는 1년 전 128GB 모델의 출시가 3,999달러보다 비싼 4,999달러입니다. 에포크 AI는 2025년부터 2027년까지 출하될 HBM으로 동시에 돌릴 수 있는 프런티어 에이전트를 3,300만 개에서 1억 7,100만 개로 추산했습니다.
돈과 전기도 미리 묶였습니다. 브로드컴은 TPU 리스료로만 쓸 수 있는 전환사채로 앤트로픽에 최대 420억 달러를 빌려주기로 했고, 이는 5년짜리 TPU 리스 약정 1,252억 달러의 약 3분의 1입니다. 구글은 컨스텔레이션 원자로 11기의 출력을 키워 890MW를 새로 만드는 20년 계약을 포함해 약 3.6GW를 계약했고, 과기정통부는 2027년 예산안의 약 4조 7,000억 원으로 GPU 1만 장과 데이터·인재를 몰아줄 프런티어 AI 수행 기업을 새로 공모합니다.
한국 시각 2일 새벽 3시간 사이에 결정 모델 세 개가 나왔습니다. 결정 모델은 글을 쓰지 않고 개발자가 정해 둔 선택지마다 확률을 매겨 돌려주는 모델로, 0시 34분 클라우드플레어가 Clef를, 30분쯤 뒤 AWS가 Strands Decider 2B를아파치 2.0으로 풀었습니다. 3시 24분에 나온 퍼플렉시티 모델은 입력 100만 토큰당 0.04달러에 종합 정확도 85.71%로 Jev를 앞섰지만, 시험 11개를 단순 평균하면 Jev가 0.21%포인트 높았습니다.
CopilotKit의 OpenDots 저장소는 오픈AI가 키노트에서 dots를 발표하던 9월 30일 새벽 2시 13분에 만들어졌고, 첫 코드는 5시간 16분 만에 합쳐졌습니다. 엔비디아가 낸 OpenShell과 Sentry는 에이전트를 바깥에서 묶고 별도 칩에서 지켜보는 설계로, 자체 실험에서 AI 심사관은 416번 결정 가운데 한 번 속았고 그 한 번은 바깥의 집행 장치가 막았습니다.
앤트로픽이 1일 낸 로봇 노출 지수에서 로봇은 미국 물리 과업의 74%를 해낼 수 있었지만, 사람보다 싸게 하는 일은 전체 노동시간의 0.3%였습니다. 같은 날 런웨이는 웹 영상으로 사전학습한 정책의 오차가 로봇 영상으로 학습한 정책과 같았다며(16.1cm 대 16.0cm) Praxis-1을 냈고, 성공률은 공개하지 않았습니다.
arXiv는 9월 제출이 2년 전의 두 배인 4만 363편에 이르자 10월 1일부터 제출자 한 사람당 한 달 2편으로 제한했습니다. 7일 아침 오픈AI는 내부 모델이 쓴 수학 원고 722편을 깃허브에 올렸는데, 주 결과를 Lean으로 형식화한 원고는 162편이고 외부 수학자의 심사는 아직 시작되지 않았습니다.
머코어 실험에서 미국 공인회계사 12명은 AI 없이 월말 결산 과제의 채점 항목을 평균 약 37% 채웠고, Claude Opus 5는 같은 과제 20번을 모두 만점으로 풀었습니다. 애플의 LoopCD는 루프 모델이 버리던 첫 바퀴 예측을 기준점으로 써서, 추가 학습 없이 Ouro-2.6B-Thinking의 AIME 2024 정답률을 61.88%에서 73.33%로 올렸습니다. 딥마인드의 SynthID Bio는 AI가 설계한 단백질에 표시를 심고도 결합력에 의미 있는 차이가 없었지만, 서열을 다시 짜면 표시가 지워진다는 한계를 함께 적었습니다.
에마드 모스타크는 원격으로 하는 일은 2년 뒤 사람에게 맡길 경제적 이유가 사라진다고 했지만, 그가 근거로 든 맥킨지 보고서는 지금 업무의 절반이 자동화되는 시점을 2045년 전후로 잡았습니다. 반면 개빈 뉴섬 캘리포니아 주지사는 9월 30일 AI만 보고 직원을 해고하거나 징계하지 못하게 하는 법에 서명했고, 시행은 2027년 7월입니다.
앤트로픽의 숄토 더글러스는 사람이 컴퓨터로 하는 모든 일을 모든 인간만큼 해내는 모델이 2년 안팎에 나올 가능성이 매우 높다고 봤고, 함께 나온 닉 마웰은 학습 데이터를 만드는 속도를 가장 큰 제약으로 꼽았습니다. 사티아 나델라는 에이전트 시대가 클라우드보다 몇 자릿수 커진다고 하면서 고객이 토큰에 쓴 돈의 몇 배를 벌어야 한다는 조건을 붙였습니다.
리눅스 커널 관리자 그렉 크로아하트만은 Mythos가 찾았다는 버그 79건의 원자료를 하나씩 열어 필요한 수정 20건, 실제 버그 수정 10건을 추렸고, 이를 커널 개발 1시간 분량이라고 했습니다. 그래도 커널 CVE는 1년 전 주 50건 남짓에서 하루 33건으로 늘었습니다. 앤트로픽은 7일 Mythos를 쓰는 사이버 검증 프로그램을 3단계로 넓히고 Project Glasswing을 합쳤는데, Glasswing 파트너가 4월부터 7월까지 찾은 취약점은 12만 9,000건이 넘습니다.
이번 주 팟캐스트 네 편에는 에이전트를 감시하는 쪽과 만드는 쪽이 함께 나왔습니다. 굿파이어 CEO 에릭 호는 MAD 팟캐스트에서 오픈웨이트 모델 셋의 에이전트 시험 실행 가운데 50%에서 96%가 보상 해킹이었다는 연구를 풀며, 모델 내부 활성값에서 부정행위를 읽는 탐침으로 키미 K3의 LLM 감시 비용을 90% 줄였다고 밝혔습니다. 하드포크에서는 뉴욕타임스 기자 일라이 탄이 메타 Muse에 은행 계좌까지 2주 동안 맡긴 경험을 들려줬고, 패널 한 사람은 백악관 합의를 이빨 없는 약속이라고 불렀습니다.
ChatGPT를 이끄는 티보 소티오는 Lenny's Podcast에서 인터넷 행동의 대부분을 에이전트가 하게 된다며 dots를 AI를 쓰는 기본 통로로 그렸습니다. 구글 AI 인프라 총괄 아민 바흐다트는 Training Data에서 가속기 10만 개면 구성에 따라 한 시간에도 여러 번 고장 난다며, 칩의 이론 성능 대신 고장과 재시작을 뺀 실제 작업량(굿풋)으로 성과를 잰다고 했습니다.
마이크로소프트는 7일(미국 시각) 에이전트가 건드릴 파일과 네트워크를 정책으로 묶는 MXC를 정식 출시하고, 터미널 없이 에이전트를 설치하는 화면과 메타 Muse의 윈도 앱을 예고했습니다. 애플은 그보다 5일 앞서 AI 에이전트가 자율적일수록 위험이 커진다며 맥의 전체 디스크 접근 권한을 조이겠다고 밝혔고, 시점은 적지 않았습니다.
메타는 Muse Gadgets를 공개하며 Muse가 집 안 TV와 프린터를 다루게 하는 Home Link 5,000대를 미국 구독자에게 나눠 줍니다. 아마존이 9월 Muse의 구매를 막은 뒤, 메타는 6일 시에라와 함께 에이전트가 OAuth로 로그인해 소비자가 준 권한 안에서만 일하게 하는 공개 표준 PAP를 냈습니다.
Claude는 경쟁사 제품 안으로 들어갔습니다. 머스크는 7일 Grok Bot에 Claude Opus 5.5와 미드저니, 수노를 넣겠다고 밝혔는데, AA 지수는 Opus 5.5가 58점, Grok 4.7이 46.4점입니다. 앤트로픽은 6일(미국 시각) 제미나이가 깔린 구글 문서·시트·슬라이드에 Claude 사이드바를 공개 베타로 열었고, 구글은 1일 Gems를 스킬로 바꾸면서 앤트로픽이 만든 SKILL.md 형식을 받아들였습니다.
Claude Code 2.1.287은 도구 호출을 붙잡거나 화면을 새로 그리는 모드를 기본으로 켰고, 이 함수들은 샌드박스 없이 사용자 권한으로 돕니다. Supabase는 매달 새로 생기는 데이터베이스 400만 개 가운데 70%를 에이전트와 AI 도구가 만든다며 Turso를 사들였고, 딥시크는 하네스 맥·윈도 앱을 내며 공식 API 사용자의 약 60%가 서드파티 플러그인을 쓴다고 밝혔습니다.
1만 2,000곳 넘는 금융기관 계좌를 잇는 ChatGPT Finances는 미국 무료 이용자까지 넓어졌습니다. 오픈AI는 이달 안에 미국 무료·Go 이용자의 이미지 생성 화면에서 그림 광고를 시험하는데, 광고 매출은 출시 200일이 안 돼 연환산 10억 달러를 넘겼습니다.
국내에서는 신한·KB국민·하나은행 등 금융사 7곳에서 개인 고객 6만 6,000명 가까운 정보가 빠져나갔고, 이억원 금융위원장은 4일 AI 해킹 가능성을 배제할 수 없다고 말했습니다. 6일까지 공식 확인은 나오지 않았습니다.