오픈라우터
OpenRouter
여러 회사의 모델을 하나의 API로 중계하고 사용량 순위를 공개하는 서비스입니다. 제작사 표기 없이 익명 모델을 먼저 올려 반응을 보는 통로로도 쓰여서, GLM-5.3-Flash는 공개 전 Ox Alpha라는 이름으로 이곳에 올라와 있었습니다.
‘오픈라우터’ 이 나오는 글8
막은 사기 금액이 한 달 새 10배, OpenRouter가 Stripe로 간 이유
OpenRouter CEO 알렉스 아탈라와 AMP의 안즈니 미다가 9월 25일 Latent Space에서 하루 10조 토큰을 넘긴 과정과 Stripe 합류 배경을 풀었습니다. 아탈라는 지난달 막은 사기 금액이 전달의 10배였다고 밝혔습니다.

엔비디아 GPU로 초당 1,107토큰, 에르몬 "더 병렬적인 해법이 이긴다"
확산 모델 연구자 스테파노 에르몬이 9월 18일 No Priors에서 한 번에 여러 토큰을 만드는 확산 언어 모델이 추론에서 유리하다고 말했습니다. 그가 이끄는 Inception의 Mercury 2.5는 엔비디아 GPU에서 초당 1,107토큰을 낸다고 회사가 밝혔습니다.

GPT-5.6 Sol과 같은 점수를 40% 싸게, 메타 Muse Spark 1.3
메타가 1.2를 낸 지 4주 만인 9월 2일 Muse Spark 1.3을 공개했습니다. 과제당 비용은 0.40달러에서 0.55달러로 올랐지만 59점 이상 모델 가운데 가장 쌉니다. 저커버그는 다음 순서로 수박 이모지와 Muse Spark 오픈웨이트를 예고했습니다.
복면 벗은 1위 모델 Ox Alpha, 정체는 Z.ai GLM-5.3-Flash
Ox Alpha는 OpenRouter에서 6일 동안 토큰 23조 2,000억 개를 처리해 2위의 2.3배를 기록했습니다. 정체를 밝힌 GLM-5.3-Flash는 과제당 0.09달러로 같은 57점 모델보다 4.4~5.7배 싸고, Z.ai는 이를 모두 중국산 칩으로 처리했다고 밝혔습니다.

"특이점은 1월 1일 시작됐다", Stripe가 투자자 서한에 적은 근거
Stripe 투자자 서한은 OpenRouter의 토큰 소비가 올해 들어 매주 9%씩 복리로 늘었다고 적었습니다. 약 8주마다 두 배가 되는 속도로, 투자사 Menlo Ventures가 계산한 3년 평균인 11주보다 빠릅니다.

80일 새 몸값 5배, Stripe가 모델 중개 회사 OpenRouter를 삽니다
5월 28일 시리즈 B에서 13억 달러 가치를 인정받은 OpenRouter를 Stripe가 70억 달러 넘게 주고 사기로 했다는 블룸버그 보도가 나왔습니다. 인수가 성사되면 에이전트가 모델을 고르고 토큰을 쓰고 값을 치르는 과정이 한 회사 안에 묶입니다.

함께 나오는 용어5
- 토큰모델이 텍스트 등을 나누어 처리하는 단위입니다. 단어 전체, 단어의 일부, 문자나 기호가 토큰으로 나뉠 수 있으며, 같은 문장도 토크나이저와 언어에 따라 개수가 달라집니다. 글자 수와 고정된 비율로 대응하지 않습니다. 입력·출력 토큰 수는 컨텍스트 한도와 API 과금의 기준으로 쓰입니다.
- 에이전트한 번 답하고 멈추지 않고, 스스로 계획하고 도구를 부르고 결과를 확인하며 여러 단계를 이어가는 AI입니다. 브라우저·터미널·앱을 대신 조작하는 것이 대표 예입니다.
- 추론학습이 끝난 모델을 실제로 돌려 답을 만드는 단계입니다. 비용·속도·지연 시간 이야기는 대부분 여기서 나옵니다.
- 처리량일정 시간에 처리하거나 전달한 작업·데이터의 양입니다. 초당 요청 수, 토큰 수, 비트 수처럼 대상과 단위를 함께 표시합니다. 와트당 처리량은 전력까지 나눈 별도의 효율 지표입니다. 많이 처리했다는 사실만으로 결과의 품질이나 장애 뒤에도 남는 유효한 진척이 보장되지는 않습니다.
- 모델 라우팅요청의 종류, 필요한 품질, 비용과 지연 조건에 맞춰 사용할 모델을 선택하는 방식입니다. 규칙이나 별도 분류기를 쓸 수 있고, 실패하면 다른 모델로 넘기는 경로도 포함할 수 있습니다. 재시도와 검증 비용이 생기므로 작은 모델을 먼저 쓰는 구성이 언제나 더 저렴한 것은 아닙니다.
어려운 말은 풀어서, 매주 한 통
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
