엔비디아가 DeepSeek-V4 Pro의 기동 시간을 8분에서 1분 44초로 줄였고, Celeris Labs의 확산 모델 celeris-1은 응답을 p50 157ms에 돌려줘 GPT-5보다 17배 빨랐습니다. 메모리 값이 1년 만에 네 배가 된 가운데 애플은 중국 CXMT와 YMTC 메모리를 쓰게 해 달라고 백악관을 설득하고 있습니다.
AI 인사이트
칩을 파는 쪽이 각국의 자체 구축을 권하는 말은 수요처를 나라 단위로 넓히는 논리이기도 합니다.
AI 인사이트
검증할 시점이 정해지지 않은 전망이라, 오늘의 선택을 바꾸는 근거로 삼기는 어렵습니다.
AI 인사이트
두 팀이 각자 같은 벽을 며칠 사이에 넘었다는 사실은 우연보다 도구의 효과를 가리킵니다. 구성과 증명의 뼈대는 모델이 냈고, 사람이 다듬고 검증하는 절차를 거쳤습니다.
AI 인사이트
재현 결과에 더해 학습 코드와 시행착오까지 연 선택이 후속 연구의 진입 비용을 줄입니다.
AI 인사이트
확산 방식은 여러 토큰을 한꺼번에 만들어 지연을 줄이므로, 기다림이 곧 비용인 짧은 작업에서 값을 합니다. 회사도 분류나 추출 같은 짧은 작업용이라고 범위를 그었습니다.
AI 인사이트
작업 세션이 수주일로 길어지면 한 번의 응답보다 며칠에 걸친 결과물로 모델을 평가하게 됩니다.
AI 인사이트
부족한 것의 목록이 HBM과 LPDDR 같은 메모리에서 땅과 전력, 건설 인력까지 길어졌습니다. 칩을 더 만들어도 데이터센터를 지을 물리적 조건이 확장 속도를 정합니다.
AI 인사이트
허가를 받아도 살 물량이 남았느냐가 먼저입니다. 품귀 국면에서는 승인을 내주는 쪽보다 계약을 먼저 잠근 쪽이 순서를 정합니다.
AI 인사이트
비공개 발언 유출 하나로 조달이 멈출 만큼, 이 회사의 값은 창업자 개인에게 크게 묶여 있습니다.
AI 인사이트
자원이 달라도 인재가 해답을 찾는다는 말은 연구자 공급을 미중 경쟁의 변수로 꼽은 것입니다.
AI 인사이트
내부를 다 이해할 수 없다는 전제를 받아들이자는 주장이라, 통제 설계보다 적응 설계 쪽에 가깝습니다.
AI 인사이트
받은 복제본이 다시 공급원이 되는 구조라 규모를 키울수록 확산이 빨라집니다. 첫 워커는 여전히 느리다는 조건이 이 숫자의 전제입니다.
AI 인사이트
오픈 웨이트를 계속 내놓겠다는 약속은 자체 구축 수요를 늘리려는 칩 공급자의 이해와도 맞아떨어집니다.
〈AMD에 0%를 줬던 세미애널리시스, '승산 크다'며 조건 두 개를 달았습니다〉는 MI455X GPU 72개와 EPYC CPU 18개를 한 랙에 묶은 AMD Helios의 양산 발표를 다룹니다. 세미애널리시스는 한때 0%로 매겼던 AMD의 성공 확률을 올리면서 칩 설계와 상관없는 조건 두 개를 달았습니다.