알리바바가 2.4조 파라미터 Qwen을 Max-Preview로 열고 오픈웨이트 공개를 예고했습니다. Kimi는 K3 출시 이틀 만에 GPU 용량이 모자라 신규 구독을 막았고, 버셀 CTO의 DeepSec 벤치마크에서 Fable 5는 거부율 100%를 기록했습니다.
AI 인사이트
알리바바는 벤치마크 없이 Fable 5 바로 아래라는 순위부터 주장했습니다. 며칠 사이 Kimi K3에 이어 Qwen까지 중국 랩이 오픈웨이트로 Fable을 겨눴습니다.
AI 인사이트
아세모글루는 미중 경쟁이 규제를 피하는 명분으로 쓰인다고 봤습니다. 그 제로섬 사고가 기후변화·팬데믹 같은 다른 국제 협력까지 막는다는 것이 그의 주장입니다.
AI 인사이트
학습을 마친 뒤 압축하던 순서를 뒤집어 처음부터 세 값으로 배운 설계가 정확도를 지켰습니다. 임베딩은 벡터 DB에 대량으로 쌓여 출력 벡터를 줄이면 저장·서빙 비용이 내려갑니다.
AI 인사이트
아세모글루는 업무 대체율 대신 신뢰성과 맥락 이해를 AGI의 기준으로 삼았습니다. 금융권이 AI에 10~15%만 맡기는 이유도 같은 기준으로 설명했습니다.
AI 인사이트
같은 생산성 증가가 고용을 줄이는 자동화로도, 고용을 유지하며 GDP를 키우는 방식으로도 나올 수 있다는 정리입니다. 아세모글루는 후자를 “AI가 주는 약속”이라고 불렀습니다.
AI 인사이트
Fable 5의 분류기는 이중용도 요청을 응답 전에 막아 방어용 취약점 탐색도 거부합니다. 인증 없이 API를 쓰면 모든 요청이 거부되고, 분류기가 없는 Opus 4.8은 같은 요청을 처리합니다.
AI 인사이트
편집 도구가 앱으로 내려오면 제작 흐름이 데스크톱 밖으로 나갑니다. 공개 시점은 아직 확인되지 않았습니다.
AI 인사이트
SMIC가 어센드 다이를 연 100만 개 넘게 찍어도 HBM이 모자라 실제 칩은 30만 개를 못 넘깁니다. 값싼 오픈모델이 나와도 수요를 받아낼 서빙 용량이 먼저 한계에 닿습니다.
AI 인사이트
모델이 똑똑해지면서 예시와 제약을 일일이 적은 긴 프롬프트가 오히려 능력을 제한할 수 있다는 경험담입니다. Thariq는 사용자가 쓰는 지시문과 파일도 요점만 남기라고 권했습니다.
Claude Code 팀이 시스템 프롬프트를 80% 줄인 소식과 함께 읽을 글은 〈코드 100만 줄을 AI가 쓴 팀, 매주 금요일은 'AI 슬롭' 청소였습니다〉입니다. 오픈AI 엔지니어 라이언 로포폴로의 팀은 다섯 달 동안 사람이 손으로 쓴 코드 없이 사내 베타를 만들었습니다.