구글이 영상을 최대 40초까지 이어 붙이는 Gemini Omni 1.1 Flash를 360p 초당 0.03달러부터 내놨고, Claude Cowork에는 개인 로그인과 분리된 자체 브라우저가 들어갔습니다. 전날 가중치가 풀린 GLM-5.3-Flash는 Unsloth의 3비트판으로 RAM 128GB PC에서 돌아가게 됐습니다.
AI 인사이트
Cowork 브라우저는 사용자의 개인 브라우저와 로그인 정보를 공유하지 않아, Claude가 사이트를 탐색하고 양식을 작성하는 동안 사용자가 평소 로그인해 둔 계정과 분리된 상태로 움직입니다.
AI 인사이트
에이전트가 차트·대시보드·3D 시뮬레이션을 조작 가능한 화면으로 바로 만들고 HTML 파일로 내보내므로, 결과를 글로 읽는 대신 눌러 보며 확인할 수 있습니다.
AI 인사이트
$visualize는 긴 설명이나 자료의 구조와 관계를 시각 자료로 정리해 주므로, 개념 사이의 연결을 글을 다 읽지 않고도 파악할 수 있습니다.
AI 인사이트
크레딧이 Gemini API 호출과 Vertex AI·Firebase에도 적용돼, AI Studio에서 시험한 모델을 앱이나 API로 옮길 때 드는 초기 비용 일부를 구독료 안에서 충당할 수 있습니다.
AI 인사이트
Microduck의 동작은 물리 시뮬레이션에서 강화학습으로 익힌 뒤 실물로 옮긴 것이고, 개발도구와 시뮬레이터는 공개됐지만 기계·전자 설계 파일은 빠졌습니다.
AI 인사이트
360p 초안은 초당 0.03달러, 4K는 0.30달러로 10배 차이가 나서, 초안을 싸게 여러 번 뽑은 뒤 고른 컷만 고해상도로 만드는 순서가 가능합니다.
AI 인사이트
채팅 연결은 Vercel Chat SDK가, 실행·세션·메모리는 Claude Managed Agents가 맡아, 메시지 처리 로직을 한 번 작성하면 15개 넘는 채널에서 같은 세션으로 대화가 이어집니다.
AI 인사이트
GLM-5.3-Flash는 320B 가운데 토큰마다 약 18B만 쓰는 MoE라, 3비트로 줄인 가중치를 128GB 메모리에 올려도 토큰마다 계산하는 양은 18B 수준에 머뭅니다.
AI 인사이트
거절을 만드는 회로가 내부 신호의 한 방향에 몰려 있어, 그 방향만 가중치에서 지우면 재학습 없이 거부율이 0%로 내려가고 MMLU는 90.0에서 87.7로만 떨어졌습니다.
같은 날 올라온 〈고쳐 말하면 고친 대로 적는 받아쓰기, 구글 제미나이 3.5 Transcribe〉에 따르면 구글은 제미나이 맥 앱의 음성 입력과 Gboard의 Rambler가 이미 이 모델로 돌아가고 있었다고 밝혔습니다.