





Grok Bot이 Cursor에 코딩을 맡기고 GitHub와 Origin 플러그인으로 풀 리퀘스트(PR)를 관리하며, 완성한 결과를 영상으로 공유할 수 있게 됐습니다.
xAI 내부 엔지니어들이 쓰는 봇도 템플릿으로 제공합니다.
Choi
Origin은 Cursor가 8월 17일 유료 요금제에 초기 베타로 내놓은 코드 호스팅 서비스로, 저장소와 PR, GitHub 동기화를 지원합니다.
Cursor의 Agents Window에서 /visualize를 입력하면 에이전트가 데이터를 분석한 뒤 결과를 그래프나 다이어그램으로 만들어 채팅 안에 바로 보여 줍니다.
코드의 데이터 흐름을 다이어그램으로 정리하거나 데이터셋을 분석해 그래프로 시각화하는 데 쓸 수 있습니다.
Choi
Cursor는 4월부터 에이전트가 대시보드나 저장소 구조도 같은 대화형 시각 자료를 별도 캔버스에 그리게 해 왔습니다.
매 턴 모델에 보내던 시스템 프롬프트의 3분의 2를 지우고, 자주 쓰지 않는 도구 설명은 필요할 때만 불러오게 한 결과입니다.
Cursor는 에이전트 품질은 떨어지지 않았다고 밝혔고, 캐시 재사용과 파일 읽기 압축도 함께 손봤습니다.
Choi
시스템 프롬프트와 도구 설명은 모든 턴에 다시 실리는 고정 입력이라 긴 작업일수록 절감이 쌓이고, 읽기·검색·편집·셸처럼 자주 쓰는 도구 위주로 고정 입력에 남기자 도구 설명 토큰이 60% 줄었습니다.
코드 변경을 배포하기 전에 모니터링 계획을 세우고, 배포가 시작되면 문제가 생기는지 계속 확인해 사용자가 겪기 전에 회귀 오류를 찾아냅니다.
함께 개선된 Security Reviewer는 평균 검사 시간이 4.8분에서 3.8분으로 21% 줄었습니다.
두 기능은 Teams와 Enterprise 요금제에서 쓸 수 있습니다.
Choi
Rollouts는 풀 리퀘스트마다 배포 과정을 텔레메트리와 대조해, 테스트 통과 이후의 운영 상태까지 에이전트의 확인 범위에 넣습니다.
독립 평가에서는 지표마다 오른 폭이 다릅니다.
AA 지능 지수는 4.6의 high 44점에서 4.7의 xhigh 46점으로 2점 올랐지만, Grok Build에서 잰 코딩 에이전트 지수는 47점에서 56점으로 9점 올랐습니다.
Terminal-Bench 4.0은 18%에서 33%로 뛰었습니다.
대신 과제당 출력 토큰이 3만 6,000개에서 8만 1,000개로 125% 늘었고 긴 문맥 추론을 보는 AA-LCR은 3.7%포인트 내려갔습니다.
API 단가는 4.6과 같은 입력 2달러, 출력 6달러를 유지했습니다.
Choi
종합 지수는 2점 올랐지만 오래 붙잡고 도는 코딩·터미널 작업에서는 크게 올랐고, 그 대가로 과제당 출력 토큰을 두 배 넘게 씁니다.
매 작업마다 새 채팅을 만드는 대신 하나의 coordinator가 여러 에이전트에 일을 나눠 맡기고, 수개월간 프로젝트 맥락을 유지합니다.
Slack 버그 감시, PR 추적, CI 수정, 예약 작업도 가능합니다.
Cursor 내부 사용 결과 신규 사용자는 PR 병합이 30% 늘었고, Projects를 주로 쓴 사용자는 6배 더 많은 PR을 병합했다고 합니다.
베타로 순차 배포 중입니다.
Choi
수개월 치 프로젝트 맥락이 Cursor 안에 쌓일수록, 다른 도구로 옮길 때 잃는 것도 커집니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.