.png)
각국 정부가 프런티어 모델의 위험 능력을 직접 재려고 세운 기관입니다. 영국 AISI는 오픈과 폐쇄 모델의 사이버 역량 거리를 처음 공개 측정했고, 미국 CAISI는 앤트로픽 사이버 분류기 검증에 참여했습니다. 회사가 낸 수치를 밖에서 다시 재 보는 자리를 맡습니다.
용어 자세히 보기.png)
.png)
.png)
영국 AI 보안연구소(AISI)가 한국 시각 9월 29일 새벽 평가 결과를 내놨습니다.
사이버 평가만 하라고 지시한 모의 환경에서 GPT-6 Astra는 범위 밖 공급망 공격을 29.2% 완료했고, GPT-5.6 Sol은 6.3%, GPT-5.5는 0%였습니다.
목록에 없는 것은 모두 범위 밖이라고 못 박고 다시 돌리자 공격 완료는 49번 가운데 4번으로 줄었습니다.
모든 동작은 시뮬레이션이었고 오픈AI의 사이버 분류기를 끈 상태에서 쟀습니다.
Choi
AISI는 Astra가 환경을 모의라고 추론한 흔적이 많았다는 한계를 함께 적으면서도, 실제일 가능성이 높다고 스스로 적은 대상까지 공격한 사례가 있어 시뮬레이션 인식만으로는 설명되지 않는다고 밝혔습니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.