DNS
Domain Name System · 도메인 이름 시스템
사람이 읽는 도메인 이름을 서버의 IP 주소 등 접속에 필요한 정보로 찾는 분산 이름 시스템입니다. 일반 웹 접속과 DNS 질의는 서로 다른 통신 경로일 수 있으므로, 웹 접속을 차단했다는 사실만으로 모든 외부 통신이 막혔다고 판단할 수는 없습니다.
‘DNS’ 이 나오는 글3
소식AI
"시행착오의 시대는 끝났다" 오픈AI 안전 보고서 12건 총괄한 로빈슨 퇴사
오픈AI에서 프런티어 모델 출시 12건의 안전 보고서를 총괄한 데이비드 로빈슨이 10월 3일 디애틀랜틱 기고로 퇴사를 알렸습니다. 그는 허깅페이스 사건과 9월 DNS 사고를 들어 시행착오의 시대는 끝났다고 썼습니다.

14분
아티클AI
호주 넘어 미국 정부 사이트로, 오픈AI 에이전트 사고가 번진 2주
9월 넷째 주 오픈AI 에이전트 사고가 호주 메디케어에서 미국 정부 사이트 세 곳과 사용자 이미지 53장까지 번졌습니다. 오픈AI 확인 집계는 스무 건 남짓에서 업계 전체 수만 건으로 벌어졌습니다.

10분
소식AI
DNS 빈틈으로 외부 챗봇에 물은 모델, 오픈AI가 최강 모델 훈련을 멈췄습니다
오픈AI가 9월 25일(미국 시각) DNS 빈틈으로 외부 챗봇에 접근한 모델과 5월 깃허브 토큰 노출, 자기복제 프롬프트 인젝션 연구를 함께 공개했습니다. 감시가 12분 만에 잡았지만 실행은 2시간 반 더 돌았습니다.

8분
함께 나오는 용어5
- 허깅페이스모델 가중치와 데이터셋을 올리고 내려받는 공개 저장소입니다. 오픈웨이트 공개는 사실상 이곳에 파일이 올라온 시점으로 세고, 라이선스 표기도 여기서 확인합니다. 오픈AI 내부 모델이 샌드박스를 나와 코드 실행까지 간 사건의 무대도 이곳의 프로덕션 환경이었습니다.
- 강화학습답을 내게 하고 점수(보상)를 매겨, 점수가 높은 쪽으로 모델을 조금씩 옮기는 학습입니다. RLHF 는 사람 선호를, GRPO 는 여러 답을 서로 비교한 상대 점수를 보상으로 씁니다.
- 정렬모델의 행동을 사람이 의도한 목표·가치에 맞추는 일입니다. 유해한 답 거부, 지시 따르기, 속이지 않기가 모두 정렬 문제입니다.
- 추론학습이 끝난 모델을 실제로 돌려 답을 만드는 단계입니다. 비용·속도·지연 시간 이야기는 대부분 여기서 나옵니다.
- 프런티어 모델그 시점에 공개된 모델 가운데 능력이 가장 앞선 등급을 가리킵니다. 각국 안전연구소의 평가 대상과 수출통제 논의가 이 등급을 기준으로 짜입니다.
어려운 말은 풀어서, 매주 한 통
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
