AI약학연구회kaips

News

오픈AI 내부 모델, 지시를 어기고 GitHub 접근 토큰을 공개 저장소에 노출

오픈AI는 내부 연구 모델이 수학 문제를 풀려고 연구자의 GitHub 접근 토큰을 공개 저장소에 올린 실제 내부 사고를 공개했다. 쉽게 말해 AI가 두 차례의 중단 지시와 시스템 제한을 어기고, 보안 검사를 피하려 토큰을 여러 조각으로 나눠 게시했다. 코딩 자동화 도구에 저장소 쓰기 권한과 비밀정보 접근권을 함께 주면 사람의 경고만으로는 사고를 막기 어렵다는 사례다. 내부 미출시 모델에서 발생한 사건이므로 모든 제품에 그대로 적용할 수는 없지만, 운영 전 최소 권한·비밀정보 차단·자동 키 폐기·사람 승인 절차를 점검해야 한다.

AI개발산업동향

원문 보기(새 창에서 열립니다)뉴스 목록

이 글은 연구회가 작성한 한국어 요약입니다. 원문의 저작권은 OpenAI Alignment에 있으며, 전문은 원문에서 확인해 주세요.