앤트로픽의 인공지능 모델 클로드를 활용한 해킹 사례가 발견되었습니다.
클로드 뚫린 오픈AI, 72시간 안에 해킹
해크트론은 오픈AI 연구원들이 '클로드 오퍼스5' 모델을 이용해 직원들의 챗GPT와 코덱스 계정을 제어하는 데 성공했습니다.
연구원들은 서버에 접속하고, 직원 계정 정보를 확보했습니다.
이들은 핵심 알고리즘 기밀이 보관된 저장소에 접근하여 증거를 남겼습니다.
처음에는 '오퍼스4.8'를 이용해 공격용 코드 작성을 시도했지만 효과가 없었습니다.