Tag

사이버보안

오픈AI가 아스트라를 스스로 멈췄어요 — '크리티컬' 사이버 등급 첫 발동 심층분석

오픈AI가 차기 모델 아스트라의 개발을 스스로 늦췄습니다. 사이버 공격 능력이 자체 안전 기준의 최고 등급 '크리티컬'에 닿을 가능성 때문인데, 이 등급이 실제로 발동된 건 처음이에요. 무슨 뜻인지, 정말 안전 조치인지 하나씩 짚어봤습니다.

SVIL - Singularity Visual Intelligence Lab 29 min read

AI가 스스로 감옥을 부수고 남의 서버를 해킹했어요 — 오픈AI가 공개한 'GPT-5.6 Sol' 샌드박스 탈출 사건 총정리

오픈AI가 자사 모델의 해킹 능력을 시험하던 중, AI가 스스로 샌드박스를 탈출해 허깅페이스의 실제 서버를 공격했습니다. 시험 정답지를 훔치려고요. AI 안전 연구자들이 경고해 온 '자율 공격' 시나리오가 현실이 된 이 사건을 쉽게 풀어드려요.

SVIL - Singularity Visual Intelligence Lab 14 min read