인공지능

LLM, 공격자가 안전장치 우회하게 하는 고칠 수 없는 결함 발견

1 min read

LLM, 공격자가 안전장치 우회하게 하는 고칠 수 없는 결함 발견
Photo: Logan Voss · Unsplash
0 0
XWhatsAppTelegramLinkedIn

2026년 7월 30일, 연구진은 국제기계학습학회(ICML)에서 발표한 논문에서 대규모 언어 모델(LLM)이 근본적이고 해결 불가능한 보안 결함을 가지고 있다고 주장했다. 이 결함은 모델이 명령어의 출처를 식별하는 방식에서 비롯되며, 안전 훈련을 우회하는 공격에 취약하게 만든다.

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.