[2026.08.03 뉴스레터] 해킹에 취약한 LLM, 버그가 아닌 구조의 문제


MIT Technology Review 독자 여러분, 안녕하세요.

AI에게 "이 지시는 따르지 마"라고 가르치면 정말 안전해질까요?


AI 기업들은 지금도 수없이 많은 공격 사례를 학습시키며 안전장치를 강화하고 있습니다. 새로운 공격이 나오면 막고, 또 다른 공격이 나오면 다시 보완하는 방식입니다. 그런데 최근 연구자들은 조금 다른 질문을 던졌습니다.

"혹시 이 문제는 고칠 수 있는 버그가 아니라, AI가 만들어진 방식 자체의 한계는 아닐까?"


연구에 따르면 LLM은 '누가 내린 명령인지'를 근본적으로 완벽하게 구분하지 못할 가능성이 있습니다. 만약 이 분석이 맞다면, 아무리 많은 공격 사례를 학습시켜도 AI를 완전히 안전하게 만드는 것은 근본적으로 불가능할 수도 있습니다.


더 큰 문제는 이러한 AI가 이미 의료, 금융, 행정, 국방 등 사회의 핵심 시스템으로 빠르게 들어가고 있다는 사실입니다.


우리가 믿고 있는 AI의 안전성은 계속 보완될 수 있는 기술적 문제일까요? 아니면 처음부터 안고 태어난 구조적 한계일까요?


지금 바로 기사에서 확인해 보시기 바랍니다.


감사합니다.

MIT 테크놀로지 리뷰 코리아
customer@technologyreview.kr
92, Saemunan-ro, Jongno-gu, Seoul, Republic of Korea, 02-2038-3690
수신거부 Unsubscribe
팔로우하세요. 핵심 기술과 혁의 뉴스를 SNS나 메일로 받기
MIT Technology Review Korean Edition Team
MIT테크놀로지 리뷰는 기술로 세상을 이롭게 한다는 미션을 추구합니다.
MIT Technology Review 편집장 : Gideon Lichfield | 한국 에디션 발행인 & 편집인 : 박세정 | 개인정보관리책임자 : 박세정
주소 : 서울특별시 종로구 새문안로 92 (신문로1가), 5층 503호 | 대표번호 : 02-2038-3690 | 이메일 : customer@technologyreview.kr
사업자등록번호 : 주식회사 디엠케이글로 451-88-00827 [사업자정보확인] | 통신판매업 신고번호 : 제 2018-서울영등포-0513호
정보간행물 신고번호 : 종로 다00053
copyright © 2021 MIT Technology Review
magnifiercrossmenu