AI 가드레일의 사이버 보안 연구 방해 논란과 기술적 한계
인공지능 기업이 도입한 엄격한 가드레일이 보안 연구자의 취약점 분석 업무를 저해한다는 지적이 제기되었습니다. 연구자들은 규제 강화보다 책임 있는 접근 권한 부여가 필요하다고 강조합니다.
주장인공지능 기업이 악의적인 해커를 차단하기 위해 도입한 엄격한 가드레일이 합법적인 네트워크 방어자와 공격적 보안 연구자의 업무를 방해하고 있습니다. 보안 연구자는 이러한 제한이 보안 취약점을 발견하고 수정하는 핵심 과정을 가로막는다고 지적합니다.
팩트2026년 6월, 미국 정부는 앤스로픽의 인공지능 모델인 미토스와 페이블에 대해 수출 통제 조치를 시행했습니다. 이는 해당 모델이 악의적인 사이버 공격에 악용될 수 있다는 우려와 가드레일 우회 가능성에 관한 보고서가 제기되었기 때문입니다.
팩트앤스로픽과 오픈AI는 보안 연구자를 위해 별도의 검증 프로그램을 운영합니다. 오픈AI는 트러스티드 액세스 포 사이버를, 앤스로픽은 사이버 베리피케이션 프로그램을 통해 승인된 연구자에게 상대적으로 완화된 보안 제한을 적용합니다.
교차검증보안 연구자 마크 다우드는 대형 기술 기업이 무엇이 안전하고 무엇이 위험한지를 자의적으로 결정하는 현재의 구조에 불만을 표했습니다. 그는 이러한 기업의 결정이 보안 전문가의 전문적인 판단을 대체할 수 없다고 주장합니다.
팩트NCC 그룹의 수석 과학자 크리스 앤리는 인공지능 모델에게 버그를 공격하도록 요청하는 과정이 취약점을 확인하는 필수 단계라고 설명했습니다. 그러나 가드레일이 이러한 요청을 즉각 거부하면 방어자의 업무는 실질적으로 마비됩니다.
주장보안 도구는 집을 짓는 도구인 동시에 무기로도 사용될 수 있는 망치와 같습니다. 따라서 공격과 방어를 구분하여 도구의 사용을 제한하는 것은 기술적으로 불가능하며, 이는 오히려 방어자의 역량을 약화합니다.
팩트크라우드펜스의 최고 기술 책임자 파올로 스타뇨는 인공지능 기업이 고객을 보살핌이 필요한 아이처럼 취급한다고 비판했습니다. 그는 민감한 데이터 유출을 방지하기 위해 클라우드 기반 모델 대신 로컬에서 실행되는 오픈소스 모델을 사용합니다.
교차검증보안 연구자 주세페 칼리는 가드레일이 자신의 업무를 방해하지 않는다고 말했습니다. 그는 인공지능을 취약점 발견이나 무기화가 아닌, 코드 분석 및 보조 도구 개발을 위한 역공학 단계에서만 제한적으로 활용합니다.
팩트리모트스렛의 최고 경영자 크리스 톰슨은 가드레일이 일관성 없이 작동하여 연구자가 모델과 협상하는 데 많은 시간을 허비하게 만든다고 지적했습니다. 이로 인해 많은 연구자가 미국 기업의 모델 대신 통제가 없는 중국산 오픈소스 모델로 이동합니다.
주장톰슨은 가드레일을 강화하는 것보다 책임 있는 접근 권한을 제공하고 오용자에 대한 처벌을 강화하는 방안이 바람직하다고 강조했습니다. 그는 현재의 규제가 보안 전문가의 업무를 방해하여 다가올 대규모 사이버 공격에 대한 대응력을 떨어뜨린다고 경고합니다.
주장인공지능 모델의 안전성을 확보하려는 기업의 의도는 타당하지만, 보안 연구자가 현장에서 겪는 실질적인 제약은 기술 생태계의 발전을 저해합니다. 기업과 정부는 보안 전문가의 업무 효율성을 보장하는 유연한 규제 체계를 마련해야 합니다.
출처테크크런치의 2026년 7월 23일 보도 내용을 교차 검증했습니다.
본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

