[Techmeme 요약] 앤트로픽의 AI 모델 '페이블', 과도한 보안 설정으로 연구자 불만
101
설명
앤트로픽(Anthropic)이 공개한 인공지능(AI) 모델 '페이블(Fable)'이 지나치게 엄격한 보안 기능으로 인해 사이버 보안 연구자들 사이에서 불만의 목소리가 나오고 있습니다.
지난 6월 10일 공개된 페이블은 맬웨어 개발이나 소프트웨어 침해 위험을 줄이기 위해 설계되었으나, 블로그 게시물 읽기나 코드 검토와 같은 일상적인 작업까지 차단하는 것으로 알려졌습니다.
이러한 과도한 제약은 AI의 유용성을 떨어뜨린다는 지적과 함께, 향후 AI 모델의 안전성과 활용성 사이의 균형점을 찾는 것이 중요함을 시사합니다.
### 배경 설명
앤트로픽은 2026년 6월 10일, 강력한 사이버 보안 모델인 '미토스(Mythos)'의 공개 및 제한적 버전을 '페이블'이라는 이름으로 출시했습니다. 페이블은 맬웨어 개발이나 소프트웨어 침해와 같은 잠재적 위험을 방지하기 위해 엄격한 안전 장치(guardrails)를 갖추고 있습니다. 또한, 생물학 무기 개발 가능성을 우려하여 생물학 관련 주제에 대한 접근도 제한하고 있습니다.
지난 4월, 앤트로픽은 미토스 모델을 핵심 소프트웨어 및 인프라 보안을 위해 '프로젝트 글래스윙(Project Glasswing)'이라는 이름으로 소수의 기업 및 조직에만 제한적으로 제공했습니다. 이후 6월 둘째 주, 미토스에 대한 접근 범위를 15개국 수백 개 조직으로 확대했습니다. 하지만 페이블에 적용된 안전 장치는 의도와 달리 많은 사이버 보안 전문가들에게 불편함을 주고 있습니다.
### 연구자들의 불만: '무해한 작업'까지 차단
IBM X-Force 소속의 유명 보안 연구원인 발렌티나 팔미오티(Valentina "Chompie" Palmiotti)는 페이블이 "간접적으로라도 사이버 보안과 관련된 모든 요청을 거부한다"며, "블로그 게시물을 읽는 것과 같은 무해한 작업조차 차단한다"고 지적했습니다. 페이블은 안전 장치가 작동하면 채팅을 일시 중지하고 "안전 조치가 사이버 보안 또는 생물학 주제로 이 메시지를 플래그 지정했습니다"라는 메시지를 표시합니다.
### 키워드 기반의 과도한 제약
보안 전문가 맷 수이체(Matt Suiche)는 페이블이 "보안 코드를 작성해달라고 요청하면, 소프트웨어 엔지니어링 모범 사례가 아닌 사이버 보안 관련 작업으로 간주하여 등급을 낮춘다"고 언급했습니다. 그는 이러한 제약이 "키워드 기반으로 작동하는 것으로 보이며, '사이버 보안'이라는 단어의 어휘 범위에 있는 모든 것이 안전 장치를 발동시킨다"고 설명했습니다. 페이블은 안전 장치에 걸리면 클로드 오푸스 4.8(Claude Opus 4.8)로 대체됩니다.
### 안전 장치와 활용성 사이의 균형
수이체는 이러한 초기 단계의 제약이 이해할 만하며, 앤트로픽과 다른 선도적인 모델 기업들이 사이버 보안 기업들과 협력하면서 점차 개선될 것이라고 낙관했습니다. 그는 "출시 시점에 너무 적은 사람을 놓치는 것보다 더 많은 사람을 놓치는 것이 낫고, 시간이 지남에 따라 안전 장치를 완화할 것"이라고 덧붙였습니다. 다른 연구원 역시 "코드 검토를 요청하는 것만으로도 페이블의 안전 장치가 작동한다"고 불만을 토로했습니다.
### 앤트로픽의 사이버 보안 프로그램
앤트로픽은 모델 내부의 안전 장치 외에도, 사이버 보안 전문가들이 '사이버 검증 프로그램(Cyber Verification Program)'에 지원하도록 요구합니다. 이 프로그램에 승인되면 사이버 보안 업무에 클로드를 사용하는 데 있어 제한이 줄어듭니다. 경쟁사인 OpenAI 역시 '신뢰 액세스(Trusted Access for Cyber)'라는 유사한 프로그램을 운영하고 있습니다.
### 가치와 인사이트
페이블 모델의 엄격한 안전 장치는 AI 모델의 오용을 방지하려는 앤트로픽의 노력을 보여주지만, 동시에 AI의 실질적인 활용성을 저해할 수 있다는 점을 시사합니다. 특히 사이버 보안 분야와 같이 민감하면서도 전문적인 지식이 요구되는 영역에서는, 지나치게 경직된 안전 장치가 오히려 연구 및 개발 활동에 걸림돌이 될 수 있습니다. 이는 AI 개발사들이 안전성과 유용성 사이에서 정교한 균형점을 찾아야 함을 보여주는 사례입니다.
### 향후 전망
페이블과 같은 AI 모델의 안전 장치 문제는 향후 AI 기술 발전과 규제 논의에 중요한 영향을 미칠 것입니다.
첫째, AI 개발사들은 특정 산업 분야의 전문가들과 긴밀히 협력하여, 실제 업무에 필요한 기능을 수행하면서도 악용될 가능성을 최소화하는 맞춤형 안전 장치를 개발해야 할 것입니다. 이는 '프로젝트 글래스윙'이나 '사이버 검증 프로그램'과 같은 접근 방식을 더욱 확대하고 정교화하는 방향으로 나아갈 수 있습니다.
둘째, 이러한 경험은 AI 모델의 '투명성'과 '설명 가능성'에 대한 요구를 증대시킬 것입니다. 연구자들은 왜 특정 작업이 차단되는지에 대한 명확한 이해를 바탕으로 개선점을 제시할 수 있을 것입니다.
셋째, 정부 및 규제 기관은 AI의 안전한 사용을 위한 가이드라인을 마련할 때, 이러한 실제 현장의 목소리를 반영하여 과도한 규제로 인한 기술 발전 저해를 막는 데 신중을 기해야 할 것입니다. 궁극적으로는 AI가 사회에 긍정적인 영향을 미치도록 하되, 잠재적 위험을 효과적으로 관리하는 방안이 모색될 것입니다.
📝 원문 및 참고
- Source: Techmeme
- Techmeme 리버: [techmeme.com](https://www.techmeme.com/260610/p49#a260610p49)
- 원문 기사: [링크 열기](https://techcrunch.com/2026/06/10/cybersecurity-researchers-arent-happy-about-the-guardrails-on-anthropics-fable/)
---
출처: Techmeme ([Original Article](https://techcrunch.com/2026/06/10/cybersecurity-researchers-arent-happy-about-the-guardrails-on-anthropics-fable/))
이 글에 대한 한 줄 의견
신고 · 불법·유해·아동 안전(CSAE) 관련 콘텐츠

댓글 0
아직 댓글이 없습니다. 로그인하면 바로 의견을 남길 수 있습니다.