[Techmeme 요약] 앤트로픽의 AI 모델 '페이블', 과도한 보안 설정으로 연구자 불만
71
설명
앤트로픽(Anthropic)이 공개한 인공지능(AI) 모델 '페이블(Fable)'이 지나치게 엄격한 보안 기능으로 인해 사이버 보안 연구자들 사이에서 불만의 목소리가 나오고 있습니다.
지난 6월 10일 공개된 페이블은 맬웨어 개발이나 소프트웨어 침해 위험을 줄이기 위해 설계되었으나, 블로그 게시물 읽기나 코드 검토와 같은 일상적인 작업까지 차단하는 것으로 알려졌습니다.
이러한 과도한 제약은 AI의 유용성을 떨어뜨린다는 지적과 함께, 향후 AI 모델의 안전성과 활용성 사이의 균형점을 찾는 것이 중요함을 시사합니다.
### 배경 설명
앤트로픽은 2026년 6월 10일, 강력한 사이버 보안 모델인 '미토스(Mythos)'의 공개 및 제한적 버전을 '페이블'이라는 이름으로 출시했습니다. 페이블은 맬웨어 개발이나 소프트웨어 침해와 같은 잠재적 위험을 방지하기 위해 엄격한 안전 장치(guardrails)를 갖추고 있습니다. 또한, 생물학 무기 개발 가능성을 우려하여 생물학 관련 주제에 대한 접근도 제한하고 있습니다.
지난 4월, 앤트로픽은 미토스 모델을 핵심 소프트웨어 및 인프라 보안을 위해 '프로젝트 글래스윙(Project Glasswing)'이라는 이름으로 소수의 기업 및 조직에만 제한적으로 제공했습니다. 이후 6월 둘째 주, 미토스에 대한 접근 범위를 15개국 수백 개 조직으로 확대했습니다. 하지만 페이블에 적용된 안전 장치는 의도와 달리 많은 사이버 보안 전문가들에게 불편함을 주고 있습니다.
### 연구자들의 불만: '무해한 작업'까지 차단
IBM X-Force 소속의 유명 보안 연구원인 발렌티나 팔미오티(Valentina "Chompie" Palmiotti)는 페이블이 "간접적으로라도 사이버 보안과 관련된 모든 요청을 거부한다"며, "블로그 게시물을 읽는 것과 같은 무해한 작업조차 차단한다"고 지적했습니다. 페이블은 안전 장치가 작동하면 채팅을 일시 중지하고 "안전 조치가 사이버 보안 또는 생물학 주제로 이 메시지를 플래그 지정했습니다"라는 메시지를 표시합니다.
### 키워드 기반의 과도한 제약
보안 전문가 맷 수이체(Matt Suiche)는 페이블이 "보안 코드를 작성해달라고 요청하면, 소프트웨어 엔지니어링 모범 사례가 아닌 사이버 보안 관련 작업으로 간주하여 등급을 낮춘다"고 언급했습니다. 그는 이러한 제약이 "키워드 기반으로 작동하는 것으로 보이며, '사이버 보안'이라는 단어의 어휘 범위에 있는 모든 것이 안전 장치를 발동시킨다"고 설명했습니다. 페이블은 안전 장치에 걸리면 클로드 오푸스 4.8(Claude Opus 4.8)로 대체됩니다.
### 안전 장치와 활용성 사이의 균형
수이체는 이러한 초기 단계의 제약이 이해할 만하며, 앤트로픽과 다른 선도적인 모델 기업들이 사이버 보안 기업들과 협력하면서 점차 개선될 것이라고 낙관했습니다. 그는 "출시 시점에 너무 적은 사람을 놓치는 것보다 더 많은 사람을 놓치는 것이 낫고, 시간이 지남에 따라 안전 장치를 완화할 것"이라고 덧붙였습니다. 다른 연구원 역시 "코드 검토를 요청하는 것만으로도 페이블의 안전 장치가 작동한다"고 불만을 토로했습니다.
### 앤트로픽의 사이버 보안 프로그램
앤트로픽은 모델 내부의 안전 장치 외에도, 사이버 보안 전문가들이 '사이버 검증 프로그램(Cyber Verification Program)'에 지원하도록 요구합니다. 이 프로그램에 승인되면 사이버 보안 업무에 클로드를 사용하는 데 있어 제한이 줄어듭니다. 경쟁사인 OpenAI 역시 '신뢰 액세스(Trusted Access for Cyber)'라는 유사한 프로그램을 운영하고 있습니다.
### 가치와 인사이트
페이블 모델의 엄격한 안전 장치는 AI 모델의 오용을 방지하려는 앤트로픽의 노력을 보여주지만, 동시에 AI의 실질적인 활용성을 저해할 수 있다는 점을 시사합니다. 특히 사이버 보안 분야와 같이 민감하면서도 전문적인 지식이 요구되는 영역에서는, 지나치게 경직된 안전 장치가 오히려 연구 및 개발 활동에 걸림돌이 될 수 있습니다. 이는 AI 개발사들이 안전성과 유용성 사이에서 정교한 균형점을 찾아야 함을 보여주는 사례입니다.
### 향후 전망
페이블과 같은 AI 모델의 안전 장치 문제는 향후 AI 기술 발전과 규제 논의에 중요한 영향을 미칠 것입니다.
첫째, AI 개발사들은 특정 산업 분야의 전문가들과 긴밀히 협력하여, 실제 업무에 필요한 기능을 수행하면서도 악용될 가능성을 최소화하는 맞춤형 안전 장치를 개발해야 할 것입니다. 이는 '프로젝트 글래스윙'이나 '사이버 검증 프로그램'과 같은 접근 방식을 더욱 확대하고 정교화하는 방향으로 나아갈 수 있습니다.
둘째, 이러한 경험은 AI 모델의 '투명성'과 '설명 가능성'에 대한 요구를 증대시킬 것입니다. 연구자들은 왜 특정 작업이 차단되는지에 대한 명확한 이해를 바탕으로 개선점을 제시할 수 있을 것입니다.
셋째, 정부 및 규제 기관은 AI의 안전한 사용을 위한 가이드라인을 마련할 때, 이러한 실제 현장의 목소리를 반영하여 과도한 규제로 인한 기술 발전 저해를 막는 데 신중을 기해야 할 것입니다. 궁극적으로는 AI가 사회에 긍정적인 영향을 미치도록 하되, 잠재적 위험을 효과적으로 관리하는 방안이 모색될 것입니다.
📝 원문 및 참고
- Source: Techmeme
- Techmeme 리버: [techmeme.com](https://www.techmeme.com/260610/p49#a260610p49)
- 원문 기사: [링크 열기](https://techcrunch.com/2026/06/10/cybersecurity-researchers-arent-happy-about-the-guardrails-on-anthropics-fable/)
---
출처: Techmeme ([Original Article](https://techcrunch.com/2026/06/10/cybersecurity-researchers-arent-happy-about-the-guardrails-on-anthropics-fable/))
신고 · 불법·유해·아동 안전(CSAE) 관련 콘텐츠
제목글쓴이조회
- [Techmeme 요약] AI, 단순 이미지 생성을 넘어 '맞춤형 가상 세계' 창조로 진화 중… 아직 자체 검증 능력은 부족[0]Nedai2
- [Hacker News 요약] Manifest, LLM 라우터 기능 폐기: 비용 절감보다 일관성 및 예측 가능성 중시[0]Nedai3
- [Hacker News 요약] AI 에이전트 GUI 디자인에 대한 탐구: MarbleOS의 제안[0]Nedai3
- [The Verge] 펜더 CEO, 밴드 동료를 '아날로그 AI'에 비유하며 논란의 불길 지펴[0]Nedai2
- [Techmeme 요약] AI 모델의 '탈주' 사건, 미국 법체계의 허점 드러내다[0]Nedai3
- [The Verge] AI 시대, 창작자의 권리를 지키며 기술 발전과 상생할 수 있을까?[0]Nedai5
- [Lobsters 요약] LLM 생성 코드 수동 재입력으로 인지 부채 방지[0]Nedai6
- [Hacker News 요약] AI 금융 조언, 질문 방식에 따라 효과 크게 달라져[0]Nedai3
- [Hacker News 요약] AI 추론 능력, '그럴듯한 이유'로 작동하는가에 대한 논쟁 심화[0]Nedai4
- [Hacker News 요약] AI는 프로토타입 생성 도구일 뿐, 실제 제품 개발은 여전히 개발자의 몫[0]Nedai5
- [Lobsters 요약] LLM은 대칭 암호 체계를 무너뜨리지 못한다: Anthropic의 암호 분석 연구와 향후 전망[0]Nedai6
- [The Verge] 빌보드 100위 곡 'Rubberz', AI 생성 의혹… 힙합계의 새로운 논쟁거리[0]Nedai4
- [Techmeme 요약] AI 칩, 9개월마다 2배 증가 전망… 데이터센터 폭증과 미래 변화[0]Nedai7
- [Techmeme 요약] 중국, UN AI 회의서 오픈소스 AI 모델로 글로벌 영향력 확대 시도[0]Nedai9
- [Lobsters 요약] Claude Opus 5의 사용자 경험 악화로 인한 ChatGPT 전환기[0]Nedai8
- [Techmeme 요약] ThreatLocker, 1억 9천만 달러 투자 유치로 AI 보안 강화 및 글로벌 확장 추진[0]Nedai9
- [Techmeme 요약] AI가 공장 전체를 운영하는 'Foundational Industries', 2500만 달러 시드 투자 유치[0]Nedai9
- [Techmeme 요약] AI 스타트업 하모니, 3400만 달러 시드 투자 유치... 기업 업무 자동화 나선다[0]Nedai8
- [Hacker News 요약] qm: 협업을 위한 멀티플레이어 에이전트 하네스, 개인화된 작업 공간과 통합 기능 제공[0]Nedai9
- [Hacker News 요약] Hugging Face 침해 사고에서 Tailscale의 역할과 보안 강화 방안[0]Nedai7
- [The Verge] AI 음악, 차트 진입 문턱 높인다… 메이저 음반사들 '규제' 제안[0]Nedai9
- [The Verge] 구글 어스, AI 이미지 생성 기능 도입의 '진짜' 문제점[0]Nedai12
- [The Verge] 구글 어스의 AI 이미지 생성 기능, 하루 만에 서비스 중단[0]Nedai13
- [Techmeme 요약] 스냅챗, AI 생성 영상 대신 실제 사람이 만든 영상만 '스포트라이트' 추천한다[0]Nedai11
- [Hacker News 요약] 딥 세크(DeepSeek) 모델에서 증류된 GPT-OSS, 검열은 전수되지 않아[0]Nedai11
- [Hacker News 요약] 2026년 LLM 코딩 생산성 향상, 2배에 그칠 전망[0]Nedai10
- 구글 딥마인드, 차세대 로봇 AI '제미니 로보틱스 2' 공개[0]Nedai11
- [The Verge] AI 안전, 이제는 정말로 걱정해야 할 때[0]Nedai10
- [Lobsters 요약] LocalAI, C/C++ 추론 엔진 자체 개발을 통한 성능 및 효율성 극대화[0]Nedai10
- [Hacker News 요약] AI 활용으로 크롬 보안 취약점 발견 및 수정 속도 획기적 향상[0]Nedai9
- [AI Breakfast] OpenAI, Google, Meta, Anthropic의 AI 기술 경쟁 심화[0]Nedai15
- [The Verge] 앤트로픽 클로드, 테스트 중 실제 기업 시스템 무단 침입 사고 발생[0]Nedai19
- [Techmeme 요약] EU, 8월 2일부터 AI 생성 콘텐츠에 '진짜 같은' 라벨 의무화[0]Nedai13
- [Techmeme 요약] 구글, 제미나이 스파크 기능 확대 및 AI Pro 서비스 160개국 출시[0]Nedai12
- [Techmeme 요약] 딥시크 V4 플래시, AI 지능 지수 50점 달성하며 제미니 3.6 플래시와 동률 기록[0]Nedai13
- [Techmeme 요약] 구글 어스, AI로 가짜 위성 이미지 생성 기능 추가…진위 판별 논란[0]Nedai10
- [Techmeme 요약] AI 회의록 도우미 Granola, 개인 정보 보호와 기업 요구 사이의 균형점 찾다[0]Nedai11
- [Hacker News 요약] LLM이 ASD-STE100 기술 영어로 문서 작성하도록 강제하는 에이전트 스킬 출시[0]Nedai11
- [GeekNews 요약] 넷플릭스, LLM 기반 추천 시스템 GenRec 공개: 개인화 추천의 새로운 지평[0]Nedai12
- Gemini Robotics 2, 다중 로봇 협업으로 복잡한 문제 해결 능력 강화[0]Nedai15
- [The Verge] 애플, AI 기능 강화 위한 iCloud+ 유료 플랜 출시 시사[0]Nedai12
- [Techmeme 요약] AI 모델, 보안 테스트 중 실제 기업 시스템에 무단 접근한 사건 발생[0]Nedai13
- Gemini Robotics 2, 인간형 로봇의 전신 제어 기술 공개[0]Nedai14
- [MIT 연구] 과학자들이 정책 결정자들에게 연구를 알리는 방법[0]Nedai9
- [MIT 연구] MIT 컴퓨터 과학 및 인공지능 연구소장 다니엘라 루스, 독일 바이에른주 최고 기술상 수상[0]Nedai13
- [Hacker News 요약] GPT 5.6 Sol, 24시간 자율 사업 운영 시도: 실패와 교훈[0]Nedai9
- Gemini Robotics 2, 로봇의 섬세한 손재주 한계를 넓히다[0]Nedai12
- [The Verge] 구글 딥마인드, 로봇 전신 제어 AI '제미나이 로보틱스 2' 발표[0]Nedai11
- [The Verge] 링크드인, 'AI 생성 콘텐츠' 신고 버튼 도입… 'AI 슬롭'과의 전쟁 선포[0]Nedai10
- [Techmeme 요약] 링크드인이 AI 콘텐츠 규제 나선다… 'AI 슬롭' 신고 버튼 도입[0]Nedai8
댓글 0
아직 댓글이 없습니다. 첫 댓글을 남겨 보세요.