미국이 앤트로픽 모델 사용을 금지한 것은 AI 탈옥과 관련이 없었다

지난 주말 직전 앤트로픽(Anthropic)에 최신 AI 모델의 서비스를 중단하도록 사실상 강제한 미국 정부의 최근 집행 통지서는, AI 연구소 여부와 상관없이 모든 미국 기술 기업에 대한 엄중한 경고가 되어야 할 것이다.
간단히 정리해 보자면, 지난 금요일 오후 미국 상무부는 앤트로픽에 서한을 보내, 구체적으로 명시되지 않은 국가 안보 문제를 이유로 앤트로픽 직원들을 포함한 비미국인의 ‘Fable 5’ 및 ‘Mythos 5’ 접근을 금지하는 잘 알려지지 않은 수출 통제 규정을 인용했다. 앤트로픽은 이 서한이 모델의 안전 장치를 우회한 것과 관련이 있다고 보고 있으나, 구체적인 내용이 명시되지 않아 확실하지 않다고 밝혔다. 해당 서한은 공개되지 않았다.
이에 대응해 앤트로픽은 지침을 준수하기 위해 모든 고객을 대상으로 자사의 두 주력 모델 운영을 중단했다. 결과적으로 미국 정부는 법원의 승인 없이도 가능한 것으로 보이는 신속하고 일방적인 조치를 통해 한 기술 기업이 자사 모델을 오프라인으로 전환하도록 성공적으로 강요했다.
금요일 트럼프 행정부의 개입은 AI 산업도 정부의 간섭에서 자유롭지 않음을 보여준다. 또한 이는 기술 업계에 “규정을 준수하지 않으면 너희와 너희 제품을 모두 중단시킬 수 있다”는 더 광범위한 메시지를 전달한다.
Axios는 소식통을 인용해 주말 동안 양측 사이에 긴장된 상황이 벌어졌다고 전하며, AI 제품의 기술적 결함보다는 앤트로픽과 트럼프 행정부 간의 “성격 차이”가 이번 수출 지침의 발단이 되었음을 시사했다.
주말 동안 드러난 새로운 세부 사항들은 이미 의문스러운 정부의 논리에 대한 의구심을 더욱 키우고 있다.
사이버 보안 전문가이자 연구원이며 루타 시큐리티(Luta Security)의 창립자인 케이티 무소리스(Katie Moussouris)는 블로그 게시물을 통해, 앤트로픽이 최근 ‘Fable 5’의 가드레일 우회 가능성을 기술한 보안 연구원들의 논문 사본을 그녀에게 비공개로 공유했다고 밝혔다. (월스트리트저널(WSJ)은 이 논문의 저자들이 아마존 소속 보안 연구원들라고 보도했다.) 무수리스는 앤트로픽 측이 해당 논문에 대한 그녀의 견해를 묻기 위해 연락해 왔다고 밝혔다.
무수리스는 블로그 게시물에서 연구원들이 어떻게 가드레일 우회 공격을 유발했는지 설명했으나, 우회 공격 자체가 “수출 통제를 발동시켜서는 안 되는 상황”이었다고 지적했다. 핵심적인 차이는 AI 모델에게 “보안 문제를 위해 코드를 검토해 달라”고 요청하는 것과 “이 코드를 수정해 달라”고 요청하는 것 사이에 있다. 질문의 표현이 약간 다르더라도 최종 결과는 대체로 동일하다.
“논문에 기술된 행동은 실질적으로 수정할 수 없으며, 어떤 시도라도 모델의 방어 능력을 약화시킬 뿐이다”라고 말한 무수리스는 이 수출 통제 지침을 성급하고, 지나치게 강압적이며, 잘못된 조치라고 비판했다.
무수리스는 이후 수십 명의 다른 최고 보안 연구자 및 전문가들과 함께 트럼프 행정부에 수출 통제 명령을 철회할 것을 촉구하며, 미국 내 네트워크 방어 담당자들로부터 첨단 사이버 보안 역량을 빼앗는 이러한 조치를 “위험하다”고 규정했다.
이전 행정부들도 지식의 공백을 근거로 포괄적인 결정을 내린 적이 있다. 예를 들어, 2010년대에 미국 정부가 사이버 공격에도 사용될 수 있는 사이버 보안 도구를 다루는 수출법을 개정하기 위해 사용한 표현은 너무 광범위하여, 의도치 않게 합법적인 보안 및 취약점 연구를 거의 불법화할 뻔했다.
그러나 트럼프 행정부의 지침은 보복적인 성격으로 보인다.
테크 폴리시 프레스(Tech Policy Press)의 저스틴 헨드릭스 편집장은 트럼프 행정부의 이번 조치가 “중요 응용 분야에 대한 미국 AI의 신뢰성에 대해 외국 수도들에서 경각심을 불러일으킬 가능성이 높다”고 말했다. 이는 미국 내 AI 기업들이 미국 정부의 간섭 없이 운영될 수 있다고 믿을 수 없다는 메시지를 전달하는 것이다.
트럼프 행정부는 왜 수출 통제 지침을 발동했는지 확인하지 않았다. 당국자들이 보고서를 오해하고 과잉 반응한 것일까? 아마존 CEO 앤디 재시가 정부 고위 관리들에게 어떤 말을 했기에, 신중함에서든 악의에서든 이러한 대응이 촉발된 것일까? 번역 과정에서 무언가 누락된 것일까, 아니면 이미 행정부와 삐걱거리는 관계를 맺고 있는 앤트로픽(Anthropic)에 압력을 가하기 위한 수단이었을까? 백악관이 해당 서한의 요구가 초래할 광범위한 파장을 인지하지 못했고, 관계자들이 이제 자신들이 초래한 피해를 수습하기 위해 분주히 움직이고 있을 가능성도 있다.
헨드릭스의 말을 인용하자면, “고위 관리들이 개인적·정치적 요인에 따라 특정 업체를 편애하고 있다는 의혹의 구름이 드리워진 분위기”다. 그 여파로 정부는 미국산 소프트웨어의 출시를 얼마나 통제할 것인지에 대해 위험한 선례를 남겼다.
이번에는 정부가 앤트로픽(Anthropic)을 문제 삼았지만, 내일은 다른 누구라도 대상이 될 수 있다.
관련 기사
Anthropic, 새로운 동적 워크플로우 도구를 탑재한 Opus 4.8 출시
앤트로픽은 목요일, 자사의 주력 공개 모델인 ‘오푸스(Opus)’의 최신 버전인 4.8을 공개했다. 이전 버전과 가격이 동일한 이번 업데이트는 이제 모든 플랫폼에서 이용할 수 있다.Opus 4.7 출시 불과 41일 만에 Opus 4.8을 공개한 Anthropic은 개발 주기를 대폭 단축했으며, 이는 최근 Sonnet 및 Haiku 출시 시 보였던 3개월 및
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
Anthropic, Fable를 공개하다: 더 저렴하고 제한이 적은 AI 모델
Anthropic은 화요일에 Fable과 Mythos 5.1을 출시하며 최신 AI 기술의 쌍을 이루는 버전을 제공했습니다. 성능 향상 외에도 업데이트된 Fable 버전은 토큰 사용량을 줄이고 안전 필터를 강화하여 잘못된 제한을 최소화합니다.전작과 마찬가지로 Mythos 5.1은 사이버 보안 또는 생명 과학에 중점을 둔 검증된 Anthropic 파트너에게만 제한됩니다. 이제 제한이 없는 Fable 5.1은 클라우드 플랫폼과 Anthropic A
관련 특별 주제 추천
의견 (0)
0/500

지난 주말 직전 앤트로픽(Anthropic)에 최신 AI 모델의 서비스를 중단하도록 사실상 강제한 미국 정부의 최근 집행 통지서는, AI 연구소 여부와 상관없이 모든 미국 기술 기업에 대한 엄중한 경고가 되어야 할 것이다.
간단히 정리해 보자면, 지난 금요일 오후 미국 상무부는 앤트로픽에 서한을 보내, 구체적으로 명시되지 않은 국가 안보 문제를 이유로 앤트로픽 직원들을 포함한 비미국인의 ‘Fable 5’ 및 ‘Mythos 5’ 접근을 금지하는 잘 알려지지 않은 수출 통제 규정을 인용했다. 앤트로픽은 이 서한이 모델의 안전 장치를 우회한 것과 관련이 있다고 보고 있으나, 구체적인 내용이 명시되지 않아 확실하지 않다고 밝혔다. 해당 서한은 공개되지 않았다.
이에 대응해 앤트로픽은 지침을 준수하기 위해 모든 고객을 대상으로 자사의 두 주력 모델 운영을 중단했다. 결과적으로 미국 정부는 법원의 승인 없이도 가능한 것으로 보이는 신속하고 일방적인 조치를 통해 한 기술 기업이 자사 모델을 오프라인으로 전환하도록 성공적으로 강요했다.
금요일 트럼프 행정부의 개입은 AI 산업도 정부의 간섭에서 자유롭지 않음을 보여준다. 또한 이는 기술 업계에 “규정을 준수하지 않으면 너희와 너희 제품을 모두 중단시킬 수 있다”는 더 광범위한 메시지를 전달한다.
Axios는 소식통을 인용해 주말 동안 양측 사이에 긴장된 상황이 벌어졌다고 전하며, AI 제품의 기술적 결함보다는 앤트로픽과 트럼프 행정부 간의 “성격 차이”가 이번 수출 지침의 발단이 되었음을 시사했다.
주말 동안 드러난 새로운 세부 사항들은 이미 의문스러운 정부의 논리에 대한 의구심을 더욱 키우고 있다.
사이버 보안 전문가이자 연구원이며 루타 시큐리티(Luta Security)의 창립자인 케이티 무소리스(Katie Moussouris)는 블로그 게시물을 통해, 앤트로픽이 최근 ‘Fable 5’의 가드레일 우회 가능성을 기술한 보안 연구원들의 논문 사본을 그녀에게 비공개로 공유했다고 밝혔다. (월스트리트저널(WSJ)은 이 논문의 저자들이 아마존 소속 보안 연구원들라고 보도했다.) 무수리스는 앤트로픽 측이 해당 논문에 대한 그녀의 견해를 묻기 위해 연락해 왔다고 밝혔다.
무수리스는 블로그 게시물에서 연구원들이 어떻게 가드레일 우회 공격을 유발했는지 설명했으나, 우회 공격 자체가 “수출 통제를 발동시켜서는 안 되는 상황”이었다고 지적했다. 핵심적인 차이는 AI 모델에게 “보안 문제를 위해 코드를 검토해 달라”고 요청하는 것과 “이 코드를 수정해 달라”고 요청하는 것 사이에 있다. 질문의 표현이 약간 다르더라도 최종 결과는 대체로 동일하다.
“논문에 기술된 행동은 실질적으로 수정할 수 없으며, 어떤 시도라도 모델의 방어 능력을 약화시킬 뿐이다”라고 말한 무수리스는 이 수출 통제 지침을 성급하고, 지나치게 강압적이며, 잘못된 조치라고 비판했다.
무수리스는 이후 수십 명의 다른 최고 보안 연구자 및 전문가들과 함께 트럼프 행정부에 수출 통제 명령을 철회할 것을 촉구하며, 미국 내 네트워크 방어 담당자들로부터 첨단 사이버 보안 역량을 빼앗는 이러한 조치를 “위험하다”고 규정했다.
이전 행정부들도 지식의 공백을 근거로 포괄적인 결정을 내린 적이 있다. 예를 들어, 2010년대에 미국 정부가 사이버 공격에도 사용될 수 있는 사이버 보안 도구를 다루는 수출법을 개정하기 위해 사용한 표현은 너무 광범위하여, 의도치 않게 합법적인 보안 및 취약점 연구를 거의 불법화할 뻔했다.
그러나 트럼프 행정부의 지침은 보복적인 성격으로 보인다.
테크 폴리시 프레스(Tech Policy Press)의 저스틴 헨드릭스 편집장은 트럼프 행정부의 이번 조치가 “중요 응용 분야에 대한 미국 AI의 신뢰성에 대해 외국 수도들에서 경각심을 불러일으킬 가능성이 높다”고 말했다. 이는 미국 내 AI 기업들이 미국 정부의 간섭 없이 운영될 수 있다고 믿을 수 없다는 메시지를 전달하는 것이다.
트럼프 행정부는 왜 수출 통제 지침을 발동했는지 확인하지 않았다. 당국자들이 보고서를 오해하고 과잉 반응한 것일까? 아마존 CEO 앤디 재시가 정부 고위 관리들에게 어떤 말을 했기에, 신중함에서든 악의에서든 이러한 대응이 촉발된 것일까? 번역 과정에서 무언가 누락된 것일까, 아니면 이미 행정부와 삐걱거리는 관계를 맺고 있는 앤트로픽(Anthropic)에 압력을 가하기 위한 수단이었을까? 백악관이 해당 서한의 요구가 초래할 광범위한 파장을 인지하지 못했고, 관계자들이 이제 자신들이 초래한 피해를 수습하기 위해 분주히 움직이고 있을 가능성도 있다.
헨드릭스의 말을 인용하자면, “고위 관리들이 개인적·정치적 요인에 따라 특정 업체를 편애하고 있다는 의혹의 구름이 드리워진 분위기”다. 그 여파로 정부는 미국산 소프트웨어의 출시를 얼마나 통제할 것인지에 대해 위험한 선례를 남겼다.
이번에는 정부가 앤트로픽(Anthropic)을 문제 삼았지만, 내일은 다른 누구라도 대상이 될 수 있다.
Anthropic, 새로운 동적 워크플로우 도구를 탑재한 Opus 4.8 출시
앤트로픽은 목요일, 자사의 주력 공개 모델인 ‘오푸스(Opus)’의 최신 버전인 4.8을 공개했다. 이전 버전과 가격이 동일한 이번 업데이트는 이제 모든 플랫폼에서 이용할 수 있다.Opus 4.7 출시 불과 41일 만에 Opus 4.8을 공개한 Anthropic은 개발 주기를 대폭 단축했으며, 이는 최근 Sonnet 및 Haiku 출시 시 보였던 3개월 및
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
Anthropic, Fable를 공개하다: 더 저렴하고 제한이 적은 AI 모델
Anthropic은 화요일에 Fable과 Mythos 5.1을 출시하며 최신 AI 기술의 쌍을 이루는 버전을 제공했습니다. 성능 향상 외에도 업데이트된 Fable 버전은 토큰 사용량을 줄이고 안전 필터를 강화하여 잘못된 제한을 최소화합니다.전작과 마찬가지로 Mythos 5.1은 사이버 보안 또는 생명 과학에 중점을 둔 검증된 Anthropic 파트너에게만 제한됩니다. 이제 제한이 없는 Fable 5.1은 클라우드 플랫폼과 Anthropic A





집






