뉴스로 돌아가기

Anthropic은 사용자가 Claude를 무기, 병원균 및 모니터링을 위해 고용하려고 시도했다고 말합니다.

이 회사는 식별된 작전을 방해했다고 말하지만 위협 보고서는 일반적인 AI가 군사, 생물학 및 정보 활동에 대한 장애물을 어떻게 줄이는지 보여줍니다.

기계 번역 · 영어 원문 · 원문 보기

더 넓은 시도 오용 카탈로그

Anthropic에 따르면 범죄자, 국가 연결된 그룹, 연구원, 스파이웨어 운영자 및 선전가들은 사이버 공격에서 전통적인 무기 개발 및 생물학적 연구에 이르기까지 클로드 모델을 사용하려고 시도했습니다. 이 회사의 새로운 위협 정보 보고서는 미사일 및 드론 소프트웨어, 분쟁자의 모니터링, 영향 캠페인 및 합법적 인 과학 및 위험한 군사 응용 프로그램을 가질 수있는 연구를 포함하는 노력을 설명합니다.

회사는 보고서에 포함된 모든 작업을 발견하고 방해했다고 밝혔다. 그것은 여러 생물학적 사례 뒤에있는 기관이나 국가를 식별하지 않았으며 일부 연구원의 의도는 여전히 불확실하다고 말했습니다. 그 자격은 중요합니다 : 척구니아와 같은 바이러스에 대한 연구에 대한 도움은 백신에 기여할 수 있지만, 비슷한 지식과 실험실 계획은 해로운 병원성 작업으로 리디렉션 될 수 있습니다. 따라서 보고서는 생물학적 무기가 완성되었음을 증명하는 대신 위험 지표를 문서화합니다.

무기, 스파이 및 영향력 작전

Anthropic에 의해 설명 된 사례에는 예멘, 중국 및 러시아에서 화재 무기, 미사일, 무장 드론, 폭발물 및 기타 탄약과 관련된 소프트웨어를 개발하려는 시도가 포함되었습니다. 이 보고서는 또한 러시아 사이버 스파이 활동, 급속한 범죄 해킹, 시리아에서 중국과 관련된 유그루스 모니터링, 국내 분쟁자 모니터팅 및 러시아, 말레이시아, 이란 및 뱅갈라와 관련된 선전 작업을 확인했습니다. 이러한 예제들은 여러 개의 확립된 보안 위협에 대해 하나의 모델이 적용되고 있음을 보여주고, 전혀 새로운 분쟁 범주를 창출하는 대신에.

중앙 변화는 속도와 접근성입니다. 일반적인 목적을 위한 보조원은 사용자가 기술 정보를 조직하고, 코드를 제안하고, 재료를 번역하고, 복잡한 작업을 통해 이테라를 할 수 있도록 도와줍니다. 미국 국립안보국(NSA)은 이전에 반대자들이 이미 AI를 사용하여 공격적인 사이버 작전의 속도, 규모 및 고급화를 증가시키고 있다고 경고했는데, 이는 스파이어 피싱, 깊은 사실 및 국가 해커에 대한 지원을 포함한다. Anthropic의 사례는 더 넓은 패턴에 대한 회사 수준의 스냅샷을 제공합니다.

보고서가 해결하지 못하는 것

발견은 Anthropic의 내부 시야에서 자신의 서비스로 나온다. 그들은 오픈 모델, 경쟁 플랫폼 또는 모니터링 된 상업 인프라 밖에서 전적으로 운영되는 시스템을 통해 수행 된 오용을 측정하지 않습니다. 그들은 또한 회사의 탐지 방법과 어떤 활동이 의심되는지에 대한 판단에 의존합니다. 이것은 독립적 인 평가가 중요하게 만듭니다, 특히 Anthropic이 조사를 보호하기 위해 정체성을 유지하거나 의도를 결정할 수없는 경우.

즉각적인 정책 문제는 자발적인 모니터링과 계산 금지가 충분한지, 모델이 더 능숙한 코딩 및 과학 기능을 얻을 수 있는지 여부입니다. 정부와 개발자는 국경을 넘어 위험이 발생할 때 기밀 사고 공유, 독립적 인 평가 및 신속한 조정에 대한 메커니즘이 필요합니다. 이 보고서는 AI 보안을 현재 운영 국가 보안 문제로 취급하는 사례를 강화하고, 실패 시도, 입증 된 능력 및 성공적으로 완료 된 공격 사이의 명확한 구별을 유지합니다.