요약
- 앤트로픽이 안전성 관련 약속을 완화했습니다.
- 이전에 회사가 엄격하게 시행했던 개발 동결 조치는 투명성 제고를 약속하는 것으로 대체되었습니다.
- 이러한 조치는 업계의 안전 기준을 낮출 수 있습니다.
인공지능 에이전트 클로드(Claude)를 만든 회사인 앤트로픽(Anthropic) 우리가 가장 좋아하는 생산성 도구이 회사의 핵심 특징 중 하나는 안전에 대한 확고한 의지입니다. 블로그 게시물회사는 책임 있는 확장 정책(RSP)과 버전 3.0에 포함된 변경 사항을 설명했습니다.
![]()
로압 스리유에스
앤트로픽의 이전 안전 정책은 무엇이었습니까?
이 회사는 안전 보장에 있어 업계 표준을 세웠습니다.
앤트로픽이 진행 중인 변화를 이해하려면 먼저 기존의 책임 있는 확장 정책(RSP)을 이해해야 합니다. 앤트로픽은 2023년, AI 모델의 기능이 회사가 안전성을 입증할 수 있는 수준을 넘어서면 학습을 중단하겠다고 약속했습니다. 이러한 중단을 유발할 수 있는 안전상의 위험 신호는 다음과 같습니다.
- 화학, 생물학 또는 핵무기 개발이나 배치에 도움이 될 수 있는 모델.
- 스스로를 과도하게 개선할 수 있는 모델들.
- 사이버 공격에 도움이 될 수 있는 모델들.
- 인간의 개입 없이 특정 방식으로 작동할 수 있는 모델, 예를 들어 전원이 꺼지는 것을 피하기 위해 주변 환경에서 "탈출"하는 모델 등이 있습니다.
책임 있는 확장 정책(RSP)은 이러한 모델에 엄격한 제한을 두었습니다. 앤스로픽은 경쟁업체에 추월당하더라도 개발을 중단했습니다. 모두가 숨 가쁘게 경쟁하는 업계에서 이는 매우 대담한 입장이었습니다.
앤트로픽의 새로운 책임 있는 확장 정책(RSP)
버전 3.0에서는 규칙이 상당히 완화되었습니다.
앤트로픽은 여전히 책임 있는 확장 정책을 유지하고 있지만, 버전 3.0부터는 경쟁사 대비 상당한 우위를 확보했다고 판단될 경우에만 개발을 중단할 것입니다. 개발 중단에 대한 구속력 있는 약속은 회사가 안전 목표를 달성하고 경쟁사의 안전성과 동등하거나 그 이상을 달성하고 있는지에 대한 투명성 확보 약속으로 대체되었습니다. 다시 말해, 안전에 대한 확약을 한 것입니다.
이러한 변화를 촉발한 요인은 무엇일까요? 앤트로픽은 기존의 안전 서약(RSP)이 원하는 효과를 거두지 못했다고 밝혔습니다. RSP는 다른 기업들이 따라야 할 안전 모범 사례를 제시하기 위한 것이었지만, 경쟁사들은 이를 제대로 인식하지 못했습니다. 앤트로픽은 자사의 노력을 제한함으로써 안전 의식이 낮은 경쟁사들이 시장을 장악하고 개발 속도를 좌우하도록 방치하고 있다고 판단했습니다.
이것이 업계에 어떤 의미를 갖는가?
큰 퇴보
불행히도 이러한 변화는 인공지능 분야에 좋지 않은 선례를 남길 수 있습니다. Anthropic은 안전 관행의 모범 사례였는데, 이러한 변화로 인해 기준이 상당히 낮아졌습니다. 이는 경쟁사들에게 안전이 혁신보다 후순위라는 메시지를 전달할 수 있습니다. 이러한 변화가 클로드에게는 도움이 될 수도 있겠지만, ChatGPT와의 근황 공유하지만 이는 여전히 잘못된 방향으로 나아가는 것처럼 보입니다.
궁극적으로 AI 비관론자들의 우려를 불식시키려면 한 기업의 안전 약속만으로는 충분하지 않습니다. 업계 전체가 단결하여 분명한 선을 그어야 합니다. 하지만 현재로서는 이러한 일이 일어날 가능성이 점점 희박해 보입니다.







