앤트로픽, 선구적인 안전 약속을 포기하다: 무엇이 바뀌었고, 왜 중요한가?

요약

  • 앤트로픽이 안전성 관련 약속을 완화했습니다.
  • 이전에 회사가 엄격하게 시행했던 개발 동결 조치는 투명성 제고를 약속하는 것으로 대체되었습니다.
  • 이러한 조치는 업계의 안전 기준을 낮출 수 있습니다.

인공지능 에이전트 클로드(Claude)를 만든 회사인 앤트로픽(Anthropic) 우리가 가장 좋아하는 생산성 도구이 회사의 핵심 특징 중 하나는 안전에 대한 확고한 의지입니다. 블로그 게시물회사는 책임 있는 확장 정책(RSP)과 버전 3.0에 포함된 변경 사항을 설명했습니다.

앤트로픽, 선구적인 안전 약속을 포기하다: 무엇이 바뀌었고, 왜 중요한가?

앤트로픽의 이전 안전 정책은 무엇이었습니까?

이 회사는 안전 보장에 있어 업계 표준을 세웠습니다.

앤트로픽이 진행 중인 변화를 이해하려면 먼저 기존의 책임 있는 확장 정책(RSP)을 이해해야 합니다. 앤트로픽은 2023년, AI 모델의 기능이 회사가 안전성을 입증할 수 있는 수준을 넘어서면 학습을 중단하겠다고 약속했습니다. 이러한 중단을 유발할 수 있는 안전상의 위험 신호는 다음과 같습니다.

  • 화학, 생물학 또는 핵무기 개발이나 배치에 도움이 될 수 있는 모델.
  • 스스로를 과도하게 개선할 수 있는 모델들.
  • 사이버 공격에 도움이 될 수 있는 모델들.
  • 인간의 개입 없이 특정 방식으로 작동할 수 있는 모델, 예를 들어 전원이 꺼지는 것을 피하기 위해 주변 환경에서 "탈출"하는 모델 등이 있습니다.

책임 있는 확장 정책(RSP)은 이러한 모델에 엄격한 제한을 두었습니다. 앤스로픽은 경쟁업체에 추월당하더라도 개발을 중단했습니다. 모두가 숨 가쁘게 경쟁하는 업계에서 이는 매우 대담한 입장이었습니다.

앤트로픽의 새로운 책임 있는 확장 정책(RSP)

버전 3.0에서는 규칙이 상당히 완화되었습니다.

앤트로픽은 여전히 ​​책임 있는 확장 정책을 유지하고 있지만, 버전 3.0부터는 경쟁사 대비 상당한 우위를 확보했다고 판단될 경우에만 개발을 중단할 것입니다. 개발 중단에 대한 구속력 있는 약속은 회사가 안전 목표를 달성하고 경쟁사의 안전성과 동등하거나 그 이상을 달성하고 있는지에 대한 투명성 확보 약속으로 대체되었습니다. 다시 말해, 안전에 대한 확약을 한 것입니다.

이러한 변화를 촉발한 요인은 무엇일까요? 앤트로픽은 기존의 안전 서약(RSP)이 원하는 효과를 거두지 못했다고 밝혔습니다. RSP는 다른 기업들이 따라야 할 안전 모범 사례를 제시하기 위한 것이었지만, 경쟁사들은 이를 제대로 인식하지 못했습니다. 앤트로픽은 자사의 노력을 제한함으로써 안전 의식이 낮은 경쟁사들이 시장을 장악하고 개발 속도를 좌우하도록 방치하고 있다고 판단했습니다.

이것이 업계에 어떤 의미를 갖는가?

큰 퇴보

불행히도 이러한 변화는 인공지능 분야에 좋지 않은 선례를 남길 수 있습니다. Anthropic은 안전 관행의 모범 사례였는데, 이러한 변화로 인해 기준이 상당히 낮아졌습니다. 이는 경쟁사들에게 안전이 혁신보다 후순위라는 메시지를 전달할 수 있습니다. 이러한 변화가 클로드에게는 도움이 될 수도 있겠지만, ChatGPT와의 근황 공유하지만 이는 여전히 잘못된 방향으로 나아가는 것처럼 보입니다.

궁극적으로 AI 비관론자들의 우려를 불식시키려면 한 기업의 안전 약속만으로는 충분하지 않습니다. 업계 전체가 단결하여 분명한 선을 그어야 합니다. 하지만 현재로서는 이러한 일이 일어날 가능성이 점점 희박해 보입니다.

맨 위로 이동 버튼