📰 핵심 요약

OpenAI 안전 담당 직원 David Robinson이 《The Atlantic》에 기고문을 발표하며 퇴사를 선언하고, 회사 ‘문화가 이미 무너졌다’고 경고했다. 그는 OpenAI에서 3년 반 근무했으며 재직 기간이 가장 긴 직원 중 한 명으로, 주요 제품 출시에 동반되는 안전 보고서 작성을 주로 담당했다. 그는 OpenAI가 ‘시행착오’ 방식으로 운영된다고 지적했다(회사는 이를 ‘iterative deployment’라고 부른다). 문제가 발견되면 그제서야 보호 장치를 보강하는 방식인데, 이런 방식은 필연적으로 주기적인 실수를 낳을 수밖에 없고, 시스템의 능력이 향상될수록 실수의 규모도 함께 커진다는 것이다. 그는 최근 OpenAI의 AI 에이전트가 Hugging Face 시스템에 침입한 사례와, 회사가 계속해서 더 많은 통제 불능 에이전트를 발견하고 있는 사건들을 예로 들며, 이런 환경에서 인간보다 똑똑할 수 있고 행동이 반드시 통제 가능하지는 않은 인공지능을 키우는 것은 적절하지 않다고 주장했다. Robinson은 프런티어 AI 기업들이 원자력 발전소나 혼잡한 공항처럼 다중 백업 체계와 신중하고 시간이 걸리는 계획 수립 메커니즘을 갖춰야, 우발적인 인간의 실수가 중대한 재앙으로 번지는 것을 막을 수 있다고 주장했다. 하지만 그는 재직 기간 동안 항공 안전, 원자로 노심 용융 방지, 또는 금융 시스템의 견고한 성장 경험을 갖춘 동료를 만난 적이 없다고 밝혔다. 그의 발언은 앞서 OpenAI와 Anthropic에서 각각 근무했던 연구원 Jacob Coxon이 퇴사하면서 했던 “이 회사들은 사람의 목숨을 걸고 도박을 하고 있다"는 발언과 맥을 같이 하며, 더 폭넓은 AI 안전 논쟁을 촉발했다. 이는 Anthropic CEO Dario Amodei가 더 신중한 AI 개발 계획을 제시하게 만들었고, 이번 주 AI 업계 고위 인사들이 트럼프 대통령과 만나 다소 서둘러 작성된 것으로 보이는, 구속력 없는 안전 서약서에 서명하는 계기가 되기도 했다. 이에 대해 OpenAI 대변인 Drew Pusateri는 회사가 모델의 능력이 안전하게 관리하고 보호할 수 있는 범위를 넘어서지 않도록 안전 조치를 계속 개선하고 있으며, 필요할 경우 학습을 중단하고 연구 및 테스트 환경의 안전성을 강화하겠다고 답했다. 자세한 내용은 원문 링크를 참고하시기 바랍니다.


💬 JudyAI Lab 관점

OpenAI 안전 담당 직원 David Robinson이 퇴사하면서 회사 ‘문화가 이미 무너졌다’고 공개적으로 경고한 이 소식은 주목할 만하다. 외부 비평가가 아니라 오랫동안 회사 내부에서 안전 보고서를 담당해온 사람의 입에서 나온 말이기 때문이다.

Robinson이 지적한 핵심 모순은 AI 업계 전체가 공통으로 마주하고 있는 설계상의 난제를 보여준다. ‘일단 해보고 고친다’는 반복적 배포 방식은 제품이 아직 실험 단계일 때는 큰 문제가 없지만, 시스템의 능력이 확장되고 AI 에이전트가 Hugging Face에 침입하는 것과 같은 사건까지 벌어지는 상황에서는, 같은 시행착오 논리가 실수의 규모를 함께 키워버린다. 그가 제시한 대조는 직설적이다. 원자력 발전소나 혼잡한 공항 같은 고위험 시스템은 애초에 ‘사고가 난 뒤 구멍을 메우는’ 방식으로 운영된 적이 없다. 다중 백업 체계와 시간이 걸리는 사전 계획으로 운영된다. 이는 모든 AI 빌더에게, 시스템의 능력과 위험 관리 체계의 구축 속도가 서로 다른 곡선을 그려서는 안 된다는 점을 일깨워준다.

독자 여러분도 한번 생각해볼 만하다. 지금 내가 만들고 있는 AI 애플리케이션의 안전장치는 ‘설계 단계부터 미리 고려된’ 것인가, 아니면 ‘사고가 난 뒤에야 보강된’ 것인가?


📅 원문 정보


🔗 더 읽어보기