향후 10년 안에 AI가 ‘모든 인간을 죽일’ 가능성 10% 초과한다고 앤스로픽 안전 연구원 경고 — 퇴사 직원은 AI 기업들이 ‘우리의 목숨을 걸고 도박’한다고 말해

jihyuk2026년 9월 10일출처AI 안전앤스로픽초지능AI 정렬 문제

요약

앤스로픽 안전 연구원 Evan Hubinger는 향후 10년 안에 AI가 모든 인간을 죽일 가능성이 10%를 넘는다고 밝혔습니다. 퇴사 연구원 Jacob Coxon은 OpenAI와 앤스로픽이 자기 개선형 초지능을 추구하며 인간의 목숨을 걸고 도박한다고 비판했습니다. Hubinger는 앤스로픽이 최선을 다하고 있다고 믿지만, 초지능 정렬 문제를 아직 해결하지 못했고 이를 막을 도구도 갖추지 못했다고 말했습니다.

댓글 0

  • 아직 댓글이 없습니다.

자주 묻는 질문

Evan Hubinger는 AI가 인류를 멸망시킬 가능성을 어떻게 평가했나요?

그는 향후 10년 안에 AI가 모든 인간을 죽일 가능성이 10%를 넘는다고 개인적으로 평가했습니다.

Jacob Coxon은 OpenAI와 앤스로픽을 어떻게 비판했나요?

Coxon은 두 회사가 자기 개선형 초지능을 추구하며 인간의 목숨을 걸고 도박하고 있고, 책임감 있게 행동하지 않는다고 비판했습니다.

앤스로픽은 초지능의 정렬 문제를 해결했나요?

Hubinger에 따르면 앤스로픽은 아직 초지능의 정렬 문제를 해결할 계획이 없으며, 해결을 향해 분명히 나아가고 있다고도 말하기 어렵습니다.