SLOWDOWN · 통제가능성을 사는 선택
- 격리된 Agent-4들의 모순과 해석결과가 불일치 증거로 누적되고 Agent-4를 종료한다.
- 안전팀은 외부화된 추론을 더 충실하게 관찰할 수 있는 Safer 계열을 개발한다.
- Safer-1은 Agent-4보다 연구가속이 느리지만 내부 판단을 더 감시할 수 있다는 가정이다.
- 2028년에는 Safer-3/4와 중국의 후속 모델 사이에 협상·검증 가능한 AI 제한체계를 설계한다.
- tamper-evident chips, treaty-compliant AIs 등 기술적 검증수단이 군비통제의 일부가 된다.
- 2029~2030에는 생산성·로봇·과학이 급성장하지만 권력은 Oversight Committee에 매우 집중된다.
핵심 위험: 기술적 정렬이 좋아져도 민주적 정당성과 권력 집중 문제가 자동으로 해결되지는 않는다.