본문으로 건너뛰기
HOTAIRESEARCH

Claude가 Claude를 만든다: Anthropic의 재귀적 자기개선 경고와 브레이크 페달 요구

7 MIN READBY JJY
#Anthropic#Claude#재귀적 자기개선#AI 안전#AI 거버넌스#Jack Clark#브레이크 페달#RSI

핵심 요약

Anthropic이 6월 초 공식 사이트에 "When AI builds itself(AI가 자신을 만들 때)"라는 연구 보고서를 공개했습니다. Anthropic 공동 창업자 Jack Clark이 작성한 이 보고서의 핵심 주장은 단순하지만 묵직합니다. Claude는 이미 Anthropic 코드베이스에 병합되는 코드의 80% 이상을 작성하고 있으며, 2025년 초 한 자릿수 퍼센트였던 수치가 불과 16개월 만에 도달한 결과입니다. Clark은 AI 업계 전체가 "액셀은 있지만 브레이크가 없는 차"를 몰고 있다고 경고하면서, 재귀적 자기개선(RSI)이 현실화되기 전에 국제적으로 조율된 일시정지 메커니즘을 구축해야 한다고 주장합니다.

관련 글: Anthropic 비공개 S-1 제출: $965B에서 시작된 첫 트릴리언 AI 상장 카운트다운

재귀적 자기개선이란 무엇인가

재귀적 자기개선(Recursive Self-Improvement, RSI)은 AI 시스템이 인간 개입 없이 자기 자신의 후속 버전을 설계하고, 훈련하고, 배포하는 과정입니다. 개념 자체는 수십 년 전부터 AI 이론서에 등장했지만 Anthropic은 이 단계가 더 이상 먼 미래의 가설이 아니라고 봅니다.

현재 Anthropic 내부에서는 이미 루프의 절반이 돌고 있습니다. Claude가 Anthropic 소프트웨어를 개선하고, 그 개선된 소프트웨어가 다음 버전 Claude를 훈련시키는 데 활용됩니다. 완전한 RSI는 이 루프에서 인간 엔지니어가 빠져나간 상태를 의미합니다.

보고서는 "우리는 아직 거기에 도달하지 않았다"고 명시합니다. 하지만 바로 이어서 "예상보다 빠르게 다가오고 있다"고 덧붙입니다.

숫자로 보는 현재

Anthropic이 공개한 수치는 추상적 경고가 아닙니다. 실제 내부 운영 데이터입니다.

코드 비율 80% 돌파: 2025년 2월 Claude Code 출시 이전, Claude의 코드베이스 기여율은 낮은 한 자릿수 퍼센트였습니다. 16개월 뒤인 2026년 현재, 병합되는 전체 코드의 80% 이상이 Claude가 작성한 것입니다.

엔지니어 생산성 8배 향상: Anthropic 엔지니어들은 분기당 코드 배포량 기준으로 2021~2025년 평균 대비 8배 처리량을 달성하고 있습니다. 헤드카운트가 늘어난 게 아니라 사람 한 명당 산출량이 8배가 됐습니다.

4월, 4년치 작업을 한 달에: 2026년 4월 한 달 동안 Claude는 특정 API 오류 클래스를 1,000분의 1 수준으로 줄이는 800개 이상의 수정 패치를 배포했습니다. Anthropic의 한 시니어 엔지니어는 이 작업을 인간이 혼자 했다면 4년이 걸렸을 것이라고 평가했습니다.

지표수치기준
Claude 코드 작성 비율80%+2026년 현재 병합 코드
엔지니어 생산성 증가8배2021~2025 평균 대비
4월 수정 패치 수800+단일 월 기준
API 오류 감소 배율1,000분의 1동일 오류 클래스
동등 인간 작업 기간약 4년엔지니어 추산

이 수치들은 벤치마크나 시뮬레이션이 아닙니다. Anthropic 내부 프로덕션 데이터입니다.

브레이크 없는 차

Jack Clark의 비유는 직설적입니다.

"AI 업계에는 지금 액셀은 있지만 브레이크가 없다. 우리는 그 브레이크를 만드는 작업을 하고 싶다."

Anthropic은 RSI가 불가피하다고 주장하지 않습니다. Clark은 "이것은 선택의 문제"라고 명시합니다. AI 기업들이 RSI 임계점까지 아무런 제동 장치 없이 달리느냐, 아니면 그 전에 멈출 수 있는 구조를 먼저 만드느냐의 선택입니다.

문제는 현재의 경쟁 구도입니다. 어느 한 기업이 자발적으로 속도를 늦춰도, 다른 기업이 계속 달린다면 그 선택은 경쟁 열위로 돌아옵니다. 개별 기업 차원의 자정이 구조적으로 어려운 이유입니다. Anthropic은 이 점을 솔직하게 인정하면서, 해결책으로 국제 조율을 제시합니다.

Anthropic의 제안: 국제 조율 메커니즘

Anthropic이 요구하는 것은 "개발을 멈추자"가 아닙니다. "멈출 수 있는 옵션을 확보하자"입니다.

보고서에서 제시하는 방향은 크게 세 가지입니다.

첫째, 검증 가능한 일시정지 절차. 특정 역량 임계값에 도달한 AI가 식별될 경우, 여러 독립 기관이 공동으로 검증하고 개발을 일시 중단할 수 있는 국제적 절차를 구축합니다.

둘째, 정렬 연구 선행. RSI 가능 시점 전에 AI 정렬(Alignment) 연구가 충분히 성숙해야 합니다. 보고서에는 "사회 구조와 정렬 연구가 기술의 발전 속도를 따라잡을 수 있도록 일시적 여유가 필요할 수 있다"고 명시되어 있습니다.

셋째, 프론티어 기업 간 공동 참여. Anthropic 단독이 아닌 OpenAI, Google DeepMind, xAI 등 프론티어 연구 기관들이 함께 참여하는 프레임워크가 필요합니다.

타이밍도 주목할 만합니다. 같은 주에 미국에서는 Great American AI Act 초안이 상정됐고, 트럼프 행정명령도 공개 전 90일 정부 제출을 요구하고 있습니다. Anthropic의 제안은 규제 논의의 흐름에 합류하면서도 한 단계 더 나아간 것입니다.

업계 반응

발표 이후 찬성과 회의론이 모두 나왔습니다.

AI 안전 연구자들 사이에서는 "RSI 리스크를 공개적으로 인정하고 구체적 운영 수치를 공개한 최초의 대형 AI 연구소"라는 평가가 있습니다. OpenAI와 Google도 내부적으로 유사한 트렌드를 경험하고 있을 가능성이 높지만 수치를 공개하지 않았습니다.

한편 비판적 시각도 있습니다. "RSI의 문을 직접 열면서 동시에 규제를 요구하는 것은 자기모순"이라는 것입니다. 경쟁사에 불리한 규제를 선점하려는 전략적 행보가 아니냐는 의혹입니다.

Anthropic의 입장은 명확합니다. RSI가 가져올 이점(의학, 과학, 생산성 혁신)은 실재하고, 위험도 실재한다는 것. 그리고 업계 전체가 그 선택 앞에 있다는 것.

전망

이 보고서가 나온 시점의 맥락을 보면 타이밍이 절묘합니다. Apple이 Gemini 기반 Siri를 공개하고, Microsoft가 양자컴퓨팅 칩을 선보이고, NVIDIA가 AI PC를 선언한 같은 주에 Anthropic은 가속이 아닌 제동 장치를 이야기했습니다.

RSI가 언제 어떤 형태로 현실화될지는 단언하기 어렵습니다. 다만 Claude가 Anthropic 코드베이스의 80%를 이미 작성하고 있다는 사실은 추측이 아니라 현재 진행형입니다.

"브레이크 페달을 만들자"는 Anthropic의 제안이 국제 사회에서 어떻게 수용될지, 2026년 하반기 AI 거버넌스 논의의 핵심 의제가 될 것으로 보입니다. 특히 Anthropic 자체가 IPO를 준비하고 있는 상황에서 이 발표가 어떤 파장을 가져올지도 지켜볼 부분입니다.

참고

Share
JJY
// AUTHORJJY

AI · WEB SECURITY · DEV ENV

GH

새 글 알림 받기

스팸 없이 새 포스트만 전달합니다.

// RELATED

관련 포스트