Anthropic Claude Code 사용 보고서 2026년 6월 – 에이전트형 코딩, 전문성, 노동 시장 영향에 대한 발견

요약

Anthropic는 2025년 10월부터 2026년 4월까지 약 40만 건의 Claude Code 세션을 분석하여 사용자가 작업 계획을 수립하고 Claude가 실행을 담당하며, 다양한 직업군에서 전문성 수준이 높을수록 성공률과 작업 가치가 크게 향상됨을 확인했다.


연구 개요

Anthropic는 상호작용적이고 에이전트형 코딩 세션을 분석하기 위한 개인정보 보호 프레임워크를 도입했다. 데이터셋은 약 23만 명의 사용자로부터 약 40만 건의 세션을 포함하며, Claude Code의 CLI, 웹 UI, 데스크톱 앱을 통해 수집되었다. 분석은 작업 모드, 결정 분배, 세션 성공률이라는 세 가지 차원에 초점을 맞추며, 사용자의 전문성과 직업과의 관계를 탐구한다.


작업 모드와 작업 구성

결론: 코딩과 관련된 작업이 주를 이루지만, 비코딩 활동의 비중이 급격히 증가하고 있다.

  • 세션은 서로 배타적인 아홉 가지 작업 모드로 분류된다: 빌드, 수정, 테스트, 오케스트레이션(코드 중심), 운영(배포/모니터링), 이해계획(기존 시스템 분석), 분석소통(데이터 또는 논문).
  • 분포(그림 1): 세션의 56%는 코드 생성, 수정, 테스트를 포함한다(빌드 25%, 수정 26%, 테스트/오케스트레이션 5%). 소프트웨어 운영은 17%, 계획/탐색은 14%, 분석/소통은 13%이다.
  • 분류 신뢰도는 높다: 코드 변경으로 라벨링된 세션 중 90% 이상이 해당하는 텔레메트리 데이터를 보여준다.

사용자와 Claude 간의 노동 분배

결론: 사용자는 무엇을 만들 것인지를 결정한다(계획 결정의 약 70%), Claude는 어떻게 만들 것인지를 결정한다(실행 결정의 약 80%).

  • 결정 할당: 분류기가 대화 기록을 분석하여 각 결정을 계획 또는 실행으로 분류하고, 사용자 또는 Claude에게 할당한다.
  • 평균 비중: 사용자는 약 70%의 계획 결정을 내리지만, 실행 결정의 약 20%만을 담당한다.
  • 턴당 작업 수: 일반적인 세션은 약 4회의 프롬프트-작업 사이클을 가진다. 사용자의 프롬프트는 약 10회의 Claude 작업(약 2,400단어의 출력)을 유도한다. Claude가 계획을 제어할 경우 턴당 작업 수는 약 16으로 증가하고, 사용자가 실행을 유지할 경우 약 8로 감소한다.
  • 그림 2는 계획과 실행 결정의 분배를 시각화한다.

전문성 수준과 모델 출력

결론: 더 전문적인 사용자는 Claude에게 더 긴, 더 풍부한 출력을 유도한다. 전문가의 경우 프롬프트당 최대 12회의 작업과 3,200단어의 출력을 얻는 반면, 초보자는 5회의 작업과 600단어에 그친다.

  • 전문성은 대화 기록의 단서(명확한 지시, 검증 요청, 수정 방향)를 바탕으로 5단계의 초보자에서 전문가까지의 척도로 추정한다.
  • 표 1(그림 3)은 공개된 SWE-chat 데이터셋에서 초보자와 전문가 세션의 예시를 보여준다.
  • 작업 수와 단어 수는 전문성 수준과 함께 단조로운 증가 추세를 보이며, 회귀 분석은 통계적 유의성(p < 0.001)을 확인하고, 전문성 수준당 작업 수 +9%, 단어 수 +13%의 증가를 확인한다.

누구들이 Claude Code를 사용하는가?

직업 분포

결론: 소프트웨어 관련 직업이 가장 큰 사용자 집단이지만, 비즈니스, 예술, 경영, 과학 등 다양한 직업군이 정기적으로 Claude Code를 활용하고 있다.

  • 직업은 대화 맥락(파일 이름, 참조된 자산, 도메인 용어)을 바탕으로 추론하고, 23개의 SOC 카테고리로 매핑한다.
  • 약 70%의 세션에서 직업이 식별 가능하다. 상위 카테고리: 컴퓨터 및 수학, 비즈니스 및 재무 운영, 예술/디자인/미디어, 경영, 생명/물리/사회 과학.
  • 비소프트웨어 분야에서 가장 빠르게 성장하는 그룹: 경영, 영업, 법조.

작업 유형의 변화

결론: 일곱 달 동안 수정 세션의 비중은 33%에서 19%로 감소했고, 운영, 작성, 분석 세션은 각각 약 두 배로 증가했다.

  • 그림 4는 작업 모드 비중을 추적하며, 배포, 데이터 분석, 문서 생성 등 종단간 에이전트형 작업으로의 전환을 보여준다.
  • 프리랜서 마켓플레이스 수준의 수익을 기반으로 추정한 경제적 가치는 전반적으로 27% 증가했으며, 빌드, 운영, 수정 작업은 각각 약 30~40% 증가했다.

성공 지표와 전문성의 역할

결론: 사용자의 전문성 수준이 높을수록 검증된 성공률과 강하게 상관되며, 초보자에서 중급자로 옮길 때 가장 큰 성과를 얻는다.

  • 성공 정의: 두 단계 분류기가 사용자가 목표를 달성했는지(성공, 부분 성공, 실패, 명확한 목표 없음) 판단한다. 별도의 검증기는 git 커밋, 풀리퀘스트 병합, 통과한 테스트, 사용자 명시적 확인과 같은 강한 신호를 확인한다. 검증된 성공은 두 조건 모두 충족해야 한다.
  • 명확한 목표가 없는 세션(~7.7%의 데이터)은 성공 분석에서 제외된다.
  • 성공률(그림 5):
    • 초보자: 검증된 성공률 15%, 부분 성공률 77%
    • 중급/전문가: 검증된 성공률 2833%, 부분 성공률 9192%
  • 문제 발생 시(실패 신호 > 3개) 검증된 성공률은 초보자(4%)에서 전문가(15%)로 상승하고, 부분 성공률은 60%에서 약 80%로 증가한다.
  • 포기(실패 + 코드 0줄)는 초보자 세션의 19%에서 발생하지만, 전문성 수준이 높을수록 5~7%로 감소한다.

직업 vs. 전문성

결론: 직업보다 전문성이 더 중요하다. 다양한 직업군 간 성공률은 몇 퍼센트 차이에 불과하다.

  • 모든 세션에서 검증된 성공률: 소프트웨어 관련 사용자 30%, 기타 직업군 26%
  • 코드 생성 세션에서 검증된 성공률은 소프트웨어 분야 34% vs. 기타 29%; 부분 성공률은 둘 다 88%를 초과한다.
  • 그림 6은 10대 주요 직업군이 소프트웨어 엔지니어와 7포인트 이내의 범위에 있음을 보여준다. 경영 직업군은 검증된 성공률에서 엔지니어를 약간 상회하며, 명확한 확인 언어 사용이 원인일 수 있다.

노동 시장에 대한 함의

결론: 에이전트형 코딩은 공식적인 코딩 배경의 중요성을 낮추지만, 도메인 전문성의 가치를 극대화한다. 적당한 전문성만으로도 대부분의 이점을 얻을 수 있으며, 심층적인 숙련도는 추가적인 이득을 거의 제공하지 않는다.

  • 강력한 도메인 지식을 가진 사용자는 Claude에게 더 많은 작업을 지시할 수 있어, 더 높은 성공률과 더 높은 가치의 작업을 달성할 수 있다.
  • 노동 분배는 코딩 에이전트가 구현 엔진 역할을 하며, 인간은 문제 정의도메인 판단을 제공함을 시사한다.
  • 향후 모델이 전문성 장벽을 낮춘다면, 모든 직업군에서 소프트웨어 개발의 보편적 채택이 가능해지고, 기술 수요 구조가 재편될 수 있다.

제한점과 향후 연구 방향

  • 생성된 코드의 실제 결과(예: 배포 후 사용)는 측정되지 않았다.
  • 비상호작용적인 Claude Code 사용(예: 일괄 생성)은 제외됨; 향후 프레임워크는 이 활동도 포착할 예정이다.
  • 모든 분류는 모델 기반 대화 기록 분석에 의존한다. 텔레메트리 교차 검증은 높은 일치도를 보였지만, 대규모 인간 검증은 여전히 도전적이다.
  • 모델이 더 자율적으로 발전함에 따라 전문성의 수익이 감소하는지 지속적으로 모니터링할 예정이다.

참고문헌


참조된 모든 그림은 원본 Anthropic 보고서에서 재생산되었습니다.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch