Claude 3 모델 패밀리 출시

Anthropic는 지능, 속도, 비용 사이에서 확장 가능한 균형을 제공하도록 설계된 세 가지 모델—Opus, Sonnet, Haiku—로 구성된 Claude 3 모델 패밀리를 발표했습니다. 이번 출시는 일반 지능 분야에서의 중요한 진전을 나타내며, 다중 모달 비전 기능을 도입하고 전체 패밀리에서 불필요한 거부 반응을 줄였습니다.

모델 등급 및 기능

Claude 3은 다양한 운영 요구에 맞춰 설계된 세 가지 모델로 나뉩니다:

  • Claude 3 Opus: 패밀리 내에서 가장 지능적인 모델로, 매우 복잡한 작업에 적합합니다. MMLU(학부 수준 전문 지식), GPQA(대학원 수준 전문 추론), GSM8K(기초 수학)과 같은 벤치마크에서 경쟁 모델을 능가합니다. 작업 자동화, 연구 개발, 고도 전략 분석에 사용됩니다.
  • Claude 3 Sonnet: 지능과 속도 사이의 균형을 목표로 합니다. Claude 2 및 2.1보다 2배 빠르며, RAG, 영업 자동화, 코드 생성과 같은 기업 업무에 최적화되어 있습니다.
  • Claude 3 Haiku: 가장 빠르고 비용 효율적인 모델입니다. 실시간 고객 채팅, 콘텐츠 모니터링, 비구조화된 데이터에서 지식 추출에 적합합니다.

기술적 진보

비전 및 다중 모달성

모든 Claude 3 모델은 사진, 차트, 그래프, 기술 도면과 같은 시각적 형식을 처리할 수 있는 고도로 발전된 비전 기능을 갖추고 있습니다. 이 기능은 PDF, 흐름도, 프레젠테이션 슬라이드에 저장된 지식 기반을 보유한 기업 사용자를 대상으로 합니다.

정확도 및 환상 감소

Claude 3 Opus는 Claude 2.1에 비해 도전적인 개방형 사실 질문에서 정확도가 두 배 향상되었습니다. 또한 잘못된 답변(환상)의 수준이 낮아졌으며, 답을 모를 때 불확실성을 인정하는 빈도가 높아졌습니다.

컨텍스트 창 및 기억력

패밀리는 200K 컨텍스트 창으로 출시되었으며, 특정 고객에게는 100만 토큰을 초과하는 입력도 가능합니다. '침묵 속의 바늘'(NIAH) 평가에서 Claude 3 Opus는 방대한 문서 집합에서 정보를 회상하는 데 99% 이상의 정확도를 달성했으며, 테스트용 '침묵'이 텍스트에 인위적으로 삽입되었을 때 이를 식별하는 경우도 있었습니다.

지시사항 준수 및 구조화된 출력

Claude 3 모델은 복잡한 다단계 지시사항과 브랜드 음성 가이드라인을 더 잘 따르며, JSON과 같은 구조화된 출력을 더 잘 생성합니다. 이는 자연어 분류 및 감성 분석을 용이하게 합니다.

안전성 및 책임 있는 설계

Anthropic는 모델이 신뢰할 수 있도록 여러 안전 조치를 시행했습니다:

  • 거부율: 이전 세대에 비해 시스템 가드레일에 근접한 무해한 프롬프트에 대해 거부할 가능성이 훨씬 낮습니다.
  • 편향 감소: 질문 답변을 위한 편향 벤치마크(BBQ)에 따르면, Claude 3는 이전 모델보다 편향이 적습니다.
  • 안전 수준: Anthropic의 책임 있는 확장 정책에 따라 패밀리는 AI 안전 수준 2(ASL-2)를 유지합니다. 레드팀 평가 결과, 모델은 치명적인 위험 가능성에 거의 없음을 확인했습니다.
  • 헌법 기반 AI: 모델은 투명성과 안전성을 향상시키기 위해 헌법 기반 AI를 계속 사용합니다.

가격 및 가용성

모델 입력 (M 토큰당) 출력 (M 토큰당) 컨텍스트 창
Opus $15 $75 200K*
Sonnet $3 $15 200K
Haiku $0.25 $1.25 200K

*특정 사용 사례에 대해 1M 토큰 이용 가능.

가용성: Opus와 Sonnet은 Claude API(159개국에서 일반 제공) 및 claude.ai(무료 사용자는 Sonnet, Pro 구독자는 Opus)를 통해 이용 가능합니다. Sonnet은 Amazon Bedrock을 통해 이용 가능하며, Google Cloud의 Vertex AI 모델 가든에서 사전 프리뷰로 제공되며, Opus와 Haiku는 곧 출시될 예정입니다.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch