Claude 2.1 출시 노트
Anthropic은 대규모 컨텍스트 창 확장, 향상된 사실적 정확성, 그리고 새로운 통합 기능을 갖춘 기업용 애플리케이션을 위해 설계된 업데이트된 모델인 Claude 2.1을 출시했습니다. 이번 출시는 대규모 데이터 세트를 처리하는 모델의 능력을 강화하고 허위 진술의 빈도를 줄여 비즈니스 운영의 신뢰성을 높이는 데 중점을 둡니다.
200K 토큰 컨텍스트 창
Claude 2.1은 이전 용량의 두 배인 200,000 토큰 컨텍스트 창을 제공하며, 이는 약 150,000 단어 또는 500페이지 이상의 텍스트에 해당합니다. 이러한 확장을 통해 사용자는 전체 코드베이스, 재무 제표(S-1s와 같은), 그리고 긴 문학 작품을 분석을 위해 입력할 수 있습니다.
이 창을 통해 가능해진 주요 기능은 다음과 같습니다:
- 대규모 요약: 방대한 양의 콘텐츠를 처리하고 압축합니다.
- 복잡한 Q&A: 제공된 광범위한 데이터를 기반으로 질문에 답변합니다.
- 트렌드 예측: 패턴을 예측하기 위해 장기 데이터를 분석합니다.
- 문서 비교: 여러 개의 대형 문서를 동시에 대조합니다.
Anthropic은 200K 길이의 메시지를 처리하는 것은 업계 최초라고 언급했지만, 일반적으로 인간의 노력이 몇 시간 걸릴 작업을 완료하는 데 몇 분이 소요될 수 있습니다. 회사는 기술이 발전함에 따라 지연 시간이 감소할 것으로 기대합니다.
환각률 감소
Claude 2.1은 Claude 2.0에 비해 허위 진술이 2배 감소했습니다. 이러한 "정직성"의 향상은 모델이 잘못된 주장을 제공하는 대신 불확실성을 인정하는(demurring) 능력에 대해 평가된 정교하게 선별된 복잡한 사실적 질문 세트를 사용하여 측정되었습니다.
일반적인 정직성 외에도, 모델은 법률 및 재무 보고서와 같은 복잡한 문서에 대한 이해 및 요약에서 구체적인 이득을 보여줍니다:
- 오답: 30% 감소했습니다.
- 허위 주장: 문서가 특정 주장을 뒷받침한다고 잘못 결론짓는 비율이 이전 버전보다 3-4배 낮습니다.
API 도구 사용 (Beta)
Claude 2.1은 베타 기능으로 도구 사용(tool use)을 도입하여, 모델이 외부 API, 제품 및 개발자가 정의한 함수와 통합될 수 있도록 합니다. 이를 통해 Claude는 특정 작업에 필요한 도구가 무엇인지 결정함으로써 사용자를 대신하여 작업을 조율할 수 있습니다.
도구 사용 애플리케이션의 예시는 다음과 같습니다:
- 수치 추론: 복잡한 수학을 위해 계산기를 사용합니다.
- API 변환: 자연어 요청을 구조화된 API 호출로 변환합니다.
- 정보 검색: 데이터베이스를 검색하거나 웹 검색 API를 사용하여 질문에 답변합니다.
- 소프트웨어 자동화: 프라이빗 API를 통해 소프트웨어에서 간단한 작업을 수행합니다.
- 제품 추천: 사용자의 구매를 완료하도록 돕기 위해 데이터 세트에 연결합니다.
개발자 경험 및 시스템 프롬프트
Anthropic은 프롬프트를 반복하고 저장된 수정 사항과 함께 여러 프로젝트를 관리할 수 있는 플레이그라운드 스타일의 환경인 Workbench를 도입하여 개발자 경험을 업데이트했습니다. 개발자들은 또한 프롬프트를 SDK에 직접 통합할 수 있도록 코드 스니펫을 생성할 수 있습니다.
또한, 이번 출시는 시스템 프롬프트를 도입하여, 개발자가 Claude의 성격, 역할 및 응답 구조를 정의하기 위한 맞춤형 지침을 제공할 수 있게 함으로써, 특정 사용자 요구에 맞춘 더 일관적이고 맞춤화된 출력을 보직합니다.
가용성 및 가격 정책
Claude 2.1은 Anthropic Console의 API를 통해 사용할 수 있으며, claude.ai의 채팅 경험을 구동합니다(무료 및 Pro 티어 모두).
200K 토큰 컨텍스트 창은 Claude Pro 사용자에게만 특별히 예약되어 있습니다. Anthropic은 또한 모델 전반에 걸쳐 비용 효율성을 개선하기 위해 가격 정책을 업데이트했습니다.
Sources
- OriginalIntroducing Claude 2.1
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch