stanfordnlp/CoreNLP

CoreNLP: A Java suite of core NLP tools for tokenization, sentence segmentation, NER, parsing, coreference, sentiment analysis, etc.

해결하는 문제

Stanford CoreNLP는 원시 인간 언어 텍스트를 구조화된 데이터로 변환하는 자연어 분석 도구 세트입니다. 텍스트에서 언어적 특징 추출을 자동화하여 상위 수준의 텍스트 이해 애플리케이션을 위한 기본 빌딩 블록을 제공합니다.

작동 방식

규칙 기반 시스템, 확률적 기계 학습 및 딥러닝 구성 요소를 조합하여 사용하는 Java로 작성된 통합 프레임워크입니다. 텍스트에서 다양한 언어 속성을 추출하기 위해 일련의 언어 분석 도구(annotators)를 실행하도록 시스템을 구성할 수 있습니다.

대상 사용자

학계, 산업계 및 정부의 연구원들이 영어, 아랍어, 중국어, 프랑스어, 독일어, 헝가리어, 이탈리아어 및 스페인어를 포함한 여러 언어의 자연어 처리 작업에 광범위하게 사용합니다.

주요 특징

  • 종합적인 분석: 단어의 기본형, 품사, 명명된 개체(회사, 사람 등) 및 통사 구조(구 또는 의존성)를 추출합니다.
  • 정규화: 날짜, 시간 및 수치량을 해석하고 정규화합니다.
  • 공지시 해결: 어떤 명사구가 동일한 개체를 참조하는지 식별합니다.
  • 다국어 지원: 세계 주요 언어에 대해 다양한 수준의 지원을 제공합니다.
  • 쉬운 통합: 단 두 줄의 코드로 전체 분석 도구 모음을 실행할 수 있습니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트