OpenAI 모델 증류 API 통합

OpenAI는 전체 증류 파이프라인(데이터셋 생성, 평가, 미세 조정)을 OpenAI 플랫폼에 직접 통합한 모델 증류 스위트를 출시했습니다. 이를 통해 개발자는 o1-preview 및 GPT-4o와 같은 고성능 최첨단 모델을 교사로 사용하여 GPT-4o mini와 같은 비용 효율적인 모델의 특정 작업에 대한 성능을 향상시킬 수 있습니다.

모델 증류 워크플로우

모델 증류는 더 강력한 “교사” 모델의 출력을 사용하여 소형이면서 비용 효율적인 모델을 미세 조정하는 과정입니다. 목표는 소형 모델이 낮은 운영 비용을 유지하면서 특정 작업에서 고급 모델의 성능에 맞추도록 하는 것입니다.

이전에는 이 과정이 다단계이자 반복적인 절차였으며, 개발자가 데이터셋 생성, 미세 조정, 성능 측정을 위해 분리된 도구들을 수동으로 조정해야 했습니다. 새로운 통합 스위트는 세 가지 핵심 구성 요소를 제공함으로써 이를 간소화합니다:

저장된 완성

Stored Completions는 개발자가 API를 통해 GPT-4o 또는 o1-preview와 같은 모델이 생성한 입력-출력 쌍을 자동으로 캡처하고 저장할 수 있게 합니다. 이를 통해 실제 프로덕션 데이터를 사용한 증류 데이터셋을 생성할 수 있으며, 이 데이터셋은 모델 평가 및 미세 조정에 활용될 수 있습니다.

Evals (베타)

Evals는 특정 작업에 대한 모델 성능을 측정하는 통합된 방법을 제공하는 베타 기능입니다. 개발자는 Stored Completions에서 가져온 데이터나 업로드된 데이터셋을 사용해 맞춤형 평가를 생성하고 실행할 수 있습니다. Evals는 미세 조정 과정과 독립적으로 사용되어 특정 사용 사례에 대한 모델 성능을 정량적으로 평가할 수 있습니다.

통합 미세 조정

Stored Completions와 Evals는 OpenAI의 기존 미세 조정 서비스와 완전히 통합됩니다. 개발자는 Stored Completions을 통해 생성된 데이터셋을 미세 조정 작업에 사용할 수 있으며, 이후 Evals를 활용해 결과 미세 조정 모델에 대한 성능 평가를 수행할 수 있습니다. 모든 과정이 단일 플랫폼 생태계 내에서 이루어집니다.

Sources