OpenAI 파인튜닝 API 개선 및 맞춤 모델 프로그램 확장
OpenAI는 개발자 제어 기능을 강화한 파인튜닝 API를 업데이트하고, 깊은 도메인 전문 지식이 필요한 조직을 위해 지원 파인튜닝 및 완전 맞춤형 모델을 제공하도록 맞춤 모델 프로그램을 확장했습니다.
새로운 파인튜닝 API 기능
OpenAI는 자체 서비스 파인튜닝 API에 여러 기능을 도입하여 개발자에게 훈련 작업 및 모델 평가에 대한 보다 세밀한 제어를 제공했습니다. 이러한 업데이트는 모델을 특정 작업에 맞게 최적화함으로써 지연 시간을 줄이고, 정확성을 향상시키며, 비용을 낮추는 데 도움을 주는 것을 목표로 합니다.
Key technical improvements include:
- 에포크 기반 체크포인트 생성: API는 이제 각 훈련 에포크마다 전체 파인튜닝 모델 체크포인트를 자동으로 하나 생성합니다. 이는 특히 과적합을 해결할 때 재훈련 필요성을 줄여줍니다.
- 비교 플레이그라운드: 새로운 나란히 표시되는 UI를 통해 개발자는 여러 모델 또는 파인튜닝 스냅샷의 출력을 단일 프롬프트와 비교하여 인간 평가를 수행할 수 있습니다.
- 타사 통합: Weights and Biases를 시작으로 타사 플랫폼 지원이 추가되어, 개발자가 기존 기술 스택에 상세 파인튜닝 데이터를 통합할 수 있게 되었습니다.
- 포괄적인 검증 메트릭: 개발자는 이제 샘플링된 배치에 의존하는 대신 전체 검증 데이터셋에 대한 손실 및 정확도 메트릭을 계산할 수 있어 모델 품질을 보다 정확하게 파악할 수 있습니다.
- 하이퍼파라미터 구성: 하이퍼파라미터를 이제 대시보드에서 직접 설정할 수 있어 API나 SDK만 사용해야 하는 제한이 사라졌습니다.
- 대시보드 개선: 파인튜닝 대시보드가 이제 이전 구성에서 작업을 재실행하고 보다 상세한 훈련 메트릭을 확인할 수 있도록 지원합니다.
사례 연구: Indeed
Indeed는 GPT-3.5 Turbo의 파인튜닝 API를 활용해 개인화된 채용 추천을 생성했습니다. 모델을 고품질 설명을 생성하도록 파인튜닝함으로써 Indeed는 프롬프트 토큰을 80% 감소시켰으며, 이를 통해 월 100만 건 미만의 메시지에서 약 2천만 건으로 규모를 확장할 수 있었습니다.
확장된 맞춤 모델 프로그램
자체 서비스 API를 넘어서는 요구가 있는 조직을 위해 OpenAI는 맞춤 모델 프로그램을 확장했습니다. 이 프로그램은 OpenAI 연구원과 직접 협업하여 고급 기술을 활용해 특정 도메인에 최적화된 모델을 만들 수 있도록 지원합니다.
지원 파인튜닝
지원 파인튜닝은 표준 API를 넘어선 기술을 활용하는 협업 서비스로, 고급 하이퍼파라미터와 다양한 파라미터 효율 파인튜닝(PEFT) 방법을 대규모로 적용합니다. 이 서비스는 효율적인 훈련 데이터 파이프라인, 평가 시스템 및 맞춤형 파라미터 구축에 도움이 필요한 조직을 위해 설계되었습니다.
예시: SK Telecom
SK Telecom은 OpenAI와 협력하여 한국어 통신 분야에 맞게 GPT-4를 파인튜닝했습니다. 이 협업을 통해 다음과 같은 성과를 얻었습니다:
- 대화 요약 품질이 35% 향상되었습니다.
- 의도 인식 정확도가 33% 향상되었습니다.
- 기본 GPT-4 모델에 비해 고객 만족도 점수가 3.6에서 4.5(5점 만점)로 상승했습니다.
맞춤형 훈련 모델
수백만 개의 예시 또는 수십억 토큰에 달하는 방대한 독점 데이터셋을 보유한 조직을 위해 OpenAI는 완전 맞춤형 훈련 모델을 제공합니다. 이러한 모델은 새로운 중간 훈련 및 사후 훈련 기법을 통해 모델 훈련 과정을 수정하여 깊은 도메인 지식을 부여함으로써 처음부터 구축됩니다.
예시: Harvey
Harvey는 법률 AI 도구로, 사례법을 위한 맞춤형 훈련 모델을 만들기 위해 OpenAI와 파트너십을 맺었습니다. 프롬프트 엔지니어링과 RAG만으로는 필요한 법률 역사의 깊이를 충족시키기에 부족하다는 판단 하에, Harvey는 약 100억 토큰에 해당하는 데이터를 통합했습니다. OpenAI는 도메인 특화 중간 훈련 및 전문 변호사 피드백을 포함하도록 훈련 과정을 수정했습니다. 그 결과:
- 사실 기반 응답이 83% 증가했습니다.
- 변호사들 사이에서 맞춤형 모델의 출력이 GPT-4보다 97% 선호되었습니다.
플랫폼 상태 업데이트
2026년 5월 8일 현재, OpenAI는 파인튜닝 플랫폼을 단계적으로 종료하고 있습니다. 이 플랫폼은 신규 사용자가 접근할 수 없으며, 기존 사용자는 몇 개월 동안 훈련 작업을 계속 생성할 수 있습니다. 모든 파인튜닝 모델은 해당 기본 모델이 폐기될 때까지 추론에 사용할 수 있습니다.