Gradient Labs 은행용 AI 계정 관리자
Gradient Labs는 OpenAI 모델을 활용하여 모든 은행 고객에게 전담 AI 계정 관리자를 제공합니다. 이 시스템은 사기 신고 및 계정 확인과 같은 복잡한 은행 절차를 자동화하면서 엄격한 규정 준수와 자연스러운 음성 대화를 위한 낮은 지연 시간을 유지합니다.
음성 상호작용을 위한 고성능 모델
Gradient Labs는 자연스러운 음성 대화에 필요한 500밀리초 지연 시간을 달성하기 위해 생산 트래픽을 GPT-5.4 mini 및 nano로 전환하고 있습니다. Gradient Labs의 공동 설립자이자 최고 과학자인 Danai Antoniou에 따르면, OpenAI가 선택된 이유는 세 가지 핵심 요구 사항을 동시에 충족하는 유일한 제공업체였기 때문입니다: 명령 수행 정확도, 낮은 환각률, 그리고 음성 지연 제약 하에서 함수 호출의 신뢰성.
SOP에서 실시간 AI 시스템으로 전환
은행 상호작용은 표준 운영 절차(SOP)에 의해 관리됩니다. Gradient Labs의 AI 에이전트는 이러한 SOP를 실시간 시스템으로 변환하여 신원 확인, 카드 정지, 그리고 상태를 잃지 않고 중단이나 주제 전환을 처리할 수 있습니다.
궤적 정확도 및 모델 선택
Gradient Labs는 시스템이 시작부터 끝까지 올바른 절차 경로를 따르는지를 측정하기 위해 "궤적 정확도"라는 지표를 사용합니다. 초기 평가에서 GPT-4.1은 97%의 궤적 정확도와 일관성을 달성했으며, 가장 근접한 경쟁사인 88%를 크게 앞섰습니다.
하이브리드 아키텍처 및 가드레일
추론과 속도의 균형을 맞추기 위해 Gradient Labs는 하이브리드 아키텍처를 사용합니다:
- 추론 집약 단계: OpenAI 모델이 처리합니다.
- 결정론적 작업: 작은 모델이 처리합니다.
- 오케스트레이션: 중앙 추론 에이전트가 전문 기술을 관리하여 복잡한 사례가 워크플로우를 이동하면서도 컨텍스트를 유지하도록 합니다.
- 규정 준수: 15개 이상의 병렬 가드레일 시스템이 금융 조언 감지, 취약점 신호, 불만 및 민감한 데이터에 대한 무단 접근 시도를 모니터링합니다.
고위험 환경에서의 신뢰성 및 배포
높은 위험의 금융 환경에서 환각을 완전히 방지하기 위해 Gradient Labs는 엄격한 테스트 및 배포 프레임워크를 적용합니다:
- 행동 재생: 팀이 실제 고객 대화를 재생하고 AI 행동을 기대되는 절차와 비교합니다.
- 합성 테스트: 배포 전에 희귀한 엣지 케이스를 테스트하기 위해 합성 대화를 생성합니다.
- 점진적 롤아웃: 은행은 자동화할 고객 이슈의 특정 카테고리를 선택할 수 있으며, 저위험 워크플로우부터 시작합니다. 배포는 소량의 트래픽으로 시작하고, 자동화된 검사를 통해 성능을 모니터링하면서 확대됩니다.
- 시뮬레이션: 고객은 라이브 전 다양한 시나리오에서 AI 응답을 검토하기 위해 대화를 시뮬레이션할 수 있습니다.
비즈니스 영향 및 향후 방향
Gradient Labs는 고객이 CSAT 점수 98%에 달하고, 사기 및 분쟁과 같은 복잡한 워크플로우에서 첫날에 50% 이상의 해결률을 달성한다고 보고합니다. 이러한 성과는 지난 1년 동안 Gradient Labs의 매출이 10배 증가하는 데 기여했습니다.
향후 개발은 여러 상호작용에 걸쳐 컨텍스트를 유지하는 데 초점을 맞추어 AI가 진행 중인 이슈를 추적하고 고객의 전체 이력을 이해하도록 합니다. 이 목표는 OpenAI의 추론 모델이 최고 수준의 인간 에이전트와 동등한 일관성과 판단을 제공하는 방향과 일치합니다.