AWS와 OpenAI 전략적 파트너십

AWS와 OpenAI는 핵심 AI 워크로드를 확장하기 위해 AWS 인프라에 즉시 접근할 수 있도록 제공하는 다년 전략적 파트너십を発表했습니다. 이 380억 달러 규모의 7년 계약은 OpenAI가 AWS의 대규모 인프라를 활용하여 컴퓨팅 용량을 확장하고, 차세대 모델의 훈련 및 ChatGPT의 추론 서비스를 지원할 수 있도록 합니다.

컴퓨팅 인프라 및 스케일링

OpenAI는 최신형 NVIDIA GPU 수십만 개로 구성된 AWS 컴퓨팅을 활용할 것이며, 이는 수천만 개의 CPU로 확장 가능한 용량을 갖추고 있습니다. 이 인프라는 에이전틱 워크로드의 급속한 확장을 지원하고, frontier AI 모델에 필요한 컴퓨팅 파워에 대한 일반적인 수요를 충족하도록 특별히 설계되었습니다.

하드웨어 및 아키텍처

인프라 배치는 AI 처리 효율성을 최적화한 아키텍처 설계를 특징으로 합니다. 주요 기술 사양은 다음과 같습니다:

  • 하드웨어: 배치는 NVIDIA GB200과 GB300을 클러스터링하기 위해 Amazon EC2 UltraServers를 활용합니다.
  • 연결성: 동일한 네트워크에 이러한 GPU를 클러스터링함으로써 시스템은 상호 연결된 시스템 전반에 걸쳐低延迟 성능을 달성합니다.
  • 배포 타임라인: 초기 용량은 2026년 말까지 배포를 목표로 하며, 2027년 이후로 추가 확장을 위한 옵션이 있습니다.

전략적 목표 및 모델 배포

이 파트너십은 다음 시대의 AI를 구동하기 위해 필요한 컴퓨팅 생태계를 강화하는 것을 목표로 합니다. OpenAI CEO 샘 알트먼에 따르면, "프론티어 AI 확장은 massive하고 신뢰할 수 있는 컴퓨팅이 필요합니다."

Amazon Bedrock과의 통합

이 전략적 파트너십 이전에, OpenAI 오픈 웨이트 foundation 모델은 Amazon Bedrock에서 제공되었습니다. 이로 인해 Peloton, Thomson Reuters, Comscore, Bystreet, Triomics, Verana Health 등을 포함한 수천 개의 고객이 다음과 같은 작업에 OpenAI 모델을 활용하고 있습니다:

  • 에이전틱 워크플로우
  • 코딩
  • 코딩 및 과학적 분석
  • 수학적 문제 해결

운영 규모 및 보안

AWS는 OpenAI의 massive한 워크로드에 필요한 규모와 보안을 제공합니다. AWS는 500,000개 이상의 칩을 갖춘 클러스터를 관리한 경험이 있으며, 이는 ChatGPT를 실행하고 미래 모델을 훈련하는 데 사용되는 인프라의 신뢰성을 보장합니다.

Sources