Hugging Face와 Microsoft 전략적 협업 업데이트 2024년 5월
Hugging Face와 Microsoft는 클라우드 인프라, 하드웨어, 개발자 도구 전반에 걸쳐 오픈 소스 AI 모델의 배포와 사용을 간소화하기 위해 전략적 협업을 심화했습니다. 이번 파트너십은 Azure Model Catalog를 통해 오픈 모델을 보다 쉽게 접근할 수 있게 하고, 새로운 AMD 하드웨어에서 성능을 최적화하며, Hugging Face Spaces와 VS Code 간 개발자 워크플로를 효율화하는 데 중점을 두고 있습니다.
Azure AI Studio에서 확장된 오픈 모델 접근
Microsoft Azure AI Studio는 이제 확장된 Hugging Face 컬렉션을 제공하여 여러 고성능 오픈 대형 언어 모델(LLM)을 원클릭으로 배포할 수 있습니다. 이 통합을 통해 Azure AI 고객은 Hugging Face Hub에서 직접 또는 Azure AI Studio 인터페이스 내에서 모델을 배포할 수 있게 되었습니다.
컬렉션에 새롭게 추가된 모델은 다음과 같습니다:
- Llama 3 (Meta)
- Mistral 7B (Mistral AI)
- Command R Plus (Cohere for AI)
- Qwen 1.5 110B (Qwen)
- Open LLM Leaderboard에서 순위가 높은 Hugging Face 커뮤니티의 다양한 파인튜닝 모델들.
Azure에서 AMD MI300X를 활용한 하드웨어 최적화
Azure는 AMD Instinct MI300 GPU를 탑재한 Azure ND MI300X 가상 머신(VM)의 일반 제공을 발표했습니다. Hugging Face는 AMD와 Microsoft와 협력하여 이러한 VM에서 Hugging Face 모델의 성능과 비용 효율성을 최적화했습니다.
이 최적화는 Optimum-AMD 오픈 소스 라이브러리를 통해 이루어지며, ROCm 통합 및 AMD Instinct GPU에서 모델과 라이브러리를 지속적으로 테스트하여 높은 성능을 보장합니다.
오픈 사이언스와 로컬 추론의 발전
Microsoft는 Hugging Face Hub에 약 300개의 모델을 호스팅하는 등 오픈 사이언스에 지속적으로 기여하고 있습니다. 여기에는 MIT 라이선스를 가진 Phi-3 시리즈도 포함됩니다. 3.8 억 파라미터를 갖춘 Phi-3 mini 모델은 디바이스 내 애플리케이션을 위해 설계되었으며 현재 Hugging Face Chat에서 이용할 수 있습니다.
로컬 추론을 지원하기 위해 Hugging Face와 Microsoft는 Transformers.js와 ONNX Runtime Web을 통해 WebGPU를 활용하고 있습니다. 이 협업을 통해 Phi-3와 같은 모델을 브라우저에서 로컬로 실행할 수 있으며, 데모에서는 WebGPU를 사용해 Phi-3가 초당 70 토큰 이상을 생성하는 모습을 보여주었습니다.
Spaces Dev Mode를 통한 개발자 경험 향상
새로운 통합인 Spaces Dev Mode는 개발자가 Hugging Face Spaces(현재 50만 개 이상의 AI 데모 애플리케이션이 존재)와 로컬 VS Code 환경을 직접 연결하거나 웹 기반 VS Code 인스턴스를 사용할 수 있게 합니다.
Spaces Dev Mode는 현재 베타 단계이며 Hugging Face PRO 구독자에게 제공되고 있습니다. 이를 통해 로컬 개발과 클라우드에 호스팅된 AI 데모 간의 전환을 보다 원활하게 만들고자 합니다.