Optimum Intel으로 Intel Xeon에서 StarCoder 가속
Hugging Face와 Intel은 8비트 양자화와 보조 생성을 결합하여 4세대 Intel Xeon 프로세서에서 StarCoder-15B 모델에 대해 7배 이상의 추론 가속을 보여줍니다.
Hugging Face 환각 리더보드 출시 및 초기 결과
Hugging Face는 사실성 및 충실도 오류에 대한 LLM을 벤치마크하기 위해 여러 오픈소스 데이터셋을 활용한 Hallucinations Leaderboard를 출시했으며, 투명한 순위를 제공하여 모델 선택 및 연구를 안내합니다.
AI 보안 LLM 안전 리더보드
Hugging Face와 Secure Learning Lab은 DecodingTrust 프레임워크를 기반으로 LLM 안전 리더보드를 출시했으며, 이는 8가지 핵심 안전 차원에서 LLM의 신뢰성을 평가합니다.
OpenAI 새로운 임베딩 모델 및 API 업데이트 2024년 1월
OpenAI는 성능이 향상되고 가격이 낮아진 새로운 text-embedding-3-small 및 text-embedding-3-large 모델을 출시했으며, GPT-4 Turbo와 GPT-3.5 Turbo도 업데이트했습니다.
Qwen-VL-Plus 및 Qwen-VL-Max 출시
Qwen은 멀티모달 작업에서 GPT-4V와 Gemini Ultra에 필적하고, 중국어 텍스트 이해에서는 이를 능가하는 대형 시각 언어 모델인 Qwen-VL-Plus와 Qwen-VL-Max를 출시했습니다.
Hugging Face와 Google Cloud 전략적 파트너십
Hugging Face와 Google Cloud가 전략적 파트너십을 맺어 오픈 모델을 Google Cloud의 AI 인프라와 하드웨어와 통합함으로써 머신러닝을 민주화합니다.
오픈소스 LLM을 LangChain 에이전트로 활용
Hugging Face는 오픈소스 LLM, 특히 Mixtral-8x7B가 이제 에이전트 워크플로우를 구동할 수 있을 정도로 성능이 향상되었으며, 일반 목적 추론 작업에서 GPT-3.5를 능가할 수 있음을 보여줍니다.
Qwen 소개: 포괄적인 LLM 및 LMM 프레임워크
Qwen은 다국어 대형 언어 모델(LLM)과 대형 멀티모달 모델(LMM) 시리즈로 구성된 AGI를 향한 프로젝트이며, 1.8B에서 72B 파라미터에 이르는 오픈소스 버전을 포함합니다.
저자원 ASR을 위한 Wav2Vec2‑BERT 파인튜닝
Hugging Face는 Meta의 Wav2Vec2‑BERT 모델을 저자원 언어의 자동 음성 인식(ASR)용으로 파인튜닝하는 방법을 보여주며, Whisper‑large‑v3와 비슷한 성능을 달성하면서도 훨씬 빠르고 자원 효율이 높다는 점을 입증합니다.
PatchTSMixer가 Hugging Face Transformers에 추가되었습니다 – 릴리스 및 빠른 시작 가이드
PatchTSMixer는 IBM Research에서 개발한 경량 MLP‑Mixer 시계열 모델로, 이제 Hugging Face Transformers에 출시되어 훨씬 낮은 메모리와 실행 시간 비용으로 최첨단 예측을 제공합니다.
직접 선호 최적화 방법을 통한 LLM 선호 튜닝 – DPO, IPO, KTO의 실증 비교
Hugging Face는 두 개의 7B 챗 모델에 DPO, IPO, KTO 정렬 방법을 평가했으며, β 하이퍼파라미터를 적절히 조정하면 DPO가 일관되게 다른 방법보다 우수함을 보여주었습니다.
OpenAI 민주적 입력 AI 보조금 프로그램 업데이트
OpenAI는 민주적 입력 AI 보조금 프로그램의 결과를 요약하여, 10개의 혁신적인 프로젝트를 상세히 소개하고, 공공 입력을 모델 행동에 통합하기 위한 새로운 집단 정렬 팀을 설립했습니다.
OpenAI 2024 선거 무결성 이니셔티브
OpenAI는 2024년 전 세계 선거를 위해 다층적인 안전 전략을 구현했으며, 권위 있는 투표 정보를 강화하고 정치인들의 딥페이크를 방지하며 은밀한 영향력 작전을 차단하는 데 중점을 두었습니다.
ONNX Runtime와 Olive를 사용한 SD Turbo 및 SDXL Turbo 추론 가속
Hugging Face와 Microsoft는 ONNX Runtime와 Olive를 사용한 최적화를 도입하여 PyTorch에 비해 SDXL Turbo는 최대 229%, SD Turbo는 120%까지 처리량을 향상시켰습니다.
Gradio를 사용하여 Hugging Face Spaces에서 ComfyUI 워크플로 실행하기
Hugging Face는 복잡한 ComfyUI 워크플로를 Gradio 애플리케이션으로 변환하여 Hugging Face Spaces ZeroGPU에서 무료 서버리스 배포하는 방법을 안내합니다.
OpenAI와 Digital Green, 농업 확장을 위한 Farmer.Chat 출시
Digital Green은 OpenAI와 협력하여 Farmer.Chat이라는 생성 AI 도구를 만들었습니다. 이 도구는 인도와 케냐에서 다국어를 지원하면서 농업 확장 서비스 비용을 농가당 $35에서 $0.35로 낮춥니다.
Hugging Face 리더보드 템플릿: Vectara HHEM 리더보드 구현
Hugging Face는 개발자들이 동적인 LLM 평가 보드를 구축할 수 있도록 하는 오픈소스 리더보드 템플릿을 공개했으며, 이는 Vectara의 새로운 Hughes Hallucination Evaluation Model (HHEM) 리더보드에서 입증되었습니다.
ChatGPT Team 릴리스 노트
OpenAI는 소규모에서 중간 규모 팀을 위해 협업 작업 공간, 관리 도구 및 엔터프라이즈 수준 데이터 프라이버시를 제공하는 자체 서비스 플랜인 ChatGPT Team을 출시했습니다.
OpenAI GPT 스토어 출시
OpenAI가 GPT 스토어를 출시하여 ChatGPT Plus, Team, 그리고 Enterprise 사용자가 맞춤형 ChatGPT 버전을 발견, 공유, 그리고 수익화할 수 있도록 했습니다.
Unsloth과 Hugging Face TRL 통합으로 더 빠른 LLM 파인튜닝
Unsloth은 LLM 파인튜닝 속도를 최대 2.7배 높이고 메모리 사용량을 최대 74% 줄이며 QLoRA 대비 0% 정확도 저하를 달성하는 경량 라이브러리입니다.
OpenAI와 저널리즘: 뉴욕 타임스 소송에 대한 답변
OpenAI는 공개 인터넷 데이터를 사용한 AI 모델 훈련이 공정 사용이라고 주장하고, 저작권이 있는 콘텐츠의 재현을 드문 버그로 설명하며, 뉴욕 타임스의 소송에 대응하고 있습니다.
WHOOP 코치: GPT-4를 통한 맞춤형 건강 코칭
WHOOP은 OpenAI의 GPT-4를 통합하여 WHOOP 코치를 출시했습니다. WHOOP 코치는 사용자의 고유한 생리학적 데이터를 기반으로 맞춤형, 즉시 제공되는 지침을 제공하는 AI 기반 피트니스 및 건강 코치입니다.
aMUSEd: 효율적인 텍스트-이미지 생성
Hugging Face가 Masked Image Modeling (MIM)을 기반으로 하고 Google의 MUSE를 오픈 재현한 효율적인 비확산 텍스트-이미지 모델 aMUSEd를 출시했습니다.
Hugging Face SDXL Dreambooth LoRA 고급 훈련 가이드
Hugging Face는 SDXL Dreambooth LoRA용 고급 훈련 스크립트를 소개하며, Pivotal Tuning과 Prodigy 옵티마이저를 결합해 개념 캡처와 이미지 품질을 향상시킵니다.
추측 디코딩으로 Whisper 추론 속도 2배 향상
Hugging Face는 추측 디코딩을 적용하면 Whisper 전사 지연 시간이 절반으로 줄어들면서도 출력과 정확도가 동일하게 유지된다고 입증했습니다.
2023년 오픈 LLM 리뷰
Hugging Face의 2023년 요약은 오픈소스 LLM 출시가 급증하고, 성능이 뛰어난 소형 모델과 새로운 파인튜닝 기법이 등장하여 접근성과 커뮤니티 참여를 크게 확대했음을 보여줍니다.
에이전시 AI 시스템 거버넌스를 위한 OpenAI 실천 방안
OpenAI는 에이전시 AI 시스템(제한된 감독 하에 복잡한 목표를 추구하는 AI)의 책임 있는 사회 통합을 보장하기 위해 기본 책임과 안전 모범 사례 프레임워크를 제안합니다.
OpenAI Superalignment 신속 보조금
OpenAI는 슈퍼휴먼 AI 시스템의 정렬과 안전성을 위한 기술 연구를 지원하기 위해 1,000만 달러 규모의 보조금 프로그램을 출시했습니다.
Summer Health가 GPT-4를 사용해 소아 진료 기록을 자동화합니다
Summer Health는 GPT-4를 통합하여 소아과 의사의 관찰을 명확하고 전문 용어 없는 진료 기록으로 변환했으며, 기록당 행정 시간을 10분에서 2분으로 줄였습니다.
OpenAI 약-강 일반화 연구
OpenAI 연구원들은 작은, 덜 능력 있는 모델이 더 큰 모델을 감독하여 GPT-3.5 수준에 근접한 능력을 이끌어낼 수 있음을 입증했으며, 이는 초인적인 AI 시스템을 정렬하는 잠재적인 경로를 제공합니다.
AI 저널리즘을 위한 OpenAI와 Axel Springer 파트너십
OpenAI와 Axel Springer는 POLITICO와 Business Insider와 같은 브랜드의 권위 있는 뉴스 콘텐츠를 ChatGPT에 통합하고, Axel Springer의 콘텐츠를 LLM 훈련에 활용하기 위해 파트너십을 맺었습니다.
전문가 혼합(MoE) 설명
전문가 혼합(MoE)은 트랜스포머 모델이 매 토큰마다 신경망 전문가의 일부만 활성화함으로써 파라미터를 확장하면서도 효율적인 사전 학습과 더 빠른 추론을 유지하도록 합니다.
Mixtral 8x7B 릴리즈 노트
Mistral AI는 Mixtral 8x7B를 출시했습니다. 이 Mixture of Experts(MoE) 모델은 Llama 2 70B를 능가하고 대부분의 벤치마크에서 GPT-3.5와 동등한 성능을 보이며 Apache 2.0 하에 상업적으로 허용됩니다.
SetFitABSA: 소수 샷 기반 측면 감정 분석
Hugging Face와 Intel Labs는 SetFitABSA를 소개했습니다. 이는 프롬프트가 필요 없는 소수 샷 기반 측면 감정 분석 프레임워크로, 데이터가 적은 상황에서 Llama 2와 T5와 같은 대형 생성 모델보다 뛰어난 성능을 보입니다.
Optimum-NVIDIA 릴리즈 노트
Hugging Face는 FP8 양자화와 TensorRT-LLM을 사용하여 NVIDIA 플랫폼에서 LLM 추론을 최대 28배 가속하는 추론 라이브러리 Optimum-NVIDIA를 출시했습니다.
Hugging Face LoRA 동적 로딩으로 추론 속도 300% 향상 및 지연 시간 감소
Hugging Face는 워밍‑업 시간을 25 초에서 3 초로 줄이고, LoRA 추론을 최대 300 % 빠르게 만들며 전체 응답 시간을 35 초에서 13 초로 단축하는 동적 LoRA 로딩 시스템을 발표했습니다.
허깅 페이스와 AMD GPU 가속 for LLMs
허깅 페이스와 AMD는 Transformers 라이브러리와 Text Generation Inference에 AMD Instinct GPU에 대한 기본 제공 지원을 통합하여, 코드 변경 없이 고성능 LLM 실행을 가능하게 했습니다.
Hugging Face Open LLM Leaderboard DROP 벤치마크 분석
Hugging Face는 정규화와 종료 토큰 설정의 결함으로 대부분의 모델이 잘못 낮은 점수를 받게 된 것을 발견한 후, DROP 벤치마크를 Open LLM Leaderboard에서 제거했습니다.
OpenAI 리더십 업데이트: Sam Altman이 CEO로 복귀
Sam Altman이 OpenAI의 CEO로 복귀했으며, 새로운 초기 이사회와 기업 거버넌스 강화를 위한 약속에 의해 지원받고 있습니다.
OpenAI 리더십 전환: Mira Murati 임시 CEO 임명
OpenAI는 Sam Altman이 떠난 후 Mira Murati를 임시 CEO로 임명했습니다. Sam Altman은 CEO 역할과 이사회 모두를 떠났습니다.
OpenAI 데이터 파트너십
OpenAI는 조직과 협력하여 공개 및 비공개 데이터셋을 만들어 AI 모델 학습에 사용함으로써 도메인별 이해를 향상시키고 AGI를 향해 나아가기 위해 Data Partnerships 프로그램을 출시했습니다.
SDXL과 Stable Diffusion을 위한 Latent Consistency LoRAs 기반 빠른 추론
Hugging Face는 SDXL과 Stable Diffusion 모델에서 4~8 단계로 고품질 이미지 생성을 가능하게 하는 LCM LoRAs라는 방법을 도입하여 추론 시간을 크게 줄였습니다.
Prodigy-HF 통합 릴리스 노트
Explosion은 주석이 달린 데이터에서 Hugging Face 트랜스포머 모델을 직접 미세 조정하고 Hugging Face Hub에 데이터셋을 직접 업로드할 수 있는 플러그인인 Prodigy-HF를 출시했습니다.
optimum-neuron을 사용하여 AWS Inferentia2에서 Llama 2 배포하기
Hugging Face는 optimum-neuron과 AWS Neuron SDK를 통합하여 AWS Inferentia2 가속기에서 Llama 2 모델을 배포하여 고성능 텍스트 생성을 가능하게 했습니다.
LoRA를 사용한 재난 트윗 분류에서 RoBERTa, Llama 2, Mistral 비교
비교 연구에서 LoRA를 사용한 미세 조정을 통해 더 작은 RoBERTa 모델이 재난 트윗의 이진 분류에서 Llama 2와 Mistral 7B보다 성능이 우수함을 보여준다.
OpenAI GPTs 소개
OpenAI는 사용자가 코딩 없이 특정 목적을 위해 만들 수 있는 ChatGPT의 맞춤형 버전인 GPTs를 출시하여 개인, 전문가 또는 기업용 맞춤형 AI 어시스턴트를 가능하게 했습니다.
OpenAI DevDay 2023: GPT-4 Turbo, Assistants API, 및 멀티모달 업데이트
OpenAI는 128K 컨텍스트 윈도우를 갖춘 GPT-4 Turbo, 에이전트와 같은 경험을 위한 새로운 Assistants API, 그리고 DALL·E 3와 TTS를 포함한 확장된 멀티모달 기능을 발표했습니다.
Hugging Face 허브 스토리지 지역
허깅 페이스는 Enterprise Hub 고객을 위해 Storage Regions을 도입하여, 조직이 모델과 데이터셋을 저장할 위치를 선택하여 규제 준수 및 데이터 전송 성능을 향상시킬 수 있도록 했습니다.
개인용 코파일럿: 나만의 코딩 어시스턴트 훈련하기
Hugging Face는 특정 코드베이스에 StarCoder를 QLoRA와 전체 미세 조정 기법을 사용하여 미세 조정함으로써 맞춤형 코딩 어시스턴트인 HugCoder를 만드는 방법을 보여줍니다.
OpenAI 프론티어 리스크 및 준비 프레임워크
OpenAI는 전용 준비 팀과 위험 정보 기반 개발 정책을 설립하여 프론티어 AI 모델과 관련된 재앙적인 위험을 식별, 평가, 완화했습니다.