7101

프로덕션 환경에서의 LLM 최적화: 정밀도, 어텐션 및 아키텍처

Hugging Face는 저정밀도 양자화, 메모리 효율성을 위한 Flash Attention, 그리고 RoPE, ALiBi, MQA, GQA와 같은 아키텍처 최적화에 초점을 맞춘 효율적인 LLM 배포를 위한 핵심 기술들을 설명합니다.

7102

OpenAI는 새로운 더블린 사무소를 통해 유럽에 존재감을 확립합니다

OpenAI는 아일랜드 더블린에 새로운 사무소를 열어 유럽 운영, 신뢰 및 안전, 보안 엔지니어링, 법무 기능을 확장합니다.

7103

PyTorch FSDP를 사용한 Llama 2 70B 파인튜닝

Hugging Face는 CPU RAM 병목 현상을 극복하고 VRAM 사용량을 최적화하기 위해 PyTorch Fully Sharded Data Parallelism (FSDP) 및 Accelerate를 사용하여 Llama 2 70B를 파인튜닝하는 방법을 보여줍니다.

7104

Würstchen 소개: 이미지 생성을 위한 빠른 확산

Würstchen은 42x 공간 압축을 달성하여 훈련 및 추론 비용을 크게 줄이는 빠르고 효율적인 텍스트-이미지 확산 모델입니다.

7105

Hugging Face Transformers 양자화 개요

Hugging Face는 소형 장치에서 대규모 모델 추론을 가능하게 하고 효율적인 어댑터 미세 조정을 지원하기 위해 bitsandbytes 및 auto-gptq 양자화 방식을 기본적으로 지원합니다.

7106

SafeCoder 대 폐쇄형 코드 어시스턴트

Hugging Face는 오픈소스 StarCoder 모델을 기반으로 하는 엔터프라이즈급 코드 어시스턴트인 SafeCoder를 소개하며, 폐쇄형 대안보다 투명성, 커스터마이징, 데이터 프라이버시를 우선시합니다.

7107

T2I-Adapters를 사용한 SDXL의 효율적인 컨트롤러블 생성

Hugging Face와 TencentARC는 가벼운 플러그 앤 플레이 모델인 T2I-Adapter-SDXL을 소개합니다. 이 모델은 스케치와 깊이 맵과 같은 외부 신호를 사용하여 Stable Diffusion XL (SDXL) 생성을 정밀하게 제어하며, ControlNet에 비해 계산 오버헤드가 현저히 낮습니다.

7108

OpenAI DevDay 발표

OpenAI는 2023년 11월 6일 샌프란시스코에서 열리는 첫 번째 개발자 컨퍼런스인 DevDay를 발표했으며, 새로운 도구를 미리 살펴보고 개발자 커뮤니티와 소통할 예정입니다.

7109

Falcon 180B 출시 노트

TII는 1800억 파라미터를 갖춘 가장 큰 공개적으로 이용 가능한 언어 모델인 Falcon 180B를 출시했습니다. 이 모델은 3.5조 토큰으로 훈련되어 PaLM-2와 같은 독점 모델과의 경쟁을 목표로 합니다.

7110

Fetch 사례 연구: Amazon SageMaker와 Hugging Face를 사용하여 ML 처리 지연 시간을 50% 줄이기

Fetch는 ML 파이프라인을 Amazon SageMaker와 Hugging Face로 마이그레이션하여 영수증 스캔의 ML 처리 지연 시간을 50% 줄이고 문서 이해 모델 정확도를 200% 높였습니다.

7111

OpenAI AI 교육 가이드

OpenAI는 언어 지원, 수업 계획, 개인 맞춤형 튜터링을 위해 교육자들이 AI를 활용할 수 있는 실용적인 프레임워크와 프롬프트 템플릿을 제공합니다.

7112

AudioLDM 2 최적화 가이드: Hugging Face Diffusers를 사용한 추론 시간 단축

Hugging Face는 코드와 모델 최적화를 적용하여 AudioLDM 2의 추론 시간을 10배 이상 줄여, 10초 오디오 샘플 생성을 1초 미만으로 줄이는 방법을 보여줍니다.

7113

ChatGPT Enterprise 릴리스 노트

OpenAI는 조직에 엔터프라이즈급 보안, 개인정보 보호, 그리고 GPT-4에 대한 무제한 고속 액세스를 제공하는 ChatGPT Enterprise를 출시했습니다.

7114

Hugging Face 허브 Git 인증 변경

Hugging Face는 2023년 10월 1일에 비밀번호 기반 Git 인증을 중단하고 보안 강화를 위해 사용자에게 개인 액세스 토큰 또는 SSH 키로 전환하도록 요구했습니다.

7115

Code Llama 릴리스 노트

Code Llama은 Llama 2를 기반으로 한 오픈 액세스 모델 가족으로, 코드 작업에 특화되어 있으며 인필링과 최대 100,000 토큰까지의 긴 컨텍스트 윈도우를 지원합니다.

7116

OpenAI와 Scale의 기업용 파인튜닝 파트너십

OpenAI는 Scale과 파트너십을 맺어 기업에 GPT-3.5 Turbo 및 GPT-4 파인튜닝을 위한 전문 데이터 enrichment 및 모델 평가 지원을 제공합니다.

7117

Hugging Face AutoGPTQ 및 Transformers 통합

Hugging Face는 AutoGPTQ 라이브러리를 Transformers에 통합하여, 4비트에서 정확도 손실을 무시할 수 있는 수준으로 유지하면서 메모리 요구 사항을 줄이기 위해 LLM을 8, 4, 3 또는 2비트 정밀도로 양자화할 수 있도록 했습니다.

7118

GPT-3.5 Turbo 파인튜닝 및 API 업데이트

OpenAI는 GPT-3.5 Turbo에 대한 파인튜닝 기능을 출시하여 개발자가 모델 성능을 맞춤화하고, 출력 신뢰성을 향상시키며, 프롬프트 비용을 절감할 수 있도록 했습니다.

7119

IDEFICS: 최첨단 시각 언어 모델의 오픈 재현

Hugging Face는 Flamingo 아키텍처를 기반으로 한 오픈 액세스 시각 언어 모델인 IDEFICS를 출시했으며, 9B 및 80B 파라미터 크기의 interleaved 이미지 및 텍스트 입력을 지원합니다.

7120

Hugging Face SafeCoder 발표

Hugging Face는 기업이 자체 보안 인프라 내에서 독점적인 Code LLM을 구축하고 배포할 수 있도록 하는 자체 호스팅 엔터프라이즈급 코드 어시스턴트 솔루션인 SafeCoder를 선보였습니다.

7121

OpenAI가 Global Illumination을 인수함

OpenAI는 창의적 도구 및 인프라 회사인 Global Illumination을 인수하여, ChatGPT를 포함한 핵심 제품 개발에 팀을 통합했습니다.

7122

GPT-4를 사용한 콘텐츠 모더레이션

OpenAI는 정책 적용 및 정교화를 자동화하여 콘텐츠 모더레이션을 가속화하기 위해 GPT-4를 활용하고 있으며, 이로써 맞춤형 정책 개발에 필요한 시간을 개월에서 시간으로 단축하고 있습니다.

7123

AWS Marketplace의 Hugging Face Hub

Hugging Face는 AWS Marketplace와 Hub를 통합하여, 조직이 AWS 계정을 통해 Inference Endpoints 및 AutoTrain과 같은 관리형 서비스를 직접 결제할 수 있도록 했습니다.

7124

BentoML을 사용한 DeepFloyd IF 배포

Hugging Face는 BentoML을 사용하여 DeepFloyd IF 텍스트-이미지 모델을 배포하는 방법을 보여주며, 여러 GPU에 걸쳐 다단계 픽셀 확산 아키텍처를 독립적으로 확장할 수 있게 합니다.

7125

🤗 Transformers를 사용한 Bark 최적화

Hugging Face는 Better Transformer, 반정밀도(fp16), CPU 오프로드를 사용하여 Bark 텍스트-음성 모델의 메모리 사용량을 줄이고 추론 속도를 높이는 방법을 보여줍니다.

7126

Swift Transformers 출시: Apple 기기에서 온디바이스 LLM 실행

Hugging Face가 알파 swift-transformers Swift 패키지, swift-chat 데모 앱, 업데이트된 exporters 및 transformers-to-coreml 도구, 그리고 Llama 2 7B와 Falcon 7B의 Core ML 버전을 출시하여 개발자가 Apple 앱에서 온디바이스 LLM을 실행할 수 있게 했습니다.

7127

TRL을 통한 Direct Preference Optimization (DPO)를 사용한 Llama 2 미세 조정

Hugging Face은 TRL 라이브러리에 Direct Preference Optimization (DPO)를 통합하여, 복잡한 RLHF 파이프라인 대신 간단한 바이너리 크로스 엔트로피 손실을 사용하여 Llama 2 및 기타 LLMs의 정렬을 가능하게 했습니다.

7128

Hugging Face Inference Endpoints를 통해 MusicGen 배포하기

Hugging Face은 표준 파이프라인으로 지원되지 않는 모델에 대해 커스텀 핸들러를 사용하여 Inference Endpoints를 통해 MusicGen, 텍스트-음악 생성 모델을 API로 배포하는 방법을 보여줍니다.

7129

FHE를 이용한 암호화된 대규모 언어 모델을 향하여

Hugging Face와 Zama는 완전 동형 암호(FHE)를 통해 대규모 언어 모델이 모델 소유자의 지적 재산을 보호하면서 암호화된 사용자 데이터를 처리할 수 있는 방법을 보여줍니다.

7130

허기 링고: 머신러닝을 사용한 허깅 페이스 허브 언어 메타데이터 개선

허깅 페이스는 fastText 언어 식별 모델과 Librarian-Bot을 사용하여 현재 언어 메타데이터가 없는 데이터셋에 대해 언어를 자동으로 감지하고 메타데이터를 제안합니다.

7131

인공지능을 위한 신뢰 구축 조치

OpenAI와 버클리 리스크 앤드 시큐리티 랩은 foundation models이 도입한 국제 보안 위험을 완화하기 위해 여섯 가지 신뢰 구축 조치(CBMs)를 제안합니다.

7132

실용적인 3D 에셋 생성 가이드

Hugging Face는 OpenAI의 Shap-E 모델과 Blender, Dream Textures를 결합하여 저해상도 PS1 스타일 3D 에셋을 만드는 단계별 워크플로를 제공합니다.

7133

Segmind SD-Small 및 SD-Tiny 지식 증류 출시

Segmind가 Stable Diffusion보다 각각 35% 및 55% 작으면서도 최대 2배 빠른 추론 속도를 제공하는 두 가지 확산 모델인 SD-Small 및 SD-Tiny의 코드와 사전 학습된 가중치를 오픈 소스로 공개했습니다.

7134

고급 Core ML 양자화를 이용한 Mac용 Stable Diffusion XL

Hugging Face와 Apple이 Stable Diffusion XL을 Core ML로 포팅했으며, 혼합 비트 팔레트화를 도입해 UNet 크기를 71% 줄이면서 Apple Silicon Mac에서 이미지 품질을 유지합니다.

7135

프론티어 모델 포럼 발표

OpenAI, Google, Microsoft, 그리고 Anthropic은 프론티어 AI 모델의 개발을 위한 안전 표준, 연구, 정보 공유를 조정하기 위해 Frontier Model Forum을 출시했습니다.

7136

Agents.js 출시: JavaScript를 사용하여 LLM에 도구 제공

Hugging Face가 Agents.js를 출시했습니다. 이는 브라우저 또는 서버에서 LLM이 도구에 접근하고 실행할 수 있게 하는 JavaScript 라이브러리입니다.

7137

허깅 페이스와 파트너들이 EU AI 법안을 위한 오픈 ML 고려사항을 제시하다

허깅 페이스는 크리에이티브 커먼즈, 엘레우더 AI, 깃허브, LAION, 오픈 퓨처와의 연합으로 EU AI 법안이 오픈소스 머신러닝 개발을 지원하도록 보장하는 다섯 가지 핵심 권장 사항을 제시했다.

7138

OpenAI AI 거버넌스 약속

OpenAI는 내부 및 외부 레드팀링, 정보 공유, AI 생성 콘텐츠 식별, 그리고 모델 기능과 사회적 위험에 대한 투명한 보고를 포함한 프레임워크에 전념하고 있습니다.

7139

허깅 페이스 오픈 소스 AI 게임 잼 결과

허깅 페이스는 첫 번째 오픈 소스 AI 게임 잼을 개최했으며, 이로 인해 88개의 게임 제출작이 나왔는데, 이 게임들은 자산, 코딩, 게임플레이 메커니즘에 오픈 소스 AI 도구를 통합했습니다.

7140

ChatGPT 맞춤 지시사항 출시

OpenAI는 ChatGPT용 맞춤 지시사항을 도입하여, 사용자가 모델이 모든 미래 대화에서 고려하도록 지속적인 선호도와 요구사항을 설정할 수 있게 했습니다.

7141

Hugging Face Diffusers 첫 번째 주년 개요

Hugging Face는 텍스트-이미지, 비디오, 3D, 오디오 생성을 위한 모듈형 툴박스로의 진화를 강조하며 Diffusers 라이브러리의 첫 번째 주년을 축하합니다.

7142

OpenAI와 American Journalism Project의 지역 뉴스 파트너십

OpenAI는 1천만 달러 규모의 자금 및 API 크레딧을 통해 American Journalism Project(AJP)와 파트너십을 맺어 AI가 지역 저널리즘을 어떻게 향상시킬 수 있고 허위 정보를 어떻게 막을 수 있는지 탐구합니다.

7143

Llama 2 출시 및 Hugging Face 통합

Meta가 Hugging Face 생태계와 완전히 통합되어 상업적 용도로 사용 가능한 오픈 액세스 대규모 언어 모델 제품군인 Llama 2를 출시했습니다.

7144

Hugging Face AI WebTV: 자동화된 비디오 및 음악 합성 스트림 구축

Hugging Face는 LLM이 생성한 프롬프트로부터 비디오와 음악 스트림을 자동으로 합성하는 Zeroscope와 MusicGen을 사용하는 실험적인 데모인 AI WebTV를 개발했습니다.

7145

Hugging Face의 오픈 소스 텍스트 생성 및 LLM 생태계

Hugging Face의 2023년 블로그 게시물은 모델 배경, 라이선스, 서빙 도구 및 매개변수 효율적 미세 조정을 다루며 오픈 소스 텍스트 생성 및 LLM 생태계를 조사합니다.

7146

Hugging Face Diffusers를 사용하여 Intel Sapphire Rapids CPUs에서 Stable Diffusion 미세 조정

Hugging Face는 다섯 개의 예시 이미지만 사용하여 텍스트 역전환을 통해 Intel Sapphire Rapids CPU에서 Stable Diffusion 모델을 미세 조정하는 방법을 보여주며, Intel Extension for PyTorch와 oneCCL을 통한 CPU 기반 미세 조정을 시연합니다.

7147

Viable과 GPT-4를 활용한 대규모 질적 데이터 분석

Viable은 미세 조정 된 GPT-4 모델을 활용하여 단순한 요약을 넘어 정확한 대규모 질적 데이터 분석을 제공하여 비즈니스 인사이트를 도출합니다.

7148

OpenAI 프론티어 AI 규제 제안

OpenAI와 다학제 연구자 그룹은 표준 설정, 등록, 준수 메커니즘을 통해 공공 안전 위험을 관리하기 위한 프론티어 AI 모델 규제 프레임워크를 제안합니다.

7149

Transformers.js를 사용한 기계 학습 기반 웹 게임 만들기

Hugging Face는 Transformers.js와 파인튜닝된 MobileViT 모델을 사용하여 브라우저 내에서 완전히 실행되는 실시간 스케치 감지 게임인 Doodle Dash를 만드는 방법을 보여줍니다.

7150

Hugging Face Inference Endpoints로 LLM 배포하기

Hugging Face Inference Endpoints는 개발자가 오픈소스 LLM을 프로덕션 준비가 된 API로 배포할 수 있도록 하는 관리형 SaaS 솔루션이며, 자동 스케일링, 스케일-투-제로, 엔터프라이즈급 보안과 같은 기능을 제공합니다.