1601

프론티어 모델 포럼 업데이트

OpenAI, Anthropic, Google, 그리고 Microsoft는 프론티어 모델 포럼의 실행 이사 크리스 메제로레를 임명하고, capaces AI 모델 평가를 위한 연구를 진전시키기 위해 1천만 달러 규모의 AI 안전 기금을 설립했습니다.

1602

확장 가능한 데이터 검사를 위한 Hugging Face와 Renumics Spotlight 통합

Hugging Face는 Renumics Spotlight와 통합하여 ML 데이터셋의 인터랙티브한 한 줄 코드 시각화 및 검사를 가능하게 했으며, 멀티모달 데이터와 모델 결과도 지원합니다.

1603

추론 속도 및 메모리 최적화를 위한 Stable Diffusion XL (SDXL) 최적화

Hugging Face는 Stable Diffusion XL (SDXL)을 위한 여러 최적화 기술을 탐구하며, 메모리 사용량을 28GB에서 최소 11.47GB까지 줄이고 추론 지연 시간을 72.2초에서 약 10.3초까지 단축하는 방법을 보여줍니다.

1604

허깅페이스 인퍼런스 엔드포인트로 임베딩 모델 배포하기

허깅페이스는 인퍼런스 엔드포인트를 통해 Text Embeddings Inference(TEI)를 도입하여 RAG 및 의미 검색을 위한 오픈소스 임베딩 모델을 고성능かつ 비용 효율적으로 배포할 수 있는 방법을 제공합니다.

1605

RLHF와 PPO의 N 구현 세부 사항 – Hugging Face 블로그 요약

Hugging Face 블로그 글은 OpenAI의 2019 RLHF 코드베이스를 재현하고, 학습 곡선을 일치시키며, N가지 구현 세부 사항을 설명합니다. 여기에는 더 공격적인 업데이트를 초래하는 핵심 PyTorch Adam 옵티마이저 차이도 포함됩니다.

1606

ChatGPT Plus 및 Enterprise에서의 DALL·E 3 통합

OpenAI는 ChatGPT Plus 및 Enterprise에 DALL·E 3를 통합하여, 시각적 충실도가 높고 프롬프트 준수 능력이 향상되었으며 텍스트, 손, 얼굴 렌더링이 개선된 모델을 도입했습니다.

1607

Gradio-Lite: 브라우저 내에서 완전히 실행되는 서버리스 Gradio

Hugging Face는 웹 브라우저에서 직접 Gradio 애플리케이션을 실행하여 서버 측 인프라의 필요성을 제거하는 Pyodide를 사용하는 JavaScript 라이브러리인 Gradio-Lite (@gradio/lite)를 소개합니다.

1608

Typeform Formless: AI 기반 대화형 데이터 수집

Typeform은 GPT-3.5 Turbo와 GPT-4를 기반으로 한 AI 기반 플랫폼인 Formless를 출시하여 전통적인 폼 구조를 동적인 양방향 대화형 경험으로 대체했습니다.

1609

Ironclad AI Assist GPT-4 통합

Ironclad은 AI Assist를 통해 계약 수명 주기 관리 플랫폼에 GPT-4를 통합하여 초기 계약 레드라인 시간을 40분에서 2분으로 단축했습니다.

1610

Retool AI와 GPT-4 통합

Retool은 GPT-4로 구동되는 기능 모음인 Retool AI를 출시하여, 기업이 시각적 캔버스를 사용하여 맞춤형 AI 기반 애플리케이션과 워크플로를 구축할 수 있도록 지원합니다.

1611

ONNX Runtime을 사용한 Hugging Face 모델 가속화

Hugging Face와 ONNX Runtime은 130,000개 이상의 모델에 대한 성능 가속을 가능하게 하며, PyTorch와 비교하여 whisper-tiny 모델의 지연 시간이 최대 74.30% 감소하는 것을 포함합니다.

1612

DALL·E 3 시스템 카드

OpenAI는 DALL·E 3 시스템 카드를 공개했으며, DALL·E 2에 비해 캡션 정확도와 이미지 품질 개선 사항을 상세히 설명하고, 광범위한 안전 평가 및 위험 완화 조치를 함께 제시했습니다.

1613

Hugging Face Chat Templates

Hugging Face는 채팅 모델이 학습 시와 정확히 일치하는 형식으로 입력을 받아 성능 저하가 발생하는 것을 방지하기 위해 Jinja 기반 시스템인 채팅 템플릿을 도입했습니다.

1614

Cloud TPU v5e에서 JAX를 사용하여 Stable Diffusion XL 추론 가속화하기

Hugging Face Diffusers는 이제 Cloud TPU v5e에서 JAX를 사용하여 Stable Diffusion XL (SDXL)을 서빙하는 기능을 지원하며, 이는 TPU v4 대비 달러당 성능을 최대 2.4배 향상시킵니다.

1615

Hugging Face Inference API를 통해 AI Comic Factory 배포하기

Hugging Face는 Inference API를 사용하여 AI Comic Factory의 개인 인스턴스를 배포하는 가이드를 제공하며, Llama-2 및 SDXL 1.0 모델을 활용합니다.

1616

TRL을 통한 DDPO를 이용한 Stable Diffusion 파인튜닝

Hugging Face는 TRL 라이브러리에 Denoising Diffusion Policy Optimization(DDPO)를 통합하여 강화 학습을 사용하여 Stable Diffusion 모델을 인간 선호도에 맞출 수 있게 했습니다.

1617

허깅 페이스 윤리와 사회 업데이트 여름 2023

허깅 페이스는 미국, EU, 영국에서 AI 규제에 영향을 미치기 위한 2023 여름 노력을 상세히 설명했으며, 공공 옹호와 기술 연구를 통해 오픈소스 윤리를 발전시켰습니다.

1618

Hugging Face 가이드: 코드 없이 LLaMA 2 챗봇 훈련하기

Hugging Face는 Spaces, AutoTrain, ChatUI를 사용하는 노코드 워크플로를 제공하여 엔지니어가 아닌 사람들도 LLaMA 2를 미세 조정하고 기능적인 챗 애플리케이션으로 배포할 수 있도록 합니다.

1619

Amazon SageMaker에서의 Llama 2 벤치마크

Hugging Face는 Amazon SageMaker에서의 Llama 2에 대해 60개의 배포 구성을 분석하여 비용, 처리량, 지연 시간에 대한 최적의 설정을 식별했습니다.

1620

GPT-4V(ision) 시스템 카드

OpenAI는 GPT-4의 멀티모달 확장으로서 이미지 입력을 분석하고 처리하여 새로운 작업을 해결하고 새로운 사용자 경험을 제공할 수 있는 GPT-4V(ision)을 도입했습니다.

1621

ChatGPT 음성 및 이미지 기능 업데이트

OpenAI는 ChatGPT에 멀티모달 기능을 도입하여 Plus 및 Enterprise 사용자가 음성 대화를 나누고 이미지를 공유하여 분석할 수 있도록 했습니다.

1622

허깅 페이스 PROs용 추론

허깅 페이스는 PRO 사용자를 위한 Inference를 도입하여, 선별된 최첨단 모델에 대한 가속화된 API 엔드포인트와 무료 Inference API의 증가된 속도 제한을 제공합니다.

1623

OpenAI 레드팀 네트워크

OpenAI가 레드팀 네트워크를 출시했습니다. 이는 전 세계 도메인 전문가로 구성된 공식 커뮤니티로, AI 모델을 엄격히 평가하여 위험을 식별하고 개발 수명 주기 전반에 걸쳐 안전성을 향상시키는 임무를 맡고 있습니다.

1624

Rocket Money x Hugging Face: 프로덕션에서 변동성이 큰 ML 모델 확장

Rocket Money는 Hugging Face의 Inference API를 사용하여 레거시 regex 기반 시스템을 대체하고 월간 10억 건 이상의 거래를 처리하도록 거래 분류 시스템을 확장했습니다.

1625

3D 가우시안 스플래팅 소개

3D 가우시안 스플래팅은 소수의 이미지에서 학습된 포토리얼리스틱 3D 장면을 실시간으로 렌더링할 수 있는 래스터화 기술입니다.

1626

Hugging Face 객체 감지 리더보드

허깅 페이스는 COCO 스타일 메트릭스를 사용해 오픈소스 모델을 순위 매기는 객체 감지 리더보드를 출시하고, 평균 정밀도와 평균 재현율이 어떻게 계산되는지 및 결과에 영향을 줄 수 있는 요인을 설명하는 블로그를 게시했습니다.

1627

프로덕션 환경에서의 LLM 최적화: 정밀도, 어텐션 및 아키텍처

Hugging Face는 저정밀도 양자화, 메모리 효율성을 위한 Flash Attention, 그리고 RoPE, ALiBi, MQA, GQA와 같은 아키텍처 최적화에 초점을 맞춘 효율적인 LLM 배포를 위한 핵심 기술들을 설명합니다.

1628

OpenAI는 새로운 더블린 사무소를 통해 유럽에 존재감을 확립합니다

OpenAI는 아일랜드 더블린에 새로운 사무소를 열어 유럽 운영, 신뢰 및 안전, 보안 엔지니어링, 법무 기능을 확장합니다.

1629

PyTorch FSDP를 사용한 Llama 2 70B 파인튜닝

Hugging Face는 CPU RAM 병목 현상을 극복하고 VRAM 사용량을 최적화하기 위해 PyTorch Fully Sharded Data Parallelism (FSDP) 및 Accelerate를 사용하여 Llama 2 70B를 파인튜닝하는 방법을 보여줍니다.

1630

Würstchen 소개: 이미지 생성을 위한 빠른 확산

Würstchen은 42x 공간 압축을 달성하여 훈련 및 추론 비용을 크게 줄이는 빠르고 효율적인 텍스트-이미지 확산 모델입니다.

1631

Hugging Face Transformers 양자화 개요

Hugging Face는 소형 장치에서 대규모 모델 추론을 가능하게 하고 효율적인 어댑터 미세 조정을 지원하기 위해 bitsandbytes 및 auto-gptq 양자화 방식을 기본적으로 지원합니다.

1632

SafeCoder 대 폐쇄형 코드 어시스턴트

Hugging Face는 오픈소스 StarCoder 모델을 기반으로 하는 엔터프라이즈급 코드 어시스턴트인 SafeCoder를 소개하며, 폐쇄형 대안보다 투명성, 커스터마이징, 데이터 프라이버시를 우선시합니다.

1633

T2I-Adapters를 사용한 SDXL의 효율적인 컨트롤러블 생성

Hugging Face와 TencentARC는 가벼운 플러그 앤 플레이 모델인 T2I-Adapter-SDXL을 소개합니다. 이 모델은 스케치와 깊이 맵과 같은 외부 신호를 사용하여 Stable Diffusion XL (SDXL) 생성을 정밀하게 제어하며, ControlNet에 비해 계산 오버헤드가 현저히 낮습니다.

1634

OpenAI DevDay 발표

OpenAI는 2023년 11월 6일 샌프란시스코에서 열리는 첫 번째 개발자 컨퍼런스인 DevDay를 발표했으며, 새로운 도구를 미리 살펴보고 개발자 커뮤니티와 소통할 예정입니다.

1635

Falcon 180B 출시 노트

TII는 1800억 파라미터를 갖춘 가장 큰 공개적으로 이용 가능한 언어 모델인 Falcon 180B를 출시했습니다. 이 모델은 3.5조 토큰으로 훈련되어 PaLM-2와 같은 독점 모델과의 경쟁을 목표로 합니다.

1636

Fetch 사례 연구: Amazon SageMaker와 Hugging Face를 사용하여 ML 처리 지연 시간을 50% 줄이기

Fetch는 ML 파이프라인을 Amazon SageMaker와 Hugging Face로 마이그레이션하여 영수증 스캔의 ML 처리 지연 시간을 50% 줄이고 문서 이해 모델 정확도를 200% 높였습니다.

1637

OpenAI AI 교육 가이드

OpenAI는 언어 지원, 수업 계획, 개인 맞춤형 튜터링을 위해 교육자들이 AI를 활용할 수 있는 실용적인 프레임워크와 프롬프트 템플릿을 제공합니다.

1638

AudioLDM 2 최적화 가이드: Hugging Face Diffusers를 사용한 추론 시간 단축

Hugging Face는 코드와 모델 최적화를 적용하여 AudioLDM 2의 추론 시간을 10배 이상 줄여, 10초 오디오 샘플 생성을 1초 미만으로 줄이는 방법을 보여줍니다.

1639

ChatGPT Enterprise 릴리스 노트

OpenAI는 조직에 엔터프라이즈급 보안, 개인정보 보호, 그리고 GPT-4에 대한 무제한 고속 액세스를 제공하는 ChatGPT Enterprise를 출시했습니다.

1640

Hugging Face 허브 Git 인증 변경

Hugging Face는 2023년 10월 1일에 비밀번호 기반 Git 인증을 중단하고 보안 강화를 위해 사용자에게 개인 액세스 토큰 또는 SSH 키로 전환하도록 요구했습니다.

1641

Code Llama 릴리스 노트

Code Llama은 Llama 2를 기반으로 한 오픈 액세스 모델 가족으로, 코드 작업에 특화되어 있으며 인필링과 최대 100,000 토큰까지의 긴 컨텍스트 윈도우를 지원합니다.

1642

OpenAI와 Scale의 기업용 파인튜닝 파트너십

OpenAI는 Scale과 파트너십을 맺어 기업에 GPT-3.5 Turbo 및 GPT-4 파인튜닝을 위한 전문 데이터 enrichment 및 모델 평가 지원을 제공합니다.

1643

Hugging Face AutoGPTQ 및 Transformers 통합

Hugging Face는 AutoGPTQ 라이브러리를 Transformers에 통합하여, 4비트에서 정확도 손실을 무시할 수 있는 수준으로 유지하면서 메모리 요구 사항을 줄이기 위해 LLM을 8, 4, 3 또는 2비트 정밀도로 양자화할 수 있도록 했습니다.

1644

GPT-3.5 Turbo 파인튜닝 및 API 업데이트

OpenAI는 GPT-3.5 Turbo에 대한 파인튜닝 기능을 출시하여 개발자가 모델 성능을 맞춤화하고, 출력 신뢰성을 향상시키며, 프롬프트 비용을 절감할 수 있도록 했습니다.

1645

IDEFICS: 최첨단 시각 언어 모델의 오픈 재현

Hugging Face는 Flamingo 아키텍처를 기반으로 한 오픈 액세스 시각 언어 모델인 IDEFICS를 출시했으며, 9B 및 80B 파라미터 크기의 interleaved 이미지 및 텍스트 입력을 지원합니다.

1646

Hugging Face SafeCoder 발표

Hugging Face는 기업이 자체 보안 인프라 내에서 독점적인 Code LLM을 구축하고 배포할 수 있도록 하는 자체 호스팅 엔터프라이즈급 코드 어시스턴트 솔루션인 SafeCoder를 선보였습니다.

1647

OpenAI가 Global Illumination을 인수함

OpenAI는 창의적 도구 및 인프라 회사인 Global Illumination을 인수하여, ChatGPT를 포함한 핵심 제품 개발에 팀을 통합했습니다.

1648

GPT-4를 사용한 콘텐츠 모더레이션

OpenAI는 정책 적용 및 정교화를 자동화하여 콘텐츠 모더레이션을 가속화하기 위해 GPT-4를 활용하고 있으며, 이로써 맞춤형 정책 개발에 필요한 시간을 개월에서 시간으로 단축하고 있습니다.

1649

AWS Marketplace의 Hugging Face Hub

Hugging Face는 AWS Marketplace와 Hub를 통합하여, 조직이 AWS 계정을 통해 Inference Endpoints 및 AutoTrain과 같은 관리형 서비스를 직접 결제할 수 있도록 했습니다.

1650

BentoML을 사용한 DeepFloyd IF 배포

Hugging Face는 BentoML을 사용하여 DeepFloyd IF 텍스트-이미지 모델을 배포하는 방법을 보여주며, 여러 GPU에 걸쳐 다단계 픽셀 확산 아키텍처를 독립적으로 확장할 수 있게 합니다.