1751

Khan Academy가 GPT-4를 통합해 Khanmigo AI 어시스턴트를 구동

Khan Academy는 GPT-4 기반 AI 튜터 및 교사 보조인 Khanmigo를 파일럿 프로그램으로 진행하여 개별 학습과 교육 지원을 제공하고 있습니다.

1752

OpenAI와 아이슬란드 정부의 아이슬란드어 보존 파트너십

OpenAI는 아이슬란드 정부 및 민간 기업과 협력하여 GPT-4와 인간 피드백 강화 학습(RLHF)을 활용해 디지털 시대에 아이슬란드어를 보존하고 있습니다.

1753

Informer를 활용한 다변량 확률적 시계열 예측

Hugging Face는 계산 및 메모리 복잡성을 줄여 효율적인 다변량 확률적 시계열 예측을 가능하게 하기 위해 Informer 모델을 Transformers 라이브러리에 통합했습니다.

1754

24GB 소비자 GPU에서 RLHF를 이용한 20B LLM 파인튜닝

Hugging Face는 TRL과 PEFT의 통합을 발표했으며, 이를 통해 8비트 양자화와 저랭크 어댑터를 사용해 24 GB GPU 하나에서 200억 파라미터 언어 모델의 강화 학습 파인튜닝이 가능해졌습니다.

1755

Kakao Brain ViT 및 ALIGN 모델, COYO 700M 데이터셋과 함께 공개

Kakao Brain과 Hugging Face가 새로운 700 M 이미지‑텍스트 COYO 데이터셋으로 학습된 오픈소스 ViT와 ALIGN 시각‑언어 모델을 공개했습니다. 이는 최초의 공개 ALIGN 모델이자 재현 가능한 학습 데이터를 갖춘 ViT 모델을 제공한다는 의미입니다.

1756

Diffusers의 ControlNet

Hugging Face는 Diffusers 라이브러리에 ControlNet을 통합하여 Canny 엣지, 깊이 맵, 인간 포즈와 같은 조건을 사용해 Stable Diffusion 이미지 생성에 정밀한 공간 제어를 가능하게 했습니다.

1757

재난 대응을 위한 머신러닝 활용: afetharita 프로젝트

Hugging Face는 자원봉사자들이 Hugging Face 생태계를 활용해 2023년 2월 터키 지진 피해자들을 돕기 위해 OCR, NER 및 원격 감지를 위한 머신러닝 모델을 신속히 배포한 과정을 설명합니다.

1758

Hugging Face Diffusers 윤리 가이드라인

Hugging Face는 Diffusers 라이브러리를 위한 윤리 프레임워크를 도입하여 기술적 결정과 커뮤니티 기여를 안내하고, 확산 모델의 잠재적인 사회적 위험을 완화합니다.

1759

Hugging Face 전문가 가속 프로그램: Witty Works 사례 연구

Witty Works는 Hugging Face 전문가 가속 프로그램과 SetFit을 활용하여 최소한의 라벨링 데이터로 높은 정확도의 문맥 의존 포괄적 언어 분류기를 구축했습니다.

1760

AGI와 그 너머를 위한 OpenAI 계획

OpenAI는 사회가 적응할 수 있도록 AI 시스템의 점진적 배포 전략을 제시하며, 정렬 연구 확대, 글로벌 거버넌스, 그리고 존재적 위험에 대한 신중한 접근의 필요성을 강조합니다.

1761

Swift Diffusers for Mac 1.1 릴리스

Hugging Face는 Diffusers for Mac 버전 1.1을 출시했습니다. 이 네이티브 오픈소스 앱은 Core ML을 활용해 Apple Silicon에서 Stable Diffusion을 가속화하며, 특정 하드웨어 구성에서 최대 2배 빠른 생성 속도를 제공합니다.

1762

대형 언어 모델 레드팀

Hugging Face는 유해한 출력을 방지하기 위해 LLM 취약점을 식별하는 데 있어 레드팀의 중요한 역할을 강조하며, 협업적이고 적응적인 평가 방법의 필요성을 강조합니다.

1763

Fetch AI 인프라 마이그레이션: Hugging Face와 AWS를 활용한 도구 통합

Fetch는 서드파티 AI '블랙 박스'에서 Hugging Face와 AWS 기반의 자체 ML 파이프라인으로 전환함으로써 개발 시간을 30% 단축하고 처리 지연 시간을 50% 감소시켰습니다.

1764

Hugging Face와 AWS의 AI 접근성을 위한 전략적 파트너십

Hugging Face와 AWS는 Hugging Face 모델을 AWS 인프라와 특수 설계된 ML 가속기에 통합하여 생성 AI를 민주화하기 위해 전략적 파트너십을 확대했습니다.

1765

OpenAI AI 시스템 행동 및 거버넌스 프레임워크

OpenAI는 ChatGPT의 행동을 형성하기 위한 두 단계 훈련 과정과 기본값 개선, 사용자 맞춤화, 공공 의견 통합을 통한 AI 거버넌스를 위한 세 가지 전략을 제시합니다.

1766

Hugging Face Inference Endpoints 사례 연구

Hugging Face는 운영 복잡성을 줄이고 지연 시간을 개선하기 위해 CPU 기반 ML 모델을 AWS ECS/Fargate에서 Hugging Face Inference Endpoints로 이전하고 있습니다.

1767

BLIP-2: 제로샷 이미지-텍스트 생성

BLIP-2는 Salesforce Research에서 개발한 비주얼-언어 모델로, Querying Transformer(Q-Former)를 사용해 고정된 이미지 인코더와 고정된 대형 언어 모델을 연결함으로써 효율적인 제로샷 이미지-텍스트 생성을 가능하게 합니다.

1768

🤗 PEFT 라이브러리 출시, 억대 규모 모델의 파라미터 효율적 파인튜닝 가능

Hugging Face는 🤗 PEFT 라이브러리를 발표했으며, 사용자가 파라미터의 아주 작은 부분만 학습함으로써 저자원 하드웨어에서도 억대 파라미터 모델을 파인튜닝할 수 있게 합니다.

1769

SpeechT5: 통합 모달 인코더-디코더를 이용한 음성 처리

Hugging Face는 통합된 Transformer 기반 모델인 SpeechT5를 통합했으며, 이는 공유 인코더-디코더 백본을 통해 텍스트-음성, 음성-음성, 그리고 음성-텍스트 작업을 수행할 수 있습니다.

1770

Hugging Face AI vs. AI: 다중 에이전트 강화 학습 대회 시스템

Hugging Face는 ELO 평점 시스템을 활용한 지속적인 다중 에이전트 경쟁을 통해 딥 강화 학습 모델을 순위 매기는 오픈소스 시스템인 AI vs. AI를 소개했습니다.

1771

Hugging Face AI를 활용한 게임 개발: 스토리 생성

Hugging Face는 ChatGPT와 같은 대형 언어 모델(LLM)을 사용해 게임 스토리와 콘텐츠를 생성하는 워크플로우를 제시하면서, 독창성, 법적 위험, 장기적인 일관성에 관한 중요한 제한 사항을 강조합니다.

1772

Intel Sapphire Rapids로 PyTorch Transformer 가속하기

Hugging Face는 Intel Sapphire Rapids CPU와 Optimum Intel 라이브러리를 결합하면 이전 Xeon 세대에 비해 PyTorch Transformer 추론을 최대 3배 가속할 수 있음을 보여줍니다.

1773

비전‑언어 모델 탐구

Hugging Face는 비전‑언어 모델에 대한 기술 개요를 제공하며, 다섯 가지 주요 사전 학습 전략과 이를 VQA 및 이미지 분할과 같은 작업을 위해 Transformers 라이브러리에 통합하는 방법을 상세히 설명합니다.

1774

ChatGPT Plus 출시

OpenAI는 피크 타임에도 접근을 보장하고, 더 빠른 응답 및 기능 우선 롤아웃을 제공하는 월 $20 구독 서비스인 ChatGPT Plus를 발표했으며, 전 세계적으로 이용 가능 범위를 확대했습니다.

1775

OpenAI AI 텍스트 분류기 출시 (2023년 1월)

OpenAI는 2023년 1월에 공개 AI 텍스트 분류기를 출시했으며, AI가 생성한 것으로 추정되는 영어 텍스트를 표시하지만 신뢰성이 낮아 AI 텍스트의 26%만 식별하고 인간 텍스트의 9%를 오분류합니다.

1776

Hugging Face의 컴퓨터 비전 현황

Hugging Face는 8개의 핵심 컴퓨터 비전 작업, 3,000개 이상의 모델, 그리고 100개 이상의 데이터셋을 지원하도록 생태계를 확장했으며, Transformer와 컨볼루션 아키텍처를 모두 통합했습니다.

1777

Hugging Face 2D 자산 생성 - 게임 개발

Hugging Face는 Stable Diffusion의 Image2Image 기능을 협업 2D 게임 자산 워크플로에 통합하여 생산 준비가 된 아이콘을 효율적으로 만드는 방법을 보여줍니다.

1778

효율적인 Stable Diffusion 파인튜닝을 위한 LoRA 활용

Hugging Face는 Low-Rank Adaptation(LoRA)을 diffusers 라이브러리에 통합하여, 훨씬 낮은 VRAM 요구량과 3 MB 정도의 작은 모델 가중치로 Stable Diffusion 파인튜닝을 더 빠르게 수행할 수 있게 했습니다.

1779

Hugging Face Optimum 및 ONNX Runtime 훈련 통합

Hugging Face와 Microsoft는 ONNX Runtime을 Optimum 라이브러리에 통합하여 트랜스포머 기반 모델의 훈련 시간을 35% 이상 단축했습니다.

1780

대화형 에이전트를 유용하게 만드는 요소는? 기술 분석

Hugging Face는 기본 언어 모델을 유용한 대화형 에이전트로 전환하는 핵심 기술인 Instruction Fine‑Tuning(IFT), Supervised Fine‑Tuning(SFT), Reinforcement Learning from Human Feedback(RLHF), 그리고 Chain‑of‑Thought(CoT)를 분석합니다.

1781

OpenAI와 Microsoft, 전략적 파트너십 확대

OpenAI와 Microsoft는 수년간 수십억 달러 규모의 파트너십을 연장하여 독립적인 AI 연구를 가속화하고 Azure를 통한 AI 모델 배포를 확대했습니다.

1782

Hugging Face 게임 개발을 위한 AI: 3D 자산 생성

Hugging Face는 텍스트‑투‑3D AI의 현재 상태를 탐구하며, DreamFusion 및 Point‑E와 같은 도구가 존재하지만 아직 빠른 게임 개발 워크플로에 실용적으로 적용될 수 없다고 결론짓습니다.

1783

Mask2Former와 OneFormer: 🤗 Transformers의 범용 이미지 분할 모델

Hugging Face는 Transformers 라이브러리에 Mask2Former와 OneFormer를 출시하여, 단일 모델로 인스턴스, 의미, 파노프틱 분할을 처리할 수 있는 범용 아키텍처를 제공합니다.

1784

Hugging Face Hub와 PaddlePaddle 통합

Hugging Face는 PaddlePaddle과 협력하여 PaddleNLP를 시작으로 그들의 딥러닝 플랫폼 및 라이브러리를 Hugging Face Hub에 통합함으로써 접근성과 공유를 향상시켰습니다.

1785

Hugging Face Datasets와 Transformers를 이용한 이미지 유사도

Hugging Face는 Transformers와 Datasets 라이브러리를 사용해 밀집 벡터 임베딩을 계산하고 코사인 유사도를 측정함으로써 이미지 유사도 시스템을 구축하는 방법을 보여줍니다.

1786

디스인포메이션 캠페인을 위한 언어 모델 남용 예측

OpenAI, Georgetown University, 그리고 Stanford Internet Observatory는 대형 언어 모델이 디스인포메이션 캠페인의 비용을 낮추고 규모를 확대할 수 있는 방식을 분석하고, 완화를 위한 4단계 프레임워크를 제안하는 보고서를 발표했습니다.

1787

게임 개발을 위한 AI: LLM을 활용한 게임 디자인

Hugging Face는 ChatGPT와 같은 대형 언어 모델을 게임 디자인의 브레인스토밍 및 가속화 도구로 활용하는 방법을 보여주며, 특히 농업 게임의 핵심 기능 정의에 적용됩니다.

1788

고객 피드백 분석을 위한 Yabble GPT-3 통합

Yabble은 OpenAI의 GPT-3을 통합하여 복잡한 고객 피드백 데이터 세트를 분석하는 데 걸리는 시간을 몇 주에서 몇 분으로 단축했습니다.

1789

Waymark의 비디오 스크립트 제작을 위한 GPT-3 파인튜닝

Waymark는 맞춤형 고품질 비디오 광고 스크립트 생성을 자동화하기 위해 파인튜닝된 GPT-3 모델을 통합했으며, 고객의 편집 시간을 줄이고 비디오 제작을 확장했습니다.

1790

그래프 머신 러닝 소개

Hugging Face는 그래프 머신 러닝에 대한 포괄적인 개요를 제공하며, 그래프가 어떻게 표현되는지와 사전 신경망 특징에서 그래프 신경망 및 그래프 트랜스포머로의 진화를 자세히 설명합니다.

1791

게임 개발을 위한 AI: 5일 만에 농장 게임 만들기 (파트 1)

Hugging Face는 Stable Diffusion을 활용해 농장 게임의 시각적 아트 스타일과 컨셉 아트를 설정하고, 이를 Unity에 구현하는 방법을 보여줍니다.

1792

Intel Sapphire Rapids와 함께 PyTorch Transformer 가속 – 파트 1

Hugging Face는 IPEX와 oneCCL을 사용하여 Intel Sapphire Rapids CPU 클러스터에서 PyTorch Transformer를 학습하는 방법을 보여주며, Ice Lake 대비 최대 8배 속도 향상과 4노드에 걸친 거의 선형 확장을 달성합니다.

1793

OpenAI 차세대 캐릭터 제작 발표

차세대 캐릭터 제작에 관한 발표를 위한 제공된 원본 자료는 404 오류로 인해 사용할 수 없으며, 기술 세부 사항이나 공식 주장도 제공되지 않습니다.

1794

OFASys: 다중모달 멀티태스크 학습을 위한 프레임워크

Qwen은 사용자가 단일 라인 Instruction 인터페이스를 통해 복잡한 작업과 모달리티를 정의할 수 있게 함으로써 다중모달 멀티태스크 학습을 간소화하는 AI 프레임워크인 OFASys를 소개합니다.

1795

Chinese CLIP: 중국어 대비 비전-언어 사전학습

Qwen은 문화적·언어적 한계를 극복하도록 설계된 비전-언어 모델인 Chinese CLIP을 출시했습니다. 이 모델은 교차 모달 검색 및 이미지 분류에서 영어 중심 CLIP 모델의 한계를 뛰어넘습니다.

1796

OpenAI Applied AI Research: AGI, 안전, 그리고 지속적 학습에 대한 관점

OpenAI Applied AI Research 팀의 Lilian Weng은 AGI로 가는 길, 모델 정렬 및 안전의 중요한 중요성, 그리고 AI 개발에서 지속적 학습의 역할에 대해 논의합니다.

1797

CLIPSeg을 이용한 제로샷 이미지 분할

Hugging Face는 CLIPSeg를 소개합니다. 이 제로샷 이미지 분할 모델은 CLIP 임베딩을 활용하여 텍스트 또는 이미지 프롬프트 중 하나로부터 분할 마스크를 생성하며, 카테고리별 학습이 필요하지 않습니다.

1798

Hugging Face 모델 카드 문서화 프레임워크

Hugging Face는 GUI 기반 생성 도구와 표준화된 템플릿을 포함한 일련의 도구와 리소스를 출시하여 머신러닝 모델 문서화의 접근성과 표준화를 향상시켰습니다.

1799

OpenAI Point-E: 텍스트 프롬프트에서 3D 포인트 클라우드 생성

OpenAI는 복잡한 텍스트 프롬프트에서 3D 포인트 클라우드를 1~2분 안에 단일 GPU로 생성하는 시스템인 Point-E를 소개했으며, 절대적인 샘플 품질보다 샘플링 속도를 우선시합니다.

1800

OpenAI text-embedding-ada-002 릴리스

OpenAI는 text-embedding-ada-002 모델을 발표했습니다. 이 모델은 통합된, 더 빠르고, 더 저렴한 임베딩 모델로 대부분의 작업에서 이전 모델보다 뛰어납니다.