✷ 아카이브 · 연구소 11곳 · 디스패치 870건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
GPT-OSS Agentic RL 훈련: 실용적인 회고
Hugging Face와 LinkedIn 연구원들은 GPT-OSS 모델에 대해 안정적인 에이전트 강화 학습을 가능하게 하는 데 필요한 엔지니어링 수정을 상세히 설명했으며, MoE 라우팅, attention sinks, 메모리 효율성에 중점을 두었습니다.
AssetOpsBench: AI 에이전트 벤치마크와 산업 현실 사이의 격차 해소
Hugging Face와 IBM Research가 산업 자산 수명주기 관리에서 다중 에이전트 AI 시스템을 평가하기 위해 설계된 포괄적인 벤치마크인 AssetOpsBench를 소개합니다. 이 벤치마크는 안전‑중요 고장 모드와 운영 제약에 초점을 맞춥니다.
딥시크 모먼트 1년 후: 중국의 오픈소스 AI 생태계의 부상
Hugging Face는 딥시크 R1 출시가 중국의 오픈소스 AI로의 대규모 전환을 촉발했다고 분석하며, 이로 인해 고성능 오픈 모델이 급증하여 현재 글로벌 다운로드 메트릭을 지배하고 있다고 설명합니다.
Differential Transformer V2 소스 사용 불가
Hugging Face 웹사이트의 429 Too Many Requests 오류로 인해 Differential Transformer V2의 소스 콘텐츠를 사용할 수 없습니다.
Waypoint-1: Overworld의 실시간 인터랙티브 비디오 디퓨전
Overworld는 10,000시간 분량의 게임 영상을 학습한 실시간 인터랙티브 비디오 디퓨전 모델 Waypoint-1을 출시했으며, 텍스트, 마우스, 키보드를 통해 지연 없는 세계 상호작용을 가능하게 합니다.
Hugging Face Open Responses 추론 표준
Hugging Face는 에이전트형 AI 워크플로우를 위해 Chat Completion 형식을 대체하도록 설계된 Responses API 기반의 오픈 추론 표준인 Open Responses를 도입했습니다.
NVIDIA Cosmos Reason 2 릴리즈 노트 / 새로운 소식
NVIDIA는 물리 AI를 위해 설계된 오픈 추론 비전‑언어 모델인 Cosmos Reason 2를 출시했으며, 이 모델은 Physical AI Bench와 Physical Reasoning 리더보드에서 1위를 차지했습니다.
Falcon-H1-Arabic 릴리즈 노트
Hugging Face는 Falcon-H1-Arabic을 발표했습니다. 이 모델군은 3B, 7B, 34B 규모의 하이브리드 Mamba-Transformer 모델로, 최대 256K 토큰까지 확장된 컨텍스트 윈도우를 제공하며 아랍어 NLP에서 새로운 최첨단 벤치마크를 설정합니다.
NVIDIA DGX Spark 및 Reachy Mini 통합 가이드
NVIDIA는 DGX Spark 하드웨어, Reachy Mini 로봇공학, 그리고 오픈 추론 및 비전 모델을 사용하는 NeMo Agent Toolkit을 결합하여 실제 세계 AI 에이전트를 생성하기 위한 프레임워크를 도입했습니다.
AprielGuard: 현대 LLM 시스템에서 안전 및 적대적 견고성을 위한 가드레일
Hugging Face와 ServiceNow AI는 8B 파라미터의 보호 모델인 AprielGuard를 소개했습니다. 이 모델은 독립 프롬프트, 다중 턴 대화, 에이전시 워크플로우 전반에 걸쳐 16가지 안전 위험 카테고리와 다양한 적대적 공격을 탐지하도록 설계되었습니다.
Transformers v5 토크나이제이션 업데이트
Hugging Face는 Transformers v5에서 토크나이저 아키텍처를 학습된 어휘와 분리하도록 토크나이제이션을 재설계하여, 더 쉬운 검사, 맞춤화 및 처음부터 학습이 가능하도록 했습니다.
NVIDIA Nemotron 3 Nano와 NeMo Evaluator 오픈 평가 레시피
NVIDIA는 NeMo Evaluator를 기반으로 한 완전한 오픈 평가 레시피와 함께 30B Nemotron 3 Nano 모델을 출시했으며, 누구나 벤치마크 점수를 재현하고 전체 평가 파이프라인을 감사할 수 있게 했습니다.
Hugging Face에서의 CUGA: 구성 가능한 AI 에이전트의 민주화
IBM Research는 CUGA(구성 가능한 범용 에이전트)를 출시했는데, 이는 복잡한 API 및 웹 작업에 대한 AppWorld 및 WebArena 벤치마크에서 최첨단 성능을 달성하는 오픈소스 에이전트 프레임워크입니다.
llama.cpp 모델 관리 및 라우터 모드
llama.cpp 서버는 라우터 모드를 도입하여 서버를 다시 시작하지 않고 여러 GGUF 모델 간의 동적 로드, 언로드 및 전환을 가능하게 합니다.
Hugging Face가 엔드‑투‑엔드 ML 실험을 위해 Codex를 통합했습니다
Hugging Face는 OpenAI Codex가 HF-skills 저장소에 접근하도록 함으로써 엔드‑투‑엔드 머신러닝 실험을 수행할 수 있게 했으며, 에이전트가 파인튜닝, 평가 및 배포를 자동화하도록 허용했습니다.
swift-huggingface 릴리즈 노트 / 새로운 기능
Hugging Face는 신뢰할 수 있는 모델 다운로드, Python 호환 캐시, OAuth 2.0 지원을 도입하는 Hugging Face Hub용 포괄적인 Swift 클라이언트인 swift-huggingface를 출시했습니다.
허깅페이스 스킬: AI 에이전트가 LLM을 미세 조정하도록 지원
허깅페이스는 허깅페이스 스킬을 도입했는데, 이는 클로드 코드와 같은 코딩 에이전트가 하드웨어 선택부터 모델 배포까지 LLM 미세 조정 전 과정을 관리할 수 있게 해주는 도구입니다.
DeepMath: smolagents를 사용하는 경량 수학 추론 에이전트
DeepMath는 Qwen3-4B Thinking을 기반으로 한 수학 추론 에이전트로, GRPO를 사용하여 장황한 텍스트를 결정적 계산을 위한 간결한 Python 스니펫으로 대체하여 출력 길이를 최대 66% 줄이면서 정확성을 향상시킵니다.
Hugging Face Transformers v5 release notes / what's new
Hugging Face가 상호 운용성, PyTorch 중심의 모델 정의, 그리고 양자화 및 대규모 사전 학습에 대한 일급 지원에 초점을 맞춘 Transformers v5를 출시했습니다.
Diffusers FLUX.2 통합
Hugging Face는 Diffusers 라이브러리에 FLUX.2를 통합하여 Mistral3 텍스트 인코딩과 함께 FLUX.2-dev-bnb-4bit 모델의 사용을 가능하게 합니다.
Hugging Face: Continuous Batching from First Principles
Hugging Face는 KV caching, chunked prefill, ragged batching을 dynamic scheduling과 결합하여 패딩 낭비를 제거하고 LLM 처리량을 극대화하는 기술인 continuous batching에 대해 설명합니다.
Tavily Deep Research: AI 연구 에이전트에서 최첨단 달성
Tavily는 인간과 유사한 정보 증류를 기반으로 한 선형 컨텍스트 엔지니어링 접근 방식을 구현하여 Open Deep Research 대비 토큰 소비를 66% 줄인 최첨단 연구 에이전트를 개발했습니다.
Hugging Face Inference Providers에서의 OVHcloud
OVHcloud는 이제 Hugging Face에서 지원되는 추론 제공업체가 되었으며, HF UI와 SDK를 통해 gpt-oss, Qwen3, DeepSeek R1, Llama과 같은 모델에 대한 서버리스 액세스를 제공하며, 백만 토큰당 €0.04부터 시작하는 토큰당 과금 방식을 제공합니다.
허깅 페이스 오픈 ASR 리더보드 트렌드 및 통찰
허깅 페이스는 새로운 다국어 및 장문 트랙을 추가하여 오픈 ASR 리더보드를 업데이트했으며, Conformer 인코더와 LLM 디코더를 조합한 모델이 현재 영어 정확도에서 선두를 달리고 있으며, CTC/TDT 디코더는 더 높은 처리량을 제공한다는 것을 보여줍니다.
Hugging Face TRL과 RapidFire AI 통합
Hugging Face TRL은 이제 RapidFire AI와 통합되어 여러 LLM 구성의 동시 미세 조정을 가능하게 하여 실험 처리량을 최대 24배까지 높입니다.
AnyLanguageModel: Apple 플랫폼을 위한 통합 LLM API
Hugging Face는 AnyLanguageModel이라는 Swift 패키지를 소개했습니다. 이 패키지는 Apple 플랫폼에서 로컬 및 원격 LLM을 통합하기 위한 통합 API를 제공하며, Apple의 Foundation Models 프레임워크를 대체하는 드롭인 방식으로 동작합니다.
Apriel-H1: Mamba 하이브리드를 통한 효율적인 추론 모델 증류
ServiceNow AI는 Apriel-H1을 소개합니다. 이는 2.1배 처리량 향상을 최소한의 품질 손실로 달성하기 위해 일반적인 사전 학습 데이터 대신 고품질 추론 트레이스를 증류하여 Mamba 하이브리드로 변환된 15B 추론 모델 제품군입니다.
Hugging Face와 함께 ROCm 커널을 쉽게 구축하고 공유하기
Hugging Face는 kernels 라이브러리와 kernel-builder를 활용하여 ROCm 호환 GPU 커널을 구축, 패키징 및 Hugging Face Hub에 공유하는 간소화된 워크플로우를 소개합니다.
AMD 오픈 로봇 해커톤
AMD, Hugging Face, 그리고 Data Monsters는 도쿄와 파리에서 AMD 오픈 로봇 해커톤을 개최하여 LeRobot과 AMD AI 하드웨어를 사용하여 혁신적인 로봇 솔루션 개발을 장려합니다.
Hugging Face와 Google Cloud 전략적 파트너십
Hugging Face와 Google Cloud는 구글 클라우드 인프라에서 오픈 모델 배포를 간소화하기 위해 심화된 전략적 파트너십을 체결했으며, 더 빠른 모델 다운로드를 위한 새로운 CDN 게이트웨이와 Google Threat Intelligence를 통한 강화된 보안을 특징으로 합니다.
MiniMax M2 에이전트 정렬 및 일반화
MiniMax M2는 인터리브드 사고와 전체 경로 일반화를 구현하여 벤치마크 성능과 실제 세계 에이전트 사용성 사이의 격차를 해소합니다.
변화하는 글로벌 컴퓨팅 환경: 중국의 AI 하드웨어 및 소프트웨어 부상
Hugging Face는 미국 수출 통제가 역설적으로 중국의 국내 AI 칩 및 계산 효율적인 오픈 웨이트 모델 개발을 가속화하여 병렬 AI 인프라를 구축했다고 분석합니다.
NVIDIA Isaac for Healthcare v0.4: 시뮬레이션에서 배포까지 헬스케어 로봇 구축
NVIDIA Isaac for Healthcare v0.4는 SO-ARM starter 워크플로를 사용하여 합성 시뮬레이션 데이터와 실제 세계 훈련을 결합한 자율 수술 어시스턴트를 구축하기 위한 엔드-투-엔드 워크플로를 도입합니다.
NVIDIA Isaac for Healthcare v0.4 출시
NVIDIA Isaac for Healthcare v0.4는 시뮬레이션에서 실제 세계 배포까지 엔드투엔드 AI 의료 로봇 개발을 가능하게 하는 개발자 프레임워크와 SO-ARM 스타터 워크플로를 도입합니다.
IBM Granite 4.0 Nano 릴리스 노트
IBM은 에지 및 온-디바이스 애플리케이션을 위해 설계된 고성능 소형 언어 모델(SLM) 시리즈인 Granite 4.0 Nano를 Apache 2.0 라이선스 하에 출시했습니다.
Hugging Face 음성 클로닝과 동의
Hugging Face는 음성 동의 게이트를 도입했는데, 이는 음성 클로닝 모델이 활성화되기 전에 말하는 사람이 녹음된 문구를 통해 명시적으로 동의를 밝히도록 요구하는 시스템 인프라입니다.
huggingface_hub v1.0: 오픈 머신러닝의 기반을 다진 5년
huggingface_hub은 5년 후 v1.0에 도달했으며, 2백만 개 이상의 모델, 500k 데이터셋, 1M Spaces에 대한 핵심 접근을 제공하면서, 다음 10년을 위한 오픈 머신러닝을 지원하기 위해 httpx, hf_xet, 그리고 재설계된 CLI와 같은 중단 변경을 도입했습니다.
허깅페이스 스트리밍 데이터셋 업데이트
허깅페이스는 데이터셋 라이브러리의 스트리밍 기능을 최적화하여 시작 요청을 100배 줄이고 데이터 해상도 속도를 10배 높여 로컬 다운로드 없이 멀티테라바이트 규모의 데이터셋에서 효율적인 학습을 가능하게 했습니다.
LeRobot v0.4.0 릴리즈 노트 / 새로운 내용
Hugging Face가 LeRobot v0.4.0을 출시했으며, 확장 가능한 Datasets v3.0, PI0.5 및 GR00T N1.5와 같은 VLA 모델, 그리고 하드웨어 통합을 간소화하는 플러그인 시스템을 도입했습니다.
Hugging Face와 Meta가 에이전트 환경을 위한 OpenEnv를 소개합니다
Hugging Face와 Meta가 OpenEnv 및 OpenEnv Hub를 출시했습니다. 이는 교육 및 배포에 사용되는 안전하고 샌드박스된 에이전트 환경을 위한 표준화된 오픈 커뮤니티 허브입니다.
Hugging Face와 VirusTotal 보안 협업
Hugging Face는 VirusTotal과 파트너십을 맺어 Hugging Face Hub에 있는 220만 개 이상의 공개 모델 및 데이터셋 저장소를 지속적으로 스캔하여 머신러닝 커뮤니티를 악성 자산으로부터 보호합니다.
Sentence Transformers가 Hugging Face에 합류합니다
Sentence Transformers 라이브러리는 TU Darmstadt의 UKP Lab에서 Hugging Face로 이전하여 더 나은 인프라를 활용하고 지속적인 오픈소스 개발을 진행합니다.
Hugging Face AI Sheets 비전 업데이트
Hugging Face AI Sheets는 이제 비전 기능을 지원하는 오픈소스 도구로, 사용자가 이미지에서 구조화된 데이터를 추출하고, 텍스트에서 시각 자료를 생성하며, 스프레드시트 인터페이스 내에서 이미지를 편집할 수 있습니다.
오픈소스 OCR 모델 가이드 – 현대 비전-언어 OCR 선택, 실행 및 확장
Hugging Face는 오픈 가중치 OCR 모델에 대한 포괄적인 가이드를 발표했으며, 모델의 기능, 벤치마크 성능, 비용 효율성 및 로컬 또는 호스팅 엔드포인트를 통한 실행 방법을 상세히 설명합니다.
식품 알레르기를 위한 AI: 생물 의학 연구를 위한 공개 데이터셋 컬렉션
Hugging Face는 AI for Food Allergies 프로젝트를 시작했으며, AI 기반 알레르기 예측, 약물 발견 및 식품 안전을 가속화하기 위한 첫 번째 공개 커뮤니티 기반 정제된 데이터셋 컬렉션을 소개합니다.
Google Cloud C4와 Intel Xeon 6의 GPT OSS 성능
Google Cloud C4 VM은 Intel Xeon 6 프로세서로 구동되어, C3 VM에 비해 GPT OSS MoE 모델 추론에 대한 총 소유 비용(TCO)을 최대 1.7배 개선합니다.
OpenVINO를 사용해 Intel CPU에서 SmolVLM 실행 (3단계)
Hugging Face는 Optimum‑Intel과 OpenVINO를 사용해 Intel CPU에서 작은 Vision‑Language 모델 SmolVLM을 배포하는 방법을 보여주며, PyTorch 대비 최대 65배 높은 처리량을 달성합니다.
Nemotron-Personas-India: 주권 AI를 위한 합성 데이터
NVIDIA는 인도 다언어 및 문화적으로 다양한 환경에서 주권 AI를 위한 데이터 격차를 메우기 위해 설계된 2100만 개의 인도어 페르소나를 포함한 CC BY 4.0 라이선스 합성 데이터셋 Nemotron-Personas-India를 출시했습니다.
PyTorch 컨퍼런스 2025에서 Arm
Arm은 10월 22‑23일에 열리는 PyTorch 컨퍼런스에 참여하여 ExecuTorch와 vLLM 등 AI 배포 도구를 선보이고, 클라우드, 엣지, 모바일 플랫폼 전반에 걸친 AI 확장에 대한 개발자 피드백을 수집합니다.
BigCodeArena: 코드 생성 평가를 엔드 투 엔드로 코드 실행과 함께 판단
Hugging Face는 사용자가 생성된 코드를 실시간으로 실행하고 상호작용할 수 있게 함으로써 코드 생성 모델을 평가하는 인간-인-루프 플랫폼인 BigCodeArena를 출시했습니다.