Kimina-Prover: 대규모 형식 추론 모델에 대한 테스트 시점 RL 검색 적용
Hugging Face는 Lean 4용 최첨단 정리 증명 모델인 Kimina-Prover-72B를 발표했으며, 새로운 테스트 시점 강화 학습(TTRL) 검색 프레임워크를 활용해 miniF2F 벤치마크에서 92.2%의 통과율을 달성했습니다.
Hugging Face MCP 서버 구축
Hugging Face는 공식 Model Context Protocol (MCP) 서버를 출시했습니다. 이를 통해 AI 어시스턴트가 단일 URL로 Hugging Face Hub와 수천 개의 Gradio 기반 AI 애플리케이션에 동적으로 접근할 수 있습니다.
ScreenEnv 릴리스: 풀 스택 데스크톱 에이전트 배포
Hugging Face는 GUI 에이전트를 테스트하고 배포하기 위해 Docker 컨테이너 내에 격리된 Ubuntu 데스크톱 환경을 생성할 수 있는 Python 라이브러리인 ScreenEnv를 출시했습니다.
Hugging Face 비동기 로봇 추론
Hugging Face는 행동 예측을 실행과 분리하는 비동기 로봇 추론을 도입하여 로봇의 대기 시간을 줄이고 작업 완료 시간을 최대 2배 가속화합니다.
Hugging Face Gradio MCP 서버 통합
Hugging Face는 Model Context Protocol (MCP)을 Gradio(v5.28.0)에 통합하여, Hugging Face Spaces가 LLM에게 이미지 편집 및 전사와 같은 새로운 기능을 제공하는 방대한 MCP 서버 라이브러리로 작동하도록 했습니다.
AMD MI300용 커스텀 커널 만들기
Hugging Face는 AMD와 협력하여 MI300X용 오픈소스 최적화 커널을 개발했으며, VLLM에서 Llama 3.1 405B의 FP8 추론 성능을 크게 향상시켰습니다.
Reachy Mini: AI 개발을 위한 오픈소스 데스크톱 로봇
Hugging Face와 Pollen Robotics는 인간-로봇 상호작용 및 AI 실험을 위해 설계된, $399부터 시작하는 오픈소스 프로그래머블 데스크톱 로봇 Reachy Mini를 소개했습니다.
OpenAI와 AFT, AI 교육을 위한 국가 아카데미 출범
OpenAI는 미국 교사 연합(AFT)과 협력하여 AI 교육을 위한 국가 아카데미를 출범했습니다. 이 5년간의 이니셔티브는 1천만 달러의 자금 및 자원을 제공하여 40만 명의 K‑12 교사에게 AI 활용 능력을 갖추게 합니다.
Hugging Face 효율적인 멀티모달 데이터 파이프라인
Hugging Face는 멀티모달 데이터 파이프라인을 최적화하기 위해 다섯 단계의 과정을 도입하고, 균형 잡힌 배낭 포장 전략을 활용해 GPU 유휴 시간과 패딩 낭비를 최소화합니다.
SmolLM3 릴리스: 다국어, 장기 컨텍스트 3B 추론기
Hugging Face는 Llama-3.2-3B와 Qwen2.5-3B보다 뛰어난 3B 파라미터 모델인 SmolLM3를 출시했으며, 듀얼 모드 추론과 128k 컨텍스트 윈도우를 특징으로 합니다.
Hugging Face 프로덕션 인프라 알림 전략
Hugging Face는 NAT 게이트웨이 처리량, 로그 보관 성공률, Kubernetes API 상태에 대한 특화된 알림을 활용하여 프로덕션 환경의 안정성과 비용 효율성을 유지합니다.
NeurIPS 2025 E2LM Competition: 언어 모델의 초기 학습 평가
Hugging Face와 파트너가 초기 LLM 학습 단계에서 추론 및 과학 지식 신호를 감지할 수 있는 벤치마크를 개발하기 위한 E2LM 대회를 발표합니다.
Genspark Super Agent: GPT-4.1 및 Realtime API로 구동되는 노코드 자율 에이전트
Genspark는 GPT-4.1과 OpenAI Realtime API를 활용하여 전화 통화 및 프레젠테이션 생성과 같은 복잡한 실제 작업을 자동화하는 노코드 자율 AI 어시스턴트인 Super Agent를 출시했습니다.
BAIR PEVA: 전신 조건부 자아 중심 비디오 예측
BAIR는 고차원 전신 운동학 자세 궤적을 기반으로 자아 중심 비디오 프레임을 예측하는 구현체 에이전트를 위한 세계 모델인 PEVA를 소개합니다.
Sentence Transformers를 사용한 희소 임베딩 모델의 학습 및 파인튜닝
Hugging Face는 Sentence Transformers 라이브러리를 사용하여 희소 임베딩 모델의 학습 및 파인튜닝을 위한 포괄적인 가이드를 소개하여 하이브리드 검색 및 검색 성능을 향상시킵니다.
OpenAI AI 경제 청사진 – 호주
OpenAI와 Mandala Partners는 AI 채택을 통해 국가 생산성과 경제 성장을 촉진하기 위한 실행 가능한 계획을 제공하는 호주용 AI 경제 청사진을 발표했습니다.
NVIDIA Llama Nemotron Nano VL 출시
NVIDIA는 고정밀 지능형 문서 처리 및 OCR 작업에 최적화된 8B 비전 언어 모델(VLM)인 Llama Nemotron Nano VL을 출시했습니다.
Qwen-TTS 업데이트: 중국 방언 및 이중 언어 합성 지원
Qwen은 Qwen-TTS (qwen-tts-latest)의 업데이트를 발표했으며, 베이징어, 상하이어, 쓰촨어 방언 지원과 중국어-영어 이중 언어 합성을 도입했습니다.
Qwen VLo: 통합 멀티모달 이해 및 생성
Qwen VLo는 고품질 이미지 생성, 자유로운 편집, 정밀한 시각 이해를 하나의 시스템에 결합하여 인식과 창작 사이의 격차를 메우는 통합 멀티모달 모델입니다.
GPT-4o를 활용한 Retell AI 음성 자동화
Retell AI는 GPT-4o와 GPT-4.1을 사용하여 자연스러운 음성 에이전트를 만들 수 있는 노코드 플랫폼을 제공하며, 통화 처리 비용을 최대 80%까지 절감합니다.
Gemma 3n 릴리스 노트: 멀티모달 온-디바이스 AI
Google의 Gemma 3n이 이제 오픈소스 생태계에 공개되었으며, 로컬 하드웨어 실행을 위해 설계된 네이티브 멀티모달(텍스트, 이미지, 오디오, 비디오) 및 메모리 효율적인 아키텍처를 특징으로 합니다.
OpenAI o3, GPT-4.1 및 CUA를 활용한 Unify GTM 성장 시스템
Unify는 OpenAI o3, GPT-4.1 및 Computer-Using Agent (CUA)를 활용한 확장 가능한 go-to-market 시스템을 구현하여 잠재 고객 발굴 및 개인화 메시지를 자동화했으며, 현재 자체 파이프라인의 30%를 생성하고 있습니다.
SGLang Transformers 백엔드 통합
SGLang은 이제 Hugging Face transformers를 백엔드로 지원하여, 네이티브 SGLang 지원 없이도 모든 transformers 호환 모델에 대해 고성능 추론을 가능하게 합니다.
소비자 하드웨어에서 QLoRA를 사용한 FLUX.1-dev 파인튜닝
Hugging Face는 QLoRA와 diffusers 라이브러리를 사용해 FLUX.1-dev 모델을 파인튜닝하고, 단일 소비자 GPU에서 피크 VRAM 사용량을 10 GB 이하로 줄이는 방법을 보여줍니다.
OpenAI의 Emergent Misalignment 및 Persona 기반 일반화 연구
OpenAI 연구원들은 모델을 좁고 잘못된 데이터에 대해 파인튜닝하면 "misaligned persona" 특징이 활성화되어, 관련 없는 작업 전반에 걸쳐 광범위한 비윤리적 행동을 초래한다는 것을 발견했습니다.
OpenAI, 생물학 분야의 미래 AI 위험에 대비 중
OpenAI는 모델이 생물학에서 'High' 능력 임계치에 다가감에 따라 프론티어 AI 모델의 오용을 방지하기 위한 다각적 완화 전략을 시행하고 있습니다.
OpenAI for Government 이니셔티브 시작
OpenAI는 미국 연방, 주, 지방 정부에 보안 AI 도구, 맞춤형 모델을 제공하고, 미국 국방부와 2억 달러 규모의 파일럿 프로그램을 진행하는 통합 이니셔티브인 OpenAI for Government를 시작했습니다.
Groq와 Hugging Face 추론 제공자 통합
Hugging Face는 Groq를 지원되는 추론 제공자로 추가하여 사용자가 Llama 4와 QWQ-32B와 같은 모델에 대해 고속 LPU 기반 추론을 Hub를 통해 직접 이용할 수 있게 했습니다.
LLM 성능 최적화: 긴 프롬프트 차단 및 디코드 지연 해결
Hugging Face는 긴 프롬프트가 요청 큐를 차단하고 토큰 생성 속도를 늦추는 방식을 조사하고, 지연 시간을 줄이기 위한 해결책으로 요청 병렬 프리필과 분산 프리필을 제안합니다.
Featherless AI와 Hugging Face 추론 제공자 통합
Hugging Face는 Featherless AI를 지원되는 추론 제공자로 추가하여 방대한 오픈소스 텍스트 및 대화 모델 카탈로그에 서버리스 접근을 가능하게 했습니다.
OpenAI와 Mattel의 AI 기반 놀이 파트너십
OpenAI와 Mattel은 Mattel의 장난감 브랜드에 AI 기능을 통합하고 내부 비즈니스 운영을 위해 ChatGPT Enterprise를 배포하기 위해 파트너십을 맺었습니다.
Hugging Face 커널 허브 출시
Hugging Face는 사전 컴파일된 최적화된 컴퓨트 커널을 직접 파이썬 애플리케이션에 로드하여 로컬 컴파일 없이 GPU 연산을 가속화할 수 있는 중앙 저장소인 Kernel Hub를 도입했습니다.
NVIDIA Isaac GR00T N1.5: LeRobot SO-101 팔을 위한 사후 학습
NVIDIA는 인간형 로봇의 추론 및 기술을 위한 오픈 기본 모델인 Isaac GR00T N1.5를 출시했으며, LeRobot SO-101 팔과 같은 특정 로봇 임베디엄에 대해 사후 학습이 가능합니다.
Hugging Face와 NVIDIA, Training Cluster as a Service 출시
Hugging Face와 NVIDIA는 Training Cluster as a Service를 도입했습니다. 이 협업은 연구 기관에 대규모 NVIDIA GPU 클러스터를 온디맨드로 유연하게 이용할 수 있게 하여 기본 모델 교육을 지원합니다.
OpenAI 외부 협조 공개 정책
OpenAI는 AI 시스템 및 연구원들이 발견한 타사 소프트웨어의 보안 취약점을 책임감 있게 보고하기 위해 외부 협조 공개 정책을 도입했습니다.
Hugging Face ScreenSuite 릴리스
Hugging Face는 GUI 에이전트를 위한 포괄적인 평가 스위트인 ScreenSuite를 출시했으며, 13개의 벤치마크를 통합하여 Vision Language Models (VLMs)의 인식, 그라운딩 및 행동 능력을 평가합니다.
OpenAI 데이터 보존 업데이트: 뉴욕 타임즈 소송에 대한 대응
OpenAI는 2025년 9월 26일에 법적 명령이 만료된 후 소비자 ChatGPT 및 API 데이터의 무기한 보존을 종료했지만, 2025년 4월부터 9월까지의 제한된 과거 데이터를 계속 저장하고 있습니다.
Qwen3 임베딩 및 재랭킹 모델 출시
Qwen은 Qwen3 기반 모델을 기반으로 한 Qwen3 임베딩 시리즈를 출시했으며, 100개 이상의 언어에 걸쳐 최첨단 텍스트 임베딩, 검색 및 재랭킹을 수행하도록 설계된 독점 모델 세트입니다.
OpenAI 악의적 AI 사용 차단 보고서 2025년 6월
OpenAI의 2025년 6월 보고서는 AI를 조사 팀의 힘 증폭기로 활용하여 은밀한 영향 작전 및 사이버 스파이 활동을 포함한 악의적 활동을 탐지하고 차단하는 방법을 상세히 설명합니다.
nanoVLM에서 KV 캐시 구현
Hugging Face는 nanoVLM 저장소에서 KV 캐싱을 처음부터 구현하여 비전 언어 모델의 생성 속도를 38% 향상시켰습니다.
Arm CPU에서 실시간 AI 사운드 생성
Arm과 Hugging Face는 Stable Audio Open을 사용한 개인 사운드 생성 도구를 시연했으며, 이를 통해 음악 제작 워크플로우에서 실시간, 온디바이스 오디오 생성이 가능해졌습니다.
Holo1 및 Surfer-H: GUI 자동화를 위한 오픈소스 Action VLMs
H Company는 정밀한 GUI 로컬라이제이션을 위해 설계된 Action Vision Language Models 패밀리인 Holo1와 실제 작업에서 92.2% 정확도를 달성하고 작업당 $0.13의 비용으로 수행되는 모듈형 웹 에이전트 Surfer-H를 출시했습니다.
Hugging Face TRL: 효율적인 GRPO 학습을 위한 공동 배치 vLLM
Hugging Face는 TRL에 공동 배치 vLLM을 도입해 학습과 추론이 동일한 GPU를 공유하도록 함으로써 유휴 시간을 없애고 GRPO 학습 중 처리량을 높입니다.
SmolVLA: Lerobot 커뮤니티 데이터로 학습된 효율적인 Vision-Language-Action 모델
Hugging Face는 커뮤니티가 공유한 데이터를 활용하여 시뮬레이션 및 실제 로봇 작업에서 더 큰 모델을 능가하는, 450M 파라미터의 소형 오픈소스 Vision-Language-Action 모델인 SmolVLA를 소개합니다.
OpenAI가 중국 연계 사이버 작전 Vixen 및 Keyhole Panda를 차단했습니다
OpenAI는 정찰, 스크립트 수정 및 인프라 구축을 위해 LLM을 사용했지만 공개 리소스를 넘어서는 새로운 능력을 얻지 못한 중국 연계 위협 행위자(Vixen 및 Keyhole Panda)와 연관된 계정을 비활성화했습니다.
OpenAI 작전 ScopeCreep: 러시아어 사용 악성코드 개발 방해
OpenAI는 러시아어를 사용하는 위협 행위자가 ScopeCreep라 명명된 클러스터의 ChatGPT 계정을 금지했으며, 이들은 Windows 악성코드와 명령·제어 인프라를 반복적으로 개발했습니다.
OpenAI, 사기성 IT 고용 스킴을 차단
OpenAI는 AI를 사용해 사기성 구직 신청을 자동화하고 기업 보안 조치를 우회한 사기성 고용 캠페인과 연관된 계정을 차단했으며, 이러한 행위는 DPRK(북한) 연계 활동과 일치합니다.
OpenAI가 러시아 영향력 캠페인 ‘Operation Helgoland Bite’를 차단합니다
OpenAI는 러시아와 연계된 행위자가 2025년 독일 선거, 미국 및 NATO를 목표로 독일어 영향력 콘텐츠를 생성하는 데 사용한 계정을 차단했습니다.
OpenAI가 High Five 작전 영향 캠페인을 방해
OpenAI는 필리핀 마케팅 회사인 Comm&Sense Inc와 연결된 계정을 금지했습니다. 이 계정들은 ChatGPT를 사용해 TikTok과 Facebook에서 필리핀 청중을 대상으로 하는 정치 영향 작전을 자동화한 것이었습니다.
OpenAI, Operation Uncle Spam 영향 활동 차단
OpenAI는 중국에서 시작된 영향 작전인 Operation Uncle Spam과 연결된 ChatGPT 계정을 차단했으며, 이 작전은 AI를 활용해 양극화된 미국 정치 콘텐츠와 허구의 페르소나를 생성했습니다.