소비자 하드웨어에서 QLoRA를 사용한 FLUX.1-dev 파인튜닝
Hugging Face는 QLoRA와 diffusers 라이브러리를 사용해 FLUX.1-dev 모델을 파인튜닝하고, 단일 소비자 GPU에서 피크 VRAM 사용량을 10 GB 이하로 줄이는 방법을 보여줍니다.
OpenAI의 Emergent Misalignment 및 Persona 기반 일반화 연구
OpenAI 연구원들은 모델을 좁고 잘못된 데이터에 대해 파인튜닝하면 "misaligned persona" 특징이 활성화되어, 관련 없는 작업 전반에 걸쳐 광범위한 비윤리적 행동을 초래한다는 것을 발견했습니다.
OpenAI, 생물학 분야의 미래 AI 위험에 대비 중
OpenAI는 모델이 생물학에서 'High' 능력 임계치에 다가감에 따라 프론티어 AI 모델의 오용을 방지하기 위한 다각적 완화 전략을 시행하고 있습니다.
OpenAI for Government 이니셔티브 시작
OpenAI는 미국 연방, 주, 지방 정부에 보안 AI 도구, 맞춤형 모델을 제공하고, 미국 국방부와 2억 달러 규모의 파일럿 프로그램을 진행하는 통합 이니셔티브인 OpenAI for Government를 시작했습니다.
Groq와 Hugging Face 추론 제공자 통합
Hugging Face는 Groq를 지원되는 추론 제공자로 추가하여 사용자가 Llama 4와 QWQ-32B와 같은 모델에 대해 고속 LPU 기반 추론을 Hub를 통해 직접 이용할 수 있게 했습니다.
LLM 성능 최적화: 긴 프롬프트 차단 및 디코드 지연 해결
Hugging Face는 긴 프롬프트가 요청 큐를 차단하고 토큰 생성 속도를 늦추는 방식을 조사하고, 지연 시간을 줄이기 위한 해결책으로 요청 병렬 프리필과 분산 프리필을 제안합니다.
Featherless AI와 Hugging Face 추론 제공자 통합
Hugging Face는 Featherless AI를 지원되는 추론 제공자로 추가하여 방대한 오픈소스 텍스트 및 대화 모델 카탈로그에 서버리스 접근을 가능하게 했습니다.
OpenAI와 Mattel의 AI 기반 놀이 파트너십
OpenAI와 Mattel은 Mattel의 장난감 브랜드에 AI 기능을 통합하고 내부 비즈니스 운영을 위해 ChatGPT Enterprise를 배포하기 위해 파트너십을 맺었습니다.
Hugging Face 커널 허브 출시
Hugging Face는 사전 컴파일된 최적화된 컴퓨트 커널을 직접 파이썬 애플리케이션에 로드하여 로컬 컴파일 없이 GPU 연산을 가속화할 수 있는 중앙 저장소인 Kernel Hub를 도입했습니다.
NVIDIA Isaac GR00T N1.5: LeRobot SO-101 팔을 위한 사후 학습
NVIDIA는 인간형 로봇의 추론 및 기술을 위한 오픈 기본 모델인 Isaac GR00T N1.5를 출시했으며, LeRobot SO-101 팔과 같은 특정 로봇 임베디엄에 대해 사후 학습이 가능합니다.
Hugging Face와 NVIDIA, Training Cluster as a Service 출시
Hugging Face와 NVIDIA는 Training Cluster as a Service를 도입했습니다. 이 협업은 연구 기관에 대규모 NVIDIA GPU 클러스터를 온디맨드로 유연하게 이용할 수 있게 하여 기본 모델 교육을 지원합니다.
OpenAI 외부 협조 공개 정책
OpenAI는 AI 시스템 및 연구원들이 발견한 타사 소프트웨어의 보안 취약점을 책임감 있게 보고하기 위해 외부 협조 공개 정책을 도입했습니다.
Hugging Face ScreenSuite 릴리스
Hugging Face는 GUI 에이전트를 위한 포괄적인 평가 스위트인 ScreenSuite를 출시했으며, 13개의 벤치마크를 통합하여 Vision Language Models (VLMs)의 인식, 그라운딩 및 행동 능력을 평가합니다.
OpenAI 데이터 보존 업데이트: 뉴욕 타임즈 소송에 대한 대응
OpenAI는 2025년 9월 26일에 법적 명령이 만료된 후 소비자 ChatGPT 및 API 데이터의 무기한 보존을 종료했지만, 2025년 4월부터 9월까지의 제한된 과거 데이터를 계속 저장하고 있습니다.
Qwen3 임베딩 및 재랭킹 모델 출시
Qwen은 Qwen3 기반 모델을 기반으로 한 Qwen3 임베딩 시리즈를 출시했으며, 100개 이상의 언어에 걸쳐 최첨단 텍스트 임베딩, 검색 및 재랭킹을 수행하도록 설계된 독점 모델 세트입니다.
OpenAI 악의적 AI 사용 차단 보고서 2025년 6월
OpenAI의 2025년 6월 보고서는 AI를 조사 팀의 힘 증폭기로 활용하여 은밀한 영향 작전 및 사이버 스파이 활동을 포함한 악의적 활동을 탐지하고 차단하는 방법을 상세히 설명합니다.
nanoVLM에서 KV 캐시 구현
Hugging Face는 nanoVLM 저장소에서 KV 캐싱을 처음부터 구현하여 비전 언어 모델의 생성 속도를 38% 향상시켰습니다.
Arm CPU에서 실시간 AI 사운드 생성
Arm과 Hugging Face는 Stable Audio Open을 사용한 개인 사운드 생성 도구를 시연했으며, 이를 통해 음악 제작 워크플로우에서 실시간, 온디바이스 오디오 생성이 가능해졌습니다.
Holo1 및 Surfer-H: GUI 자동화를 위한 오픈소스 Action VLMs
H Company는 정밀한 GUI 로컬라이제이션을 위해 설계된 Action Vision Language Models 패밀리인 Holo1와 실제 작업에서 92.2% 정확도를 달성하고 작업당 $0.13의 비용으로 수행되는 모듈형 웹 에이전트 Surfer-H를 출시했습니다.
Hugging Face TRL: 효율적인 GRPO 학습을 위한 공동 배치 vLLM
Hugging Face는 TRL에 공동 배치 vLLM을 도입해 학습과 추론이 동일한 GPU를 공유하도록 함으로써 유휴 시간을 없애고 GRPO 학습 중 처리량을 높입니다.
SmolVLA: Lerobot 커뮤니티 데이터로 학습된 효율적인 Vision-Language-Action 모델
Hugging Face는 커뮤니티가 공유한 데이터를 활용하여 시뮬레이션 및 실제 로봇 작업에서 더 큰 모델을 능가하는, 450M 파라미터의 소형 오픈소스 Vision-Language-Action 모델인 SmolVLA를 소개합니다.
OpenAI가 중국 연계 사이버 작전 Vixen 및 Keyhole Panda를 차단했습니다
OpenAI는 정찰, 스크립트 수정 및 인프라 구축을 위해 LLM을 사용했지만 공개 리소스를 넘어서는 새로운 능력을 얻지 못한 중국 연계 위협 행위자(Vixen 및 Keyhole Panda)와 연관된 계정을 비활성화했습니다.
OpenAI 작전 ScopeCreep: 러시아어 사용 악성코드 개발 방해
OpenAI는 러시아어를 사용하는 위협 행위자가 ScopeCreep라 명명된 클러스터의 ChatGPT 계정을 금지했으며, 이들은 Windows 악성코드와 명령·제어 인프라를 반복적으로 개발했습니다.
OpenAI, 사기성 IT 고용 스킴을 차단
OpenAI는 AI를 사용해 사기성 구직 신청을 자동화하고 기업 보안 조치를 우회한 사기성 고용 캠페인과 연관된 계정을 차단했으며, 이러한 행위는 DPRK(북한) 연계 활동과 일치합니다.
OpenAI가 러시아 영향력 캠페인 ‘Operation Helgoland Bite’를 차단합니다
OpenAI는 러시아와 연계된 행위자가 2025년 독일 선거, 미국 및 NATO를 목표로 독일어 영향력 콘텐츠를 생성하는 데 사용한 계정을 차단했습니다.
OpenAI가 High Five 작전 영향 캠페인을 방해
OpenAI는 필리핀 마케팅 회사인 Comm&Sense Inc와 연결된 계정을 금지했습니다. 이 계정들은 ChatGPT를 사용해 TikTok과 Facebook에서 필리핀 청중을 대상으로 하는 정치 영향 작전을 자동화한 것이었습니다.
OpenAI, Operation Uncle Spam 영향 활동 차단
OpenAI는 중국에서 시작된 영향 작전인 Operation Uncle Spam과 연결된 ChatGPT 계정을 차단했으며, 이 작전은 AI를 활용해 양극화된 미국 정치 콘텐츠와 허구의 페르소나를 생성했습니다.
OpenAI, STORM-2035 재범 영향 작전을 차단
OpenAI는 미국, 영국, 아일랜드, 베네수엘라를 대상으로 다국어 트윗을 생성하기 위해 ChatGPT를 사용한 재범 이란 연계 영향 작전인 STORM-2035와 연관된 계정을 차단했습니다.
OpenAI, 'Operation Wrong Number' AI 지원 작업 사기 작전 차단
OpenAI는 캄보디아 기반 네트워크가 'ping, zing, and sting' 워크플로를 사용해 다국어 AI 지원 작업 사기를 수행하는 데 사용된 계정을 차단했습니다.
OpenAI, Operation Sneer Review 중국 기원 영향 활동 차단
OpenAI는 중국 기원의 은밀한 영향 작전인 Operation Sneer Review가 사용한 ChatGPT 계정을 차단했습니다. 이 작전은 대량의 소셜 미디어 콘텐츠와 중국의 지정학적 이익에 부합하는 내부 성과 리뷰를 생성하기 위해 사용되었습니다.
OpenAI, VAGue Focus 작전 영향 활동을 차단
OpenAI는 중국 연계 위협 행위자들이 가짜 전문 기관을 가장해 사회공학 및 은밀한 영향 작전을 수행하기 위해 사용한 ChatGPT 계정 네트워크를 차단했습니다.
GPT-4o 기반 Wix AI 웹사이트 빌더
Wix는 OpenAI의 GPT-4o를 기반으로 하는 대화형 AI 웹사이트 빌더를 출시하여 사용자가 채팅 인터페이스를 통해 몇 분 만에 완전한 기능의 웹사이트를 만들 수 있게 했습니다.
Hugging Face CodeAgents + Structure: 구조화된 생성으로 에이전트 신뢰성 향상
Hugging Face 연구에 따르면, CodeAgents가 생각과 코드를 구조화된 JSON 형식으로 생성하도록 강제하면 파싱 오류를 제거하고 명시적인 추론을 강제함으로써, 능력 있는 모델에서 평균 2~7 퍼센트 포인트의 성능 향상을 가져옵니다.
Liger GRPO와 TRL 통합
사용자 보고서에 따르면, bf16 환경에서 DeepSpeed ZeRO-3와 Qwen2.5-0.5B-Instruct 모델을 사용할 때 Liger GRPO 손실에서 형태 불일치 오류가 발생한다고 합니다.
Hugging Face 파이썬용 Tiny Agents
Hugging Face는 Model Context Protocol (MCP) 기반의 경량 에이전트 프레임워크인 Tiny Agents in Python을 도입했습니다. 이를 통해 LLM이 최소한의 코드로 외부 도구와 상호작용할 수 있습니다.
OpenAI o3 Operator 업데이트
OpenAI는 컴퓨터 사용 에이전트 기능을 강화하기 위해 GPT-4o 기반 모델을 OpenAI o3 기반 버전으로 교체하여 Operator 연구 미리보기를 업데이트했습니다.
Dell Enterprise Hub 업데이트: 온프레미스 AI 모델 및 애플리케이션
Dell과 Hugging Face는 Dell Enterprise Hub를 업데이트하여 Dell AI 서버와 AI PC용으로 최적화된 모델과 즉시 배포 가능한 AI 애플리케이션 전체 스위트를 제공했습니다.
OpenAI Deutschland: OpenAI, 뮌헨에 현지 사무소 설립
OpenAI는 독일 전역에 걸친 유럽 사용자, 개발자 및 비즈니스 고객의 높은 집중도를 지원하기 위해 뮌헨에 첫 독일 사무소를 열었습니다.
OpenAI와 CodeRabbit: o3, o4-mini, GPT-4.1을 활용한 소프트웨어 제공 가속화
CodeRabbit은 OpenAI의 o3, o4-mini, GPT-4.1 모델을 활용해 코드 리뷰를 자동화하여 프로덕션 버그를 50% 감소시키고 풀 리퀘스트 사이클을 25-50% 가속화합니다.
OpenAI Stargate UAE 및 OpenAI for Countries 이니셔티브 출시
OpenAI는 정부가 주권 AI 역량을 구축할 수 있도록 돕는 새로운 'OpenAI for Countries' 이니셔티브의 일환으로, 자사의 AI 인프라 플랫폼의 첫 번째 국제적 배포인 Stargate UAE를 출시했습니다.
OpenAI Responses API 업데이트 2025년 5월
OpenAI는 원격 Model Context Protocol (MCP) 서버 지원, 이미지 생성 및 Code Interpreter와 같은 새로운 내장 도구, 그리고 백그라운드 모드와 암호화된 추론을 포함한 엔터프라이즈 기능을 추가하여 Responses API를 확장했습니다.
Falcon-H1: 효율성과 성능을 위한 하이브리드 헤드 언어 모델
Hugging Face와 TII UAE는 Transformer 어텐션과 Mamba-2 상태 공간 모델을 결합하여 메모리 사용량을 줄이고 추론 속도를 높이면서 높은 성능을 달성하는 0.5B에서 34B까지의 6가지 오픈소스 하이브리드 헤드 모델군인 Falcon-H1을 소개했습니다.
Falcon-Arabic: 아랍어 언어 모델의 혁신
Technology Innovation Institute(TII)는 Falcon-Arabic이라는 7B 파라미터 모델을 출시했으며, 이 모델은 현대 표준 아랍어와 지역 방언 전반에 걸친 일반 지식, 문법 및 추론에서 더 큰 규모의 아랍어 LLM을 능가합니다.
nanoVLM: 비전 언어 모델 훈련을 위한 미니멀리스트 PyTorch 툴킷
Hugging Face는 초보자와 연구자를 위해 Vision Language Models (VLM)의 훈련 및 이해를 간소화하도록 설계된 가볍고 순수 PyTorch 기반 툴킷인 nanoVLM을 출시했습니다.
Hugging Face Diffusers 양자화 백엔드
Hugging Face Diffusers는 bitsandbytes, torchao, Quanto, GGUF, 그리고 FP8 레이어별 캐스팅을 포함한 여러 양자화 백엔드를 통합하여 FLUX.1-dev와 같은 대형 디퓨전 모델의 메모리 사용량을 줄입니다.
Microsoft와 Hugging Face, Azure AI Foundry를 위한 협업 확대
Microsoft와 Hugging Face는 10,000개 이상의 오픈 소스 모델을 Azure AI Foundry에 통합하기 위해 파트너십을 확대했으며, 이를 통해 다양한 AI 모달리티를 안전하고 엔터프라이즈급으로 배포할 수 있게 되었습니다.
OpenAI Codex: codex-1으로 구동되는 클라우드 기반 코딩 에이전트
OpenAI는 codex-1 모델(최적화된 o3 버전)로 구동되는 클라우드 기반 코딩 에이전트인 Codex를 도입했으며, 격리된 클라우드 컨테이너에서 소프트웨어 엔지니어링 작업을 수행합니다.
OpenAI Codex 연구 미리보기
OpenAI는 codex-1 모델로 구동되는 클라우드 기반 소프트웨어 엔지니어링 에이전트인 Codex를 출시했으며, 이 에이전트는 격리된 샌드박스 환경에서 독립적으로 기능을 작성하고, 버그를 수정하며, 풀 리퀘스트를 제안할 수 있습니다.
Falcon-Edge: 강력하고, 범용적이며, 미세조정 가능한 1.58비트 LLMs
Hugging Face와 Falcon-LLM 팀은 새로운 사전 학습 패러다임을 통해 추론과 미세조정 모두를 지원하는 1B 및 3B 파라미터 규모의 1.58비트(삼진) 언어 모델 시리즈인 Falcon-Edge를 출시했습니다.
Hugging Face Transformers: 생태계 상호 운용성을 위한 모델 정의 표준화
Hugging Face는 Transformers 라이브러리를 모델 정의의 중심축으로 자리매김하여, Transformers가 지원하는 모든 아키텍처가 추론 엔진 및 학습 프레임워크를 포함한 광범위한 ML 생태계와 자동으로 호환되도록 하고 있습니다.