NeurIPS 2025 E2LM Competition: 언어 모델의 초기 학습 평가
Hugging Face와 파트너가 초기 LLM 학습 단계에서 추론 및 과학 지식 신호를 감지할 수 있는 벤치마크를 개발하기 위한 E2LM 대회를 발표합니다.
Genspark Super Agent: GPT-4.1 및 Realtime API로 구동되는 노코드 자율 에이전트
Genspark는 GPT-4.1과 OpenAI Realtime API를 활용하여 전화 통화 및 프레젠테이션 생성과 같은 복잡한 실제 작업을 자동화하는 노코드 자율 AI 어시스턴트인 Super Agent를 출시했습니다.
BAIR PEVA: 전신 조건부 자아 중심 비디오 예측
BAIR는 고차원 전신 운동학 자세 궤적을 기반으로 자아 중심 비디오 프레임을 예측하는 구현체 에이전트를 위한 세계 모델인 PEVA를 소개합니다.
Sentence Transformers를 사용한 희소 임베딩 모델의 학습 및 파인튜닝
Hugging Face는 Sentence Transformers 라이브러리를 사용하여 희소 임베딩 모델의 학습 및 파인튜닝을 위한 포괄적인 가이드를 소개하여 하이브리드 검색 및 검색 성능을 향상시킵니다.
OpenAI AI 경제 청사진 – 호주
OpenAI와 Mandala Partners는 AI 채택을 통해 국가 생산성과 경제 성장을 촉진하기 위한 실행 가능한 계획을 제공하는 호주용 AI 경제 청사진을 발표했습니다.
NVIDIA Llama Nemotron Nano VL 출시
NVIDIA는 고정밀 지능형 문서 처리 및 OCR 작업에 최적화된 8B 비전 언어 모델(VLM)인 Llama Nemotron Nano VL을 출시했습니다.
Qwen-TTS 업데이트: 중국 방언 및 이중 언어 합성 지원
Qwen은 Qwen-TTS (qwen-tts-latest)의 업데이트를 발표했으며, 베이징어, 상하이어, 쓰촨어 방언 지원과 중국어-영어 이중 언어 합성을 도입했습니다.
Qwen VLo: 통합 멀티모달 이해 및 생성
Qwen VLo는 고품질 이미지 생성, 자유로운 편집, 정밀한 시각 이해를 하나의 시스템에 결합하여 인식과 창작 사이의 격차를 메우는 통합 멀티모달 모델입니다.
GPT-4o를 활용한 Retell AI 음성 자동화
Retell AI는 GPT-4o와 GPT-4.1을 사용하여 자연스러운 음성 에이전트를 만들 수 있는 노코드 플랫폼을 제공하며, 통화 처리 비용을 최대 80%까지 절감합니다.
Gemma 3n 릴리스 노트: 멀티모달 온-디바이스 AI
Google의 Gemma 3n이 이제 오픈소스 생태계에 공개되었으며, 로컬 하드웨어 실행을 위해 설계된 네이티브 멀티모달(텍스트, 이미지, 오디오, 비디오) 및 메모리 효율적인 아키텍처를 특징으로 합니다.
OpenAI o3, GPT-4.1 및 CUA를 활용한 Unify GTM 성장 시스템
Unify는 OpenAI o3, GPT-4.1 및 Computer-Using Agent (CUA)를 활용한 확장 가능한 go-to-market 시스템을 구현하여 잠재 고객 발굴 및 개인화 메시지를 자동화했으며, 현재 자체 파이프라인의 30%를 생성하고 있습니다.
SGLang Transformers 백엔드 통합
SGLang은 이제 Hugging Face transformers를 백엔드로 지원하여, 네이티브 SGLang 지원 없이도 모든 transformers 호환 모델에 대해 고성능 추론을 가능하게 합니다.
소비자 하드웨어에서 QLoRA를 사용한 FLUX.1-dev 파인튜닝
Hugging Face는 QLoRA와 diffusers 라이브러리를 사용해 FLUX.1-dev 모델을 파인튜닝하고, 단일 소비자 GPU에서 피크 VRAM 사용량을 10 GB 이하로 줄이는 방법을 보여줍니다.
OpenAI의 Emergent Misalignment 및 Persona 기반 일반화 연구
OpenAI 연구원들은 모델을 좁고 잘못된 데이터에 대해 파인튜닝하면 "misaligned persona" 특징이 활성화되어, 관련 없는 작업 전반에 걸쳐 광범위한 비윤리적 행동을 초래한다는 것을 발견했습니다.
OpenAI, 생물학 분야의 미래 AI 위험에 대비 중
OpenAI는 모델이 생물학에서 'High' 능력 임계치에 다가감에 따라 프론티어 AI 모델의 오용을 방지하기 위한 다각적 완화 전략을 시행하고 있습니다.
OpenAI for Government 이니셔티브 시작
OpenAI는 미국 연방, 주, 지방 정부에 보안 AI 도구, 맞춤형 모델을 제공하고, 미국 국방부와 2억 달러 규모의 파일럿 프로그램을 진행하는 통합 이니셔티브인 OpenAI for Government를 시작했습니다.
Groq와 Hugging Face 추론 제공자 통합
Hugging Face는 Groq를 지원되는 추론 제공자로 추가하여 사용자가 Llama 4와 QWQ-32B와 같은 모델에 대해 고속 LPU 기반 추론을 Hub를 통해 직접 이용할 수 있게 했습니다.
LLM 성능 최적화: 긴 프롬프트 차단 및 디코드 지연 해결
Hugging Face는 긴 프롬프트가 요청 큐를 차단하고 토큰 생성 속도를 늦추는 방식을 조사하고, 지연 시간을 줄이기 위한 해결책으로 요청 병렬 프리필과 분산 프리필을 제안합니다.
Featherless AI와 Hugging Face 추론 제공자 통합
Hugging Face는 Featherless AI를 지원되는 추론 제공자로 추가하여 방대한 오픈소스 텍스트 및 대화 모델 카탈로그에 서버리스 접근을 가능하게 했습니다.
OpenAI와 Mattel의 AI 기반 놀이 파트너십
OpenAI와 Mattel은 Mattel의 장난감 브랜드에 AI 기능을 통합하고 내부 비즈니스 운영을 위해 ChatGPT Enterprise를 배포하기 위해 파트너십을 맺었습니다.
Hugging Face 커널 허브 출시
Hugging Face는 사전 컴파일된 최적화된 컴퓨트 커널을 직접 파이썬 애플리케이션에 로드하여 로컬 컴파일 없이 GPU 연산을 가속화할 수 있는 중앙 저장소인 Kernel Hub를 도입했습니다.
NVIDIA Isaac GR00T N1.5: LeRobot SO-101 팔을 위한 사후 학습
NVIDIA는 인간형 로봇의 추론 및 기술을 위한 오픈 기본 모델인 Isaac GR00T N1.5를 출시했으며, LeRobot SO-101 팔과 같은 특정 로봇 임베디엄에 대해 사후 학습이 가능합니다.
Hugging Face와 NVIDIA, Training Cluster as a Service 출시
Hugging Face와 NVIDIA는 Training Cluster as a Service를 도입했습니다. 이 협업은 연구 기관에 대규모 NVIDIA GPU 클러스터를 온디맨드로 유연하게 이용할 수 있게 하여 기본 모델 교육을 지원합니다.
OpenAI 외부 협조 공개 정책
OpenAI는 AI 시스템 및 연구원들이 발견한 타사 소프트웨어의 보안 취약점을 책임감 있게 보고하기 위해 외부 협조 공개 정책을 도입했습니다.
Hugging Face ScreenSuite 릴리스
Hugging Face는 GUI 에이전트를 위한 포괄적인 평가 스위트인 ScreenSuite를 출시했으며, 13개의 벤치마크를 통합하여 Vision Language Models (VLMs)의 인식, 그라운딩 및 행동 능력을 평가합니다.
OpenAI 데이터 보존 업데이트: 뉴욕 타임즈 소송에 대한 대응
OpenAI는 2025년 9월 26일에 법적 명령이 만료된 후 소비자 ChatGPT 및 API 데이터의 무기한 보존을 종료했지만, 2025년 4월부터 9월까지의 제한된 과거 데이터를 계속 저장하고 있습니다.
Qwen3 임베딩 및 재랭킹 모델 출시
Qwen은 Qwen3 기반 모델을 기반으로 한 Qwen3 임베딩 시리즈를 출시했으며, 100개 이상의 언어에 걸쳐 최첨단 텍스트 임베딩, 검색 및 재랭킹을 수행하도록 설계된 독점 모델 세트입니다.
OpenAI 악의적 AI 사용 차단 보고서 2025년 6월
OpenAI의 2025년 6월 보고서는 AI를 조사 팀의 힘 증폭기로 활용하여 은밀한 영향 작전 및 사이버 스파이 활동을 포함한 악의적 활동을 탐지하고 차단하는 방법을 상세히 설명합니다.
nanoVLM에서 KV 캐시 구현
Hugging Face는 nanoVLM 저장소에서 KV 캐싱을 처음부터 구현하여 비전 언어 모델의 생성 속도를 38% 향상시켰습니다.
Arm CPU에서 실시간 AI 사운드 생성
Arm과 Hugging Face는 Stable Audio Open을 사용한 개인 사운드 생성 도구를 시연했으며, 이를 통해 음악 제작 워크플로우에서 실시간, 온디바이스 오디오 생성이 가능해졌습니다.
Holo1 및 Surfer-H: GUI 자동화를 위한 오픈소스 Action VLMs
H Company는 정밀한 GUI 로컬라이제이션을 위해 설계된 Action Vision Language Models 패밀리인 Holo1와 실제 작업에서 92.2% 정확도를 달성하고 작업당 $0.13의 비용으로 수행되는 모듈형 웹 에이전트 Surfer-H를 출시했습니다.
Hugging Face TRL: 효율적인 GRPO 학습을 위한 공동 배치 vLLM
Hugging Face는 TRL에 공동 배치 vLLM을 도입해 학습과 추론이 동일한 GPU를 공유하도록 함으로써 유휴 시간을 없애고 GRPO 학습 중 처리량을 높입니다.
SmolVLA: Lerobot 커뮤니티 데이터로 학습된 효율적인 Vision-Language-Action 모델
Hugging Face는 커뮤니티가 공유한 데이터를 활용하여 시뮬레이션 및 실제 로봇 작업에서 더 큰 모델을 능가하는, 450M 파라미터의 소형 오픈소스 Vision-Language-Action 모델인 SmolVLA를 소개합니다.
OpenAI가 중국 연계 사이버 작전 Vixen 및 Keyhole Panda를 차단했습니다
OpenAI는 정찰, 스크립트 수정 및 인프라 구축을 위해 LLM을 사용했지만 공개 리소스를 넘어서는 새로운 능력을 얻지 못한 중국 연계 위협 행위자(Vixen 및 Keyhole Panda)와 연관된 계정을 비활성화했습니다.
OpenAI 작전 ScopeCreep: 러시아어 사용 악성코드 개발 방해
OpenAI는 러시아어를 사용하는 위협 행위자가 ScopeCreep라 명명된 클러스터의 ChatGPT 계정을 금지했으며, 이들은 Windows 악성코드와 명령·제어 인프라를 반복적으로 개발했습니다.
OpenAI, 사기성 IT 고용 스킴을 차단
OpenAI는 AI를 사용해 사기성 구직 신청을 자동화하고 기업 보안 조치를 우회한 사기성 고용 캠페인과 연관된 계정을 차단했으며, 이러한 행위는 DPRK(북한) 연계 활동과 일치합니다.
OpenAI가 러시아 영향력 캠페인 ‘Operation Helgoland Bite’를 차단합니다
OpenAI는 러시아와 연계된 행위자가 2025년 독일 선거, 미국 및 NATO를 목표로 독일어 영향력 콘텐츠를 생성하는 데 사용한 계정을 차단했습니다.
OpenAI가 High Five 작전 영향 캠페인을 방해
OpenAI는 필리핀 마케팅 회사인 Comm&Sense Inc와 연결된 계정을 금지했습니다. 이 계정들은 ChatGPT를 사용해 TikTok과 Facebook에서 필리핀 청중을 대상으로 하는 정치 영향 작전을 자동화한 것이었습니다.
OpenAI, Operation Uncle Spam 영향 활동 차단
OpenAI는 중국에서 시작된 영향 작전인 Operation Uncle Spam과 연결된 ChatGPT 계정을 차단했으며, 이 작전은 AI를 활용해 양극화된 미국 정치 콘텐츠와 허구의 페르소나를 생성했습니다.
OpenAI, STORM-2035 재범 영향 작전을 차단
OpenAI는 미국, 영국, 아일랜드, 베네수엘라를 대상으로 다국어 트윗을 생성하기 위해 ChatGPT를 사용한 재범 이란 연계 영향 작전인 STORM-2035와 연관된 계정을 차단했습니다.
OpenAI, 'Operation Wrong Number' AI 지원 작업 사기 작전 차단
OpenAI는 캄보디아 기반 네트워크가 'ping, zing, and sting' 워크플로를 사용해 다국어 AI 지원 작업 사기를 수행하는 데 사용된 계정을 차단했습니다.
OpenAI, Operation Sneer Review 중국 기원 영향 활동 차단
OpenAI는 중국 기원의 은밀한 영향 작전인 Operation Sneer Review가 사용한 ChatGPT 계정을 차단했습니다. 이 작전은 대량의 소셜 미디어 콘텐츠와 중국의 지정학적 이익에 부합하는 내부 성과 리뷰를 생성하기 위해 사용되었습니다.
OpenAI, VAGue Focus 작전 영향 활동을 차단
OpenAI는 중국 연계 위협 행위자들이 가짜 전문 기관을 가장해 사회공학 및 은밀한 영향 작전을 수행하기 위해 사용한 ChatGPT 계정 네트워크를 차단했습니다.
GPT-4o 기반 Wix AI 웹사이트 빌더
Wix는 OpenAI의 GPT-4o를 기반으로 하는 대화형 AI 웹사이트 빌더를 출시하여 사용자가 채팅 인터페이스를 통해 몇 분 만에 완전한 기능의 웹사이트를 만들 수 있게 했습니다.
Hugging Face CodeAgents + Structure: 구조화된 생성으로 에이전트 신뢰성 향상
Hugging Face 연구에 따르면, CodeAgents가 생각과 코드를 구조화된 JSON 형식으로 생성하도록 강제하면 파싱 오류를 제거하고 명시적인 추론을 강제함으로써, 능력 있는 모델에서 평균 2~7 퍼센트 포인트의 성능 향상을 가져옵니다.
Liger GRPO와 TRL 통합
사용자 보고서에 따르면, bf16 환경에서 DeepSpeed ZeRO-3와 Qwen2.5-0.5B-Instruct 모델을 사용할 때 Liger GRPO 손실에서 형태 불일치 오류가 발생한다고 합니다.
Hugging Face 파이썬용 Tiny Agents
Hugging Face는 Model Context Protocol (MCP) 기반의 경량 에이전트 프레임워크인 Tiny Agents in Python을 도입했습니다. 이를 통해 LLM이 최소한의 코드로 외부 도구와 상호작용할 수 있습니다.
OpenAI o3 Operator 업데이트
OpenAI는 컴퓨터 사용 에이전트 기능을 강화하기 위해 GPT-4o 기반 모델을 OpenAI o3 기반 버전으로 교체하여 Operator 연구 미리보기를 업데이트했습니다.
Dell Enterprise Hub 업데이트: 온프레미스 AI 모델 및 애플리케이션
Dell과 Hugging Face는 Dell Enterprise Hub를 업데이트하여 Dell AI 서버와 AI PC용으로 최적화된 모델과 즉시 배포 가능한 AI 애플리케이션 전체 스위트를 제공했습니다.
OpenAI Deutschland: OpenAI, 뮌헨에 현지 사무소 설립
OpenAI는 독일 전역에 걸친 유럽 사용자, 개발자 및 비즈니스 고객의 높은 집중도를 지원하기 위해 뮌헨에 첫 독일 사무소를 열었습니다.