DABStep: 데이터 에이전트 벤치마크: 다단계 추론
Hugging Face와 Adyen은 450개 이상의 실제 세계 데이터 분석 작업으로 구성된 DABStep 벤치마크를 도입했으며, 이는 현재 최첨단 AI 에이전트가 복잡한 추론 작업에서 16%의 정확도만을 달성한다는 것을 보여줍니다.
pi0와 pi0-FAST: 일반 로봇 제어를 위한 Vision-Language-Action 모델
Hugging Face는 Physical Intelligence가 개발한 범용 Vision-Language-Action(VLA) 모델인 pi0와 pi0-FAST를 LeRobot 저장소에 통합하여 다양한 로봇 형태에서 다재다능한 로봇 제어를 가능하게 했습니다.
ChatGPT를 이용한 네일 아트 디자인
자격을 갖춘 네일 테크니시안 Tabytha Scott는 ChatGPT를 창의적 파트너로 사용하여 무한한 디자인 아이디어를 실행 가능한 네일 아트 개념으로 좁힌다.
Hugging Face Open-source DeepResearch
Hugging Face는 OpenAI의 Deep Research 기능을 재현하는 프레임워크를 오픈소스로 공개했으며, 코드네이티브 에이전트 접근 방식을 사용하여 GAIA 벤치마크에서 55.15% 점수를 달성했습니다.
ChatGPT를 이용한 특수 낚시 가이드
OpenAI는 프로 낚시인이 ChatGPT를 이용해 맞춤형 낚시 계획을 세우고 스포츠 초보자들의 학습 곡선을 가속화하는 방법을 강조합니다.
ChatGPT GPTs를 활용한 맞춤형 수학 튜터 만들기
Phil Birchenall은 맞춤형 GPT를 사용하여 딸의 수학 실력 향상과 SAT 시험 합격을 도운 개인 맞춤형 개 테마 수학 튜터를 만들었습니다.
OpenAI 심층 연구: 복잡한 산업 동향
OpenAI는 복잡한 산업 동향 분석을 자동화하여 전문 연구자의 개인 역량을 높이기 위해 설계된 심층 연구 도구를 도입했습니다.
OpenAI 딥 리서치
OpenAI는 o3 모델의 버전으로 구동되는 ChatGPT의 에이전트형 기능인 딥 리서치를 출시했습니다. 이는 자율적으로 다단계 웹 연구를 수행하여 종합적인 애널리스트 수준의 보고서를 생성합니다.
Open-R1 업데이트 #1: DeepSeek-R1 훈련 및 합성 데이터 복제
Hugging Face는 Open-R1 프로젝트에 대한 첫 번째 진행 상황 업데이트를 제공하며, DeepSeek-R1 평가 점수 재현, TRL에 GRPO 통합, 그리고 합성 추론 데이터 생성 확대를 위한 전략을 상세히 설명합니다.
OpenAI, AI 지원 로맨스 베이팅 및 피그 부처링 사기 차단
OpenAI는 캄보디아에 기반을 둔 네트워크가 로맨스 및 투자 사기를 위해 번역과 페르소나 생성을 자동화하는 데 사용한 다수의 ChatGPT 계정을 차단했습니다.
OpenAI, 'Sponsored Discontent' 영향 작전 차단
OpenAI는 'Sponsored Discontent'라는 이름의 중국 영향 작전과 연계된 계정을 차단했습니다. 이 작전은 ChatGPT를 이용해 미국과 중국 반체제 인사에 대한 비판적 콘텐츠를 생성하고, 최종적으로 라틴아메리카 주류 언론에 장문 기사를 삽입했습니다.
OpenAI, AI를 이용한 DPRK 연계 사이버 위협 행위자 차단
OpenAI는 AI를 활용해 코딩 지원, 디버깅, 사회공학 연구를 수행한 VELVET CHOLLIMA와 STARDUST CHOLLIMA를 포함한 DPRK 연계 위협 행위자와 연결된 계정을 차단했습니다.
OpenAI, ChatGPT를 활용해 이란 영향력 네트워크를 차단
OpenAI는 이란과 연계된 영향력 작전인 STORM-2035와 IUVM이 다국어 및 다플랫폼에서 친이란·친하마스 콘텐츠를 생성하는 데 사용한 다섯 개의 ChatGPT 계정을 차단했습니다.
OpenAI가 가나 선거를 겨냥한 은밀한 영향 작전을 차단
OpenAI는 가나 대통령 선거 기간 동안 은밀한 영향 작전을 위해 DigitSol이라는 상업 기업이 사용한 ChatGPT 계정 클러스터를 차단했습니다. 이 계정들은 Bawumia를 지지하고 Mahama를 비판하는 콘텐츠를 생성했습니다.
OpenAI, AI 지원 작업 사기 네트워크 차단
OpenAI는 캄보디아 기반 네트워크가 AI 기반 번역 및 사회공학을 통해 '작업 사기'를 수행하기 위해 사용한 ChatGPT 계정 클러스터를 차단했습니다.
OpenAI, AI 지원 사기 고용 계획을 차단
OpenAI는 AI를 활용해 허위 채용 지원서를 만들고, 면접을 진행하며, 업무를 수행하는 사기 고용 계획에 사용된 수십 개의 계정을 차단했으며, 이는 북한 국가 차원의 노력에 귀속된 전술·기술·절차(TTP)와 일치합니다.
OpenAI 운영 피어 리뷰: AI 지원 감시 계획 방해
OpenAI는 중국에서 시작된 것으로 추정되는 ChatGPT 계정 클러스터를 차단했으며, 이들은 AI를 활용해 정치 행위자 연구, 시위 문서 분석, 감시 도구 개발을 지원했습니다.
OpenAI o3-mini 시스템 카드
OpenAI는 o3-mini 시스템 카드를 공개했으며, 대규모 강화 학습과 사고사슬(chain-of-thought) 추론이 모델이 최첨단 안전 성능을 달성하고 Preparedness Framework 하에서 Medium 위험 등급을 받을 수 있도록 하는 방법을 상세히 설명합니다.
OpenAI o3-mini 릴리스 노트 / 새로운 기능
OpenAI는 STEM에 최적화된 비용 효율적인 추론 모델인 o3-mini를 출시했으며, 수학, 코딩, 과학에서 o1과 비슷한 성능을 제공하면서 지연 시간이 낮고 개발자 기능이 확장되었습니다.
Hugging Face AI Tools for Art 뉴스레터 제1호
Hugging Face는 오픈 소스 크리에이티브 AI의 현황을 상세히 다루는 월간 뉴스레터를 출시했으며, 2024년 Diffusion Transformers로의 전환과 고품질 오픈 비디오 및 오디오 모델의 등장을 강조했습니다.
OpenAI와 미국 국립 연구소 파트너십
OpenAI는 미국 국립 연구소와 파트너십을 맺어 베나도 슈퍼컴퓨터에 추론 모델을 배포하여 과학 연구를 가속화하고 국가 안보를 강화하고 있습니다.
AWS에서 DeepSeek R1 모델을 배포하고 미세 조정하는 방법
Hugging Face는 Hugging Face Inference Endpoints, Amazon Bedrock Marketplace, Amazon SageMaker AI (GPU 및 Neuron 인스턴스), 그리고 Hugging Face Neuron Deep Learning AMI를 사용한 EC2 Neuron을 통해 AWS에서 DeepSeek R1 및 그 증류 변체들을 배포하고 미세 조정하는 방법을 보여줍니다.
Qwen2.5-Max 릴리스 노트
Qwen은 20조 개 이상의 토큰으로 사전 학습된 대규모 Mixture-of-Experts (MoE) 모델인 Qwen2.5-Max를 출시했으며, API와 Qwen Chat을 통해 이용할 수 있습니다.
Open-R1: DeepSeek-R1의 완전한 오픈 재생산
Hugging Face는 Open-R1 프로젝트를 출시하여 DeepSeek-R1의 데이터와 학습 파이프라인을 체계적으로 재구성하고, 오픈소스 커뮤니티에 추론 모델을 위한 누락된 데이터셋과 코드를 제공하려고 합니다.
Hugging Face 인퍼런스 프로바이더 통합
허깅 페이스는 fal, Replicate, SambaNova, 그리고 Together AI 네 가지 서버리스 인퍼런스 프로바이더를 허브에 직접 통합하여 통합된 모델 중심 서버리스 인퍼런스를 제공합니다.
Diffusers에서의 오픈 비디오 생성 모델 현황
Hugging Face는 오픈 비디오 생성 모델에 대한 포괄적인 개요를 제공하고, HunyuanVideo와 같은 모델의 VRAM 요구 사항을 60GB에서 약 6.5GB로 줄일 수 있는 Diffusers 최적화 스위트를 소개합니다.
Qwen2.5-1M 릴리스: 1M‑토큰 컨텍스트와 vLLM 기반 추론 프레임워크를 갖춘 오픈소스 7B 및 14B 모델
Qwen은 최대 1백만 토큰 컨텍스트를 지원하는 오픈소스 Qwen2.5‑7B‑Instruct‑1M 및 Qwen2.5‑14B‑Instruct‑1M 모델을 출시하며, 최적화된 vLLM 기반 추론 프레임워크를 함께 제공하여 사전 채우기 속도를 3배에서 7배 향상시키고 GPT‑4o‑mini와 comparable한 단문 작업 성능을 유지합니다.
Qwen2.5-VL 출시 노트
Qwen은 3B, 7B, 72B 크기로 제공되는 주력 비전-언어 모델인 Qwen2.5-VL을 출시했으며, 고급 시각 에이전트 기능, 장시간 비디오 이해, 구조화된 문서 파싱을 도입했습니다.
smolagents Vision 지원 업데이트
Hugging Face가 smolagents에 네이티브 비전 지원을 추가하여, 자율 웹 브라우징과 같은 작업에 시각 언어 모델(VLMs)을 에이전트 파이프라인에서 사용할 수 있게 되었습니다.
OpenAI Operator 연구 프리뷰
OpenAI는 양식 작성 및 식료품 주문과 같은 작업을 수행하기 위해 웹 브라우저를 독립적으로 탐색할 수 있는 Computer-Using Agent (CUA) 모델 기반의 AI 에이전트 연구 프리뷰인 Operator를 선보였습니다.
OpenAI Computer-Using Agent (CUA)와 Operator 연구 미리보기
OpenAI는 화면, 마우스, 키보드의 범용 인터페이스를 통해 GUI와 상호작용하여 디지털 작업을 수행할 수 있는 Computer-Using Agent (CUA) 모델을 소개했으며, 현재 Operator를 통해 연구 미리보기로 이용할 수 있습니다.
OpenAI Operator 시스템 카드
OpenAI는 사용자를 대신하여 작업을 수행하기 위해 GUI와 상호작용하는 Computer-Using Agent(CUA) 모델의 연구 미리보기인 Operator를 도입했으며, 다층 안전 프레임워크를 통해 프롬프트 주입 및 모델 오류와 같은 위험을 완화합니다.
NVIDIA KVPress: Long-Context LLM에서의 KV 캐시 압축을 위한 툴킷
NVIDIA는 메모리 사용량을 줄이고 장문 컨텍스트 Large Language Models의 디코딩 속도를 높이는 최신 KV 캐시 압축 기술을 구현한 Python 툴킷인 KVPress를 출시했습니다.
SmolVLM 256M 및 500M 릴리스 노트
Hugging Face가 대폭 줄어든 파라미터 크기 내에서도 강력한 멀티모달 성능을 유지하는 고효율 Vision Language Model인 SmolVLM-256M 및 SmolVLM-500M를 선보입니다.
Bertelsmann과 OpenAI의 기업용 AI 통합 파트너십
Bertelsmann은 전 세계 미디어, 서비스, 교육 브랜드 전반에 걸쳐 OpenAI 기술과 ChatGPT Enterprise를 통합하여 창의성, 생산성, 제품 개발을 대규모로 향상시키고 있습니다.
추론 시간 컴퓨팅을 통한 적대적 견고성 확보
OpenAI 연구에 따르면, o1-preview 및 o1-mini와 같은 추론 모델에서 추론 시간 컴퓨팅을 증가시키면 다양한 유형의 적대적 공격에 대한 견고성이 향상됩니다.
Hugging Face와 FriendliAI의 모델 배포 파트너십
Hugging Face는 FriendliAI의 추론 인프라를 Hugging Face Hub에 통합하여, 고성능 엔드포인트로 생성형 AI 모델을 원클릭 배포할 수 있게 했습니다.
OpenAI Stargate 인프라스트럭처 이니셔티브
OpenAI는 다음 세대 AI 시스템에 필요한 물리적 용량을 개발하기 위해 미국 기반 데이터 센터 인프라 기업과의 파트너십을 찾고 있습니다.
OpenAI가 The Stargate Project를 발표한다
OpenAI와 그 파트너들은 The Stargate Project를 출시했습니다. 이는 미국에서 대규모 AI 인프라를 구축하여 AGI 개발을 지원하기 위한 $500 billion 규모의 이니셔티브입니다.
Hugging Face Organization Blog Articles Feature
Hugging Face는 이제 Enterprise Hub를 구독하는 조직이 자신의 조직 프로필에 블로그 기사를 직접 게시할 수 있도록 지원합니다.
Qwen 글로벌-배치 로드 밸런스 MoE LLM 훈련
Qwen은 전체 글로벌 배치를 기준으로 균형을 계산함으로써 개별 마이크로 배치 대신 MoE 모델 성능을 향상시키고 전문가 특화를 가능하게 하는 글로벌-배치 로드 밸런스 손실을 도입합니다.
Hugging Face Text Generation Inference (TGI) 멀티 백엔드 지원
Hugging Face는 Text Generation Inference (TGI)에 멀티 백엔드 아키텍처를 도입하여, 사용자가 통합된 프론트엔드를 통해 다양한 실행 엔진(예: TensorRT-LLM 및 vLLM)을 이용해 LLM을 배포할 수 있도록 했습니다.
Hugging Face Transformers timm 통합
Hugging Face가 TimmWrapper를 도입하여 PyTorch Image Models (timm) 라이브러리의 모든 모델을 추론, 양자화 및 미세 조정을 위해 transformers 생태계 내에서 원활하게 사용할 수 있도록 했습니다.
OpenAI 뉴스 산업 파트너십 및 Axios 확장
OpenAI는 Axios와의 새로운 콘텐츠 파트너십을 발표하고 지역 뉴스에 대한 자금을 확대했으며, 거의 20개의 미디어 조직이 AI를 통합하여 생산을 간소화하고 사용자 참여를 강화하며 비즈니스 운영을 최적화하는 방법을 상세히 설명했습니다.
Sentence Transformers를 사용하여 400배 더 빠른 정적 임베딩 모델 학습하기
Hugging Face는 all-mpnet-base-v2와 같은 모델 품질의 최소 85%를 유지하면서 CPU에서 100배~400배 더 빠르게 실행되는 정적 임베딩 모델 학습 방법을 소개하며, 학습 스크립트 및 평가 결과와 함께 두 가지 모델(static-retrieval-mrl-en-v1 및 static-similarity-mrl-multilingual-v1)을 공개했습니다.
아데바요 오군레시가 OpenAI 이사회에 합류했습니다
아데바요 오군레시, 글로벌 인프라 파트너스(GIP) CEO이자 블랙록의 수석 전무이사가 OpenAI 스쿨에서 경영학 석사(M.B.A.)를 취득했습니다. - **기타 이사회 직책:** 블랙록, 탑골프 캘러웨이 브랜드, 코스모스 에너지 홀딩스, 터미널 인베스트먼트 리미티드의 이사회 멤버이며, 이전에 골드만 삭스 그룹의 리드 디렉터를 역임했습니다.
Qwen2.5-Math-PRM 및 ProcessBench 출시
Qwen은 수학 문제 해결에서 중간 추론 오류를 식별하도록 설계된 최첨단 프로세스 보상 모델인 Qwen2.5-Math-PRM-7B와 72B를 출시했으며, 새로운 단계 수준 평가 벤치마크인 ProcessBench도 함께 공개했습니다.
허깅 페이스 AI 에이전트 윤리 및 프레임워크 분석
허깅 페이스는 AI 에이전트를 이해하기 위한 포괄적인 프레임워크를 제공하며, 자율성이 높아질수록 위험이 증가한다고 주장하고 완전 자율 에이전트 개발에 반대한다.
Hugging Face가 vdr-2b-multi-v1 다국어 시각적 문서 검색 모델을 출시했습니다
Hugging Face는 OCR 없이 페이지 스크린샷을 밀집 벡터로 인코딩하여 복잡한 문서를 검색할 수 있게 하는 다국어 임베딩 모델인 vdr-2b-multi-v1을 도입했습니다.
Hugging Face Open LLM Leaderboard: CO₂ 배출량 및 모델 성능 분석
Hugging Face는 커뮤니티 파인튜닝 모델이 공식 출시물보다 탄소 효율성이 더 높다고 밝혔으며, 이는 간결성 증가와 지시 사항 준수 개선 때문이라고 설명했습니다.