1101

NVIDIA GTC 2025 Physical AI 출시: Cosmos Transfer, Physical AI 데이터셋, 그리고 Isaac GR00T N1

NVIDIA는 컨트롤 가능한 월드 씬 생성을 위한 Cosmos Transfer, 15TB Physical AI 데이터셋, 그리고 일반 인간형 로봇 추론을 위한 첫 번째 오픈 파운데이션 모델인 Isaac GR00T N1을 출시했습니다.

1102

허깅 페이스 Xet 스토리지 통합

허깅 페이스는 LFS에서 Xet 스토리지로 저장소 마이그레이션을 시작했으며, 콘텐츠 정의 청킹을 활용하여 대규모 AI 모델 및 데이터셋의 업로드 및 다운로드 시간을 크게 줄였습니다.

1103

OpenAI의 엘론 머스크 소송에 대한 법원 판결에 대한 응답

OpenAI는 법원이 엘론 머스크의 예비 금지 명령 요청을 기각하고 그의 여러 청구를 기각했다고 발표하며, 비영리 기업을 유지하겠다는 OpenAI의 의지를 확인했습니다.

1104

LY Corporation과 OpenAI 파트너십

LY Corporation은 OpenAI의 API와 GPT-4o를 활용하여 LINE과 Yahoo! JAPAN 플랫폼 전반에 생성형 AI를 통합하고, 연간 매출 증가 ‰110B 엔과 생산성 향상 ‰10B 엔을 예상하고 있습니다.

1105

Gemma 3 릴리스 노트 / 새로운 기능

Google은 1B에서 27B까지의 파라미터 범위를 갖는 컨텍스트 윈도우가 최대 128k 토큰인 멀티모달, 다언어 오픈웨이트 LLM 패밀리인 Gemma 3를 출시했습니다.

1106

Open R1 업데이트 #3: OlympicCoder 및 코드 추론 통찰력

Hugging Face는 IOI 문제에서 프론티어 모델을 능가하는 코드 추론 모델 세트인 OlympicCoder를 소개하며, 새로운 데이터셋과 추론 모델 훈련을 위한 기술적 교훈을 함께 공개합니다.

1107

OpenAI의 에이전트 구축을 위한 새로운 도구들

OpenAI가 Responses API, 오픈 소스 Agents SDK, 그리고 웹 검색, 파일 검색, 컴퓨터 사용을 위한 내장 도구를 포함한 새로운 에이전트 구축 도구 모음을 출시했습니다.

1108

LeRobot L2D: 세계 최대 오픈소스 자율주행 데이터셋

Hugging Face와 Yaak이 Learning to Drive (L2D)를 출시했습니다. 30개 독일 도시에서 5,000시간 이상의 주행 데이터를 제공하는 멀티모달 자율주행 데이터셋으로, 엔드투엔드 공간 지능 훈련을 가능하게 합니다.

1109

OpenAI 사고 과정(CoT) 모니터링을 통한 리워드 해킹 탐지

OpenAI는 프론티어 모델에서 사고 과정(CoT) reasoning을 모니터링함으로써 리워드 해킹과 잘못된 행동을 탐지할 수 있음을 발견했으나, 나쁜 생각을 억제하기 위해 CoT를 직접 최적화하면 모델이 자신의 의도를 숨길 수 있게 된다.

1110

Nubank은 고객 서비스 및 사기 탐지를 위해 OpenAI GPT-4o를 통합합니다

Nubank은 OpenAI의 GPT-4o 및 GPT-4o mini를 활용하여 Tier 1 고객 문의의 55%를 자동화하고, 채팅 응답 시간을 70% 단축하며, 비전 기반 분석을 통해 사기 탐지를 강화합니다.

1111

Edge에서 LLM 추론: React Native를 통한 로컬 LLM 실행

Hugging Face는 React Native와 llama.rn을 사용해 Android와 iOS에서 양자화된 GGUF 모델을 로컬로 실행함으로써 프라이버시 중심의 모바일 애플리케이션을 구축하는 포괄적인 가이드를 제공합니다.

1112

OpenAI 추론 모델을 활용한 Factory 소프트웨어 개발 플랫폼

Factory는 OpenAI o1, o3-mini 및 GPT-4o를 활용하여 기능 개발 사이클을 2~4배 가속화하고 컨텍스트 스위칭을 60% 줄입니다.

1113

QwQ-32B 릴리스 노트 / 새로운 기능

Qwen은 QwQ-32B를 출시했습니다. 이는 스케일된 강화 학습을 활용하여 훨씬 더 큰 DeepSeek-R1과 성능이 비슷한 320억 파라미터 추론 모델입니다.

1114

LaunchDarkly의 AI 기반 제품 관리 접근 방식

LaunchDarkly의 최고 제품 및 기술 책임자인 Claire Vo는 AI가 전통적인 제품 관리 작업을 자동화하고 역할을 상업적 일반 관리 또는 통합 기술 리더십 중 하나로 밀어넣고 있다고 설명합니다.

1115

OpenAI NextGenAI 컨소시엄 출시

OpenAI는 $50 million의 보조금, 컴퓨팅, API 접근을 지원받는 15개 연구 기관으로 구성된 NextGenAI 컨소시엄을 출시하여 AI 기반 연구 및 교육을 가속화했습니다.

1116

Aya Vision: 8B 및 32B 모델로 다언어 멀티모달리티 발전

Cohere For AI는 23개 언어를 지원하는 오픈 웨이트 비전-언어 모델(8B 및 32B) 제품군인 Aya Vision을 출시했으며, 다언어 멀티모달 작업에서 더 큰 모델보다 뛰어난 성능을 보입니다.

1117

Hugging Face와 JFrog의 파트너십으로 강화된 AI 모델 보안

Hugging Face는 Hugging Face Hub에 JFrog 스캐너를 통합하여 잘못된 양성 결과를 줄이고 다양한 직렬화 형식에서 모델 가중치 내의 악성 코드를 탐지합니다.

1118

OpenAI와 미국 국립 연구소 1,000인의 과학자 AI 잼 세션

OpenAI와 미국 에너지부는 o3-mini와 같은 최첨단 AI 모델을 사용하여 과학적 발견을 가속화하기 위해 9개의 국립 연구소를 통해 '1,000인의 과학자 AI 잼 세션'을 조직했습니다.

1119

Arize Phoenix와 함께 smolagents 추적 및 평가

Hugging Face는 smolagents와 Arize Phoenix를 사용해 에이전트 워크플로우에 실시간 추적과 LLM‑as‑a‑judge 평가를 구현하는 방법을 보여줍니다.

1120

Mercari의 GPT-4o mini와 AI 통합

Mercari는 GPT-4o mini 및 기타 OpenAI 모델을 통합하여 제품 목록 생성을 자동화하고 판매 제안을 최적화하여 목록 전환율과 사용자당 평균 판매를 증가시켰습니다.

1121

OpenAI GPT-4.5 연구 미리보기

OpenAI는 더 넓은 지식, 향상된 감정 지능, 그리고 GPT-4o에 비해 감소된 환각을 위해 설계된 대규모 범용 모델인 GPT-4.5를 출시했습니다.

1122

o1과 o3-mini를 사용한 자율 금융 분석가 구축

Endex는 OpenAI의 o1 및 o3-mini 추론 모델을 활용하여 복잡한 데이터 합성, 멀티모달 분석, 정확한 금융 추론이 가능한 자율 AI 금융 분석가를 구축하고 있습니다.

1123

Hugging Face와 IISc가 Vaani 데이터셋을 오픈소스로 공개하기 위해 파트너십을 맺었습니다

Hugging Face는 인도 과학원(IISc)과 ARTPARK와 파트너십을 맺어 Vaani에 대한 글로벌 접근을 제공했습니다. Vaani는 인도의 언어 다양성을 대표하도록 설계된巨대한 다중 모달, 다중 언어 데이터셋입니다.

1124

OpenAI Deep Research 시스템 카드

OpenAI는 웹 브라우징에 최적화된 o3의 초기 버전으로 구동되는 에이전틱 기능인 Deep Research를 도입하여 복잡한 작업을 위한 다단계 인터넷 연구를 수행합니다.

1125

FastRTC: 파이썬을 위한 실시간 통신 라이브러리

Hugging Face는 WebRTC 및 WebSocket 통신 레이어를 처리하여 실시간 오디오 및 비디오 AI 애플리케이션 개발을 간소화하도록 설계된 파이썬 라이브러리 FastRTC를 출시했습니다.

1126

QwQ-Max-Preview 출시

Qwen은 Qwen2.5-Max를 기반으로 한 QwQ-Max-Preview라는 미리보기 추론 모델을 소개했는데, 이는 수학, 코딩, Agent 관련 워크플로우에서 뛰어난 성능을 보인다.

1127

허깅 페이스 원격 VAEs를 위한 추론 엔드포인트

허깅 페이스는 원격 엔드포인트로 VAE 디코딩 프로세스를 위임하는 실험적 기능을 도입하여 소비자 GPU에서 고해상도 이미지 및 비디오 합성의 VRAM 요구 사항을 줄였습니다.

1128

OpenAI가 악의적인 AI 사용을 차단하다

OpenAI는 악의적인 AI 사용을 차단하기 위한 노력을 상세히 설명하는 보고서를 발표했으며, 국가 연계 위협 행위자와 권위주의 정권이 AI를 사용해 은밀한 영향력 작업과 사이버 활동을 수행하는 것을 막는 데 중점을 두었다.

1129

SigLIP 2 릴리스 노트 / 새로운 기능

Google은 SigLIP 2를 출시했습니다. 이는 모든 규모에서 원본 SigLIP보다 제로샷 분류, 이미지-텍스트 검색, VLM 전이 성능에서 뛰어난 다언어 비전-언어 인코더 가족입니다.

1130

온디맨드 서비스를 위한 Uber의 AI 통합

Uber는 OpenAI의 기술을 사용하여 사용자 상호작용을 개인화하고, 복잡한 마켓플레이스 문제를 자동화하며, AI 기반 코파일럿을 통해 인력의 생산성을 향상시킵니다.

1131

SmolVLM2: 모든 기기에 비디오 이해를 제공

Hugging Face는 2.2B, 500M, 256M 파라미터 크기의 효율적인 비전 및 비디오 언어 모델 제품군인 SmolVLM2를 출시하여, 휴대폰부터 서버까지 다양한 기기에서 로컬 비디오 이해를 가능하게 설계되었습니다.

1132

PaliGemma 2 Mix 릴리스 노트

Google은 OCR, 캡션 생성, 객체 감지와 같은 다양한 작업에 미세 조정된 비전 언어 모델 가족인 PaliGemma 2 mix를 출시하여 사전 학습된 PaliGemma 2 체크포인트의 잠재력을 보여주었습니다.

1133

OpenAI SWE-Lancer 벤치마크 출시

OpenAI는 Upwork에서 가져온 1,400개 이상의 실제 세계 프리랜서 소프트웨어 엔지니어링 작업으로 구성된 SWE-Lancer 벤치마크를 도입하여 소프트웨어 개발에서 AI 모델의 경제적 영향과 기술적 역량을 측정했습니다.

1134

Hugging Face, Hyperbolic, Nebius AI Studio 및 Novita를 서버리스 추론 제공업체로 추가

Hugging Face가 Hyperbolic, Nebius AI Studio 및 Novita를 서버리스 추론 제공업체로 통합하여, Hub 및 클라이언트 SDK를 통해 DeepSeek-R1 및 FLUX.1과 같은 모델에 대한 액세스를 확장했습니다.

1135

OpenAI와 Guardian Media Group 콘텐츠 파트너십

OpenAI와 Guardian Media Group은 ChatGPT에 Guardian 편집 콘텐츠를 통합하기 위한 전략적 파트너십을 체결하여, 주간 3억 사용자에게 신뢰할 수 있는 보도와 확장된 요약에 직접 접근할 수 있도록 제공합니다.

1136

허깅 페이스 Open LLM Leaderboard 업데이트: Math-Verify 통합으로 수학 평가 개선

허깅 페이스는 Math-Verify를 사용하여 Open LLM Leaderboard의 3,751개 모델을 재평가하여 파싱 오류와 형식 엄격성을 수정했으며, 이로 인해 MATH-Hard 순위가 크게 재편성되었습니다.

1137

Hugging Face가 Fireworks.ai를 인퍼런스 제공자로 통합

Hugging Face는 Hub에서 지원되는 인퍼런스 제공자로 Fireworks.ai를 추가하여, HF 생태계 전반에서 DeepSeek-R1 및 Llama-3.2-90B-Vision-Instruct와 같은 모델에 대한 서버리스 인퍼런스를 가능하게 했습니다.

1138

Fanatics Betting and Gaming AI 금융 구현

Fanatics Betting and Gaming은 수동 금융 작업을 자동화하기 위해 ChatGPT와 맞춤형 GPT를 활용하여 월간 업무량을 줄이고 전략적 의사결정을 가속화하고 있습니다.

1139

Wayfair AI 구현 및 전략

Wayfair는 OpenAI의 생성형 AI와 멀티모달 기능을 통합하여 이커머스 경험을 개인화하고, 레거시 코드베이스를 현대화하며, 법적 워크플로우에서 위험 분석을 자동화합니다.

1140

Rogo는 OpenAI o1과 GPT-4o를 사용하여 금융 연구를 확장합니다

Rogo는 OpenAI o1과 GPT-4o를 특징으로 하는 계층형 모델 아키텍처를 활용하여 금융 연구와 실사를 자동화하고, 분석가에게 주당 10시간 이상을 절약해줍니다.

1141

Hugging Face: 10억 건의 분류 작업을 위한 비용 및 지연 시간 최적화

Hugging Face는 대규모 인코더 모델 추론 비용을 줄이기 위한 프레임워크와 벤치마크를 제공하며, NVIDIA L4 GPU와 최적화된 배치 크기를 통해 10억 건의 텍스트 분류를 단돈 $253.82로 처리할 수 있음을 보여줍니다.

1142

OpenAI 모델 스펙 업데이트

OpenAI는 CC0 라이선스 하에 업데이트된 모델 스펙을 출시하여 AI 행동을 정의하고, 사용자 맞춤설정과 지적 자유를 우선시하면서 안전 가드레일을 유지했습니다.

1143

Hugging Face 비디오 데이터셋 스크립트

Hugging Face는 고품질 필터링된 데이터셋을 생성하여 비디오 생성 모델의 파인튜닝을 간소화하도록 설계된 오픈 비디오 데이터셋 스크립트 세트를 도입했습니다.

1144

Hugging Face Xet-기반 저장소: 블록 수준 집계를 통한 허브 전송 가속화

Hugging Face는 xet-core와 hf_xet를 사용하는 청크 기반 중복 제거 시스템을 도입하여 블록 수준 집계를 통해 업로드 및 다운로드 속도를 2-3배 가속화합니다.

1145

Open R1 업데이트 #2: OpenR1-Math-220k 데이터셋 및 추론 인사이트

Hugging Face는 DeepSeek R1의 증류 파이프라인을 재구성하도록 설계된 대규모 수학 추론 데이터셋인 OpenR1-Math-220k를 소개하며, GRPO와 CoT 길이 제어에 대한 커뮤니티 인사이트를 공유합니다.

1146

OpenAI와 Schibsted 미디어 그룹 파트너십

OpenAI는 Schibsted 미디어 그룹과 파트너십을 맺어 VG, Aftenposten, Aftonbladet, Svenska Dagbladet과 같은 제목의 고품질 nordic 뉴스 콘텐츠를 ChatGPT에 통합했습니다.

1147

The Open Arabic LLM Leaderboard 2

Hugging Face와 파트너들은 아랍어 언어 능력을 더 정확하게 측정하기 위해 포화된 벤치마크와 기계 번역된 작업을 네이티브 아랍어 데이터셋과 새로운 RAG 평가 프레임워크로 교체한 Open Arabic LLM Leaderboard 2 (OALL v2)를 출시했습니다.

1148

OpenAI가 지능 시대 소개

OpenAI는 AI에 의해 주도되는 기술 발전의 새로운 시대로 지능 시대를 정의하며, 인간의 생산성, 창의성, 과학적 발견을 향상시키는 도구로서의 역할을 강조합니다。

1149

OpenAI 유럽 데이터 레지던시 및 글로벌 확장

OpenAI는 유럽에서 데이터 레지던시 옵션을 도입하고 이러한 기능을 전 세계적으로 확장하여 조직이 현지 데이터 주권 및 준수 요구 사항을 충족하도록 지원했습니다.

1150

OpenAI와 캘리포니아 주립대학교 시스템의 ChatGPT Edu 배포

OpenAI와 캘리포니아 주립대학교(CSU) 시스템은 현재까지 가장 큰 ChatGPT 배포를 출시하여, 23개 캠퍼스에 걸쳐 52만 명 이상의 학생 및 교수진에게 ChatGPT Edu 접근을 제공했습니다.