5951

전이적 RL: 분할 정복을 통한 오프-폴리시 RL 확장

BAIR는 전이적 RL(TRL)을 소개합니다. 이는 시간 차이(TD) 학습을 제거하여 n단계 튜닝 없이 오프-폴리시 RL을 장거리 작업으로 확장하는 분할 정복 기반 가치 학습 알고리즘입니다.

5952

OpenAI가 미시간에 Stargate 인프라 확장

OpenAI는 미시간 세일린 타운십에 새로운 Stargate 캠퍼스를 발표했으며, 계획 용량을 8기가와트 이상으로 늘리고 총 투자액을 4500억 달러 이상으로 증가시켰습니다.

5953

OpenAI Aardvark: 에이전트형 보안 연구원

OpenAI는 Aardvark를 도입했습니다. 이는 GPT-5 기반의 자율 에이전트로, 대규모로 소프트웨어 취약점을 식별, 검증 및 패치하여 방어자에게 유리하도록 전환합니다.

5954

MiniMax M2 에이전트 정렬 및 일반화

MiniMax M2는 인터리브드 사고와 전체 경로 일반화를 구현하여 벤치마크 성능과 실제 세계 에이전트 사용성 사이의 격차를 해소합니다.

5955

OpenAI Atlas: AI 기반 브라우징을 위한 OWL 아키텍처

OpenAI는 OWL(OpenAI's Web Layer)을 도입했는데, 이는 Chromium 런타임을 메인 애플리케이션 프로세스로부터 분리하여 Atlas 브라우저에서 더 빠른 시작, 네이티브 UI 성능, 그리고 에이전트 기반 웹 기능을 가능하게 하는 새로운 브라우저 아키텍처입니다.

5956

Google DeepMind 수학을 위한 AI 이니셔티브

Google DeepMind과 Google.org가 AI for Math Initiative를 출시했으며, 이는 수학적 발견을 가속화하기 위해 다섯 개의 저명한 연구 기관과의 파트너십으로, Gemini Deep Think, AlphaEvolve, AlphaProof와 같은 AI 도구를 사용합니다.

5957

변화하는 글로벌 컴퓨팅 환경: 중국의 AI 하드웨어 및 소프트웨어 부상

Hugging Face는 미국 수출 통제가 역설적으로 중국의 국내 AI 칩 및 계산 효율적인 오픈 웨이트 모델 개발을 가속화하여 병렬 AI 인프라를 구축했다고 분석합니다.

5958

NVIDIA Isaac for Healthcare v0.4: 시뮬레이션에서 배포까지 헬스케어 로봇 구축

NVIDIA Isaac for Healthcare v0.4는 SO-ARM starter 워크플로를 사용하여 합성 시뮬레이션 데이터와 실제 세계 훈련을 결합한 자율 수술 어시스턴트를 구축하기 위한 엔드-투-엔드 워크플로를 도입합니다.

5959

OpenAI gpt-oss-safeguard 기술 보고서

OpenAI는 제공된 정책에 기반한 콘텐츠 분류를 위해 특별히 설계된 오픈 웨이트 추론 모델인 gpt-oss-safeguard-120b와 gpt-oss-safeguard-20b를 출시했습니다.

5960

gpt-oss-safeguard 릴리즈 노트 / 새로운 기능

OpenAI는 안전 분류 작업을 위한 오픈 웨이트 추론 모델 세트인 gpt-oss-safeguard를 출시했으며, 이를 통해 개발자는 추론 시 사용자 정의 정책을 적용할 수 있습니다.

5961

NVIDIA Isaac for Healthcare v0.4 출시

NVIDIA Isaac for Healthcare v0.4는 시뮬레이션에서 실제 세계 배포까지 엔드투엔드 AI 의료 로봇 개발을 가능하게 하는 개발자 프레임워크와 SO-ARM 스타터 워크플로를 도입합니다.

5962

다이 닛폰 프린팅(DNP) ChatGPT Enterprise 배포 결과

다이 닛폰 프린팅(DNP)은 dieci 핵심 부서에 ChatGPT Enterprise를 배포한 후 주간 활성 사용률 100%와 특허 연구 시간 95% 감소를 달성했습니다.

5963

IBM Granite 4.0 Nano 릴리스 노트

IBM은 에지 및 온-디바이스 애플리케이션을 위해 설계된 고성능 소형 언어 모델(SLM) 시리즈인 Granite 4.0 Nano를 Apache 2.0 라이선스 하에 출시했습니다.

5964

Doppel AI 방어 시스템: GPT-5와 o4-mini를 활용한 위협 탐지 자동화

Doppel은 OpenAI의 GPT-5와 o4-mini 모델을 활용한 AI 기반 방어 시스템을 배포하여 위장 사이트와 피싱 공격의 탐지 및 차단을 자동화하고, 응답 시간을 시간에서 분으로 단축했습니다.

5965

OpenAI 기업 재자본화 및 OpenAI Foundation 출시

OpenAI는 기업 재자본화를 완료하여, 영리 목적인 OpenAI Group PBC를 통제하는 비영리 단체인 OpenAI Foundation을 설립하여, AGI가 인류 전체에 이익이 되도록 보장했습니다.

5966

마이크로소프트와 오픈AI 파트너십 업데이트 2025

마이크로소프트와 오픈AI는 오픈AI를 공익법인(PBC)으로 전환하고 IP 권리, AGI 검증 및 컴퓨팅 계약을 업데이트하는 새로운 확정 계약을 체결했습니다.

5967

Hugging Face 음성 클로닝과 동의

Hugging Face는 음성 동의 게이트를 도입했는데, 이는 음성 클로닝 모델이 활성화되기 전에 말하는 사람이 녹음된 문구를 통해 명시적으로 동의를 밝히도록 요구하는 시스템 인프라입니다.

5968

OpenAI의 미국 AI 리더십 및 에너지 인프라 전략

OpenAI는 미국이 AI 분야에서 리더십을 유지하고 중국의 전자 갭을 피하기 위해 연간 100기가와트의 새로운 에너지 용량을 구축하는 국가 프로젝트를 옹호합니다.

5969

GPT-5 시스템 카드 추가문: 민감한 대화

OpenAI는 GPT-5를 업데이트하여 정서적 고통을 겪는 사용자를 더 잘 인식하고 지원하도록 하였으며, 170명 이상의 정신 건강 전문가와의 협력을 통해 비최적 응답을 65-80% 감소시켰습니다.

5970

OpenAI가 민감한 대화를 위한 ChatGPT 응답을 강화합니다

OpenAI가 ChatGPT의 기본 모델(GPT-5)을 업데이트하여 고통받는 사용자를 더 잘 인식하고 지원함으로써, 정신 건강, 자해, 감정적 의존 시나리오에서 원하지 않는 응답을 65%에서 80% 감소시켰습니다.

5971

huggingface_hub v1.0: 오픈 머신러닝의 기반을 다진 5년

huggingface_hub은 5년 후 v1.0에 도달했으며, 2백만 개 이상의 모델, 500k 데이터셋, 1M Spaces에 대한 핵심 접근을 제공하면서, 다음 10년을 위한 오픈 머신러닝을 지원하기 위해 httpx, hf_xet, 그리고 재설계된 CLI와 같은 중단 변경을 도입했습니다.

5972

허깅페이스 스트리밍 데이터셋 업데이트

허깅페이스는 데이터셋 라이브러리의 스트리밍 기능을 최적화하여 시작 요청을 100배 줄이고 데이터 해상도 속도를 10배 높여 로컬 다운로드 없이 멀티테라바이트 규모의 데이터셋에서 효율적인 학습을 가능하게 했습니다.

5973

Steuerrecht.com 사례 연구: ChatGPT Business를 활용한 법률 분석 확장

Steuerrecht.com은 ChatGPT Business를 사용하여 일상적인 법률 초안 작성, 연구 및 다국어 커뮤니케이션을 자동화하여 특정 작업을 며칠에서 분 단위로 단축하고 변호사당 주당 최대 10시간의 작업을 절감합니다.

5974

T5Gemma: 디코더 전용 적응을 통한 인코더-디코더 LLM

Google DeepMind은 사전 학습된 디코더 전용 Gemma 2 모델을 적응시켜 추론 효율성과 추론 성능을 향상시킨 인코더-디코더 모델 컬렉션인 T5Gemma를 소개합니다.

5975

MedGemma 및 MedSigLIP 릴리스 노트

Google DeepMind는 의료 및 생명 과학 AI 개발을 위해 고성능 및 프라이버시 보호 기반을 제공하도록 설계된 오픈 멀티모달 모델 컬렉션인 MedGemma와 MedSigLIP을 출시했습니다.

5976

Gemma 3n 릴리스 노트 / 새로운 기능

Google DeepMind은 중첩 MatFormer 아키텍처를 특징으로 하는 모바일 우선 멀티모달 모델 패밀리인 Gemma 3n을 출시했는데, 이는 탄력적 추론을 가능하게 하고 에지 디바이스에서 높은 성능을 제공합니다.

5977

Gemini 2.5 Flash-Lite 릴리스 노트

Google DeepMind은 Gemini 2.5 가족에서 가장 빠르고 비용 효율적인 모델인 Gemini 2.5 Flash-Lite의 안정 버전을 출시했으며, 1백만 토큰 컨텍스트 윈도우와 네이티브 추론 기능을 제공합니다.

5978

Google DeepMind Veo: ANCESTRA를 위한 실사 영화 제작에 생성 비디오 통합

Google DeepMind는 감독 Eliza McNitt와 Darren Aronofsky의 Primordial Soup와 협력하여 단편 영화 ANCESTRA를 제작했으며, Veo가 개인화된 생성 및 모션 매칭을 통해 생성 비디오와 실사 영상을 어떻게 결합할 수 있는지 보여줍니다.

5979

AlphaEarth Foundations: 전 세계 매핑을 위한 통합 지리공간 임베딩

Google DeepMind는 멀티모달 지구 관측 데이터를 페타바이트 단위로 통합 디지털 임베딩으로 결합하여 전 세계 매핑 및 환경 모니터링에 혁신을 가져올 AI 모델인 AlphaEarth Foundations를 발표했습니다.

5980

DeepMind Backstory 이미지 출처 및 신뢰성 검증을 위한 실험적 도구

Google DeepMind는 Gemini 모델을 활용해 이미지의 AI 생성 여부, 출처, 변형 및 변화하는 맥락을 밝혀 사용자들이 신뢰성을 평가하도록 돕는 실험적 AI 도구인 Backstory를 발표했습니다.

5981

Gemini Deep Think가 IMO 2025에서 금메달 기준을 달성했습니다

Deep Think를 탑재한 Gemini의 고급 버전이 국제수학올림피아드(IMO) 6문제 중 5문제를 해결하여 35점을 획득하고 금메달 기준을 달성했습니다.

5982

Google DeepMind Aeneas: 고대 비문을 맥락화하는 AI

Google DeepMind는 다중모달 분석과 평행 텍스트 검색을 통해 파편화된 라틴 비문을 해석하고, 귀속하며, 복원하도록 돕는 최초의 AI 모델인 Aeneas를 소개했습니다.

5983

Genie 3 실시간 세계 모델 출시

Genie 3은 DeepMind의 새로운 실시간 세계 모델로, 24 fps, 720p 인터랙티브 환경을 생성하고 몇 분 동안 일관성을 유지해 고급 구현형 에이전트 연구를 가능하게 합니다.

5984

Google DeepMind Perch 업데이트: 멸종 위기 종을 위한 생물음향학 발전

Google DeepMind는 새 종 예측을 개선하고 포유류, 양서류 및 산호초와 같은 수중 환경까지 생물음향 분석을 확장하는 업데이트된 오픈소스 Perch 모델을 출시했습니다.

5985

Google DeepMind Deep Loop Shaping을 LIGO 중력파 관측소에 적용

Google DeepMind는 Deep Loop Shaping이라는 AI 방법을 도입했으며, 이는 LIGO의 피드백 시스템에서 제어 노이즈를 30배에서 100배까지 감소시켜 중력파를 보다 정밀하게 탐지할 수 있게 합니다.

5986

Gemini 2.5 Deep Think ICPC 월드 파이널 성능

Gemini 2.5 Deep Think의 고급 버전이 2025년 국제 대학생 프로그래밍 대회 (ICPC) 월드 파이널에서 금메달 수준의 성능을 달성했으며, 12개의 복잡한 알고리즘 문제 중 10개를 해결했습니다.

5987

Google DeepMind, AI를 활용해 새로운 유체 역학 특이점 발견

Google DeepMind는 물리 기반 신경망(PINNs)을 활용한 새로운 AI 방법을 개발하여 유체 역학 방정식에서 새로운 불안정 특이점 군을 발견했으며, 이는 오랜 수학적 난제 해결의 길을 제시합니다.

5988

LeRobot v0.4.0 릴리즈 노트 / 새로운 내용

Hugging Face가 LeRobot v0.4.0을 출시했으며, 확장 가능한 Datasets v3.0, PI0.5 및 GR00T N1.5와 같은 VLA 모델, 그리고 하드웨어 통합을 간소화하는 플러그인 시스템을 도입했습니다.

5989

Google DeepMind Frontier Safety Framework 업데이트

Google DeepMind는 Frontier Safety Framework(FSF)의 세 번째 버전을 발표했으며, 해로운 조작 및 정렬 불일치 AI에 대한 새로운 위험 영역을 도입하고, 조기 위험 탐지를 위해 Tracked Capability Levels(TCLs)를 추가했습니다.

5990

Gemini Robotics 1.5 및 Gemini Robotics-ER 1.5 릴리스

Google DeepMind는 고수준 구현 추론과 직접적인 시각-언어-액션 제어를 결합한 Gemini Robotics 1.5와 Gemini Robotics-ER 1.5 모델을 소개했습니다. 이를 통해 로봇은 복잡하고 다단계의 물리적 작업을 수행할 수 있습니다.

5991

Google DeepMind CodeMender AI 에이전트: 코드 보안

Google DeepMind는 CodeMender라는 AI 기반 에이전트를 도입했으며, 이 에이전트는 오픈소스 프로젝트에서 소프트웨어 취약점을 자동으로 식별하고 패치하며, 사전에 보안을 강화합니다.

5992

Google DeepMind와 Commonwealth Fusion Systems의 융합 에너지 파트너십

Google DeepMind는 Commonwealth Fusion Systems와 협력하여 AI, 강화 학습 및 TORAX 시뮬레이터를 적용함으로써 SPARC 토카막에서 순융합 에너지 달성을 가속화하고 있습니다.

5993

Gemini 2.5 Deep Think 릴리스

Google DeepMind는 Google AI Ultra 구독자를 위해 Gemini 앱에 Deep Think를 출시했으며, 코딩, 과학 및 수학 분야의 복잡한 문제 해결을 강화하기 위해 병렬 사고 기법을 도입했습니다.

5994

Google DeepMind와 Kaggle, AI 평가를 위한 Game Arena 출시

Google DeepMind와 Kaggle이 전략 게임에서의 정면 대결을 통해 AI 모델을 평가하는 오픈소스 플랫폼인 Game Arena를 도입하여 일반적인 문제 해결 능력을 검증 가능한 방식으로 측정합니다.

5995

OpenAI, Sky를 ChatGPT에 통합하기 위해 Software Applications Incorporated 인수

OpenAI는 Sky의 제작사인 Software Applications Incorporated를 인수하여 macOS와의 깊은 통합 및 자연어 인터페이스를 ChatGPT에 통합했습니다.

5996

Consensus Scholar Agent: GPT-5와 Responses API를 활용한 연구 자동화

Consensus는 GPT-5와 Responses API를 기반으로 하는 다중 에이전트 시스템인 Scholar Agent를 출시했으며, 2억 2천만 편의 논문에 대한 동료 검토 문헌의 합성을 자동화합니다.

5997

Hugging Face와 Meta가 에이전트 환경을 위한 OpenEnv를 소개합니다

Hugging Face와 Meta가 OpenEnv 및 OpenEnv Hub를 출시했습니다. 이는 교육 및 배포에 사용되는 안전하고 샌드박스된 에이전트 환경을 위한 표준화된 오픈 커뮤니티 허브입니다.

5998

OpenAI, ChatGPT Business, Enterprise 및 Edu용 Company Knowledge 도입

OpenAI는 ChatGPT Business, Enterprise 및 Edu용 Company Knowledge를 출시하여, 사용자가 Slack 및 Google Drive와 같은 내부 도구를 GPT‑5 모델을 통해 인용과 함께 조회할 수 있게 하면서 데이터는 비공개로 유지합니다.

5999

OpenAI 한국 경제 청사진

OpenAI는 한국을 위한 경제 청사진을 발표했으며, 주권 AI 역량과 전략적 최첨단 AI 파트너십을 결합하는 이중 트랙 전략을 제안하여 국가 생산성을 촉진합니다.

6000

OpenAI 영국 주권 AI 업데이트

OpenAI는 영국 법무부와 새로운 계약을 체결하여 2,500명의 공무원에게 ChatGPT Enterprise를 제공하고, API, Enterprise 및 Edu 고객을 위한 영국 데이터 거주 옵션을 도입했습니다.