Gemini Omni Flash 출시
Google DeepMind은 텍스트, 이미지, 오디오, 비디오 입력의 조합으로부터 고품질 비디오를 생성하고 편집할 수 있는 네이티브 멀티모달 모델인 Gemini Omni Flash를 도입했습니다.
Google Antigravity 2.0 발표
Google DeepMind은 Google Antigravity 2.0を発表했으나, 제공된 소스 자료는 리다이렉트 통지뿐이며 기술적인 세부 사항이 포함되어 있지 않습니다.
Gemini for Science: 과학적 발견을 위한 AI 도구
Google DeepMind은 가설 생성, 계산적 발견, 문헌 합성을 통해 과학적 방법을 가속화하도록 설계된 AI 도구 및 실험 모음인 Gemini for Science를 도입했습니다.
Google DeepMind 콘텐츠 투명성 및 검증 도구 업데이트
Google DeepMind은 Search, Gemini, Chrome, Pixel 전반에 걸쳐 SynthID 워터마킹 및 C2PA 콘텐츠 자격 증명을 확장하여 사용자가 AI 생성 콘텐츠와 진정한 카메라 촬영 콘텐츠를 식별하도록 돕고 있습니다.
Google DeepMind와 싱가포르 국가 AI 파트너십
Google DeepMind는 싱가포르 정부와 파트너십을 맺고 헬스케어, 교육 및 지속 가능성 전반에 걸쳐 프론티어 AI를 배포하여 2040년까지 33억 싱가포르 달러의 경제 가치를 창출할 잠재력을 가지고 있습니다.
Google DeepMind Co-Scientist 감염병 연구
케임브리지 대학교의 Clare Bryant 교수는 Google DeepMind의 Co-Scientist를 사용하여 동물원성 병원체의 분자 스위치를 식별하고, 정밀한 아미노산 표적 식별 시간을 년에서 월로 단축하고 있습니다.
노화 연구의 새로운 길을 열다 – Google DeepMind와 Calico, Co‑Scientist를 사용하여 가설 생성
Google DeepMind는 Calico Life Sciences가 자사의 Co‑Scientist 멀티 에이전트 AI 시스템을 사용하여 노화 과정에서의 통합 스트레스 반응에 관한 새로운 가설을 생성하고 테스트했으며, 이를 통해 AI가 어떻게 생물 의학적 발견을 가속화할 수 있는지 보여주었다고 발표했습니다.
Google DeepMind Co-Scientist 간질환 연구 가속화
Google DeepMind의 Co-Scientist AI 시스템은 에든버러 대학교 연구자들이 MASH 간질환에서 핵심 분자 다리인 NLRP3 인플라마솜을 식별하도록 도와 잠재적인 이중 치료의 발견을 가능하게 했습니다.
Google DeepMind Co-Scientist for ALS 연구
Google DeepMind의 Co-Scientist AI 에이전트는 MIT와 Boston Children’s Hospital 간의 다학제 협업을 촉진하여 ALS의 새로운 RNA 기반 메커니즘 및 치료제 발견을 지원하고 있습니다.
Google DeepMind Co-Scientist를 이용한 간 섬유증 약물 재활용
Google DeepMind의 Co-Scientist AI를 스탠포드 연구진이 간 섬유증에 대한 재활용 약물을 식별하는 데 사용했으며, 흉터 형성을 차단하고 세포 재생을 촉진하는 후보 물질을 성공적으로 발견했습니다.
Google DeepMind WeatherNext: 허리케인 강도 및 경로 예측 개선
Google DeepMind의 WeatherNext AI 모델은 국립 허리케인 센터가 멜리사 허리케인의 카테고리 5 등급 상륙을 자메이카에서 5일 전에 예측하도록 도와주었으며, 급속 강화 예측에서 역사적인 이정표를 세웠습니다.
OpenAI와 몰타 파트너십: 모든 시민을 위한 ChatGPT Plus
OpenAI와 몰타 정부는 전문 AI 리터러시 과정을 이수한 모든 몰타 시민에게 무료 1년 ChatGPT Plus 접근을 제공하기 위해 파트너십을 체결했습니다.
Gemini 3.5 Flash 릴리스 노트 / 새로운 기능
Google DeepMind는 에이전트 기반 워크플로와 코딩에 최적화된 Gemini 3.5 Flash 모델을 출시했으며, 이는 다른 최첨단 모델에 비해 출력 속도가 4배 빠른 최첨단 수준의 지능을 제공합니다.
비즈니스 운영 팀이 ChatGPT Work를 사용하는 방법
OpenAI는 비즈니스 운영 팀이 파편화된 데이터를 의사 결정이 가능한 브리프와 전략 모델로 통합할 수 있는 도구로서 ChatGPT Work를 소개합니다.
Databricks가 기업 에이전트 워크플로우에 GPT-5.5를 통합합니다
Databricks는 기업 에이전트 워크플로우에 GPT-5.5를 통합하여 복잡한 문서 작업에 대한 OfficeQA Pro 벤치마크에서 새로운 최첨단 성능을 달성했습니다.
ChatGPT 개인 금융 체험 출시
OpenAI는 ChatGPT에 새로운 개인 금융 체험을 도입하여 사용자가 안전하게 금융 계정을 연결하고 AI 기반의 현실적인 예산 책정 및 재무 계획을 할 수 있도록 했습니다.
Sea Limited의 에이전트 기반 소프트웨어 개발을 위한 Codex 도입
Sea Limited는 엔지니어링 팀을 수동 코딩에서 시스템 오케스트레이션으로 전환하기 위해 Codex를 통합하고 있으며, 개발자들 사이에서 87%의 주간 활성 사용률을 기록하고 있습니다.
Granite Embedding 다국어 R2 릴리스: 32K 컨텍스트를 지원하는 오픈 Apache 2.0 다국어 임베딩
IBM Granite은 Apache 2.0 라이선스의 두 가지 다국어 임베딩 모델—granite-embedding-97m-multilingual-r2(97M)와 granite-embedding-311m-multilingual-r2(311M)—을 출시했으며, 32K 토큰 컨텍스트, 200개 이상 언어 지원, 그리고 서브‑100M 규모 모델 중 최고 검색 점수를 제공합니다.
OpenAI Codex 모바일 통합 및 엔터프라이즈 업데이트
OpenAI는 Codex를 ChatGPT 모바일 앱에 통합하여 사용자가 노트북과 원격 환경 전반에서 긴 실행 에이전트 작업을 휴대폰에서 관리할 수 있도록 했습니다.
VeRL-Omni: Diffusion 및 Omni-Modality 모델을 위한 RL 학습 프레임워크
vLLM은 diffusion 및 omni-modality 아키텍처를 포함하여 멀티모달 생성 모델을 위해 특별히 설계된 범용 강화 학습 사후 학습 프레임워크인 VeRL-Omni의 프리릴리스를 발표했습니다.
vLLM Elastic Expert Parallelism
vLLM은 서버 재시작 없이 런타임에 Mixture-of-Experts (MoE) 배포의 워커 수를 늘리거나 줄일 수 있는 Elastic Expert Parallelism (Elastic EP)을 도입했습니다.
OpenAI, 민감한 대화에서 맥락 인식을 개선하기 위해 ChatGPT 안전 업데이트
OpenAI는 ChatGPT에 안전 업데이트를 적용하여 모델이 단일 및 다중 대화 전반에 걸쳐 진화하는 위험 신호와 해로운 의도를 더 잘 인식하도록 했으며, 특히 자살, 자해 및 타인에게 해를 끼치는 상황에 초점을 맞추었습니다.
연속 배치에서 비동기성 활용하기
Hugging Face는 CUDA 스트림과 이벤트를 사용하여 연속 배치에서 CPU와 GPU 작업을 겹치게 하는 방법을 보여주며, 8B 모델이 8K 토큰을 생성할 때 LLM 추론 시간을 약 22% 단축합니다.
Codex를 Windows에서 사용할 수 있도록 안전하고 효과적인 샌드박스 구축
OpenAI는 Windows용 Codex를 위해 맞춤형 샌드박스를 구현하여, 코딩 에이전트가 매 명령마다 지속적인 사용자 승인을 요구하지 않고도 안전하고 제한된 실행을 할 수 있도록 했습니다.
OpenAI의 TanStack npm 공급망 공격 대응
OpenAI는 Mini Shai-Hulud 캠페인의 일환으로 TanStack npm 라이브러리를 노린 공급망 공격에 대응했으며, 사용자 데이터 침해 증거는 없지만 macOS, iOS, Windows, Android 앱의 코드 서명 인증서를 교체했습니다.
재무 팀이 ChatGPT Work를 사용하는 방법 – OpenAI Academy 가이드
OpenAI Academy 기사에서는 재무 팀이 ChatGPT Work를 사용해 기존 재무 입력을 코드 작성 없이 보고, 계획 및 변동 분석을 위한 검토 준비가 된 자산으로 전환하는 방법을 보여줍니다.
Google DeepMind Co-Scientist: 과학적 가설 생성을 위한 다중 에이전트 AI 시스템
Google DeepMind는 Gemini 기반의 다중 에이전트 AI 파트너인 Co-Scientist를 도입했으며, 이 시스템은 새로운 과학적 가설을 반복적으로 생성, 토론 및 진화시켜 생명과학 및 공학 연구를 가속화합니다.
OpenAI 파라미터 골프: AI 지원 ML 연구에 대한 인사이트
OpenAI의 파라미터 골프 챌린지는 AI 코딩 에이전트가 실험 장벽을 낮추고, 매우 제한된 최적화 문제를 통해 뛰어난 ML 인재를 발굴한다는 점을 보여주었습니다.
AutoScout24, OpenAI AI 기반 워크플로우로 엔지니어링 규모 확대
AutoScout24 그룹은 ChatGPT와 Codex를 통합하여 개발 기간을 주 단위에서 일 단위로 단축하고 차량 마켓플레이스 플랫폼 전반에 걸쳐 엔지니어링 처리량을 증가시켰습니다.
NVIDIA가 OpenAI Codex와 GPT-5.5를 활용하는 방법
NVIDIA 엔지니어와 연구원들은 GPT-5.5 기반 Codex를 GB200 및 GB300 인프라에서 실행하여 복잡한 엔지니어링 작업과 엔드‑투‑엔드 머신러닝 연구 워크플로를 자동화하고 있습니다.
AWS에서 파운데이션 모델 훈련 및 추론을 위한 빌딩 블록
Hugging Face는 AWS에서 인프라, 리소스 오케스트레이션, ML 소프트웨어 스택, 관측성을 포함하는 4계층 아키텍처 프레임워크를 상세히 설명하여 사전 훈련, 사후 훈련 및 테스트 시점 컴퓨팅의 진화하는 스케일링 법칙을 지원합니다.
ChatGPT 도입 동향 Q1 2026
OpenAI는 2026년 Q1에 ChatGPT 사용이 연령대, 성별, 지역 전반에 걸쳐 확대되었으며, 보다 전문적인 직장 업무 작업으로의 전환이 있었다고 보고했습니다.
OpenAI, 학생 클럽을 위한 캠퍼스 네트워크 관심 양식 출시
OpenAI는 캠퍼스 네트워크를 발표하고, 전 세계 학생 클럽이 관심 양식을 통해 참여하여 AI 학습 지원, 이벤트 자원, 조기 도구 접근 및 앰배서더 기회를 받을 수 있도록 초대했습니다.
기업이 AI를 확장하는 방법: OpenAI 경영진 연구에서 얻은 교훈
OpenAI는 기업에서 AI를 확장하기 위한 다섯 가지 핵심 패턴을 제시하며, 성공이 도구의 기술적 배포보다 문화, 거버넌스 및 워크플로 재설계에 더 크게 좌우된다고 강조합니다.
OpenAI, 기업 AI 도입 가속화를 위해 OpenAI Deployment Company를 출시
OpenAI는 초기 투자 40억 달러와 Tomoro 인수를 바탕으로 독립적인 사업 부문인 OpenAI Deployment Company를 출시했으며, 이를 통해 Forward Deployed Engineers를 조직에 배치하여 최첨단 AI를 중심으로 워크플로를 재설계하도록 설계되었습니다.
vLLM 성능 벤치마크: Artificial Analysis 리더보드 1위
vLLM은 DeepSeek V3.2, MiniMax-M2.5, 그리고 Qwen 3.5 397B에 대해 공격적인 커널 융합 및 추측 디코딩 최적화를 구현함으로써 Artificial Analysis 리더보드에서 최고 순위를 달성했습니다.
vLLM TurboQuant 연구: 정확도 및 성능 분석
vLLM이 수행한 포괄적인 연구에 따르면 KV-cache 양자화에 있어 FP8이 여전히 최고의 기본 옵션이며, TurboQuant 변형은 추가 메모리 용량을 위해 상당한 처리량 및 지연 시간을 희생합니다.
OpenAI에서 Codex 안전하게 실행하기
OpenAI는 Codex를 위해 샌드박싱, 관리형 네트워크 정책, 에이전트 네이티브 텔레메트리를 결합한 보안 프레임워크를 구현하여 개발자 생산성과 엔터프라이즈 수준의 제어 사이의 균형을 맞추었습니다.
적응형 병렬 추론: 효율적인 추론 확장의 차세대 패러다임
BAIR는 적응형 병렬 추론(Adaptive Parallel Reasoning, APR)을 소개합니다. 이 패러다임은 대형 언어 모델(LLM)이 지연 시간을 줄이고 컨텍스트 회전(context-rot)을 방지하면서 정확성을 유지하기 위해 언제 추론 스레드를 병렬화할지 동적으로 결정하도록 합니다.
OpenAI GPT-5.5 및 GPT-5.5-Cyber 출시
OpenAI는 제한된 프리뷰 형태로 GPT-5.5-Cyber를 도입하고 Trusted Access for Cyber (TAC) 프레임워크를 통해 검증된 보안 방어자에게 핵심 인프라 보호를 위한 보다 관대한 특수 AI 기능을 제공했습니다.
Parloa AI 에이전트 관리 플랫폼 (AMP) 개요
Parloa는 `GPT-5.4`를 포함한 OpenAI 모델을 기반으로 한 엔터프라이즈급 시스템인 AI 에이전트 관리 플랫폼 (AMP)을 출시했습니다. 이 플랫폼은 비기술적인 주제 전문가가 신뢰할 수 있고 저지연인 고객 서비스 에이전트를 설계하고 배포할 수 있도록 설계되었습니다.
OpenAI, API에서 GPT-Realtime-2, GPT-Realtime-Translate, GPT-Realtime-Whisper를 소개합니다
OpenAI는 실시간 오디오 모델인 GPT‑Realtime‑2, GPT‑Realtime‑Translate, GPT‑Realtime‑Whisper를 출시하여 개발자들이 실시간으로 추론하고 번역하며 전사하는 음성 앱을 만들 수 있도록 했습니다.
OpenAI Codex 통합을 통한 Simplex 소프트웨어 개발
Simplex는 OpenAI Codex와 ChatGPT Enterprise를 통합하여 보조 AI에서 AI 기반 제공으로 전환했으며, CRUD 기반 웹 애플리케이션의 화면 개발 시간을 최대 70%까지 단축했습니다.
ChatGPT의 신뢰할 수 있는 연락처: 위기 지원을 위한 OpenAI의 새로운 안전 기능
OpenAI는 ChatGPT에 선택적 안전 기능인 신뢰할 수 있는 연락처를 도입했으며, 성인이 심각한 자해 우려가 감지될 경우 알림을 받을 신뢰할 수 있는 사람을 지정할 수 있게 합니다.
vLLM V1 마이그레이션: 강화 학습에서 백엔드 정확성 보장
ServiceNow AI는 로그확률 의미, 런타임 기본값, 가중치 업데이트 경로를 수정하고 fp32 lm_head를 구현함으로써 RL 롤아웃 생성에서 vLLM V0와 V1 간의 동등성을 달성했습니다.
AlphaEvolve: Gemini 기반 알고리즘 발견을 산업 전반에 확장
Google DeepMind의 AlphaEvolve는 Gemini 기반 코딩 에이전트로서, 유전체학, 양자 물리학, AI 인프라 및 상업 분야에서 알고리즘을 최적화함으로써 큰 영향을 보여주었습니다.
ChatGPT가 학습하고 사용자 프라이버시를 보호하는 방법
OpenAI는 데이터 소스, OpenAI Privacy Filter와 같은 프라이버시 보호 기술, 그리고 ChatGPT 대화가 모델 학습에 사용되지 않도록 하는 사용자 제어 기능을 설명합니다.
vLLM x Mooncake를 이용한 대규모 에이전틱 워크로드 서빙
vLLM은 Mooncake의 분산 KV cache 스토어를 통합하여 에이전틱 LLM 서빙 성능을 향상시켰으며, 실제 트레이스에서 3.8배 높은 처리량, 46배 낮은 TTFT, 8.6배 낮은 엔드 투 엔드 지연 시간을 달성하는 동시에 60 GB200 GPU까지 확장 가능함을 보여주었습니다.
허깅 페이스 오픈 ASR 리더보드: 벤치맥싱 방지를 위한 비공개 데이터셋
허깅 페이스는 Appen Inc.와 DataoceanAI의 비공개 평가 데이터셋을 오픈 ASR 리더보드에 도입하여 테스트 세트 오염을 방지하고 실제 세계에서의 ASR 성능에 대한 보다 강력한 측정을 제공합니다.
Singular Bank, ChatGPT와 Codex를 통합해 Singularity Assistant를 출시
Singular Bank는 ChatGPT와 Codex를 기반으로 하는 내부 AI 어시스턴트인 Singularity를 개발하여, 자동화된 포트폴리오 분석 및 커뮤니케이션을 통해 은행가들의 생산성 손실을 하루에 60~90분 줄였습니다.