301

Uber와 OpenAI 통합: AI 기반 운전자 안내 및 음성 예약

Uber는 운전자 수익 최적화와 음성 기반 라이드 예약을 위해 Uber Assistant를 출시하기 위해 OpenAI 최첨단 모델을 통합하고 있으며, 이를 통해 승객의 불편을 줄이고 있습니다.

302

OpenAI, ChatGPT Futures 발표: 2026학번

OpenAI는 AI를 활용해 도구를 만들고, 연구를 진전시키며, 사회적 영향을 창출하는 2026학번 학생들에게 보조금과 모델 접근성을 제공하는 프로그램인 ChatGPT Futures를 시작했습니다.

303

OpenAI B2B Signals: 선두 기업들이 앞서 나가는 방법

OpenAI는 B2B Signals를 도입해 사용량 상위 95번째 백분위에 해당하는 선두 기업들이 이제 일반 기업보다 직원당 3.5배 더 많은 인텔리전스를 활용하고 있으며, 이는 복잡하고 에이전트 기반 워크플로우에 의해 촉진되고 있음을 밝혔습니다.

304

GPT-5.5 Instant 릴리스 노트 / 새로운 내용

OpenAI는 ChatGPT의 새로운 기본 모델인 GPT-5.5 Instant를 출시했으며, 사실성 향상, 장황함 감소, 그리고 사용자 컨텍스트와의 깊은 통합을 통한 개인화 강화가 이루어졌습니다.

305

OpenAI MRC 다중 경로 신뢰 연결 프로토콜

OpenAI는 대규모 AI 학습 클러스터에서 GPU 네트워킹의 복원력과 성능을 향상시키기 위해 Open Compute Project를 통해 Multipath Reliable Connection (MRC) 프로토콜을 공개했습니다.

306

GPT-5.5 Instant 시스템 카드

OpenAI가 GPT-5.5 Instant 시스템 카드를 공개했으며, 이는 Instant 모델이 사이버 보안 및 생물학적 및 화학적 대비 카테고리에서 처음으로 High capability로 분류된 사례입니다.

307

OpenAI 유럽 청소년 안전 청사진 및 EMEA 청소년 및 복지 보조금

OpenAI는 유럽 청소년 안전 청사진과 EMEA 청소년 및 복지 보조금의 첫 수혜자를 발표하여 연령에 맞는 AI 활용을 촉진하고 유럽, 중동 및 아프리카의 청소년을 보호합니다.

308

OpenAI, 자체 서비스 Ads Manager와 CPC 입찰을 통해 ChatGPT 광고 파일럿 확대

OpenAI는 베타 자체 서비스 Ads Manager와 클릭당 비용(CPC) 입찰, 확장된 측정 도구를 도입해 모든 규모의 기업이 광고를 보다 쉽게 이용할 수 있도록 ChatGPT 광고 파일럿을 확대하고 있습니다.

309

OpenAI와 PwC의 금융 분야 AI 에이전트 협업

OpenAI와 PwC는 AI 에이전트를 도입해 금융 워크플로우를 자동화하고, OpenAI 자체 금융 조직을 테스트 환경으로 활용하여 CFO 사무실을 현대화하기 위해 협업하고 있습니다.

310

OpenAI 저지연 음성 AI 인프라

OpenAI는 분할 릴레이‑플러스‑트랜시버 아키텍처를 도입해 9억 명 이상의 주간 활성 사용자에게 저지연·확장 가능한 음성 AI를 제공하도록 WebRTC 스택을 재구성했습니다.

311

Google DeepMind AI 공동임상의 연구 이니셔티브

Google DeepMind는 증거 종합 및 임상 감독 하에 실시간 환자 상호작용을 통해 의료 제공자를 지원하도록 설계된 다중모달 AI 시스템인 AI 공동임상의 연구 이니셔티브를 소개했습니다.

312

Qwen-Scope 해석 가능성 툴킷 출시

Qwen은 Sparse Autoencoders(SAE)를 사용하여 Qwen3 및 Qwen3.5 모델의 은닉 표현을 해석 가능한 특징으로 분해하고 모델 최적화를 위한 해석 가능성 툴킷인 Qwen-Scope를 출시했습니다.

313

OpenAI 고급 계정 보안 출시

OpenAI는 고위험 사용자를 보호하기 위해 피싱 방지 인증을 의무화하고 기존 복구 방식을 비활성화하는 옵션 설정인 고급 계정 보안을 ChatGPT 및 Codex 계정에 출시했습니다.

314

OpenAI 모델 행동 분석: '고블린' 어휘 틱

OpenAI는 'Nerdy' 성격 기능을 위한 보상 신호가 GPT‑5.1부터 GPT‑5.5까지 모델이 고블린 및 그렘린 은유를 의도치 않게 사용하는 습관을 형성하게 했으며, 이 습관이 다른 모델 행동으로 일반화되었다는 사실을 확인했습니다.

315

IBM Granite 4.1 LLMs 릴리스 노트 / 기술 개요

IBM은 Granite 4.1을 출시했습니다. 이는 높은 성능을 달성하기 위해 엄격한 데이터 큐레이션과 다단계 강화 학습 파이프라인을 사용하는 밀집형, 디코더 전용 LLM 가족(3B, 8B, 30B)입니다.

316

OpenAI Stargate 컴퓨팅 인프라 업데이트

OpenAI는 미국을 위한 초기 10GW AI 인프라 목표를 초과 달성했으며, 텍사스주 아빌린에 위치한 플래그십 Stargate 사이트에서 GPT-5.5를 훈련시켰습니다.

317

OpenAI 사이버 보안 액션 플랜: 인텔리전스 시대

OpenAI는 AI 기반 사이버 방어를 민주화하고 AI 기반 위협에 대한 탄력성을 강화하기 위한 다섯 가지 기둥의 액션 플랜을 도입했습니다.

318

DeepInfra와 Hugging Face Inference Providers의 통합

Hugging Face가 DeepInfra를 지원되는 Inference Provider로 추가하여, Hub 및 클라이언트 SDK를 통해 DeepSeek V4 및 Kimi-K2.6를 포함한 100개 이상의 모델에 대한 서버리스 액세스를 가능하게 했습니다.

319

제목: NVIDIA Nemotron 3 Nano Omni 릴리스 노트 / 새로운 기능

요약: NVIDIA는 텍스트, 이미지, 비디오, 오디오 전반에 걸친 장기 컨텍스트 추론이 가능한 옴니모달 모델인 Nemotron 3 Nano Omni를 출시했으며, 문서 지능 및 비디오 이해 벤치마크에서 최고 수준의 정확도를 제공합니다.

320

FlashQLA: GDN을 위한 CP-/Bwd-친화적 융합 선형 어텐션 커널

Qwen은 TileLang 기반의 고성능 선형 어텐션 커널 라이브러리인 FlashQLA를 오픈소스화했으며, NVIDIA Hopper GPU에서 Gated Delta Network (GDN) 레이어에 대해 전방 2-3배, 후방 2배 속도 향상을 달성합니다.

321

OpenAI 커뮤니티 안전 및 폭력 완화 프레임워크

OpenAI는 모델 훈련, 자동 탐지, 인간 검토를 결합하여 ChatGPT가 폭력 계획 또는 실행에 사용되는 것을 방지하는 다층 접근 방식을 상세히 설명했습니다.

322

vLLM에서 NVIDIA Nemotron 3 Nano Omni 지원

vLLM은 이제 NVIDIA Nemotron 3 Nano Omni를 지원합니다. 이 모델은 30B MoE 멀티모달 모델로, 비전, 오디오, 언어 추론을 하나의 루프로 통합하여 에이전트 AI를 구동하는 고효율 모델입니다.

323

OpenAI GPT-5.5, Codex, 및 AWS 관리 에이전트 릴리스 노트

2026년 4월 28일, OpenAI는 GPT‑5.5를 포함한 최첨단 모델, Codex 코딩 에이전트, 그리고 OpenAI 기반 Amazon Bedrock 관리 에이전트가 AWS에서 제한된 프리뷰로 제공된다고 발표했으며, 이를 통해 기업은 기존 AWS 보안·컴플라이언스·조달 워크플로우 내에서 이러한 기능을 활용할 수 있게 되었습니다.

324

OpenAI, FedRAMP 중간 수준 인증 획득

OpenAI는 ChatGPT Enterprise와 API 플랫폼에 대해 FedRAMP 20x 중간 수준 인증을 획득했으며, 이를 통해 미국 정부 기관이 연방 보안 및 개인정보 보호 기준에 부합하는 GPT-5.5를 포함한 최첨단 AI 모델에 접근할 수 있게 되었습니다.

325

Google DeepMind과 대한민국과의 파트너십

Google DeepMind은 대한민국 과학기술정보통신부와 파트너십을 체결하여 서울에 AI 캠퍼스를 설립하고 최첨단 AI 모델을 배치하여 생명 과학, 에너지, 기후 분야의 과학 연구를 가속화할 것입니다.

326

Microsoft OpenAI 파트너십의 다음 단계

OpenAI와 Microsoft는 파트너십 계약을 수정하여 유연성을 높였으며, OpenAI가 Microsoft를 주요 클라우드 파트너로 유지하면서 모든 클라우드 제공업체에 제품을 제공할 수 있게 되었습니다.

327

Choco는 AI 에이전트로 식품 유통을 자동화합니다

Choco는 OpenAI API를 기반으로 구축된 AI 기반 OrderAgent와 VoiceAgentを発表하여 식품 유통 주문 처리를 자동화했습니다.

328

Symphony: Codex 오케스트레이션을 위한 오픈 소스 사양

OpenAI가 Linear와 같은 이슈 트래커를 Codex 코딩 에이전트를 위한 상시 가동 오케스트레이터로 변환하는 오픈 소스 사양인 Symphony를 출시했습니다. 이를 통해 팀은 일상적인 구현 작업을 자동화하고 PR 처리량을 높일 수 있습니다.

329

OpenAI Privacy Filter: 확장 가능한 PII 탐지 웹 앱 구축하기

OpenAI는 128k 컨텍스트 윈도우에서 8가지 범주의 민감한 데이터를 라벨링할 수 있는 오픈 소스 1.5B-parameter PII 탐지기인 Privacy Filter를 출시했습니다.

330

OpenAI AGI 개발을 위한 운영 원칙

OpenAI는 인공 일반 지능(AGI)이 인류 전체에 이익이 되도록 보장하기 위해 다섯 가지 핵심 원칙—민주화, 권한 부여, 회복력, 보편적 번영, 적응력—을 제시했습니다.

331

OpenAI AI 직업 전환 프레임워크

OpenAI는 921개 직업에 걸쳐 AI가 고용에 미치는 영향을 분석하기 위해 AI 직업 전환 프레임워크를 도입했으며, 자동화 위험, 재구성, 성장 잠재력, 안정성을 기반으로 직업을 네 가지 경로로 분류합니다.

332

DeepSeek-V4 릴리스 노트: AI 에이전트를 위한 효율적인 1M-토큰 컨텍스트

DeepSeek-V4는 하이브리드 CSA/HCA 주의 메커니즘으로 구동되는 1M-토큰 컨텍스트 윈도우를 도입하며, 장기 실행 에이전트 워크로드 및 도구 사용 궤적에 특별히 최적화되었습니다.

333

vLLM DeepSeek V4 지원: 효율적인 장기 컨텍스트 어텐션

vLLM은 이제 DeepSeek V4-Pro와 V4-Flash를 지원하며, 컨텍스트 길이를 최대 백만 토큰까지 확장하고 KV 캐시 메모리를 크게 절감하는 새로운 어텐션 메커니즘을 구현했습니다.

334

OpenAI GPT-5.5 System Card

OpenAI가 복잡한 실무 작업 및 도구 사용에 최적화되고, 향상된 작업 이해도와 더욱 강력한 안전 프레임워크를 특징으로 하는 GPT-5.5를 출시했습니다.

335

OpenAI GPT-5.5 릴리스 노트

OpenAI는 GPT-5.5와 GPT-5.5 Pro를 출시했으며, 에이전트 코딩, 컴퓨터 사용, 과학 연구 분야에서 큰 발전을 이루면서도 GPT-5.4와 동일한 지연 시간을 유지합니다.

336

일상 업무에서 ChatGPT Work 사용하기

2026년 4월 23일 OpenAI 아카데미 게시물에서는 ChatGPT Work가 캘린더, 이메일, 문서, 스프레드시트와 같은 기존 작업 자료를 팀이 검토하고 편집할 수 있는 초안 브리프, 요약, 데크, 워크북, 계획, 프로세스 문서로 변환하는 방법을 설명합니다.

337

크롬 확장 프로그램에서 Transformers.js 사용하기

Hugging Face는 Gemma 4 E2B로 구동되는 백그라운드 호스팅 모델 아키텍처를 특징으로 하는 Manifest V3를 사용하는 Chrome 확장 프로그램에 Transformers.js를 통합하는 기술 가이드를 제공합니다.

338

ChatGPT for Clinicians 출시

OpenAI는 인증된 미국 의료 제공자를 위해 문서화, 의료 연구 및 임상 워크플로를 자동화하도록 설계된 ChatGPT의 무료 버전인 ChatGPT for Clinicians를 출시했습니다.

339

Google DeepMind Decoupled DiLoCo

Google DeepMind는 저대역폭과 혼합된 하드웨어 세대를 사용하여 멀리 떨어진 데이터 센터 간에 회복 탄력적이고 비동기적인 LLM 학습을 가능하게 하는 분산 학습 아키텍처인 Decoupled DiLoCo를 소개했습니다.

340

ChatGPT에서 워크스페이스 에이전트 소개 – OpenAI 연구 미리보기

OpenAI는 ChatGPT에서 워크스페이스 에이전트를 도입하여, 팀이 조직 통제를 준수하면서 도구 간 멀티스텝 워크플로를 자동화하는 공유 클라우드 기반 AI 에이전트를 만들 수 있도록 했습니다.

341

ChatGPT의 워크스페이스 에이전트: 개요 및 구축 방법

OpenAI는 트리거, 프로세스 및 도구 통합을 결합하여 반복 가능하고 구조화된 워크플로를 자동화하는 워크스페이스 에이전트를 ChatGPT에 도입했으며, 이를 통해 팀이 일관된 AI 기반 작업을 공유할 수 있게 했습니다.

342

OpenAI Responses API WebSocket 모드 출시

OpenAI는 Responses API에 WebSocket 지원을 도입하여 중복된 API 오버헤드를 제거하고 초당 최대 4,000 토큰의 추론 속도를 가능하게 함으로써 에이전트 워크플로우 지연 시간을 최대 40%까지 감소시켰습니다.

343

Qwen3.6-27B 릴리스 노트 / 새로운 내용

Qwen은 27억 파라미터의 밀집형 멀티모달 모델인 Qwen3.6-27B를 출시했으며, 모든 주요 에이전트 코딩 벤치마크에서 더 큰 Qwen3.5-397B-A17B를 능가합니다.

344

vLLM FP8 KV-Cache 및 Attention 양자화 업데이트

vLLM은 Hopper 및 Blackwell 아키텍처 전반에서 베이스라인에 가까운 정확도를 유지하면서 디코딩 지연 시간과 메모리 사용량을 줄이기 위해 FP8 KV-cache 및 attention 양자화를 최적화했습니다.

345

OpenAI 프라이버시 필터 릴리스

OpenAI는 비구조화 텍스트에서 개인 식별 정보(PII)를 고속으로, 컨텍스트를 인식하여 감지하고 삭제하도록 설계된 오픈-웨이트 1.5B 파라미터 모델인 Privacy Filter를 공개했습니다.

346

Google DeepMind, Accenture, Bain & Company, BCG, Deloitte 및 McKinsey와 협력해 AI 전환을 가속화

Google DeepMind는 Accenture, Bain & Company, BCG, Deloitte, 그리고 McKinsey와의 파트너십을 발표했습니다. 이 파트너십은 Gemini와 같은 최첨단 모델에 대한 조기 접근을 제공하고, 산업별 AI 솔루션을 공동 개발하며, 리더십을 고객 CEO와 연결함으로써 기업 AI 전환을 가속화합니다.

347

ChatGPT 이미지 2.0 출시

OpenAI는 이미지 생성 기능을 크게 향상시킨 ChatGPT Images 2.0을 출시했으며, 정밀도 향상, 다국어 텍스트 렌더링, 스타일리시한 사실감이 강화되었습니다.

348

QIMMA: 품질 우선 아라비아어 LLM 리더보드

Hugging Face와 파트너들은 QIMMA를 도입했습니다. 이는 새로운 아라비아어 LLM 리더보드로, 벤치마크가 실제 언어 능력을 반영하도록 엄격한 품질 검증 파이프라인을 구현합니다.

349

전 세계 기업에 Codex 확장 – OpenAI 발표

OpenAI는 Codex 사용량이 주당 3백만 명 이상에서 4백만 명 이상으로 증가했다고 발표했으며, Codex Labs와 글로벌 시스템 통합업체 파트너 프로그램을 도입하여 기업이 소프트웨어 개발 수명 주기 전반 및 그 이상에서 Codex를 도입하도록 지원했습니다.

350

vLLM v0.20.0 하이브리드 SSM 모델을 위한 분산 서빙 추가

vLLM v0.20.0은 하이브리드 SSM‑FA 모델을 위한 분산 프리필/디코드 서빙을 도입하여, 이중 디스크립터 뷰와 3‑디스크립터 Conv 상태 전송을 통해 효율적인 KV 전송을 가능하게 합니다.