201

OpenAI 정책 및 정치 옹호 입장

OpenAI는 정치 행동 위원회나 후보에 자금을 지원하지 않으며, AI 정책은 단일 조직이 아닌 광범이한 이해관계자 연합에 의해 형성되어야 한다고 밝혔습니다.

202

JetBrains Mellum2 릴리스

JetBrains는 12B Mixture-of-Experts(MoE) 모델인 Mellum2의 출시를 발표했지만, 제공된 소스 자료는 오류 페이지이며 기술 세부 정보가 없습니다.

203

LLMs를 넘어: 확장 가능한 기업 AI 채택이 Agent Logic에 의존하는 이유

제공된 소스 자료는 429 Too Many Requests 오류로 인해 사용할 수 없으며, 따라서 Agent Logic 또는 기업 AI 채택과 관련된 기술 내용이 없습니다.

204

OpenAI 스타게이트: 미시간에 위치한 The Barn 데이터 센터

OpenAI는 미시간 살린에 위치한 1GW 데이터 센터 캠퍼스인 The Barn의 착공을 시작했으며, 이는 AI 인프라를 확장하고 미국의 재산업화를 지원하기 위한 스타게이트 프로그램의 일환입니다.

205

OpenAI 프론티어 모델과 Codex가 이제 AWS에서 사용 가능

OpenAI는 프론티어 모델과 Codex를 AWS에 통합하여, 기업이 기존 AWS 보안, 규정 준수 및 청구 워크플로우를 사용하여 OpenAI 기능을 배포할 수 있도록 했습니다.

206

Qwen3.7-Plus 릴리즈 노트 / 새로운 소식

Qwen3.7-Plus는 비전과 언어를 통합하여 GUI와 CLI 환경에서 복잡한 소프트웨어 엔지니어링 및 생산성 자동화를 수행할 수 있는 멀티모달 에이전트 모델입니다.

207

DGX Spark에서 vLLM: 아키텍처, 구성 및 로컬 평가

vLLM은 NVIDIA DGX Spark를 위한 고성능 로컬 추론 엔드포인트를 제공하여, 통합 메모리 아키텍처와 OpenAI 호환 API를 사용해 Nemotron-3-Super와 같은 대형 NVFP4 모델을 배포할 수 있게 합니다.

208

OpenAI, '데이터 센터 열풍' 영향 작전 차단

OpenAI는 ChatGPT를 사용해 소셜 미디어 콘텐츠와 운영 계획을 생성하여 AI 전력 수요에 관한 미국 청중을 영향하고 중국 반체제 인사들을 괴롭힌 중국 연계 계정 클러스터를 차단했습니다.

209

OpenAI가 PRC 연계 'Tech and Tariffs' 영향 작전을 차단했습니다

OpenAI는 PRC 연계 행위자들이 친 PRC 서사를 생성하고, 미국 기술 정책을 비판하며, 데이터 유출에 대한 허위 주장을 통해 OpenAI의 신뢰를 손상시키려 시도한 ChatGPT 계정 클러스터를 차단했습니다.

210

Braintrust와 OpenAI Codex 통합

Braintrust는 OpenAI Codex를 사용해 고객 기능 요청을 몇 분 안에 작동하는 코드 미리보기로 변환하여 개발 피드백 루프를 크게 가속화합니다.

211

보스턴 어린이 병원 AI 통합 및 희귀 질환 진단

보스턴 어린이 병원은 기업 AI 레이어를 통합하여 운영을 최적화하고 이전에 해결되지 않았던 40여 개의 희귀 질환을 진단했습니다.

212

Qwen-VLA: 구현 지능을 위한 비전-언어-액션 모델링 통합

Qwen-VLA는 로봇 조작, 비전-언어 내비게이션, 그리고 다양한 구현체 제어를 하나의 일반화 정책 모델로 통합하는 범용 비전-언어-액션 모델입니다.

213

OpenAI Rosalind 바이오방어 및 GPT-Rosalind 확장

OpenAI는 Rosalind 바이오방어 이니셔티브를 출시하고 정부 및 동맹 파트너에 대한 GPT-Rosalind의 신뢰할 수 있는 접근을 확장하여 바이오방어 및 팬데믹 대비 도구 개발을 가속화했습니다.

214

OpenAI는 신뢰할 수 있는 타사 평가에 대한 프런티어 AI 모델 플레이북을 공유합니다

OpenAI는 타사 평가자가 하네스를 선택하고, 능력을 유도하며, 타당성을 검사하여 프런티어 AI 모델에 대한 신뢰할 수 있는 평가를 수행할 수 있도록 설명하는 공유 플레이북을 발표했습니다.

215

PyTorch에서 프로파일링: torch.profiler 초보자 가이드

Hugging Face는 torch.profiler를 활용해 병목을 식별하고, CPU‑GPU 디스패치 체인을 이해하며, torch.compile이 커널 실행에 미치는 영향을 분석하는 포괄적인 가이드를 제공합니다.

216

Endava의 OpenAI Codex를 활용한 에이전틱 조직 전략

Endava는 OpenAI Codex를 사용하여 시니어 아키텍처 전문성을 코드화하고 소프트웨어 배포 수명을 주에서 일로 압축함으로써 에이전틱 조직으로 전환했습니다.

217

vLLM, Speculators, 및 LLM Compressor를 사용한 Laguna XS.2 추론 최적화

Poolside와 Red Hat AI는 vLLM 통합, DFlash 추측 디코딩, 및 LLM Compressor 양자화를 사용하여 에이전트 코딩 작업을 위한 Laguna XS.2 33B-A3B MoE 모델을 최적화했습니다.

218

vLLM Semantic Router 멀티모달 라우팅 및 비전 인코더 강화

vLLM은 Semantic Router (VSR)에 멀티모달 라우팅을 도입하여, Rust/Candle와 PyTorch 경로 간의 심각한 구현 드리프트를 해결하는 동시에 시각적 증거를 요청 수준 정책 결정을 위한 일급 신호로 사용할 수 있도록 했습니다.

219

Speculators v0.5.0 릴리스 노트 / 새로운 기능

Speculators v0.5.0은 단일 패스 드래프트 토큰 생성을 위한 DFlash 알고리즘 지원, vLLM의 네이티브 히든 스테이트 추출을 통한 온라인 및 오프라인 학습 통합, 그리고 업데이트된 문서를 도입합니다.

220

vLLM 네이티브 RL API 릴리스

vLLM은 훈련과 추론 사이의 가중치 전송을 표준화하고 대규모 DPEP 배포에서 교착 상태를 제거하기 위해 네이티브 가중치 동기화 API와 향상된 비동기 RL 지원을 도입했습니다.

221

OpenAI 프론티어 거버넌스 프레임워크

OpenAI는 EU AI 법 및 캘리포니아 주의 Frontier AI 투명성 법과 같은 신흥 법적 요구사항에 맞추기 위해 안전 및 보안 관행을 정렬하는 프론티어 거버넌스 프레임워크를 도입했습니다.

222

Cisco와 OpenAI Codex 엔터프라이즈 통합

Cisco는 OpenAI의 Codex를 생산 엔지니어링 워크플로에 통합하여 기능 개발 시간을 몇 분기에서 몇 주로 단축하고 결함 해결 처리량을 10-15배 증가시켰습니다.

223

Codex를 사용한 자체 개선 세무 에이전트 구축

OpenAI와 Thrive Holdings는 크리트 회계사를 위한 자체 개선 에이전트인 Tax AI를 개발했는데, 이는 Codex 기반 루프를 사용하여 최대 97% 정확도로 복잡한 세무 신고를 자동화합니다.

224

Reachy Mini 로컬 음성 백엔드 통합

Hugging Face는 Reachy Mini용 로컬 음성-음성 파이프라인을 출시하여, 캐스케이드된 VAD, STT, LLM, TTS 스택을 사용해 로봇이 대화를 완전히 로컬에서 처리할 수 있도록 했습니다.

225

2026년 OpenAI 선거 정보 및 보호 조치

OpenAI는 2026년 선거 주기를 위한 포괄적인 보호 조치를 발표했으며, 신뢰할 수 있는 정보 제공, 사이버 인프라 방어, 콘텐츠 출처 보장, 그리고 모델 편향 완화에 중점을 두고 있습니다.

226

Warp Open Agentic Development과 Oz 오케스트레이션 플랫폼

Warp는 GPT-5.5와 Oz 오케스트레이션 플랫폼을 사용하여 Open Agentic Development을 구현하고 소프트웨어 엔지니어링을 인간 감독 하의 에이전트 함대로 전환하고 있다.

227

TRL의 Delta Weight Sync를 통한 최소 대역폭 기반 조 단위 파라미터 모델 학습

Hugging Face는 TRL에 Delta Weight Sync 기능을 발표했습니다. 이 기능은 Hugging Face Buckets를 통해 희소 가중치 변경 사항만 전송함으로써 비동기 RL 학습의 가중치 동기화 대역폭을 100배 이상 줄여, 공유 클러스터 없이도 분리된 학습을 가능하게 합니다.

228

EAGLE 3.1 릴리즈 노트: 추측 디코딩 견고성 및 효율성 향상

EAGLE 3.1은 어텐션 드리프트를 해결하기 위한 아키텍처 개선을 도입하여 장기 컨텍스트 작업에서 허용 길이를 두 배로 늘리고, vLLM 및 TorchSpec 통합을 통해 처리량을 크게 증가시킵니다.

229

Hugging Face AI Agent 용어 사전: Harness, Scaffold 및 Agent Architecture 정의

Hugging Face는 AI agent를 모델, 실행을 위한 harness, 행동 정의를 위한 scaffolding의 결합으로 정의하며, AI agent를 위한 표준화된 어휘를 제공합니다.

230

OpenAI, Grupo Folha, 및 Grupo UOL 전략적 콘텐츠 파트너십

OpenAI는 브라질의 Grupo Folha 및 Grupo UOL과 파트너십을 맺어 고품질 브라질 저널리즘을 ChatGPT에 통합하고, 주간 활성 사용자 9억 명에게 근거가 있고 출처가 명시된 보도를 제공합니다.

231

OpenAI 분석: 소규모 기업을 위한 첫 번째 채용으로서의 AI

OpenAI는 2026년 3월에 미국 내 4백만 명의 사용자가 소규모 사업 운영을 지원하기 위해 ChatGPT를 사용했다고 보고하며,これにより 행정 부담을 줄이고 창업의 고정 비용을 낮춘다고 밝혔습니다.

232

OpenAI Codex와 함께하는 Virgin Atlantic 소프트웨어 개발

Virgin Atlantic은 OpenAI Codex를 활용해 리뉴얼된 모바일 앱을 P1 결함 없이 출시하고 레거시 코드베이스 크기를 최대 80%까지 줄였습니다.

233

OpenAI Codex, 2026 Gartner Magic Quadrant 기업용 AI 코딩 에이전트 부문 리더 선정

OpenAI는 Gartner Magic Quadrant 기업용 AI 코딩 에이전트 부문에서 리더로 인정받았으며, 이는 Codex의 규모와 거버넌스 역량을 반영합니다.

234

Google DeepMind 가속기 프로그램 (아시아 태평양)

Google DeepMind는 아시아 태평양 지역에서 AI for the Planet 가속기 프로그램을 시작하여 스타트업, 연구팀 및 비영리 단체가 환경 위험에 대응하는 최첨단 AI 솔루션을 확장하도록 돕고 있습니다.

235

AdventHealth와 OpenAI: 임상 행정 부담을 줄이기 위한 AI 확장

AdventHealth는 ChatGPT for Healthcare를 도입하여 시간 소모적인 문서화 및 임상 워크플로를 자동화하고, 임상의 시간을 회수하여 환자 진료 용량을 확대하고 있습니다.

236

Qwen3.7-Max 에이전트 모델 출시

Qwen은 Qwen3.7-Max를 출시했으며, 코딩, 사무 자동화 및 초장기 자율 작업에 뛰어난 새로운 에이전트 중심 기반 모델로, 이제 Alibaba Cloud Model Studio를 통해 이용할 수 있습니다.

237

Codex with GPT-5.5는 Ramp에서 코드 리뷰 속도를 높인다

Ramp 엔지니어는 Codex with GPT-5.5를 사용하여 시간을 분 단위로 줄여 실질적인 풀 리퀘스트 피드백을 얻고, On‑Call Assistant와 같은 내부 에이전트형 도구를 구축합니다.

238

OpenAI 국가를 위한 교육 프로그램 업데이트

OpenAI는 Education for Countries 이니셔티브를 확장하여 싱가포르를 포함시키고, 첫 번째 코호트 국가들 전반에 걸쳐 연구 중심의 AI 배포를 확대하여 주체적 AI를 통해 학습 결과를 개선하고 있습니다.

239

OpenAI 모델이 평면 단위 거리 추측을 반증함

OpenAI 범용 추론 모델은 정사각형 격자 구성보다 다항식 개선을 발견함으로써 이산 기하학의 80년 된 추측을 자율적으로 반증했습니다.

240

OpenAI 싱가포르 파트너십 발표

OpenAI는 'OpenAI for Singapore'를 출시했습니다. 이는 디지털 개발 및 정보부(MDDI)와의 S$3억 파트너십으로, Applied AI Lab을 설립하고 현지 AI 인재를 육성하기 위한 것입니다.

241

OlmoEarth v1.1 릴리스 노트 / 새로운 기능

Hugging Face와 AllenAI는 계산 비용을 최대 3배까지 줄이면서 v1과 유사한 성능을 유지하는 지구 관측 모델 가족인 OlmoEarth v1.1을 출시했습니다.

242

OpenAI 콘텐츠 출처 업데이트

SUMMARY: OpenAI는 C2PA 준수, Google SynthID 워터마킹, 그리고 새로운 공개 검증 도구를 사용하여 다층적 출처 시스템을 구현하고 있으며, 이를 통해 AI 생성 콘텐츠 신호의 투명성과 내구성을 높이고자 합니다.

243

Qwen3.5-LiveTranslate-Flash 릴리스 노트

Qwen3.5-LiveTranslate-Flash는 Qwen3.5-Omni를 기반으로 구축된 동시 통역 모델로, 초저지연 및 음성 클로닝을 통해 60개 언어에 대한 실시간 다중모달 번역을 제공합니다.

244

Ettin Reranker 패밀리 v1 릴리즈 노트

Hugging Face가 Ettin Reranker 패밀리를 공개했습니다. 17M부터 1B 파라미터까지 여섯 개의 CrossEncoder 재랭커가 mxbai-rerank-large-v2 로부터 디스틸링되었으며, 최첨단 검색 재랭킹 품질과 속도를 달성했습니다.

245

Google DeepMind: 세포 노화를 역전시키기 위한 유전적 리드 빠른 추적

Google DeepMind의 Co-Scientist AI는 새로운 유전적 요인을 식별하고 데이터 분석 시간을 6개월에서 며칠로 단축함으로써 세포 노화 연구를 가속화하고 있습니다.

246

PaddleOCR 3.5 릴리즈 노트 / 새로운 내용

PaddleOCR 3.5는 Hugging Face Transformers를 지원되는 추론 백엔드로 도입하여 OCR 및 문서 파싱 모델이 PyTorch 기반 워크플로에 보다 원활하게 통합될 수 있도록 합니다.

247

OpenAI와 Dell Technologies의 엔터프라이즈 Codex 배포 파트너십

OpenAI와 Dell Technologies는 Dell AI Data Platform과 Dell AI Factory를 통해 하이브리드 및 온프레미스 엔터프라이즈 환경에서 Codex 배포를 가능하게 하는 파트너십을 체결했습니다.

248

vLLM x Novita AI: PegaFlow for Production-Grade External KV Cache

vLLM과 Novita AI가 외부 KV 캐시 서비스인 PegaFlow를 발표했습니다. 이 서비스는 KV 캐시를 vLLM 워커와 분리하여 시작 시간을 단축하고, 캐시 공유를 통한 처리량을 높이며, RDMA 기반의 노드 간 접근을 가능하게 합니다.

249

프로젝트 지니 스트리트 뷰 통합

Google DeepMind는 Google Street View 이미지를 Project Genie에 통합하여, 범용 세계 모델이 AI 에이전트와 사용자를 위한 인터랙티브하고 실제 기반의 환경을 생성할 수 있게 했습니다.

250

Gemini Omni Flash 출시

Google DeepMind은 텍스트, 이미지, 오디오, 비디오 입력의 조합으로부터 고품질 비디오를 생성하고 편집할 수 있는 네이티브 멀티모달 모델인 Gemini Omni Flash를 도입했습니다.