직장에서 AI 채택을 위한 OpenAI Academy 강좌
OpenAI는 AI 기초, 적용 AI 기초, 그리고 에이전트와 워크플로우라는 세 가지 새로운 과정을 출시하여 조직이 AI 유창성을 구축하고 개별 작업 개선에서 구조화된 에이전트 지원 워크플로우로 전환하도록 돕습니다.
Preply와 OpenAI: AI를 활용한 언어 학습 개인화
Preply는 OpenAI API를 통합해 Lesson Insights를 만들었으며, 이 도구는 1:1 인간 튜터링 세션을 자동 피드백과 맞춤형 연습을 통해 개인화된 학습 여정으로 전환합니다.
MiniMax M3 vLLM 지원: 1M-토큰 멀티모달 추론을 위한 Day-0 서빙
vLLM은 MiniMax M3 모델 패밀리에 대한 day-0 지원을 출시했으며, MiniMax Sparse Attention (MSA)를 사용해 1M-토큰 컨텍스트와 네이티브 멀티모달 추론을 효율적으로 서빙할 수 있게 되었습니다.
PyTorch 프로파일링 (파트 2): nn.Linear에서 융합 MLP까지
Hugging Face는 GPU 커널 융합 분석, torch.compile의 영향, 그리고 kernels 라이브러리를 통한 손수 튜닝된 커널 사용을 통해 PyTorch에서 다층 퍼셉트론(MLP)을 최적화하는 방법을 설명합니다.
OpenAI가 Codex의 지속적인 클라우드 실행을 가능하게 하기 위해 Ona를 인수함
OpenAI는 보안 클라우드 실행 및 오케스트레이션 기술을 Codex에 통합하기 위해 Ona를 인수하고 있으며, 이를 통해 AI 에이전트는 사용자의 활성 세션에 독립적으로 복잡하고 장기적인 작업을 수행할 수 있습니다.
OpenAI의 AI 생성 콘텐츠 투명성에 관한 EU 행동 규범 지지
OpenAI는 EU AI 법을 시행하고 디지털 출처를 개선하기 위해 유럽 위원회의 AI 생성 콘텐츠 투명성에 관한 행동 규범에 대한 지지를 발표했습니다.
OpenAI Codex를 사용하여 블랙홀 플라즈마 시뮬레이션 가속화
천체물리학자 Chi-kwan Chan은 OpenAI Codex를 사용하여 블랙홀 주변의 입자 움직임 시뮬레이션의 계산 오버헤드를 줄이는 새로운 수치 알고리즘을 도출하고 테스트하고 있다.
BBVA와 OpenAI의 AI 네이티브 뱅킹을 위한 전략적 협력
BBVA는 OpenAI와 전략적 동맹을 체결하여 전 세계 운영에 인공지능을 통합하고, ChatGPT Enterprise를 100,000명의 직원으로 확장하며, 'The Eight'라고 불리는 포괄적인 AI 변혁 로드맵을 구현했습니다.
OpenAI와 Oracle Cloud Infrastructure 통합
OpenAI와 Oracle은 파트너십을 맺어 Oracle Cloud Infrastructure(OCI) 고객이 자격이 있는 Oracle Universal Credits를 OpenAI 프론티어 모델과 Codex 사용에 적용할 수 있도록 허용합니다.
DiffusionGemma: 텍스트 확산을 통한 4배 빠른 텍스트 생성
Google DeepMind has released DiffusionGemma, an experimental 26B MoE model that uses text diffusion to generate blocks of text simultaneously, achieving up to 4x faster inference on dedicated GPUs compared to autoregressive models.
OpenAI, PRC 연계 영향력 작전 차단: 미국 AI 논쟁 표적
OpenAI는 중국과 연관된 두 개의 ChatGPT 계정 클러스터를 금지했는데, 이들은 AI를 사용하여 미국 공공 논의에서 AI 인프라 및 기술 정책과 관련하여 은밀히 조작했습니다.
Google DeepMind 다중 에이전트 AI 안전 연구 펀딩 콜
Google DeepMind과 파트너들은 대규모 다중 에이전트 AI 시스템의 안전과 안정성을 연구하여 상호작용하는 독립적인 에이전트에서 발생하는 발생 위험을 완화하기 위해 1,000만 달러 규모의 펀딩 콜을 발표했습니다.
LSEG, OpenAI 통합으로 신뢰할 수 있는 AI 확장
런던 증권 거래소 그룹(LSEG)은 ChatGPT Enterprise와 OpenAI API를 통합하여 제품 출시 주기를 월에서 주로 단축하고 전 세계 직원의 생산성을 향상시켰습니다.
DiffusionGemma: vLLM에서 네이티브로 처음 지원되는 첫 번째 Diffusion LLM
vLLM은 26B 파라미터 이산 디퓨전 언어 모델인 DiffusionGemma를 통합하여, 순차적 자동 회귀 디코딩 대신 토큰 블록을 반복적으로 디노이즈함으로써 높은 처리량과 낮은 지연 시간을 달성합니다.
Gemini 3.5 Live Translate 출시 노트
Google DeepMind은 70개 이상의 언어에 대해 거의 실시간 음성-음성 번역을 제공하면서 화자의 억양과 피치를 보존하는 오디오 모델인 Gemini 3.5 Live Translate를 출시했습니다.
Gemma 4 12B 릴리스 노트 / 새로운 기능
Google DeepMind은 로컬에서 실행될 수 있도록 설계된 16GB RAM을 갖춘 노트북용 인코더 프리 멀티모달 모델인 Gemma 4 12B를 출시했으며, 네이티브 오디오 및 시각 처리를 특징으로 합니다.
Google DeepMind 액셀러레이터: 로봇 프로그램 출시
Google DeepMind은 유럽에서 로봇 액셀러레이터를 출시하여, 3개월간의 기술 지원과 Gemini 로봇 모델에 대한 접근을 제공받을 15개의 초기 단계 스타트업을 선정했습니다.
Nextdoor 엔지니어링 OpenAI Codex 통합
Nextdoor는 개별 엔지니어가 종단 간 제품 소유를 할 수 있도록 OpenAI Codex와 GPT-5.5를 활용하여, 엔지니어링 병목을 구현에서 전략적 계획으로 이동시켰습니다.
Hugging Face Spaces agents.md는 자동 3D 멀티미디어 파이프라인을 가능하게 한다
코딩 에이전트가 자동으로 정적 Hugging Face Space를 구축했는데, 이는 두 개의 기존 Space(하나는 이미지 생성용, 다른 하나는 단일 이미지 3‑D 재구성용)를 연결하여 파리 기념비를 3‑D 가우시안 스플랫으로 보여주며, `agents.md`가 어떤 Space라도 멀티미디어 파이프라인의 조합 가능한 구성 요소로 변환함을 보여준다.
Notion에서의 OpenAI Codex 통합
Notion은 OpenAI Codex를 사용하여 기능 개발을 자동화하고, 엔지니어와 관리자가 주가 아닌 시간 단위로 프로덕션 준비 코드를 출시할 수 있게 한다.
OpenAI 지능 시대 산업 정책
OpenAI는 초지능의 혜택이广泛 공유되도록 보장하기 위해 사람 우선 산업 정책 아이디어 세트를 제안하고, 관련 연구를 지원하기 위한 장학금 프로그램을 출시했습니다.
GitHub CI를 Hugging Face Jobs로 마이그레이션하기
Hugging Face는 서버리스 Hugging Face Jobs 인프라에서 GitHub Actions를 실행하는 방법을 소개하며, 이로 인해 GPU 가속 CI를 가능하게 하고 CPU 작업 실행 시간을 최대 30% 단축합니다.
vime RL 프레임워크 출시
vLLM은 오픈소스 RL pós트레이닝 프레임워크인 vime를 소개합니다. 이는 Megatron 훈련과 vLLM 추론을 통합하여 LLM 강화 학습을 위한 안정적이고 효율적인 파이프라인을 제공합니다.
OpenAI 기밀 S-1 제출
OpenAI는 SEC에 기밀 S-1 초안을 제출했으며,これにより 회사는 특정 목표를 추구하기 위해 비공개 상태를 유지하면서 공개할 수 있는 옵션을 제공합니다.
Google DeepMind Guided Learning AI 시에라리온 시험
시에라리온에서 진행된 사전 등록된 시험은 AI 기반 Guided Learning이 교사 주도 보조 도구로 사용될 경우, 8주 동안 일반적인 학습 진도의 최대 2.5년 수준까지 수학 진전을 가속할 수 있음을 보여줍니다.
OpenAI AGI 배포 및 개발 전략 계획
OpenAI는 자동화된 AI 연구, 경제 가속화, 그리고 지구상의 모든 사람에게 개인 AGI 제공에 초점을 맞춰 AGI가 인류 전체에 이익이 되도록 하는 전략 계획을 발표했습니다.
OpenEnv: 오픈소스 AI를 위한 에이전틱 RL 환경 표준화
Hugging Face는 OpenEnv를 커뮤니티 조정 프로젝트로 전환하여 에이전틱 강화 학습 환경의 상호 운용성 레이어로 제공하고 있습니다.
OpenAI 경제 연구 교환 출시
OpenAI은 외부 연구자가 OpenAI 도구와 데이터 세트에 접근하여 AI의 경제적 영향에 대한 독립적인 경험적 증거를 생산할 수 있도록 Economic Research Exchange를 출시했습니다.
vLLM Semantic Router v0.3 Themis 릴리스 노트
vLLM Semantic Router v0.3 Themis는 상태 저장 프로덕션 라우팅을 도입하며, 세션 인식 에이전트 라우팅 (SAAR), 표준 구성 계약, 그리고 AMD ROCm 및 Intel OpenVINO에 대한 확장된 하드웨어 지원을 특징으로 합니다.
NVIDIA Nemotron 3.5 콘텐츠 안전 릴리스
NVIDIA는 맞춤 정책 적용 및 선택적 추론 흔적을 갖춘 4B 파라미터 멀티모달, 다국어 안전 모델인 Nemotron 3.5 콘텐츠 안전을 기업용 AI를 위해 출시했습니다.
Endava AI 통합: OpenAI 에이전트로 소프트웨어 배달 재설계
Endava는 11,000명의 직원에 걸쳐 OpenAI 기술을 통합하여 소프트웨어 배달과 운영 워크플로를 재설계했으며, AI를 생산성 도구에서 핵심 운영 모델로 전환했습니다.
ChatGPT 꿈꾸는 메모리 업데이트
OpenAI는 '꿈꾸기' 기반의 더 강력하고 계산 효율적인 메모리 아키텍처를 출시하여 ChatGPT가 사용자 컨텍스트, 선호도, 시간 민감 정보를 어떻게 합성, 업데이트, 회상하는지를 개선했습니다.
OpenAI 지능 시대 바이오디펜스 액션 플랜
OpenAI는 책임 있는 방어자들에게 고급 AI 역량을 제공하여 생물학적 회복력을 강화하는 바이오디펜스 액션 플랜을 출시했으며, 구체적으로 GPT-Rosalind 모델을 활용합니다.
TITLE: Hugging Face hf CLI 에이전트‑최적화 재설계, 토큰 사용량을 절감하고 성공률을 높인다
SUMMARY: Hugging Face는 hf CLI의 에이전트‑최적화 재설계를 발표했으며, 토큰 사용량을 최대 6배 절감하고 Claude Code와 Codex와 같은 코딩 에이전트의 성공률을 향상시킵니다.
vLLM에서의 NVIDIA Nemotron 3 Ultra 지원
vLLM이 하이브리드 Transformer-Mamba MoE 아키텍처를 통해 장기 실행 자율 에이전트 워크플로우에 최적화된 550B 파라미터 모델인 NVIDIA Nemotron 3 Ultra에 대한 Day-0 지원을 발표했습니다.
GPT-Rosalind 업데이트: 생명과학 역량 및 연구 도구 강화
OpenAI는 GPT-Rosalind를 업데이트하여 GPT-5.5의 에이전트형 기능을 의약 화학, 유전체학, 습식 랙 문제 해결 분야의 전문 지능과 통합하여 기업 규모의 생명과학 연구를 지원합니다.
챗봇을 넘어선 직접 선호 최적화
제공된 소스 자료는 Hugging Face의 429 속도 제한 오류 페이지이며, Direct Preference Optimization과 관련된 기술적 내용이 포함되어 있지 않습니다.
제목: Wasmer가 Codex를 사용하여 엣지용 Node.js 런타임을 구축한 방법
요약: Wasmer는 OpenAI의 Codex를 활용하여 WebAssembly 샌드박스 내에서 Node.js 워크로드를 실행할 수 있는 JavaScript 런타임인 Edge.js를 개발했으며, 이로 인해 개발 시간이 예상했던 1년에서 2주로 단축되었습니다.
OpenAI 프론티어 AI 민주적 거버넌스를 위한 블루프린트
OpenAI는 국가 표준화, CAISI 강화, 그리고 정부 전반 탄력성 계획을 통해 점점 더 능력이 향상된 AI 시스템을 관리하기 위한 미국을 위한 세 부분 연방 프레임워크를 제안하는 블루프린트를 발표했습니다.
OpenAI 공공 정책 의제
2026년 6월 3일, OpenAI는 안전, 청소년 보호, 교육, 노동력 전환, 딥페이크 및 AI 인프라 전반에 걸친 미션, 원칙 및 정책 우선순위를 개괄하는 공공 정책 의제를 발표했습니다.
Hugging Face Rate Limit로 인해 'Adding MCP Tools to Reachy Mini' 게시물에 접근 불가
요약: Hugging Face 링크가 블로그 게시물 'Adding MCP Tools to Reachy Mini'에 대해 429 rate limit 오류를 반환하므로 요약할 내용이 없습니다.
vLLM을 활용한 빠르고 효율적인 LLM 추론 코스 출시
vLLM이 DeepLearning.AI 및 Red Hat과 협력하여 전체 AI 배포 라이프사이클을 교육하기 위한 무료 중급 코스인 "Fast & Efficient LLM Inference with vLLM"을 출시했습니다.
제목: Holo3.1: 빠른 & 로컬 컴퓨터 사용 에이전트
요약: Holo3.1에 대한 제공된 소스 자료는 429 속도 제한 오류로 인해 사용할 수 없으며, 기술 세부 사항이 제공되지 않았습니다.
Travelers는 OpenAI를 활용한 AI 기반 클레임 어시스턴트를 배포합니다
Travelers는 OpenAI의 Realtime API를 기반으로 한 전국 규모의 AI 클레임 어시스턴트를 출시하여 자동차 재산 손해 청구의 첫 번째 손실 통보를 자동화하고, 사용자의 85-90%가 자율적으로 청구를 완료할 수 있도록 했습니다.
ChatGPT Sites: Codex를 통한 내부 페이지 및 경량 앱 생성
OpenAI는 사용자가 Codex 데스크톱 앱에서 직접 내부 웹사이트와 경량 대화형 앱을 생성, 배포, 공유할 수 있도록 하는 기능인 ChatGPT Sites를 도입했습니다.
모든 역할, 도구, 워크플로우를 위한 Codex
OpenAI는 Codex에 새로운 역할별 플러그인, 인터랙티브 사이트, 인플레이스 주석을 발표하여 개발자를 넘어 분석가, 마케터, 영업, 투자자, 은행가 등으로 사용 범위를 확장했습니다.
OpenAI 청소년 AI 안전 제안 및 글로벌 리더십 이니셔티브
OpenAI는 국제 청소년 안전 연구소 설립과 G7 정상회의에서 논의될 연령에 적합한 AI 보호를 위한 9가지 원칙 프레임워크를 제안했습니다.
OpenAI Codex 지식 업무로의 확장
OpenAI는 Codex가 주간 활성 사용자 5백만 명을 달성했다고 보고하며, 지식 근로자는 현재 사용자 기반의 20%를 차지하고 개발자보다 세 배 더 빠르게 성장하고 있다고 밝혔습니다.
vLLM Session-Aware Agentic Routing (SAAR) 출시
vLLM은 세션 연속성을 유지하고 도구 루프 및 제공자 상태 전환 중 안전하지 않은 모델 전환을 방지함으로써 장기 호리즌 LLM 에이전트의 비용을 줄이는 모델 선택 정책인 Session-Aware Agentic Routing (SAAR)를 도입합니다.
vLLM-Omni는 AutoRound 양자화로 추론을 가속화합니다
vLLM-Omni는 이제 Intel의 AutoRound 포스트 트레이닝 양자화를 통합하여, W4A16 양자화를 통해 모델 크기를 최대 62% 줄이면서 정확도를 유지하고 Intel XPU 및 NVIDIA GPU에서 성능 향상을 잠금 해제합니다.