5701

OpenAI와 국방부 간의 협약

OpenAI는 클라우드 전용 아키텍처와 엄격한 안전 가드레일을 적용하여 기밀 환경에 고급 AI 시스템을 배포하기 위해 국방부와 협약을 체결했습니다.

5702

OpenAI와 Amazon 전략적 파트너십

OpenAI와 Amazon은 OpenAI에 대한 500억 달러 투자와 Amazon Bedrock에서의 Stateful Runtime Environment 공동 개발을 포함하는 다년간 전략적 파트너십을 발표했습니다.

5703

Amazon Bedrock의 에이전트를 위한 상태 저장 런타임 환경

OpenAI와 Amazon이 협력하여 Amazon Bedrock에 상태 저장 런타임 환경을 출시했습니다. 이 환경은 AI 에이전트가 다단계 프로덕션 워크플로우 전반에 걸쳐 상태, 신뢰성 및 거버넌스를 유지할 수 있도록 네이티브 AWS 인프라를 제공합니다.

5704

OpenAI와 Microsoft의 파트너십 지속에 관한 공동 성명

OpenAI와 Microsoft는 OpenAI의 새로운 자금 조달 및 Amazon을 포함한 다른 클라우드 제공업체와의 파트너십에도 불구하고 전략적 파트너십이 변함없음을 확인했습니다.

5705

OpenAI 모두를 위한 AI 확장 발표

OpenAI는 SoftBank, NVIDIA, Amazon으로부터 1,100억 달러의 신규 투자를 확보했으며, 사전 평가 가치는 7,300억 달러입니다. 이 자금은 컴퓨팅 인프라와 전 세계 AI 배포를 확대하기 위해 사용됩니다.

5706

OpenAI 정신 건강 안전 업데이트 및 소송 현황

OpenAI는 성인 사용자를 위한 신뢰할 수 있는 연락처 기능을 도입하고 감정적 고통 감지 모델을 강화하는 동시에 캘리포니아에서 정신 건강 관련 법적 절차의 통합을 다루고 있습니다.

5707

vLLM AMD ROCm 어텐션 백엔드 최적화

vLLM은 AMD ROCm용 최적화된 어텐션 백엔드를 도입하여 Instinct MI300X, MI325X, MI355X GPU에서 MHA는 최대 4.4배, MLA는 1.5배 높은 처리량을 제공합니다.

5708

Nano Banana 2 출시: 플래시 속도의 프로급 이미지 생성

Google DeepMind는 Nano Banana 2를 발표했습니다. 이 이미지 생성 모델은 Nano Banana Pro의 고급 기능과 Gemini Flash의 초저지연을 결합하여 고품질의 지식 기반 이미지를 Google 제품에 즉시 제공합니다.

5709

OpenAI와 PNNL, 연방 허가 절차 가속화 파트너십

OpenAI와 태평양 북서부 국립 연구소(PNNL)는 코딩 에이전트를 활용해 국가 환경 정책법(NEPA) 연방 허가 절차를 가속화하는 방안을 평가했으며, 초안 작성 시간을 최대 15% 단축할 수 있음을 보여주었습니다.

5710

OpenAI Codex와 Figma 통합: 원활한 코드‑투‑디자인 워크플로우

OpenAI와 Figma는 Figma MCP Server를 기반으로 한 코드‑투‑디자인 통합을 출시했으며, 사용자가 Codex 코드 생성과 Figma 디자인 캔버스 사이를 원활하게 이동할 수 있게 했습니다.

5711

vLLM MoE 모델을 위한 Multi-LoRA 서빙

vLLM 버전 0.15.0은 Mixture of Experts (MoE) 모델을 위한 최적화된 Multi-LoRA 서빙을 도입하여, 여러 파인튜닝 어댑터가 단일 GPU를 공유함으로써 유휴 컴퓨팅 용량을 줄일 수 있게 합니다.

5712

트랜스포머에서 전문가 혼합 (MoEs)

Hugging Face는 새로운 가중치 로딩 리팩터, 플러그인 가능한 전문가 백엔드, 그리고 네이티브 전문가 병렬성을 통해 Mixture of Experts (MoEs)를 일등 시민으로 만들기 위해 transformers 라이브러리를 재설계했습니다.

5713

OpenAI, 악의적인 AI 사용 방해 보고서 2026년 2월

OpenAI는 위협 행위자들이 소셜 미디어와 웹사이트와 같은 전통적인 도구와 AI 모델을 결합해 악의적인 캠페인을 수행하는 방식을 상세히 다룬 위협 보고서를 발표했습니다.

5714

OpenAI, Arvind KC를 최고 인사 책임자로 임명

OpenAI는 조직 성장을 이끌고 AI 기반 업무 전환 모델을 개발하기 위해 Arvind KC를 최고 인사 책임자로 임명했습니다.

5715

OpenAI, SWE-bench Verified 평가 중단

OpenAI는 결함이 있는 테스트 케이스와 훈련 데이터 오염으로 인해 벤치마크가 최첨단 모델의 코딩 역량을 신뢰할 수 없는 측정 수단이 되었다는 이유로 SWE-bench Verified 점수 보고를 중단했습니다.

5716

OpenAI 프론티어 얼라이언스 파트너 발표

OpenAI는 프론티어 얼라이언스를 출범시켜 McKinsey, BCG, BCG X, Accenture, Capgemini와 파트너십을 맺고 기업이 프론티어 플랫폼을 활용해 AI 동료를 배포하고 확장하도록 돕습니다.

5717

OpenAI 첫 번째 증명 제출

OpenAI는 First Proof 연구 수준 수학 챌린지를 위해 증명 시도를 제출했으며, 내부 모델이 10문제 중 최소 5문제를 해결했을 가능성이 있습니다.

5718

Unsloth와 Hugging Face Jobs로 AI 모델 훈련

Hugging Face는 Unsloth와 Hugging Face Jobs를 통합하여 빠르고 저비용의 LLM 파인튜닝을 가능하게 했으며, 특히 LiquidAI/LFM2.5-1.2B-Instruct와 같은 소형 모델에 최적화되었습니다.

5719

GGML 및 llama.cpp, Hugging Face에 합류

GGML, llama.cpp의 제작자는 Hugging Face에 합류하여 로컬 AI 추론을 위한 지속 가능한 자원을 제공하고 Transformers 라이브러리와 로컬 모델 배포 간의 통합을 간소화합니다.

5720

Gemini 3.1 Pro 릴리즈 노트

Google DeepMind는 Gemini 3.1 Pro를 공개했습니다. 이 새로운 모델은 복잡한 작업에 대한 추론 능력이 크게 향상되었으며, 현재 Gemini API, Vertex AI, Gemini 앱, Notebook LM을 통해 프리뷰로 제공됩니다.

5721

OpenAI 보조금: The Alignment Project

OpenAI는 영국 AI 보안 연구소(UK AISI) 펀드인 The Alignment Project에 $7.5 백만 규모의 보조금을 발표했으며, 이는 AI 정렬 및 안전에 대한 독립 연구를 확대하기 위한 것입니다.

5722

인도용 OpenAI 이니셔티브

OpenAI는 Tata Group 및 기타 기관과 협력하여 주권 AI 인프라를 구축하고 기업 도입을 가속화하며 전국적인 AI 역량 강화를 확대하는 'OpenAI for India'라는 전국 이니셔티브를 시작했습니다.

5723

IBM과 UC Berkeley, IT-Bench와 MAST를 활용해 엔터프라이즈 에이전트 실패 진단

IBM Research와 UC Berkeley는 MAST(멀티에이전트 시스템 실패 분류법)를 도입해 엔터프라이즈 IT 에이전트가 실패하는 이유를 진단했으며, 최첨단 모델은 고립된 검증 오류를 겪는 반면 오픈 모델은 연쇄적인 시스템 붕괴를 겪는 것으로 밝혀졌습니다.

5724

Lyria 3와 Gemini 음악 생성

Google DeepMind가 Lyria 3 생성 음악 모델을 Gemini 앱에 통합하여 사용자가 텍스트 프롬프트 또는 이미지·비디오 업로드를 통해 30초 길이의 AI 생성 트랙을 만들 수 있게 했습니다.

5725

Gradio 6 gr.HTML: 원샷 웹 앱 개발

Gradio 6은 맞춤 템플릿, 범위가 지정된 CSS 및 JavaScript 인터랙티브를 지원하는 향상된 gr.HTML을 도입하여 단일 Python 파일 내에서 복잡한 웹 컴포넌트를 생성할 수 있게 합니다.

5726

OpenAI가 EVMbench를 소개합니다

OpenAI와 Paradigm은 고위험 스마트 계약 취약점을 탐지, 패치 및 악용하는 AI 에이전트의 능력을 평가하도록 설계된 벤치마크인 EVMbench를 출시했습니다.

5727

Google DeepMind AI 국가 파트너십: 인도 확장

Google DeepMind는 과학, 교육, 농업 및 에너지 안보를 위해 최첨단 AI 모델에 대한 접근성을 확대하기 위해 인도 정부 기관 및 기관들과 새로운 파트너십을 구축하고 있습니다.

5728

Qwen 3.5‑397B‑A17B 출시: 1 M 토큰 컨텍스트와 최첨단 멀티모달 성능을 갖춘 하이브리드 선형‑어텐션 MoE 모델

Qwen 3.5‑397B‑A17B는 토큰당 17 billion 파라미터만 활성화하는 397 billion 파라미터 멀티모달 모델로, 언어, 코딩, 추론 및 비전 작업에서 최첨단 성능을 제공하면서 이전 모델보다 최대 19배 빠릅니다.

5729

GPT-5.2 이론 물리학에서 새로운 결과 도출

OpenAI는 GPT-5.2 Pro와 스캐폴드된 GPT-5.2 버전을 사용해 반공선성 영역에서 비제로 글루온 트리 진폭에 관한 새로운 이론 물리학 결과를 도출했다고 발표했습니다.

5730

ChatGPT 잠금 모드 및 고위험 라벨

OpenAI는 프롬프트 인젝션 공격을 완화하고 데이터 유출 위험에 대한 사용자의 제어력을 강화하기 위해 잠금 모드와 고위험 라벨을 도입했습니다.

5731

OpenAI의 Codex 및 Sora에 대한 하이브리드 크레딧 시스템을 통한 액세스 확장

OpenAI는 Codex 및 Sora 사용자를 위한 강제 중단을 방지하기 위해 속도 제한과 구매 가능한 크레딧 시스템을 결합한 실시간 액세스 엔진을 구현했습니다.

5732

OpenAI GABRIEL: GPT를 활용한 사회과학 연구 확장

OpenAI는 GPT를 사용하여 비구조화된 텍스트와 이미지를 사회과학 연구를 위한 정량적 측정값으로 변환하는 오픈소스 Python 툴킷인 GABRIEL을 출시했습니다.

5733

Hugging Face CUDA 커널 에이전트 스킬

Hugging Face는 Claude와 Codex와 같은 코딩 에이전트가 transformers와 diffusers 라이브러리를 위한 프로덕션 수준의 CUDA 커널을 작성하고, 벤치마크하며, 통합할 수 있게 하는 에이전트 스킬을 도입했습니다.

5734

Gemini 3 Deep Think 업데이트

Google DeepMind는 Gemini 3 Deep Think를 업데이트했으며, 이 특화된 추론 모드는 수학, 물리학 및 화학 올림피아드에서 금메달 수준의 성능을 달성하고 이제 선택된 사용자에게 Gemini API를 통해 제공됩니다.

5735

GPT-5.3-Codex-Spark 릴리스 노트

OpenAI는 실시간 코딩 협업에 최적화된 소형 저지연 모델인 GPT-5.3-Codex-Spark를 출시했으며, Cerebras 하드웨어에서 초당 1,000 토큰 이상을 처리합니다.

5736

OpenEnv: 실제 환경에서 도구를 사용하는 에이전트 평가

Hugging Face와 Meta가 OpenEnv를 소개합니다. 이는 실제 시스템 및 Calendar Gym과 같은 프로덕션 급 환경에서 AI 에이전트를 평가하는 오픈소스 프레임워크로, 연구와 프로덕션 신뢰성 사이의 격차를 해소하기 위한 것입니다.

5737

OpenAI 하니스 엔지니어링: Codex를 활용한 무수동 코드 개발

OpenAI는 Codex를 사용해 수동으로 작성된 코드가 전혀 없는 내부 소프트웨어 제품을 개발했으며, 수동 코딩에서 환경 설계 및 에이전트 오케스트레이션으로 전환함으로써 개발 시간을 약 10배 단축했습니다.

5738

Qwen-Image-2.0 릴리스: 전문 인포그래픽 및 포토리얼리즘

Qwen-Image-2.0은 전문 인포그래픽을 위한 1k 토큰 지시를 지원하고, 고충실도 포토리얼리즘을 위한 네이티브 2K 해상도를 제공하는 통합 이미지 생성 및 편집 모델입니다.

5739

Gemini Deep Think는 수학, 물리학 및 컴퓨터 과학 전반에 걸친 자율 연구를 가능하게 합니다

Gemini Deep Think는 연구 수준의 수학, 물리학 및 컴퓨터 과학 문제를 해결하고, 출판 가능한 결과를 도출하며, 미해결 추측을 해결하는 자율 및 협업 에이전트를 구동합니다.

5740

OpenAI, 전쟁부를 위한 GenAI.mil에 ChatGPT 통합

OpenAI는 맞춤형 ChatGPT를 GenAI.mil에 배포하여 전쟁부 직원 300만 명에게 보안이 확보된 비밀 등급이 없는 생성 AI 기능을 제공하고, 행정 및 운영 지원을 돕습니다.

5741

Transformers.js v4 릴리즈 노트 / 새로운 내용

Hugging Face는 Transformers.js v4를 출시했으며, 브라우저와 서버 사이드 런타임 전반에서 하드웨어 가속을 위한 새로운 C++ 재작성 WebGPU 런타임과 독립형 tokenizers 라이브러리를 도입했습니다.

5742

OpenAI 현지화 접근 방식 및 OpenAI for Countries 이니셔티브

OpenAI는 OpenAI for Countries 이니셔티브를 통해 현지화된 AI 시스템 프레임워크를 도입했으며, 각 국가가 최첨단 모델을 현지 언어, 법률 및 문화 규범에 맞게 조정하면서 전 세계 안전 기준을 준수하도록 합니다.

5743

SyGra 2.0.0 스튜디오 릴리스

SyGra 2.0.0은 Studio를 소개합니다. Studio는 YAML 파일을 수동으로 편집할 필요 없이 합성 데이터 생성 워크플로를 설계하고 실행할 수 있는 시각적 대화형 환경입니다.

5744

GPT-5가 세포 자유 단백질 합성 비용을 낮추다

OpenAI와 Ginkgo Bioworks는 폐쇄 루프 자율 실험실 시스템에서 GPT-5를 사용하여 세포 자유 단백질 합성 비용을 40%, 시약 비용을 57% 감소시켰습니다.

5745

OpenAI Trusted Access for Cyber

OpenAI는 보안 전문가들에게 사이버 방어 및 취약점 해결을 가속화하기 위해 GPT-5.3-Codex에 대한 우선적인 접근 권한을 제공하는 신원 기반 프레임워크인 Trusted Access for Cyber를 출시했습니다.

5746

OpenAI Frontier 플랫폼 출시

OpenAI는 공유 비즈니스 컨텍스트, 안전한 실행 환경 및 통합 거버넌스를 갖춘 AI 에이전트를 구축, 배포 및 관리하도록 설계된 엔드‑투‑엔드 플랫폼인 Frontier를 소개했습니다.

5747

GPT-5.3-Codex 릴리스 노트 / 새로운 기능

OpenAI는 GPT-5.3-Codex라는 에이전시 코딩 모델을 출시했습니다. 이 모델은 GPT-5.2-Codex에 비해 성능, 추론 능력 및 속도가 향상되어 복잡하고 장기적인 기술 작업을 자율적으로 실행할 수 있습니다.

5748

GPT-5.3-Codex 시스템 카드

OpenAI는 GPT-5.3-Codex를 출시했습니다. 이 에이전시 코딩 모델은 GPT-5.2-Codex 성능과 GPT-5.2 추론을 통합하여 복잡하고 장기적인 기술 작업을 처리합니다.

5749

OpenAI Codex 앱 서버 아키텍처 및 통합

OpenAI는 Codex 앱 서버를 도입했습니다. 이 JSON-RPC 기반 프로토콜 및 프로세스는 Codex 에이전트 하네스를 다양한 클라이언트에 노출하여 IDE, 웹 런타임 및 터미널 인터페이스 전반에 걸쳐 일관된 에이전트 경험을 제공합니다.

5750

Hugging Face 커뮤니티 평가

Hugging Face는 Community Evals를 도입했습니다. 이는 Hub에서 직접 모델 벤치마크 점수를 보고하고 집계하는 분산 시스템으로, 투명성과 재현성을 높입니다.