501

IBM과 UC Berkeley, IT-Bench와 MAST를 활용해 엔터프라이즈 에이전트 실패 진단

IBM Research와 UC Berkeley는 MAST(멀티에이전트 시스템 실패 분류법)를 도입해 엔터프라이즈 IT 에이전트가 실패하는 이유를 진단했으며, 최첨단 모델은 고립된 검증 오류를 겪는 반면 오픈 모델은 연쇄적인 시스템 붕괴를 겪는 것으로 밝혀졌습니다.

502

Lyria 3와 Gemini 음악 생성

Google DeepMind가 Lyria 3 생성 음악 모델을 Gemini 앱에 통합하여 사용자가 텍스트 프롬프트 또는 이미지·비디오 업로드를 통해 30초 길이의 AI 생성 트랙을 만들 수 있게 했습니다.

503

Gradio 6 gr.HTML: 원샷 웹 앱 개발

Gradio 6은 맞춤 템플릿, 범위가 지정된 CSS 및 JavaScript 인터랙티브를 지원하는 향상된 gr.HTML을 도입하여 단일 Python 파일 내에서 복잡한 웹 컴포넌트를 생성할 수 있게 합니다.

504

OpenAI가 EVMbench를 소개합니다

OpenAI와 Paradigm은 고위험 스마트 계약 취약점을 탐지, 패치 및 악용하는 AI 에이전트의 능력을 평가하도록 설계된 벤치마크인 EVMbench를 출시했습니다.

505

Google DeepMind AI 국가 파트너십: 인도 확장

Google DeepMind는 과학, 교육, 농업 및 에너지 안보를 위해 최첨단 AI 모델에 대한 접근성을 확대하기 위해 인도 정부 기관 및 기관들과 새로운 파트너십을 구축하고 있습니다.

506

Qwen 3.5‑397B‑A17B 출시: 1 M 토큰 컨텍스트와 최첨단 멀티모달 성능을 갖춘 하이브리드 선형‑어텐션 MoE 모델

Qwen 3.5‑397B‑A17B는 토큰당 17 billion 파라미터만 활성화하는 397 billion 파라미터 멀티모달 모델로, 언어, 코딩, 추론 및 비전 작업에서 최첨단 성능을 제공하면서 이전 모델보다 최대 19배 빠릅니다.

507

GPT-5.2 이론 물리학에서 새로운 결과 도출

OpenAI는 GPT-5.2 Pro와 스캐폴드된 GPT-5.2 버전을 사용해 반공선성 영역에서 비제로 글루온 트리 진폭에 관한 새로운 이론 물리학 결과를 도출했다고 발표했습니다.

508

ChatGPT 잠금 모드 및 고위험 라벨

OpenAI는 프롬프트 인젝션 공격을 완화하고 데이터 유출 위험에 대한 사용자의 제어력을 강화하기 위해 잠금 모드와 고위험 라벨을 도입했습니다.

509

OpenAI의 Codex 및 Sora에 대한 하이브리드 크레딧 시스템을 통한 액세스 확장

OpenAI는 Codex 및 Sora 사용자를 위한 강제 중단을 방지하기 위해 속도 제한과 구매 가능한 크레딧 시스템을 결합한 실시간 액세스 엔진을 구현했습니다.

510

OpenAI GABRIEL: GPT를 활용한 사회과학 연구 확장

OpenAI는 GPT를 사용하여 비구조화된 텍스트와 이미지를 사회과학 연구를 위한 정량적 측정값으로 변환하는 오픈소스 Python 툴킷인 GABRIEL을 출시했습니다.

511

Hugging Face CUDA 커널 에이전트 스킬

Hugging Face는 Claude와 Codex와 같은 코딩 에이전트가 transformers와 diffusers 라이브러리를 위한 프로덕션 수준의 CUDA 커널을 작성하고, 벤치마크하며, 통합할 수 있게 하는 에이전트 스킬을 도입했습니다.

512

Gemini 3 Deep Think 업데이트

Google DeepMind는 Gemini 3 Deep Think를 업데이트했으며, 이 특화된 추론 모드는 수학, 물리학 및 화학 올림피아드에서 금메달 수준의 성능을 달성하고 이제 선택된 사용자에게 Gemini API를 통해 제공됩니다.

513

GPT-5.3-Codex-Spark 릴리스 노트

OpenAI는 실시간 코딩 협업에 최적화된 소형 저지연 모델인 GPT-5.3-Codex-Spark를 출시했으며, Cerebras 하드웨어에서 초당 1,000 토큰 이상을 처리합니다.

514

OpenEnv: 실제 환경에서 도구를 사용하는 에이전트 평가

Hugging Face와 Meta가 OpenEnv를 소개합니다. 이는 실제 시스템 및 Calendar Gym과 같은 프로덕션 급 환경에서 AI 에이전트를 평가하는 오픈소스 프레임워크로, 연구와 프로덕션 신뢰성 사이의 격차를 해소하기 위한 것입니다.

515

OpenAI 하니스 엔지니어링: Codex를 활용한 무수동 코드 개발

OpenAI는 Codex를 사용해 수동으로 작성된 코드가 전혀 없는 내부 소프트웨어 제품을 개발했으며, 수동 코딩에서 환경 설계 및 에이전트 오케스트레이션으로 전환함으로써 개발 시간을 약 10배 단축했습니다.

516

Qwen-Image-2.0 릴리스: 전문 인포그래픽 및 포토리얼리즘

Qwen-Image-2.0은 전문 인포그래픽을 위한 1k 토큰 지시를 지원하고, 고충실도 포토리얼리즘을 위한 네이티브 2K 해상도를 제공하는 통합 이미지 생성 및 편집 모델입니다.

517

Gemini Deep Think는 수학, 물리학 및 컴퓨터 과학 전반에 걸친 자율 연구를 가능하게 합니다

Gemini Deep Think는 연구 수준의 수학, 물리학 및 컴퓨터 과학 문제를 해결하고, 출판 가능한 결과를 도출하며, 미해결 추측을 해결하는 자율 및 협업 에이전트를 구동합니다.

518

OpenAI, 전쟁부를 위한 GenAI.mil에 ChatGPT 통합

OpenAI는 맞춤형 ChatGPT를 GenAI.mil에 배포하여 전쟁부 직원 300만 명에게 보안이 확보된 비밀 등급이 없는 생성 AI 기능을 제공하고, 행정 및 운영 지원을 돕습니다.

519

Transformers.js v4 릴리즈 노트 / 새로운 내용

Hugging Face는 Transformers.js v4를 출시했으며, 브라우저와 서버 사이드 런타임 전반에서 하드웨어 가속을 위한 새로운 C++ 재작성 WebGPU 런타임과 독립형 tokenizers 라이브러리를 도입했습니다.

520

OpenAI 현지화 접근 방식 및 OpenAI for Countries 이니셔티브

OpenAI는 OpenAI for Countries 이니셔티브를 통해 현지화된 AI 시스템 프레임워크를 도입했으며, 각 국가가 최첨단 모델을 현지 언어, 법률 및 문화 규범에 맞게 조정하면서 전 세계 안전 기준을 준수하도록 합니다.

521

SyGra 2.0.0 스튜디오 릴리스

SyGra 2.0.0은 Studio를 소개합니다. Studio는 YAML 파일을 수동으로 편집할 필요 없이 합성 데이터 생성 워크플로를 설계하고 실행할 수 있는 시각적 대화형 환경입니다.

522

GPT-5가 세포 자유 단백질 합성 비용을 낮추다

OpenAI와 Ginkgo Bioworks는 폐쇄 루프 자율 실험실 시스템에서 GPT-5를 사용하여 세포 자유 단백질 합성 비용을 40%, 시약 비용을 57% 감소시켰습니다.

523

OpenAI Trusted Access for Cyber

OpenAI는 보안 전문가들에게 사이버 방어 및 취약점 해결을 가속화하기 위해 GPT-5.3-Codex에 대한 우선적인 접근 권한을 제공하는 신원 기반 프레임워크인 Trusted Access for Cyber를 출시했습니다.

524

OpenAI Frontier 플랫폼 출시

OpenAI는 공유 비즈니스 컨텍스트, 안전한 실행 환경 및 통합 거버넌스를 갖춘 AI 에이전트를 구축, 배포 및 관리하도록 설계된 엔드‑투‑엔드 플랫폼인 Frontier를 소개했습니다.

525

GPT-5.3-Codex 릴리스 노트 / 새로운 기능

OpenAI는 GPT-5.3-Codex라는 에이전시 코딩 모델을 출시했습니다. 이 모델은 GPT-5.2-Codex에 비해 성능, 추론 능력 및 속도가 향상되어 복잡하고 장기적인 기술 작업을 자율적으로 실행할 수 있습니다.

526

GPT-5.3-Codex 시스템 카드

OpenAI는 GPT-5.3-Codex를 출시했습니다. 이 에이전시 코딩 모델은 GPT-5.2-Codex 성능과 GPT-5.2 추론을 통합하여 복잡하고 장기적인 기술 작업을 처리합니다.

527

OpenAI Codex 앱 서버 아키텍처 및 통합

OpenAI는 Codex 앱 서버를 도입했습니다. 이 JSON-RPC 기반 프로토콜 및 프로세스는 Codex 에이전트 하네스를 다양한 클라이언트에 노출하여 IDE, 웹 런타임 및 터미널 인터페이스 전반에 걸쳐 일관된 에이전트 경험을 제공합니다.

528

Hugging Face 커뮤니티 평가

Hugging Face는 Community Evals를 도입했습니다. 이는 Hub에서 직접 모델 벤치마크 점수를 보고하고 집계하는 분산 시스템으로, 투명성과 재현성을 높입니다.

529

H Company Holo2-235B-A22B 프리뷰 릴리스

H Company는 UI 로컬라이제이션 모델인 Holo2-235B-A22B Preview를 출시했으며, Screenspot-Pro와 OSWorld G 벤치마크에서 최첨단 성능을 달성했습니다.

530

글로벌 오픈소스 AI 생태계의 미래: DeepSeek에서 AI+까지

Hugging Face는 오픈소스가 중국 AI 조직들의 지배적인 전략이 되어, 고립된 모델 돌파구에서 모델, 하드웨어, 인프라가 통합된 확장 가능한 생태계로 전환된 과정을 분석합니다.

531

텍스트-이미지 모델을 위한 훈련 설계: Ablation에서 얻은 교훈

텍스트-이미지 모델 훈련 설계에 관한 Hugging Face 게시물의 제공된 원본 자료가 429 Too Many Requests 오류로 인해 사용할 수 없습니다.

532

OpenAI Sora 피드 철학

OpenAI는 창의성 중심 순위, 개인화된 추천, 다층 안전 가드레일에 중점을 두어 Sora 피드의 설계 원칙과 안전 프레임워크를 상세히 설명했습니다.

533

Qwen3-Coder-Next 릴리스: 고효율 에이전트 코딩 모델

Qwen3-Coder-Next는 하이브리드 어텐션과 MoE 아키텍처를 기반으로 하는 오픈-웨이트 모델로, SWE-Bench Verified에서 70% 이상을 달성하며 10-20배 더 큰 모델에 필적하는 성능을 제공합니다.

534

Snowflake와 OpenAI의 기업 인텔리전스 파트너십

OpenAI와 Snowflake가 $200 million 규모의 계약을 체결하여 GPT-5.2를 포함한 OpenAI 최첨단 모델을 Snowflake AI Data Cloud에 직접 통합하고, 보안이 확보된 데이터 기반 AI 에이전트와 애플리케이션을 만들 수 있게 합니다.

535

OpenAI Codex 앱 출시 – macOS 및 Windows용 다중 에이전트 데스크톱 인터페이스

OpenAI는 macOS용 Codex 데스크톱 앱을 출시했으며(2026년 3월에 Windows 지원 추가), 개발자가 여러 AI 에이전트를 병렬로 실행·감시·협업하고 재사용 가능한 Skill로 확장하며 반복 작업을 자동화할 수 있는 통합 인터페이스를 제공합니다.

536

Project Genie: Google DeepMind의 인터랙티브 월드 모델 프로토타입

Google DeepMind는 Genie 3 기반의 실험적 연구 프로토타입인 Project Genie를 출시했으며, 이를 통해 사용자는 인터랙티브하고 실시간으로 생성되는 환경을 만들고, 탐험하고, 리믹스할 수 있습니다.

537

OpenAI 사내 데이터 에이전트 내부 살펴보기

OpenAI는 맞춤형 내부 AI 데이터 에이전트를 개발했으며, 이를 통해 직원들은 자연어를 사용해 600페타바이트 규모의 데이터에 대한 복잡한 데이터 분석을 수행할 수 있습니다. 이 에이전트는 다층 컨텍스트 시스템과 자체 학습 추론 루프를 활용합니다.

538

OpenAI, ChatGPT에서 GPT-4o, GPT-4.1 및 o4-mini를 종료합니다

OpenAI는 사용량이 GPT-5.2로 전환됨에 따라 2026년 2월 13일에 ChatGPT에서 GPT-4o, GPT-4.1, GPT-4.1 mini 및 OpenAI o4-mini를 종료합니다.

539

Taisei Corporation ChatGPT Enterprise 구현

Taisei Corporation은 인재 개발 전략의 핵심 요소로 ChatGPT Enterprise를 도입하여 인간 잠재력을 확대하고 건설 산업의 인력 역량을 재구성했습니다.

540

Daggr 소개: 시각적 검사를 통한 AI 앱 프로그래밍 방식 체인

Hugging Face는 Daggr라는 오픈소스 Python 라이브러리를 출시했습니다. 이 라이브러리를 통해 개발자는 Gradio 앱, ML 모델, 사용자 정의 함수를 프로그래밍 방식으로 연결하여 워크플로우를 구성할 수 있으며, 디버깅 및 상태 관리를 위한 시각적 캔버스가 자동으로 생성됩니다.

541

Qwen3-ASR 및 Qwen3-ForcedAligner 릴리스

Qwen은 Qwen3-ASR (1.7B 및 0.6B)와 Qwen3-ForcedAligner-0.6B를 오픈소스로 공개했으며, Apache 2.0 라이선스 하에 최첨단 다국어 음성 인식 및 비자동회귀 타임스탬프 예측 기능을 제공합니다.

542

OpenAI EU 경제 청사진 2.0

OpenAI는 EU 경제 청사진 2.0을 발표했으며, 20,000개의 SME를 교육하는 프로그램, 청소년 안전 보조금, 그리고 정부 파트너십 확대를 통해 유럽의 AI 역량 격차를 해소하고자 합니다.

543

OpenAI EMEA 청소년 및 복지 지원금 2026

OpenAI는 유럽, 중동 및 아프리카 전역의 청소년을 위한 AI 안전, 복지 및 개발에 관한 NGO와 연구자를 지원하기 위해 €500,000 규모의 EMEA 청소년 및 복지 지원금을 시작했습니다.

544

Hugging Face Upskill: 전문가 역량을 에이전트 스킬을 통해 소형 모델로 이전하기

Hugging Face는 Claude Opus 4.5와 같은 고성능 모델을 활용해 검증된 '에이전트 스킬'을 생성하는 도구인 upskill를 소개했습니다. 이 스킬은 CUDA 커널 개발과 같은 복잡한 작업에서 소형 또는 오픈소스 모델의 성능과 토큰 효율성을 향상시킵니다.

545

OpenAI AI 에이전트 링크 안전

OpenAI는 독립적인 웹 인덱스를 통해 이전에 공개된 것으로 확인된 URL만 자동으로 가져올 수 있도록 AI 에이전트를 제한함으로써 URL 기반 데이터 유출을 방지하는 시스템을 구현했습니다.

546

중국 오픈소스 AI 생태계의 아키텍처 선택: DeepSeek R1에서 하드웨어‑우선, MoE‑주도 환경으로

DeepSeek R1의 오픈소스 릴리스 1년 후, 중국 AI 커뮤니티는 가장 큰 단일 모델 성능을 추구하던 것에서 유연하고 비용 효율적이며 하드웨어를 고려한 AI 시스템 구축으로 전환했습니다. Mixture‑of‑Experts (MoE)가 기본 아키텍처가 되어, 요청당 일부 전문가만 활성화함으로써 거대한 모델을 저렴하게 운영할 수 있게 되었습니다. 텍스트‑투‑이미지, 비디오, 오디오, 3‑D, 에이전트 등 멀티모달 경쟁이 폭발했으며, 각 모델은 전체 툴체인과 함께 공개되었습니다. 30 B 이하의 소형 모델이 로컬 배포와 파인튜닝에 인기를 끌었고, 대형 MoE 모델은 교사 네트워크 역할을 수행했습니다. Apache 2.0 및 MIT 라이선스가 주류를 이루며 법적 마찰을 없애고 상업적 채택을 가속화했습니다. 하드웨어‑우선 사고방식이 등장해, 릴리스는 국내 칩(Huawei Ascend, Cambricon, Kunlun 등)에 맞춘 양자화, 추론 및 서빙 스택을 포함하고, 학습 파이프라인도 공개되었습니다. 이제 경쟁 우위는 원시 모델 크기가 아니라 시스템 설계, 배포 효율성, 오픈소스 생태계 통합에 있습니다.

547

Alyah: 아랍어 LLM을 위한 에미리트 방언 벤치마크

Hugging Face와 파트너들은 에미리트 방언에서 아랍어 LLM의 언어·문화 역량을 평가하기 위해 1,173개의 샘플로 구성된 수동 큐레이션 벤치마크인 Alyah를 소개했습니다.

548

PVH와 OpenAI 패션 파트너십

PVH와 OpenAI 파트너십에 대한 제공된 소스 자료는 서버 오류로 인해 이용할 수 없으며, 기술 세부 정보를 검색할 수 없었습니다.

549

GPT-OSS Agentic RL 훈련: 실용적인 회고

Hugging Face와 LinkedIn 연구원들은 GPT-OSS 모델에 대해 안정적인 에이전트 강화 학습을 가능하게 하는 데 필요한 엔지니어링 수정을 상세히 설명했으며, MoE 라우팅, attention sinks, 메모리 효율성에 중점을 두었습니다.

550

OpenAI 프리즘 출시

OpenAI는 GPT‑5.2 기반의 무료 AI‑네이티브 LaTeX 작업공간인 Prism을 출시했습니다. 이 작업공간은 과학 논문 작성, 협업 및 추론을 하나의 환경에 통합하도록 설계되었습니다.