401

Gemma 4 릴리스 노트: 추론 및 에이전트를 위한 고지능 오픈 모델

Google DeepMind는 고급 추론, 에이전트 워크플로, 그리고 효율적인 온디바이스 배포를 위해 설계된 Apache 2.0 라이선스 하의 오픈 모델 패밀리인 Gemma 4를 출시했습니다.

402

OpenAI, TBPN 인수 – 전략적 미디어 통합 및 편집 독립성

OpenAI는 AI 중심 대화로 알려진 미디어 플랫폼 TBPN을 인수하여 OpenAI 전략 조직 내에 편집 독립성을 구축하고 TBPN의 커뮤니케이션 전문성을 활용한다고 발표했습니다.

403

OpenAI Codex 팀을 위한 유연한 가격 정책

OpenAI는 ChatGPT Business 및 Enterprise 작업 공간에서 Codex 전용 시트에 대한 사용량 기반 요금제를 도입하여 팀 도입 및 파일럿 프로그램의 장벽을 낮추었습니다.

404

Gemma 4 on vLLM: 고급 추론 및 멀티모달 기능

vLLM은 Gemma 4에 대한 Day 0 지원을 도입했습니다. Gemma 4는 Google의 오픈 모델 패밀리로, 고급 추론, 멀티모달 입력 및 TPUs, GPUs, XPUs에 걸친 광범위한 하드웨어 호환성을 특징으로 합니다.

405

Gemma 4 출시: 온디바이스 지원을 갖춘 오픈 소스 멀티모달 모델

Google DeepMind의 새로운 오픈 소스 멀티모달 제품군인 Gemma 4가 이미지, 오디오, 비디오 지원, 최대 256K 컨텍스트, 그리고 transformers, llama.cpp, MLX, Rust, WebGPU와의 day-0 호환성을 갖추고 Hugging Face에 출시되었습니다.

406

산다칸 중앙 시장 표지판 세로 텍스트 2024년 – “2006”

2024년 산다칸 중앙 시장 메인 표지판 오른쪽에 있는 세로 텍스트는 “2006”입니다.

407

Falcon Perception 및 Falcon OCR 출시

Hugging Face와 TII는 오픈 보카뷸러리 그라운딩을 위한 0.6B 파라미터 초기 융합 트랜스포머인 Falcon Perception과 고처리량 문서 이해를 위한 0.3B 파라미터 모델인 Falcon OCR을 소개합니다.

408

Gradient Labs 은행용 AI 계정 관리자

Gradient Labs는 OpenAI의 GPT-5.4 mini 및 nano 모델을 기반으로 하는 AI 에이전트를 배포하여 은행 고객에게 복잡하고 규정을 준수하는 금융 절차를 처리할 수 있는 전담 AI 계정 관리자를 제공합니다.

409

Gradio Server: 맞춤 프론트엔드를 Gradio 백엔드와 통합하기

Hugging Face는 `gradio.Server`라는 FastAPI 확장을 소개합니다. 이를 통해 개발자는 맞춤 프론트엔드 프레임워크를 자유롭게 사용하면서도 Gradio의 큐, API 인프라 및 ZeroGPU 지원을 그대로 유지할 수 있습니다.

410

Granite 4.0 3B Vision 릴리스 노트 / 새로운 기능

IBM은 엔터프라이즈 문서 이해를 위해 최적화된 소형 멀티모달 모델인 Granite 4.0 3B Vision을 출시했으며, 고정밀 테이블 추출, 차트 추론 및 키-값 쌍 추출 기능을 제공합니다.

411

OpenAI 자금 조달 및 인프라 전략 업데이트

OpenAI는 8,520억 달러의 사후 가치에서 1,220억 달러의 약정 자본을 조달하여 컴퓨팅 인프라를 확장하고 통합 AI 슈퍼앱을 개발하고 있습니다.

412

OpenMed CodonRoBERTa 다중 종 mRNA 언어 모델 출시

OpenMed는 CodonRoBERTa-large-v2(당혹도 4.10, CAI 0.404)를 포함한 엔드‑투‑엔드 단백질 엔지니어링 파이프라인과 55 GPU‑시간(≈ $165)으로 학습된 25종 코돈 최적화 모델 스위트를 출시했습니다.

413

TRL v1.0 릴리스 노트 / 새로운 내용

Hugging Face가 75개 이상의 방법을 구현한 안정적인 포스트 트레이닝 라이브러리인 TRL v1.0을 출시했습니다. 이 라이브러리는 빠른 실험 반복과 프로덕션 수준의 신뢰성을 균형 있게 맞추는 이중 트랙 안정성 모델을 특징으로 합니다.

414

vLLM 숨겨진 상태 추출 시스템

vLLM v0.18.0은 추측 디코딩 초안 모델 훈련을 위해 내부 모델 표현을 고성능으로 검색할 수 있는 네이티브 숨겨진 상태 추출 시스템을 도입합니다.

415

Qwen3.5-Omni 릴리스 노트

Qwen은 텍스트, 이미지, 오디오, 비디오를 처리하고 256k 컨텍스트, 113개 언어 음성 인식, 36개 언어 합성을 지원하며, 의미 중단, 웹 검색, 음성 제어, 음성 클로닝과 같은 실시간 기능을 추가한 새로운 옴니모달 LLM인 Qwen3.5-Omni를 발표했습니다.

416

Google DeepMind AI 지원 포인터

Google DeepMind은 Gemini 기반 AI 지원 포인터를 개발하고 있으며, 복잡한 텍스트 프롬프트를 직관적인 포인팅 및 음성 명령으로 대체하여 다양한 애플리케이션에서 디지털 콘텐츠와 상호작용할 수 있게 합니다.

417

STADLER AI 구현 및 생산성 향상

STADLER는 230년 역사의 산업 재활용 기업으로, OpenAI의 ChatGPT를 전사적인 생산성 레이어로 도입함으로써 지식 작업에서 30-40%의 시간 절감과 초안 작성 속도를 2.5배 향상시켰습니다.

418

Hugging Face OpenClaw 마이그레이션 가이드

Hugging Face는 제한된 Claude 모델에서 오픈소스 대안으로 OpenClaw 에이전트를 마이그레이션하기 위해 Inference Providers와 로컬 llama.cpp 설정 두 가지 방법을 제공합니다.

419

Gemini 3.1 Flash Live 릴리스 노트 / 새로운 소식

Google DeepMind는 자연스러운 실시간 대화를 위해 정밀도가 향상되고 지연 시간이 낮아진 고품질 오디오 및 음성 모델인 Gemini 3.1 Flash Live를 출시했으며, 전 세계적인 이용 가능성을 확대했습니다.

420

Google DeepMind의 AI 유해 조작 연구

Google DeepMind는 AI가 인간의 사고와 행동을 유해하게 조작하는 위험을 측정하고 완화하기 위한 새로운 연구와 실증 검증된 툴킷을 발표했습니다.

421

Lyria 3 Pro 출시: Google 제품 전반에 걸친 더 길고 구조를 인식하는 음악 생성

DeepMind는 구조 인식을 갖춘 최대 3분 길이의 트랙을 생성하는 음악 생성 모델 Lyria 3 Pro를 발표했으며, 이제 Vertex AI, AI Studio, Google Vids, Gemini, ProducerAI와 같은 Google 제품에 통합되었습니다.

422

OpenAI Model Spec: 명시적 모델 행동을 위한 프레임워크

OpenAI는 의도된 AI 모델 행동을 명시적이고 읽기 쉬우며 사용자, 개발자, 연구자가 수정할 수 있도록 설계된 공식적인 공개 프레임워크인 Model Spec를 도입했습니다.

423

OpenAI 안전 버그 현상금 프로그램 시작

OpenAI는 기존 보안 취약점을 벗어나는 AI 남용 및 안전 위험을 식별하기 위해 공개 안전 버그 현상금 프로그램을 시작했으며, 특히 에이전시 위험, 독점 정보 유출 및 플랫폼 무결성을 목표로 합니다.

424

OpenAI 청소년 안전 정책 팩 및 gpt-oss-safeguard

OpenAI는 프롬프트 기반 안전 정책과 오픈 가중치 gpt-oss-safeguard 모델을 공개하여 개발자가 AI 애플리케이션에서 청소년을 위한 연령에 맞는 보호 장치를 구현할 수 있도록 지원합니다.

425

OpenAI 재단 업데이트

OpenAI는 재단이 향후 1년 동안 생명 과학, 경제적 영향, AI 회복력 및 커뮤니티 프로그램에 최소 10억 달러를 투자해 AGI가 인류에게 혜택을 주도록 할 것이라고 발표했습니다.

426

OpenAI, Agentic Commerce Protocol을 통해 ChatGPT의 제품 발견을 확장

OpenAI는 확장된 Agentic Commerce Protocol(ACP)로 구동되는 향상된 시각적 쇼핑 및 제품 발견 기능을 ChatGPT에 도입하여 사용자가 제품을 찾고 비교하는 과정을 간소화했습니다.

427

음성 에이전트를 위한 EVA 엔드‑투‑엔드 평가 프레임워크

EVA는 정확도와 대화 경험을 동시에 평가하는 새로운 엔드‑투‑엔드 프레임워크로, 작업 성공과 사용자 만족 사이에 일관된 트레이드‑오프가 존재함을 밝혀냅니다.

428

vLLM Model Runner V2 릴리스 노트 / 새로운 내용

vLLM은 모델 러너를 처음부터 재구현한 Model Runner V2 (MRV2)를 도입했으며, GPU 네이티브, 비동기 우선, 모듈식 아키텍처를 통해 처리량을 향상하고 지연 시간을 감소시킵니다.

429

OpenAI Sora 2 안전 프레임워크

OpenAI는 Sora 2에 대한 안전 아키텍처를 상세히 설명했으며, 출처 신호, 동의 기반 외모 관리, 그리고 오디오와 비디오에 대한 엄격한 콘텐츠 필터링에 중점을 두고 있습니다.

430

NVIDIA Nemotron을 활용한 도메인 특화 임베딩 파인튜닝 – 하루 안에

NVIDIA와 Hugging Face는 단일 GPU, 하루 안에 완료되는 파이프라인을 공개했으며, Llama‑Nemotron‑Embed‑1B‑v2 모델을 합성 도메인 데이터로 파인튜닝하여 10% 이상의 검색 성능 향상과 실제 기업 데이터셋에서 최대 26% 개선을 달성했습니다.

431

OpenAI 내부 코딩 에이전트 모니터링 시스템

OpenAI는 내부 코딩 에이전트에서의 불일치 및 보안 위반을 감지하기 위해 GPT-5.4 Thinking 기반 모니터링 시스템을 배포했으며, 복잡하고 도구가 풍부한 워크플로우에서만 종종 나타나는 행동을 식별합니다.

432

OpenAI가 Astral을 인수합니다

OpenAI는 Astral을 인수하여 uv, Ruff, ty와 같은 오픈소스 Python 도구들을 Codex 생태계에 통합하고, AI 에이전트가 전체 소프트웨어 개발 라이프사이클에 참여할 수 있도록 합니다.

433

Qwen3.5-Max-Preview 릴리스 (LMSys Arena)

Qwen은 정식 출시가 2주 내에 예정된 가운데, 커뮤니티 평가를 위해 Qwen3.5-Max-Preview를 LMSys Arena에 배포했습니다.

434

Hugging Face의 오픈 소스 현황: 2026년 봄

Hugging Face는 2025년 모델 다운로드 수에서 중국이 미국을 추월하고, 로보틱스가 가장 큰 데이터셋 카테고리로 급격히 부상하는 특징을 가진 2025년 오픈 소스 AI 생태계의 대규모 확장을 보고합니다.

435

Google DeepMind, AGI 향상 측정을 위한 인지 프레임워크

Google DeepMind는 인지 분류 체계와 3단계 평가 프로토콜을 도입하여 인공지능이 인공 일반 지능(AGI)으로 나아가는 진전을 실증적으로 측정합니다.

436

Holotron-12B 고처리량 컴퓨터 사용 에이전트

H Company는 NVIDIA Nemotron-Nano-2 VL 기반의 멀티모달 컴퓨터 사용 모델인 Holotron-12B를 출시했으며, 하이브리드 SSM-Attention 아키텍처를 사용해 에이전트 작업에 대한 높은 추론 처리량을 달성합니다.

437

OpenAI GPT-5.4 mini 및 nano 릴리스 노트

OpenAI는 고효율 소형 모델인 GPT-5.4 mini와 nano를 출시했으며, 이 모델들은 GPT-5.4 기능을 고용량 워크로드에 제공하면서 지연 시간과 비용을 크게 낮춥니다.

438

OpenAI 일본 청소년 안전 청사진

OpenAI 일본은 청소년 안전을 편리함 및 프라이버시보다 우선시하는 프레임워크인 일본 청소년 안전 청사진을 도입했습니다. 이는 AI와 관련된 위험으로부터 젊은 사용자를 보호하기 위한 것입니다.

439

OpenAI 연구: 근로자들이 ChatGPT를 활용한 보상 인사이트

OpenAI 연구에 따르면 미국 근로자들은 고숙련·투명성 낮은 직무에서 특히 급여 벤치마크와 보상 안내를 얻기 위해 하루에 거의 300만 건의 메시지를 ChatGPT에 보낸다.

440

OpenAI Codex Security: 시스템이 SAST 보고서 시드를 피하는 이유

OpenAI의 Codex Security는 정적 애플리케이션 보안 테스트(SAST) 보고서로 시작하는 것을 피함으로써 분석이 조기에 좁아지는 것을 방지하고, 변환 체인을 통해 보안 불변식이 실제로 유지되는지를 검증하는 데 집중합니다.

441

BAIR가 소개하는 SPEX와 ProxySPEX: 확장 가능한 LLM 상호작용 탐색

BAIR는 신호 처리와 코딩 이론을 활용하여 대규모로 특징, 학습 데이터 및 모델 구성 요소 간의 영향력 있는 상호작용을 식별하는 알고리즘인 SPEX와 ProxySPEX를 소개했습니다.

442

P-EAGLE: vLLM에서 병렬 추측 디코딩

vLLM은 모든 초안 토큰을 단일 전방 패스로 생성하는 병렬 추측 디코딩 방법인 P-EAGLE을 도입했으며, NVIDIA B200 GPU에서 기존 EAGLE-3 대비 최대 1.69배의 속도 향상을 제공합니다.

443

OpenAI, 프롬프트 인젝션에 저항하는 AI 에이전트 설계

OpenAI는 프롬프트 인젝션을 사회공학 문제로 다루면서 방어 전략을 전환하고 있으며, 입력 필터링에만 의존하는 대신 성공적인 조작의 영향을 제한하는 데 초점을 맞추고 있습니다.

444

OpenAI Responses API 컴퓨터 환경 업데이트

OpenAI는 Responses API에 셸 도구와 호스팅된 컨테이너 작업 공간을 제공하여 모델이 명령줄 인터페이스와 지속적인 런타임 컨텍스트를 통해 실제 작업을 실행할 수 있게 했습니다.

445

엔지니어링 효율성을 위한 라쿠텐의 OpenAI Codex 통합

라쿠텐은 OpenAI Codex를 엔지니어링 스택에 통합하여 평균 복구 시간(MTTR)을 50% 단축하고, 분기 단위 개발 프로젝트를 몇 주로 압축했습니다.

446

vLLM에서 NVIDIA Nemotron 3 Super 지원

vLLM은 이제 120억 파라미터 하이브리드 MoE 모델인 NVIDIA Nemotron 3 Super를 지원합니다. 이 모델은 멀티 에이전트 AI에 최적화되어 100만 토큰 컨텍스트 윈도우와 높은 추론 효율성을 제공합니다.

447

Wayfair OpenAI 통합 사례 연구

Wayfair는 내부 시스템에 OpenAI 모델을 통합하여 3천만 개 아이템의 제품 카탈로그 태깅을 자동화하고, AI 기반 도구인 Wilma를 통해 공급업체 지원을 효율화했습니다.

448

OpenAI 지시 계층 개선 및 GPT-5 Mini-R

OpenAI는 신뢰할 수 있는 지시를 신뢰할 수 없는 지시보다 우선하도록 모델을 훈련시키기 위한 새로운 강화 학습 데이터셋인 IH-Challenge를 도입했으며, 이를 통해 안전 조정 가능성과 프롬프트 인젝션 내성이 향상된 GPT-5 Mini-R 모델을 만들었습니다.

449

ChatGPT 수학 및 과학 인터랙티브 비주얼

OpenAI는 ChatGPT에 70개 이상의 핵심 수학 및 과학 개념에 대한 동적인 비주얼 설명을 도입하여 사용자가 변수와 공식 간의 관계를 실시간으로 이해하도록 돕고 있습니다.

450

vLLM Semantic Router v0.2 Athena 릴리스 노트 / 새로운 내용

vLLM Semantic Router v0.2 Athena는 재구성된 모델 스택, 실험적인 ClawOS 오케스트레이션 레이어, 그리고 고급 모델 선택 프리미티브를 도입하여 의미 기반 라우팅을 다중 에이전트 배포를 위한 전략적 시스템 뇌로 변환합니다.