5651

Holotron-12B 고처리량 컴퓨터 사용 에이전트

H Company는 NVIDIA Nemotron-Nano-2 VL 기반의 멀티모달 컴퓨터 사용 모델인 Holotron-12B를 출시했으며, 하이브리드 SSM-Attention 아키텍처를 사용해 에이전트 작업에 대한 높은 추론 처리량을 달성합니다.

5652

OpenAI GPT-5.4 mini 및 nano 릴리스 노트

OpenAI는 고효율 소형 모델인 GPT-5.4 mini와 nano를 출시했으며, 이 모델들은 GPT-5.4 기능을 고용량 워크로드에 제공하면서 지연 시간과 비용을 크게 낮춥니다.

5653

OpenAI 일본 청소년 안전 청사진

OpenAI 일본은 청소년 안전을 편리함 및 프라이버시보다 우선시하는 프레임워크인 일본 청소년 안전 청사진을 도입했습니다. 이는 AI와 관련된 위험으로부터 젊은 사용자를 보호하기 위한 것입니다.

5654

OpenAI 연구: 근로자들이 ChatGPT를 활용한 보상 인사이트

OpenAI 연구에 따르면 미국 근로자들은 고숙련·투명성 낮은 직무에서 특히 급여 벤치마크와 보상 안내를 얻기 위해 하루에 거의 300만 건의 메시지를 ChatGPT에 보낸다.

5655

OpenAI Codex Security: 시스템이 SAST 보고서 시드를 피하는 이유

OpenAI의 Codex Security는 정적 애플리케이션 보안 테스트(SAST) 보고서로 시작하는 것을 피함으로써 분석이 조기에 좁아지는 것을 방지하고, 변환 체인을 통해 보안 불변식이 실제로 유지되는지를 검증하는 데 집중합니다.

5656

BAIR가 소개하는 SPEX와 ProxySPEX: 확장 가능한 LLM 상호작용 탐색

BAIR는 신호 처리와 코딩 이론을 활용하여 대규모로 특징, 학습 데이터 및 모델 구성 요소 간의 영향력 있는 상호작용을 식별하는 알고리즘인 SPEX와 ProxySPEX를 소개했습니다.

5657

P-EAGLE: vLLM에서 병렬 추측 디코딩

vLLM은 모든 초안 토큰을 단일 전방 패스로 생성하는 병렬 추측 디코딩 방법인 P-EAGLE을 도입했으며, NVIDIA B200 GPU에서 기존 EAGLE-3 대비 최대 1.69배의 속도 향상을 제공합니다.

5658

OpenAI, 프롬프트 인젝션에 저항하는 AI 에이전트 설계

OpenAI는 프롬프트 인젝션을 사회공학 문제로 다루면서 방어 전략을 전환하고 있으며, 입력 필터링에만 의존하는 대신 성공적인 조작의 영향을 제한하는 데 초점을 맞추고 있습니다.

5659

OpenAI Responses API 컴퓨터 환경 업데이트

OpenAI는 Responses API에 셸 도구와 호스팅된 컨테이너 작업 공간을 제공하여 모델이 명령줄 인터페이스와 지속적인 런타임 컨텍스트를 통해 실제 작업을 실행할 수 있게 했습니다.

5660

엔지니어링 효율성을 위한 라쿠텐의 OpenAI Codex 통합

라쿠텐은 OpenAI Codex를 엔지니어링 스택에 통합하여 평균 복구 시간(MTTR)을 50% 단축하고, 분기 단위 개발 프로젝트를 몇 주로 압축했습니다.

5661

vLLM에서 NVIDIA Nemotron 3 Super 지원

vLLM은 이제 120억 파라미터 하이브리드 MoE 모델인 NVIDIA Nemotron 3 Super를 지원합니다. 이 모델은 멀티 에이전트 AI에 최적화되어 100만 토큰 컨텍스트 윈도우와 높은 추론 효율성을 제공합니다.

5662

Wayfair OpenAI 통합 사례 연구

Wayfair는 내부 시스템에 OpenAI 모델을 통합하여 3천만 개 아이템의 제품 카탈로그 태깅을 자동화하고, AI 기반 도구인 Wilma를 통해 공급업체 지원을 효율화했습니다.

5663

OpenAI 지시 계층 개선 및 GPT-5 Mini-R

OpenAI는 신뢰할 수 있는 지시를 신뢰할 수 없는 지시보다 우선하도록 모델을 훈련시키기 위한 새로운 강화 학습 데이터셋인 IH-Challenge를 도입했으며, 이를 통해 안전 조정 가능성과 프롬프트 인젝션 내성이 향상된 GPT-5 Mini-R 모델을 만들었습니다.

5664

ChatGPT 수학 및 과학 인터랙티브 비주얼

OpenAI는 ChatGPT에 70개 이상의 핵심 수학 및 과학 개념에 대한 동적인 비주얼 설명을 도입하여 사용자가 변수와 공식 간의 관계를 실시간으로 이해하도록 돕고 있습니다.

5665

vLLM Semantic Router v0.2 Athena 릴리스 노트 / 새로운 내용

vLLM Semantic Router v0.2 Athena는 재구성된 모델 스택, 실험적인 ClawOS 오케스트레이션 레이어, 그리고 고급 모델 선택 프리미티브를 도입하여 의미 기반 라우팅을 다중 에이전트 배포를 위한 전략적 시스템 뇌로 변환합니다.

5666

토큰 흐름을 유지하기: 16개의 오픈소스 RL 라이브러리에서 얻은 교훈

Hugging Face는 16개의 오픈소스 RL 라이브러리를 조사했으며, 비동기 RL 훈련이 추론과 훈련을 서로 다른 GPU 풀로 분리하고, 롤아웃 버퍼를 사용하며, 가중치를 비동기적으로 푸시한다는 점을 발견했으며, Ray가 오케스트레이션을 주도하고 NCCL 브로드캐스트가 일반적인 가중치‑동기화 방법이라는 사실을 확인했습니다.

5667

Hugging Face 스토리지 버킷 출시

Hugging Face는 Xet을 기반으로 하는 가변적이며 S3와 유사한 객체 스토리지 시스템인 Storage Buckets를 도입하여 체크포인트와 처리된 데이터와 같은 중간 ML 아티팩트를 효율적으로 처리합니다.

5668

Google DeepMind: 알파고의 10년 영향

Google DeepMind는 알파고가 2016년에 세계 챔피언을 이긴 승리가 과학, 수학, 그리고 인공 일반 지능(AGI) 추구 분야에서 10년간 AI 혁신을 촉진한 과정을 되돌아봅니다.

5669

OpenAI가 Promptfoo를 인수합니다

OpenAI는 Promptfoo를 인수하여 AI 보안 및 평가 도구를 기업 AI 동료를 구축하기 위한 OpenAI Frontier 플랫폼에 통합합니다.

5670

백만 토큰 컨텍스트 학습을 위한 Ulysses 시퀀스 병렬 처리

Hugging Face는 Accelerate, Transformers, 그리고 TRL에 Ulysses 시퀀스 병렬 처리를 통합하여, 여러 GPU에 걸쳐 어텐션 연산을 분산함으로써 백만 토큰 컨텍스트를 가진 LLM 훈련을 가능하게 했습니다.

5671

LeRobot v0.5.0 릴리스 노트 / 새로운 내용

Hugging Face는 LeRobot v0.5.0을 출시했으며, 전체 Unitree G1 인간형 지원, Pi0-FAST 및 Wall-X와 같은 새로운 VLA 정책, 그리고 데이터셋 성능 최적화를 도입했습니다.

5672

OpenAI Codex 보안 연구 미리보기

OpenAI는 최첨단 모델과 자동 검증을 활용하여 높은 신뢰도의 취약점을 식별하고 실행 가능한 해결책을 제공하는 애플리케이션 보안 에이전트인 Codex Security를 도입했습니다.

5673

Descript GPT-5 더빙 파이프라인, 다국어 비디오 현지화 강화

Descript는 의미와 타이밍을 동시에 최적화하는 GPT‑5 기반 더빙 파이프라인을 공개했으며, 더빙된 비디오 내보내기가 15% 증가하고 지속 시간 일치도가 최대 43포인트 향상되어 확장 가능한 다국어 비디오 현지화를 가능하게 합니다.

5674

Balyasny 자산 관리 AI 연구 엔진 사례 연구

Balyasny 자산 관리는 GPT-5.4를 사용한 중앙 집중형 AI 연구 엔진을 개발하여 심층 연구 작업을 며칠에서 몇 시간으로 단축하고 복잡한 금융 분석을 자동화했습니다.

5675

로보틱스 AI를 임베디드 플랫폼으로 가져오기: 데이터셋 기록, VLA 파인튜닝, 그리고 온-디바이스 최적화

Hugging Face와 NXP는 Vision-Language-Action (VLA) 모델을 i.MX 95 SoC에 배포하기 위한 기술 가이드를 제공하며, 데이터셋 일관성, 아키텍처 분해, 비동기 추론을 강조하여 실시간 로봇 제어를 달성합니다.

5676

OpenAI GPT-5.4 출시: 통합 추론, 코딩 및 컴퓨터 사용 모델, 1M 토큰 컨텍스트

OpenAI는 네이티브 컴퓨터 사용, 1 M 토큰 컨텍스트, 향상된 추론·코딩·도구 기능을 갖춘 통합 최첨단 모델 GPT‑5.4를 출시했으며, 전문 및 에이전트 벤치마크 전반에서 높은 정확도와 낮은 토큰 사용량을 제공합니다.

5677

OpenAI 추론 모델 CoT 제어 가능성 연구

OpenAI 연구에 따르면 현재 최첨단 추론 모델들은 자신의 사고 사슬을 제어하는 데 어려움을 겪고 있으며, 이는 CoT 모니터링이 추론 은폐에 대한 강력한 안전 방어 수단으로 남아 있음을 시사합니다.

5678

GPT-5.4 Thinking 시스템 카드

OpenAI는 GPT-5.4 Thinking에 대한 시스템 카드를 발표했으며, 이는 사이버 보안에서 높은 역량을 위한 특정 안전 완화 조치를 구현한 최초의 범용 추론 모델입니다.

5679

OpenAI AI 교육 이니셔티브: AI 역량 격차 해소

OpenAI는 대학생들이 파워 유저 수준보다 90%에서 99% 낮은 수준으로 AI를 사용하는 "capability overhang"을 해소하기 위해 도구와 기관 파트너십을 도입하고 있습니다.

5680

Hugging Face Modular Diffusers 릴리스

Hugging Face는 재사용 가능한 블록을 혼합·매칭하여 전체 파이프라인을 처음부터 작성하지 않고도 확산 파이프라인을 구축할 수 있는 조합 가능한 프레임워크인 Modular Diffusers를 소개했습니다.

5681

OpenAI, 기업 AI 구현을 위한 Adoption 뉴스 채널 출시

OpenAI는 기업 리더가 AI 실험 단계에서 구체적인 운영 변화와 확장 가능한 도입으로 전환하도록 돕기 위해 비즈니스 중심의 블로그인 Adoption 뉴스 채널을 소개했습니다.

5682

VfL Wolfsburg ChatGPT 엔터프라이즈 구현

VfL Wolfsburg은 조직 전반에 AI 역량을 확장하기 위해 ChatGPT 엔터프라이즈를 구현했으며, 50개 이상의 맞춤형 GPT와 연간 6자리 수의 비용 절감을 달성했습니다.

5683

OpenAI ChatGPT for Excel 베타 및 금융 데이터 통합 발표

OpenAI는 GPT‑5.4 기반의 ChatGPT for Excel (베타)를 출시하고 주요 금융 데이터 제공업체와의 기본 통합을 추가하여 AI 지원 스프레드시트 모델링과 신뢰할 수 있는 시장 데이터에 대한 즉각적인 접근을 가능하게 했습니다.

5684

OpenAI: 비즈니스 혁신을 위한 다섯 가지 AI 가치 모델

OpenAI는 조직을 고립된 AI 파일럿에서 전체 비즈니스 모델 변혁으로 이동시키기 위해 인력 역량 강화, AI‑네이티브 배포, 전문가 역량, 시스템 및 의존성 관리, 프로세스 재설계라는 다섯 가지 전략적 가치 모델을 정의합니다.

5685

OpenAI "Single-minus graviton tree amplitudes are nonzero" 프리프린트 발표

OpenAI는 단일 마이너 중력자 트리 진폭이 반공선성 영역에서 비제로가 될 수 있음을 보여주는 프리프린트를 발표했으며, 이 결과는 AI 모델 GPT‑5.2 Pro의 상당한 지원을 받아 도출되었다.

5686

OpenAI 학습 성과 측정 스위트

OpenAI는 단순 시험 점수를 넘어 학생 학습에 대한 AI의 장기적 영향을 추적하도록 설계된 프레임워크인 학습 성과 측정 스위트를 도입했습니다.

5687

Axios 로컬 AI 통합

Axios는 생산 워크플로우 자동화, 공공 데이터 분석, 새로운 도시 뉴스룸 구축 비용 절감을 통해 고효과 로컬 저널리즘을 확장하기 위해 OpenAI 도구를 활용하고 있습니다.

5688

vLLM Triton Attention Backend 심층 분석

vLLM은 단일 소스 코드 구현을 통해 NVIDIA, AMD, Intel GPU 전반에서 최첨단 성능을 달성하는 휴대 가능한 Triton 기반 어텐션 백엔드를 구현했습니다.

5689

PRX 파트 3: 24시간 안에 텍스트-이미지 모델 훈련하기

Hugging Face와 Photoroom은 32개의 H200 GPU와 $1500 예산으로 24시간 안에 텍스트-이미지 모델을 훈련시켰으며, 픽셀 공간 훈련, 토큰 라우팅, 그리고 표현 정렬을 결합했습니다.

5690

Gemini 3.1 Flash‑Lite 릴리스: 고용량 워크로드를 위한 빠르고 저비용 AI

Google DeepMind는 고용량 워크로드를 위한 빠르고 비용 효율적인 AI 모델인 Gemini 3.1 Flash‑Lite를 출시했으며, 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.50의 가격을 제시합니다.

5691

GPT-5.3 Instant 릴리스 노트

OpenAI는 더 빠른 응답 시간과 향상된 웹 검색 맥락화, 간소화된 대화 흐름을 갖춘 모델인 GPT-5.3 Instant를 출시했습니다.

5692

GPT-5.3 Instant 릴리스: 더 부드럽고, 더 정확한 일상 대화

OpenAI는 GPT‑5.3 Instant를 발표했습니다. 이 업데이트는 일상적인 ChatGPT 대화를 더 부드럽고, 더 정확하게 만들며, 불필요한 거절이나 과도하게 조심스러운 언어에 덜 민감하도록 합니다.

5693

OpenAI와 국방부 간의 협약

OpenAI는 클라우드 전용 아키텍처와 엄격한 안전 가드레일을 적용하여 기밀 환경에 고급 AI 시스템을 배포하기 위해 국방부와 협약을 체결했습니다.

5694

OpenAI와 Amazon 전략적 파트너십

OpenAI와 Amazon은 OpenAI에 대한 500억 달러 투자와 Amazon Bedrock에서의 Stateful Runtime Environment 공동 개발을 포함하는 다년간 전략적 파트너십을 발표했습니다.

5695

Amazon Bedrock의 에이전트를 위한 상태 저장 런타임 환경

OpenAI와 Amazon이 협력하여 Amazon Bedrock에 상태 저장 런타임 환경을 출시했습니다. 이 환경은 AI 에이전트가 다단계 프로덕션 워크플로우 전반에 걸쳐 상태, 신뢰성 및 거버넌스를 유지할 수 있도록 네이티브 AWS 인프라를 제공합니다.

5696

OpenAI와 Microsoft의 파트너십 지속에 관한 공동 성명

OpenAI와 Microsoft는 OpenAI의 새로운 자금 조달 및 Amazon을 포함한 다른 클라우드 제공업체와의 파트너십에도 불구하고 전략적 파트너십이 변함없음을 확인했습니다.

5697

OpenAI 모두를 위한 AI 확장 발표

OpenAI는 SoftBank, NVIDIA, Amazon으로부터 1,100억 달러의 신규 투자를 확보했으며, 사전 평가 가치는 7,300억 달러입니다. 이 자금은 컴퓨팅 인프라와 전 세계 AI 배포를 확대하기 위해 사용됩니다.

5698

OpenAI 정신 건강 안전 업데이트 및 소송 현황

OpenAI는 성인 사용자를 위한 신뢰할 수 있는 연락처 기능을 도입하고 감정적 고통 감지 모델을 강화하는 동시에 캘리포니아에서 정신 건강 관련 법적 절차의 통합을 다루고 있습니다.

5699

vLLM AMD ROCm 어텐션 백엔드 최적화

vLLM은 AMD ROCm용 최적화된 어텐션 백엔드를 도입하여 Instinct MI300X, MI325X, MI355X GPU에서 MHA는 최대 4.4배, MLA는 1.5배 높은 처리량을 제공합니다.

5700

Nano Banana 2 출시: 플래시 속도의 프로급 이미지 생성

Google DeepMind는 Nano Banana 2를 발표했습니다. 이 이미지 생성 모델은 Nano Banana Pro의 고급 기능과 Gemini Flash의 초저지연을 결합하여 고품질의 지식 기반 이미지를 Google 제품에 즉시 제공합니다.