5551

OpenAI 의료 프롬프트 템플릿

OpenAI는 진단 검사 선택, 감별 진단 생성, 평가 및 계획 작성, 진료 기록 문서화, 환자 상담, 치료 전환 조정, 가이드라인 요약, 임상 참고 자료 검색 등과 같은 임상 작업을 위한 빈칸 채우기 프롬프트 템플릿을 제공하는 Healthcare 페이지를 발표했습니다.

5552

CyberAgent AI 통합: ChatGPT Enterprise 및 Codex 활용

CyberAgent는 자발적 채택 문화와 엔터프라이즈 수준 보안을 통해 ChatGPT Enterprise와 Codex를 비즈니스 운영에 통합함으로써 AI 도구의 월간 활성 사용자 비율을 93% 달성했습니다.

5553

Sentence Transformers v5.4: 멀티모달 임베딩 및 리랭커 모델

Sentence Transformers v5.4는 텍스트, 이미지, 오디오, 비디오의 인코딩 및 비교를 위한 멀티모달 임베딩 및 리랭커 모델을 도입합니다.

5554

Waypoint-1.5 릴리스 노트

Hugging Face와 Overworld가 Waypoint-1.5를 출시했습니다. 이 실시간 비디오 세계 모델은 고품질 인터랙티브 생성 환경을 소비자 GPU에서 로컬로 실행할 수 있게 합니다.

5555

OpenAI 엔터프라이즈 AI 전략 및 프론티어 플랫폼

OpenAI는 OpenAI Frontier를 회사 전체 에이전트를 위한 통합 인텔리전스 레이어로 도입하고 직원 워크플로를 위한 통합 AI 슈퍼앱을 개발함으로써 AI 실험에서 기업 배포로 전환하고 있습니다.

5556

OpenAI 아동 안전 블루프린트

OpenAI는 법률 현대화, 제공자 보고 개선, AI 시스템에서의 안전 중심 설계 조치 구현을 통해 미국 아동 보호 프레임워크를 강화하는 정책 블루프린트를 도입했습니다.

5557

Safetensors, PyTorch Foundation에 합류

Safetensors는 벤더 중립적인 거버넌스와 커뮤니티 주도 개발을 보장하기 위해 PyTorch Foundation 및 Linux Foundation 아래의 재단 호스팅 프로젝트로 전환되었습니다.

5558

vLLM 프리필-디코드 분산 처리 with MORI-IO

vLLM은 AMD의 MORI-IO 커넥터를 사용하여 단일 노드 8-GPU MI300X 환경에서 프리필-디코드 분산 처리를 구현하고, 인터-토큰 지연(ITL) 스파이크를 제거함으로써 2.5배 높은 굿풋을 달성합니다.

5559

OpenAI Safety Fellowship 프로그램 발표

OpenAI는 외부 연구자를 대상으로 2026년 9월 14일부터 2027년 2월 5일까지 AI 안전 및 정렬에 대한 고임팩트 연구를 수행하는 OpenAI Safety Fellowship 프로그램을 시작했습니다.

5560

Gemma 4 릴리스 노트: 추론 및 에이전트를 위한 고지능 오픈 모델

Google DeepMind는 고급 추론, 에이전트 워크플로, 그리고 효율적인 온디바이스 배포를 위해 설계된 Apache 2.0 라이선스 하의 오픈 모델 패밀리인 Gemma 4를 출시했습니다.

5561

OpenAI, TBPN 인수 – 전략적 미디어 통합 및 편집 독립성

OpenAI는 AI 중심 대화로 알려진 미디어 플랫폼 TBPN을 인수하여 OpenAI 전략 조직 내에 편집 독립성을 구축하고 TBPN의 커뮤니케이션 전문성을 활용한다고 발표했습니다.

5562

OpenAI Codex 팀을 위한 유연한 가격 정책

OpenAI는 ChatGPT Business 및 Enterprise 작업 공간에서 Codex 전용 시트에 대한 사용량 기반 요금제를 도입하여 팀 도입 및 파일럿 프로그램의 장벽을 낮추었습니다.

5563

Gemma 4 on vLLM: 고급 추론 및 멀티모달 기능

vLLM은 Gemma 4에 대한 Day 0 지원을 도입했습니다. Gemma 4는 Google의 오픈 모델 패밀리로, 고급 추론, 멀티모달 입력 및 TPUs, GPUs, XPUs에 걸친 광범위한 하드웨어 호환성을 특징으로 합니다.

5564

Gemma 4 출시: 온디바이스 지원을 갖춘 오픈 소스 멀티모달 모델

Google DeepMind의 새로운 오픈 소스 멀티모달 제품군인 Gemma 4가 이미지, 오디오, 비디오 지원, 최대 256K 컨텍스트, 그리고 transformers, llama.cpp, MLX, Rust, WebGPU와의 day-0 호환성을 갖추고 Hugging Face에 출시되었습니다.

5565

산다칸 중앙 시장 표지판 세로 텍스트 2024년 – “2006”

2024년 산다칸 중앙 시장 메인 표지판 오른쪽에 있는 세로 텍스트는 “2006”입니다.

5566

Falcon Perception 및 Falcon OCR 출시

Hugging Face와 TII는 오픈 보카뷸러리 그라운딩을 위한 0.6B 파라미터 초기 융합 트랜스포머인 Falcon Perception과 고처리량 문서 이해를 위한 0.3B 파라미터 모델인 Falcon OCR을 소개합니다.

5567

Gradient Labs 은행용 AI 계정 관리자

Gradient Labs는 OpenAI의 GPT-5.4 mini 및 nano 모델을 기반으로 하는 AI 에이전트를 배포하여 은행 고객에게 복잡하고 규정을 준수하는 금융 절차를 처리할 수 있는 전담 AI 계정 관리자를 제공합니다.

5568

Gradio Server: 맞춤 프론트엔드를 Gradio 백엔드와 통합하기

Hugging Face는 `gradio.Server`라는 FastAPI 확장을 소개합니다. 이를 통해 개발자는 맞춤 프론트엔드 프레임워크를 자유롭게 사용하면서도 Gradio의 큐, API 인프라 및 ZeroGPU 지원을 그대로 유지할 수 있습니다.

5569

Granite 4.0 3B Vision 릴리스 노트 / 새로운 기능

IBM은 엔터프라이즈 문서 이해를 위해 최적화된 소형 멀티모달 모델인 Granite 4.0 3B Vision을 출시했으며, 고정밀 테이블 추출, 차트 추론 및 키-값 쌍 추출 기능을 제공합니다.

5570

OpenAI 자금 조달 및 인프라 전략 업데이트

OpenAI는 8,520억 달러의 사후 가치에서 1,220억 달러의 약정 자본을 조달하여 컴퓨팅 인프라를 확장하고 통합 AI 슈퍼앱을 개발하고 있습니다.

5571

OpenMed CodonRoBERTa 다중 종 mRNA 언어 모델 출시

OpenMed는 CodonRoBERTa-large-v2(당혹도 4.10, CAI 0.404)를 포함한 엔드‑투‑엔드 단백질 엔지니어링 파이프라인과 55 GPU‑시간(≈ $165)으로 학습된 25종 코돈 최적화 모델 스위트를 출시했습니다.

5572

TRL v1.0 릴리스 노트 / 새로운 내용

Hugging Face가 75개 이상의 방법을 구현한 안정적인 포스트 트레이닝 라이브러리인 TRL v1.0을 출시했습니다. 이 라이브러리는 빠른 실험 반복과 프로덕션 수준의 신뢰성을 균형 있게 맞추는 이중 트랙 안정성 모델을 특징으로 합니다.

5573

vLLM 숨겨진 상태 추출 시스템

vLLM v0.18.0은 추측 디코딩 초안 모델 훈련을 위해 내부 모델 표현을 고성능으로 검색할 수 있는 네이티브 숨겨진 상태 추출 시스템을 도입합니다.

5574

Qwen3.5-Omni 릴리스 노트

Qwen은 텍스트, 이미지, 오디오, 비디오를 처리하고 256k 컨텍스트, 113개 언어 음성 인식, 36개 언어 합성을 지원하며, 의미 중단, 웹 검색, 음성 제어, 음성 클로닝과 같은 실시간 기능을 추가한 새로운 옴니모달 LLM인 Qwen3.5-Omni를 발표했습니다.

5575

Google DeepMind AI 지원 포인터

Google DeepMind은 Gemini 기반 AI 지원 포인터를 개발하고 있으며, 복잡한 텍스트 프롬프트를 직관적인 포인팅 및 음성 명령으로 대체하여 다양한 애플리케이션에서 디지털 콘텐츠와 상호작용할 수 있게 합니다.

5576

STADLER AI 구현 및 생산성 향상

STADLER는 230년 역사의 산업 재활용 기업으로, OpenAI의 ChatGPT를 전사적인 생산성 레이어로 도입함으로써 지식 작업에서 30-40%의 시간 절감과 초안 작성 속도를 2.5배 향상시켰습니다.

5577

Hugging Face OpenClaw 마이그레이션 가이드

Hugging Face는 제한된 Claude 모델에서 오픈소스 대안으로 OpenClaw 에이전트를 마이그레이션하기 위해 Inference Providers와 로컬 llama.cpp 설정 두 가지 방법을 제공합니다.

5578

Gemini 3.1 Flash Live 릴리스 노트 / 새로운 소식

Google DeepMind는 자연스러운 실시간 대화를 위해 정밀도가 향상되고 지연 시간이 낮아진 고품질 오디오 및 음성 모델인 Gemini 3.1 Flash Live를 출시했으며, 전 세계적인 이용 가능성을 확대했습니다.

5579

Google DeepMind의 AI 유해 조작 연구

Google DeepMind는 AI가 인간의 사고와 행동을 유해하게 조작하는 위험을 측정하고 완화하기 위한 새로운 연구와 실증 검증된 툴킷을 발표했습니다.

5580

Lyria 3 Pro 출시: Google 제품 전반에 걸친 더 길고 구조를 인식하는 음악 생성

DeepMind는 구조 인식을 갖춘 최대 3분 길이의 트랙을 생성하는 음악 생성 모델 Lyria 3 Pro를 발표했으며, 이제 Vertex AI, AI Studio, Google Vids, Gemini, ProducerAI와 같은 Google 제품에 통합되었습니다.

5581

OpenAI Model Spec: 명시적 모델 행동을 위한 프레임워크

OpenAI는 의도된 AI 모델 행동을 명시적이고 읽기 쉬우며 사용자, 개발자, 연구자가 수정할 수 있도록 설계된 공식적인 공개 프레임워크인 Model Spec를 도입했습니다.

5582

OpenAI 안전 버그 현상금 프로그램 시작

OpenAI는 기존 보안 취약점을 벗어나는 AI 남용 및 안전 위험을 식별하기 위해 공개 안전 버그 현상금 프로그램을 시작했으며, 특히 에이전시 위험, 독점 정보 유출 및 플랫폼 무결성을 목표로 합니다.

5583

OpenAI 청소년 안전 정책 팩 및 gpt-oss-safeguard

OpenAI는 프롬프트 기반 안전 정책과 오픈 가중치 gpt-oss-safeguard 모델을 공개하여 개발자가 AI 애플리케이션에서 청소년을 위한 연령에 맞는 보호 장치를 구현할 수 있도록 지원합니다.

5584

OpenAI 재단 업데이트

OpenAI는 재단이 향후 1년 동안 생명 과학, 경제적 영향, AI 회복력 및 커뮤니티 프로그램에 최소 10억 달러를 투자해 AGI가 인류에게 혜택을 주도록 할 것이라고 발표했습니다.

5585

OpenAI, Agentic Commerce Protocol을 통해 ChatGPT의 제품 발견을 확장

OpenAI는 확장된 Agentic Commerce Protocol(ACP)로 구동되는 향상된 시각적 쇼핑 및 제품 발견 기능을 ChatGPT에 도입하여 사용자가 제품을 찾고 비교하는 과정을 간소화했습니다.

5586

음성 에이전트를 위한 EVA 엔드‑투‑엔드 평가 프레임워크

EVA는 정확도와 대화 경험을 동시에 평가하는 새로운 엔드‑투‑엔드 프레임워크로, 작업 성공과 사용자 만족 사이에 일관된 트레이드‑오프가 존재함을 밝혀냅니다.

5587

vLLM Model Runner V2 릴리스 노트 / 새로운 내용

vLLM은 모델 러너를 처음부터 재구현한 Model Runner V2 (MRV2)를 도입했으며, GPU 네이티브, 비동기 우선, 모듈식 아키텍처를 통해 처리량을 향상하고 지연 시간을 감소시킵니다.

5588

OpenAI Sora 2 안전 프레임워크

OpenAI는 Sora 2에 대한 안전 아키텍처를 상세히 설명했으며, 출처 신호, 동의 기반 외모 관리, 그리고 오디오와 비디오에 대한 엄격한 콘텐츠 필터링에 중점을 두고 있습니다.

5589

NVIDIA Nemotron을 활용한 도메인 특화 임베딩 파인튜닝 – 하루 안에

NVIDIA와 Hugging Face는 단일 GPU, 하루 안에 완료되는 파이프라인을 공개했으며, Llama‑Nemotron‑Embed‑1B‑v2 모델을 합성 도메인 데이터로 파인튜닝하여 10% 이상의 검색 성능 향상과 실제 기업 데이터셋에서 최대 26% 개선을 달성했습니다.

5590

OpenAI 내부 코딩 에이전트 모니터링 시스템

OpenAI는 내부 코딩 에이전트에서의 불일치 및 보안 위반을 감지하기 위해 GPT-5.4 Thinking 기반 모니터링 시스템을 배포했으며, 복잡하고 도구가 풍부한 워크플로우에서만 종종 나타나는 행동을 식별합니다.

5591

OpenAI가 Astral을 인수합니다

OpenAI는 Astral을 인수하여 uv, Ruff, ty와 같은 오픈소스 Python 도구들을 Codex 생태계에 통합하고, AI 에이전트가 전체 소프트웨어 개발 라이프사이클에 참여할 수 있도록 합니다.

5592

Qwen3.5-Max-Preview 릴리스 (LMSys Arena)

Qwen은 정식 출시가 2주 내에 예정된 가운데, 커뮤니티 평가를 위해 Qwen3.5-Max-Preview를 LMSys Arena에 배포했습니다.

5593

Hugging Face의 오픈 소스 현황: 2026년 봄

Hugging Face는 2025년 모델 다운로드 수에서 중국이 미국을 추월하고, 로보틱스가 가장 큰 데이터셋 카테고리로 급격히 부상하는 특징을 가진 2025년 오픈 소스 AI 생태계의 대규모 확장을 보고합니다.

5594

Google DeepMind, AGI 향상 측정을 위한 인지 프레임워크

Google DeepMind는 인지 분류 체계와 3단계 평가 프로토콜을 도입하여 인공지능이 인공 일반 지능(AGI)으로 나아가는 진전을 실증적으로 측정합니다.

5595

Holotron-12B 고처리량 컴퓨터 사용 에이전트

H Company는 NVIDIA Nemotron-Nano-2 VL 기반의 멀티모달 컴퓨터 사용 모델인 Holotron-12B를 출시했으며, 하이브리드 SSM-Attention 아키텍처를 사용해 에이전트 작업에 대한 높은 추론 처리량을 달성합니다.

5596

OpenAI GPT-5.4 mini 및 nano 릴리스 노트

OpenAI는 고효율 소형 모델인 GPT-5.4 mini와 nano를 출시했으며, 이 모델들은 GPT-5.4 기능을 고용량 워크로드에 제공하면서 지연 시간과 비용을 크게 낮춥니다.

5597

OpenAI 일본 청소년 안전 청사진

OpenAI 일본은 청소년 안전을 편리함 및 프라이버시보다 우선시하는 프레임워크인 일본 청소년 안전 청사진을 도입했습니다. 이는 AI와 관련된 위험으로부터 젊은 사용자를 보호하기 위한 것입니다.

5598

OpenAI 연구: 근로자들이 ChatGPT를 활용한 보상 인사이트

OpenAI 연구에 따르면 미국 근로자들은 고숙련·투명성 낮은 직무에서 특히 급여 벤치마크와 보상 안내를 얻기 위해 하루에 거의 300만 건의 메시지를 ChatGPT에 보낸다.

5599

OpenAI Codex Security: 시스템이 SAST 보고서 시드를 피하는 이유

OpenAI의 Codex Security는 정적 애플리케이션 보안 테스트(SAST) 보고서로 시작하는 것을 피함으로써 분석이 조기에 좁아지는 것을 방지하고, 변환 체인을 통해 보안 불변식이 실제로 유지되는지를 검증하는 데 집중합니다.

5600

BAIR가 소개하는 SPEX와 ProxySPEX: 확장 가능한 LLM 상호작용 탐색

BAIR는 신호 처리와 코딩 이론을 활용하여 대규모로 특징, 학습 데이터 및 모델 구성 요소 간의 영향력 있는 상호작용을 식별하는 알고리즘인 SPEX와 ProxySPEX를 소개했습니다.