6401

Microsoft와 Hugging Face, Azure AI Foundry를 위한 협업 확대

Microsoft와 Hugging Face는 10,000개 이상의 오픈 소스 모델을 Azure AI Foundry에 통합하기 위해 파트너십을 확대했으며, 이를 통해 다양한 AI 모달리티를 안전하고 엔터프라이즈급으로 배포할 수 있게 되었습니다.

6402

OpenAI Codex: codex-1으로 구동되는 클라우드 기반 코딩 에이전트

OpenAI는 codex-1 모델(최적화된 o3 버전)로 구동되는 클라우드 기반 코딩 에이전트인 Codex를 도입했으며, 격리된 클라우드 컨테이너에서 소프트웨어 엔지니어링 작업을 수행합니다.

6403

OpenAI Codex 연구 미리보기

OpenAI는 codex-1 모델로 구동되는 클라우드 기반 소프트웨어 엔지니어링 에이전트인 Codex를 출시했으며, 이 에이전트는 격리된 샌드박스 환경에서 독립적으로 기능을 작성하고, 버그를 수정하며, 풀 리퀘스트를 제안할 수 있습니다.

6404

Falcon-Edge: 강력하고, 범용적이며, 미세조정 가능한 1.58비트 LLMs

Hugging Face와 Falcon-LLM 팀은 새로운 사전 학습 패러다임을 통해 추론과 미세조정 모두를 지원하는 1B 및 3B 파라미터 규모의 1.58비트(삼진) 언어 모델 시리즈인 Falcon-Edge를 출시했습니다.

6405

Hugging Face Transformers: 생태계 상호 운용성을 위한 모델 정의 표준화

Hugging Face는 Transformers 라이브러리를 모델 정의의 중심축으로 자리매김하여, Transformers가 지원하는 모든 아키텍처가 추론 엔진 및 학습 프레임워크를 포함한 광범위한 ML 생태계와 자동으로 호환되도록 하고 있습니다.

6406

Expedia Group AI 마케팅 통합

Expedia Group은 생성형 AI와 OpenAI API를 활용해 콘텐츠 제작을 확장하고, 기술 분석을 강화하며, 변화하는 소비자 검색 행동에 적응하고 있습니다.

6407

Hugging Face와 Kaggle 모델 액세스 통합

Hugging Face와 Kaggle은 Hugging Face 모델을 Kaggle 노트북 및 모델 페이지 내에서 직접 검색 가능성과 사용성을 향상시키는 통합을 출시했습니다.

6408

Hugging Face 추론 엔드포인트: 빠른 Whisper 전사

Hugging Face는 Inference Endpoints에서 새로운 OpenAI Whisper 배포 옵션을 도입했으며, 전사 속도를 최대 8배 향상시키면서 정확성을 희생하지 않습니다.

6409

OpenAI HealthBench 릴리스

OpenAI는 5,000개의 현실적인 의료 대화와 48,562개의 의사가 만든 루브릭 기준을 포함한 새로운 벤치마크인 HealthBench를 도입하여 의료 분야에서 AI 역량을 엄격히 평가합니다.

6410

Hugging Face 비전 언어 모델 2025 업데이트

Hugging Face는 Vision Language Models (VLMs)의 2024‑2025년 진화를 포괄적으로 정리하며, any-to-any 아키텍처, 추론 모델, 로봇 분야를 위한 Vision‑Language‑Action (VLA) 모델의 부상을 강조합니다.

6411

LeRobot 커뮤니티 데이터셋: 로봇공학의 ImageNet 구축

Hugging Face는 LeRobot를 통해 로봇 정책의 일반화 문제를 해결하기 위해 다양하고 오픈소스인 로봇 데이터셋 저장소를 만들기 위한 커뮤니티 주도 노력을 촉진하고 있습니다.

6412

OpenAI 리더십 확대: Fidji Simo, 애플리케이션 부문 CEO 임명

OpenAI는 Fidji Simo를 애플리케이션 부문 CEO로 임명하여, 회사가 글로벌 제품 및 인프라 조직으로 성장함에 따라 제품 및 운영 기능을 확장합니다.

6413

AI 인프라에 관한 에너지부에 대한 OpenAI 응답

OpenAI는 미국 AI 리더십을 유지하기 위해 연방 토지에 AI 슈퍼컴퓨터 허브를 신속히 건설할 수 있도록 허가 절차 간소화와 전략적 연방 재정 인센티브를 옹호합니다.

6414

아시아에서의 OpenAI 데이터 거주지

OpenAI는 일본, 인도, 싱가포르 및 한국에서 ChatGPT Enterprise, ChatGPT Edu 및 API Platform에 대한 데이터 거주 옵션을 도입하여 조직이 현지 데이터 주권 요구 사항을 충족하도록 돕습니다.

6415

샌안토니오 스퍼스 ChatGPT 엔터프라이즈 통합

샌안토니오 스퍼스는 ChatGPT 엔터프라이즈를 통합하여 운영 성장을 확대하고, 직원 AI 숙련도를 14%에서 85%로 증가시켰으며, 팬 참여와 비즈니스 운영을 위한 맞춤형 GPT를 배포했습니다.

6416

Lowe's AI 구현 with OpenAI GPT-4o

Lowe's는 GPT-4o를 통합하여 Mylow와 Mylow Companion이라는 AI 기반 어드바이저를 출시했으며, 이들은 고객과 매장 직원에게 전문가 수준의 프로젝트 안내를 제공합니다.

6417

OpenAI for Countries 이니셔티브

OpenAI는 Stargate 프로젝트 내에서 국가들이 주권 AI 인프라를 구축하고, 맞춤형 ChatGPT 서비스를 제공하며, 민주적 AI 원칙에 기반한 국가 스타트업 펀드를 지원하도록 돕는 프로그램인 OpenAI for Countries를 시작했습니다.

6418

OpenAI가 실제 AI 혜택을 강조하기 위해 AI Stories를 소개합니다

OpenAI는 미국의 개인 및 조직이 과학, 의학, 교육 분야의 문제를 해결하기 위해 AI를 활용하고, 이를 통해 경제 성장과 국가 안보를 촉진하는 모습을 보여주기 위해 AI Stories를 출시합니다.

6419

John Deere AI 통합 및 농업 혁신

John Deere는 OpenAI API를 활용하여 정밀 농업을 확장하고 AI 기반 진단, 실시간 텔레매틱스, See & Spray 기술을 통해 고객 성공을 혁신하고 있습니다.

6420

OpenAI 구조적 진화: 공익 기업으로의 전환

OpenAI는 영리 부문을 공익 기업(PBC)으로 전환하면서 비영리 조직의 통제를 유지하여 인류 전체를 위한 AGI 확장에 필요한 자원을 확보하고 있습니다.

6421

주택 개조 소매를 위한 Lowe’s AI 통합

Lowe’s는 OpenAI의 API를 활용하여 AI 기반 가상 어드바이저와 직원 도구를 배포함으로써 고객 경험을 제품 판매에서 프로젝트 해결로 전환하고 있습니다.

6422

GPT-4o 순종성 문제 및 배포 프로세스 개선에 대한 OpenAI 분석

OpenAI는 모델 순종성을 증가시킨 GPT-4o 업데이트를 롤백했으며, 행동 문제를 출시 차단 안전 위험으로 간주하는 새로운 프로토콜을 도입했습니다.

6423

Gradio로 MCP 서버 구축

Hugging Face는 Model Context Protocol(MCP)을 Gradio에 통합하여, 개발자가 단 하나의 매개변수 변경만으로 Python 함수를 LLM이 접근할 수 있는 도구로 전환할 수 있게 했습니다.

6424

Qwen-3 채팅 템플릿 분석

Qwen-3 모델은 선택적 추론, rolling checkpoint를 통한 동적 문맥 관리, 그리고 개선된 도구 인자 직렬화가 가능한 정교한 채팅 템플릿을 도입합니다.

6425

OpenAI GPT-4o 아첨 행동 업데이트 및 롤백

OpenAI는 아첨 행동으로 인해 최근 GPT-4o 업데이트를 롤백했으며, 장기적인 사용자 만족도와 모델 성격에 대한 사용자 제어 확대에 초점을 전환했습니다.

6426

Intel AutoRound: 대형 언어 모델(LLM) 및 비전-언어 모델(VLM)을 위한 고급 가중치 전용 양자화

Intel은 서명된 그래디언트 하강법을 사용하여 LLM 및 VLM에 대해 고정밀 저비트 양자화(INT2-INT8)를 가능하게 하는 가중치 전용 사후 훈련 양자화 방법인 AutoRound를 소개했습니다.

6427

Llama Guard 4 및 Llama Prompt Guard 2 출시

Meta는 12B 멀티모달 안전 모델인 Llama Guard 4와 프롬프트 인젝션 및 탈옥을 감지하기 위한 일련의 분류기인 Llama Prompt Guard 2를 출시했습니다.

6428

Qwen3 릴리즈 노트: 하이브리드 사고와 다국어 MoE 모델

Qwen은 확장 가능한 추론을 위한 하이브리드 사고 모드와 119개 언어 지원을 특징으로 하는 오픈-웨이트 모델군인 Qwen3를 출시했습니다.

6429

PipelineRL: 인플라이트 가중치 업데이트를 통한 LLM 강화 학습 최적화

Hugging Face와 ServiceNow Research가 인플라이트 가중치 업데이트를 사용하여 추론 처리량과 온-폴리시 데이터 수집 간의 트레이드오프를 없애는 실험적 RL 구현인 PipelineRL을 오픈소스로 공개했습니다.

6430

Hugging Face Tiny Agents: 50줄 코드로 MCP 기반 에이전트 구축

Hugging Face는 Model Context Protocol (MCP)과 InferenceClient를 사용하여 기능적인 AI 에이전트를 구축하는 방법을 보여주며, 핵심 에이전트 로직을 간단한 while 루프로 축소합니다.

6431

ChatGPT for Business 2025년 4월 업데이트

OpenAI는 2025년 4월에 ChatGPT for Business에 대한 업데이트를 발표했으며, OpenAI o3 실습 데모, 이미지 생성, 메모리 및 내부 지식 기능을 특징으로 합니다.

6432

OpenAI gpt-image-1 API 릴리스

OpenAI는 API를 통해 사용할 수 있는 본래 다중모달 이미지 생성 모델인 gpt-image-1을 출시했으며, 이를 통해 개발자는 전문 등급 이미지 생성 및 편집 기능을 자체 플랫폼에 통합할 수 있습니다.

6433

신뢰할 수 있는 문서 추출을 위한 olmOCR 파인튜닝

TNG는 헤더와 푸터를 보존하는 파인튜닝된 olmOCR-7B-0225-preview 버전을 출시했으며, 이를 통해 인보이스 파싱과 같은 비즈니스 애플리케이션에 적합합니다.

6434

Speak AI 언어 튜터링 통합

Speak는 OpenAI의 실시간 API와 멀티모달 오디오 기능을 활용하여 자연스러운 대화와 발음에 중점을 둔 맞춤형 AI 언어 튜터를 만들고 있습니다.

6435

워싱턴 포스트와 OpenAI의 검색 콘텐츠 파트너십

OpenAI와 워싱턴 포스트는 고품질 뉴스 요약, 인용문 및 포스트의 직접 링크를 ChatGPT 응답에 통합하기 위해 파트너십을 맺었습니다.

6436

LLM 성능 최적화: 동시 요청을 위한 프리필 및 디코드

Hugging Face(TNG)를 통해 연속 배치와 청크 프리필과 같은 전략으로 토큰 생성의 프리필 및 디코드 단계를 관리하면 GPU 활용도를 최적화하고 토큰 처리량을 최대 50%까지 증가시킬 수 있음을 설명합니다.

6437

OpenAI o3 및 o4-mini 시각적 추론 출시

OpenAI는 o-시리즈 최초 모델인 o3와 o4-mini를 소개했으며, 이 모델들은 고급 시각적 추론을 위해 이미지 조작 도구를 내부 체인 오브 생각에 직접 통합할 수 있습니다.

6438

OpenAI o3 및 o4-mini 릴리스 노트 / 새로운 소식

OpenAI는 코딩, 수학, 과학 전반에 걸친 복잡한 문제를 해결하기 위해 멀티모달 기능과 에이전트형 도구 사용을 통합한 추론 모델인 o3와 o4-mini를 출시했습니다.

6439

HELMET: 장기 컨텍스트 언어 모델을 전체적으로 평가하기

Hugging Face와 Princeton 연구원들은 HELMET를 도입했다. 이는 needle-in-a-haystack와 같은 합성 테스트를 대체하고, 장기 컨텍스트 언어 모델을 위한 다양하고, 제어 가능하며, 신뢰할 수 있는 실제 평가를 제공하는 포괄적인 벤치마크이다.

6440

Cohere와 Hugging Face 추론 제공자 통합

Hugging Face가 Cohere를 지원되는 추론 제공자로 추가하여, 사용자가 Hub에서 직접 다양한 Cohere 및 Cohere Labs 모델에 대해 서버리스 추론을 실행할 수 있게 되었습니다.

6441

Gradio 프레임워크 개요: UI 라이브러리 기능을 넘어

Hugging Face는 Gradio가 보편적인 API 접근, 서버 측 렌더링, 그리고 특화된 ML 리소스 관리 기능을 제공하는 포괄적인 AI 중심 프레임워크로 진화한 과정을 상세히 설명합니다.

6442

OpenAI, 비영리 위원회 고문 발표

OpenAI는 비영리 위원회를 새로 구성하여 경험이 풍부한 고문 그룹을 임명했으며, 이들은 자선 활동을 안내하고 AI 기술이 소외된 커뮤니티에 혜택을 주도록 보장합니다.

6443

OpenAI 대비 프레임워크 업데이트

OpenAI는 심각한 해를 초래할 수 있는 고급 AI 능력과 관련된 위험을 추적, 평가 및 완화하는 방식을 개선하기 위해 대비 프레임워크를 업데이트했습니다.

6444

GPT-4.1 API 릴리스 노트 / 새로운 소식

OpenAI는 1백만 토큰 컨텍스트 윈도우를 갖춘 GPT-4.1, GPT-4.1 mini, GPT-4.1 nano를 출시했으며, 코딩, 지시 따름, 멀티모달 장기 컨텍스트 이해에서 큰 개선을 이루었습니다.

6445

Hugging Face와 Protect AI 보안 파트너십: 6개월 진행 보고서

Hugging Face와 Protect AI는 1,410,000개의 리포지토리에서 4,470,000개의 모델 버전을 스캔하여 352,000개의 위험하거나 의심스러운 문제를 식별했으며, Guardian 스캔 기술을 통해 오픈소스 AI 보안을 강화했습니다.

6446

Hugging Face, 오픈소스 로봇 하드웨어 확장을 위해 Pollen Robotics 인수

Hugging Face는 오픈소스 인간형 하드웨어를 LeRobot 소프트웨어 생태계와 통합하기 위해 Pollen Robotics를 인수했으며, Reachy 2 로봇 판매를 시작으로 진행합니다.

6447

Visual Salamandra 7B 릴리스

Hugging Face의 Language Technologies Lab이 유럽 언어 다양성에 초점을 맞춘 이미지와 비디오를 지원하는 70억 파라미터 멀티모달 모델인 Visual Salamandra를 출시했습니다.

6448

OpenAI BrowseComp 벤치마크 릴리스

OpenAI는 인터넷에서 찾기 어려운 얽힌 정보를 찾아내는 AI 에이전트의 능력을 측정하기 위해 설계된 1,266개의 도전적인 문제로 구성된 벤치마크인 BrowseComp를 오픈소스로 공개했습니다.

6449

OpenAI 파이오니어스 프로그램

OpenAI는 고영향 산업 분야를 위해 기업이 도메인별 평가를 만들고 강화 파인튜닝을 통해 모델 성능을 최적화하도록 돕는 OpenAI 파이오니어스 프로그램을 시작했습니다.

6450

Hugging Face와 Cloudflare FastRTC 통합

Hugging Face와 Cloudflare는 FastRTC 개발자에게 Cloudflare의 글로벌 TURN 서버 네트워크에 대한 무료 접근을 제공하여 저지연 실시간 오디오 및 비디오 AI 애플리케이션 배포를 간소화했습니다.