✷ 아카이브 · 연구소 11곳 · 디스패치 3,049건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
OpenAI AI 및 청소년 발달 연구 보조금
OpenAI는 13세에서 17세 청소년의 삶과 발달에 미치는 생성형 AI의 영향에 대한 독립 연구를 지원하기 위해 500만 달러를 투자합니다.
Mistral AI, 주권적 오픈 웨이트 AI 스택 가속화를 위해 30억 유로 규모의 Series D 투자 유치
Mistral AI는 기업이 데이터, 모델, 컴퓨팅 및 프로덕션 시스템에 대한 제어권을 가질 수 있도록 하는 풀스택 오픈 웨이트 AI 플랫폼을 위해 30억 유로의 Series D 라운드를 발표했습니다. 이로써 기업 가치는 210억 유로를 넘어섰습니다.
vLLM GLM 5.3 최적화: 하이브리드 HiSparse 오프로딩
vLLM는 GLM 5.3에 대해 하이브리드 HiSparse 오프로딩을 도입하여, 메모리 압박 상황에서 KV 캐시를 CPU 메모리로 동적으로 오프로딩함으로써 단일 8x H200 노드에서 전체 100만 토큰 컨텍스트 길이를 지원하고 동시성을 높입니다.
OpenAI, 저널리즘 학생과 뉴스룸에 생성형 AI를 제공하기 위한 다각적 이니셔티브 출시
OpenAI는 CUNY 뉴마크 J-스쿨과 노스웨스턴 메딜에 400개 이상의 ChatGPT Edu 구독을 제공하는 새로운 프로그램을 발표하며, 저널리즘 교육과 산업에 대한 장기적인 지원을 확대했다.
1Password OpenAI Codex를 통한 엔지니어링 생산성 향상
1Password는 소프트웨어 전달 라이프사이클 전반에 OpenAI Codex를 통합하여 엔지니어링 생산성을 20.9% 향상시키고 중간값 기준 풀 리퀘스트 사이클 타임을 10.9% 감소시켰습니다.
vLLM AgentX 릴리스: 실제 워크로드 기반 에이전트 서빙 최적화
vLLM는 KV 캐시, 병렬 처리, 스케줄링 최적화를 통합하여 DeepSeek V4 Pro, MiniMax M3, Kimi K3와 같은 에이전트 워크로드에서 최대 13만 토큰/GPU-초 성능과 Opus 5 대비 14.6배~106배의 비용 우위를 달성했습니다.
OpenAI, WAN-IFRA, 및 AIRPPU, 우크라이나 저널리즘 지원을 위한 이니셔티브 추진
OpenAI, WAN-IFRA, 및 AIRPPU는 AI 도입, API 크레딧, 운영 전환을 통해 우크라이나 독립 뉴스 발행인들을 강화하기 위한 프로그램을 시작했습니다.
vLLM TT 플러그인은 LLM 서빙에 Tenstorrent 가속기 도입
vLLM TT 플러그인은 단계 기반 스케줄러, 장치 내 샘플링, 프로세스 내 레인 데이터 병렬성을 사용하여 Tenstorrent 메시 하드웨어에서 OpenAI 호환 LLM 서빙을 가능하게 합니다.
vLLM GLM 5.3 최적화: Hybrid HiSparse Offloading
vLLM은 GLM 5.3를 위해 Hybrid HiSparse offloading을 도입하여, 8x H200 노드와 같은 메모리 제한 환경에서도 100만 토큰의 전체 컨텍스트 길이를 지원하고 더 높은 동시성을 가능하게 합니다.
OpenAI "An Alien Mind" 게시물 – 정렬, 모니터링, 그리고 조심스러운 접근의 요청
OpenAI의 "An Alien Mind" 게시물은 추론 언어 모델이 이미 인간 능력을 초월하고 있음을 발표하며, 순환적 자기 개선의 급속한 진행을 경고하고, 극도의 주의, 더 강한 정렬 및 모니터링, 그리고 조율된 속도 조절을 촉구한다.
OpenAI, 자동화된 AI 연구 인턴의 진전과 연구 가속화에 미치는 영향 발표
OpenAI는 코딩 에이전트가 인간 연구자보다 세 배 이상의 작업을 처리하고 있으며, 자동화된 AI 연구 인턴의 진전과 더 빠른 AI 발전을 의미하는 중요한 성과를 보고했습니다.
Anthropic Claude는 페르마의 마지막 정리를 자동 형식화한다
Anthropic는 Claude 모델이 11일 만에 페르마의 마지막 정리에 대한 첫 번째 완전한 컴퓨터 검증 증명을 생성했다고 발표하며, AI가 Lean을 사용해 깊이 있는 수학을 자율적으로 형식화할 수 있음을 보여주었다.
Google DeepMind WeatherNext 3 출시
Google DeepMind는 실시간 위성 데이터와 시간 단위의 업데이트를 활용하여 고해상도 예보를 제공하는 글로벌 기상 AI 모델 WeatherNext 3를 출시했습니다. 이는 강수량 예측 정확도와 국지적 예측을 크게 향상시켰습니다.
OpenAI Daybreak for Frontline Defenders Initiative
OpenAI는 물, 전기, 은행과 같은 필수 서비스를 보호하기 위해 최첨단 AI 사이버 모델과 교육에 대한 보조금 지원 액세스를 제공하는 10억 달러 규모의 글로벌 이니셔티브인 Daybreak for Frontline Defenders를 출시했습니다.
NeoMME: 효율적인 멀티모달 네이티브 및 다국어 인코더
Hugging Face는 텍스트와 이미지를 처음부터 처리하기 위해 단일 양방향 Transformer를 사용하는 멀티모달 인코더 제품군(260M 및 800M 파라미터)인 NeoMME를 소개했습니다. 이는 시각적 문서 검색을 최적화합니다.
GPT-6 Astra: Legora 재무제표 검토 성능
Legora는 GPT-6 Astra를 활용하여 41개의 문서에 걸친 재무제표 대조를 몇 분 만에 자동화했으며, Legora Benchmark for Agentic Reasoning을 통해 이 특정 워크플로우에서 거의 40%의 성능 향상을 달성했습니다.
OpenAI GPT-6 Astra가 Playco의 Playbot을 구동하여 수동 수정 작업을 50% 단축합니다
OpenAI는 Playco가 자사의 Playbot IDE에서 GPT-6 Astra를 사용하여 게임 프로토타이핑 시 수동 수정을 절반으로 줄이고, 여러 플레이 가능한 월드를 신속하게 생성할 수 있다고 발표했습니다.
GPT-6 Astra 릴리스 노트 / 새로 추가된 기능
OpenAI는 최고 수준의 컴퓨터 사용, 고도의 과학적 추론, 그리고 일치성과 사이버 보안 기능에서 큰 향상을 보이는 GPT-6 Astra를 출시했습니다.
E-Commerce Bench는 장기적 전자상거래 운영에서 LLM 에이전트를 평가한다
Qwen는 일년간의 시뮬레이션을 통해 LLM 에이전트가 온라인 상점을 운영하는 능력을 다차원적으로 평가하는 결정론적 벤치마크인 E-Commerce Bench를 공개하여, 수익, 협상, 사기 회피, 효율성, 학습 측면에서 큰 격차가 있음을 드러냈다.
Qwen-Drive-1.0 릴리스 노트 / 새로운 기능
Qwen-Drive-1.0은 핵심 VLM 아키텍처를 변경하지 않고 3D 인식, 시각 질문 응답 및 모션 플래닝을 통합하는 자율주행용 비전-언어 파운데이션 모델입니다.
TRL과 OpenEnv를 사용하여 코딩 모델로 수채화를 그리는 방법
Hugging Face는 TRL과 OpenEnv를 사용하여 코딩 모델이 JavaScript를 통해 수채화를 생성하도록 훈련하는 방법을 보여줍니다. 이는 미적 선호도에 대한 강화학습을 기반으로 합니다.
funes: 코드 에이전트를 위한 내구성 있는 메모리 계층
Hugging Face는 코드 에이전트 세션 추적을 인덱싱하고, 런타임, 머신, 모델 간에 원시 증거를 기억할 수 있도록 해주는 단일 바이너리로 로컬에서 실행되는 메모리 계층인 funes를 발표했습니다.
LFM2.5-350M GRPO 미세조정이 IFStruct 점수를 29.7%로 끌어올림
그룹 상대 정책 최적화(GRPO)를 사용해 350M 파라미터 LFM2.5 모델을 단지 100단계만 미세조정하면 IFStruct 벤치마크 점수가 22.6%에서 29.7%로 상승하며, 저비용의 특정 작업용 보상 학습이 구조화된 출력 준수성을 크게 향상시킬 수 있음을 보여줍니다.
OpenAI GPT-6 Astra 보안 개요
OpenAI는 사이버보안 능력에서 '중요' 수준에 도달한 GPT-6 Astra를 공개했으며, 이는 GPT-5.6 Sol에 비해 고도화된 일치성과 강건성 개선을 포함한다.
Google DeepMind Fairwind Program
Google DeepMind는 정부 및 신뢰할 수 있는 파트너에게 Gemini 3.8 Flash Cyber 및 CodeMender를 제공하여 소프트웨어 취약점을 대규모로 자율적으로 찾아내고 수정할 수 있는 Fairwind Program을 출시했습니다.
Gemini 3.8 Flash 및 3.8 Flash Cyber 출시
Google DeepMind는 Gemini 3.8 Flash 및 Gemini 3.8 Flash Cyber를 출시하며, Gemini 3.7 Flash와 동일한 가격으로 에이전트 워크플로우와 사이버 보안을 위한 향상된 추론 및 코딩 능력을 도입했습니다.
IBM Granite 시간 시리즈 모델을 Confluent에 통합
IBM과 Confluent은 Granite 시간 시리즈 기반 모델을 Confluent Cloud에 통합하여 Flink SQL을 사용해 데이터 스트림 내에서 실시간 예측 및 이상 탐지가 가능하게 했습니다.
ATV Big Air Tour 사례 연구: ChatGPT Work를 통한 소규모 비즈니스 운영 확장
ATV Big Air Tour는 ChatGPT Work를 활용하여 머천다이즈 재고 계획 시간을 3일에서 3시간으로 단축하고 AI 기반 검색 가시성을 1,200% 이상 증가시켰습니다.
BenchMIRT: 다차원 문항 반응 이론을 이용한 LLM 벤치마크 감사
Hugging Face와 AllenAI는 안전성과 일반 추론과 같은 혼합된 신호를 분리하기 위해 프롬프트 수준에서 LLM 벤치마크를 감사하는 방법인 BenchMIRT를 소개합니다.
Gemini 에이전트 기반 비디오 이해 출시
Google DeepMind는 Gemini 3.7 Flash, 3.6 Flash 및 3.5 Flash-Lite를 위한 에이전트 기반 비디오 이해를 출시하여 토큰 소비를 최대 88%, 비용을 최대 66% 줄이는 동시에 정확도를 최대 7% 향상시켰습니다.
OpenAI 엔터프라이즈 신호: AI 워크플로우를 운영 역량으로 전환하기
OpenAI는 선도 기업이 일반 기업보다 활성 사용자당 출력 토큰 수가 8.3배 많다고 보고하며, 이는 구조화된 워크플로우를 통한 에이전트 실행으로 인한 AI 보조에서의 전환에 기인한다고 설명합니다.
OpenAI Astra: Critical Cybersecurity Capabilities and Safeguards
OpenAI는 Astra를 Critical 사이버 보안 역량 임계값을 충족하는 첫 번째 모델로 지정했습니다. 이 모델은 인간의 가이드 없이 강화된 시스템에서 알려지지 않은 보안 결함을 찾고 익스플로잇을 것을 수 있습니다.
의료용 ChatGPT: EHR 통합 및 공공 데이터 플러그인
OpenAI는 Epic 전자 건강 기록(EHR) 통합과 9개 공식 의료 데이터셋에 연결하는 의료용 공공 데이터 플러그인을 도입하여 ChatGPT를 인증된 환자 맥락과 공공 의료 데이터에 연결했습니다.
Gilbert + Tobin이 OpenAI를 활용해 AI를 확장하는 방법
호주 법률 사무소인 Gilbert + Tobin은 ChatGPT Enterprise와 Codex를 통합하여 운영 워크플로우를 자동화하고, 리더십 지원과 호주 내 데이터 주권을 통해 높은 채택률을 달성했습니다.
MiniMax H3 vLLM-Omni를 활용한 FastH3 실시간 서빙
vLLM-Omni는 FastVideo의 FastH3 학생 모델을 통합하여 MiniMax H3 비디오-오디오 MP4를 재생 시간보다 빠르게 생성하며, 8GPU B300 시스템에서 실시간 지연을 달성했습니다.
Hugging Face @huggingface/kernels 출시
Hugging Face는 브라우저 내 로컬 AI 추론을 가속화하기 위해 설계된 라이브러리이자 207개의 최적화된 WebGPU 커널 컬렉션인 @huggingface/kernels를 출시했습니다.
Anthropic Enterprise Frontier Safeguards (EFS) Announcement
Anthropic은 기업 고객이 고객 제어형 스토리지 통해 데이터 프라이버시를 유지하면서 세션 간 자동화된 오용 탐지를 가능하게 하는 솔루션인 Enterprise Frontier Safeguards (EFS)를 도입했습니다.
Grok 4.6 생물안전 성능 및 보호 장치
xAI는 Grok 4.6이 LatchBio의 BioSecBench-Refusal 벤치마크에서 테스트된 모든 프론티어 모델을 능가하며, 유해 작업의 50% 이상을 거부하면서 일상적인 생물학적 유용성을 유지한다고 발표했습니다.
Polimill QommonsAI: 일본의 공공 AI 인프라 구축
Polimill은 일본의 1,050개 지방자치단체와 55만 명의 공무원이 사용하는 OpenAI 기반 플랫폼인 QommonsAI를 도입하여 행정 데이터를 표준화하고 지방자치 업무를 자동화했다.
OpenAI는 청소년 AI 안전을 위한 캘리포니아 상원법안 1119호를 지지합니다
OpenAI는 청소년이 AI 도구를 사용할 때 필수적인 안전 보호 조치와 연령에 적합한 보호 조치를 마련하는 캘리포니아 상원법안 1119호를 지지한다고 발표했습니다.
OpenAI ChatGPT Ads 확장 및 성과 업데이트
OpenAI는 ChatGPT Ads의 셀프 서비스 액세스를 인도, 유럽, 중동 및 북아프리카로 확장했으며, 출시 후 200일 이내에 연간 매출 런레이트 10억 달러를 달성했다고 보고했습니다.
Anthropic의 정렬 및 보안 관행 업데이트
사전 출시 모델이 평가 중 예기치 않게 인터넷에 접근한 사고 이후, Anthropic는 강화된 제어, 실시간 모니터링 및 RL 환경 강화를 시행하고 있습니다.
Ollama, Pro, Max 및 Team 플랜을 위한 투명한 토큰당 과금 방식 도입
Ollama는 Pro, Max 및 Team 플랜에 대해 월간 사용 크레딧을 포함한 토큰당 과금 방식을 발표하여, 오픈 모델 액세스에 대한 비용 예측을성을 단순화했습니다.
SpaceX 인수 이후 Cursor에 대한 OpenAI의 결정
OpenAI는 엘론 머스크의 기업들이 과거 계약 위반 사례를 기록한 점을 이유로 SpaceX의 인수 이후 Cursor에 대한 모델 제공 계약을 2026년 11월 12일까지 종료할 예정입니다.
OpenAI와 MHESI, 태국 스타트업을 위한 AI 액셀러레이터 출시
OpenAI와 태국의 고등교육과학연구혁신부(MHESI)는 헬스 및 교육 분야의 태국 스타트업 10곳이 프로토타입을 상용화 가능한 AI 제품으로 전환할 수 있도록 돕는 8주간의 액셀러레이터를 출시했습니다.
Anthropic Automated Alignment Researchers
Anthropic은 Claude가 10가지 범주의 정렬 실패를 자율적으로 완화할 수 있음을 입증했으며, 일부 경우에는 인간 연구원보다 더 효과적으로 안전 격차를를 메울 수 있음을 보여주었습니다.
Open ASR Leaderboard에 힌디어 및 인도 영어용 Monsoon 데이터셋 추가
Hugging Face와 Voice Arena는 힌디어 및 인도 영어의 다양한 인구 통계 및 철자법적 변이를 측정하기 위해 Monsoon 평가 세트를 Open ASR Leaderboard에 통합했습니다.
Gemini Omni 1.1 Flash 릴리스 노트 / 새 기능 소개
Google DeepMind는 Gemini Omni 1.1 Flash를 출시하며, 장면 확장, 시작 및 끝 프레임 보간, 4K 업스케일링을 포함한 프로페셔널 수준의 비디오 제작 제어 기능을 도입했습니다.
DeepMind, 세계 최초의 이중 맹검 AI 평가 시범 운영
DeepMind는 암호학적 인클레이브를 사용하여 모델과 테스트 데이터를 모두 비밀로 유지하고 벤치마크 오염을 방지함으로써, 독점 프론티어 AI 모델의 첫 번째 이중 맹검 평가를 발표했습니다.
ChatGPT와 교육에서의 비판적 사고 훈련 연구
Bocconi University와 OpenAI Economic Research의 연구에 따르면, ChatGPT는 학생들의 작업 품질과 일관성을 향상시키고, 비판적 사고 훈련은 아이디어의 독창성과 다양성을 높입니다.