✷ 아카이브 · 연구소 11곳 · 디스패치 3,049건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
vLLM x Mooncake를 이용한 대규모 에이전틱 워크로드 서빙
vLLM은 Mooncake의 분산 KV cache 스토어를 통합하여 에이전틱 LLM 서빙 성능을 향상시켰으며, 실제 트레이스에서 3.8배 높은 처리량, 46배 낮은 TTFT, 8.6배 낮은 엔드 투 엔드 지연 시간을 달성하는 동시에 60 GB200 GPU까지 확장 가능함을 보여주었습니다.
허깅 페이스 오픈 ASR 리더보드: 벤치맥싱 방지를 위한 비공개 데이터셋
허깅 페이스는 Appen Inc.와 DataoceanAI의 비공개 평가 데이터셋을 오픈 ASR 리더보드에 도입하여 테스트 세트 오염을 방지하고 실제 세계에서의 ASR 성능에 대한 보다 강력한 측정을 제공합니다.
OpenAI B2B Signals: 선두 기업들이 앞서 나가는 방법
OpenAI는 B2B Signals를 도입해 사용량 상위 95번째 백분위에 해당하는 선두 기업들이 이제 일반 기업보다 직원당 3.5배 더 많은 인텔리전스를 활용하고 있으며, 이는 복잡하고 에이전트 기반 워크플로우에 의해 촉진되고 있음을 밝혔습니다.
OpenAI, ChatGPT Futures 발표: 2026학번
OpenAI는 AI를 활용해 도구를 만들고, 연구를 진전시키며, 사회적 영향을 창출하는 2026학번 학생들에게 보조금과 모델 접근성을 제공하는 프로그램인 ChatGPT Futures를 시작했습니다.
Singular Bank, ChatGPT와 Codex를 통합해 Singularity Assistant를 출시
Singular Bank는 ChatGPT와 Codex를 기반으로 하는 내부 AI 어시스턴트인 Singularity를 개발하여, 자동화된 포트폴리오 분석 및 커뮤니케이션을 통해 은행가들의 생산성 손실을 하루에 60~90분 줄였습니다.
Uber와 OpenAI 통합: AI 기반 운전자 안내 및 음성 예약
Uber는 운전자 수익 최적화와 음성 기반 라이드 예약을 위해 Uber Assistant를 출시하기 위해 OpenAI 최첨단 모델을 통합하고 있으며, 이를 통해 승객의 불편을 줄이고 있습니다.
Grok Imagine Quality Mode API 출시
xAI는 Grok Imagine API를 위한 Quality Mode를 출시하여, 기업용 개발자에게 향상된 사실주의, 개선된 다국어 텍스트 렌더링, 그리고 이미지 생성 및 편집을 위한 우수한 창의적 제어 기능을 제공합니다.
xAI Grok Connectors 출시
xAI는 웹, iOS 및 Android용 Grok을 위한 심층 통합 기능인 Connectors를 출시했습니다. 이를 통해 Grok은 Google Workspace, GitHub, Notion과 같은 제3자 애플리케이션의 데이터를 읽고 쓸 수 있습니다.
xAI와 Anthropic 컴퓨팅 파트너십
xAI는 Colossus 1 슈퍼컴퓨터에 대한 접근 권한을 제공하기 위해 Anthropic과 파트너십을 맺었으며, 추가적으로 궤도 AI 컴퓨팅 용량을 탐색할 계획입니다.
Anthropic, SpaceX와의 파트너십을 통해 컴퓨팅 용량 확장 및 Claude 사용 한도 증대
Anthropic은 SpaceX와 파트너십을 맺어 Colossus 1 데이터 센터를 사용할 수 있게 되었으며, 이를 통해 Claude Code 및 Claude API의 사용 한도를 높였습니다.
GPT-5.5 Instant 시스템 카드
OpenAI가 GPT-5.5 Instant 시스템 카드를 공개했으며, 이는 Instant 모델이 사이버 보안 및 생물학적 및 화학적 대비 카테고리에서 처음으로 High capability로 분류된 사례입니다.
GPT-5.5 Instant 릴리스 노트 / 새로운 내용
OpenAI는 ChatGPT의 새로운 기본 모델인 GPT-5.5 Instant를 출시했으며, 사실성 향상, 장황함 감소, 그리고 사용자 컨텍스트와의 깊은 통합을 통한 개인화 강화가 이루어졌습니다.
OpenAI MRC 다중 경로 신뢰 연결 프로토콜
OpenAI는 대규모 AI 학습 클러스터에서 GPU 네트워킹의 복원력과 성능을 향상시키기 위해 Open Compute Project를 통해 Multipath Reliable Connection (MRC) 프로토콜을 공개했습니다.
OpenAI 유럽 청소년 안전 청사진 및 EMEA 청소년 및 복지 보조금
OpenAI는 유럽 청소년 안전 청사진과 EMEA 청소년 및 복지 보조금의 첫 수혜자를 발표하여 연령에 맞는 AI 활용을 촉진하고 유럽, 중동 및 아프리카의 청소년을 보호합니다.
OpenAI, 자체 서비스 Ads Manager와 CPC 입찰을 통해 ChatGPT 광고 파일럿 확대
OpenAI는 베타 자체 서비스 Ads Manager와 클릭당 비용(CPC) 입찰, 확장된 측정 도구를 도입해 모든 규모의 기업이 광고를 보다 쉽게 이용할 수 있도록 ChatGPT 광고 파일럿을 확대하고 있습니다.
OpenAI와 PwC의 금융 분야 AI 에이전트 협업
OpenAI와 PwC는 AI 에이전트를 도입해 금융 워크플로우를 자동화하고, OpenAI 자체 금융 조직을 테스트 환경으로 활용하여 CFO 사무실을 현대화하기 위해 협업하고 있습니다.
OpenAI 저지연 음성 AI 인프라
OpenAI는 분할 릴레이‑플러스‑트랜시버 아키텍처를 도입해 9억 명 이상의 주간 활성 사용자에게 저지연·확장 가능한 음성 AI를 제공하도록 WebRTC 스택을 재구성했습니다.
Anthropic, Blackstone, Hellman & Friedman, Goldman Sachs와 함께 새로운 기업용 AI 서비스 회사 설립
Anthropic은 Blackstone, Hellman & Friedman, Goldman Sachs와 파트너십을 맺고 중소 규모 조직을 위한 Claude 배포에 집중하는 새로운 AI 서비스 회사를 출시했습니다.
Google DeepMind AI 공동임상의 연구 이니셔티브
Google DeepMind는 증거 종합 및 임상 감독 하에 실시간 환자 상호작용을 통해 의료 제공자를 지원하도록 설계된 다중모달 AI 시스템인 AI 공동임상의 연구 이니셔티브를 소개했습니다.
Qwen-Scope 해석 가능성 툴킷 출시
Qwen은 Sparse Autoencoders(SAE)를 사용하여 Qwen3 및 Qwen3.5 모델의 은닉 표현을 해석 가능한 특징으로 분해하고 모델 최적화를 위한 해석 가능성 툴킷인 Qwen-Scope를 출시했습니다.
OpenAI 고급 계정 보안 출시
OpenAI는 고위험 사용자를 보호하기 위해 피싱 방지 인증을 의무화하고 기존 복구 방식을 비활성화하는 옵션 설정인 고급 계정 보안을 ChatGPT 및 Codex 계정에 출시했습니다.
Anthropic Claude 개인 가이드 연구를 통해 사용 패턴을 밝히고 Opus 4.7 및 Mythos Preview에서 아첨 행위를 줄임
Anthropic은 Claude 대화의 약 6%가 개인 가이드 요청이며, 새로운 Opus 4.7 및 Mythos Preview 모델이 특히 관계 조언에 대한 아첨 응답을 절반으로 줄였다고 발표했습니다.
xAI Custom Voices 출시
xAI는 사용자가 짧은 녹음으로 자신의 목소리를 복제하여 Grok Text to Speech 및 Voice Agent API에서 사용할 수 있도록 하는 Custom Voices를 도입했습니다.
OpenAI 모델 행동 분석: '고블린' 어휘 틱
OpenAI는 'Nerdy' 성격 기능을 위한 보상 신호가 GPT‑5.1부터 GPT‑5.5까지 모델이 고블린 및 그렘린 은유를 의도치 않게 사용하는 습관을 형성하게 했으며, 이 습관이 다른 모델 행동으로 일반화되었다는 사실을 확인했습니다.
IBM Granite 4.1 LLMs 릴리스 노트 / 기술 개요
IBM은 Granite 4.1을 출시했습니다. 이는 높은 성능을 달성하기 위해 엄격한 데이터 큐레이션과 다단계 강화 학습 파이프라인을 사용하는 밀집형, 디코더 전용 LLM 가족(3B, 8B, 30B)입니다.
OpenAI Stargate 컴퓨팅 인프라 업데이트
OpenAI는 미국을 위한 초기 10GW AI 인프라 목표를 초과 달성했으며, 텍사스주 아빌린에 위치한 플래그십 Stargate 사이트에서 GPT-5.5를 훈련시켰습니다.
OpenAI 사이버 보안 액션 플랜: 인텔리전스 시대
OpenAI는 AI 기반 사이버 방어를 민주화하고 AI 기반 위협에 대한 탄력성을 강화하기 위한 다섯 가지 기둥의 액션 플랜을 도입했습니다.
DeepInfra와 Hugging Face Inference Providers의 통합
Hugging Face가 DeepInfra를 지원되는 Inference Provider로 추가하여, Hub 및 클라이언트 SDK를 통해 DeepSeek V4 및 Kimi-K2.6를 포함한 100개 이상의 모델에 대한 서버리스 액세스를 가능하게 했습니다.
BioMysteryBench를 활용한 클로드의 생물정보학 연구 능력 평가
Anthropic는 BioMysteryBench라는 새로운 생물정보학 벤치마크를 도입했는데, 최신 클로드 모델이 인간 전문가와 동등한 성능을 보이며 인간 전문가가 해결하지 못한 몇 가지 문제도 해결했다.
제목: NVIDIA Nemotron 3 Nano Omni 릴리스 노트 / 새로운 기능
요약: NVIDIA는 텍스트, 이미지, 비디오, 오디오 전반에 걸친 장기 컨텍스트 추론이 가능한 옴니모달 모델인 Nemotron 3 Nano Omni를 출시했으며, 문서 지능 및 비디오 이해 벤치마크에서 최고 수준의 정확도를 제공합니다.
FlashQLA: GDN을 위한 CP-/Bwd-친화적 융합 선형 어텐션 커널
Qwen은 TileLang 기반의 고성능 선형 어텐션 커널 라이브러리인 FlashQLA를 오픈소스화했으며, NVIDIA Hopper GPU에서 Gated Delta Network (GDN) 레이어에 대해 전방 2-3배, 후방 2배 속도 향상을 달성합니다.
vLLM에서 NVIDIA Nemotron 3 Nano Omni 지원
vLLM은 이제 NVIDIA Nemotron 3 Nano Omni를 지원합니다. 이 모델은 30B MoE 멀티모달 모델로, 비전, 오디오, 언어 추론을 하나의 루프로 통합하여 에이전트 AI를 구동하는 고효율 모델입니다.
OpenAI 커뮤니티 안전 및 폭력 완화 프레임워크
OpenAI는 모델 훈련, 자동 탐지, 인간 검토를 결합하여 ChatGPT가 폭력 계획 또는 실행에 사용되는 것을 방지하는 다층 접근 방식을 상세히 설명했습니다.
OpenAI GPT-5.5, Codex, 및 AWS 관리 에이전트 릴리스 노트
2026년 4월 28일, OpenAI는 GPT‑5.5를 포함한 최첨단 모델, Codex 코딩 에이전트, 그리고 OpenAI 기반 Amazon Bedrock 관리 에이전트가 AWS에서 제한된 프리뷰로 제공된다고 발표했으며, 이를 통해 기업은 기존 AWS 보안·컴플라이언스·조달 워크플로우 내에서 이러한 기능을 활용할 수 있게 되었습니다.
OpenAI, FedRAMP 중간 수준 인증 획득
OpenAI는 ChatGPT Enterprise와 API 플랫폼에 대해 FedRAMP 20x 중간 수준 인증을 획득했으며, 이를 통해 미국 정부 기관이 연방 보안 및 개인정보 보호 기준에 부합하는 GPT-5.5를 포함한 최첨단 AI 모델에 접근할 수 있게 되었습니다.
Mistral AI Workflows 퍼블릭 프리뷰
Mistral AI는 기업용 AI를 위한 오케스트레이션 레이어를 출시하여, 프로덕션 AI 프로세스의 내구성, 관찰 가능성 및 결함 허용을 보장하는 Workflows를 퍼블릭 프리뷰로 출시했습니다.
Google DeepMind과 대한민국과의 파트너십
Google DeepMind은 대한민국 과학기술정보통신부와 파트너십을 체결하여 서울에 AI 캠퍼스를 설립하고 최첨단 AI 모델을 배치하여 생명 과학, 에너지, 기후 분야의 과학 연구를 가속화할 것입니다.
Microsoft OpenAI 파트너십의 다음 단계
OpenAI와 Microsoft는 파트너십 계약을 수정하여 유연성을 높였으며, OpenAI가 Microsoft를 주요 클라우드 파트너로 유지하면서 모든 클라우드 제공업체에 제품을 제공할 수 있게 되었습니다.
Choco는 AI 에이전트로 식품 유통을 자동화합니다
Choco는 OpenAI API를 기반으로 구축된 AI 기반 OrderAgent와 VoiceAgentを発表하여 식품 유통 주문 처리를 자동화했습니다.
OpenAI Privacy Filter: 확장 가능한 PII 탐지 웹 앱 구축하기
OpenAI는 128k 컨텍스트 윈도우에서 8가지 범주의 민감한 데이터를 라벨링할 수 있는 오픈 소스 1.5B-parameter PII 탐지기인 Privacy Filter를 출시했습니다.
Symphony: Codex 오케스트레이션을 위한 오픈 소스 사양
OpenAI가 Linear와 같은 이슈 트래커를 Codex 코딩 에이전트를 위한 상시 가동 오케스트레이터로 변환하는 오픈 소스 사양인 Symphony를 출시했습니다. 이를 통해 팀은 일상적인 구현 작업을 자동화하고 PR 처리량을 높일 수 있습니다.
OpenAI AGI 개발을 위한 운영 원칙
OpenAI는 인공 일반 지능(AGI)이 인류 전체에 이익이 되도록 보장하기 위해 다섯 가지 핵심 원칙—민주화, 권한 부여, 회복력, 보편적 번영, 적응력—을 제시했습니다.
OpenAI AI 직업 전환 프레임워크
OpenAI는 921개 직업에 걸쳐 AI가 고용에 미치는 영향을 분석하기 위해 AI 직업 전환 프레임워크를 도입했으며, 자동화 위험, 재구성, 성장 잠재력, 안정성을 기반으로 직업을 네 가지 경로로 분류합니다.
vLLM DeepSeek V4 지원: 효율적인 장기 컨텍스트 어텐션
vLLM은 이제 DeepSeek V4-Pro와 V4-Flash를 지원하며, 컨텍스트 길이를 최대 백만 토큰까지 확장하고 KV 캐시 메모리를 크게 절감하는 새로운 어텐션 메커니즘을 구현했습니다.
DeepSeek-V4 릴리스 노트: AI 에이전트를 위한 효율적인 1M-토큰 컨텍스트
DeepSeek-V4는 하이브리드 CSA/HCA 주의 메커니즘으로 구동되는 1M-토큰 컨텍스트 윈도우를 도입하며, 장기 실행 에이전트 워크로드 및 도구 사용 궤적에 특별히 최적화되었습니다.
DeepSeek-V4 Preview Release
DeepSeek는 1M 토큰 컨텍스트 창과 최첨단 에이전트 코딩 능력을 특징으로 하는 두 가지 모델 변체인 Pro와 Flash를 도입하여 오픈 소스 DeepSeek-V4 프리뷰를 출시했습니다.
Anthropic과 NEC의 일본 내 AI 네이티브 엔지니어링을 위한 파트너십
Anthropic과 NEC는 30,000명의 NEC 직원에게 Claude를 배포하고 일본의 금융, 제조 및 정부 부문을 위한 안전하고 산업 특화된 AI 제품을 개발하기 위해 파트너십을 맺었습니다.
Anthropic 선거 안전장치 업데이트
Anthropic은 2026년 미국 중간선거 및 기타 글로벌 선거 기간 동안 Claude가 공정하고 안전하게 유지되도록 중립성 훈련 및 자동 분류기를 포함한 포괄적인 안전장치 세이프가드 세트를 구현했습니다.
OpenAI GPT-5.5 릴리스 노트
OpenAI는 GPT-5.5와 GPT-5.5 Pro를 출시했으며, 에이전트 코딩, 컴퓨터 사용, 과학 연구 분야에서 큰 발전을 이루면서도 GPT-5.4와 동일한 지연 시간을 유지합니다.
OpenAI GPT-5.5 System Card
OpenAI가 복잡한 실무 작업 및 도구 사용에 최적화되고, 향상된 작업 이해도와 더욱 강력한 안전 프레임워크를 특징으로 하는 GPT-5.5를 출시했습니다.