아카이브 · 연구소 11곳 · 디스패치 3,049건

연구소

매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.

151

OpenAI, CodeAI와 협력해 청소년용 ChatGPT 및 AI 리터러시 프로그램 출시

OpenAI는 CodeAI와 협력하여 고등학생들에게 AI 리터러시, 비판적 사고, 책임감 있는 사용을 가르치는 청소년용 ChatGPT 및 교육 프로그램 패키지를 출시했다.

152

OpenAI 사이버 보안 핵심 역량을 위한 모델 개발 속도 조절

OpenAI는 심각한 사이버 보안 역량에 대한 증거가 발견됨에 따라, 강화된 모니터링, 정렬 및 보안 안전장치를 구현하기 위해 Astra를 포함한 최신 모델의 스케일링 속도를 일시적으로 늦추었습니다.

153

Asana, OpenAI Codex를 사용하여 레거시 코드 마이그레이션 가속화

Asana는 OpenAI Codex를 사용하여 구식 테스트 시스템을 2주 만에 제거했으며, 이는 5년과 600만 달러가 소요될 것으로 예상되었던 프로젝트를 완료한 것입니다.

154

Sentence Transformers v6.0 다중 벡터 인코더 릴리스

Sentence Transformers v6.0은 ColBERT 스타일의 후기 상호작용 검색을 위한 `MultiVectorEncoder` 모델 유형을 추가하여, 텍스트, 이미지, 오디오, 비디오에 걸쳐 토큰 수준 임베딩을 가능하게 하며, 더 높은 검색 품질을 제공하지만 더 큰 인덱스를 요구합니다.

155

NVIDIA의 ChatGPT Work 도입 사례

NVIDIA는 ChatGPT Work를 사용하여 운영 프로세스를 자동화하고 산업 지능을 합성하며, 수동 분석 시간을 줄이고 프로토타입 개발을 가속화합니다.

156

클로드 단백질 설계 및 분석 화학 기능

애너트릭은 클로드 모델이 인간 전문가를 초월하는 히트율로 자율적으로 고결합력 단백질 결합체를 설계하고, NMR 및 LC-MS 데이터 처리를 포함한 복잡한 분석 화학 워크플로우를 자동화할 수 있음을 입증했다.

157

Dharma AI GPU 관리: 제약 조건 인식 할당을 통한 클러스터 활용도 향상

Dharma AI는 동일한 하드웨어에서 FIFO 스케줄링과 비교해 GPU 활용도를 최대 33%포인트, 우선순위 가중 출력을 최대 105% 향상시킨 제약 조건 인식 GPU 할당기를 개발했습니다.

158

방어자의 창: OpenAI의 AI 기반 사이버보안 전략

OpenAI-Hugging Face 사고 이후 OpenAI는 AI 기반 사이버공격에 대응하기 위한 포괄적인 방어 전략을 제시하며, 조직이 선도적인 지능을 활용해 보안 프로그램을 자동화할 긴급한 필요성을 강조한다.

159

OpenAI, PORTS-Pike 프로젝트 참여

OpenAI는 프론티어 AI 학습 및 제품 수요를 지원하기 위해 오하이오주 PORTS-Pike Technology Campus에서 8 gigawatts-IT의 용량을 확보하고자 SB Energy, NVIDIA, 그리고 미국 에너지부와 파트너십을 맺고 있습니다.

160

OpenAI 지능형 시대의 새로운 정책 아이디어 보조금

OpenAI는 AI 시대의 경제적 기회와 사회적 회복탄력성을 위한 14개의 글로벌 독립 프로젝트에 100만 달러의 자금과 100만 달러의 API 크레딧을 제공합니다.

161

vLLM-Omni 분산 계층별 오프로드

vLLM-Omni는 분산 계층별 오프로드(DLO)를 도입하여, 가중치 샤딩과 이중 버퍼 프리페치를 통해 HBM 및 호스트 메모리 사용을 최적화함으로써 200B 파라미터 이상의 대규모 Diffusion Transformer(DiT) 모델을 효율적으로 제공할 수 있게 합니다.

162

클로드 텍스트 워터마킹 구현

안트로픽은 유럽연합 AI 법규 준수를 위해 향후 클로드 모델에 텍스트 워터마킹을 도입하고 있으며, 이는 단어 선택 과정에서 난수의 원천을 변경함으로써 출력 품질에 영향을 주지 않으면서도 AI 생성 콘텐츠를 탐지할 수 있도록 하는 방법입니다.

163

vLLM DSpark을 활용한 적응형 검증(Adaptive Verification)

vLLM은 DSpark의 신뢰도 헤드를 사용하여 단계별로 검증할 추측적 토큰의 수를 동적으로 조정함으로써, 다양한 동시성 수준에서 높은 처리량을 유지하는 적응형 검증을 도입합니다.

164

오픈 모델 현황 2026년 여름 보고서

Hugging Face의 2026년 여름 보고서에 따르면, 현재 중국 연구소들이 프론티어 오픈 모델 출시를 주도하고 있으며, 소형 모델이 여전히 대부분의 다운로드를 차지하고 있습니다. Qwen은 커뮤니티의 베이스 모델로 자리 잡았으며, 에이전트가 Hub의 주요 사용자로 부상했습니다.

165

GitHub Copilot의 Grok 4.6

xAI는 최신 코딩 모델인 Grok 4.6을 GitHub Copilot에 통합하여 VS Code 및 GitHub를 사용하는 개발자들이 사용할 수 있도록 했습니다.

166

Strands 로봇과 LeRobot 스트리밍 데이터 루프를 Hugging Face 저장 버킷과 함께 사용하기

Hugging Face는 Strands 로봇이 LeRobot 시연을 기록하고, 바이트 수준 중복 제거 기능이 있는 수정 가능한 Hugging Face 저장 버킷으로 동기화하며, Hub에서 직접 데이터셋을 스트리밍하여 훈련하고, 결과 정책을 하드웨어로 재배포하는 완전한 데이터 루프를 발표했습니다. 이 과정은 로컬 다운로드 없이도 가능합니다.

167

Gemini 3.7 Flash 릴리스 노트 / 새로운 기능

Google DeepMind가 Gemini 3.6 Flash보다 성능은 대폭 향상시키고 도입 비용은 절반으로 낮춘, 코딩 및 에이전트에 최적화된 Gemini 3.7 Flash를 출시했습니다.

168

Fyxer AI 비서 기술 구현

Fyxer는 30~50개의 전문화된 OpenAI 모델 시스템과 500,000시간의 인간 비서 워크플로우 데이터셋을을 사용하여 90%의 90일 사용자 유지율을 달성했습니다.

169

GPT-5.6 릴리스 노트: 에이전트의 가격-성능 향상

OpenAI는 모델 선택 개선, 추론 지속성에 대한 새로운 API 제어, 프로그래밍 기반 도구 호출을 통해 선도적인 에이전트 성능의 비용을 크게 줄인 GPT-5.6 모델 패밀리를 출시했습니다.

170

OpenAI GPT-5.6 Sol Ultrafast Mode Preview

OpenAI는 Cerebras를 기반으로 초당 최대 750개의 출력 토큰을 제공하며 표준 처리 속도보다 최대 14배 빠른 GPT-5.6 Sol의 새로운 서비스 티어인 Ultrafast 모드를 도입했습니다.

171

OpenAI, 최고 수익 책임자로 달리 라지크 임명

OpenAI, 주간 활성 사용자 수가 10억 명을 넘는 상황에서 글로벌 수익 조직을 확장하기 위해 달리 라지크를 최고 수익 책임자로 임명했다.

172

허깅페이스 ICML 2026 오픈 재현 보고서

허깅페이스는 코드 에이전트를 활용해 2,226편의 ICML 2026 논문을 재현하는 커뮤니티 해커톤을 주도하였으며, 그 결과 51%의 논문에서 적어도 하나의 확인된 주장이 발견되었고, 23%의 논문에서 적어도 하나의 위조되거나 논란이 된 주장이 확인되었다.

173

DeepSeek-V4-Pro GA 릴리스

DeepSeek는 향상된 에이전트 기능, 유연한 추론 노력 설정, 네이티브 OpenAI Responses API 지원을 특징으로 하는 DeepSeek-V4-Pro를 출시했습니다.

174

다중 에이전트 시스템에서의 앤트로픽 패턴과 문제점

앤트로픽의 연구에 따르면, 최전선 모델은 병렬 작업에서는 협력할 수 있지만, 동료 수준의 협업에서는 어려움을 겪고, 행동 일치로 인해 체계적 실패를 겪으며, 상충된 목표가 주어지면 '영토 전쟁'으로 악화될 수 있다.

175

OlmoEarth Embeddings: 지구 관측을 위한 맞춤형 벡터 내보내기

Hugging Face와 AllenAI는 OlmoEarth Studio에서 맞춤형 임베딩 내보내기 기능을 도입하여, 사용자가 다운스트림 지형 공간 분석을을 위해 지구 관측 데이터의 압축된 수치 표현을 생성할 수 있도록 했습니다.

176

Google DeepMind SL2T: Pixel 11용 수어-to-텍스트 번역

Google DeepMind는 미국 수어(ASL)를 시작으로, Pixel 11의 Gboard와 Live Transcribe에서 수어-to-텍스트 음성 인식 기능을 제공하는 다국어 수어-to-텍스트 모델 SL2T를 발표했습니다.

177

LFM2.5-VL-3B 릴리스 노트 / 새로운 기능

Liquid AI는 화면 이해, 그라운딩, 및 도구 호출 기능이 향상된, 에지 장치에 최적화된 3.1B 파라미터 시각-언어 모델인 LFM2.5-VL-3B를 출시했습니다.

178

OpenAI 기업용 AI 도입: 보조에서 실행으로

OpenAI는 상위 10%의 기업 사용자가 단순한 AI 보조에서 에이전트형 실행으로 전환함으로써 일반 기업보다 8.3배 더 많은 출력 토큰을 생성하는 '프런티어 격차'가 확대되고 있다고 보고했습니다.

179

vLLM의 Qwen3.8-2.4T-A95B Day 0 지원

vLLM이 Qwen-Max급 성능을 오픈 웨이트로 제공하는 2.4조 파라미터 규모의 희소 MoE 모델인 Qwen3.8-2.4T-A95B에 대한 Day-0 지원을 발표했습니다.

180

RingCentral AI-Native 개발 및 운영 통합

RingCentral는 기술직 및 비기술직 직원 모두를 대상으로 제품 개발을 가속화하고 PMO 운영을 자동화하기 위해 ChatGPT Work와 Codex를 사용하는 AI-native 워크플로우를 구현했습니다.

181

Anthropic 연구: 노동자 재교육 프로그램에 대한 증거 검토

Anthropic과 연구원 David Roodman은 직업 재교육 프로그램이 완만한 긍정적 효과를가져오지만, AI로 인한 대규모 노동 시장 혼란을 완화하기에는 불충분할 가능성이 높다는 것을 발견했습니다.

182

Grok 4.6 릴리스 노트 / 새로 추가된 기능

xAI는 장기 실행형 에이전트, 복잡한 프로그래밍 및 시각 작업에 최적화된 Grok 4.6을 출시했으며, AA 지능 지수에서 GPT-5.6 Sol과 동등한 성능을 보였습니다.

183

ALTK-Evolve vs ACE: 동일한 학습 내용, 더 적은 토큰

ALTK‑Evolve는 전체 플레이북을 주입하는 대신 선택적 가이드라인 검색을 사용함으로써, 추론 토큰을 20-40%만 사용하면서도 ACE의 작업 완료 정확도와 대등하거나 이를 능가하는 성능을 보여줍니다.

184

Mistral AI 주권 AI 인프라 및 지역별 추론 업데이트

Mistral AI는 지역별 추론 엔드포인트, 제3자 오픈 모델 지원, 그리고 장기적인 유럽 컴퓨팅 용량 연합을 도입함으로써 기업과 정부의 AI 주권을 강화하고 있습니다.

185

OpenAI Daybreak 모델이 이제 AWS Bedrock에서 사용 가능합니다

OpenAI는 Daybreak Blue(GPT-5.6 Sol과 같은 범용 최첨단 모델) 및 Daybreak Red(목적 기반 보안 모델)를 포함한 한 Daybreak 사이버 보안 모델을 Amazon Bedrock을 통해 사용할 수 있다고 발표했습니다. 이를 통해 기업은 기존 AWS 워크플로우 내에서 고급 AI 기반 보안 기능을 통합할 수 있습니다.

186

NVIDIA Nemotron 3.5 Lightning 출시

NVIDIA Nemotron 3.5 Lightning는 토큰당 30억 개의 활성 파라미터를 가진 30B 파라미터 오픈 모델로, 1M 토큰 컨텍스트 윈도우를 통해 로컬 에이전트 워크플로우 및 다단계 작업을 위해 설계되었습니다.

187

xAI Grok Bot 출시

xAI는 API가 필요하지 않고 다양한 애플리케이션과 도구를 통해 엔드투엔드 작업을 수행하기 위해 자체 클라우드 컴퓨터를를 운영할 수 있는 AI 팀원인 Grok Bot을 출시했습니다.

188

Anthropic의 효과적인 AI 에이전트 구축 – 실용적인 패턴 및 가이드라인

Anthropic은 LLM 증강 에이전트 및 워크플로우 구축을 위한 실용적인 패턴을 개략적으로 설명하며, 단순한 결합형 설계, 각 패턴의 사용 시점, 도구 엔지니어링을 위한 모범 사례를 강조합니다.

189

Anthropic Claude Sonnet 5 발표

Anthropic은 Opus-class 성능에 필적하며 안전성과 가격을 개선한, 더 에이전트적인 그리고 비용 효율적인 모델인 Claude Sonnet 5를 발표했습니다.

190

OpenAI AI-Native Finance Function Implementation

OpenAI는 핵심 워크플로우에 AI를 통합하고 재무 전문가가 직접 도구를 구축할 수 있도록 지원함으로써, zero-day close 및 지속적인 예측을 달성하기 위해 재무 운영을 재설계하고 있습니다.

191

NVIDIA Magpie TTS Multilingual 출시

NVIDIA는 저지연, 프로덕션 준비가 된 음성 에이전트를 위해 설계된 12개 언어를 지원하는 364M-parameter open-weights 모델인 Magpie TTS Multilingual를 출시했습니다.

192

OpenAI의 텍사스 내 책임감 있는 AI 인프라 구축 제안

OpenAI는 텍사스 주민들에게 의미 있는 혜택을 제공하기 위해 주 내에 책임감 있는 AI 인프라를 개발하겠다는 의지를 담은 서한을 Greg Abbott 텍사스 주지사에게 보냈습니다.

193

Model ML 및 GPT-5.6 Sol을 활용한 금융 워크플로우 자동화

Model ML은 GPT-5.6 Sol을 활용하여 엔드 투 엔드 금융 워크플로우를 자동화하며, 이전 모델들과 비교하여 PowerPoint 및 Excel 결과물의 전문가용 준비율을 크게 향상시킵니다.

194

LLM을 위한 효율적인 지식 증류: Offline Top-K Logits 및 Fused Chunked KL Loss

Multiverse Computing은 offline top-K logit caching과 fused chunked KL loss를 사용하여 대규모 언어 모델의 VRAM 요구 사항과 학습 비용을 크게 줄이는 메모리 효율적인 증류 방법을 소개합니다.

195

OpenAI Daybreak Cyber Partner Program

OpenAI는 보안 파트너가 최첨단 사이버 모델을 사용할 수 있도록 Daybreak Cyber Partner Program을 출시하여 조직이 취약점을 더 효율적으로 찾고 해결할 수 있도록 지원합니다.

196

OpenAI Daybreak 및 GPT-5.6-Cyber 출시

OpenAI는 Daybreak 프로그램을 확장하고, 신뢰할 수 있는 방어자들에게 고급 사이버 보안 역량을 제공하고 승인된 보안 연구를 위한 거부율을 낮추도록 설계된 특화 모델인 GPT-5.6-Cyber를 도입했습니다.

197

Meta Muse Glimmer 30B 출시

Meta는 Muse 모델에서 증류된 30B 파라미터 멀티모달 모델인 Muse Glimmer를 Apache 2.0 라이선스로 출시했으며, 코딩 및 문서 분석과 같은 로컬 에이전트 활용 사례에 최적화되어 있습니다.

198

ChatGPT Business 프리미엄 좌석 출시

OpenAI는 고용량 사용자를 위한 ChatGPT Business용 프리미엄 좌석을 출시하여 5배 더 많은 사용량과 5시간 사용 제한 제거를 제공합니다.

199

Virgin Atlantic의 ChatGPT Work 통합

Virgin Atlantic은 경쟁사 조사를 가속화하고, 고객 여정 데이터를 통합하며, 제품 계획을 간소화하여 엔드 투 엔드 승객 경험을 개선하기 위해 ChatGPT Work를 활용하고 있습니다.

200

ChatGPT Work를 활용한 Zapier의 마케팅 자동화

Zapier의 엔터프라이즈 마케팅 팀은 ChatGPT Work를 사용하여 리드 퍼널 최적화와 캠페인 실행을 자동화하며, 그 결과 월간 7자리 숫자의 파이프라인 성장을 이끌어냈습니다.