✷ 아카이브 · 연구소 11곳 · 디스패치 3,049건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
일상 업무에서 ChatGPT Work 사용하기
2026년 4월 23일 OpenAI 아카데미 게시물에서는 ChatGPT Work가 캘린더, 이메일, 문서, 스프레드시트와 같은 기존 작업 자료를 팀이 검토하고 편집할 수 있는 초안 브리프, 요약, 데크, 워크북, 계획, 프로세스 문서로 변환하는 방법을 설명합니다.
크롬 확장 프로그램에서 Transformers.js 사용하기
Hugging Face는 Gemma 4 E2B로 구동되는 백그라운드 호스팅 모델 아키텍처를 특징으로 하는 Manifest V3를 사용하는 Chrome 확장 프로그램에 Transformers.js를 통합하는 기술 가이드를 제공합니다.
xAI Grok Voice Think Fast 1.0 출시
xAI는 복잡한 기업용 워크플로우, 대량의 도구 호출, 저지연 실시간 추론을 위해 설계된 플래그십 음성 모델인 grok-voice-think-fast-1.0을 출시했습니다.
Anthropic Claude 코드 품질 사후 분석 보고서
Anthropic는 Claude Code, Claude Agent SDK, Claude Cowork에 영향을 준 세 가지 별개의 기술적 문제를 해결했으며, 기본 고수준 추론 노력으로 복원하고 세션 메모리 버그를 수정했습니다.
ChatGPT for Clinicians 출시
OpenAI는 인증된 미국 의료 제공자를 위해 문서화, 의료 연구 및 임상 워크플로를 자동화하도록 설계된 ChatGPT의 무료 버전인 ChatGPT for Clinicians를 출시했습니다.
Google DeepMind Decoupled DiLoCo
Google DeepMind는 저대역폭과 혼합된 하드웨어 세대를 사용하여 멀리 떨어진 데이터 센터 간에 회복 탄력적이고 비동기적인 LLM 학습을 가능하게 하는 분산 학습 아키텍처인 Decoupled DiLoCo를 소개했습니다.
ChatGPT에서 워크스페이스 에이전트 소개 – OpenAI 연구 미리보기
OpenAI는 ChatGPT에서 워크스페이스 에이전트를 도입하여, 팀이 조직 통제를 준수하면서 도구 간 멀티스텝 워크플로를 자동화하는 공유 클라우드 기반 AI 에이전트를 만들 수 있도록 했습니다.
ChatGPT의 워크스페이스 에이전트: 개요 및 구축 방법
OpenAI는 트리거, 프로세스 및 도구 통합을 결합하여 반복 가능하고 구조화된 워크플로를 자동화하는 워크스페이스 에이전트를 ChatGPT에 도입했으며, 이를 통해 팀이 일관된 AI 기반 작업을 공유할 수 있게 했습니다.
OpenAI Responses API WebSocket 모드 출시
OpenAI는 Responses API에 WebSocket 지원을 도입하여 중복된 API 오버헤드를 제거하고 초당 최대 4,000 토큰의 추론 속도를 가능하게 함으로써 에이전트 워크플로우 지연 시간을 최대 40%까지 감소시켰습니다.
Qwen3.6-27B 릴리스 노트 / 새로운 내용
Qwen은 27억 파라미터의 밀집형 멀티모달 모델인 Qwen3.6-27B를 출시했으며, 모든 주요 에이전트 코딩 벤치마크에서 더 큰 Qwen3.5-397B-A17B를 능가합니다.
OpenAI 프라이버시 필터 릴리스
OpenAI는 비구조화 텍스트에서 개인 식별 정보(PII)를 고속으로, 컨텍스트를 인식하여 감지하고 삭제하도록 설계된 오픈-웨이트 1.5B 파라미터 모델인 Privacy Filter를 공개했습니다.
vLLM FP8 KV-Cache 및 Attention 양자화 업데이트
vLLM은 Hopper 및 Blackwell 아키텍처 전반에서 베이스라인에 가까운 정확도를 유지하면서 디코딩 지연 시간과 메모리 사용량을 줄이기 위해 FP8 KV-cache 및 attention 양자화를 최적화했습니다.
Anthropic 연구: 81,000명 사용자 설문을 기반으로 한 AI의 경제학
Anthropic의 81,000명 사용자 설문 조사 결과, 초기 경력 종사자와 AI 노출도가 높은 직무 종사자일수록 직업 대체 우려가 가장 크며, 생산성 향상은 고소득 종사자와 전문 역량 범위를 확장하는 사람들에게 가장 두드러진 것으로 나타났다.
앤트로픽 경제 지수 설문 조사 발표
앤트로픽은 월간 질적 연구를 통해 앤트로픽 인터뷰어를 활용해 AI가 일자리, 생산성, 근로자 기대에 미치는 영향을 실시간으로 추적하는 경제 지수 설문 조사를 시작했습니다.
Google DeepMind, Accenture, Bain & Company, BCG, Deloitte 및 McKinsey와 협력해 AI 전환을 가속화
Google DeepMind는 Accenture, Bain & Company, BCG, Deloitte, 그리고 McKinsey와의 파트너십을 발표했습니다. 이 파트너십은 Gemini와 같은 최첨단 모델에 대한 조기 접근을 제공하고, 산업별 AI 솔루션을 공동 개발하며, 리더십을 고객 CEO와 연결함으로써 기업 AI 전환을 가속화합니다.
ChatGPT 이미지 2.0 출시
OpenAI는 이미지 생성 기능을 크게 향상시킨 ChatGPT Images 2.0을 출시했으며, 정밀도 향상, 다국어 텍스트 렌더링, 스타일리시한 사실감이 강화되었습니다.
QIMMA: 품질 우선 아라비아어 LLM 리더보드
Hugging Face와 파트너들은 QIMMA를 도입했습니다. 이는 새로운 아라비아어 LLM 리더보드로, 벤치마크가 실제 언어 능력을 반영하도록 엄격한 품질 검증 파이프라인을 구현합니다.
vLLM v0.20.0 하이브리드 SSM 모델을 위한 분산 서빙 추가
vLLM v0.20.0은 하이브리드 SSM‑FA 모델을 위한 분산 프리필/디코드 서빙을 도입하여, 이중 디스크립터 뷰와 3‑디스크립터 Conv 상태 전송을 통해 효율적인 KV 전송을 가능하게 합니다.
Hugging Face: AI와 사이버 보안의 미래
Hugging Face는 오픈소스 AI 모델과 툴링이 Mythos와 같은 자율 취약점 탐지 시스템이 초래하는 위험에 대응하기 위한 사이버 보안 방어에 필수적이라고 주장합니다.
전 세계 기업에 Codex 확장 – OpenAI 발표
OpenAI는 Codex 사용량이 주당 3백만 명 이상에서 4백만 명 이상으로 증가했다고 발표했으며, Codex Labs와 글로벌 시스템 통합업체 파트너 프로그램을 도입하여 기업이 소프트웨어 개발 수명 주기 전반 및 그 이상에서 Codex를 도입하도록 지원했습니다.
GRASP: 장기 지평선에서 세계 모델을 위한 Gradient 기반 계획
BAIR는 GRASP를 소개합니다. 이는 학습된 세계 모델에서 궤적을 가상 상태로 올리고 행동 Gradient만을 사용해 적대적 상태‑입력 민감성을 회피함으로써 견고한 장기 지평선 계획을 가능하게 하는 Gradient 기반 플래너입니다.
Hyatt, 글로벌 운영 향상을 위해 ChatGPT Enterprise 배포
Hyatt는 ChatGPT Enterprise를 통합하여, 글로벌 기업 및 호텔 직원이 GPT 5.4와 Codex에 접근하여 수작업 작업을 자동화하고 고객 경험을 개선할 수 있도록 제공했습니다.
Anthropic와 Amazon의 5GW 컴퓨팅 용량 확보를 위한 협력 확대
Anthropic과 Amazon은 Claude의 학습 및 배포를 확장하기 위해 최대 5기가와트의 컴퓨팅 용량과 10년 동안 AWS 기술에 1,000억 달러의 투자를 확보하기 위한 협약을정을 sign했습니다.
Qwen3.6-Max-Preview 릴리스 노트 / 새로운 내용
Qwen3.6-Max-Preview는 Qwen이 제공하는 독점 프리뷰 모델로, Qwen3.6-Plus에 비해 에이전시 코딩, 세계 지식, 그리고 지시 수행 능력을 향상시켰습니다.
xAI Grok Speech to Text and Text to Speech APIs
xAI는 Grok Voice 및 Tesla 차량에 적용된 기술을 기반으로 고정밀 전사 및 표현력이 풍부한 음성 생성을 제공하는 독립형 Grok Speech to Text (STT) 및 Text to Speech (TTS) API를 출시했습니다.
OpenAI Codex 업데이트 2026년 4월
OpenAI는 Codex를 업데이트하여 백그라운드 컴퓨터 사용, 장기 작업 자동화 및 메모리를 지원하도록 하였으며, 코드 생성기에서 전체 소프트웨어 개발 라이프사이클 파트너로 활용 범위를 확대했습니다.
GPT-Rosalind: 생명과학을 위한 OpenAI의 프론티어 추론 모델
OpenAI는 생물학, 약물 발견 및 번역 의학에 최적화된 추론 모델인 GPT-Rosalind를 도입하여 초기 단계 연구 워크플로우를 가속화했습니다.
Hugging Face transformers-to-mlx 스킬 및 테스트 하네스
Hugging Face는 transformers 라이브러리에서 mlx-lm으로 언어 모델 포팅을 간소화하면서 높은 코드 품질과 리뷰어 신호를 유지하기 위해 스킬과 비에이전트 테스트 하네스를 출시했습니다.
Sentence Transformers를 사용한 멀티모달 임베딩 & 리랭커 모델의 학습 및 파인튜닝
Hugging Face는 Sentence Transformers를 사용한 멀티모달 임베딩 및 리랭커 모델의 학습과 파인튜닝에 대한 가이드를 발표했으며, 작업 특화 파인튜닝이 Visual Document Retrieval과 같은 검색 작업에서 성능을 향상시킨다는 것을 보여주었습니다.
OpenAI 사이버를 위한 신뢰할 수 있는 접근 프로그램
OpenAI는 신뢰할 수 있는 사이버 접근 프로그램을 출시했습니다. 이 프로그램은 다양한 수비자 생태계에 고급 사이버 기능에 대한 확장된 접근과 API 크레딧 1,000만 달러를 제공하여 글로벌 디지털 탄력성을 강화하는 것을 목표로 합니다.
Ecom-RLVE: 전자상거래 대화형 에이전트를 위한 적응형 검증 가능한 환경
Hugging Face는 대화형 유창성과 실제 작업 완료 사이의 격차를 해소하기 위해 적응형 난이도 확장을 갖춘 여덟 개 검증 가능하고 다중 턴 환경을 사용하여 전자상거래 에이전트를 훈련하는 프레임워크인 EcomRLVE-GYM을 소개합니다.
Gemini 3.1 Flash TTS 출시 노트 / 새로운 기능
Google DeepMind은 자연어 오디오 태그를 통해 음성 스타일, 속도, 전달을 정밀하게 제어할 수 있는 70+ 언어 지원 텍스트-음성 모델인 Gemini 3.1 Flash TTS를 출시했습니다.
VAKRA 벤치마크 분석: 에이전트 추론, 도구 사용 및 실패 모드
Hugging Face는 8,000개 이상의 API와 문서 소스에 걸쳐 구성적 추론 능력을 평가하는 실행 가능한 도구 기반 스위트인 VAKRA 벤치마크를 발표했으며, 이를 통해 도구 선택, 멀티 홉 추론 및 정책 준수에서 나타나는 광범위한 실패를 드러냈습니다.
OpenAI Agents SDK 업데이트
OpenAI는 Agents SDK의 업데이트된 기능을 출시하여 모델-네이티브 하네스와 네이티브 샌드박스 실행을 도입함으로써 프로덕션 환경에서 에이전트의 신뢰성과 성능을 향상시켰습니다.
HCompany HoloTab 출시
HCompany은 Holo3 모델을 기반으로 하는 Chrome 확장 프로그램인 HoloTab을 출시했는데, 이는 사용자가 자연어 설명이나 기록된 루틴을 통해 웹 작업을 자동화할 수 있게 합니다.
Qwen3.6-35B-A3B 릴리즈 노트
Qwen은 350억 전체 파라미터와 30억 활성 파라미터를 가진 오픈소스 혼합 전문가 모델 Qwen3.6-35B-A3B를 출시했으며, 이는 에이전시 코딩 및 멀티모달 추론에서 더 큰 밀집 모델과 경쟁합니다.
OpenAI, 사이버를 위한 Trusted Access를 확대하고 방어 사이버 보안을 위한 GPT‑5.4‑Cyber를 출시
OpenAI는 검증된 방어자를 수천 명으로 확대하고, 방어 사이버 보안을 위해 설계된 미세 조정된 보다 관용적인 모델인 GPT‑5.4‑Cyber를 출시하면서 Trusted Access for Cyber 프로그램을 확장합니다.
vLLM Korea Meetup 2026 정리
서울에서 열린 vLLM Korea Meetup 2026은 vLLM이 통합 추론 인프라로 진화한 모습을 보여주었으며, 커뮤니티 성장, 하드웨어 통합 진전, 프로덕션 스택 기능, 그리고 오픈소스 및 엔터프라이즈 트랙 전반에 걸친 실제 배포 전략을 선보였습니다.
앤트로픽 자동화된 일치 연구자, 0.97 성능 차이 회복 달성
앤트로픽의 자동화된 일치 연구자(AARs)는 Claude Opus 4.6를 기반으로 하여 약한 모델에서 강한 모델로의 감시 성능 차이의 97%를 회복했으며, 대규모 언어 모델이 일치 관련 아이디어를 자율적으로 생성하고 테스트할 수 있음을 입증했습니다.
Anthropic Long-Term Benefit Trust, Vas Narasimhan을 이사회 멤버로 임명
Anthropic의 Long-Term Benefit Trust가 헬스케어 및 생명 과학 AI 애플리케이션 분야에서 회사의 거버넌스를 강화하기 위해 Novartis의 CEO인 Vas Narasimhan을 이사회 멤버로 임명했습니다.
Gemini Robotics-ER 1.6 릴리스 노트 / 새로운 내용
Google DeepMind는 Gemini Robotics-ER 1.6을 출시했습니다. 이 모델은 추론 중심 모델로, 공간 추론, 다중 시점 이해 및 자동 로봇 작업을 위한 계측기 판독을 향상시킵니다.
Cloudflare Agent Cloud와 OpenAI 통합
Cloudflare Agent Cloud는 이제 GPT-5.4와 Codex를 포함한 OpenAI 프론티어 모델을 통합하여, 기업이 에지에서 확장 가능하고 프로덕션 준비가 된 AI 에이전트를 배포할 수 있도록 합니다.
고객 성공 팀을 위한 ChatGPT
OpenAI는 고객 성공 팀이 산재된 고객 컨텍스트를 구조화된 실행 계획과 커뮤니케이션으로 합성하여 운영 오버헤드를 줄이는 ChatGPT 사용 가이드를 소개했습니다.
OpenAI에서의 AI 응용
OpenAI는 ChatGPT와 Codex와 같은 직접 접근 제품을 통해 AI 기능을 제공하며, 또한 OpenAI API를 통해 개발자 통합을 위한 조합 가능한 빌딩 블록도 제공합니다.
ChatGPT 연구 가이드
OpenAI는 연구 프로세스를 가속화하기 위해 ChatGPT를 사용하는 가이드를 발표했으며, 빠른 오리엔테이션을 위한 Search와 다단계 조사를 위한 Deep Research라는 두 가지 차별화된 접근 방식을 소개했습니다.
Axios 개발자 도구 침해에 대한 OpenAI 대응
OpenAI는 Axios 라이브러리에 대한 제3자 공급망 공격으로 GitHub Actions 워크플로가 노출된 후 macOS 코드 서명 인증서를 교체하고 있지만, 사용자 데이터 도난이나 소프트웨어 침해에 대한 증거는 발견되지 않았습니다.
OpenAI Academy: 영업 팀을 위한 ChatGPT
OpenAI는 영업 팀이 ChatGPT를 사용하여 계정 조사 속도를 높이고, 맞춤형 아웃리치를 수행하며, 내부 거래 관리를 조정할 수 있도록 가이드를 발표했습니다.
ChatGPT를 사용한 데이터 분석 – OpenAI Academy
OpenAI Academy는 채팅 인터페이스에서 직접 그리고 Excel 또는 Google Sheets 내에서 ChatGPT를 사용하여 데이터 분석하는 방법을 보여주는 가이드를 발표했으며, 데이터 업로드, 질문하기, 시각화 생성, 신뢰할 수 있는 결과 보장을 위한 단계들을 설명합니다.
OpenAI 의료 프롬프트 템플릿
OpenAI는 진단 검사 선택, 감별 진단 생성, 평가 및 계획 작성, 진료 기록 문서화, 환자 상담, 치료 전환 조정, 가이드라인 요약, 임상 참고 자료 검색 등과 같은 임상 작업을 위한 빈칸 채우기 프롬프트 템플릿을 제공하는 Healthcare 페이지를 발표했습니다.
운영 팀을 위한 ChatGPT
OpenAI는 운영 팀이 ChatGPT를 '항시 대기 중인 수석 실무자'처럼 사용하도록 하는 가이드를 소개하여 조정 마찰을 줄이고 운영 워크플로를 표준화합니다.