✷ 아카이브 · 연구소 11곳 · 디스패치 3,049건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
앤트로픽 책임 있는 스케일링 정책 버전 3.0
앤트로픽은 책임 있는 스케일링 정책(RSP)의 버전 3.0을 발표하며, 회사의 단독 약속과 산업 전반의 안전 권고를 분리하는 프레임워크를 재구성하고, 프론티어 안전 로드맵과 정기적인 리스크 보고서를 도입했습니다.
OpenAI, SWE-bench Verified 평가 중단
OpenAI는 결함이 있는 테스트 케이스와 훈련 데이터 오염으로 인해 벤치마크가 최첨단 모델의 코딩 역량을 신뢰할 수 없는 측정 수단이 되었다는 이유로 SWE-bench Verified 점수 보고를 중단했습니다.
OpenAI 프론티어 얼라이언스 파트너 발표
OpenAI는 프론티어 얼라이언스를 출범시켜 McKinsey, BCG, BCG X, Accenture, Capgemini와 파트너십을 맺고 기업이 프론티어 플랫폼을 활용해 AI 동료를 배포하고 확장하도록 돕습니다.
앤트로픽 교육 보고서: AI 유창성 지수
앤트로픽은 사용자가 AI와 협업하는 방식을 측정하기 위해 AI 유창성 지수를 도입했으며, 반복적인 개선이 고수준의 AI 유창성에 가장 강한 예측 요소임을 발견했다.
앤트로픽 퍼소나 선택 모델
앤트로픽은 퍼소나 선택 모델을 제안하며, AI 어시스턴트가 인간처럼 행동하는 이유가 사전 훈련 과정에서 배운 인간적인 퍼소나를 시뮬레이션하기 때문이며, 후속 훈련이 이를 정제하기 때문이라고 주장한다.
Ollama 0.17: OpenClaw AI 어시스턴트를 위한 간소화된 설정
Ollama 0.17은 로컬 하드웨어에서 이메일, 캘린더, 메시징 앱을 관리할 수 있는 개인용 AI 어시스턴트인 OpenClaw의 단일 명령어 설치 프로세스를 도입합니다.
증류 공격 탐지 및 방지에 관한 Anthropic 보고서
Anthropic은 DeepSeek, Moonshot, MiniMax가 24,000개 이상의 허위 계정을 사용하여 Claude의 능력을 불법적으로 추출하기 위해 수행한 산업 규모의 증류 공격을 식별하고 상세히 설명했습니다.
OpenAI 첫 번째 증명 제출
OpenAI는 First Proof 연구 수준 수학 챌린지를 위해 증명 시도를 제출했으며, 내부 모델이 10문제 중 최소 5문제를 해결했을 가능성이 있습니다.
Unsloth와 Hugging Face Jobs로 AI 모델 훈련
Hugging Face는 Unsloth와 Hugging Face Jobs를 통합하여 빠르고 저비용의 LLM 파인튜닝을 가능하게 했으며, 특히 LiquidAI/LFM2.5-1.2B-Instruct와 같은 소형 모델에 최적화되었습니다.
GGML 및 llama.cpp, Hugging Face에 합류
GGML, llama.cpp의 제작자는 Hugging Face에 합류하여 로컬 AI 추론을 위한 지속 가능한 자원을 제공하고 Transformers 라이브러리와 로컬 모델 배포 간의 통합을 간소화합니다.
Anthropic Claude Code Security 연구 프리뷰 발표
Anthropic은 코드베이스의 복잡한 취약점을 스캔하고 패치를 제안하는 AI 기반 정적 분석 도구인 Claude Code Security를 출시했으며, 현재 기업 및 오픈소스 팀을 위한 제한된 연구 프리뷰로 제공됩니다.
Gemini 3.1 Pro 릴리즈 노트
Google DeepMind는 Gemini 3.1 Pro를 공개했습니다. 이 새로운 모델은 복잡한 작업에 대한 추론 능력이 크게 향상되었으며, 현재 Gemini API, Vertex AI, Gemini 앱, Notebook LM을 통해 프리뷰로 제공됩니다.
OpenAI 보조금: The Alignment Project
OpenAI는 영국 AI 보안 연구소(UK AISI) 펀드인 The Alignment Project에 $7.5 백만 규모의 보조금을 발표했으며, 이는 AI 정렬 및 안전에 대한 독립 연구를 확대하기 위한 것입니다.
인도용 OpenAI 이니셔티브
OpenAI는 Tata Group 및 기타 기관과 협력하여 주권 AI 인프라를 구축하고 기업 도입을 가속화하며 전국적인 AI 역량 강화를 확대하는 'OpenAI for India'라는 전국 이니셔티브를 시작했습니다.
IBM과 UC Berkeley, IT-Bench와 MAST를 활용해 엔터프라이즈 에이전트 실패 진단
IBM Research와 UC Berkeley는 MAST(멀티에이전트 시스템 실패 분류법)를 도입해 엔터프라이즈 IT 에이전트가 실패하는 이유를 진단했으며, 최첨단 모델은 고립된 검증 오류를 겪는 반면 오픈 모델은 연쇄적인 시스템 붕괴를 겪는 것으로 밝혀졌습니다.
Lyria 3와 Gemini 음악 생성
Google DeepMind가 Lyria 3 생성 음악 모델을 Gemini 앱에 통합하여 사용자가 텍스트 프롬프트 또는 이미지·비디오 업로드를 통해 30초 길이의 AI 생성 트랙을 만들 수 있게 했습니다.
Gradio 6 gr.HTML: 원샷 웹 앱 개발
Gradio 6은 맞춤 템플릿, 범위가 지정된 CSS 및 JavaScript 인터랙티브를 지원하는 향상된 gr.HTML을 도입하여 단일 Python 파일 내에서 복잡한 웹 컴포넌트를 생성할 수 있게 합니다.
OpenAI가 EVMbench를 소개합니다
OpenAI와 Paradigm은 고위험 스마트 계약 취약점을 탐지, 패치 및 악용하는 AI 에이전트의 능력을 평가하도록 설계된 벤치마크인 EVMbench를 출시했습니다.
Anthropic, 실질적인 AI 에이전트 자율성 측정 – 주요 발견 및 함의
Anthropic의 2026년 2월 연구에 따르면, 클로드 코드 에이전트는 더 오래 자율적으로 작동하며, 경험이 많은 사용자는 더 많은 작업을 자동 승인하지만 더 자주 개입합니다. 에이전트는 인간보다 더 자주 명확화를 요청하며, 위험 도메인에서의 사용은 제한적이지만 점차 확대되고 있습니다.
Google DeepMind AI 국가 파트너십: 인도 확장
Google DeepMind는 과학, 교육, 농업 및 에너지 안보를 위해 최첨단 AI 모델에 대한 접근성을 확대하기 위해 인도 정부 기관 및 기관들과 새로운 파트너십을 구축하고 있습니다.
Anthropic과 르완다 정부의 AI 통합을 위한 MOU
Anthropic과 르완다 정부는 르완다의 보건, 교육 및 공공 부문 시스템에 AI를 통합하기 위한 3년 기간의 양해각서(MOU)를 체결했습니다.
Anthropic과 Infosys의 기업용 AI 에이전트 협업
Anthropic과 Infosys는 Claude 모델과 Claude Code를 Infosys Topaz와 통합하여 통신, 금융 서비스, 제조를 포함한 규제 산업을 위한 에이전트형 AI 솔루션을 구축하기 위해 파트너십을 맺었습니다.
Anthropic Economic Index: India Country Brief
인도는 Claude.ai의 총 사용량 측면에서 전 세계 2위를 기록하고 있지만, IT 분야에 사용이 집중되어 있고 1인당 채택률은 현저히 낮습니다. 한편, 복잡한 작업에 대한 15배의 생산성 향상을 제공합니다.
Ollama가 Claude Code에 Subagents 및 Web Search 기능 추가
Ollama는 이제 Claude Code 내에서 subagents 및 web search를 지원하여, MCP 서버나 API 키 없이도 모델이 병렬 작업을 수행하고 실시간 정보에 접근할 수 있도록 합니다.
Anthropic, 벵갈루루 사무소 개설 및 전략적 파트너십을 통해 인도 시장 확장
Anthropic은 벵갈루루에 새로운 사무소를 개설하고 책임감 있는 AI와 인도 언어 능력 향상을 위해 기업, 교육 및 농업 분야에서 파트너십을 것을 맺었습니다.
Qwen 3.5‑397B‑A17B 출시: 1 M 토큰 컨텍스트와 최첨단 멀티모달 성능을 갖춘 하이브리드 선형‑어텐션 MoE 모델
Qwen 3.5‑397B‑A17B는 토큰당 17 billion 파라미터만 활성화하는 397 billion 파라미터 멀티모달 모델로, 언어, 코딩, 추론 및 비전 작업에서 최첨단 성능을 제공하면서 이전 모델보다 최대 19배 빠릅니다.
GPT-5.2 이론 물리학에서 새로운 결과 도출
OpenAI는 GPT-5.2 Pro와 스캐폴드된 GPT-5.2 버전을 사용해 반공선성 영역에서 비제로 글루온 트리 진폭에 관한 새로운 이론 물리학 결과를 도출했다고 발표했습니다.
ChatGPT 잠금 모드 및 고위험 라벨
OpenAI는 프롬프트 인젝션 공격을 완화하고 데이터 유출 위험에 대한 사용자의 제어력을 강화하기 위해 잠금 모드와 고위험 라벨을 도입했습니다.
OpenAI의 Codex 및 Sora에 대한 하이브리드 크레딧 시스템을 통한 액세스 확장
OpenAI는 Codex 및 Sora 사용자를 위한 강제 중단을 방지하기 위해 속도 제한과 구매 가능한 크레딧 시스템을 결합한 실시간 액세스 엔진을 구현했습니다.
OpenAI GABRIEL: GPT를 활용한 사회과학 연구 확장
OpenAI는 GPT를 사용하여 비구조화된 텍스트와 이미지를 사회과학 연구를 위한 정량적 측정값으로 변환하는 오픈소스 Python 툴킷인 GABRIEL을 출시했습니다.
Hugging Face CUDA 커널 에이전트 스킬
Hugging Face는 Claude와 Codex와 같은 코딩 에이전트가 transformers와 diffusers 라이브러리를 위한 프로덕션 수준의 CUDA 커널을 작성하고, 벤치마크하며, 통합할 수 있게 하는 에이전트 스킬을 도입했습니다.
Anthropic 이사회에 크리스 리델 임명
Anthropic은 마이크로소프트와 제너럴 모터스의 전 CFO이자 전 백악관 부수석보좌관인 크리스 리델을 이사회 이사로 임명하여 AI의 사회적 영향에 대한 거버넌스와 감독을 강화했다.
Anthropic와 CodePath의 AI 통합 컴퓨터 과학 교육을 위한 파트너십
Anthropic은 CodePath와 파트너십을 맺어 Claude와 Claude Code를 커리큘럼에 통합하여, 커뮤니티 칼리지, 주립대학교, 및 HBCU의 20,000명 이상의 학생들에게 최첨단 AI 도구에 대한 접근성을 제공합니다.
Gemini 3 Deep Think 업데이트
Google DeepMind는 Gemini 3 Deep Think를 업데이트했으며, 이 특화된 추론 모드는 수학, 물리학 및 화학 올림피아드에서 금메달 수준의 성능을 달성하고 이제 선택된 사용자에게 Gemini API를 통해 제공됩니다.
GPT-5.3-Codex-Spark 릴리스 노트
OpenAI는 실시간 코딩 협업에 최적화된 소형 저지연 모델인 GPT-5.3-Codex-Spark를 출시했으며, Cerebras 하드웨어에서 초당 1,000 토큰 이상을 처리합니다.
OpenEnv: 실제 환경에서 도구를 사용하는 에이전트 평가
Hugging Face와 Meta가 OpenEnv를 소개합니다. 이는 실제 시스템 및 Calendar Gym과 같은 프로덕션 급 환경에서 AI 에이전트를 평가하는 오픈소스 프레임워크로, 연구와 프로덕션 신뢰성 사이의 격차를 해소하기 위한 것입니다.
Anthropic, AI 거버넌스를 위해 Public First Action에 2,000만 달러 기부
Anthropic은 AI 안전장치 촉진, 대중 교육, 그리고 AI 정책에서의 미국의 리더십을 위해 헌신하는 초당파적 501(c)(4) 단체인 Public First Action에 2,000만 달러를 기부했습니다.
Anthropic Series G Funding and Enterprise Growth
Anthropic은 프론티어 연구, 제품 개발 및 인프라 확장을 위해 3,800억 달러의 기업 가치로 Series G 펀딩을 통해 300억 달러를 유달치했습니다.
OpenAI 하니스 엔지니어링: Codex를 활용한 무수동 코드 개발
OpenAI는 Codex를 사용해 수동으로 작성된 코드가 전혀 없는 내부 소프트웨어 제품을 개발했으며, 수동 코딩에서 환경 설계 및 에이전트 오케스트레이션으로 전환함으로써 개발 시간을 약 10배 단축했습니다.
Anthropic의 데이터 센터 전력 가격 상승분 부담 약속
Anthropic은 미국 납세자들을 보호하기 위해 자사의 데이터 센터 운영으로 인한 그리드 업그레이드 비용과 수요 기반의 전력 가격 상승분을 부담하기로 약속했습니다.
Qwen-Image-2.0 릴리스: 전문 인포그래픽 및 포토리얼리즘
Qwen-Image-2.0은 전문 인포그래픽을 위한 1k 토큰 지시를 지원하고, 고충실도 포토리얼리즘을 위한 네이티브 2K 해상도를 제공하는 통합 이미지 생성 및 편집 모델입니다.
Gemini Deep Think는 수학, 물리학 및 컴퓨터 과학 전반에 걸친 자율 연구를 가능하게 합니다
Gemini Deep Think는 연구 수준의 수학, 물리학 및 컴퓨터 과학 문제를 해결하고, 출판 가능한 결과를 도출하며, 미해결 추측을 해결하는 자율 및 협업 에이전트를 구동합니다.
OpenAI, 전쟁부를 위한 GenAI.mil에 ChatGPT 통합
OpenAI는 맞춤형 ChatGPT를 GenAI.mil에 배포하여 전쟁부 직원 300만 명에게 보안이 확보된 비밀 등급이 없는 생성 AI 기능을 제공하고, 행정 및 운영 지원을 돕습니다.
Transformers.js v4 릴리즈 노트 / 새로운 내용
Hugging Face는 Transformers.js v4를 출시했으며, 브라우저와 서버 사이드 런타임 전반에서 하드웨어 가속을 위한 새로운 C++ 재작성 WebGPU 런타임과 독립형 tokenizers 라이브러리를 도입했습니다.
OpenAI 현지화 접근 방식 및 OpenAI for Countries 이니셔티브
OpenAI는 OpenAI for Countries 이니셔티브를 통해 현지화된 AI 시스템 프레임워크를 도입했으며, 각 국가가 최첨단 모델을 현지 언어, 법률 및 문화 규범에 맞게 조정하면서 전 세계 안전 기준을 준수하도록 합니다.
SyGra 2.0.0 스튜디오 릴리스
SyGra 2.0.0은 Studio를 소개합니다. Studio는 YAML 파일을 수동으로 편집할 필요 없이 합성 데이터 생성 워크플로를 설계하고 실행할 수 있는 시각적 대화형 환경입니다.
GPT-5가 세포 자유 단백질 합성 비용을 낮추다
OpenAI와 Ginkgo Bioworks는 폐쇄 루프 자율 실험실 시스템에서 GPT-5를 사용하여 세포 자유 단백질 합성 비용을 40%, 시약 비용을 57% 감소시켰습니다.
OpenAI Trusted Access for Cyber
OpenAI는 보안 전문가들에게 사이버 방어 및 취약점 해결을 가속화하기 위해 GPT-5.3-Codex에 대한 우선적인 접근 권한을 제공하는 신원 기반 프레임워크인 Trusted Access for Cyber를 출시했습니다.
OpenAI Frontier 플랫폼 출시
OpenAI는 공유 비즈니스 컨텍스트, 안전한 실행 환경 및 통합 거버넌스를 갖춘 AI 에이전트를 구축, 배포 및 관리하도록 설계된 엔드‑투‑엔드 플랫폼인 Frontier를 소개했습니다.
GPT-5.3-Codex 시스템 카드
OpenAI는 GPT-5.3-Codex를 출시했습니다. 이 에이전시 코딩 모델은 GPT-5.2-Codex 성능과 GPT-5.2 추론을 통합하여 복잡하고 장기적인 기술 작업을 처리합니다.