✷ 아카이브 · 연구소 11곳 · 디스패치 3,049건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
STADLER AI 구현 및 생산성 향상
STADLER는 230년 역사의 산업 재활용 기업으로, OpenAI의 ChatGPT를 전사적인 생산성 레이어로 도입함으로써 지식 작업에서 30-40%의 시간 절감과 초안 작성 속도를 2.5배 향상시켰습니다.
Hugging Face OpenClaw 마이그레이션 가이드
Hugging Face는 제한된 Claude 모델에서 오픈소스 대안으로 OpenClaw 에이전트를 마이그레이션하기 위해 Inference Providers와 로컬 llama.cpp 설정 두 가지 방법을 제공합니다.
Gemini 3.1 Flash Live 릴리스 노트 / 새로운 소식
Google DeepMind는 자연스러운 실시간 대화를 위해 정밀도가 향상되고 지연 시간이 낮아진 고품질 오디오 및 음성 모델인 Gemini 3.1 Flash Live를 출시했으며, 전 세계적인 이용 가능성을 확대했습니다.
Google DeepMind의 AI 유해 조작 연구
Google DeepMind는 AI가 인간의 사고와 행동을 유해하게 조작하는 위험을 측정하고 완화하기 위한 새로운 연구와 실증 검증된 툴킷을 발표했습니다.
Lyria 3 Pro 출시: Google 제품 전반에 걸친 더 길고 구조를 인식하는 음악 생성
DeepMind는 구조 인식을 갖춘 최대 3분 길이의 트랙을 생성하는 음악 생성 모델 Lyria 3 Pro를 발표했으며, 이제 Vertex AI, AI Studio, Google Vids, Gemini, ProducerAI와 같은 Google 제품에 통합되었습니다.
OpenAI Model Spec: 명시적 모델 행동을 위한 프레임워크
OpenAI는 의도된 AI 모델 행동을 명시적이고 읽기 쉬우며 사용자, 개발자, 연구자가 수정할 수 있도록 설계된 공식적인 공개 프레임워크인 Model Spec를 도입했습니다.
OpenAI 안전 버그 현상금 프로그램 시작
OpenAI는 기존 보안 취약점을 벗어나는 AI 남용 및 안전 위험을 식별하기 위해 공개 안전 버그 현상금 프로그램을 시작했으며, 특히 에이전시 위험, 독점 정보 유출 및 플랫폼 무결성을 목표로 합니다.
Claude Code 자동 모드: 더 안전한 자율 코딩을 위한 모델 기반 권한 보호 장치
Anthropic는 모델 기반 분류기를 사용해 작업을 승인하는 중간 지점 권한 시스템인 Claude Code 자동 모드를 도입하여, 승인 피로를 줄이고 위험한 과도한 행동을 방지했습니다.
OpenAI 청소년 안전 정책 팩 및 gpt-oss-safeguard
OpenAI는 프롬프트 기반 안전 정책과 오픈 가중치 gpt-oss-safeguard 모델을 공개하여 개발자가 AI 애플리케이션에서 청소년을 위한 연령에 맞는 보호 장치를 구현할 수 있도록 지원합니다.
OpenAI, Agentic Commerce Protocol을 통해 ChatGPT의 제품 발견을 확장
OpenAI는 확장된 Agentic Commerce Protocol(ACP)로 구동되는 향상된 시각적 쇼핑 및 제품 발견 기능을 ChatGPT에 도입하여 사용자가 제품을 찾고 비교하는 과정을 간소화했습니다.
OpenAI 재단 업데이트
OpenAI는 재단이 향후 1년 동안 생명 과학, 경제적 영향, AI 회복력 및 커뮤니티 프로그램에 최소 10억 달러를 투자해 AGI가 인류에게 혜택을 주도록 할 것이라고 발표했습니다.
음성 에이전트를 위한 EVA 엔드‑투‑엔드 평가 프레임워크
EVA는 정확도와 대화 경험을 동시에 평가하는 새로운 엔드‑투‑엔드 프레임워크로, 작업 성공과 사용자 만족 사이에 일관된 트레이드‑오프가 존재함을 밝혀냅니다.
vLLM Model Runner V2 릴리스 노트 / 새로운 내용
vLLM은 모델 러너를 처음부터 재구현한 Model Runner V2 (MRV2)를 도입했으며, GPU 네이티브, 비동기 우선, 모듈식 아키텍처를 통해 처리량을 향상하고 지연 시간을 감소시킵니다.
Anthropic 경제 지수 2026년 3월 보고서: 학습 곡선
Anthropic의 2026년 3월 경제 지수 보고서는 클로드 사용이 다양화되었으며, 저임금 작업이 증가하고 고사용 기간 사용자들이 더 높은 성공률을 기록함으로써 학습을 통한 성장과 기술 역량 중심의 영향이 나타나고 있음을 보여줍니다.
Anthropic 장기 실행 애플리케이션 개발을 위한 하서드 설계
Anthropic는 클라우드가 다시간에 걸쳐 고품질 프론트엔드 디자인과 전체 스택 애플리케이션을 자율적으로 생성할 수 있도록 하는 3에이전트 하서드(기획자, 생성자, 평가자)를 도입했습니다. 이는 컨텍스트 한계와 자기 평가 편향을 해결합니다.
Mistral AI Voxtral TTS 릴리스
Mistral AI는 기업용 음성 에이전트를 위한 고자연스러운 음성 생성과 낮은 지연 시간 스트리밍을 제공하는 4B 파라미터 다국어 텍스트-to-음성 모델인 Voxtral TTS를 출시했습니다.
OpenAI Sora 2 안전 프레임워크
OpenAI는 Sora 2에 대한 안전 아키텍처를 상세히 설명했으며, 출처 신호, 동의 기반 외모 관리, 그리고 오디오와 비디오에 대한 엄격한 콘텐츠 필터링에 중점을 두고 있습니다.
Vibe Physics: Claude Opus 4.5를 이론 물리학을 위한 AI 대학원생으로 활용하기
Matthew Schwartz 교수는 Claude Opus 4.5가 전문가의 감독하에 1년이 걸릴 계산을 2주로 단축하며 최첨단 이론 물리학 연구를 수행할 수 있음을 입증했습니다.
장시간 실행 가능한 클로드를 통한 과학 계산
애너티픽은 클로드 오퍼스 4.6를 사용한 다일간 에이전트 기반 코딩 워크플로우가 복잡한 과학 계산 작업, 예를 들어 차별 가능한 우주론적 볼츠만 해법기 구현을 자동화할 수 있음을 보여주며, 연구자들의 수개월에 걸친 노력이 며칠로 단축될 수 있음을 입증했습니다.
Anthropic, AI 기반 발견을 가속화하기 위한 사이언스 블로그 출시
Anthropic은 과학적 진보를 가속화하기 위해 AI 연구, 실질적인 과학적 워크플로우 및 협업을 공유하는 데 전념하는 새로운 Science Blog를 출시했습니다.
NVIDIA Nemotron을 활용한 도메인 특화 임베딩 파인튜닝 – 하루 안에
NVIDIA와 Hugging Face는 단일 GPU, 하루 안에 완료되는 파이프라인을 공개했으며, Llama‑Nemotron‑Embed‑1B‑v2 모델을 합성 도메인 데이터로 파인튜닝하여 10% 이상의 검색 성능 향상과 실제 기업 데이터셋에서 최대 26% 개선을 달성했습니다.
OpenAI 내부 코딩 에이전트 모니터링 시스템
OpenAI는 내부 코딩 에이전트에서의 불일치 및 보안 위반을 감지하기 위해 GPT-5.4 Thinking 기반 모니터링 시스템을 배포했으며, 복잡하고 도구가 풍부한 워크플로우에서만 종종 나타나는 행동을 식별합니다.
OpenAI가 Astral을 인수합니다
OpenAI는 Astral을 인수하여 uv, Ruff, ty와 같은 오픈소스 Python 도구들을 Codex 생태계에 통합하고, AI 에이전트가 전체 소프트웨어 개발 라이프사이클에 참여할 수 있도록 합니다.
Qwen3.5-Max-Preview 릴리스 (LMSys Arena)
Qwen은 정식 출시가 2주 내에 예정된 가운데, 커뮤니티 평가를 위해 Qwen3.5-Max-Preview를 LMSys Arena에 배포했습니다.
Hugging Face의 오픈 소스 현황: 2026년 봄
Hugging Face는 2025년 모델 다운로드 수에서 중국이 미국을 추월하고, 로보틱스가 가장 큰 데이터셋 카테고리로 급격히 부상하는 특징을 가진 2025년 오픈 소스 AI 생태계의 대규모 확장을 보고합니다.
Google DeepMind, AGI 향상 측정을 위한 인지 프레임워크
Google DeepMind는 인지 분류 체계와 3단계 평가 프로토콜을 도입하여 인공지능이 인공 일반 지능(AGI)으로 나아가는 진전을 실증적으로 측정합니다.
Mistral AI Forge: 기업용 맞춤형 프론티어급 모델 시스템
Mistral AI는 기업이 자체 지식을 기반으로 프론티어급 AI 모델을 구축하고 지속적으로 개선할 수 있는 시스템인 Forge를 도입했습니다.
Holotron-12B 고처리량 컴퓨터 사용 에이전트
H Company는 NVIDIA Nemotron-Nano-2 VL 기반의 멀티모달 컴퓨터 사용 모델인 Holotron-12B를 출시했으며, 하이브리드 SSM-Attention 아키텍처를 사용해 에이전트 작업에 대한 높은 추론 처리량을 달성합니다.
OpenAI GPT-5.4 mini 및 nano 릴리스 노트
OpenAI는 고효율 소형 모델인 GPT-5.4 mini와 nano를 출시했으며, 이 모델들은 GPT-5.4 기능을 고용량 워크로드에 제공하면서 지연 시간과 비용을 크게 낮춥니다.
OpenAI 일본 청소년 안전 청사진
OpenAI 일본은 청소년 안전을 편리함 및 프라이버시보다 우선시하는 프레임워크인 일본 청소년 안전 청사진을 도입했습니다. 이는 AI와 관련된 위험으로부터 젊은 사용자를 보호하기 위한 것입니다.
OpenAI 연구: 근로자들이 ChatGPT를 활용한 보상 인사이트
OpenAI 연구에 따르면 미국 근로자들은 고숙련·투명성 낮은 직무에서 특히 급여 벤치마크와 보상 안내를 얻기 위해 하루에 거의 300만 건의 메시지를 ChatGPT에 보낸다.
Mistral Small 4 출시 노트 / 새로운 기능
Mistral AI는 추론, 멀티모달, 에이전트 코딩 기능을 하나의 다재다능한 아키텍처로 통합한 Apache 2.0 라이선스의 통합 오픈소스 모델인 Mistral Small 4를 출시했습니다.
Mistral AI와 NVIDIA 파트너십: NVIDIA Nemotron Coalition
Mistral AI는 NVIDIA의 컴퓨팅 리소스와 Mistral AI의 모델 아키텍처를 사용하여 오픈 소스 프론티어 AI 모델을 공동 개발하기 위해 NVIDIA Nemotron Coalition의 창립 멤버로 합류했습니다.
Mistral AI Leanstral 출시
Mistral AI는 Lean 4를 위해 설계된 6B 활성 파라미터를 가진 오픈 소스 코드 에이전트 Leanstral을 출시했습니다. 이는 공식적으로 검증된 코드와 수학적 증명을 가능하게 합니다.
OpenAI Codex Security: 시스템이 SAST 보고서 시드를 피하는 이유
OpenAI의 Codex Security는 정적 애플리케이션 보안 테스트(SAST) 보고서로 시작하는 것을 피함으로써 분석이 조기에 좁아지는 것을 방지하고, 변환 체인을 통해 보안 불변식이 실제로 유지되는지를 검증하는 데 집중합니다.
BAIR가 소개하는 SPEX와 ProxySPEX: 확장 가능한 LLM 상호작용 탐색
BAIR는 신호 처리와 코딩 이론을 활용하여 대규모로 특징, 학습 데이터 및 모델 구성 요소 간의 영향력 있는 상호작용을 식별하는 알고리즘인 SPEX와 ProxySPEX를 소개했습니다.
P-EAGLE: vLLM에서 병렬 추측 디코딩
vLLM은 모든 초안 토큰을 단일 전방 패스로 생성하는 병렬 추측 디코딩 방법인 P-EAGLE을 도입했으며, NVIDIA B200 GPU에서 기존 EAGLE-3 대비 최대 1.69배의 속도 향상을 제공합니다.
Anthropic 교차 아키텍처 모델 디핑을 위한 전용 피처 크로스코더 (DFC)
Anthropic 연구원들은 고유 피처를 격리하여 서로 다른 아키텍처를 가진 AI 모델 간의 행동 차이를 식별하는 도구인 전용 피처 크로스코더 (DFC)를 개발했습니다. 이를 통해 "unknown unknown" 위험을 탐해지할 수 있습니다.
Anthropic has launched the Claude Partner Network with an initial $100 million investment to provide training, technical support, and co-investment for organizations helping enterprises adopt Claude.
Mistral AI Rails Testing Agent
Mistral AI는 Vibe를 사용하여 Ruby on Rails 모놀리스를 위한 RSpec 테스트를 자동으로 생성하고 개선하는 자율 에이전트를 개발했으며, 275개 파일 실험에서 100% 라인 커버리지와 RuboCop 위반 0건을 달성했습니다.
OpenAI, 프롬프트 인젝션에 저항하는 AI 에이전트 설계
OpenAI는 프롬프트 인젝션을 사회공학 문제로 다루면서 방어 전략을 전환하고 있으며, 입력 필터링에만 의존하는 대신 성공적인 조작의 영향을 제한하는 데 초점을 맞추고 있습니다.
OpenAI Responses API 컴퓨터 환경 업데이트
OpenAI는 Responses API에 셸 도구와 호스팅된 컨테이너 작업 공간을 제공하여 모델이 명령줄 인터페이스와 지속적인 런타임 컨텍스트를 통해 실제 작업을 실행할 수 있게 했습니다.
vLLM에서 NVIDIA Nemotron 3 Super 지원
vLLM은 이제 120억 파라미터 하이브리드 MoE 모델인 NVIDIA Nemotron 3 Super를 지원합니다. 이 모델은 멀티 에이전트 AI에 최적화되어 100만 토큰 컨텍스트 윈도우와 높은 추론 효율성을 제공합니다.
엔지니어링 효율성을 위한 라쿠텐의 OpenAI Codex 통합
라쿠텐은 OpenAI Codex를 엔지니어링 스택에 통합하여 평균 복구 시간(MTTR)을 50% 단축하고, 분기 단위 개발 프로젝트를 몇 주로 압축했습니다.
Wayfair OpenAI 통합 사례 연구
Wayfair는 내부 시스템에 OpenAI 모델을 통합하여 3천만 개 아이템의 제품 카탈로그 태깅을 자동화하고, AI 기반 도구인 Wilma를 통해 공급업체 지원을 효율화했습니다.
앤트로픽 인스티튜트 소개
앤트로픽은 잭 클락이 이끄는 다학제적 연구 노력인 앤트로픽 인스티튜트를 출시하여, 가속화되는 프론티어 AI 개발이 초래하는 사회적, 경제적, 법적 도전 과제를 연구하고 공유하고 있습니다.
OpenAI 지시 계층 개선 및 GPT-5 Mini-R
OpenAI는 신뢰할 수 있는 지시를 신뢰할 수 없는 지시보다 우선하도록 모델을 훈련시키기 위한 새로운 강화 학습 데이터셋인 IH-Challenge를 도입했으며, 이를 통해 안전 조정 가능성과 프롬프트 인젝션 내성이 향상된 GPT-5 Mini-R 모델을 만들었습니다.
ChatGPT 수학 및 과학 인터랙티브 비주얼
OpenAI는 ChatGPT에 70개 이상의 핵심 수학 및 과학 개념에 대한 동적인 비주얼 설명을 도입하여 사용자가 변수와 공식 간의 관계를 실시간으로 이해하도록 돕고 있습니다.
vLLM Semantic Router v0.2 Athena 릴리스 노트 / 새로운 내용
vLLM Semantic Router v0.2 Athena는 재구성된 모델 스택, 실험적인 ClawOS 오케스트레이션 레이어, 그리고 고급 모델 선택 프리미티브를 도입하여 의미 기반 라우팅을 다중 에이전트 배포를 위한 전략적 시스템 뇌로 변환합니다.
Hugging Face 스토리지 버킷 출시
Hugging Face는 Xet을 기반으로 하는 가변적이며 S3와 유사한 객체 스토리지 시스템인 Storage Buckets를 도입하여 체크포인트와 처리된 데이터와 같은 중간 ML 아티팩트를 효율적으로 처리합니다.