✷ 아카이브 · 연구소 11곳 · 디스패치 3,053건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
AI 모델에서 사기 감지 및 감소
OpenAI와 Apollo Research는 모델이 겉으로는 정렬된 것처럼 가장하면서 숨은 의도를 추구하는 AI 사기 위험을 해결하기 위해, 최첨단 모델에서 은밀한 행동을 약 30배 감소시키는 '심사숙고 정렬' 방법을 개발했습니다.
Anthropic 사후 분석: 2025년 8월부터 9월 초까지 클로드 응답 품질에 영향을 준 인프라 버그
앤트로픽은 2025년 8월부터 9월 초까지 클로드의 응답 품질을 간헐적으로 저하시킨 세 가지 별개의 인프라 버그를 해결했으며, 서버 부하로 인해 모델 품질이 의도적으로 낮춰지지 않는다고 명확히 밝혔습니다.
OpenAI, 주권 AI 인프라를 위한 Stargate UK를 도입
OpenAI, NVIDIA, 그리고 Nscale가 협력하여 Stargate UK를 출시했습니다. 이 AI 인프라 이니셔티브는 OpenAI 모델에 대한 로컬 컴퓨팅 파워를 제공하여 영국의 주권 AI 역량을 지원합니다.
OpenAI 연령 예측 및 청소년 안전 보호
OpenAI는 18세 미만 사용자를 위해 연령에 맞는 정책을 자동으로 적용하는 연령 예측 시스템을 개발 중이며, 2025년 9월 말까지 부모 제어 기능을 출시할 예정입니다.
OpenAI 청소년 안전, 자유 및 프라이버시 프레임워크
OpenAI는 청소년 보호를 프라이버시와 자유보다 우선시하는 단계적 안전 프레임워크를 구현하고 있으며, 18세 미만 사용자를 위한 더 엄격한 콘텐츠 경계를 적용하기 위해 연령 예측 시스템을 포함하고 있습니다.
LeRobotDataset v3.0 릴리즈 노트 / 새로운 점
Hugging Face는 LeRobotDataset v3.0을 출시했습니다. 이는 대규모 데이터 저장 및 스트리밍을 가능하게 하여 수백만 개의 에피소드를 지원하는 표준화된 로봇 데이터셋 형식입니다.
OpenAI GPT-5-Codex 릴리스 및 Codex 플랫폼 업데이트
OpenAI는 에이전트형 소프트웨어 엔지니어링에 최적화된 모델인 GPT-5-Codex를 출시했으며, Codex CLI, IDE 확장 및 클라우드 환경에 대한 주요 업데이트를 함께 제공했습니다.
사람들이 ChatGPT를 사용하는 방법: 150만 대화 분석
OpenAI와 하버드 경제학자 David Deming은 150만 건의 ChatGPT 대화에 대한 연구를 발표했으며, AI 채택이 성별 및 소득 차원에서 민주화되고 있으며 주로 일상적인 실용적 안내와 의사결정 지원 도구로 활용되고 있음을 밝혀냈습니다.
Gradio와 함께하는 가시 워터마킹
허깅페이스는 Gradio 라이브러리를 사용해 AI 생성 이미지, 비디오, 텍스트에 가시 워터마크를 간단히 추가하는 방법을 도입하여 합성 콘텐츠 투명성을 향상시켰습니다.
GPT-5-Codex 릴리스 및 안전 부록
OpenAI는 실제 작업에 대한 강화 학습을 통해 에이전트 코딩에 최적화된 GPT-5 버전인 GPT-5-Codex를 출시했습니다.
앤트로픽 경제 지수 2025년 9월 보고서
앤트로픽은 2025년 9월 경제 지수를 발표하여, 클로드를 통한 AI 채택이 국가 소득, 미국 주의 산업 구조, 기업과 소비자 사용 방식에 따라 크게 차이가 나며, 지시형 자동화가 대화의 비중을 27%에서 39%로 증가했다고 밝혔습니다.
앤트로픽 경제 지수 2025년 9월 보고서
앤트로픽의 2025년 9월 경제 지수 보고서는 AI 채택이 지역과 기업 간에 극도로 불균형하며, 사용이 고소득 지역에 집중되고 프로그래밍 및 자동화 업무 중심이라는 점을 보여준다.
Claude Sonnet 4 Xcode 6 통합
Anthropic은 Xcode 26에서 Claude Sonnet 4를 일반적으로 사용할 수 있도록 하여, Apple 플랫폼 개발자가 IDE 내에서 AI 기반 코딩 지능형 기능에 직접 액세스할 수 있도록 했습니다.
OpenAI와 미국 CAISI 및 영국 AISI의 보안 협력
OpenAI는 미국 AI 표준 및 혁신 센터(CAISI)와 영국 AI 보안 연구소(UK AISI)와 협력하여 에이전트 AI와 생물보안 방어책에 대한 심층 레드팀 및 취약점 테스트를 수행하고 있습니다.
Claude Desktop Extensions release notes / what's new
Anthropic은 Claude Desktop을 위한 Model Context Protocol (MCP) 서버의 원클릭 설치를 가능하게 하는 새로운 패키징 형식인 Desktop Extensions (.mcpb 파일)를 도입했습니다. 이는 수동 설정 및 개발자 도구의 필요성을 제거합니다.
앤트로픽, 미국 CAISI 및 영국 AISI와 함께 AI 안전장치 협력
앤트로픽은 미국 인공지능 표준 및 혁신 센터(CAISI)와 영국 인공지능 보안 연구소(AISI)와 협력하여, 특히 헌법적 분류기의 취약점을 타깃으로 삼아 AI 시스템의 보안을 강화하고 스트레스 테스트를 수행했습니다.
Writer Palmyra-mini 패밀리 출시
Writer는 Palmyra-mini 패밀리를 출시했습니다. 이 패밀리는 1.5B에서 1.7B 파라미터를 갖는 경량 오픈 모델 세트로, 기본 모델과 논리 및 수학에 최적화된 두 가지 특수 추론 변형을 포함합니다.
OpenAI와 Microsoft 파트너십 업데이트
OpenAI와 Microsoft는 비구속 양해각서(MOU)를 체결하여 파트너십의 다음 단계에 진입했으며, AI 도구 제공과 안전성에 중점을 두고 있습니다.
OpenAI 비영리 조직 및 공익 기업(PBC) 구조 진화
OpenAI는 비영리 조직이 공익 기업(PBC)을 통제하고 1천억 달러를 초과하는 지분을 보유하여 AGI가 인류에게 혜택을 주도록 하는 사명을 지원하도록 구조를 변화시키고 있습니다.
Transformers 4.40 성능 업그레이드 – OpenAI GPT‑OSS용: 제로‑빌드 커널, MXFP4 양자화, 병렬 처리 및 빠른 로딩
Hugging Face는 OpenAI GPT‑OSS 모델을 위한 제로‑빌드 커널, MXFP4 4‑비트 양자화, 텐서 및 전문가 병렬 처리, 동적 슬라이딩‑윈도우 캐시, 연속 배치, 그리고 더 빠른 모델 로딩을 transformers 라이브러리에 추가했습니다. 이를 통해 효율성과 확장성이 크게 향상되었습니다.
AI 에이전트를 위한 효과적인 도구 작성: 앤트로픽 엔지니어링 가이드
앤트로픽은 비결정론적 AI 에이전트를 위한 도구 설계를 위한 체계적이고 평가 기반의 프레임워크를 제시하며, 전통적인 결정론적 API 패턴보다 에이전트 중심 설계를 강조합니다.
Together AI를 활용한 Hugging Face Hub LLM 파인튜닝
Together AI와 Hugging Face는 플랫폼을 통합하여, 개발자가 Together AI의 인프라를 사용하여 Hugging Face Hub의 모든 호환 가능한 LLM을 파인튜닝할 수 있도록 했습니다.
Jupyter 에이전트: 노트북을 활용한 LLM 추론 훈련
Hugging Face는 고품질 합성 데이터를 생성하고 최적화된 스캐폴딩을 제공하는 파이프라인을 소개하여 Qwen3-4B와 같은 소형 LLM을 최첨단 데이터 과학 에이전트로 전환합니다.
OpenAI 모델 기반 SafetyKit 위험 에이전트
SafetyKit은 GPT-5, GPT-4.1 및 기타 OpenAI 모델을 활용해 고객 콘텐츠 100%에 대해 95% 이상의 정확도로 사기 및 금지된 활동을 자동으로 탐지합니다.
Mistral AI 시리즈 C 투자 유치 발표
ASML 주도의 시리즈 C 투자 라운드를 통해 Mistral AI는 17억 유로를 유치하여 투자 후 평가액 117억 유로를 달성, 전략적 산업을 위한 선도 AI 연구를 가속화할 예정입니다.
mmBERT: ModernBERT가 다국어로 확장
Hugging Face는 1,800개 이상의 언어에서 3조 토큰 이상으로 학습된 대규모 다국어 인코더 모델 mmBERT를 소개하며, 이는 성능과 추론 속도 모두에서 XLM‑R을 능가합니다.
OpenAI 사람 중심 AI 펀드
OpenAI는 AI 리터러시, 커뮤니티 혁신, 경제적 기회를 촉진하기 위해 미국 기반 비영리 단체에 무제한 보조금을 제공하는 5천만 달러 규모의 펀드 신청을 받습니다.
Anthropic의 캘리포니아 SB 53 지지
Anthropic은 기술적 명령보다는 투명성 및 공개를 우선시하는 강력한 AI 시스템을 위한 규제 프레임워크인 캘리포니아 상원 법안 53(SB 53)을 지지했습니다.
OpenAI 연구: 언어 모델이 환각을 일으키는 이유
OpenAI는 언어 모델이 환각을 일으키는 이유가 신비로운 결함 때문이 아니라, 표준 학습 및 평가 절차가 불확실성을 인정하기보다 추측을 장려하기 때문이라고 주장합니다.
OpenAI for Greece 파트너십, 교육 파일럿 및 AI 액셀러레이터 출시
OpenAI는 ‘OpenAI for Greece’ 파트너십을 발표하고, 중등 학교에서 ChatGPT Edu 파일럿을 시작하며 현지 AI 스타트업을 촉진하기 위한 그리스 AI 액셀러레이터를 출범시켰습니다. 이는 그리스의 교육 및 혁신 분야 전반에 고급 AI를 도입하는 중요한 단계입니다.
앤트로픽 LLM과 생물학적 위험: 인공지능 기반 생물학적 위협 평가
앤트로픽은 클로드 오퍼스 4 모델이 생물학적 무기 개발을 방지하기 위해 AI 안전 수준 3 보호 기능을 적용했으며, 인공지능 기반 생물학적 위험과 완화 전략에 대한 연구를 상세히 발표했다.
OpenAI AI 이니셔티브를 통한 경제 기회 확대
OpenAI는 근로자들이 AI 역량을 습득하고 고용주와 연결될 수 있도록 OpenAI Jobs Platform과 OpenAI Certifications를 발표했으며, 2030년까지 1천만 명의 미국인을 인증하는 것을 목표로 하고 있습니다.
EmbeddingGemma 300M 릴리즈 노트
Google은 308M 파라미터의 다국어 임베딩 모델인 EmbeddingGemma를 출시했으며, 500M 이하 모델 중 MTEB 벤치마크에서 최고 성능을 기록하고 온‑디바이스 사용에 최적화되었습니다.
Anthropic, 적대적 접근 방지를 위해 지역별 판매 제한 사항 업데이트
Anthropic은 중국과 같은 지원되지 않는 지역의 통제 하에 있는 기업이 자회사가 어디에 설립되었는지에 관계없이 자사의 서비스를 이용하지 못하도록 서비스 약관을 강화하고 있습니다.
Anthropic, 백악관의 AI 교육 서약에 참여
Anthropic은 K-12 사이버 보안에 대한 100만 달러 투자, Presidential AI Challenge 지원, 그리고 교육자를 위한 Creative Commons AI Fluency 커리큘럼 출시를 통해 AI 교육 접근성을 확대하기로 약속했습니다.
SandboxAQ SAIR 데이터셋 릴리스
SandboxAQ는 실험 IC₅₀ 라벨과 짝을 이룬 공동 접힘 3D 단백질-리간드 구조의 가장 큰 데이터셋인 SAIR를 공개했으며, 5백만 개가 넘는 AI 생성 구조를 제공하여 AI 기반 신약 발견을 가속화합니다.
Mistral AI Le Chat Memories Beta Release
Mistral AI는 투명성과 사용자 제어권을 위해 설계된 하이브리드 메모리 시스템인 Memories (beta)를 Le Chat에 도입했습니다. 이를 통해 AI는 재학습 없이 과거의 대화와 업로드된 파일을 회상할 수 있습니다.
OpenAI, Statsig 인수 및 Vijaye Raji를 Applications CTO로 임명
OpenAI는 실험 플랫폼인 Statsig를 인수하고, 설립자이자 CEO인 Vijaye Raji를 Applications CTO로 임명하여 ChatGPT와 Codex의 제품 엔지니어링을 이끌게 했습니다.
OpenAI, ChatGPT 안전 및 웰빙 이니셔티브 업데이트
OpenAI는 의료 전문가 네트워크의 지침을 받아 ChatGPT가 정신 건강 위기에 대응하는 방식을 개선하고 청소년을 위한 부모 통제를 도입하기 위해 120일 이니셔티브를 시행하고 있습니다.
Mistral AI Le Chat 업데이트: MCP 커넥터 및 메모리 기능
Mistral AI는 Le Chat에 MCP 기반 커넥터와 메모리 기능을 도입하여 20개 이상의 기업 도구와의 원활한 통합 및 대화 간 개인화된 맥락을 가능하게 했습니다.
Hugging Face ZeroGPU 사전 컴파일 가이드
Hugging Face는 ZeroGPU Spaces를 위한 사전 컴파일(AoT) 방식을 도입하여, Flux, Wan, LTX와 같은 생성 모델에서 JIT 컴파일 오버헤드를 제거함으로써 1.3배에서 1.8배까지 속도 향상을 가능하게 합니다.
Anthropic Series F Funding and Valuation Update
Anthropic은 ICONIQ가 주도한 Series F 라운드에서 130억 달러를 유치했으며, 기업 성장과 안전 연구를 지원하기 위해 기업 가치를 1,830억 달러(post-money)로 평가받았습니다.
word2vec가 배우는 것: 특징 학습에 대한 폐쇄형 이론
BAIR 연구원들은 word2vec 학습이 가중치가 없는 최소제곱 행렬 분해로 귀결된다는 예측 이론을 개발했으며, 학습된 표현은 특정 목표 행렬에 대한 PCA 결과와 동일함을 증명했습니다.
Anthropic Claude 3.5 Sonnet 컴퓨터 사용 기능
Anthropic는 Claude 3.5 Sonnet의 공개 베타를 통해 모델이 커서를 이동하고 클릭하며 텍스트를 입력함으로써 컴퓨터 화면과 직접 상호작용할 수 있도록 했습니다. 이는 인간의 컴퓨터 사용 방식을 모방하는 기능입니다.
Claude 3.5 Sonnet 출시 노트 / 새 기능 소개
Anthropic는 Claude 3 Opus와 경쟁 모델보다 추론 및 코딩 벤치마크에서 뛰어난 성능을 보이며 Opus의 두 배 속도로 작동하는 Claude 3.5 Sonnet을 출시했습니다.
Anthropic Clio 개인정보 보호 분석 도구
Anthropic는 사용자 데이터를 노출하지 않고 실제 클로드 사용 사례를 추상화된 주제 군집으로 요약하는 자동화된 개인정보 보호 시스템인 Clio를 발표했습니다. 이는 안전 모니터링을 개선하는 데 기여합니다.
OpenAI gpt-realtime 및 Realtime API 일반 제공
OpenAI는 고성능 음성-음성 모델인 gpt-realtime를 출시하고, 이미지 입력, 원격 MCP 서버, SIP 전화 호출을 지원하는 Realtime API를 일반 제공했습니다.
OpenAI 비영리 및 커뮤니티 혁신 기금 지원
OpenAI는 미국 기반 501(c)(3) 비영리 단체와 커뮤니티 조직에 무제한 보조금을 제공하여 공공 선을 위한 AI 기반 혁신을 촉진하기 위한 5천만 달러 기금의 신청을 시작합니다.
Grok Code Fast 1 릴리스 노트 / 새로운 기능
xAI는 여러 프로그래밍 언어에 걸쳐 속도, 비용 효율성 및 에이전트 기반 코딩 워크플로우에 최적화된 새로운 모델 아키텍처인 grok-code-fast-1을 출시했습니다.
OpenAI 집단 정렬 및 모델 사양 업데이트
OpenAI는 1,000명 이상의 전 세계 참가자들의 공개 선호를 모델 사양에 통합하여 AI 기본 행동이 다양한 인간 가치를 반영하도록 보장하는 집단 정렬 연구 노력을 도입했습니다.