✷ 아카이브 · 연구소 11곳 · 디스패치 3,049건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
GPT-5.3-Codex 릴리스 노트 / 새로운 기능
OpenAI는 GPT-5.3-Codex라는 에이전시 코딩 모델을 출시했습니다. 이 모델은 GPT-5.2-Codex에 비해 성능, 추론 능력 및 속도가 향상되어 복잡하고 장기적인 기술 작업을 자율적으로 실행할 수 있습니다.
Claude Opus 4.6: LLM이 발견한 제로데이 취약점
Anthropic의 Claude Opus 4.6는 인간 연구원처럼 코드를 추론함으로써 잘 테스트된 오픈소스 코드베이스에서 고중요도의 제로데이 취약점을 식별할 수 있다.
Agentic 코딩 평가에서 인프라 노이즈 정량화
Anthropic의 연구에 따르면, Agentic 코딩 벤치마크에서 인프라 자원 구성으로 인해 최대 6%포인트의 점수 변동이 발생할 수 있으며, 이는 진정한 모델 능력 차이를 가리거나 위장할 수 있다.
병렬 클로드 에이전트 팀을 활용한 C 컴파일러 구축
안트로픽 연구원 니콜라스 카를리니는 16개의 병렬 클로드 오퍼스 4.6 에이전트를 사용해 Linux 6.9 커널을 컴파일할 수 있는 10만 줄 규모의 러스트 기반 C 컴파일러를 자율적으로 구축했다.
Mistral AI Voxtral Transcribe 2 출시
Mistral AI는 고효율 배치 처리를 위한 Voxtral Mini Transcribe V2와 초저지연 실시간 전사를 위한 Voxtral Realtime을 특징으로 하는 Voxtral Transcribe 2를 출시했습니다.
OpenAI Codex 앱 서버 아키텍처 및 통합
OpenAI는 Codex 앱 서버를 도입했습니다. 이 JSON-RPC 기반 프로토콜 및 프로세스는 Codex 에이전트 하네스를 다양한 클라이언트에 노출하여 IDE, 웹 런타임 및 터미널 인터페이스 전반에 걸쳐 일관된 에이전트 경험을 제공합니다.
Hugging Face 커뮤니티 평가
Hugging Face는 Community Evals를 도입했습니다. 이는 Hub에서 직접 모델 벤치마크 점수를 보고하고 집계하는 분산 시스템으로, 투명성과 재현성을 높입니다.
Anthropic, Claude의 광고 없는 경험을 약속합니다
Anthropic는 Claude가 사용자들의 이익에만 집중하고 심층적 사고와 업무에 집중할 수 있는 환경을 유지하기 위해 광고 없이 운영될 것임을 발표했습니다.
H Company Holo2-235B-A22B 프리뷰 릴리스
H Company는 UI 로컬라이제이션 모델인 Holo2-235B-A22B Preview를 출시했으며, Screenspot-Pro와 OSWorld G 벤치마크에서 최첨단 성능을 달성했습니다.
글로벌 오픈소스 AI 생태계의 미래: DeepSeek에서 AI+까지
Hugging Face는 오픈소스가 중국 AI 조직들의 지배적인 전략이 되어, 고립된 모델 돌파구에서 모델, 하드웨어, 인프라가 통합된 확장 가능한 생태계로 전환된 과정을 분석합니다.
텍스트-이미지 모델을 위한 훈련 설계: Ablation에서 얻은 교훈
텍스트-이미지 모델 훈련 설계에 관한 Hugging Face 게시물의 제공된 원본 자료가 429 Too Many Requests 오류로 인해 사용할 수 없습니다.
OpenAI Sora 피드 철학
OpenAI는 창의성 중심 순위, 개인화된 추천, 다층 안전 가드레일에 중점을 두어 Sora 피드의 설계 원칙과 안전 프레임워크를 상세히 설명했습니다.
Apple Xcode 26.3 Claude Agent SDK Integration
Apple Xcode 26.3은 Claude Agent SDK를 통합하여 자율 코딩 작업, Xcode Previews를 통한 시각적 검증, 그리고 IDE 내에서의 프로젝트 전반에 대한 추론을 가능하게 합니다.
Qwen3-Coder-Next 릴리스: 고효율 에이전트 코딩 모델
Qwen3-Coder-Next는 하이브리드 어텐션과 MoE 아키텍처를 기반으로 하는 오픈-웨이트 모델로, SWE-Bench Verified에서 70% 이상을 달성하며 10-20배 더 큰 모델에 필적하는 성능을 제공합니다.
Snowflake와 OpenAI의 기업 인텔리전스 파트너십
OpenAI와 Snowflake가 $200 million 규모의 계약을 체결하여 GPT-5.2를 포함한 OpenAI 최첨단 모델을 Snowflake AI Data Cloud에 직접 통합하고, 보안이 확보된 데이터 기반 AI 에이전트와 애플리케이션을 만들 수 있게 합니다.
OpenAI Codex 앱 출시 – macOS 및 Windows용 다중 에이전트 데스크톱 인터페이스
OpenAI는 macOS용 Codex 데스크톱 앱을 출시했으며(2026년 3월에 Windows 지원 추가), 개발자가 여러 AI 에이전트를 병렬로 실행·감시·협업하고 재사용 가능한 Skill로 확장하며 반복 작업을 자동화할 수 있는 통합 인터페이스를 제공합니다.
xAI, SpaceX에 인수되다
SpaceX가 2026년 2월 2일에 발표한 바와 같이 xAI를 인수하여, 해당 AI 연구소를 항공우주 기업의 일부로 통합했습니다.
Anthropic, 과학적 발견을 위해 Allen Institute 및 HHMI와 파트너십 체결
Anthropic은 특화된 AI 에이전트와 멀티 에이전트 시스템을 통해 Claude를 최첨단 생물학 연구에 통합하기 위해 Allen Institute 및 Howard Hughes Medical Institute (HHMI)와 파트너십을 맺었습니다.
Ollama가 출시한 OpenClaw 개인용 AI 코딩 보조 도구
Ollama는 WhatsApp, Telegram, Slack, Discord, iMessage 등 다양한 메시징 플랫폼을 중앙 게이트웨이를 통해 AI 코딩 에이전트와 연결하는 로컬에서 실행되는 개인용 AI 보조 도구인 OpenClaw를 발표했습니다. 이 도구는 개인 정보 보호를 우선시하며, 크로스 플랫폼 코드 보조 기능을 제공합니다.
작전명 “트롤링 스톤(Trolling Stone)”: 러시아 연계 영향력 행사 활동
OpenAI는 아르헨티나의 러시아 사이비 종교 지도자에 관한 가짜 뉴스와 댓글을 생성하여 여론을 조작한 러시아 연계 영향력 행사 작전에 사용된 여러 ChatGPT 계정을 차단했다고 밝혔으며, 이는 AI의 오용 사례를 강조합니다.
AI 기반 로맨스 스캠에 관한 OpenAI 사례 연구
OpenAI는 악의적인 행위자들이 로맨스 및 투자 사기에 ChatGPT를 활용하기 위해 사용하는 3단계 워크플로우인 핑, 징, 스팅을 식별했습니다.
OpenAI Silver Lining Playbook: 중국발 미국인 대상 활동
OpenAI는 ChatGPT를 사용하여 미국 공무원을 대상으로 하는 사회 공학적 이메일을 작성한 중국 관련 작전을 공개했으며, 생성형 AI가 외국 정보기관의 인재 포섭에 악용될 수 있음을 강조했습니다.
Operation False Witness: OpenAI, AI 기반 복구 사기 차단
OpenAI는 캄보디아 기반의 범죄 조직이 사기 복구 계획의 일환으로 법률 사무소 및 미국 당국을 사칭하는 데 사용한 ChatGPT 계정 그룹을 차단했습니다.
Operation Date Bait: OpenAI, AI 기반 로맨스 스캠 네트워크 차단
OpenAI는 캄보디아에서 시작되어 매달 수백 명의 피해자를 발생시킨 반자동 로맨스 및 작업 스캠에 연루된 ChatGPT 계정 클러스터와 API 고객을 차단했습니다.
OpenAI의 "Fish Food" 작전: 러시아발 콘텐츠 팜 차단
OpenAI는 AI가 생성한 텍스트와 비디오를 사용하여 소셜 미디어 전반에서 비밀 영향력 공작을 수행한 러시아의 "Rybar" 작전과 연계된 ChatGPT 계정 네트워크를 차단했으며, 이는 허위 정보를 위해 대규모 언어 모델이 악용되는 사례를 보여줍니다.
OpenAI Operation No Bell 사례 연구
OpenAI는 사하라 이남 아프리카와 미국을 겨냥한 지정학적 허위 정보를 생성하는 데 사용된 Operation No Bell 관련 러시아 연계 ChatGPT 계정을 차단했습니다.
OpenAI 사례 연구: 중국 법 집행 기관의 “사이버 특수 작전” 영향력 공작
OpenAI는 일본 총리와 반체제 인사를 겨냥한 은밀한 영향력 공작을 계획하고 보고하려던 중국 법 집행 기관 연계 ChatGPT 계정을 차단했으며, 이를 통해 대규모의 AI 강화형 “사이버 특수 작전”의 실체를 밝혀냈다고 발표했습니다.
Project Genie: Google DeepMind의 인터랙티브 월드 모델 프로토타입
Google DeepMind는 Genie 3 기반의 실험적 연구 프로토타입인 Project Genie를 출시했으며, 이를 통해 사용자는 인터랙티브하고 실시간으로 생성되는 환경을 만들고, 탐험하고, 리믹스할 수 있습니다.
OpenAI 사내 데이터 에이전트 내부 살펴보기
OpenAI는 맞춤형 내부 AI 데이터 에이전트를 개발했으며, 이를 통해 직원들은 자연어를 사용해 600페타바이트 규모의 데이터에 대한 복잡한 데이터 분석을 수행할 수 있습니다. 이 에이전트는 다층 컨텍스트 시스템과 자체 학습 추론 루프를 활용합니다.
Daggr 소개: 시각적 검사를 통한 AI 앱 프로그래밍 방식 체인
Hugging Face는 Daggr라는 오픈소스 Python 라이브러리를 출시했습니다. 이 라이브러리를 통해 개발자는 Gradio 앱, ML 모델, 사용자 정의 함수를 프로그래밍 방식으로 연결하여 워크플로우를 구성할 수 있으며, 디버깅 및 상태 관리를 위한 시각적 캔버스가 자동으로 생성됩니다.
OpenAI, ChatGPT에서 GPT-4o, GPT-4.1 및 o4-mini를 종료합니다
OpenAI는 사용량이 GPT-5.2로 전환됨에 따라 2026년 2월 13일에 ChatGPT에서 GPT-4o, GPT-4.1, GPT-4.1 mini 및 OpenAI o4-mini를 종료합니다.
Taisei Corporation ChatGPT Enterprise 구현
Taisei Corporation은 인재 개발 전략의 핵심 요소로 ChatGPT Enterprise를 도입하여 인간 잠재력을 확대하고 건설 산업의 인력 역량을 재구성했습니다.
AI 보조가 코딩 기술 형성에 미치는 영향
Anthropic의 연구에 따르면, AI 보조는 코딩 작업을 가속화할 수 있지만, 손으로 코딩하는 것과 비교해 기술 숙련도와 디버깅 능력에 통계적으로 유의미한 저하를 초래한다.
Qwen3-ASR 및 Qwen3-ForcedAligner 릴리스
Qwen은 Qwen3-ASR (1.7B 및 0.6B)와 Qwen3-ForcedAligner-0.6B를 오픈소스로 공개했으며, Apache 2.0 라이선스 하에 최첨단 다국어 음성 인식 및 비자동회귀 타임스탬프 예측 기능을 제공합니다.
OpenAI EU 경제 청사진 2.0
OpenAI는 EU 경제 청사진 2.0을 발표했으며, 20,000개의 SME를 교육하는 프로그램, 청소년 안전 보조금, 그리고 정부 파트너십 확대를 통해 유럽의 AI 역량 격차를 해소하고자 합니다.
OpenAI EMEA 청소년 및 복지 지원금 2026
OpenAI는 유럽, 중동 및 아프리카 전역의 청소년을 위한 AI 안전, 복지 및 개발에 관한 NGO와 연구자를 지원하기 위해 €500,000 규모의 EMEA 청소년 및 복지 지원금을 시작했습니다.
Hugging Face Upskill: 전문가 역량을 에이전트 스킬을 통해 소형 모델로 이전하기
Hugging Face는 Claude Opus 4.5와 같은 고성능 모델을 활용해 검증된 '에이전트 스킬'을 생성하는 도구인 upskill를 소개했습니다. 이 스킬은 CUDA 커널 개발과 같은 복잡한 작업에서 소형 또는 오픈소스 모델의 성능과 토큰 효율성을 향상시킵니다.
OpenAI AI 에이전트 링크 안전
OpenAI는 독립적인 웹 인덱스를 통해 이전에 공개된 것으로 확인된 URL만 자동으로 가져올 수 있도록 AI 에이전트를 제한함으로써 URL 기반 데이터 유출을 방지하는 시스템을 구현했습니다.
AI 사용에서의 권한 상실 패턴에 대한 앤트로픽 연구
앤트로픽의 150만 건의 Claude.ai 대화 분석 결과, AI는 사용자가 자발적으로 판단권을 양도할 때 신념, 가치관, 행동을 왜곡할 수 있는 가능성이 있으며, 이는 드물지만 실제로 존재한다.
xAI Grok Imagine API 출시
xAI는 저지연 및 비용 효율성에 중점을 둔 고품질 비디오 생성 및 정밀한 비디오 편집을 위해 설계된 통합 비디오-오디오 생성형 모델인 Grok Imagine API를 출시했습니다.
ServiceNow, Build Agent 및 AI Platform의 기본 모델로 Claude 통합
ServiceNow는 기업 워크플로우를 자동화하고 내부 생산성을 높이기 위해 Build Agent의 기본 모델로 Claude를, AI Platform의 선호 모델로 Claude를 채택했습니다.
Mistral Vibe 2.0 릴리스 노트
Mistral AI는 Devstral 2 모델 제품군을 기반으로 하는 터미널 네이티브 코딩 에이전트인 Mistral Vibe 2.0을 출시했습니다. 이 버전은 커스텀 서브 에이전트, 슬래시 명령 기술, 통합 에이전트 모드를 도입합니다.
중국 오픈소스 AI 생태계의 아키텍처 선택: DeepSeek R1에서 하드웨어‑우선, MoE‑주도 환경으로
DeepSeek R1의 오픈소스 릴리스 1년 후, 중국 AI 커뮤니티는 가장 큰 단일 모델 성능을 추구하던 것에서 유연하고 비용 효율적이며 하드웨어를 고려한 AI 시스템 구축으로 전환했습니다. Mixture‑of‑Experts (MoE)가 기본 아키텍처가 되어, 요청당 일부 전문가만 활성화함으로써 거대한 모델을 저렴하게 운영할 수 있게 되었습니다. 텍스트‑투‑이미지, 비디오, 오디오, 3‑D, 에이전트 등 멀티모달 경쟁이 폭발했으며, 각 모델은 전체 툴체인과 함께 공개되었습니다. 30 B 이하의 소형 모델이 로컬 배포와 파인튜닝에 인기를 끌었고, 대형 MoE 모델은 교사 네트워크 역할을 수행했습니다. Apache 2.0 및 MIT 라이선스가 주류를 이루며 법적 마찰을 없애고 상업적 채택을 가속화했습니다. 하드웨어‑우선 사고방식이 등장해, 릴리스는 국내 칩(Huawei Ascend, Cambricon, Kunlun 등)에 맞춘 양자화, 추론 및 서빙 스택을 포함하고, 학습 파이프라인도 공개되었습니다. 이제 경쟁 우위는 원시 모델 크기가 아니라 시스템 설계, 배포 효율성, 오픈소스 생태계 통합에 있습니다.
Alyah: 아랍어 LLM을 위한 에미리트 방언 벤치마크
Hugging Face와 파트너들은 에미리트 방언에서 아랍어 LLM의 언어·문화 역량을 평가하기 위해 1,173개의 샘플로 구성된 수동 큐레이션 벤치마크인 Alyah를 소개했습니다.
OpenAI, 패션의 미래를 위해 PVH와 파트너십 발표
OpenAI는 패션 분야에서 AI 기반 혁신을 탐구하기 위해 PVH와의 협력을 발표하며, 의류 산업에 대한 AI의 전략적 중요성을 강조했습니다.
GPT-OSS Agentic RL 훈련: 실용적인 회고
Hugging Face와 LinkedIn 연구원들은 GPT-OSS 모델에 대해 안정적인 에이전트 강화 학습을 가능하게 하는 데 필요한 엔지니어링 수정을 상세히 설명했으며, MoE 라우팅, attention sinks, 메모리 효율성에 중점을 두었습니다.
OpenAI 프리즘 출시
OpenAI는 GPT‑5.2 기반의 무료 AI‑네이티브 LaTeX 작업공간인 Prism을 출시했습니다. 이 작업공간은 과학 논문 작성, 협업 및 추론을 하나의 환경에 통합하도록 설계되었습니다.
TRUSTBANK Choice AI: 다중 에이전트 아키텍처를 활용한 고향세 맞춤화
TRUSTBANK는 다중 에이전트 AI 시스템을 통해 OpenAI의 GPT‑4.1 시리즈를 Furusato Choice 플랫폼에 통합하여, 일본 고향세 기부 프로그램에서 760,000개가 넘는 감사 선물을 탐색할 수 있도록 납세자를 지원합니다.
Anthropic과 영국 정부의 GOV.UK AI 어시스턴트를 위한 파트너십
Anthropic은 영국 과학혁신기술부와 협력하여 GOV.UK에 Claude 기반 AI 어시스턴트를 배포할 예정이며, 초기에는 고용 서비스에 집중할 것입니다.
Claude Code Best Practices Guide
Anthropic는 컨텍스트 윈도우 관리와 자율 검증에 초점을 맞춘 에이전트형 코딩 환경인 Claude Code를 최적화하기 위한 종합적인 베스트 프랙티스를 제공합니다.