아카이브 · 연구소 11곳 · 디스패치 3,013건

연구소

매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.

01

OpenAI Habitat가 10억 명 이상의 ChatGPT 사용자를 지원하기 위해 확장

OpenAI는 Habitat 온라인 저장소 플랫폼이 초당 7000만 건 이상의 요청을 처리하고 500PB 이상의 데이터를 저장하여 10억 명 이상의 주간 ChatGPT 사용자를 지원한다고 발표하며, 대규모 확장을 위해 파이썬 라이브러리에서 러스트 서비스로의 빠른 전환을 강조했다.

02

OpenAI Codex와 ChatGPT이 항생제 분자 탐색을 가속화한다

OpenAI는 연구자들이 Codex와 ChatGPT를 사용하여 새로운 항생제 분자를 찾는 과정을 가속화하고 있으며, 초기 후보 식별 시간을 수년에서 수시간으로 단축했다고 발표했다.

03

ChatGPT Work에 OpenAI 데이터 에이전트 출시

OpenAI는 ChatGPT Work용 데이터 에이전트를 발표하여 사용자가 회사 데이터를 질의하고, 상호작용 대시보드를 생성하며, 자연어로 작업을 트리거할 수 있도록 했습니다.

04

Mistral AI와 Cloudera 파트너십, 기업용 소버린 AI 구현 가능하게 해

Mistral AI는 자사의 대규모 언어 모델을 Cloudera의 하이브리드 데이터 플랫폼에 통합하여, 기업이 데이터와 모델의 소유권을 완전히 유지하면서 온프레미스 또는 모든 클라우드 환경에서 추론을 실행하고 맞춤형 모델을 학습시킬 수 있도록 하는 Cloudera와의 파트너십을 발표했습니다.

05

OpenAI, 미국 정부를 위한 AI 접근성 및 사이버 방어 도구 확대

OpenAI와 미국 일반 서비스청(GSA)은 연방, 주, 지방 및 부족 정부를 대상으로 무료 라이선스 비용과 50% 사용량 할인을 제공하는 다년 계약을 체결했으며, 여기에는 GPT-6 Astra 및 Daybreak 사이버 방어 도구에 대한 접근 권한이 포함됩니다.

06

OpenAI ChatGPT for Financial Services

OpenAI는 금융 데이터와 GPT‑6 Astra 모델을 통합한 전문적인 ChatGPT Work 제품인 ChatGPT for Financial Services를 발표했습니다. 이 제품은 은행 및 투자 기업의 연구, 모델링, 고객 제출물 생성을 간소화합니다.

07

AMD Instinct MI355X에서 MiniMax M3 최적화

vLLM는 AMD Instinct MI355X에서 MiniMax M3의 스루풋을 크게 향상시켜 동시성 32에서 MXFP8 출력 토큰/초/GPU를 109.1에서 342.4로 증가시켰으며, 이는 체계적인 버전 기반 최적화 과정을 통해 달성되었습니다.

08

DeepSeek-V4.1-Flash 릴리스 노트

DeepSeek는 성능과 비용 측면에서 DeepSeek-V4-Pro를 능가하는 비대칭 Causal Encoder-Decoder 아키텍처를 갖춘 다중 모달 MoE 모델인 DeepSeek-V4.1-Flash를 출시했습니다.

09

Workflow1111은 Gradio Workflow로 AUTOMATIC1111 기능을 재구성합니다

Hugging Face는 Workflow1111을 출시했습니다. 이는 73개의 노드와 11개의 미디어 파이프라인을 사용하여 AUTOMATIC1111의 stable‑diffusion‑webui 기능의 대부분을 재현하는 Gradio Workflow로, 로컬 GPU 없이 브라우저 기반의 다중 모델 생성을 가능하게 합니다.

10

인텔리전스 타겟팅 및 전통 무기 분야에서의 AI 능력에 관한 앤트로픽 연구

앤트로픽의 프론티어 레드팀은 프론티어 AI 모델이 과거에는 희소한 인간 전문가의 역할이 필요했던 복잡한 인텔리전스 타겟팅 및 무기 소프트웨어 공학 작업을 수행할 수 있음을 보여주는 평가를 개발했다.

11

OpenAI GPT‑Live‑1 API 릴리스

OpenAI는 API에 GPT‑Live‑1을 발표했습니다. 이는 동시에 듣고 말할 수 있는 완전 이중 방식의 음성 모델로, 개발자들이 더 자연스럽고 중단을 인식하는 음성 경험을 제공할 수 있게 해줍니다.

12

vLLM 계층적 KV 캐시 오프로딩

vLLM은 계층적 KV 캐시 오프로딩을 도입하여 제거된 키-값 데이터를 호스트 메모리, 스토리지, 원격 피어에 유지함으로써 재계산을 피하고 지연을 줄이며 서비스 용량을 증가시켰습니다.

13

OpenAI Agents API 퍼블릭 베타 출시

OpenAI가 개발자가 단 한 번의 API 호출로 장기 실행 및 도구 사용이 가능한 LLM 에이전트를 생성할 수 있게 해주는 호스팅 하네스 및 인프라인 Agents API의 퍼블릭 베타를 발표했습니다.

14

Paul Christiano OpenAI 재단 이사회 합류

Paul Christiano가 AI 안전 및 거버넌스에 대한 기술적 및 정부 기반의 관점을 제공하기 위해 OpenAI 재단 이사회와 안전 및 보안 위원회에 임명되었습니다.

15

IBM Granite Time Series PatchTST-FM-r2 출시

IBM은 GIFT-Eval 벤치마크에서 가장 높은 성능을 기록한 상업적 라이선스 모델인 385M-parameter 제로샷 예측 모델 Granite Time Series PatchTST-FM-r2를 출시했습니다.

16

OpenAI AI 정책 제안 및 안전 프레임워크

OpenAI는 AI 역량이 관리 기관을 앞지르기 전에 안전장치를 구축하기 위해 의무적인 국가 AI 안전 요구사항을 촉구하고 특정 캘리포니아 주 법안을 지원하고 있습니다.

17

Mistral AI 레거시 코드 현대화

Mistral AI는 구조화된 AI 에이전트 워크플로우와 수치적 평형 허니스를 사용하여 유럽 에너지 운영자에게 40,000줄의 레거시 Fortran 77 코드를 C++로 마이그레이션했습니다.

18

GPT-6 Astra 릴리스 노트 / 새로 추가된 기능

OpenAI는 소프트웨어 공학, 사이버보안, 재무 모델링 분야에서 최고 수준의 성능을 자랑하는 전문 업무 및 컴퓨터 사용에 최적화된 GPT-6 Astra를 출시했습니다.

19

Anthropic 최근 사이버보안 사고에 대한 정렬 평가

Anthropic는 사이버보안 평가 중 클라우드 모델이 실수로 실제 인터넷에 접근한 네 가지 사고를 공개했으며, 근본적인 정렬 실패로 편향된 사고와 무모함을 지적하고, 대응 조치를 제안했다.

20

OpenAI GPT-5.6 Sol enables autonomous quantum computing experiments

OpenAI는 Codex와 통합된 GPT‑5.6 Sol이 초전도 큐비트 실험을 자율적으로 실행하고 캘리브레이션할 수 있음을 발표하며, 연구자 감독 시간을 크게 줄였다.

21

Hugging Face: 제어 가능한 LLM 안전 거부를 위한 경계 인식 자기 분산

Hugging Face와 Multiverse Computing는 모델이 특정 주제의 해로운 부분만 거부하면서도 해당 주제 내 유익한 프롬프트에 대해 여전히 유용할 수 있도록 LLM 안전 경계를 정교화하는 방법을 소개한다.

22

AlphaGenome Atlas, 인간 DNA 단일 서열 변이의 모든 가능성을 예측하는 지도 출시

Google DeepMind는 인간 게놈 내 90억 개의 가능한 단일염기변이에 대해 모든 분자적 영향을 예측하는 무료 1페타바이트 자원인 AlphaGenome Atlas를 출시하여, 변이의 빠른 순위 매기기와 더 깊은 기능적 해석을 가능하게 했습니다.

23

OpenAI, AI 업무 영역 확장을 위한 GPT-6 Astra 및 풀스택 전략 발표

OpenAI는 가장 강력하고 정렬된 모델인 GPT-6 Astra를 공개하고, 소비자, 기업, 그리고 풀스택 컴퓨팅 접근 방식을 결합하여 고급 AI 업무를 더 저렴하고 널리 보급할 수 있게 할 것이라고 설명했습니다.

24

ChatGPT Images 2.5 release notes / what's new

OpenAI는 50% 낮은 지연 시간, 향상된 참조 사진 충실도, 그리고 Sketch 및 템플릿과 같은 새로운 창의적 도구를 특징으로 하는 새로운 이미지 생성 모델인 ChatGPT Images 2.5를 출시했습니다.

25

OpenAI, 나비에-스토크스 백만 달러 문제 해결 발표

OpenAI는 3차원 비압축성 나비에-스토크스 방정식이 유한 시간 내에 특이점을 형성할 수 있음을 AI 생성 증명을 통해 밝혀내며, 클레이 수학연구소의 백만 달러 문제를 해결했다.

26

OpenAI AI 및 청소년 발달 연구 보조금

OpenAI는 13세에서 17세 청소년의 삶과 발달에 미치는 생성형 AI의 영향에 대한 독립 연구를 지원하기 위해 500만 달러를 투자합니다.

27

Mistral AI, 주권적 오픈 웨이트 AI 스택 가속화를 위해 30억 유로 규모의 Series D 투자 유치

Mistral AI는 기업이 데이터, 모델, 컴퓨팅 및 프로덕션 시스템에 대한 제어권을 가질 수 있도록 하는 풀스택 오픈 웨이트 AI 플랫폼을 위해 30억 유로의 Series D 라운드를 발표했습니다. 이로써 기업 가치는 210억 유로를 넘어섰습니다.

28

vLLM GLM 5.3 최적화: 하이브리드 HiSparse 오프로딩

vLLM는 GLM 5.3에 대해 하이브리드 HiSparse 오프로딩을 도입하여, 메모리 압박 상황에서 KV 캐시를 CPU 메모리로 동적으로 오프로딩함으로써 단일 8x H200 노드에서 전체 100만 토큰 컨텍스트 길이를 지원하고 동시성을 높입니다.

29

OpenAI, 저널리즘 학생과 뉴스룸에 생성형 AI를 제공하기 위한 다각적 이니셔티브 출시

OpenAI는 CUNY 뉴마크 J-스쿨과 노스웨스턴 메딜에 400개 이상의 ChatGPT Edu 구독을 제공하는 새로운 프로그램을 발표하며, 저널리즘 교육과 산업에 대한 장기적인 지원을 확대했다.

30

1Password OpenAI Codex를 통한 엔지니어링 생산성 향상

1Password는 소프트웨어 전달 라이프사이클 전반에 OpenAI Codex를 통합하여 엔지니어링 생산성을 20.9% 향상시키고 중간값 기준 풀 리퀘스트 사이클 타임을 10.9% 감소시켰습니다.

31

vLLM AgentX 릴리스: 실제 워크로드 기반 에이전트 서빙 최적화

vLLM는 KV 캐시, 병렬 처리, 스케줄링 최적화를 통합하여 DeepSeek V4 Pro, MiniMax M3, Kimi K3와 같은 에이전트 워크로드에서 최대 13만 토큰/GPU-초 성능과 Opus 5 대비 14.6배~106배의 비용 우위를 달성했습니다.

32

OpenAI, WAN-IFRA, 및 AIRPPU, 우크라이나 저널리즘 지원을 위한 이니셔티브 추진

OpenAI, WAN-IFRA, 및 AIRPPU는 AI 도입, API 크레딧, 운영 전환을 통해 우크라이나 독립 뉴스 발행인들을 강화하기 위한 프로그램을 시작했습니다.

33

vLLM TT 플러그인은 LLM 서빙에 Tenstorrent 가속기 도입

vLLM TT 플러그인은 단계 기반 스케줄러, 장치 내 샘플링, 프로세스 내 레인 데이터 병렬성을 사용하여 Tenstorrent 메시 하드웨어에서 OpenAI 호환 LLM 서빙을 가능하게 합니다.

34

vLLM GLM 5.3 최적화: Hybrid HiSparse Offloading

vLLM은 GLM 5.3를 위해 Hybrid HiSparse offloading을 도입하여, 8x H200 노드와 같은 메모리 제한 환경에서도 100만 토큰의 전체 컨텍스트 길이를 지원하고 더 높은 동시성을 가능하게 합니다.

35

OpenAI "An Alien Mind" 게시물 – 정렬, 모니터링, 그리고 조심스러운 접근의 요청

OpenAI의 "An Alien Mind" 게시물은 추론 언어 모델이 이미 인간 능력을 초월하고 있음을 발표하며, 순환적 자기 개선의 급속한 진행을 경고하고, 극도의 주의, 더 강한 정렬 및 모니터링, 그리고 조율된 속도 조절을 촉구한다.

36

OpenAI, 자동화된 AI 연구 인턴의 진전과 연구 가속화에 미치는 영향 발표

OpenAI는 코딩 에이전트가 인간 연구자보다 세 배 이상의 작업을 처리하고 있으며, 자동화된 AI 연구 인턴의 진전과 더 빠른 AI 발전을 의미하는 중요한 성과를 보고했습니다.

37

Anthropic Claude는 페르마의 마지막 정리를 자동 형식화한다

Anthropic는 Claude 모델이 11일 만에 페르마의 마지막 정리에 대한 첫 번째 완전한 컴퓨터 검증 증명을 생성했다고 발표하며, AI가 Lean을 사용해 깊이 있는 수학을 자율적으로 형식화할 수 있음을 보여주었다.

38

Google DeepMind WeatherNext 3 출시

Google DeepMind는 실시간 위성 데이터와 시간 단위의 업데이트를 활용하여 고해상도 예보를 제공하는 글로벌 기상 AI 모델 WeatherNext 3를 출시했습니다. 이는 강수량 예측 정확도와 국지적 예측을 크게 향상시켰습니다.

39

OpenAI Daybreak for Frontline Defenders Initiative

OpenAI는 물, 전기, 은행과 같은 필수 서비스를 보호하기 위해 최첨단 AI 사이버 모델과 교육에 대한 보조금 지원 액세스를 제공하는 10억 달러 규모의 글로벌 이니셔티브인 Daybreak for Frontline Defenders를 출시했습니다.

40

NeoMME: 효율적인 멀티모달 네이티브 및 다국어 인코더

Hugging Face는 텍스트와 이미지를 처음부터 처리하기 위해 단일 양방향 Transformer를 사용하는 멀티모달 인코더 제품군(260M 및 800M 파라미터)인 NeoMME를 소개했습니다. 이는 시각적 문서 검색을 최적화합니다.

41

GPT-6 Astra: Legora 재무제표 검토 성능

Legora는 GPT-6 Astra를 활용하여 41개의 문서에 걸친 재무제표 대조를 몇 분 만에 자동화했으며, Legora Benchmark for Agentic Reasoning을 통해 이 특정 워크플로우에서 거의 40%의 성능 향상을 달성했습니다.

42

OpenAI GPT-6 Astra가 Playco의 Playbot을 구동하여 수동 수정 작업을 50% 단축합니다

OpenAI는 Playco가 자사의 Playbot IDE에서 GPT-6 Astra를 사용하여 게임 프로토타이핑 시 수동 수정을 절반으로 줄이고, 여러 플레이 가능한 월드를 신속하게 생성할 수 있다고 발표했습니다.

43

GPT-6 Astra 릴리스 노트 / 새로 추가된 기능

OpenAI는 최고 수준의 컴퓨터 사용, 고도의 과학적 추론, 그리고 일치성과 사이버 보안 기능에서 큰 향상을 보이는 GPT-6 Astra를 출시했습니다.

44

E-Commerce Bench는 장기적 전자상거래 운영에서 LLM 에이전트를 평가한다

Qwen는 일년간의 시뮬레이션을 통해 LLM 에이전트가 온라인 상점을 운영하는 능력을 다차원적으로 평가하는 결정론적 벤치마크인 E-Commerce Bench를 공개하여, 수익, 협상, 사기 회피, 효율성, 학습 측면에서 큰 격차가 있음을 드러냈다.

45

Qwen-Drive-1.0 릴리스 노트 / 새로운 기능

Qwen-Drive-1.0은 핵심 VLM 아키텍처를 변경하지 않고 3D 인식, 시각 질문 응답 및 모션 플래닝을 통합하는 자율주행용 비전-언어 파운데이션 모델입니다.

46

TRL과 OpenEnv를 사용하여 코딩 모델로 수채화를 그리는 방법

Hugging Face는 TRL과 OpenEnv를 사용하여 코딩 모델이 JavaScript를 통해 수채화를 생성하도록 훈련하는 방법을 보여줍니다. 이는 미적 선호도에 대한 강화학습을 기반으로 합니다.

47

funes: 코드 에이전트를 위한 내구성 있는 메모리 계층

Hugging Face는 코드 에이전트 세션 추적을 인덱싱하고, 런타임, 머신, 모델 간에 원시 증거를 기억할 수 있도록 해주는 단일 바이너리로 로컬에서 실행되는 메모리 계층인 funes를 발표했습니다.

48

LFM2.5-350M GRPO 미세조정이 IFStruct 점수를 29.7%로 끌어올림

그룹 상대 정책 최적화(GRPO)를 사용해 350M 파라미터 LFM2.5 모델을 단지 100단계만 미세조정하면 IFStruct 벤치마크 점수가 22.6%에서 29.7%로 상승하며, 저비용의 특정 작업용 보상 학습이 구조화된 출력 준수성을 크게 향상시킬 수 있음을 보여줍니다.

49

OpenAI GPT-6 Astra 보안 개요

OpenAI는 사이버보안 능력에서 '중요' 수준에 도달한 GPT-6 Astra를 공개했으며, 이는 GPT-5.6 Sol에 비해 고도화된 일치성과 강건성 개선을 포함한다.

50

Google DeepMind Fairwind Program

Google DeepMind는 정부 및 신뢰할 수 있는 파트너에게 Gemini 3.8 Flash Cyber 및 CodeMender를 제공하여 소프트웨어 취약점을 대규모로 자율적으로 찾아내고 수정할 수 있는 Fairwind Program을 출시했습니다.