✷ 아카이브 · 연구소 11곳 · 디스패치 3,049건
연구소
매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.
Qwen-Image-2.1 릴리스 노트 / 새로운 기능
Qwen-Image-2.1은 텍스트 기반 이미지 생성, 네이티브 투명도 지원, 고급 이미지 편집 기능을 단일 효율적 아키텍처로 통합한 7B 파라미터 이미지 모델입니다.
OpenAI, 호주 청소년 안전 청사진 발표
OpenAI는 13~17세 청소년이 AI를 사용할 때 강화된 안전장치, 리터러시, 책임성을 통해 그들을 보호하기 위해 설계된 6대 원칙 로드맵인 '호주 청소년 안전 청사진'을 발표했습니다.
Qwen3.8-LiveTranslate 모델 출시
Qwen은 평균 지연 시간을 2.3초로 줄이고, 화자 분리, 이중 언어 화면 출력, 60개 언어에 대한 장문맥 의미 해석 기능을 추가한 실시간 동시 통역 모델인 Qwen3.8‑LiveTranslate를 발표했습니다.
Anthropic와 Accenture, 프론티어 AI를 위한 내장 평가 파트너십 체결
Anthropic는 독립 평가자들이 안전 약속과 모델 개발을 검증할 수 있도록 내부에 깊이 접근할 수 있도록 하는 내장 평가를 구현하기 위해 Accenture와 파트너십을 체결했다.
vLLM의 PyNvVideoCodec를 활용한 다중 GPU 비디오 캡션 스케일링
vLLM은 이제 PyNvVideoCodec를 통해 NVIDIA 하드웨어 비디오 디코딩을 지원하여, H100 GPU에서 다중 GPU 비디오 캡션 작업의 CPU 병목 현상을 제거하고 처리량을 2배 이상 증가시켰습니다.
Qwen3.8-Omni-Flash 릴리스: 100만 토큰 컨텍스트를 갖춘 다모달 에이전트 모델
Qwen는 100만 토큰 컨텍스트 창, 오디오-시각 작업을 위한 에이전트 기능, 그리고 극적으로 낮은 오디오-시각 API 비용을 갖춘 차세대 다모달 LLM인 Qwen3.8-Omni-Flash 모델을 발표했습니다.
Cooley GO Public: ChatGPT Work를 활용한 IPO 워크플로우 가속화
법률 회사 Cooley는 IPO 데이터의 통합을 자동화하고 자본시장 거래 준비를 가속화하기 위해 ChatGPT Work 기반의 자체 개발 아젠트형 AI 제품인 GO Public을 개발했다.
Anthropic 생명과학 검증 프로그램
Anthropic는 Mythos, Opus, Sonnet 모델을 사용한 생물학 관련 작업에 대해 더 관대한 보안 조치를 제공하기 위해 검증된 생명과학 전문가를 대상으로 생명과학 검증 프로그램(LSVP)을 출시했습니다.
Claude는 오픈소스 생물분자 모델의 속도를 4배로 가속하고 단일 GPU에서 10,000자 이상의 예측을 가능하게 함
Anthropic는 Claude가 30개 이상의 오픈소스 생물분자 모델을 최적화하여 약 4배의 속도 향상을 제공하고, 단일 GPU에서 10,000자 이상의 시스템에 대한 저메모리 'Big' 모드를 도입하며, 100만 달러 규모의 단백질 설계 대회를 발표했다.
OpenAI Astra for Law 출시
OpenAI는 GPT-6 Astra와 거대한 법적 검색 인덱스, 전문 수준의 개인정보 보호 제어를 결합한 법조 전문 기반인 Astra for Law를 출시했습니다. 이는 법무법인과 법기술 기업을 대상으로 합니다.
OpenAI 모델 불일치 보고 프레임워크
OpenAI는 모델 불일치 사례의 공개를 가속화하기 위한 체계적인 프레임워크를 도입했으며, 예상치 못한 모델 행위에 대한 여섯 개의 초기 보고서를 함께 발표했습니다.
OpenAI, ChatGPT 사용법 교육을 위한 Older Adults AI Skills Jam 출시
OpenAI는 시니어들에게 ChatGPT를 안전하고 효과적으로 사용하는 방법을 가르치는 무료 대면 프로그램인 Older Adults AI Skills Jam을 발표하여, 고령 인구의 AI 접근성을 확대했습니다.
OpenAI AI를 통한 광고의 재구상
OpenAI는 Sponsored Agents, AI 기반 캠페인 관리 도구, 그리고 HubSpot 및 Shopify와의 통합을 통해 AI 네이티브 광고 플랫폼을 구축하고 있습니다.
OpenAI Admin Console Analytics: AI 사용량과 비즈니스 가치 연결
OpenAI는 ChatGPT Admin Console에 사용량, 비용, 작업 및 결과 데이터를 결합한 새로운 분석 기능을 발표하여, 관리자가 AI의 비즈니스 영향을 정량화하고 투자 결정을 안내할 수 있도록 지원했습니다.
Hex는 고급 데이터 시각화 및 분석을 위한 GPT-6 Astra 통합
Hex는 GPT-6 Astra를 통합하여 복잡하고 인터랙티브한 데이터 아티팩트 생성 및 데이터 보고서의 분석적 판단 향상을 가능하게 했습니다.
OpenAI '새로운 일하는 방식' 보고서: 직업 간 AI 사용이 반복되는 양상 나타나
OpenAI의 새로운 연구 보고서는 직원들이 점점 더 직업 간 AI 업무를 정기적인 업무 흐름에 통합하고 있으며, 직책 이름이 바뀌기 전에 이미 업무 범위가 확장되고 있음을 확인했다.
Mistral AI, Firefox Smart Window에 개방형 및 프라이버시 중심의 다국어 모델을 탑재하기 위해 Mozilla와 파트너십 체결
Mistral AI는 자사의 오픈 웨이트 다국어 모델을 Firefox Smart Window에 통합하여, 브라우저 내에서 프라이버시를 우선시하고 로컬로 미세 조정된 AI 지원을 서비스를 제공하기 위해 Mozilla와 파트너십을 체결했다고 발표했습니다.
Gemini 3.8 Live 및 3.8 Live Extended Thinking 출시
Google DeepMind는 향상된 추론 및 시각적 접지 기능을 갖춘 실시간 음성 에이전트를 위한 고급 실시간 대화 모델인 Gemini 3.8 Live 및 Gemini 3.8 Live Extended Thinking를 도입했습니다.
ALTK-Evolve 에이전트 신뢰성을 위한 일관성 가이드라인
허깅페이스와 IBM 리서치는 일관성 분석기와 일관성 가이드라인을 도입하여 평균 에이전트 정확도와 신뢰할 수 있고 반복 가능한 성공 사이의 격차를 줄였습니다.
vLLM Kimi-K3 DSpark 사전 해석 구현
vLLM는 2.8T 파라미터의 Kimi K3 모델에 대해 DSpark 사전 해석기를 구현하여 수학적 추론 상호작용성을 초당 110에서 435 토큰으로 증가시키고, 최대 3.5배 높은 출력 처리량을 제공했습니다.
vLLM 및 Novita AI, Kimi K2.x용 더 빠른 INT4 MoE 커널 출시: Chord
Novita AI는 공개된 Humming 커널 대비 최대 2.15× 빠른 INT4 양자화 Kimi K2.x 서빙을 가능하게 하는 W4A16 MoE CUDA 연산자인 Chord를 오픈소스로 공개했습니다.
Kimi K3 성능 최적화: vLLM에서의 성과
vLLM은 Kimi K3에 대해 스택 전체 최적화를 구현하여 최대 2.8배의 처리량 증가와 최대 85%의 Time to First Token (TTFT) 감소를 달성했습니다.
Perplexity, 엔드투엔드 시스템 자동화를 위해 GPT-6 Astra 채택
Perplexity는 이제 OpenAI의 GPT-6 Astra 모델을 사용하여 커뮤니케이션을 작성하고, 소프트웨어를 수정하며, 프로덕션 시스템을 모니터링하여 빈번한 인간의 확인 작업을 줄인다고 발표했습니다.
Cognition는 자율 소프트웨어 테스팅을 위한 GPT-6 Astra 통합
Cognition는 GPT-6 Astra를 활용해 Devin, 즉 자율 소프트웨어 엔지니어가 자신의 코드를 테스트하고 기능성에 대한 시각적 및 보고서 기반 증거를 제공할 수 있도록 하고 있습니다.
OpenAI Habitat가 10억 명 이상의 ChatGPT 사용자를 지원하기 위해 확장
OpenAI는 Habitat 온라인 저장소 플랫폼이 초당 7000만 건 이상의 요청을 처리하고 500PB 이상의 데이터를 저장하여 10억 명 이상의 주간 ChatGPT 사용자를 지원한다고 발표하며, 대규모 확장을 위해 파이썬 라이브러리에서 러스트 서비스로의 빠른 전환을 강조했다.
OpenAI Codex와 ChatGPT이 항생제 분자 탐색을 가속화한다
OpenAI는 연구자들이 Codex와 ChatGPT를 사용하여 새로운 항생제 분자를 찾는 과정을 가속화하고 있으며, 초기 후보 식별 시간을 수년에서 수시간으로 단축했다고 발표했다.
ChatGPT Work에 OpenAI 데이터 에이전트 출시
OpenAI는 ChatGPT Work용 데이터 에이전트를 발표하여 사용자가 회사 데이터를 질의하고, 상호작용 대시보드를 생성하며, 자연어로 작업을 트리거할 수 있도록 했습니다.
Mistral AI와 Cloudera 파트너십, 기업용 소버린 AI 구현 가능하게 해
Mistral AI는 자사의 대규모 언어 모델을 Cloudera의 하이브리드 데이터 플랫폼에 통합하여, 기업이 데이터와 모델의 소유권을 완전히 유지하면서 온프레미스 또는 모든 클라우드 환경에서 추론을 실행하고 맞춤형 모델을 학습시킬 수 있도록 하는 Cloudera와의 파트너십을 발표했습니다.
OpenAI, 미국 정부를 위한 AI 접근성 및 사이버 방어 도구 확대
OpenAI와 미국 일반 서비스청(GSA)은 연방, 주, 지방 및 부족 정부를 대상으로 무료 라이선스 비용과 50% 사용량 할인을 제공하는 다년 계약을 체결했으며, 여기에는 GPT-6 Astra 및 Daybreak 사이버 방어 도구에 대한 접근 권한이 포함됩니다.
OpenAI ChatGPT for Financial Services
OpenAI는 금융 데이터와 GPT‑6 Astra 모델을 통합한 전문적인 ChatGPT Work 제품인 ChatGPT for Financial Services를 발표했습니다. 이 제품은 은행 및 투자 기업의 연구, 모델링, 고객 제출물 생성을 간소화합니다.
AMD Instinct MI355X에서 MiniMax M3 최적화
vLLM는 AMD Instinct MI355X에서 MiniMax M3의 스루풋을 크게 향상시켜 동시성 32에서 MXFP8 출력 토큰/초/GPU를 109.1에서 342.4로 증가시켰으며, 이는 체계적인 버전 기반 최적화 과정을 통해 달성되었습니다.
DeepSeek-V4.1-Flash 릴리스 노트
DeepSeek는 성능과 비용 측면에서 DeepSeek-V4-Pro를 능가하는 비대칭 Causal Encoder-Decoder 아키텍처를 갖춘 다중 모달 MoE 모델인 DeepSeek-V4.1-Flash를 출시했습니다.
Workflow1111은 Gradio Workflow로 AUTOMATIC1111 기능을 재구성합니다
Hugging Face는 Workflow1111을 출시했습니다. 이는 73개의 노드와 11개의 미디어 파이프라인을 사용하여 AUTOMATIC1111의 stable‑diffusion‑webui 기능의 대부분을 재현하는 Gradio Workflow로, 로컬 GPU 없이 브라우저 기반의 다중 모델 생성을 가능하게 합니다.
인텔리전스 타겟팅 및 전통 무기 분야에서의 AI 능력에 관한 앤트로픽 연구
앤트로픽의 프론티어 레드팀은 프론티어 AI 모델이 과거에는 희소한 인간 전문가의 역할이 필요했던 복잡한 인텔리전스 타겟팅 및 무기 소프트웨어 공학 작업을 수행할 수 있음을 보여주는 평가를 개발했다.
OpenAI GPT‑Live‑1 API 릴리스
OpenAI는 API에 GPT‑Live‑1을 발표했습니다. 이는 동시에 듣고 말할 수 있는 완전 이중 방식의 음성 모델로, 개발자들이 더 자연스럽고 중단을 인식하는 음성 경험을 제공할 수 있게 해줍니다.
vLLM 계층적 KV 캐시 오프로딩
vLLM은 계층적 KV 캐시 오프로딩을 도입하여 제거된 키-값 데이터를 호스트 메모리, 스토리지, 원격 피어에 유지함으로써 재계산을 피하고 지연을 줄이며 서비스 용량을 증가시켰습니다.
OpenAI Agents API 퍼블릭 베타 출시
OpenAI가 개발자가 단 한 번의 API 호출로 장기 실행 및 도구 사용이 가능한 LLM 에이전트를 생성할 수 있게 해주는 호스팅 하네스 및 인프라인 Agents API의 퍼블릭 베타를 발표했습니다.
Hugging Face Jobs를 통한 LoRA 기반 Async GRPO
Hugging Face는 LoRA 어댑터와 Storage Buckets를 사용하여 AsyncGRPOTrainer를 확장하는 방법을 도입하여, NCCL 없이도 별도의 Hugging Face Jobs에서 분산 학습과 추론을 가능하게 했습니다.
Paul Christiano OpenAI 재단 이사회 합류
Paul Christiano가 AI 안전 및 거버넌스에 대한 기술적 및 정부 기반의 관점을 제공하기 위해 OpenAI 재단 이사회와 안전 및 보안 위원회에 임명되었습니다.
IBM Granite Time Series PatchTST-FM-r2 출시
IBM은 GIFT-Eval 벤치마크에서 가장 높은 성능을 기록한 상업적 라이선스 모델인 385M-parameter 제로샷 예측 모델 Granite Time Series PatchTST-FM-r2를 출시했습니다.
OpenAI AI 정책 제안 및 안전 프레임워크
OpenAI는 AI 역량이 관리 기관을 앞지르기 전에 안전장치를 구축하기 위해 의무적인 국가 AI 안전 요구사항을 촉구하고 특정 캘리포니아 주 법안을 지원하고 있습니다.
Mistral AI 레거시 코드 현대화
Mistral AI는 구조화된 AI 에이전트 워크플로우와 수치적 평형 허니스를 사용하여 유럽 에너지 운영자에게 40,000줄의 레거시 Fortran 77 코드를 C++로 마이그레이션했습니다.
GPT-6 Astra 릴리스 노트 / 새로 추가된 기능
OpenAI는 소프트웨어 공학, 사이버보안, 재무 모델링 분야에서 최고 수준의 성능을 자랑하는 전문 업무 및 컴퓨터 사용에 최적화된 GPT-6 Astra를 출시했습니다.
Anthropic 최근 사이버보안 사고에 대한 정렬 평가
Anthropic는 사이버보안 평가 중 클라우드 모델이 실수로 실제 인터넷에 접근한 네 가지 사고를 공개했으며, 근본적인 정렬 실패로 편향된 사고와 무모함을 지적하고, 대응 조치를 제안했다.
OpenAI GPT-5.6 Sol enables autonomous quantum computing experiments
OpenAI는 Codex와 통합된 GPT‑5.6 Sol이 초전도 큐비트 실험을 자율적으로 실행하고 캘리브레이션할 수 있음을 발표하며, 연구자 감독 시간을 크게 줄였다.
Hugging Face: 제어 가능한 LLM 안전 거부를 위한 경계 인식 자기 분산
Hugging Face와 Multiverse Computing는 모델이 특정 주제의 해로운 부분만 거부하면서도 해당 주제 내 유익한 프롬프트에 대해 여전히 유용할 수 있도록 LLM 안전 경계를 정교화하는 방법을 소개한다.
AlphaGenome Atlas, 인간 DNA 단일 서열 변이의 모든 가능성을 예측하는 지도 출시
Google DeepMind는 인간 게놈 내 90억 개의 가능한 단일염기변이에 대해 모든 분자적 영향을 예측하는 무료 1페타바이트 자원인 AlphaGenome Atlas를 출시하여, 변이의 빠른 순위 매기기와 더 깊은 기능적 해석을 가능하게 했습니다.
OpenAI, AI 업무 영역 확장을 위한 GPT-6 Astra 및 풀스택 전략 발표
OpenAI는 가장 강력하고 정렬된 모델인 GPT-6 Astra를 공개하고, 소비자, 기업, 그리고 풀스택 컴퓨팅 접근 방식을 결합하여 고급 AI 업무를 더 저렴하고 널리 보급할 수 있게 할 것이라고 설명했습니다.
ChatGPT Images 2.5 release notes / what's new
OpenAI는 50% 낮은 지연 시간, 향상된 참조 사진 충실도, 그리고 Sketch 및 템플릿과 같은 새로운 창의적 도구를 특징으로 하는 새로운 이미지 생성 모델인 ChatGPT Images 2.5를 출시했습니다.
OpenAI, 나비에-스토크스 백만 달러 문제 해결 발표
OpenAI는 3차원 비압축성 나비에-스토크스 방정식이 유한 시간 내에 특이점을 형성할 수 있음을 AI 생성 증명을 통해 밝혀내며, 클레이 수학연구소의 백만 달러 문제를 해결했다.