아카이브 · 디스패치 5,052건

모든 디스패치

AgentLensHQ가 기록한 모든 것 — AI 생태계 전반에서 압축.

301

신진서, 카타고와의 역사적인 두 수석 핸디캡 시리즈에서 승리

바둑 명인 신진서는 두 수석 핸디캡 하에서 최첨단 바둑 엔진 카타고와의 공식 시리즈에서 승리하며, 현대 AI에 맞서도 최고 수준의 선수가 여전히 승리할 수 있음을 보였다.

302

Grok 장애 및 SpaceXAI 컴퓨팅 인프라의 영향

Memphis에 위치한 SpaceXAI의 컴퓨팅 센터 장애로 인해 Grok 및 여러 다른 프론티어 AI 모델의 서비스가 중단되었으며, 이는 업계의 중앙 집중식 컴퓨팅 인프라에 대한 의존성을 강조합니다.

303

OpenAI GPT-6 Astra 출시 및 사이버 보안 안전장치

OpenAI는 2026년 9월에 GPT‑6 Astra의 출시를 시작했으며, 이 모델이 OpenAI의 새로운 "Critical" 사이버 보안 임계값에 도달했기 때문에 처음에는 제한된 파트너들에게만 제공되었다.

304

뉴욕시 교육국, 초등 및 중등학생을 위한 AI 사용 금지

뉴욕시 교육국은 2026-27 학년부터 약 60만 명의 초등 및 중등학생에게 AI 도구 사용을 금지할 예정이며, 발달적 우려와 젊은 학생 보호를 이유로 삼고 있다.

305

Meta Muse Spark 1.3 출시

Meta는 에이전트 워크플로우와 경쟁 코딩 성능에 최적화된 Muse Spark 1.3을 출시했으며, 학습용 데이터 사용 여부에 따른 계층형 가격 모델을 제공합니다.

306

Nvidia가 Hugging Face 인수

Nvidia는 개발자를 위한 오픈 모델 플랫폼을 확장하면서도 오픈 액세스 생태계를 유지하기 위해 Hugging Face를 129억 3030만 달러에 인수하기로 합의했다.

307

Gemini 3.8 Flash 및 3.8 Flash Cyber 릴리스 노트

Google는 장기적 소프트웨어 공학, 사이버보안 취약점 탐지, 다단계 추론에서 큰 향상을 이룬 Gemini 3.8 Flash와 3.8 Flash Cyber를 출시했으며, 3.7 Flash와 동일한 비용으로 제공됩니다.

308

Perplexity AI 그라운딩 분석: 조작된 출처와 AI 생성 구매 가이드

Perplexity AI의 인용에 대한 연구에 따르면 소프트웨어 추천의 83.2%가 순위가 낮거나 순위가 없는 도메인에 근거하고 있으며, 여기에는 AI 검색을 위해 특별히 215,000개 이상의 기계 생성 '최고의 소프트웨어' 페이지를 만들어낸 세 사이트의 네트워크가 포함되어 있습니다.

309

Mistral AI 데이터 훈련 참여 거부 정책

Mistral AI는 대부분의 사용자에게 기본적으로 사용자 입력 및 출력 데이터를 훈련에 사용하며, 비기업 사용자는 참여 거부 기능을 제공하고 기업 고객은 기본적으로 훈련 참여에서 제외됩니다.

310

Fable 5.1 월드 모델링: 실제 세계 장소의 자율적 3D 재구성

PhiloLabs는 Three.js와 오픈 데이터를 사용하여 실제 세계 장소의 브라우저 네이티브 3D 재구성을 자율적으로 조사, 모델링 및 검증하기 위해 Claude Fable 5.1 에이전트 스웜을 사용합니다.

311

FrontierHarness Eval: AI 코딩 하네스 벤치마킹

FrontierHarness Eval은 동일한 모델을 서로 다른 코딩 하네스에서 사용할 경우 통과율이 50%에서 66.7%로 달라질 수 있으며, 비용은 최대 17배까지 차이가 날 수 있음을 보여줍니다.

312

AI × Crypto 라운드업: 에이전트 결제, 탈중앙화된 컴퓨팅, 검증 가능한 AI 인프라

AI 에이전트는 이제 체인 내에서 거래하고, 탈중앙화된 컴퓨팅에 접근하며, 검증 가능한 신원과 제로지식 증명을 사용하여 초기 AI 기반 경제를 구축하고 있습니다.

313

AI 및 프론티어 기술 뉴스 요약: GPT-6 아스트라 출시, 에이전트 워크플로우, 로봇 기술의 성장세

OpenAI의 GPT-6 아스트라 출시는 기록적인 벤치마크 성능, 새로운 에이전트 워크플로우, 보안 우려를 불러일으켰으며, 더 넓은 프론티어 생태계는 오픈소스 추론 스택, AI 기반 로봇 기술, 새로운 모델 생태계의 급속한 발전을 보이고 있다.

314

ChatGPT 404 장애: 원인, 영향 및 커뮤니티의 통찰

ChatGPT와 여러 다른 LLM 서비스가 404 오류를 반환하며 공유 인프라 장애의 가능성을 드러내며 개발자 커뮤니티에서 광범위한 추측을 유발했다.

315

Quasar 438B 출시: 유럽 최고 점수의 추론 모델

Multiverse Computing은 기업용 에이전트 및 코딩을 위해 설계된 추론 모델인 Quasar 438B를 출시했습니다. 이 모델은 Artificial Analysis Intelligence Index에서 유럽 모델 중 가장 높은 점수를 기록했습니다.

316

Anthropic Claude는 페르마의 마지막 정리를 자동 형식화한다

Anthropic는 Claude 모델이 11일 만에 페르마의 마지막 정리에 대한 첫 번째 완전한 컴퓨터 검증 증명을 생성했다고 발표하며, AI가 Lean을 사용해 깊이 있는 수학을 자율적으로 형식화할 수 있음을 보여주었다.

317

Compute Cheap H100/H200 GPU 클라우드 가격을 시간당 $2.04와 $3.00에 제공

Compute Cheap는 H100 GPU를 시간당 $2.038, H200 GPU를 시간당 $2.995에 제공하며, 비활성 자원을 활용하고 최소한의 서비스 스택을 갖춘 레이어로 세계에서 가장 저렴한 GPU 클라우드로 자리매김하고 있다.

318

AISLE AI, OpenAI와 Anthropic이 0개를 발견한 후 curl CVE 6개 발견

AISLE의 자율 AI 시스템은 OpenAI Codex Security와 Anthropic Mythos가 놓친 curl 8.22.0의 6개 저심각도 CVE를 식별했습니다.

319

M4 Pro Mac Mini에서의 로컬 LLM 설정

48GB RAM, oMLX, Tailscale을 사용하여 여러 기기에서 프라이빗하고 비용 예측이 가능한 AI를 제공하기 위한 M4 Pro Mac Mini 기반 로컬 LLM 서버 운영 가이드입니다.

320

애플, OpenAI 영업비밀 소송에서 포렌식 맥북 증거 제출

애플은 2026년 8월 31일 봉인된 보충 소장을 제출하여 전 직원의 맥북에서 나온 포렌식 데이터를 공개했는데, 이는 해당 직원이 OpenAI에서 애플의 전력 변환기 회로 설계를 사용했고 증거를 파괴하려 시도했음을 증명하며, 이로 인해 애플은 신속한 증거개시를 신청하게 되었다.

321

Claude Fable 5.1 및 Claude Mythos 5.1 릴리스 노트

Anthropic는 캐시 읽기 비용을 크게 절감하고, 과학 연구 능력을 강화하며, 데이터 프라이버시를 위한 새로운 기업용 최전방 보호 기능(EFS)을 도입한 Claude Fable 5.1과 Claude Mythos 5.1을 출시했습니다.

322

앤트로픽, C2PA 메타데이터를 사용한 클로드 파일 출처 검사기 출시

앤트로픽의 새로운 클로드 파일 검사기는 이미지, 비디오, 오디오 파일의 C2PA 메타데이터를 읽어 클로드가 파일을 생성하거나 처리했는지 여부를 밝혀내며, AI 생성 콘텐츠의 투명성 향상에 기여합니다.

323

OpenAI ChatGPT 데스크톱 앱에 LibreOffice 포함 – 그 의미는?

ChatGPT 데스크톱 앱에는 완전한 LibreOffice 설치가 포함되어 있으며, 이는 큰 바이너리 공간을 희생하더라도 로컬에서 복잡한 문서 형식을 지원하려는 OpenAI의 전략을 보여줍니다.

324

Ed Zitron AI 회의론자 예측: 정확성과 추론에 대한 팩트체크

Ed Zitron의 2024-2025년 AI 회의론자 예측은 압도적으로 틀렸으며, 그의 추론은 탄탄한 분석이 아닌 잘못 해석된 숫자와 분노에 찬 수사학에 의존합니다.

325

LLM 추론의 효율적 경계: 트레이드오프와 경계 확장 기법

Baseten의 게시물은 추론 엔지니어가 지연 시간-처리량 트레이드오프 곡선을 따라 움직이거나 배치 크기, 병렬화, 양자화, 커널 최적화, 사전 추론, 분리 기법을 통해 전체 경계를 외부로 밀어내는 방법을 설명합니다.

326

Nori Robotics A3: 개발을 위한 저가의 이지능 로봇

Nori Robotics는 1,688달러에 가정 작업 자동화와 개발자 실험을 위한 이지능 로봇 NORI A3를 출시했으며, 2026년 가을에 출하될 예정이다.

327

Google DeepMind WeatherNext 3 출시

Google DeepMind는 실시간 위성 데이터와 시간 단위의 업데이트를 활용하여 고해상도 예보를 제공하는 글로벌 기상 AI 모델 WeatherNext 3를 출시했습니다. 이는 강수량 예측 정확도와 국지적 예측을 크게 향상시켰습니다.

328

Martin von Zweigbergk가 East River Source Control의 CTO로 합류

Jujutsu 버전 관리 시스템의 창시자인 Martin von Zweigbergk가 East River Source Control의 CTO로 합류하며, Git을 넘어서는 차세대 VCS 인프라 구축을 위한 움직임을 나타낸다.

329

OpenAI Daybreak for Frontline Defenders Initiative

OpenAI는 물, 전기, 은행과 같은 필수 서비스를 보호하기 위해 최첨단 AI 사이버 모델과 교육에 대한 보조금 지원 액세스를 제공하는 10억 달러 규모의 글로벌 이니셔티브인 Daybreak for Frontline Defenders를 출시했습니다.

330

NeoMME: 효율적인 멀티모달 네이티브 및 다국어 인코더

Hugging Face는 텍스트와 이미지를 처음부터 처리하기 위해 단일 양방향 Transformer를 사용하는 멀티모달 인코더 제품군(260M 및 800M 파라미터)인 NeoMME를 소개했습니다. 이는 시각적 문서 검색을 최적화합니다.

331

Dwarf Fortress 개발자 Tarn Adams, AI와 정리해고가 게임 산업을 파괴하고 있다고 말함

Dwarf Fortress 공동 개발자인 Tarn Adams는 2026년 게임컴에서 생성형 AI의 과도한 기대와 정리해고를 주도하는 경영진들이 게임 산업을 붕괴로 몰고 가고 있다고 경고했다.

332

slotstream: 48GB Mac에서 104GB Qwen3.8-Flash-Next 실행하기

slotstream은 전문가(experts)를 SSD에서 RAM으로 스트리밍하여 Apple Silicon Mac에서 104GB Qwen3.8-Flash-Next 모델을 실행할 수 있게 해주는 Swift 기반 도구로, 48GB 하드웨어에서 최대 12 tokens/s의 속도를 달성합니다.

333

GPT-6 Astra: Legora 재무제표 검토 성능

Legora는 GPT-6 Astra를 활용하여 41개의 문서에 걸친 재무제표 대조를 몇 분 만에 자동화했으며, Legora Benchmark for Agentic Reasoning을 통해 이 특정 워크플로우에서 거의 40%의 성능 향상을 달성했습니다.

334

OpenAI GPT-6 Astra가 Playco의 Playbot을 구동하여 수동 수정 작업을 50% 단축합니다

OpenAI는 Playco가 자사의 Playbot IDE에서 GPT-6 Astra를 사용하여 게임 프로토타이핑 시 수동 수정을 절반으로 줄이고, 여러 플레이 가능한 월드를 신속하게 생성할 수 있다고 발표했습니다.

335

인공 신경망의 부상하는 상징적 구조 (arXiv 2608.29530) – 주요 발견과 함의

이 논문은 소규모 신경망과 대규모 언어 모델의 내부 벡터 표현이 닫힌 형태의 상징적 구조로 근사될 수 있음을 보여주며, 분석적 정제와 타겟팅된 행동 수정을 가능하게 한다.

336

Weedout: AI 라벨이 지정된 YouTube 콘텐츠를 필터링하는 Safari 확장 프로그램

Weedout은 AI 생성 콘텐츠의 혼란을 줄이기 위해 YouTube 피드, 검색 결과 및 Shorts에서 "Made with AI"로 라벨링된 영상을 제거하는 macOS Safari 확장 프로그램입니다.

337

GPT-6 Astra 릴리스 노트 / 새로 추가된 기능

OpenAI는 최고 수준의 컴퓨터 사용, 고도의 과학적 추론, 그리고 일치성과 사이버 보안 기능에서 큰 향상을 보이는 GPT-6 Astra를 출시했습니다.

338

OpenAI Astra 핵심 사이버보안 능력 및 전면적 안전 장치

OpenAI는 Astra 모델이 핵심 사이버보안 능력 기준을 충족했으며, 안전한 배포를 위해 강화된 안전 장치를 상세히 공개했다.

339

mdlARC: 테스트 시점에서의 고 샘플 효율성으로 ARC-AGI-1에서 44% 달성

테스트 시점에서 처음부터 학습된 소규모 트랜스포머 모델이 67센트의 계산 비용으로 ARC-AGI-1 벤치마크에서 44%를 달성했으며, 이는 거대한 LLM이나 합성 데이터 없이도 추상적 추론 과제에서 높은 성능을 달성할 수 있음을 보여준다.

340

GPU 월드: 보편적인 프론티어 AI의 미래를 탐구하기

GPU 월드는 2040년에 모든 인간이 B300 GPU의 컴퓨팅 능력과 프론티어 LLM에 접근할 수 있지만, AI 지능은 정체된 상태라는 상황을 상상해보는 스토리 공모전입니다.

341

E-Commerce Bench는 장기적 전자상거래 운영에서 LLM 에이전트를 평가한다

Qwen는 일년간의 시뮬레이션을 통해 LLM 에이전트가 온라인 상점을 운영하는 능력을 다차원적으로 평가하는 결정론적 벤치마크인 E-Commerce Bench를 공개하여, 수익, 협상, 사기 회피, 효율성, 학습 측면에서 큰 격차가 있음을 드러냈다.

342

AI × Crypto 라운드업: 에이전트 결제, 탈중앙화된 컴퓨팅, 토큰화된 에이전트, 검증 가능한 AI

AI 에이전트는 블록체인 기반 결제 연결, 탈중앙화된 컴퓨팅 계층, 토큰화된 신원, 제로지식 검증을 갖추며 기계 기반 경제를 위한 기반을 마련하고 있습니다.

343

AI 및 선도 기술 뉴스 요약 – Muse Spark 1.3, Gemini 3.8 Flash, Qwen 3.8, 로봇 기술 발전

메타의 Muse Spark 1.3, 구글의 Gemini 3.8 Flash, Qwen 3.8 업데이트, 그리고 새로운 로봇 AI 데모가 최신 AI 전면 뉴스를 주도하고 있습니다.

344

Atlas: 공간 지능을 위한 월드 모델

World Labs는 고해상도 3D 재구성, 카메라 제어 비디오 생성, 로봇 공학 시뮬레이션을 위한 다중 모달 자동 회귀 확산 트랜스포머인 Atlas를 소개합니다.

345

Qwen-Drive-1.0 릴리스 노트 / 새로운 기능

Qwen-Drive-1.0은 핵심 VLM 아키텍처를 변경하지 않고 3D 인식, 시각 질문 응답 및 모션 플래닝을 통합하는 자율주행용 비전-언어 파운데이션 모델입니다.

346

TRL과 OpenEnv를 사용하여 코딩 모델로 수채화를 그리는 방법

Hugging Face는 TRL과 OpenEnv를 사용하여 코딩 모델이 JavaScript를 통해 수채화를 생성하도록 훈련하는 방법을 보여줍니다. 이는 미적 선호도에 대한 강화학습을 기반으로 합니다.

347

funes: 코드 에이전트를 위한 내구성 있는 메모리 계층

Hugging Face는 코드 에이전트 세션 추적을 인덱싱하고, 런타임, 머신, 모델 간에 원시 증거를 기억할 수 있도록 해주는 단일 바이너리로 로컬에서 실행되는 메모리 계층인 funes를 발표했습니다.

348

LFM2.5-350M GRPO 미세조정이 IFStruct 점수를 29.7%로 끌어올림

그룹 상대 정책 최적화(GRPO)를 사용해 350M 파라미터 LFM2.5 모델을 단지 100단계만 미세조정하면 IFStruct 벤치마크 점수가 22.6%에서 29.7%로 상승하며, 저비용의 특정 작업용 보상 학습이 구조화된 출력 준수성을 크게 향상시킬 수 있음을 보여줍니다.

349

OpenAI GPT-6 Astra 보안 개요

OpenAI는 사이버보안 능력에서 '중요' 수준에 도달한 GPT-6 Astra를 공개했으며, 이는 GPT-5.6 Sol에 비해 고도화된 일치성과 강건성 개선을 포함한다.

350

AI와 소프트웨어 생산성의 환상

생성형 AI가 소프트웨어 품질을 반드시 개선하지 않으면서도 코드 생산을 가속화하여, 기술적 전문 지식과 보안에 있어 위험한 격차를 줄 수 있다는 비판적 분석.