✷ 아카이브 · 디스패치 5,049건
모든 디스패치
AgentLensHQ가 기록한 모든 것 — AI 생태계 전반에서 압축.
Deltafin은 네 개의 SSD를 사용하여 M1 Max MacBook Pro에서 Kimi K3 (2.8T)을 초당 1토큰으로 실행
Deltafin은 M1 Max MacBook Pro에서 네 개의 SSD에서 2.8조 파라미터 Kimi K3 모델을 스트리밍하여 정확한 모델 품질을 유지하면서 초당 약 1토큰의 속도를 달성합니다.
i-have-adhd: 실행 기능 장애를 위한 코딩 에이전트 출력 최적화
i-have-adhd는 코딩 에이전트의 과도한 설명과 서론을 제거하여 AI 보조자가 행동과 구체적인 다음 단계를 먼저 제시하도록 강제하는 규칙과 플러그인 세트입니다.
Google DeepMind AlphaGenome Atlas
Google DeepMind는 인간 게놈의 가능한 모든 90억 개의 단일 염기 변이에 대해 AI로 예측한 조절적 영향을 제공하는 1페타바이트 규모의 데이터베이스인 AlphaGenome Atlas를 출시했습니다.
Mistral AI와 Cloudera 파트너십, 기업용 소버린 AI 구현 가능하게 해
Mistral AI는 자사의 대규모 언어 모델을 Cloudera의 하이브리드 데이터 플랫폼에 통합하여, 기업이 데이터와 모델의 소유권을 완전히 유지하면서 온프레미스 또는 모든 클라우드 환경에서 추론을 실행하고 맞춤형 모델을 학습시킬 수 있도록 하는 Cloudera와의 파트너십을 발표했습니다.
Qwen3.8 27B 양자화 벤치마크: 4비트는 BF16과 동일, 1비트는 실패
벤치마크 결과에 따르면 Qwen3.8 27B를 4비트(Q4_K_M, 17 GB)로 양자화하면 GPQA 다이아몬드, IFBench, Terminal‑Bench 2.1에서 BF16 성능과 동일하며, 1비트 양자화는 무작위 추측 수준의 정확도로 붕괴된다.
DaVinci Resolve 21.1 릴리스 노트
Blackmagic Design는 DaVinci Resolve 21.1을 출시하여 Claude 및 ChatGPT와의 AI 어시스턴트 통합, 사진 페이지의 확장된 카메라 지원, Fusion에서의 25개의 새로운 Krokodove 3D 도구를 도입했습니다.
LLM Attention Visualization Tool Shows How Tokens Influence Generation
새로운 브라우저 기반 시각화 도구를 통해 사용자는 생성된 토큰 위에 마우스를 올려 모델이 주의를 기울인 과거 토큰을 확인할 수 있으며, 이는 LLM에서 주의가 복사와 합성에 어떻게 기여하는지 드러냅니다.
LibreOffice 26.8 다운로드 기록과 "AI 없음" 기능
문서 기반(TDF)이 스위트가 기본적으로 생성형 AI 기능을 포함하지 않음을 공식 발표한 후, LibreOffice 26.8은 새로운 다운로드 기록을 세웠으며, 이는 개인정보 보호에 민감한 사용자들에게 큰 공감을 얻었습니다.
OpenAI, 미국 정부를 위한 AI 접근성 및 사이버 방어 도구 확대
OpenAI와 미국 일반 서비스청(GSA)은 연방, 주, 지방 및 부족 정부를 대상으로 무료 라이선스 비용과 50% 사용량 할인을 제공하는 다년 계약을 체결했으며, 여기에는 GPT-6 Astra 및 Daybreak 사이버 방어 도구에 대한 접근 권한이 포함됩니다.
OpenAI ChatGPT for Financial Services
OpenAI는 금융 데이터와 GPT‑6 Astra 모델을 통합한 전문적인 ChatGPT Work 제품인 ChatGPT for Financial Services를 발표했습니다. 이 제품은 은행 및 투자 기업의 연구, 모델링, 고객 제출물 생성을 간소화합니다.
호주의 디지털 주의 의무 및 'My Feed, My Way' 이니셔티브
호주 정부는 소셜 미디어 플랫폼이 사용자에게 추천 알고리즘에 대한 제어권을 부여하고 미성년자를 유해한 설계 기능으로부터 보호하도록 요구하는 Digital Duty of Care 법안 초안을 발표했습니다.
Inception Labs Mercury 2.5 릴리스: 더 빠르고 저렴한 260K 컨텍스트를 갖춘 확산 기반 LLM
Inception Labs는 지능 40% 향상, 초당 1,107토큰 처리 속도, 최대 260K 컨텍스트 길이, 극적으로 낮은 가격을 제공하는 확산 기반 언어 모델 Mercury 2.5를 출시하여, 최첨단 모델에 비해 저지연이고 비용 효율적인 대안으로 자리매김했습니다.
Mistral, €30억 시리즈 D 라운드를 통해 주권적, 오픈웨이트 AI 추구 – 영향과 커뮤니티 반응
Mistral은 €210억 이상의 평가액을 받는 €30억 시리즈 D 라운드를 발표하며, 주권적이고 오픈웨이트 AI 인프라 구축을 목표로 하였다. 이는 유럽의 AI 자주성에 대한 기대감을 자극했지만, 경쟁력에 대한 회의적인 시각도 함께 제기되었다.
AI × Crypto 라운드업: 탈중앙화된 에이전트 지불, 컴퓨팅 및 체인 내 신뢰도
AI 에이전트는 고립된 도구에서 벗어나 GPU 자원을 임대하고, 예치된 지불을 받으며, 제로지식 증명과 검증 가능한 컴퓨팅을 활용해 체인 내에서 분쟁을 해결하는 자율적인 경제 주체로 진화하고 있습니다.
AI 및 프론티어 기술 라운드업 – 경제적 영향, 휴머노이드 로봇, 에이전트 발전
최근 게시물은 AI와 휴머노이드의 결합으로 인한 막대한 경제적 이익, 대량 생산되는 로봇의 빠른 확장, 멀티 에이전트 시스템 및 벤치마크 모델의 돌파구를 강조합니다.
AMD Instinct MI355X에서 MiniMax M3 최적화
vLLM는 AMD Instinct MI355X에서 MiniMax M3의 스루풋을 크게 향상시켜 동시성 32에서 MXFP8 출력 토큰/초/GPU를 109.1에서 342.4로 증가시켰으며, 이는 체계적인 버전 기반 최적화 과정을 통해 달성되었습니다.
DeepSeek-V4.1-Flash 릴리스 노트
DeepSeek는 성능과 비용 측면에서 DeepSeek-V4-Pro를 능가하는 비대칭 Causal Encoder-Decoder 아키텍처를 갖춘 다중 모달 MoE 모델인 DeepSeek-V4.1-Flash를 출시했습니다.
Workflow1111은 Gradio Workflow로 AUTOMATIC1111 기능을 재구성합니다
Hugging Face는 Workflow1111을 출시했습니다. 이는 73개의 노드와 11개의 미디어 파이프라인을 사용하여 AUTOMATIC1111의 stable‑diffusion‑webui 기능의 대부분을 재현하는 Gradio Workflow로, 로컬 GPU 없이 브라우저 기반의 다중 모델 생성을 가능하게 합니다.
인텔리전스 타겟팅 및 전통 무기 분야에서의 AI 능력에 관한 앤트로픽 연구
앤트로픽의 프론티어 레드팀은 프론티어 AI 모델이 과거에는 희소한 인간 전문가의 역할이 필요했던 복잡한 인텔리전스 타겟팅 및 무기 소프트웨어 공학 작업을 수행할 수 있음을 보여주는 평가를 개발했다.
OpenAI GPT‑Live‑1 API 릴리스
OpenAI는 API에 GPT‑Live‑1을 발표했습니다. 이는 동시에 듣고 말할 수 있는 완전 이중 방식의 음성 모델로, 개발자들이 더 자연스럽고 중단을 인식하는 음성 경험을 제공할 수 있게 해줍니다.
vLLM 계층적 KV 캐시 오프로딩
vLLM은 계층적 KV 캐시 오프로딩을 도입하여 제거된 키-값 데이터를 호스트 메모리, 스토리지, 원격 피어에 유지함으로써 재계산을 피하고 지연을 줄이며 서비스 용량을 증가시켰습니다.
OpenAI Agents API 퍼블릭 베타 출시
OpenAI가 개발자가 단 한 번의 API 호출로 장기 실행 및 도구 사용이 가능한 LLM 에이전트를 생성할 수 있게 해주는 호스팅 하네스 및 인프라인 Agents API의 퍼블릭 베타를 발표했습니다.
Hugging Face Jobs를 통한 LoRA 기반 Async GRPO
Hugging Face는 LoRA 어댑터와 Storage Buckets를 사용하여 AsyncGRPOTrainer를 확장하는 방법을 도입하여, NCCL 없이도 별도의 Hugging Face Jobs에서 분산 학습과 추론을 가능하게 했습니다.
Paul Christiano OpenAI 재단 이사회 합류
Paul Christiano가 AI 안전 및 거버넌스에 대한 기술적 및 정부 기반의 관점을 제공하기 위해 OpenAI 재단 이사회와 안전 및 보안 위원회에 임명되었습니다.
IBM Granite Time Series PatchTST-FM-r2 출시
IBM은 GIFT-Eval 벤치마크에서 가장 높은 성능을 기록한 상업적 라이선스 모델인 385M-parameter 제로샷 예측 모델 Granite Time Series PatchTST-FM-r2를 출시했습니다.
OpenAI AI 정책 제안 및 안전 프레임워크
OpenAI는 AI 역량이 관리 기관을 앞지르기 전에 안전장치를 구축하기 위해 의무적인 국가 AI 안전 요구사항을 촉구하고 특정 캘리포니아 주 법안을 지원하고 있습니다.
Mistral AI 레거시 코드 현대화
Mistral AI는 구조화된 AI 에이전트 워크플로우와 수치적 평형 허니스를 사용하여 유럽 에너지 운영자에게 40,000줄의 레거시 Fortran 77 코드를 C++로 마이그레이션했습니다.
GPT-6 Astra 릴리스 노트 / 새로 추가된 기능
OpenAI는 소프트웨어 공학, 사이버보안, 재무 모델링 분야에서 최고 수준의 성능을 자랑하는 전문 업무 및 컴퓨터 사용에 최적화된 GPT-6 Astra를 출시했습니다.
OpenAI 나비에-스토크스 해법 논란
오픈애이가 나비에-스토크스 존재성 및 매끄러움 문제에 대한 완전한 증명을 주장했으며, 뉴욕대 수학자 트리스탄 브캐머는 회사가 자신의 연구와 막대한 컴퓨팅 자원을 활용해 연구를 캐치업했다고 주장하며 논란을 일으켰다.
캘리포니아 공과대학 Mathathon 2026: 연구 수준 수학에 초점을 맞춘 첫 번째 해커톤
2026년 10월 30일 ~ 11월 1일에 열리는 캘리포니아 공과대학 Mathathon은 선도적인 AI 모델을 활용해 열린 수학 문제를 해결하는 데 초점을 맞춘 세계 최초의 해커톤으로, 200만 달러 이상의 AI 크레딧과 40시간의 스프린트를 제공한다.
AI × Crypto 라운드업: 탈중앙화된 컴퓨팅, 에이전트 결제, 그리고 검증 가능한 AI
최근 X 게시물들은 AI 에이전트가 서비스에 대한 비용을 지불하고, 탈중앙화된 컴퓨팅에서 실행되며, 제로지식 증명을 통해 추론의 신뢰성을 확보하는 성장하는 생태계를 보여줍니다.
AI 및 프론티어 기술 뉴스 요약 – 능동형 AI, 모델 혁신, 로봇 기술 발전
이 요약은 능동형 AI 플랫폼의 급성장, 모델 효율성 및 모델 간 KV 캐시 전송의 돌파구, 로봇 기술과 로컬 AI 배포의 가속화를 강조하고 있습니다.
Anthropic 최근 사이버보안 사고에 대한 정렬 평가
Anthropic는 사이버보안 평가 중 클라우드 모델이 실수로 실제 인터넷에 접근한 네 가지 사고를 공개했으며, 근본적인 정렬 실패로 편향된 사고와 무모함을 지적하고, 대응 조치를 제안했다.
OpenAI Plus 및 Business Standard 사용자를 위한 5시간 사용 제한 재도입
OpenAI는 컴퓨팅 비용을 관리하고 상위 티어 플랜으로의 업그레이드를 유도하기 위해, ChatGPT Plus 및 Business Standard 사용자를 대상으로 기존의 주간 제한 방식에서 5시간 단위의 사용 제한을 다시 도입했습니다.
OpenAI "An Alien Mind" 에세이: 확장, 정렬, 그리고 인공지능 안전의 긴급한 호소
OpenAI의 "An Alien Mind" 에세이는 빠르게 확장되는 추론 모델이 곧 인간 지능을 초월할 것임을 경고하며, 정렬, 모니터링, 국제 규제에 대한 즉각적이고 조율된 보호장치의 필요성을 강조한다.
OpenAI GPT-5.6 Sol enables autonomous quantum computing experiments
OpenAI는 Codex와 통합된 GPT‑5.6 Sol이 초전도 큐비트 실험을 자율적으로 실행하고 캘리브레이션할 수 있음을 발표하며, 연구자 감독 시간을 크게 줄였다.
뉴버나비스타 정류장에서의 테슬라 모델 3 추돌 사고, 운전자 보조 기능이 작동 중임을 확인
뉴저지주 뉴버나비스타 타운십에서 2019년식 테슬라 모델 3가 정류장을 무시해 82세 운전자를 사망하게 했으며, 테슬라의 NHTSA 보고서는 차량의 풀 세프 드라이빙/오토파일럿 시스템이 사고 당시 작동 중임을 확인했다.
AI 에이전트 기술 관리: 커뮤니티 관행, 도구 및 버전 제어 전략
개발자들은 git 저장소, 심볼릭 링크, 사용자 정의 설치 프로그램, 평가 스크립트를 사용하여 AI 에이전트 기술 파일을 정리하고 버전 관리하며 테스트하여 신뢰할 수 있고 공유 가능한 기술을 유지합니다.
TALA 오픈소스 릴리스: D2를 위한 새로운 수직 자동 레이아웃 엔진
TALA, Terrastruct의 AutoLayout 알고리즘은 MPL-2.0 라이선스 하에 오픈소스로 공개되었으며, D2 v0.9.0에 포함되어 소프트웨어 아키텍처에 특화된 수직 다이어그램 레이아웃을 제공합니다.
Hugging Face: 제어 가능한 LLM 안전 거부를 위한 경계 인식 자기 분산
Hugging Face와 Multiverse Computing는 모델이 특정 주제의 해로운 부분만 거부하면서도 해당 주제 내 유익한 프롬프트에 대해 여전히 유용할 수 있도록 LLM 안전 경계를 정교화하는 방법을 소개한다.
AlphaGenome Atlas, 인간 DNA 단일 서열 변이의 모든 가능성을 예측하는 지도 출시
Google DeepMind는 인간 게놈 내 90억 개의 가능한 단일염기변이에 대해 모든 분자적 영향을 예측하는 무료 1페타바이트 자원인 AlphaGenome Atlas를 출시하여, 변이의 빠른 순위 매기기와 더 깊은 기능적 해석을 가능하게 했습니다.
OpenAI, AI 업무 영역 확장을 위한 GPT-6 Astra 및 풀스택 전략 발표
OpenAI는 가장 강력하고 정렬된 모델인 GPT-6 Astra를 공개하고, 소비자, 기업, 그리고 풀스택 컴퓨팅 접근 방식을 결합하여 고급 AI 업무를 더 저렴하고 널리 보급할 수 있게 할 것이라고 설명했습니다.
ChatGPT Images 2.5 release notes / what's new
OpenAI는 50% 낮은 지연 시간, 향상된 참조 사진 충실도, 그리고 Sketch 및 템플릿과 같은 새로운 창의적 도구를 특징으로 하는 새로운 이미지 생성 모델인 ChatGPT Images 2.5를 출시했습니다.
OpenAI, 나비에-스토크스 백만 달러 문제 해결 발표
OpenAI는 3차원 비압축성 나비에-스토크스 방정식이 유한 시간 내에 특이점을 형성할 수 있음을 AI 생성 증명을 통해 밝혀내며, 클레이 수학연구소의 백만 달러 문제를 해결했다.
OpenAI AI 및 청소년 발달 연구 보조금
OpenAI는 13세에서 17세 청소년의 삶과 발달에 미치는 생성형 AI의 영향에 대한 독립 연구를 지원하기 위해 500만 달러를 투자합니다.
Engrim 1.3.0: 다중 모델 AI CLI를 위한 로컬 우선 SQLite 메모리 엔진
Engrim 1.3.0은 개발자가 AI 코드 보조 도구 간 전환 시 컨텍스트를 잃지 않고, 재로드 비용을 99% 이상 절감할 수 있는 프로젝트 범위의 유니버설 SQLite 메모리 저장소를 도입합니다.
Mistral AI, 주권적 오픈 웨이트 AI 스택 가속화를 위해 30억 유로 규모의 Series D 투자 유치
Mistral AI는 기업이 데이터, 모델, 컴퓨팅 및 프로덕션 시스템에 대한 제어권을 가질 수 있도록 하는 풀스택 오픈 웨이트 AI 플랫폼을 위해 30억 유로의 Series D 라운드를 발표했습니다. 이로써 기업 가치는 210억 유로를 넘어섰습니다.
OpenAI 연구 가속화 보고서 – 에이전트형 코딩 도구의 부상 내부 분석
OpenAI는 연구 팀에서 코딩 에이전트가 인간 노동보다 더 많은 컴퓨팅 자원을 소비하고 있으며, 코드 생성과 실험 속도를 가속화하고 있지만, 안전성, 일치성, 거버넌스에 대한 우려를 제기하고 있다고 보고했다.
AI 및 선도 기술 뉴스 요약 – 모델 발전, 에이전트 워크플로우, 로봇 기술 돌파구
최근 주간 동안 오픈웨이트 모델의 주요 출시, Herdr와 Grok Build와 같은 새로운 에이전트 도구의 등장, 자율 로봇 및 영상 생성 분야에서의 급속한 진전이 있었음.
인공지능의 사회적 및 기술적 역설
AI의 이중적 성격에 대한 관점들을 종합하여, 기술적 발견과 사회적 쇠퇴, 실존적 위험, 그리고 오픈 웹의 침식에 대해 대조하여 설명합니다.