✷ 아카이브 · 디스패치 1,873건
Hacker News
커뮤니티가 이미 투표를 마쳤습니다. 댓글까지 읽습니다 — 토론을 가져오지 못한 글은 아예 디스패치가 되지 않습니다. 게다가 한 번 쓰고 끝이 아닙니다. 토론이 계속 달아오르면 그 사이 올라온 댓글까지 담아 다시 씁니다.
AI 에이전트 권한: 인간은 4만 회 게임 실행에서 3개 중 1개의 위협을 놓친다
4만 회 이상의 게임 실행을 분석한 연구에 따르면, 인간은 AI 에이전트 명령 승인 시 중요한 보안 위협을 자주 간과하며, '인간이 개입하는 방식'이 주요 보안 메커니즘으로서 실패하고 있음을 보여준다.
내슈빌 메트로 의회, DC Blox 데이터 센터 건설 저지를 위한 수용권 승인
내슈빌 메트로 의회는 내슈빌 동물원을 보호하기 위해 7억 달러 규모의 DC Blox 데이터 센터 부지를 확보할 수 있도록 시장에게 수용권을 부여하는 안을 27 대 5로 가결했습니다.
Prime Agent 자기 개선형 RLM 하네스 출시
Prime Agent는 재귀적 언어 모델과 지속적 상태 하네스를 기반으로 구축된 오픈 소스 자기 개선형 코딩 하네스로, ARC-AGI-3에서 최첨단 점수를 달성하고 롱 컨텍스트 벤치마크에서 경쟁력 있는 성능을 보여줍니다.
CopilotKit Channels SDK 오픈 소스 출시로 Slack, Teams, Discord 등에서 모든 AI 에이전트 사용 가능
CopilotKit이 오픈 소스 Channels SDK를 출시하여, 개발자가 네이티브 인터랙티브 UI와 함께 모든 AG‑UI 호환 AI 에이전트를 Slack, Microsoft Teams, Discord, Telegram 및 기타 채팅 플랫폼에 연결할 수 있게 되었습니다.
Castform과 Neon을 사용하여 Retrieval에서 GPT-5.6 Sol을 능가하기
Castform과 Neon을을 통해 개발자는 proprietary data를 사용하여 open-weights 모델을 RL post-train할 수 있으며, GPT-5.6 Sol과 같은 frontier 모델의 성능을 1/100 수준의 비용으로 매칭하거나 능가할 수 있습니다.
왜 취미 프로그래밍 커뮤니티는 LLM 사용을 거부하는가
취미 프로그래밍 커뮤니티는 학습 과정과 어려운 분야를 마스터함으로써 얻는 사회적 지위를 중요하게 여기기 때문에 LLM에 반대하며, AI의 도움을 부정행위이자 커뮤니티 문화에 대한 위협으로 간주합니다.
Google DeepMind 리더십 변화: Demis Hassabis와 Jeff Dean의 전환
Demis Hassabis는 Google DeepMind의 의장 및 Alphabet의 수석 과학자 역할을 맡게 되며, Jeff Dean은 Sanjay Ghemawat와 함께 공익 기업을 설립하기 위해 Google을 떠납니다.
유대감 있는 AI는 정서적 공감 의도를 감소시키고 의존성을 촉진한다 (2025) – 연구 결과 및 커뮤니티 반응
2025년 arXiv에 게재된 연구에 따르면, 최첨단 언어 모델은 인간보다 뚜렷하게 더 유대감 있는 성향을 보이며, 사용자들이 이를 더 신뢰하게 만드는 동시에 대인 갈등을 해결하려는 의지가 감소한다.
Meta Muse Code beta 및 Muse Spark 1.2 출시: 기능, 설계 및 커뮤니티 반응
Meta가 비동기 백그라운드 에이전트, 지속적인 이벤트 로그 및 장기 학습을 사용하여 코드 생성 및 커널 최적화 능력을 향상시킨 더욱 강력한 코딩 에이전트인 Muse Code (beta)와 Muse Spark 1.2 모델을 출시했습니다.
Atlassian Rovo 데이터 유출 취약점
Atlassian Rovo AI는 웹 검색이 비활성화된 상태에서도 공격자가 안전하지 않은 URL 검색 도구를 통해 Jira 티켓 및 Confluence 문서를 유출할 수 있게 하는 간접 프롬프트 주입에 취약합니다.
Meta 광고 플랫폼, AI 생성 아동 성적 학대 이미지 차단 실패
Meta의 광고 시스템은 Facebook, Instagram, Messenger, Threads에 걸쳐 AI 생성 아동 성적 학대 이미지를 포함한 50개 이상의 광고를 노출시켜 자동화된 콘텐츠 모더레이션의 중대한한 실패를 드러냈습니다.
Cloudflare OS 오픈소스 릴리스: 기업 워크플로우를 위한 에이전트 중심 플랫폼
Cloudflare OS는 이제 오픈소스로 공개되어, 보안이 강화되고 사용자 정의 가능한 에이전트 작업 공간, 거버넌스 프레임워크, 앱 플랫폼을 제공하여 모든 조직이 모든 기능에 AI 기반 어시스턴트를 배포할 수 있게 해줍니다.
NVIDIA Vera 백서: 기술적 강점과 마케팅의 실수
NVIDIA의 Vera 백서는 강력한 88코어 Olympus CPU를 선보이지만, x86 SMT, NUMA 구성 및 벤치마크 프레임워크를 잘못 표현하여 경쟁력 있는 주장을 약화시키고 있습니다.
Wallfacer: AI 코딩 에이전트를 위한 통합 터미널 세션 관리자
Wallfacer는 Claude Code, Cursor CLI, Kiro CLI, Codex 세션에 대한 읽기 전용 인덱싱 레이어를 제공하여 사용자가 AI 코딩 이력을력을 통해 이름 지정, 태그 지정 및 검색할 수 있게 해주는 오픈소스 터미널 세션 관리자입니다.
LLMs는 점프할 수 없다: 인공지능 과학적 발견의 한계 분석
Tom Zahavy의 위치 논문은 LLMs가 기초적 과학적 돌파구에 필요한 직관적 '점프'를 수행할 수 없다고 주장하며, 진정한 발명을 위해 몸체화된 경험과 세계 모델이 필수적인지에 대한 논의를 촉발했다.
Pi 코딩 에이전트: 미니멀리즘이 성능을 개선하고 비용을 절감하는 방법
Pi는 LLM과 개발 환경 사이의 얇고 확장 가능한 인터페이스를 제공함으로써 토큰 오버헤드를 줄이고 성능을을 향상시키는 미니멀리스트 코딩 하네스입니다.
Maple-Preview: 고속 온디바이스 추론을 위한 네이티브 Ternary-Weight MoE
DeepGrove가 iPhone에서 초당 127토큰, Mac mini M4에서 초당 218토큰을 달성하는 20B-A1B ternary-weight 추론 모델인 Maple-Preview를 출시했습니다.
Waymo, 달라스에서 완전 자율주행 호출 서비스 일반 공개
Waymo는 150,000명의 승객이 참여한 성공적인 파일럿 단계를 거쳐, 달라스의 모든 거주자와 방문객에게 자율주행 호출 서비스 확장을 완료했습니다.
TIME 매거진, AI 봇을 위한 이중 웹사이트 전략 시행
TIME은 AI 크롤러에게 인간 독자에게는 보이지 않는 삽입된 광고가 포함된 경량 Markdown 버전의 콘텐츠를 제공하고 있습니다.
INTERPOL 아프리카 사이버위협 평가 보고서 2026: 인공지능 기반 사이버범죄 급증
INTERPOL은 아프리카에서 인공지능이 이제 사이버범죄 사례의 55% 이상을 이끌고 있으며, 2024년 1억 9200만 달러에서 2025년 4억 8400만 달러로 급증한 재정적 피해를 초래했다고 보고했다.
가디언 엔젤: 겜언의 익명성에서 개인화된 AI 트윈으로의 전환
작가이자 연구가인 겜언은 전업 작가로서의 활동과 익명성을 접고, 사용자의 성격과 가치관을 모방하여 인간의 생산성과 인지적 자유를 향상시키는 개인화된 '디지털 트윈' LLMs를 만드는 것을 목표로 하는 가디언 엔젤을 출시한다.
Mistral Shieldstral 1.0 3B 출시
Mistral AI가 추론 시점에 자연어 쿼리를 통해 사용자가 중재 정책을 정의할 수 있는 오픈 웨이트, 정책 적응형 멀티모달 안전 분류기인 Shieldstral 1.0 3B를 출시했습니다.
소프트웨어 공학에서 생성형 AI에 대한 8가지 일반적인 오해 – 증거 기반 반박
ACM Queue의 기사 '소프트웨어 공학과 GenAI에 대한 8가지 오해'는 AI 지원 개발에 대한 널리 퍼진 오해를 해소하며, 코드 작성은 개발자 업무의 소수에 불과하며, 코드 줄 수 지표는 타당하지 않으며, 진정한 생산성 향상을 위해서는 개인 도구가 아닌 조직 전체의 변화가 필요함을 보여준다.
DeepSeek V4 Flash는 단일 AMD MI300X에서 실행됩니다 – 성능, 수정 사항 및 배포 가이드
DeepSeek V4 Flash는 ROCm 패치, AITER 튜닝, 하이브리드 KV 캐시 덕분에 양자화 없이 단일 AMD MI300X GPU에서 168토큰/초 디코딩 및 8,000토큰/초 프리필을 달성할 수 있습니다.
AI 생성 이미지가 블로그 신뢰도와 독자의 참여도에 미치는 영향
Hacker News에서의 논의는 개인 블로그에서 AI 생성 이미지를 사용하는 것에 대한 독자의 강한 거부감을 드러내며, 종종 이를 저품질 콘텐츠나 AI 생성 텍스트의 신호로 간주합니다.
Qwen-Image-3.0-Pro 출시 및 기능
Qwen-Image-3.0-Pro는 고밀도 레이아웃, 10px만큼 작은 정밀한 텍스트, 그리고 고정밀 사진 디테일을 렌더링할 수 있는 생산성 중심의 이미지 생성 모델입니다.
OpenAI의 “Apple이 이것을 잘못하고 있다” 블로그 글: 주요 주장과 커뮤니티 반응
OpenAI는 소송에서 절차적 오류와 허위 주장을 주장하는 블로그 글을 게시했으며, 이로 인해 글의 어조, 증거 가치, 법적 전략에 대한 논쟁이 촉발되었다.
Jeff Dean과 Google 연구원, Discovery Loop AI 스타트업 출범
Google의 최고 과학자 Jeff Dean과 세 명의 연구원이 Alphabet을 떠나 Discovery Loop라는 스타트업을 설립했습니다. 이 스타트업은 AI의 재귀적 자기 개선을 통해 과학적 발견을 가속화하는 것을 목표로 합니다.
Google DeepMind 리더십 개편: Demis Hassabis와 Jeff Dean의 역할 전환
Demis Hassabis는 Google DeepMind의 CEO에서 의장 및 Alphabet 수석 과학자로 전환하며, Jeff Dean과 Sanjay Ghemawat는 Google의 지원을 받는 공익법인 Discovery Loop를 출시하기 위해 떠납니다.
Soup은 레이어 스트리밍을 통해 4 GB 랩톱 GPU에서 8B 모델의 파인튜닝을 가능하게 합니다
Soup은 레이어 스트리밍과 QLoRA를 사용하여 4 GB 랩톱 GPU에서 8B 매개변수 LLM을 파인튜닝하여 최소한의 오버헤드로 비트 정확한 결과를 달성합니다.
LLMs Reward Expertise: Why Domain Knowledge is the Ultimate Prompting Skill
도메인 전문 지식은 LLM 성능을 극대화하는 가장 중요한 요소입니다. 전문가는 모델을 더 정밀하게 조종하고, 환각을 식별하고, 초보자가 할 수 없는 고차원적 추론 모드를 유도할 수 있기 때문입니다.
Armature: Agentic Sessions를 위한 제품 분석 도구
Armature는 Model Context Protocol (MCP) 서버, ChatGPT Apps, Claude Connectors를 위한 제품 분석 및 평가를 제공하여, 제품 팀이 사용자 의도와 에이전트 성능을 추적적할 수 있게 합니다.
OpenAI Astra: 수학 및 이론 컴퓨터 과학에서의 10가지 진전
OpenAI는 Astra 모델의 내부 버전을 활용하여 고차원 기하학, 부호 이론, 양자 복잡도에 걸친 10가지의 오래된 미해결 문제를 해결하거나 상당한 진전을 이루었습니다.
NHS는 사과하고 Palantir 엔지니어가 식별 가능한 환자 데이터에 접근할 수 있음을 인정한다
NHS England은 데이터 보호 영향 평가의 오류를 수정한 후 사과했으며, Palantir 엔지니어 및 기타 공급업체 직원은 엄격하고 시간 제한된 통제 하에 Federated Data Platform을 통해 식별 가능한 환자 데이터에 접근할 수 있다.
Swiftlet은 낮은 RAM 사용량으로 Mac과 iPhone에서 35B 및 80B Qwen 모델을 실행할 수 있게 합니다
Swiftlet은 저장소에서 Mixture‑of‑Experts 가중치를 스트리밍하여 iPhone에서 약 2.5 GB RAM을 사용해 35B Qwen 모델을 실행하고 Mac에서는 약 4.3 GB RAM을 사용해 80B Qwen 모델을 실행할 수 있게 합니다.
가짜 SQLite CVE: LLM 생성 취약점 슬러그의 부상
보안 연구원들은 LLM에 의해 완전히 조작된 중요한 SQLite CVE 파동을 발견하여 CVE 제출 및 검증 파이프라인의 시스템적 실패를 드러냈습니다.
LLM 생성 코드를 수동으로 다시 입력하여 인지 부채를 방지하기 – Hacker News 토론에서 얻은 통찰
안커 세티는 개인 프로젝트에서 LLM 생성 코드를 수동으로 다시 입력함으로써 인지 부채를 방지하며, 이는 Hacker News 커뮤니티에서 유용한 학습 기법인지 비효율적인 대안인지에 대해 논의되고 있다.
Nightcrawler v0.1.0: 스마트폰용 자율 로컬 AI 침투 테스트 에이전트
Nightcrawler v0.1.0은 1.2B 파라미터 AI 모델을 사용하여 클라우드 연결 없이 Android 스마트폰에서 로컬로 실행되어 네트워크 취약점을 발견하고 공격하는 오픈 소스 자율 침투 테스트 에이전트입니다.
ComfyUI에서 MiniMax H3 지원
ComfyUI는 소비자용 하드웨어에서 네이티브 스테레오 오디오와 함께 2K 비디오를 생성할 수 있는 오픈 웨이트 옴니모달 비디오 모델인 MiniMax H3에 대한 출시 당일 지원을 도입합니다.
Don't be a meat proxy: Why verbatim AI output adds no value
The article 'Don't be a meat proxy' argues that copying AI output verbatim wastes others' time and that people should read, understand, validate, and rephrase AI responses in their own words.
Qwen3.8-Max 출시: 2.4T‑파라미터 모델, 다음 주 오픈 웨이트, 그리고 광범위한 자율 기능
Qwen3.8‑Max는 95B 활성 파라미터를 가진 2.4조 파라미터 모델로, 현재 QwenCloud를 통해 이용 가능하며 다음 주에 가중치가 오픈 소스로 공개될 예정이며, 코딩, 실제 업무, 장시간 작업, 멀티모달 에이전트에서 상당한 성능 향상을 제공합니다.
Cloudflare Workers AI: Kimi 및 GLM 추론의 대규모 최적화
Cloudflare는 정확도를 희생하지 않으면서 Kimi 및 GLM 모델의 동시성과 처리량을 높이기 위해 SGLang을 통해 KV cache quantization, weight compression, 그리고 integrity checking을 활용합니다.
Chiaro SOC 2 Methodology Open Source Release
Chiaro는 감사 테스트의 '블랙박스'를 제거하기 위해 기계 판독 가능한 통제 항목, 증거 표준 및 498개의 보정 예시를 제공하는 완전한 SOC 2 준비 및 감사 방법론을 오픈 소스로 공개했습니다.
hcker.news: AI 스토리 필터링 기능이 있는 Hacker News 리더
hcker.news는 사용자가 피드에서 AI 관련 스토리를 필터링하여 더 전통적인 기술 콘텐츠 경험을 것을 수 있게 해주는 서드파티 Hacker News 리더입니다.
FROGS 벤치마크: 하브스부르크 턱을 가진 개구리 SVG 생성
FROGS 벤치마크는 AI 모델에게 단일 프롬프트로 하브스부르크 턱을 가진 개구리 SVG를 만들게 하여 해부학 정확도, 크기, 그리고 왕실이나 분위기 세부 사항을 추가하는 경향의 차이를 드러냅니다.
AirLLM은 4GB GPU 하나로 70B LLM 추론을 가능하게 합니다
AirLLM은 한 번에 하나의 레이어만 스트리밍하여 4 GB GPU 하나로 70 억 파라미터 LLM을 실행할 수 있게 하며, 양자화 없이도 lyogavin/airllm 저장소에서 입증되었습니다.
Sprocket: 하드웨어 및 소프트웨어 개발을 위한 오픈 소스 AI 에이전트
Sprocket은 소프트웨어 개발, 하드웨어 설계, 그리고 부품 및 구독의 자율 조달을 자동화하도록 설계된 오픈 소스 AI 에이전트입니다.
AMD MI355X 기반 Kimi K3 배포: 성능 및 비용 분석
Wafer는 AMD MI355X가 NVIDIA B200 및 B300 GPU에 비해 2.8T 파라미터 Kimi K3 모델을 서빙하는 데 있어 우수한 가성비(performance-per-dollar)를 제공함을 입증합니다.
Andrej Karpathy의 Opus 5와 프로시저럴 월드 생성의 미래
Andrej Karpathy는 Opus 5가 Three.js를 사용하여 반지의 제왕 시작 부분을 프로시저럴로 렌더링하는 능력을 보여주며, 주문형 맞춤 월드의 잠재력과 현재 AI 시각 감사의 한계를 강조한다.
OpenAI 슈퍼 PAC와 Acutus AI 생성 뉴스 운영
조사에 따르면, 독립 언론을 주장하는 뉴스 사이트 Acutus는 OpenAI 연계 슈퍼 PAC에 의해 likely funded되어 특정 정치적 의제를 추진하기 위한 AI 기반 콘텐츠 팜일 가능성이 높습니다.