✷ 아카이브 · 디스패치 1,873건
Hacker News
커뮤니티가 이미 투표를 마쳤습니다. 댓글까지 읽습니다 — 토론을 가져오지 못한 글은 아예 디스패치가 되지 않습니다. 게다가 한 번 쓰고 끝이 아닙니다. 토론이 계속 달아오르면 그 사이 올라온 댓글까지 담아 다시 씁니다.
Searchlight Cyber wp2shell WordPress RCE discovered with GPT‑5.6 Sol Ultra for $25
Searchlight Cyber는 GPT‑5.6 Sol Ultra를 이용해 WordPress Batch API의 사전 인증 SQL 인젝션을 발견하고 이를 원격 코드 실행으로 연결했습니다. 비용은 단 $25에 불과했으며, 이러한 제로데이에 대해 익스플로잇 브로커가 최대 $500 k를 지불한다는 점을 보여줍니다.
arXiv에서의 AI 생성 글쓰기 측정: 트렌드와 한계
12,750개의 arXiv 논문을 분석한 연구에 따르면, 최근 제출된 논문의 약 32%가 기계 작성으로 탐지되었으며, Computer Science 분야가 65%로 가장 높은 비율을 보였습니다.
Xiaomi-Robotics-1: 100K 시간 데이터로 비전‑언어‑행동 모델 확장
Xiaomi-Robotics-1은 100,000시간의 궤적 데이터를 활용한 embodiment‑free 사전 학습을 통해 로봇공학의 데이터 병목을 해소하고, 모바일 매니퓰레이션 작업에서 최첨단 성능을 달성한 로봇 기반 모델입니다.
Claude Fable과 Jacobian 추측 반례
Claude Fable이라는 AI 모델이 Jacobian 추측에 대한 반례를 만들어냈다고 보고되었습니다. 이 추측은 85년 동안 해결되지 않은 장기 미해결 수학 문제였습니다.
AI 조언과 비판적 사고의 침식: 인지적 굴복에 관한 연구
프랑스와 이탈리아의 연구진에 의한 연구에 따르면, AI 조언에 접근할 수 있게 되면 정확도는 27%에서 { "typo": "error in translation of numbers in summary" } 9%로 감소하고, 무지를 인정할 의지를 44%에서 3%로 억제하며, 동시에 사용자의 자신감을 30%에서 76%로 증가시킨다는 것을 발견했습니다.
선별된 비(Non)-AI 기술 및 니치 블로그
AI 열풍에서 벗어나 개인 프로젝트, 소프트웨어 엔지니어링, 그리고 전문 지식에 대한 심층적인 탐구를 다루는 추천 기술, 역사, 니치 블로그 모음입니다.
Moonshot AI, 높은 수요로 인해 Kimi K3 구독 일시 중단
Moonshot AI는 수요 급증 이후 기존 회원의 서비스 품질을 유지하고 컴퓨팅 용량을 우선시하기 위해 Kimi K3의 새로운 구독을 일시적으로 중단했습니다.
AI 데이터 센터 인프라와 토지수용
전력 회사들은 AI 데이터 센터 붐을 지원하기 위해 송전선용 토지를 확보하기 위해 토지수용을 점점 더 많이 활용하고 있으며, 이러한 프로젝트가 제5수정조항의 ‘공공 이용’ 요건을 충족하는지 여부에 대한 법적 논쟁이 제기되고 있습니다.
Claude Code, Rust 기반 Bun 런타임으로 전환
Claude Code v2.1.181 이후 버전은 Rust 포팅된 Bun 런타임을 포함하며, Linux에서 10% 빠른 시작과 Bun 1.4.0 미리보기를 확인합니다.
AI 에이전트 토큰 경제학 최적화: 커스텀 딥 리서치 파이프라인 구축하기
비용을 줄이고 환각 현상을 방지하기 위해, 커스텀 리서치 파이프라인은 모델 오케스트레이션(model orchestration)을 통해 다양한 LLM에 특정 역할을 할당하고, 공유 로컬 메모리를 사용하며, 인간의 개입이 포함된 검증 프로세스를 활용합니다.
Qwen3.8 릴리스: 2.4조 파라미터 오픈-웨이트 모델
Alibaba는 2.4조 파라미터 모델인 Qwen3.8을 발표했으며, 이를 최첨단 클래스 AI로 포지셔닝하고 오픈-웨이트 형태로 출시할 예정입니다.
AI 매니아가 전 세계 의사결정을 파괴하고 있다 – 컨설턴트의 최전선 기록
수백 건의 AI 프로젝트를 관찰한 컨설턴트는 대다수 AI 이니셔티브가 실패하고, 컬트 같은 AI 과대광고가 기업 의사결정을 해치며, 매니아를 살아남기 위한 실용적인 조언을 제시한다.
OpenAI Codex 사용 제한 재설정: 추적 및 추세
커뮤니티 기반 트래커에 따르면 OpenAI는 장애 보상, 사용자 마일스톤 축하, 또는 GPT-5.6 Sol과 같은 새로운 모델 도입 촉진을 위해 Codex 및 ChatGPT Work 사용 제한을 자주 재설정합니다.
transcribe.cpp v0.1.0: 고성능, 크로스 플랫폼 ASR 추론 엔진
transcribe.cpp v0.1.0은 60개 이상의 모델과 16개의 ASR 제품군에 대해 수치적으로 검증되고 하드웨어 가속이 지원되는 로컬 ASR 추론을 제공하는 ggml 기반 전사 라이브러리입니다.
OpenAI Codex 컨텍스트 크기 축소 및 시스템 프롬프트 업데이트
OpenAI는 Codex 모델의 컨텍스트 크기를 372k에서 272k 토큰으로 축소하는 동시에, 실수로 인한 파괴적인 파일 시스템 작업 방지를 위해 새로운 시스템 프롬프트 안전 장치를 도입했습니다.
Mamdani 시장, 임대 광고에 AI 이미지 공개 의무화
Mamdani 시장은 임대 부동산을 광고할 때 집주인이 AI 생성 이미지를 비밀리에 사용하는 것을 금지하며, 기만적인 광고를 방지하기 위해 AI 사용에 대한 명시적인 공개를 요구합니다.
Kimi K3 순간: 오픈-웨이트 프론티어 모델과 AI 경제의 전환
Kimi K3와 GLM 5.2의 출시로 고성능·저비용 오픈-웨이트 모델이 부상하고 있으며, 이는 Claude와 GPT‑5.6 같은 폐쇄형 미국 프론티어 모델의 지배력을 위협하고 있습니다.
GPT-5.6 Sol Pro가 30년간의 볼록 최적화 격차를 해결합니다
매우 상세한 10페이지 프롬프트와 Lean을 이용한 형식 검증을 통해, GPT-5.6 Sol Pro는 볼록 최적화에서 오래 지속된 이차 차원 의존성 격차를 해결하는 증명을 제안했습니다.
Stack Overflow의 쇠퇴: AI와 커뮤니티 문화의 영향 분석
Stack Exchange Data Explorer의 데이터는 장기적인 문화적 적대감과 대규모 언어 모델(LLMs)의 파괴적 영향이 결합되어 Stack Overflow의 활동이 크게 감소했음을 보여줍니다.
전용 Mac에서 Claude Code 격리하기
예비 Mac을 사용하면 Claude Code가 명령을 실행하고 파일을 관리할 수 있는 하드웨어 격리 환경을 제공하여 기본 워크스테이션을 위험에 빠뜨리지 않습니다.
Claude Fable 5 vs. GPT‑5.6 Sol on KIRO NP‑Hard Fiber Network Benchmark
Claude Fable 5가 어려운 광섬유 네트워크 설계 문제에서 GPT‑5.6 Sol보다 우수했으며, 기본 `/goal` 모드가 대부분의 개별 실행에서 승리했지만 두 모델 모두 평균 성능은 악화되었습니다.
AI 로고 트렌드: 현대 브랜딩이 원형 구멍을 선호하는 이유
AI 기업 로고에서 원형·방사형 디자인을 사용하는 추세가 증가하고 있으며, 비평가들은 이를 해부학적 개구부와 유사하다고 주장합니다. 이는 위험 회피와 동질화된 디자인을 선호하는 기업 문화의 broader한 경향을 반영합니다.
Kaiser Permanente 간호사, AI 기반 감시가 치료와 근무 환경을 악화시킨다고 보고
Kaiser Permanente 간호사들은 AI 기반 모니터링과 엄격한 통화 시간 지표가 환자 선별 통화에서의 공감을 억제하고 있다고 주장하며, 이에 따라 노조 행동과 캘리포니아 AI 규제 법안이 진행 중입니다.
Qwen 3.8 Max Preview 출시
Alibaba의 Qwen 3.8 Max Preview는 현재 Qwen Cloud의 구독 기반 토큰 플랜을 통해 이용 가능하며, 이는 폐쇄형 모델로의 전환 및 DeepSeek와의 성능 비교에 대한 커뮤니티의 논계을 불러일으키고 있습니다.
Kimi K3 출시와 펠리컨 SVG 벤치마크에서 얻은 교훈
Moonshot AI의 Kimi K3는 2.8조 파라미터 모델로 강력한 성능과 비용 특성을 보여주며, 오랫동안 사용되어 온 펠리컨‑온‑어‑바이시클 SVG 테스트는 실용적인 통찰과 현대 LLM 평가에서의 한계를 드러냅니다.
Apple가 OpenAI로 이직한 전직 직원들에게 법적 통지 발송
Apple은 OpenAI에 합류한 수십 명의 전직 직원들에게 법적 서신을 발송하여, 독점 정보 및 영업 비밀에 관한 잠재적 갈등을 예고했습니다.
Mozilla 오픈 소스 AI 현황 V1.0 보고서
Mozilla의 2026년 보고서는 오픈 가중치 AI 모델이 코딩 및 일반 지식 분야에서 폐쇄 모델과 거의 동등한 수준에 도달했으며, 경쟁의 최전선이 '에이전시 활용'과 운영 도구로 이동하고 있음을 보여줍니다.
Claude Fable 5 vs GPT-5.6 Sol AI Music Video Arena: $25 and $100 Budget Comparison
Claude Fable 5와 GPT-5.6 Sol은 각각 $25와 $100 예산으로 Uptown Funk에 대한 전체 길이 AI 생성 뮤직 비디오를 제작했으며, 도구 사용 패턴, 비용 구조, 창의적 한계에서 뚜렷한 차이를 보여줍니다.
인간-인-루프가 지쳤다: LLM 지원 프로그래밍의 심리적 대가
LLM을 활용한 프로그래밍은 작업 강도를 높이고 개발자의 역할을 창작자에서 감독자로 전환시켜, 인간 보상 함수 문제라 불리는 새로운 형태의 인지 피로를 초래한다.
LM Studio Bionic 릴리스 노트
LM Studio Bionic은 오픈 모델을 위해 설계된 새로운 AI 에이전트 애플리케이션으로, 로컬 음성 전사, 에이전트 방식의 코딩 및 문서 워크플로우, 그리고 데이터 제로 보존을 지원하는 하이브리드 로컬-클라우드 실행 모델을 특징으로 합니다.
DeepMind Kaggle 대회 논란: AI 생성 콘텐츠가 대상 수상
AI 생성 '슬롭(slop)'으로 묘사되는 제출물이 25,000달러의 대상 상금을 차지하면서 DeepMind Kaggle 대회가 논란을 되고자 합니다. 이는 LLM 기반 심사의 효능에 대한 의문을 제기합니다.
Be the ChatBOT: LLM 사용자 경험 시뮬레이션
Be the ChatBOT은 사용자가 AI 역할을 수행하게 하여, 모호하거나 어려운 인간의 프롬프트를 처리할 때 발생하는 인지적 부하와 정서적 좌절감을 드러내는 인터랙티브 시뮬레이션입니다.
Decoy Font: 공간 주파수를 이용한 AI 텍스트 은폐
Decoy Font는 하이브리드 이미지 기법을 이용해 거리와 시점에 따라 다른 메시지를 표시하는 TTF 폰트로, 고주파 전경 디테일을 우선시함으로써 AI OCR 시스템을 속이고 저주파 숨겨진 메시지를 인간에게만 보이게 합니다.
Gemini Notebook으로 리브랜딩된 NotebookLM
Google은 제품을 Gemini AI 브랜드 생태계와 더 잘 맞추기 위해 NotebookLM을 Gemini Notebook으로 리브랜딩했습니다.
Kimi K3 출시: 에이전트 코딩을 위한 2.8조 파라미터 모델
Moonshot AI는 에이전트 지식 작업 및 코딩을 위해 설계된 2.8조 파라미터 오픈‑웨이트 모델 Kimi K3를 출시했으며, 최첨단 지능 벤치마크에서 Claude Fable 5와 GPT‑5.6 Sol에 바로 뒤쳐지는 성능을 보입니다.
왜 LLM 비평가들의 주장은 맞지만 나는 여전히 LLM을 사용한다 – 깊이 있는 탐구
작성자는 저작권, 환경 영향, 신뢰 약화, 지정학적 위험 등 대형 언어 모델에 대한 정당한 비판을 인정하면서도, 더 높은 품질의 결과물, 생산성 향상, 로컬‑우선 워크플로우를 위해 여전히 LLM을 활용한다.
6GB VRAM에서 생성형 킥 드럼 디퓨전 모델 훈련하기
Developer zhinit은 7년 된 NVIDIA GTX 1660 SUPER를 사용해 킥 드럼 샘플을 생성하는 잠재 디퓨전 모델을 훈련했습니다. 이를 통해 공격적인 잠재 공간 압축을 활용하면 소비자용 하드웨어에서도 고품질 생성 오디오가 가능함을 보여줍니다.
Claude Fable 5 접근 중단 및 크레딧 오류
2026년 7월 17일에 발생한 기술적 중단으로 인해 Claude Fable 5 사용자는 7월 19일까지 진행 중인 프로모션에도 불구하고 잘못된 '사용 크레딧이 필요합니다' 메시지를 받았습니다.
데이터 과학의 수학: 기초 이론과 실무 적용
'데이터 과학의 수학' 리소스는 현대 데이터 과학 실무자에게 필요한 고차원 기하학, 통계학, 그리고 선형 대수학의 중요한 교차점에 초점을 맞춥니다.
강화학습 소책자(The Little Book of Reinforcement Learning) – 간결한 개요 및 커뮤니티 의견
The Little Book of Reinforcement Learning은 핵심 RL 개념을 압축한 간결한 GitHub 가이드이며, Hacker News의 토론은 이 가이드의 교육적 가치를 높게 평가하면서도 이론적 깊이와 생물학적 연결성 및 최근 RL 기술의 발전을 반영하지 못한 점을 지적합니다.
클래식 머신러닝으로 LLM‑생성 텍스트 감지
전통적인 머신러닝 모델, 특히 TF‑IDF와 Linear SVC를 활용한 기술 프로젝트는 단어 선택의 강력한 통계적 패턴을 식별함으로써 LLM‑생성 텍스트를 약 85% 정확도로 감지할 수 있음을 보여줍니다.
YC 창업자들, OpenAI와 Anthropic에서 – 누가 이동했고 무엇을 의미하는가
현재 OpenAI 또는 Anthropic에서 일하는 Y Combinator 창업자 105명의 curated 목록은 기술 직무 역할에 강한 편향성을 보이며, AI 붐 속에서 채용 관행에 대한 질문을 제기한다.
Inkling 오픈-웨이트 모델 출시
Thinking Machines는 텍스트, 이미지, 오디오를 기본적으로 지원하며 고도로 맞춤화할 수 있는 파인튜닝 기반으로 설계된 975B 파라미터 멀티모달 Mixture-of-Experts 모델인 Inkling을 출시했습니다.
Grok Build: SpaceXAI의 오픈 소스 코딩 에이전트 하네스
Grok Build는 SpaceXAI에서 제공하는 터미널 기반 AI 코딩 에이전트로, 코드베이스 편집, 셸 실행, 웹 검색을 위한 전체 화면 TUI를 제공하며, Apache 2.0 라이선스로 출시된 Rust 프로젝트입니다.
왜 정부, 기업, 비영리 단체는 자유 오픈‑소스 AI에 투자해야 하는가
David Siegel은 AI 모델을 폐쇄하면 과학적 진보와 공공 안전이 위협받는다며, 자유 오픈‑소스 AI에 대한 공공·민간 투자를 공유 기술 발전의 검증된 모델로 촉구한다.
AI 음성 클로닝 사기가 급증: 탐지가 실패하는 이유와 제도적 책임이 필요함
AI가 생성한 음성 사기는 수십억 달러의 손실을 초래하고, 3초짜리 음성 클론을 악용하며, 피해자 경계에 의존하기보다 규제 및 제도적 보호 장치가 필요합니다.
레거시 Xeon 하드웨어에서 Gemma 4 26B 실행하기
`ik_llama.cpp`의 명령어 세트 불일치 문제를 패치하여 13년 된 Ivy Bridge Xeon CPU에서 Google의 Gemma 4 26B MoE 모델을 초당 5개 토큰의 속도로 실행하는 기술적 과정에 대한 설명입니다.
OpenAI Codex Micro: 에이전트 워크플로우를 위한 전용 하드웨어 컨트롤러
OpenAI와 Work Louder는 ChatGPT Codex에서 AI 에이전트의 촉각적 제어와 RGB 상태 피드백을 제공하기 위해 설계된 $230 가격의 기계식 매크로패드인 Codex Micro를 출시했습니다.
OpenAI 상표 분쟁: EU 일반 법원, 이름이 순수히 설명적이라고 판결
유럽 연합 일반 법원은 특정 소프트웨어 및 IT 서비스에 대한 OpenAI 이름의 상표 등록 시도를 거부했으며, 'OPENAI'가 구별된 브랜드가 아닌 설명적 용어라고 판결했습니다.
구글 딥마인드를 떠난 이유 – AI 윤리와 기업 압력에 대한 사례 연구
저자는 구글 딥마인드가 치명적인 자율 무기를 개발하지 않겠다는 약속을 어겼기 때문에 회사를 떠났으며, 이는 기업 압력이 AI 윤리 약속을 무시할 수 있음을 강조합니다.