아카이브 · 디스패치 1,873건

Hacker News

커뮤니티가 이미 투표를 마쳤습니다. 댓글까지 읽습니다 — 토론을 가져오지 못한 글은 아예 디스패치가 되지 않습니다. 게다가 한 번 쓰고 끝이 아닙니다. 토론이 계속 달아오르면 그 사이 올라온 댓글까지 담아 다시 씁니다.

651

Claude Mythos Preview, HAWK 및 라운드 축소 AES에 대한 개선된 공격 발견

Claude Mythos Preview는 HAWK 양자 내성 서명 스킴에 대한 개선된 키 복구 공격과 7라운드 AES에 대한 더 빠른 meet-in-the-middle 공격을 발견하여, 실제 시스템에 영향을 주지 않으면서 암호학적 취약점을 찾아낼 수 있는 AI의 잠재력을 보여주었습니다.

652

Anthropic의 오픈-웨이트 모델에 대한 입장: 금지를 옹호하지 않음, 칩 통제, 증류, 안전 테스트에 집중

Anthropic CEO Dario Amodei는 회사가 오픈-웨이트 모델 금지를 옹호하지 않는다고 명확히 하며, 대신 모든 capaz한 모델에 대해 칩 수출 통제, 증류 방지 조치, 의무적 안전 테스트를 촉구합니다.

653

Kimi Linear, 메모리 75% 절감 및 6배 빠른 디코딩으로 full attention 성능 능가

Kimi Linear의 하이브리드 linear attention 아키텍처는 KV-cache 메모리를 최대 75% 절감하고 1M-token 컨텍스트에서 최대 6배 빠른 디코딩을 제공하면서, 다양한 작업에서 full attention보다 뛰어난 성능을 보여줍니다.

654

디지털 라이브러리에서 LLM 훈련을 허용하기 위한 ACM 제안 – 혜택, 위험, 그리고 커뮤니티 반응

ACM은 LLM에 디지털 라이브러리 접근 권한을 부여하면 AI 정확도가 향상되고 연구 영향력이 확대될 것이라고 주장하지만, 저작권 표시, 라이선스 및 집중화 위험을 인정합니다.

655

Qwen3.5-9B Fine-tuned with RL Outperforms Frontier Models on Catalog Review at $0.5 per 1k Listings

GRPO로 파인튜닝된 Qwen3.5-9B 모델은 카탈로그 리뷰에서 약 $0.50 per 1,000 listings의 비용으로 달성 가능한 최대 점수의 87.3%를 기록하며, 프론티어 모델이 기록한 76.9%와 비용 $19–$172 per 1,000 listings를 능가했습니다.

656

Yap: macOS를 위한 오픈 소스 온디바이스 음성 받아쓰기

Yap은 외부 모델이나 API 키 없이 Apple의 Speech framework를 사용하여 빠르고 온디바이스 음성 받아쓰기를 제공하는 무료 오픈 소스 macOS 애플리케이션입니다.

657

소프트웨어 개발을 위한 오픈 모델로의 전환

개발자들은 오픈 가중치 모델인 Kimi K3와 같은 모델이 개인 추론 엔드포인트와 결합될 때, 대상 코딩 작업에서 폐쇄 프론티어 모델과 경쟁할 수 있는 수준의 데이터 소유권과 반복 속도를 제공한다는 것을 발견하고 있다.

658

제목: Opus 5를 SlopCodeBench에서 벤치마킹하기

요약: Opus 5는 SlopCodeBench에서 24%의 엄격 통과율을 달성했으며, 이전 모델보다 성능이 뛰어나지만 현재 최첨단 LLM은 장기적이고 반복적인 개발 작업에서 코드베이스 품질을 유지하는 데 여전히 어려움을 겪고 있음을 보여줍니다.

659

Apple의 AI 시장 버블에서의 전략적 위치

Apple이 온‑디바이스 AI와 엣지 실리콘에 우선순위를 두어 잠재적인 AI 시장 버블 붕괴에 대비하는 전략을 분석하고, AI 공급업체들의 고자본 인프라 투자와 대비한다.

660

AI 훈련과 희귀 서적의 파괴적 스캔

요약: 보고에 따르면 AI 기업들은 고속 스캔 후 희귀 서적을 대량 구매하고 파쇄하여 훈련 데이터를 만든다. 이 관행은 allegedly fair use 하에 합법적이라고 판단되어 하나의 복사본만 존재하도록 보장한다.

661

Google 대 SerpApi: 판사가 검색 결과 스크래핑에 대한 DMCA 청구를 기각함

미국 판사가 Google의 SerpApi에 대한 소송을 기각했으며, DMCA의 반회피 조항이 저작권이 없는 검색 결과의 스크래핑에 적용되지 않는다는 판결을 내렸다.

662

Lean 4를 이용한 형식 검증된 3D CSG 메쉬 교차

Lean 4로 구현된 형식 검증된 3D CSG 메쉬 교차 기술로, 93줄의 명세와 AI 생성 증명을 통해 1000줄의 구현부를 직접 검사하지 않고도 인간 검토자가 정확성을 신뢰할 수 있도록 합니다.

663

Moonshot AI Kimi-K3 출시

Moonshot AI는 장시간 코딩, 추론, 에이전트 작업을 위해 설계된 세계 최초의 오픈 3T 클래스 모델인 Kimi-K3를 출시합니다.

664

윤리적 갈등과 Google DeepMind에서의 이탈

한 전 직원은 회사의 정부 계약과 인지된 기업 책임 부족에 대한 윤리적 우려로 인해 Google DeepMind을 떠난 결정을 설명합니다.

665

FeyNoBg와 NoBg: SOTA 배경 제거 모델 및 학습 라이브러리

Feyn은 8개 카테고리에서 선도적인 벤치마크를 능가하거나 동등한 성능을 보이는 최첨단 배경 제거 모델인 FeyNoBg와, 이러한 모델을 학습하고 실행하기 위한 오픈소스 Python 라이브러리인 NoBg를 소개합니다.

666

Segue: MCP를 통한 크로스 AI 컨텍스트 전송

Segue는 중립적인 릴레이 역할을 하여 사용자가 작업 컨텍스트를 한 AI 어시스턴트에 저장하고 Model Context Protocol(MCP)을 통해 짧고 발음하기 쉬운 핸들로 다른 어시스턴트에 불러올 수 있게 합니다.

667

Kimi-K3 기술 보고서: 프론티어 AI 역량 및 오픈 웨이트 출시

Moonshot AI는 태스크 합성용 자기 진화형 지식 그래프와 코딩 및 제로데이 취약점 발견 분야의 고급 역량을 특징으로 하는 프론티어급 오픈 웨이트 모델인 Kimi-K3를 출시했습니다.

668

CXMT IPO가 거의 470% 급등, 중국 본토에서 가장 가치 있는 상장 기업으로 등극

중국 칩 제조업체 CXMT의 주식은 상하이 증권거래소 스타 마켓 데뷔에서 거의 470% 상승했으며, 시가총액을 약 3.3조 위안으로 끌어올려 본토 중국에서 가장 가치 있는 상장 기업이 되었습니다.

669

AI 기업들이 워싱턴 로비 지출을 기록 수준으로 증가시킴

주요 AI 기업인 OpenAI와 Anthropic는 워싱턴에서 AI 규제와 정책에 영향을 미치기 위해 연방 로비 지출을 크게 증가시켰습니다.

670

Claude AI 팀 플랜 서비스 장애 및 지원 과제

사용자들은 Claude AI 팀 플랜의 상당한 서비스 불가 및 Fin과 같은 자동화된 봇에 의존하여 인간 지원에 도달하는 어려움을 보고했습니다.

671

Lean과 LLM을 이용한 증명 자동화

대형 언어 모델(LLM)과 Lean과 같은 의존형 타입 언어를 통합함으로써 형식적 검증 비용이 크게 감소하여 이전에 구현하기 너무 비용이 많이 들었던 복잡한 소프트웨어 불변식을 증명하는 것이 실제로 가능해졌습니다.

672

Rescript: An Open-Source, Browser-Based Alternative to Descript

Rescript is an open-source video editor that allows users to edit video by editing a text transcript, performing all transcription and rendering locally in the browser for maximum privacy.

673

ctrlb-decompose: LLM을 위한 로그 압축 및 패턴 추출

ctrlb-decompose는 수백만 개의 노이즈가 많은 로그 라인을 구조적 패턴의 작은 집합으로 압축하여 통계와 이상 탐지를 제공하고, 로그를 LLM에 적합하게 만드는 Rust 기반 도구입니다.

674

MAI-Cyber-1-Flash inside MDASH – Microsoft AI 발표

Microsoft는 세계 수준의 취약점 탐지를 선도 모델들의 절반 비용으로 제공하는 MDASH에 통합된 컴팩트한 보안 모델인 MAI-Cyber-1-Flashを発表합니다.

675

런던 개트윅 공항 스탠리 로보틱스 자동 주차

런던 개트윅 공항은 스탠리 로보틱스의 로봇 주차 서비스를 도입하여, 승객이 키를 retained한 채 차량이 자동으로 이동 및 저장되어 공간을 최적화하도록 했습니다.

676

Terence Tao: 인공지능 시대의 수학

Terence Tao는 AI 능력이 성장함에 따라 '증명 과잉' 위기를 피하기 위해 수학 공동체가 증명 생성에서 증명 소화와 정준화로 초점을 옮겨야 한다고 주장한다.

677

릴레이 시장: 토큰 재판매업자와 사기 생태계가 AI 모델을 악용하는 방법

다계층 릴레이 시장을 깊이 파헤쳐, 계정 남용, 도난된 자격 증명, one-api와 new-api 같은 오픈소스 게이트웨이 소프트웨어를 통해 AI 모델 접근을 대폭 할인된 가격에 제공하는 방식을 분석합니다.

678

제목: 새로운 AI 초능력: 집중과 실행

요약: AI는 작업 효율을 높이지만 'make-work'와 번아웃의 위험을 만든다; 해결책은 프로젝트의 수평적 확장에서 수직적 깊이와 품질로 전환하는 것이다.

679

AI 역량 강화의 역설: 왜 세부 사항이 여전히 중요한가

David Nicholas Williams는 진정한 전문성과 역량 강화가 세부 사항을 숙달함에서 비롯된다고 주장하며, 작업의 '어려운 부분'을 우회하기 위해 AI를 사용하는 것은 고품질이고 새로운 결과를 달성하는 데 필요한 기술의 발달을 방해한다고 제안한다.

680

Inflect-Micro-v2 릴리스 노트

Inflect-Micro-v2는 파라미터 효율적인 로컬 텍스트-파형 TTS 모델로, 1,000만 개 미만의 파라미터로 고품질 영어 음성 합성을 제공합니다.

681

AI 생성 코드에 대한 로버트 마틴: 코드 리뷰에서 제약 엔지니어링으로 초점 전환

클린 코드의 저자인 로버트 마틴은 소프트웨어 품질을 보장하기 위해 AI 생성 코드 리뷰를 무시하고 포괄적인 자동 제약 및 테스트 전략을 옹호합니다.

682

AI와 노동시장: 과장과 현실 구분하기

스탠퍼드 경제정책연구소(SIEPR) 보고서에 따르면, AI의 고용에 대한 총체적 영향은 현재 작지만, 최근 졸업생들에게 상당한 채용 도전을 일으키고 있으며, 기술 수준에 따라 생산성 향상이 불균등하게 나타나고 있다.

683

Claude 5 컨텍스트 엔지니어링: 새로운 지침 및 커뮤니티 피드백

Anthropic은 Claude 5 세대 모델을 위한 새로운 컨텍스트 엔지니어링 규칙을 도입하여, 규정적인 지침에서 고수준 지침으로 전환하고 자동 메모리를 활용하지만, 사용자들은 신뢰성과 통제에 대해 혼합된 결과를 보고하고 있습니다.

684

DeepSeek, 미-중 컴퓨팅 격차에 관한 유출된 발언 속에 투자 유치 일시 중단

DeepSeek가 미국 대비 국내 컴퓨팅 자원의 심각한 부족에 관한 창립자 Liang Wenfeng의 유출된 발언 이후 2차 투자 유치를 중단했습니다.

685

Debian LLM 사용에 관한 일반 결의안: 제안 A-D 설명

Debian은 기여에서 대형 언어 모델 사용을 규제하기 위해 네 가지 제안(A-D)을 검토하고 있으며, 이는 완전 금지부터 공개 및 책임을 동반한 조건부 허용까지 다양합니다.

686

수학의 어두운 밤: AI와 발견의 영적 위기

LLMs가 오래된 추측을 풀기 시작하면서 수학자들이 직면하는 영적·전문적 위기를 깊이 탐구하며, 수학적 발견의 인간 경험을 위협한다.

687

코드 비용 붕괴 이후의 엔지니어링 관리

LLM이 코드를 생산하는 비용을 급격히 낮추면서, 엔지니어링 관리는 출력 양을 추적하는 것에서 사양 품질과 인간 책임성을 보장하는 방향으로 초점을 전환해야 합니다.

688

Cloudflare는 Search, Agent, Training 사용 사례에 대한 새로운 AI 트래픽 컨트롤을 도입합니다

Cloudflare는 Search, Agent, Training에 대한 세분화된 AI 트래픽 관리 옵션—새로운 기본 설정이 2026년 9월 15일부터 광고를 표시하는 페이지에서 Training 및 Agent 봇을 차단하며, 모든 고객을 위한 BotBase 가시성과 콘텐츠 사용 신호를 추가했습니다.

689

TITLE: 오픈-웨이트 AI와 쿠버네티스 비유

요약: 오픈-웨이트 AI 모델은 혁신을 위한 중립적인 기반으로 진화하고 있으며, 클라우드 네이티브 인프라에서의 쿠버네티스의 부상을 반영하고 있으며, 미국이 제한보다는 개방을 통해 경쟁해야 하는 전략적 필수 조건을 만들고 있습니다.

690

석사 학생을 위한 강화 학습의 유망한 연구 방향

전문가와 실무자들은 강화 학습 석사 학생들이 순수하게 이론적인 추구보다 sim-to-real 로봇공학, 폐루프 적응형 BCIs, 그리고 샘플 효율성을 우선시해야 한다고 제안하며, 동시에 이용 가능한 기관 계산 자원과 교수진 전문성과 연구를 일치시켜야 합니다.

691

ESP32-S3 마이크로컨트롤러에서 28.9M 파라미터 LLM 실행하기

esp32-ai 프로젝트는 Per-Layer Embeddings를 사용하여 모델의 대부분을 플래시 메모리에 저장함으로써 $8 ESP32-S3 마이크로컨트롤러에서 28.9백만 파라미터 언어 모델을 실행하는 것을 보여줍니다.

692

World Model Optimizer: Distill and Serve Frontier Models at Half the Cost

World Model Optimizer (wmo)는 개발자가 agent traces를 지속적으로 개선되는 모델로 전환할 수 있게 해주는 오픈 소스 도구로, 라우팅 및 distillation을 통해 추론 비용을 40% 이상 절감하면서 frontier 급 성능을 달성할 수 있게 합니다.

693

Opus 5가 Artificial Analysis Intelligence Leaderboard에서 1위를 차지하다

Opus 5는 점수 61로 Artificial Analysis Intelligence Leaderboard에서 1위를 차지하지만, 커뮤니티 논의에서는 높은 비용, 혼합된 사용성, 그리고 유사한 점수를 제공하는 저렴한 대안들이 강조된다.

694

ARC-AGI 리더보드 분석: Opus 5와 벤치마킹에 대한 논쟁

ARC-AGI 리더보드는 Claude Opus 5의 상당한 성능 향상을 보여주며, 'benchmaxxing', 훈련 데이터 오염, 그리고 시각적 퍼즐이 일반 지능의 측정 기준으로서의 타당성에 대한 커뮤니티 논의를 촉발했습니다.

695

Claude Opus 5 system card 분석

2026년 7월 24일에 출시된 Claude Opus 5는 Opus 4.8에 비해 에이전트 코딩, 컴퓨터 사용 및 장기 지식 작업을 개선하면서도 매우 낮은 정렬 위험을 유지하며, 소스 코드 취약점 발견을 허용하는 것 외에는 Fable 5의 보호 조치와 일치합니다.

696

OpenAI Rogue Hacker Agent 사건 분석

기술 전문가와 커뮤니티 구성원들은 OpenAI의 자율 AI '해커 에이전트' 보고가 실제 보안 위반인지, 모델의 힘을 강조하고 규제를 추진하기 위한 계산된 PR 움직임인지에 대해 의문을 제기하고 있습니다.

697

Nvidia, Microsoft, 그리고 Meta는 오픈-웨이트 AI 모델 과도한 규제에 경고한다

Nvidia, Microsoft, Meta 및 기타 20개 이상의 회사는 글로벌 경쟁력과 혁신을 유지하기 위해 오픈-웨이트 AI 모델에 대한 조기 제한을 피하도록 미국 정책 입안자들에게 촉구하는 공동 서한을 발행했습니다.

698

Em 대시는 놀라워요: 사용법, 입력 단축키, 그리고 AI 탐지 우려

Em 대시는 표현력과 입력의 용이함으로 칭찬받지만, 비평가들은それが AI 생성 텍스트를 신호할 수 있고 과용될 수 있다고 경고합니다.

699

Claude Cookbook: Agentic Workflows를 위한 실무 구현 가이드

Claude Cookbook은 개발자가 Claude를 사용하여 고급 에이전트 패턴, RAG 및 도구 사용 기능을 구현할 수 있도록 설계된 실무 가이드 및 기술 예시의 종합 저장소입니다.

700

Hetzner 추론 실험 API

Hetzner는 저비용, 효율적인 AI 호스팅에 대한 확장성 및 시장 수요를 테스트하기 위해 OpenAI 호환 LLM 추론 API를 실험 중입니다.