✷ 아카이브 · 디스패치 1,876건
Hacker News
커뮤니티가 이미 투표를 마쳤습니다. 댓글까지 읽습니다 — 토론을 가져오지 못한 글은 아예 디스패치가 되지 않습니다. 게다가 한 번 쓰고 끝이 아닙니다. 토론이 계속 달아오르면 그 사이 올라온 댓글까지 담아 다시 씁니다.
Weave Robotics Isaac 1 홈 로봇
Weave Robotics는 세탁 및 정리 정돈을 위해 설계된 7,999달러 가격의 홈 로봇 Isaac 1을 공개했으며, 2026년 가을에 배송될 예정입니다.
ZCode Harness for GLM-5.2 Overview
ZCode는 GLM‑5.2 모델용 하네스를 도입하여 배포와 실험을 간소화하는 즉시 사용 가능한 인터페이스를 제공합니다.
Senior SWE-Bench: Senior 소프트웨어 엔지니어 수준 AI 에이전트 평가
Senior SWE-Bench는 불명확한 요구사항으로부터 기능을 구현하는 AI 에이전트의 능력을 평가하도록 설계된 오픈소스 벤치마크이며, senior 소프트웨어 엔지니어의 작업 흐름을 모방합니다.
Claude Fable 5 출시 및 사용자 피드백
Anthropic은 Claude Fable 5 모델을 다시 도입했지만, 제한적인 사용 한도와 과도한 안전 가드레일, 그리고 가격 및 접근성에 대한 사용자 불만이 크게 나타나고 있습니다.
Valmis: 보안 우선 프록시 아키텍처를 갖춘 오픈소스 AI 에이전트 프레임워크
Valmis는 프로덕션 작업을 위해 설계된 오픈소스 AI 에이전트 플랫폼으로, 에이전트 런타임을 API 자격 증명 및 호스트 파일과 격리하는 보안 프록시 시스템을 특징으로 합니다.
CursorBench 3.1: 실제 작업에서 AI 코딩 에이전트 평가
CursorBench 3.1은 실제 Cursor 세션에서 나온 모호하고 다중 파일 작업을 통해 AI 코딩 에이전트를 평가하며, 현재 성능 면에서는 Fable 5 Max가 선두를 달리고 있습니다.
Claudoro: Claude Code용 Pomodoro 타이머
Claudoro는 Claude Code 상태 표시줄에 직접 삽입되는 풍부한 기능을 갖춘 Pomodoro 타이머로, 터미널 내에서 시간 추적을 유지함으로써 컨텍스트 전환을 없애줍니다.
Cloudflare Monetization Gateway 및 x402 프로토콜
Cloudflare는 오픈 x402 마이크로페이먼트 프로토콜과 스테이블코인을 활용해 웹사이트 소유자가 AI 에이전트와 사용자에게 디지털 리소스 사용료를 청구할 수 있는 Monetization Gateway 도구를 출시했습니다.
Godot Engine이 AI가 작성한 코드 기여를 금지합니다
Godot Engine 재단은 유지 관리자의 번아웃을 방지하고 기여자가 제출하는 코드를 이해하도록 보장하기 위해 AI가 작성한 코드 기여를 금지했습니다.
Claude Fable 5 재배포 및 AI 사이버보안 프레임워크
Anthropic은 미국 수출 통제 해제 후 Claude Fable 5를 전 세계에 재배포하고, AI 탈옥 심각도를 평가하기 위한 새로운 산업 프레임워크를 도입합니다.
Anthropic Claude Fable 5 및 Mythos 5 수출 통제 해제
미국 상무부는 보안 위험 감지 및 정부 협조에 관한 합의 후 Anthropic의 Claude Fable 5와 Mythos 5 모델에 대한 수출 통제를 해제했습니다.
Claude Sonnet 5 출시 노트
Anthropic은 Opus 4.8에 근접하는 성능을 더 낮은 가격으로 제공하며, 에이전트적 워크플로우에 최적화된 모델인 Claude Sonnet 5를 출시했습니다.
Henrico County 에너지 위기: 데이터 센터 확장이 전기 요금 인상 유도
Henrico County, Virginia,는 데이터 센터 개발의 급증으로 인해 정부 및 학교 시설의 전기 요금이 25% 인상되어 약 $5 million의 추가 비용이 발생할 것으로 예상됩니다.
Leanstral 1.5 릴리스 노트
Mistral AI는 Lean 4 형식 증명 엔지니어링, 자동 정리 증명 및 자동 형식화에 최적화된 119B 파라미터 특화 모델인 Leanstral 1.5를 출시했습니다.
Claude Code 2.1.196 프롬프트 스테가노그래피 발견
Claude Code 버전 2.1.196 분석 결과, 이 도구는 API 리셀러 및 커스텀 게이트웨이를 식별하기 위해 시스템 프롬프트에 스테가노그래피 마커를를 사용합니다.
Claude Science 베타 릴리스
Anthropic은 Claude Science를 공개 베타 형태로 출시했습니다. 이는 과학 데이터베이스, 컴퓨팅 인프라, 에이전트 기반 사실 검증을 통합한 AI‑네이티브 연구 환경으로, 원시 데이터에서 출판까지의 과정을 효율화합니다.
Nano Banana 2 Lite 출시 노트
Google DeepMind는 신속한 반복 작업과 실시간 애플리케이션 통합을 위해 설계된 고속, 비용 효율적인 이미지 생성 및 편집 모델인 Nano Banana 2 Lite를 출시했습니다.
Meta Brain2Qwerty: 비침습적 뇌-텍스트 통신
Meta의 Brain2Qwerty 연구는 고급 AI를 활용하여 운동 장애가 있는 개인들의 통신을 개선하기 위해 뇌파를 텍스트로 번역하는 비침습적 방법을 보여줍니다.
AI 시대의 기술적 친숙함의 침식
고마찰 컴퓨팅에서 AI 중심의 원활한 환경으로의 전환이 기계와 씨름하며 얻는 '친밀한 친숙함'을 불투명한 추상화에 대한 의존성으로 대체하고 있는 현상에 대한 성찰.
한국, 메모리 칩·데이터 센터·휴머노이드 로봇에 1조 달러 투자 발표
한국은 물리 AI 분야에서 세계적 선두를 확보하기 위해 2028년까지 메모리 칩 생산 확대, AI 데이터 센터 구축, 휴머노이드 로봇 상용화에 1조 달러를 투자합니다.
Qwen 3.6 27B: 로컬 LLM 개발을 위한 새로운 최적점
Qwen 3.6 27B는 지능과 성능의 균형을 이루는 매우 강력한 로컬 모델로 부상하고 있지만, 하드웨어 요구 사항 때문에 로컬과 클라우드 추론의 비용 효율성에 대한 논쟁을 불러일으키고 있습니다.
Moondream Photon: 파이프라인 디코딩으로 GPU 버블 제거
Moondream의 Photon 추론 엔진은 파이프라인 디코딩을 사용해 CPU 부기 작업과 GPU 연산을 겹치게 함으로써 GPU 버블이라 불리는 대기 시간을 없애고 디코드 처리량을 최대 35%까지 증가시킵니다.
LongCat-2.0 MoE 모델 분석
LongCat-2.0은 AI ASIC superpod를 사용하여 개발된 총 1.6조 개의 파라미터와 480억 개의 활성 파라미터를 특징으로 하는 대규모 Mixture-of-Experts (MoE) 모델입니다.
Cursor iOS 앱이 사용자 동의 없이 새로운 프라이버시 모드로 전환
Cursor iOS 앱을 설치하면 계정이 레거시 "코드를 저장하지 않음" 프라이버시 모드에서 덜 제한적인 새로운 모드로 자동 이동하고, 레거시 옵션은 앱 내에서 복구할 수 없습니다.
Tidal AI 정책: AI 생성 음악의 수익 창출 제한
Tidal은 플랫폼에서 AI 생성 음악을 허용하되 수익 창출을 금지하는 새로운 AI 정책을 도입했습니다. 이는 로열티가 인간 아티스트에게만 돌아가도록 보장하기 위함입니다.
Ornith-1.0: 에이전트 코딩을 위한 자기 개선형 오픈 소스 모델
Ornith-1.0은 Gemma 4 및 Qwen 3.5를 기반으로 사후 학습된 에이전트 코딩용 MIT 라이선스 자기 개선형 오픈 소스 모델 제품군(9B, 35B, 397B)입니다.
삼성, SK 하이닉스, 그리고 마이크론, 미국에서 메모리 가격 담합으로 고소당함
삼성, SK 하이닉스, 그리고 마이크론은 DRAM 공급 감소와 구형 메모리 표준의 단종을 협조해 가격을 올렸다는 혐의로 미국에서 소송을 당하고 있습니다.
ZLUDA 6 출시: 비 NVIDIA GPU에서 수정되지 않은 CUDA 애플리케이션 실행하기
ZLUDA 6는 32비트 PhysX 지원, Blender를 위한 기본적인 텍스처 지원, 그리고 비 NVIDIA 하드웨어에서 CUDA 애플리케이션을 실행하기 위한 대폭 개선된 Windows 사용성을 도입합니다.
AI와 함께 작업하기: 마법사의 견습생 문제에 대한 구체적인 사례
Carson Gross는 하이퍼스크립트 파서의 실제 버그 수정을 통해 소프트웨어 개발에서 AI의 강점과 약점을 탐구하며, AI가 제안하는 해결책을 무비판적으로 받아들이는 위험성을 강조합니다.
CUDA 커널을 실행할 때 발생하는 일: 소스에서 SASS까지
CUDA 커널의 전체 수명 주기를 깊이 있게 살펴보며, nvcc 컴파일 및 PTX/SASS 생성 단계부터 RTX 4090에서의 하드웨어 수준 실행까지의 흐름을 추적합니다.
HackerRank Hiring Agent: AI 이력서 스크리닝에서 비결정성 분석
HackerRank의 오픈소스 `hiring-agent` 도구를 분석한 결과, 동일한 이력서가 여러 번 실행될 때마다 점수가 크게 달라지는 심각한 점수 일관성 문제와 설계 결함이 드러났습니다.
Bash4LLM+ 개요: LLM API용 경량 Bash 래퍼
Bash4LLM+는 Groq 및 기타 OpenAI 호환 LLM API용 CLI 래퍼를 제공하는 의존성 없는 보안 Bash 스크립트로, 세션 관리와 UI 상태 시스템을 특징으로 합니다.
브라운 대학교의 AI 사기: 집에서 보는 시험의 종말
로베르토 세라노 교수는 브라운 대학교의 수리경제학 시험에서 대규모 AI 기반 부정행위를 규탄했으며, 이는 AI 시대에 학문적 진실성과 평가 방법에 중대한 변화를 예고합니다.
Claude Code와 Opus 4.8을 활용한 MRI 분석: AI 2차 의견에 대한 사례 연구
Claude Code와 Opus 4.8을 사용해 DICOM MRI 데이터를 분석한 기술적 탐구로, AI 기반 진단과 인간 의료 진단 사이의 극명한 차이를 강조합니다.
AI 투자 붐과 전 세계 금융 위기의 위험
중앙은행가와 금융 분석가들은 하이퍼스케일러에 의한 AI 인프라에 대한 과도한 투자와 공급 측면 병목 현상이 인플레이션을 유발할 경우, 수익이 실현되지 않으면 전 세계 금융 위기를 촉발할 수 있다고 경고한다.
GLM 5.2 IDOR 취약점 탐지 벤치마크 성능
Semgrep이 수행한 벤치마크에서, 오픈‑웨이트 모델 GLM 5.2가 최소 프롬프트 하네스만 사용했을 때 Insecure Direct Object Reference (IDOR) 취약점 탐지에서 Claude Code보다 우수한 성과를 보였습니다.
Herdr – 터미널 기반 에이전트 멀티플렉서 for Managing Multiple AI Bots
Herdr는 터미널 기반 에이전트 멀티플렉서로, 개발자가 하나의 커맨드‑라인 인터페이스에서 여러 AI 에이전트를 실행·전환·상호작용할 수 있게 하여 워크플로를 간소화하고 컨텍스트 전환을 감소시킵니다.
1960‑2026년 역사적 메모리 가격: 추세와 AI 영향
1960년부터 2026년까지 메모리 및 스토리지 가격을 포괄적으로 분석한 결과, 기가바이트당 비용의 장기적인 하락과 AI 수요에 따른 HBM 및 DRAM 가격 변동성을 강조합니다.
토큰맥스킹의 진화: 강제 채택에서 복합 정확성으로
토큰맥스킹은 AI 채택을 강제하기 위한 무딘 관리 도구에서, 반복 루프를 통한 토큰 지출 증가가 정확성을 높이는 전략적 기술 접근법으로 전환되고 있습니다.
AI 없는 기술 뉴스 소스에 대한 수요
기술 커뮤니티의 성장하는 일부가 주류 기술 언론과 포럼에서 AI 관련 콘텐츠가 포화된 상황을 벗어나기 위해 뉴스 필터와 대체 플랫폼을 찾고 있습니다.
OpenAI Codex: 민감한 파일 제외에 관한 논쟁
OpenAI Codex의 오픈 이슈에 관한 논의는 사용자가 요청한 '.agentignore' 파일과, LLM 기반 에이전트가 민감한 데이터에 접근하는 것을 진정으로 방지할 수 있는 것은 OS 레벨 샌드박싱뿐이라는 기술적 현실 사이의 근본적인 충돌을 조명합니다.
NanoEuler: C와 CUDA로 밑바닥부터 구축한 GPT-2 규모의 LLM
NanoEuler는 C와 CUDA로 완전히 작성된 GPT-2 스타일의 언어 모델의 교육용 구현체로, ML 라이브러리를 사용하지 않고 직접 작성한 backpropagation, FlashAttention, 그리고 전체 pretraining-to-SFT 파이프라인을 특징으로 합니다.
AI 슬롭(Slop)에 맞서 삶의 경험으로 대응하기
정보와 지혜의 차이는, 개인적이고 삶의 경험을 창작 과정에 통합하는 것만이 인간의 작업물을 AI 생성 콘텐츠와 차별화할 수 있는 유일한 방법임을 시사합니다.
AMD Strix Halo RDMA 클러스터 설정 가이드
Intel E810 RoCE v2 NIC를 사용하여 텐서 병렬성(Tensor Parallelism)을 통한 분산 vLLM 추론을 가능하게 하는 2노드 AMD Strix Halo 클러스터 구성에 대한 기술 가이드입니다.
Adrafinil: macOS용 AI 코딩 에이전트를 위한 조건부 수면 방지 도구
Adrafinil은 AI 코딩 에이전트가 활발히 작업하는 동안에만 클램쉘 모드를 포함한 시스템 수면을 방지하는 macOS 메뉴 바 애플리케이션입니다.
Claude Mythos와 AI 기반 사이버 보안 현황
Claude Mythos는 자동화된 취약점 탐색 및 익스플로잇 생성에서 큰 진전을 이루었지만, 제로 트러스트, 공격 표면 축소, 체계적인 취약점 관리와 같은 기본 보안 원칙을 여전히 최우선으로 해야 함을 강조합니다.
AI 권력 집중: 진정한 위협은 기계 지배가 아니라 엘리트 통제
주된 우려는 정부와 빅테크가 첨단 AI를 독점해 소수 특권층만이 혜택을 받는 도구로 전락시키고, 소규모 기업과 일반 대중을 소외시키는 것입니다.
아시아 AI 스타트업, 미국의 수출 제한 속에서 Mythos급 모델 출시
Anthropic의 Mythos 및 Fable 5에 대한 미국의 수출 제한 조치 이후, 아시아의 스타트업인 Sakana AI와 360은 지역적 AI 주권을 확보하고 미국 기반 시스템에 대한 의존도를 낮추기 위해 경쟁적인 프론티어 모델인 Tulongfeng과 Fugu를 출시하고 있습니다.
Google, Meta의 Gemini AI 모델 사용을 제한합니다
Google은 경쟁, 책임 있는 AI, 수익 문제를 이유로 Meta의 Gemini AI 모델 프로덕션 사용을 제한했습니다. 이로 인해 Meta의 Gemini‑의존 기능이 지연되고 AI 파트너십 역학이 재편될 수 있습니다.
DeepSeek DSpark 추론 최적화로 생성 속도 60–85% 향상
DeepSeek는 언어 모델 생성 속도를 60–85% 향상시켜 더 빠르고 비용 효율적인 배포를를 가능하게 하는 오픈 소스 추론 최적화 세트인 DSpark를 공개했습니다.