아카이브 · 디스패치 1,878건

Hacker News

커뮤니티가 이미 투표를 마쳤습니다. 댓글까지 읽습니다 — 토론을 가져오지 못한 글은 아예 디스패치가 되지 않습니다. 게다가 한 번 쓰고 끝이 아닙니다. 토론이 계속 달아오르면 그 사이 올라온 댓글까지 담아 다시 씁니다.

1051

Anthropic Claude 서비스 중단: 여러 모델에서 오류율 상승

2026년 6월 23일, Anthropic은 서비스 중단을 겪으며 claude.ai, Claude API 및 관련 개발자 도구 전반에 걸쳐 오류율이 상승했습니다.

1052

Qwen-AgentWorld: 일반 에이전트를 위한 언어 세계 모델

Qwen-AgentWorld는 7개 도메인에서 에이전트 환경을 시뮬레이션할 수 있는 언어 세계 모델을 도입하여 에이전트의 추론, 계획 및 강화 학습을 향상시킵니다.

1053

OpenAI Daybreak 및 GPT-5.5-Cyber 출시

OpenAI는 GPT-5.5-Cyber 모델과 Codex Security 플러그인을 포함한 사이버 보안 도구 모음인 Daybreak를 출시하여, 취약점 발견에서 자동 패치로 사이버 보안 병목 현상을 이동시키도록 설계되었습니다.

1054

VibeThinker-3B: 소형 언어 모델에서 프론티어 수준의 추론 달성

VibeThinker-3B는 Spectrum-to-Signal 사후 학습 패러다임을 활용하여 AIME26에서 94.3점, LiveCodeBench v6에서 80.2 Pass@1을 기록하며 프론티어 수준의 추론 성능을 달성하는 3B 파라미터 모델입니다.

1055

AI 채용에서의 알고리즘 단일문화: 인종적 편향과 체계적 거절

Stanford HAI의 연구에 따르면, 단일 AI 채용 벤더에 대한 광범위한 광범위한 의존도는 인종적 편향을 증폭시키고 후보자를 여러 채용 기회로부터 체계적으로 차단하는 알고리즘 단일문화를 생성할 수 있습니다.

1056

Anthropic, 연령 및 신원 확인을 포함하도록 서비스 약관 업데이트

Anthropic은 연령 및 신원 확인을 구현하기 위해 개인정보 보호 약관을 업데이트했으며, 이는 사용자 개인정보 보호, 감시, 그리고 독점적 AI 모델의 역할에 대한 논쟁을 불러일으켰습니다.

1057

Baidu Unlimited-OCR: One-Shot Long-Horizon Parsing

Baidu는 VRAM 고갈 없이 대규모 문서를 처리하기 위해 Reference Sliding Window Attention을 사용하는 장기 문서 파싱용 모델인 Unlimited-OCR을 출시했습니다.

1058

Fable과 Mythos 분석: LLM 벤치마킹에서의 성능 및 역량

사용자 토론 및 벤치마크에 따르면, Fable 모델은 Opus 및 GPT-5.5 Pro와 같은 다른 고성능 LLM에 비해 우수한 끈기, 공간 추론 및 버그 탐지 역량을 보여줍니다.

1059

Anthropic Claude Code 계정이 VPN 사용 후 차단 – 사용자가 해결 방안을 찾고 있음

사용자가 VPN을 사용한 뒤, 동일한 결제 카드를 사용해 다시 가입했을 때 Anthropic Claude Code 서비스에서 차단되었습니다. 지원팀은 일반적인 정책 위반 답변만 제공했습니다.

1060

y Coding Agent Desktop App

`y`는 보호된 Modify 표면을 통해 앱 자체의 UI를 실시간으로 수정하면서 `Claude Code` 및 `Codex`와 같은 로컬 코딩 에이전트를 실행할 수 있는 가변적인 Electron 기반 데스크톱 작업 공간입니다.

1061

GLM-5.2 로컬 실행: 하드웨어 요구 사항 및 성능 트레이드오프

GLM-5.2를 로컬에서 실행하려면 상당한 하드웨어가 필요하며, 일반적으로 MoE 오프로드를 위해 256GB RAM과 24GB VRAM이 요구됩니다. 성능은 양자화 수준 및 하드웨어 구성에 따라 크게 달라집니다.

1062

2026년 소프트웨어 엔지니어링 고용 현황

경험 많은 소프트웨어 엔지니어들은 AI 기반 선별 필터, 거시경제 불안정성, 그리고 주니어 인재 파이프라인 감소라는 특징을 가진 변동성 높은 직업 시장에 직면하고 있습니다.

1063

Claude Code Extended Thinking: Hidden Reasoning and the Summary Illusion

Claude Code는 암호화된 추론 블록을 사용하고 사고 과정의 요약본만 사용자에게 제공함으로써 감사 가능성, 보안, 그리고 모델 증류 방지와 관련된 우려를 제기합니다.

1064

Moebius: 0.2B 경량 이미지 인페인팅 프레임워크

Moebius는 0.22B 파라미터 이미지 인페인팅 모델로, FLUX.1-Fill-Dev와 같은 11.9B 파라미터 모델에 필적하는 성능을 제공하면서 15배 이상의 빠른 추론을 구현합니다.

1065

Chevron과 Microsoft, 서부 텍사스 데이터 센터를 위한 Project Kilby 전력 협약 발표

Chevron과 Microsoft는 AI 데이터 센터를 위한 전용 전력을 공급하기 위해 서부 텍사스에 2.67 GW 천연가스 발전 시설인 Project Kilby를 개발하기 위한 20년 전력 구매 계약을 체결했습니다.

1066

Neural Particle Automata: Learning Self-Organizing Particle Dynamics

Neural Particle Automata (NPA)는 SPH 기반 인식을 사용하여 연속적인 위치와 내부 상태를 가진 입자들이 불규칙하고 동적인 구성에서 자기 조직화할 수 있도록 하여 Neural Cellular Automata를 확장합니다.

1067

Prompt Injection as Role Confusion

Research reveals that prompt injections succeed because LLMs rely on writing style rather than structural role tags to identify instructions, allowing attackers to spoof privileged roles like internal reasoning.

1068

Oak v0.99.0: AI 에이전트를 위해 설계된 Git 대체제

Oak v0.99.0은 콘텐츠‑주소 기반 버전 관리 시스템으로, 지연 마운트, 세션당 브랜치 작업 단위, 기계‑읽기 가능한 JSON 인터페이스를 통해 에이전트 중심 워크플로를 최적화합니다.

1069

GLM-5.2 vs Claude Opus 4.8: 비용‑효율적인 오픈 모델 vs 더 빠른 클로즈드 모델의 3D WebGL 게임 테스트

GLM-5.2는 Claude Opus 4.8에 비해 비용의 극히 일부만으로 3D WebGL 플랫폼 게임을 구축하지만, Opus는 더 빠르게 작업을 마치고 더 깔끔하고 정확한 게임을 제공합니다.

1070

OpenAI Codex 로깅 버그: 과도한 SSD 쓰기와 해결 방법

OpenAI Codex에서 보고된 중요한 로깅 버그는 무제한 SQLite 추적 로그를 통해 로컬 SSD에 테라바이트 단위 데이터를 기록하게 하여, 디스크 마모와 성능 문제를 크게 야기합니다.

1071

Open LLM 모델로의 전환: 비용, 트레이드오프, 그리고 Linux 비유

Andrew Marble은 Claude와 GPT 같은 폐쇄형 LLM에서 오픈 웨이트 모델로의 전환을 설명하며, 성능 격차는 좁혀지고 있으며 개인정보 보호와 자율성 측면의 이점이 단기적인 생산성 저하를 상쇄한다고 주장합니다.

1072

Recall: Claude Code용 로컬 프로젝트 메모리

Recall은 세션을 자동으로 기록하고 로컬 Python 요약기를 사용해 압축된 토큰 효율적인 컨텍스트 다이제스트를 생성함으로써, Claude Code용 완전 로컬 플러그인으로 지속 가능한 프로젝트 메모리를 제공합니다.

1073

Selector Forge: 탄력적인 CSS 및 XPath 선택자를 위한 AI 기반 브라우저 확장 프로그램

Selector Forge는 Chrome 및 Firefox용 브라우저 확장 프로그램으로, AI를 활용해 웹 스크래핑 및 엔드‑투‑엔드 테스트에 적합한 탄력적인 CSS 및 XPath 선택자를 생성하고 검증합니다.

1074

사카나 푸구: 최첨단 AI 성능을 위한 다중 모델 오케스트레이션

사카나 푸구는 여러 최첨단 LLM에 작업을 라우팅하는 오케스트레이션 레이어로, 단일 모델 공급자에 의존하지 않으면서 고성능 AI를 제공합니다.

1075

Apertus: 주권적 AI를 위한 오픈 파운데이션 모델

Apertus는 주권적 AI 개발을 위해 투명하고 EU AI Act를 준수하는 기반을 제공하기 위해 Swiss AI Initiative에 의해 개발된 완전한 오픈 파운데이션 모델입니다.

1076

Anthropic, Claude를 위한 신원 확인 도입

Anthropic은 남용 방지를 위해 특정 Claude 사용 사례에 대해 Persona Identities를 통한 신원 확인을 도입하며, 이는 사용자 프라이버시 우려를 심화시키고 있습니다.

1077

Qwen 3:0.6B 모델을 질문 분류를 위해 파인튜닝하기

기술 실험을 통해 Unsloth와 불투명 ID 매핑을 사용해 0.6B 파라미터의 작은 Qwen 3 모델을 파인튜닝하면 질문 분류 정확도가 10%에서 92%로 향상됨을 보여줍니다.

1078

CleverCrow: 오픈 소스 유지보수자를 위한 커뮤니티 지원 AI 코딩 에이전트

CleverCrow는 커뮤니티 구성원들이 자금을 모아 AI 코딩 에이전트의 LLM 토큰 비용을 충당하도록 함으로써, 유지보수자가 직접 컴퓨팅 비용을 지불하지 않고도 백로그 이슈를 해결할 수 있게 하는 플랫폼입니다.

1079

Pulse: Claude Code 도구 호출 승인을 위한 로컬 대시보드

Pulse는 Claude Code 터미널 세션을 위한 시각적 대시보드를 제공하도록 설계된 로컬 애플리케이션으로, 사용자가 토큰 사용량, 세션 비용을 추적하고 모바일 기기에서 원격으로 도구 호출을 승인할 수 있게 해줍니다.

1080

신뢰할 수 있는 에이전트형 AI 시스템 구축: Bayer의 PRINCE 플랫폼 사례 연구

Bayer는 LangGraph와 다중 에이전트 아키텍처를 활용한 에이전트형 RAG 시스템인 PRINCE를 개발해 복잡한 전임상 약물 발견 데이터를 신뢰할 수 있는 대화형 연구 보조자로 전환했습니다.

1081

작동하더라도 AI 생성 코드를 거부해야 할 때

소프트웨어 엔지니어는 장기적인 기술 부채를 방지하기 위해 AI 생성 코드를 검토할 때 즉각적인 기능성보다 유지보수성 및 개념적 이해를 우선시해야 합니다.

1082

AI 에이전트를 위한 Cloudflare 임시 계정

Cloudflare는 AI 에이전트가 Cloudflare 서비스에 안전하고 자동화된 액세스를 위해 수명이 짧은 자격 증명을 획득할 수 있게 하는 임시 계정을 도입했습니다. 이는 보안을 유지하면서 마찰을 줄여줍니다.

1083

AI 콘텐츠의 균일성: Amazon Slop에서 LLM 패턴 식별

LLM의 준결정적 특성이 ‘AI slop’이라는 인식 가능한 패턴을 어떻게 만들어내는지 분석했으며, 이는 Amazon에서 거의 동일한 어린이 책이 급증한 사례로 보여진다.

1084

ArgusRed: 보안 스캐닝 및 침투 테스트를 위한 사후 학습된 AI 모델

ArgusRed는 범용 LLM의 일반적인 거부 현상 없이 정적 코드 분석(Security Scan)과 능동적 익스플로잇 검증(Pen Test)을 모두 수행하는 사후 학습된 AI 모델을 특징으로 하는 보안 도구입니다.

1085

LLM 아키텍처의 증가하는 복잡성

현대의 대형 언어 모델(LLM)은 간단한 Transformer 스택에서 복잡하고 하이브리드한 아키텍처로 이동하고 있으며, 이는 추천 시스템의 역사적 진화를 반영한다.

1086

Kent Beck: 주니어 엔지니어가 작업 완료에서 고영향력 성과로 전환하는 방법

Kent Beck은 시니어 엔지니어들이 주니어 엔지니어의 단순한 작업 완료 수보다 학습, 시스템 개선, 그리고 생산성의 ""first derivative""를 더 가치 있게 여긴다고 주장한다.

1087

Anthropic Mythos와 Fable 수출 통제: 사이버 수출 실패의 역사

미국 정부가 Anthropic에게 Fable 및 Mythos AI 모델의 수출을 제한하도록 최근 명령한 것은 사이버 수출 통제의 비효율성을 반복하는 사례이며, 이는 과거 PGP 암호화와 감시 스파이웨어에서의 실패와 유사합니다.

1088

GPT-5.5 및 GLM-5.2: 모델 크기와 환각 사이의 상관관계 분석

기술 분석 결과, GPT-5.5 및 DeepSeek V4 Pro와 같은 대규모 모델은 MIT 라이선스 기반의 더 작은 모델인 GLM-5.2에 비해 AA-Omniscience 벤치마크에서 더 높은 환각률을 보이는 것으로 나타났습니다.

1089

현대·보스턴 다이내믹스 전면 인수

현대자동차그룹은 소프트뱅크가 보유한 보스턴 다이내믹스의 남은 9.65% 지분을 3억 2500만 달러에 매입해 전면 통제권을 확보했으며, 이를 통해 Atlas 인간형 로봇을 2028년까지 전기차 제조에 통합할 계획입니다.

1090

메모리 부족이 더 효율적인 프로그래밍을 유도할까요?

소프트웨어 개발자와 업계 전문가들은 메모리 비용 상승이 자원 효율적인 코딩으로의 회귀를 유도할지, 아니면 시장 인센티브와 아키텍처적 비대화가 현상 유지를 지속할지 논쟁하고 있습니다.

1091

노르웨이, 인지 발달 보호를 위해 초등학교 내 AI 사용 금지

노르웨이 정부는 기초적인 읽기, 쓰기, 이해 능력을 숙달하기 위해 6세에서 13세 학생들을 대상으로 AI 사용에 대해 사실상 전면 금지 조치를 시행했습니다.

1092

AI와 전문 기술의 위축: 탈숙련 논쟁 분석

AI가 핵심 전문 기술을 침식하고 있는지에 대한 논의로, 고수준 생산성 증대와 기본 기술 전문성 상실 사이의 긴장을 강조합니다.

1093

John Jumper가 Google DeepMind를 떠나 Anthropic으로 이직함

AlphaFold 팀 리더인 John Jumper가 9년 만에 Google DeepMind를 떠나 AI 안전 및 연구 기업인 Anthropic에 합류했습니다.

1094

아마존, OpenAI 파트너십 발표 후 Sam Altman 전기 영화 취소

아마존은 OpenAI와의 새로운 파트너십 이후 Sam Altman 전기 영화 제작을 중단했으며, 기업 제휴가 엔터테인먼트 프로젝트를 급격히 재구성할 수 있음을 강조한다.

1095

VLA 모델을 위한 데스크톱 로봇 연구 환경 구축

개발자 mplappert는 Vision-Language-Action (VLA) 모델 훈련 및 원격 조작을 위해 설계된 로컬 로봇 연구 스테이션 구축 과정을 설명하며, ROS2와 같은 산업 표준보다 커스텀 소프트웨어 스택을 강조합니다.

1096

Model Context Protocol Enterprise-Managed Authorization 출시

Model Context Protocol (MCP)는 안정적인 Enterprise-Managed Authorization (EMA) 확장을 출시하여, 기업 사용자를 위한 중앙 집중식 ID 제공자 (IdP) 제어 및 Zero-touch OAuth를 가능하게 합니다.

1097

Are You in the Weights: 개인에 대한 LLM 인식 분석

‘Are You in the Weights’ 도구는 여러 모델을 병렬로 질의하고 응답을 클러스터링함으로써 최첨단 및 소형 LLM이 사용자를 얼마나 인식하는지 확인할 수 있게 해줍니다.

1098

DeepSeek 비전 기능 도입

DeepSeek는 채팅 인터페이스에 비전 기능을 통합하여 모델이 텍스트 추출만이 아니라 이미지 내용을 이해하고 설명할 수 있게 했습니다.

1099

Midjourney 의료: AI 기반 전신 초음파 스캔

Midjourney는 고속 AI 기반 초음파 스캐너를 통해 빈번하고 낮은 마찰의 체성분 매핑을 고급 스파 환경에서 제공하며 의료 분야로 확장하고 있습니다.

1100

Noam Shazeer OpenAI 합류

Transformer 공동 저자인 Noam Shazeer가 Character.AI로부터 그를 데려오기 위해 Google이 수십억 달러를 들인 노력 이후, Google을 떠나 OpenAI에 합류하며 AI 산업의 중대한 인재 이동을 나타냈습니다.