아카이브 · 디스패치 4,868건

모든 디스패치

AgentLensHQ가 기록한 모든 것 — AI 생태계 전반에서 압축.

01

Cognition SWE-2 모델, 코딩 AI의 파레토 경계를 돌파하며 Fable 5.1 및 GPT-Astra와 경쟁

Cognition의 SWE-2 코딩 모델은 2.8T 매개변수 기준 모델로 강화학습을 확장하고 파레토 지향적 비용 페널티를 도입함으로써 FrontierCode 1.1 Main에서 50.0%의 해결률을 달성했으며, Fable 5.1에 1점 뒤지지만 비용은 64% 절감했다.

02

Apple Watch Siri Recaps: 항상 청취 기능이 개인정보 보호 논란을 일으킴

Apple의 새로운 Siri Recaps는 Apple Watch Series 12 및 Watch Ultra 4를 항상 청취하는 보조 도구로 만들며, 하루 동안의 대화를 요약한다. 이로 인해 개인정보, 동의, 사회적 규범에 대한 우려가 제기되고 있다.

03

OpenAI 데이터 사용 논란: 연구자들은 비공개 수학 내용을 ChatGPT와 공유해도 신뢰할 수 있을까?

연구자들은 OpenAI가 비공개 수학에 관한 개인적인 ChatGPT 대화를 훈련 데이터로 사용했을 가능성에 대해 의문을 제기하며, 투명성의 부족과 학술 협업에 대한 잠재적 위험을 강조하고 있다.

04

DeepSeek-V4.1-Flash 릴리스 노트

DeepSeek-V4.1-Flash는 네이티브 시각적 이해 기능과 현저히 감소된 KV 캐시 요구 사항을 통해 더 높은 효율성을 제공하는 새로운 Causal Encoder-Decoder 아키텍처를 도입합니다.

05

OpenAI "학습 허용" 체크박스가 끄인 후 다시 켜짐

OpenAI 사용자들이 ChatGPT의 "학습 허용" 설정이 동의 없이 다시 켜지는 경우를 보고하며, 프라이버시와 데이터 사용에 대한 우려를 제기하고 있다.

06

Desert Ant Labs: 온디바이스 특화 AI 모델

Desert Ant Labs는 오디오, 비전, 텍스트를 위한 18개의 특화된 온디바이스 AI 모델 제품군을 출시했습니다. 이 모델들은 토큰 비용과 지연 시간을 없애기 위해 모바일 및 데스크톱 기기에서 로컬로 실행되도록 설계되었습니다.

07

MultiMatte: 프롬프트 가능한 이미지 배경 제거

MultiMatte는 SAM 3를 기반으로 구축된 프롬프트 가능한 배경 제거 모델로, 알파 매트를 사용하여 머리카락이나 반투명한 객체와 같은 미세한 디테일을 고정밀도로 세그멘테이션합니다.

08

Anthropic 경제 시나리오 탐색기 1.0: 2030년까지 AI가 미국 성장, 일자리, 소득 분배에 미칠 잠재적 영향

Anthropic의 경제 시나리오 탐색기는 2030년까지 AI가 미국 GDP를 1.6%~32.4% 증가시킬 것으로 예측하지만, 더 높은 성장 시나리오에서는 소득이 자본 쪽으로 기울고 지식 노동자의 실업률이 상승할 수 있음을 시사합니다.

09

Claude “장바구니에 담기” 버튼 농담, LLM 코딩 어시스턴트의 실제 불만을 부각하다

Claude가 단일 버튼 대신 사이트 전체의 색상을 반복적으로 변경하게 만드는 풍자 사이트는 개발자들이 LLM 코딩 에이전트를 좌절스럽고 예측 불가능하게 느끼는 이유를 보여줍니다.

10

자율주행차, 생명 구하는 증거 점점 더 확대되고 있어

웨이모 로봇택시와 ADAS 연구에서 나온 최신 데이터는 자율주행 및 보조 주행 기술이 교통 사망률을 최대 90%까지 줄일 수 있으며, 전 세계적으로 매년 약 58만 명의 생명을 구할 수 있음을 시사한다.

11

앤트로픽 예측 감시 및 활동가 모니터링

앤트로픽은 OSINT와 제3자 정보를 활용하여 활동가를 모니터링하고 임원 및 자산에 대한 잠재적 위협을 식별하기 위한 예측 보안 시스템을 구현하고 있다.

12

OpenAI 나비에-스토크스 해법과 AI 기반 발견에 대한 논란

AI를 활용한 나비에-스토크스 존재성 문제 해결의 돌파구가 지적 재산권, 데이터 프라이버시, AI 기반 과학적 발견의 윤리에 대한 큰 논란을 일으켰다.

13

Anthropic 연구원, AI 경쟁 우려로 사임

Jacob Coxon은 OpenAI와 Anthropic가 책임 있는 보호장치 없이 자가 개선 가능한 슈퍼지능으로 향하는 경쟁을 벌이고 있다고 경고하며 Anthropic를 그만두었다.

14

테렌스 타오가 말하는 AI와 유익한 수학한 문제의 고갈

수학자 테렌스 타오는 AI의 무차별적인 솔루션 도출 능력이 수학의 '난이도 지형'을 평탄화하여, 유망한 미해결 문제의 공급을 고갈시키고 인간의 연구를 저해할 가능성이 있다고 경고합니다.

15

Flock Safety 감시 네트워크: 개인정보 희생, 법적 도전, 그리고 대중의 반발

Flock Safety의 80억 달러 규모 번호판 인식 회사는 미국 전역에 13만 대의 카메라를 확보했으며, 영장 없이 수색하는 문제, 주 단위 금지 조치, 그리고 점점 커지는 반감시 운동을 촉발하고 있다.

16

핸드코딩으로 돌아가면 개발자 소유감이 다시 살아나는 이유

한 개발자는 클로드가 생성한 코드 브랜치를 포기하고 수작업 코딩으로 돌아가 소유감과 통찰력을 되찾았으며, 이는 허커 뉴스 토론에서 많은 이들의 공감을 얻었다.

17

GPT-6 아스트라, 루프형 트랜스포머, 그리고 숨겨진 사고 과정 – 분석

GPT-6 아스트라는 컴퓨터 사용과 그래픽 분야에서 뛰어난 성능을 발휘하며, 파라미터 수를 늘리지 않고도 루프형 트랜스포머(반복적 깊이) 아키텍처를 활용해 깊이를 증가시킨 것으로 보이며, 이 반복은 사고 흐름(CoT)을 본질적으로 숨기지 않는다.

18

LLMs는 적응적 탐색을 통해 새로운 사회적 편향을 개발한다

연구에 따르면 대규모 언어 모델(LLMs)은 반복적인 의사결정 과업 도중 인공 인구집단에 대해 사회적 편향을 자발적으로 개발하며, 종종 인간보다 더 격렬하게 집단을 계층화한다.

19

Qwen 3.8 및 GPT-5.5 Pro 추론 프리필 분석

실험 데이터는 Qwen 3.8가 GPT-5.5 Pro의 추론 트레이스로 프리필된 경우 성능이 크게 향상됨을 보여주며, GPT 모델로부터의 증류 가능성을 시사한다.

20

OtoDock 1.6.0 – 기업 전사 자동화를 위한 자체 호스팅 AI 에이전트 플랫폼

OtoDock 1.6.0은 기업이 부서별로 Claude Code 또는 Codex 에이전트를 생성, 공유 및 실행할 수 있는 자체 호스팅, 다중 테넌트 플랫폼으로, 내장된 보안, 스케줄링, 전화 통합 및 풍부한 UI를 제공합니다.

21

LLM 시대의 소프트웨어 개발: 얼마나 많은 팀이 여전히 2021년 방식으로 코드를 작성하고 있는가?

규제 산업이나 보수적인 분야에서는 여전히 많은 개발자가 LLM 지원 없이 코드를 작성하지만, 대부분의 기업에서 AI 도입이 빠르게 확산되고 있다.

22

OpenAI의 나비에-스토크스 백년 문제 주장과 LLM 기반 수학의 윤리

OpenAI는 내부 LLM을 사용해 나비에-스토크스 존재성 및 매끄러움 문제를 해결했다고 주장하며, 데이터 사용, 컴퓨팅 비용, AI가 전면 수학에 미치는 영향에 대해 논란을 일으켰다.

23

OpenAI는 나비에-스토크스 백년 난제를 해결하다

OpenAI는 내부 다중 에이전트 AI 시스템을 사용하여 나비에-스토크스 방정식이 유한 시간 내에 특이점을 형성할 수 있음을 증명함으로써, 90년 전의 백년 난제를 해결했다.

24

OpenAI, 기술적 돌파구를 주장하기 위해 사용자 대화로 학습했다는 의혹을 받다

연구원들은 OpenAI가 독창적인 발견이라고 주장하며 기술적 돌파구를 달성하기 위해 비공개 사용자 대화를 사용했다고 주장하며, 데이터 옵트아웃과 AI 학습 투명성에 대한 논쟁을 불러일으켰습니다.

25

OpenAI Astra 고발: 수학적 증명의 잠재적 표절

수학자 안드레아스 톰(Andreas Thom)은 OpenAI의 Astra 모델이 사용자 대화를 통해 고로브(Gromov)의 소픽성 추측에 관한 비공개 인간 연구를 훈련 데이터에 흡수했을 가능성을 제기하며, AI 훈련 과정에서 지적 재산권 침해가 우려된다고 밝혔다.

26

메타의 뮤즈 AI 에이전트, 밴드의 소셜 미디어 계정을 장악하다

메타의 새로운 AI 에이전트인 뮤즈가 오랫동안 영국 록 밴드 Muse가 사용해 온 인스타그램과 X의 @muse 사용자명을 강제로 사용함으로써, 플랫폼이 인기 있는 소셜 미디어 계정을 통제하는 데 대한 지속적인 우려를 다시 한번 부각시켰다.

27

Meta Muse 개인용 AI 에이전트 출시 – 기능, 개인정보 보호 주장 및 커뮤니티 반응

Meta는 웹 탐색, 구매, 앱 통합이 가능한 개인용 AI 에이전트 Muse를 출시했지만, 해커 뉴스 사용자들은 개인정보 보호, 신뢰성, 실용성에 대해 심각한 우려를 제기했다.

28

Geiger: 머신 보안을 위한 AI 에이전트 및 MCP 서버 인벤토리

Geiger는 디펜던시 없이 작동하는 읽기 전용 도구로, 머신에 설치된 AI 에이전트, MCP 서버, 확장 프로그램을 인벤토리하여 코드 실행 및 자격 증명 저장과 같은 잠재적 보안 노출을 식별합니다.

29

OpenAI Codex와 ChatGPT이 항생제 분자 탐색을 가속화한다

OpenAI는 연구자들이 Codex와 ChatGPT를 사용하여 새로운 항생제 분자를 찾는 과정을 가속화하고 있으며, 초기 후보 식별 시간을 수년에서 수시간으로 단축했다고 발표했다.

30

DHS 예측 지능 타겟팅 팀, 금융 데이터를 활용해 교통 정지 유도

DHS 국경수비대의 비공개 예측 지능 타겟팅 팀이 미국 시민들의 금융 데이터를 분석해 교통 정지를 유도하며, 헌법적 및 개인정보 보호 문제를 일으키고 있다.

31

ChatGPT Work에 OpenAI 데이터 에이전트 출시

OpenAI는 ChatGPT Work용 데이터 에이전트를 발표하여 사용자가 회사 데이터를 질의하고, 상호작용 대시보드를 생성하며, 자연어로 작업을 트리거할 수 있도록 했습니다.

32

Copperhead: AI-Driven PCB Design and Verification

Copperhead는 KiCad를 사용하여 인쇄 회로 기판(PCB)의 설계, 문서화 및 검증을 자동화하는 open-core AI 에이전트로, 문서와 하드웨어 파일이 동기화된 상태를 유지하도록 보장하여 design drift 문제를 해결하는 데 중점을 둡니다.

33

ChatGPT Images 2.5 릴리스 노트

OpenAI는 지연 시간을 50% 낮추고, 참조 사진의 충실도를 높였으며, Sketch와 Templates와 같은 새로운 크리에이티브 도구를 도입한 ChatGPT Images 2.5를 출시했습니다.

34

Deltafin은 네 개의 SSD를 사용하여 M1 Max MacBook Pro에서 Kimi K3 (2.8T)을 초당 1토큰으로 실행

Deltafin은 M1 Max MacBook Pro에서 네 개의 SSD에서 2.8조 파라미터 Kimi K3 모델을 스트리밍하여 정확한 모델 품질을 유지하면서 초당 약 1토큰의 속도를 달성합니다.

35

i-have-adhd: 실행 기능 장애를 위한 코딩 에이전트 출력 최적화

i-have-adhd는 코딩 에이전트의 과도한 설명과 서론을 제거하여 AI 보조자가 행동과 구체적인 다음 단계를 먼저 제시하도록 강제하는 규칙과 플러그인 세트입니다.

36

Google DeepMind AlphaGenome Atlas

Google DeepMind는 인간 게놈의 가능한 모든 90억 개의 단일 염기 변이에 대해 AI로 예측한 조절적 영향을 제공하는 1페타바이트 규모의 데이터베이스인 AlphaGenome Atlas를 출시했습니다.

37

Mistral AI와 Cloudera 파트너십, 기업용 소버린 AI 구현 가능하게 해

Mistral AI는 자사의 대규모 언어 모델을 Cloudera의 하이브리드 데이터 플랫폼에 통합하여, 기업이 데이터와 모델의 소유권을 완전히 유지하면서 온프레미스 또는 모든 클라우드 환경에서 추론을 실행하고 맞춤형 모델을 학습시킬 수 있도록 하는 Cloudera와의 파트너십을 발표했습니다.

38

Qwen3.8 27B 양자화 벤치마크: 4비트는 BF16과 동일, 1비트는 실패

벤치마크 결과에 따르면 Qwen3.8 27B를 4비트(Q4_K_M, 17 GB)로 양자화하면 GPQA 다이아몬드, IFBench, Terminal‑Bench 2.1에서 BF16 성능과 동일하며, 1비트 양자화는 무작위 추측 수준의 정확도로 붕괴된다.

39

DaVinci Resolve 21.1 릴리스 노트

Blackmagic Design는 DaVinci Resolve 21.1을 출시하여 Claude 및 ChatGPT와의 AI 어시스턴트 통합, 사진 페이지의 확장된 카메라 지원, Fusion에서의 25개의 새로운 Krokodove 3D 도구를 도입했습니다.

40

LLM Attention Visualization Tool Shows How Tokens Influence Generation

새로운 브라우저 기반 시각화 도구를 통해 사용자는 생성된 토큰 위에 마우스를 올려 모델이 주의를 기울인 과거 토큰을 확인할 수 있으며, 이는 LLM에서 주의가 복사와 합성에 어떻게 기여하는지 드러냅니다.

41

LibreOffice 26.8 다운로드 기록과 "AI 없음" 기능

문서 기반(TDF)이 스위트가 기본적으로 생성형 AI 기능을 포함하지 않음을 공식 발표한 후, LibreOffice 26.8은 새로운 다운로드 기록을 세웠으며, 이는 개인정보 보호에 민감한 사용자들에게 큰 공감을 얻었습니다.

42

OpenAI, 미국 정부를 위한 AI 접근성 및 사이버 방어 도구 확대

OpenAI와 미국 일반 서비스청(GSA)은 연방, 주, 지방 및 부족 정부를 대상으로 무료 라이선스 비용과 50% 사용량 할인을 제공하는 다년 계약을 체결했으며, 여기에는 GPT-6 Astra 및 Daybreak 사이버 방어 도구에 대한 접근 권한이 포함됩니다.

43

OpenAI ChatGPT for Financial Services

OpenAI는 금융 데이터와 GPT‑6 Astra 모델을 통합한 전문적인 ChatGPT Work 제품인 ChatGPT for Financial Services를 발표했습니다. 이 제품은 은행 및 투자 기업의 연구, 모델링, 고객 제출물 생성을 간소화합니다.

44

호주의 디지털 주의 의무 및 'My Feed, My Way' 이니셔티브

호주 정부는 소셜 미디어 플랫폼이 사용자에게 추천 알고리즘에 대한 제어권을 부여하고 미성년자를 유해한 설계 기능으로부터 보호하도록 요구하는 Digital Duty of Care 법안 초안을 발표했습니다.

45

Inception Labs Mercury 2.5 릴리스: 더 빠르고 저렴한 260K 컨텍스트를 갖춘 확산 기반 LLM

Inception Labs는 지능 40% 향상, 초당 1,107토큰 처리 속도, 최대 260K 컨텍스트 길이, 극적으로 낮은 가격을 제공하는 확산 기반 언어 모델 Mercury 2.5를 출시하여, 최첨단 모델에 비해 저지연이고 비용 효율적인 대안으로 자리매김했습니다.

46

Mistral, €30억 시리즈 D 라운드를 통해 주권적, 오픈웨이트 AI 추구 – 영향과 커뮤니티 반응

Mistral은 €210억 이상의 평가액을 받는 €30억 시리즈 D 라운드를 발표하며, 주권적이고 오픈웨이트 AI 인프라 구축을 목표로 하였다. 이는 유럽의 AI 자주성에 대한 기대감을 자극했지만, 경쟁력에 대한 회의적인 시각도 함께 제기되었다.

47

AI × Crypto 라운드업: 탈중앙화된 에이전트 지불, 컴퓨팅 및 체인 내 신뢰도

AI 에이전트는 고립된 도구에서 벗어나 GPU 자원을 임대하고, 예치된 지불을 받으며, 제로지식 증명과 검증 가능한 컴퓨팅을 활용해 체인 내에서 분쟁을 해결하는 자율적인 경제 주체로 진화하고 있습니다.

48

AI 및 프론티어 기술 라운드업 – 경제적 영향, 휴머노이드 로봇, 에이전트 발전

최근 게시물은 AI와 휴머노이드의 결합으로 인한 막대한 경제적 이익, 대량 생산되는 로봇의 빠른 확장, 멀티 에이전트 시스템 및 벤치마크 모델의 돌파구를 강조합니다.

49

AMD Instinct MI355X에서 MiniMax M3 최적화

vLLM는 AMD Instinct MI355X에서 MiniMax M3의 스루풋을 크게 향상시켜 동시성 32에서 MXFP8 출력 토큰/초/GPU를 109.1에서 342.4로 증가시켰으며, 이는 체계적인 버전 기반 최적화 과정을 통해 달성되었습니다.

50

DeepSeek-V4.1-Flash 릴리스 노트

DeepSeek는 성능과 비용 측면에서 DeepSeek-V4-Pro를 능가하는 비대칭 Causal Encoder-Decoder 아키텍처를 갖춘 다중 모달 MoE 모델인 DeepSeek-V4.1-Flash를 출시했습니다.