封存 · 1,880 篇 dispatch

Hacker News

社群已經替你投過票。我們連留言一起讀——討論抓不到的故事根本不會成篇。而且它不是寫完就定稿:討論繼續升溫,這篇 dispatch 就連同新出現的留言重寫一次。

951

Oomwoo:一個開源、DIY 機器人吸塵器專案

Oomwoo 是一個開源機器人吸塵器,採用社群驅動開發、3D 列印與模組化軟體,提供可維修、無雲端的商業吸塵器替代方案。

952

定理經濟的衰落:AI 與數學理解危機

David Bessis 主張,AI 解決定理的能力威脅到「定理經濟」,因為它使形式證明與人類理解脫鉤,可能使傳統的學術獎勵制度變得過時。

953

claude-real-video: 透過場景感知幀提取讓 LLM 能夠觀看影片

claude-real-video 是一款開源工具,透過在本地提取具備場景感知能力且去重後的幀與逐字稿,讓任何 LLM 都能分析影片,從而避免了固定間隔採樣的局限性。

954

日本最高法院裁定 AI 不能在專利申請中列為發明人

日本最高法院裁定,只有人類才能在專利申請中列為發明人,駁回了將人工智慧系統認定為法律發明人的請求。

955

Weave Robotics Isaac 1 家用機器人

Weave Robotics 推出了 Isaac 1,這是一款售價 7,999 美元的家用機器人,專為洗衣和整理而設計,預計於 2026 年秋季開始交付。

956

ZCode Harness for GLM-5.2 概覽

ZCode 為 GLM-5.2 模型推出了 harness,提供了一個即插即用的介面,簡化了部署與實驗流程。

957

Senior SWE‑Bench:評估 AI 代理人作為資深軟體工程師的能力

Senior SWE‑Bench 是一個開源基準,旨在評估 AI 代理人在從不完整需求實作功能的能力,模擬資深軟體工程師的工作流程。

958

Claude Fable 5 發佈與用戶回饋

Anthropic 重新推出了 Claude Fable 5 模型,但此次發佈因限制性的使用量限制、激進的安全防護機制,以及用戶對定價與存取權限的顯著不滿而蒙上陰影。

959

Valmis: 一款具備安全優先代理架構的開源 AI Agent 框架

Valmis 是一款專為生產環境設計的開源 AI agent 平台,其特色是具備安全代理系統,可將 agent runtime 與 API 憑證及主機檔案隔離。

960

CursorBench 3.1:在真實任務中評估 AI 程式編寫代理人

CursorBench 3.1 以真實 Cursor 會話中的模糊、多檔案任務評估 AI 程式編寫代理人,目前 Fable 5 Max 在效能上領先。

961

Claudoro: Claude Code 專用的番茄鐘計時器

Claudoro 是一款功能豐富的番茄鐘計時器,直接嵌入於 Claude Code 狀態列中,透過將時間追蹤保持在終端機內,消除了情境切換。

962

Cloudflare Monetization Gateway and x402 Protocol

Cloudflare 推出了 Monetization Gateway,這是一個允許網站所有者透過使用穩定幣與開放的 x402 微支付協定,向 AI agent 和用戶收取數位資源費用工具。

963

Godot Engine 禁止 AI 撰寫的程式碼貢獻

Godot Engine 基金會已禁止 AI 撰寫的程式碼貢獻,以防止維護者倦怠並確保貢獻者理解其提交的程式碼。

964

Claude Fable 5 重新部署與 AI 資安框架

Anthropic 隨美國出口管制解除後,正在全球重新部署 Claude Fable 5,並推出一套用於評估 AI 越獄嚴重程度的新產業框架。

965

Anthropic Claude Fable 5 與 Mythos 5 出口管制已解除

美國商務部已解除對 Anthropic 的 Claude Fable 5 與 Mythos 5 模型的出口管制,前提是已就安全風險偵測與政府協調達成協議。

966

Claude Sonnet 5 發布說明

Anthropic 發布了 Claude Sonnet 5,這是一款針對代理工作流優化的模型,其性能接近 Opus 4.8,且價格更低廉。

967

亨利科縣能源危機:資料中心擴張與電費上漲

弗吉尼亞州亨利科縣要求政府員工與學校在電費上漲 25% 後節約用電,該漲幅將在下一財政年度使縣政府成本估計增加 500 萬美元。

968

Leanstral 1.5 發佈說明

Mistral AI 已發佈 Leanstral 1.5,這是一個擁有 119B 參數的專用模型,針對 Lean 4 形式化證明工程、自動定理證明和自動形式化進行了優化。

969

Claude Code 2.1.196 提示詞隱寫術發現

分析 Claude Code 2.1.196 版本顯示,該工具在系統提示詞中使用隱寫標記來識別 API 轉售商與自定義閘道器。

970

Claude Science Beta Release

Anthropic 已推出 Claude Science 公開測試版,這是一個 AI 原生研究環境,整合了科學資料庫、運算基礎設施和代理式事實查核,以簡化從原始資料到發表的流程。

971

Nano Banana 2 Lite 發佈說明

Google DeepMind 發佈了 Nano Banana 2 Lite,這是一款高速、具成本效益的圖像生成與編輯模型,旨在用於快速迭代與即時應用整合。

972

Meta Brain2Qwerty: 非侵入式腦部轉文字通訊

Meta 的 Brain2Qwerty 研究展示了一種將腦波轉換為文字的非侵入式方法,利用先進的 AI 來改善運動障礙人士的通訊能力。

973

AI 時代下技術熟悉度的侵蝕

一篇關於從高摩擦運算轉向 AI 驅動的無縫體驗,如何將與機器搏鬥的「親密熟悉度」替換為對不透明抽象化的依賴之反思。

974

南韓宣布 1 兆美元投資記憶體晶片、資料中心與類人機器人

南韓承諾投入 1 兆美元,於 2028 年前擴大記憶體晶片產能、建置 AI 資料中心,並商業化類人機器人,以確保在實體 AI 領域的全球領先。

975

Qwen 3.6 27B:本地 LLM 開發的最佳切入點

Qwen 3.6 27B 正逐漸成為一款高度能幹的本地模型,兼具智慧與效能,然而其硬體需求引發了本地與雲端推理成本效益的討論。

976

Moondream Photon: 透過管線化解碼消除 GPU Bubble

Moondream 的 Photon 推論引擎透過使用管線化解碼來重疊 CPU 維護工作與 GPU 計算,在 NVIDIA B200 GPU 上將解碼吞吐量提升了高達 35%。

977

LongCat-2.0 MoE Model Analysis

LongCat-2.0 是一個大規模混合專家 (MoE) 模型,具有 1.6 兆總參數與 480 億活躍參數,是使用 AI ASIC superpods 開發的。

978

Cursor iOS 應用在未取得同意的情況下切換使用者至新隱私模式

安裝 Cursor iOS 應用會自動將帳號從舊版「不儲存我的程式碼」隱私模式切換至較寬鬆的新模式,且舊版選項在應用內無法恢復。

979

Tidal AI 政策:AI 生成音樂的去貨幣化

Tidal 推出新 AI 政策,允許平台上存在 AI 生成的音樂,但禁止其貨幣化,以確保版稅保留給人類藝術家。

980

Ornith-1.0: 用於代理編碼的自我改進開源模型

Ornith-1.0 是一套採用 MIT 授權的自我改進開源模型(9B、35B 和 397B),專為代理編碼設計,是在 Gemma 4 和 Qwen 3.5 的基礎上進行後訓練而成的。

981

三星、SK Hynix 與美光在美國因記憶體價格操縱被起訴

三星、SK Hynix 與美光面臨美國訴訟,指控他們協同減少 DRAM 供應並停產舊有記憶體標準以抬高價格。

982

ZLUDA 6 發佈:在非 NVIDIA GPU 上執行未經修改的 CUDA 應用程式

ZLUDA 6 引入了對 32-bit PhysX 的支援、Blender 的基礎紋理支援,以及顯著提升了在非 NVIDIA 硬體上執行 CUDA 應用程式的 Windows 易用性。

983

與 AI 共事:巫師學徒問題的一個具體案例

Carson Gross 透過 hyperscript 解析器中一個真實世界的錯誤修復案例,探討了 AI 在軟體開發中的優缺點,並強調了盲目接受 AI 提出的解決方案的危險性。

984

當執行 CUDA 核心時會發生什麼事:從原始碼到 SASS

深入探討 CUDA 核心的生命週期,從 nvcc 編譯、PTX/SASS 產生一路追溯到 RTX 4090 上的硬體層級執行。

985

HackerRank 招聘代理:AI 簡歷篩選非決定性的分析

對 HackerRank 開源 hiring-agent 工具的分析揭示了顯著的分數不一致性與設計缺陷,同一份簡歷在多次執行中可能得到截然不同的分數。

986

Bash4LLM+ 概覽:輕量級的 Bash 包裝器,用於 LLM API

Bash4LLM+ 是一個無依賴、具安全性的 Bash 腳本,提供 Groq 與其他相容 OpenAI 的 LLM API 的 CLI 包裝器,具備會話管理與 UI 狀態系統。

987

AI 在布朗大學的欺詐行為:帶回家考試的終結

Serrano 教授譴責了布朗大學數學經濟學考試中大規模的 AI 驅動作弊行為,這標誌著 AI 時代學術誠信與評估方法的關鍵轉變。

988

使用 Claude Code 與 Opus 4.8 進行 MRI 分析:AI 第二意見的案例研究

技術性地探索使用 Claude Code 與 Opus 4.8 分析 DICOM MRI 資料,強調了 AI 驅動與人類醫療診斷之間的顯著差異。

989

AI 投資熱潮與全球金融崩潰的風險

央行官員與金融分析師警告,超大規模雲服務商在 AI 基礎設施上的過度投資若未能產生回報,或供給端瓶頸推升通膨,皆可能觸發全球金融危機。

990

GLM 5.2 在 IDOR 漏洞檢測基準測試中的表現

在 Semgrep 進行的基準測試中,開源權重模型 GLM 5.2 在使用極簡提示詞架構的情況下,檢測不安全直接物件參照 (IDOR) 漏洞的表現優於 Claude Code。

991

Herdr – Terminal‑Based Agent Multiplexer for Managing Multiple AI Bots

Herdr 是一款終端機原生型的 agent 多路複用器,讓開發者能從單一命令列介面啟動、切換並與多個 AI agent 進行互動,從而簡化工作流程並減少上下文切換。

992

歷史記憶體價格 1960‑2026:趨勢與 AI 影響

對 1960 至 2026 年間記憶體與儲存裝置價格的全面分析,突顯每 GB 成本的長期下降趨勢,以及 AI 對 HBM 與 DRAM 需求所帶來的近期波動。

993

Tokenmaxxing 的演變:從強制採用到複合正確性

Tokenmaxxing 正從一種用於強制 AI 採用的粗糙管理工具,轉變為一種策略性技術方法;在此方法中,透過迭代迴圈增加代幣支出,可提升準確度。

994

對無 AI 科技新聞來源的需求

技術社群中越來越多的成員正尋求新聞過濾器與替代平台,以擺脫主流科技媒體與論壇中 AI 相關內容的飽和狀態。

995

OpenAI Codex: 關於敏感檔案排除的爭議

OpenAI Codex 的一項開源議題討論,突顯了使用者要求的 '.agentignore' 檔案與技術現實之間的根本衝突:只有 OS 層級的沙箱化才能真正防止基於 LLM 的 agent 能夠存取敏感資料。

996

NanoEuler: 使用 C 和 CUDA 從零開始構建的 GPT-2 規模 LLM

NanoEuler 是一個完全使用 C 和 CUDA 撰寫的 GPT-2 風格語言模型教育性實現,其特色是手寫反向傳播、FlashAttention 以及不使用 ML 函式庫的完整預訓練到 SFT 流程。

997

抗衡 AI 低劣內容的活生生經驗

資訊與智慧的區別顯示,唯一能將人類作品與 AI 生成內容區分開來的方式,就是在創作過程中融合個人、活生生的經驗。

998

AMD Strix Halo RDMA 叢集設定指南

本指南說明如何使用 Intel E810 RoCE v2 NIC,設定雙節點 AMD Strix Halo 叢集,以透過張量平行化實現低延遲的分散式 vLLM 推論。

999

Adrafinil: macOS AI 編碼代理程式的條件式睡眠防止工具

Adrafinil 是一款 macOS 選單列應用程式,僅在 AI 編碼代理程式活躍工作時防止系統進入睡眠(包括闔蓋模式)。

1000

Claude Mythos 與 AI 驅動網路安全現狀

Claude Mythos 代表了自動化漏洞發現與漏洞利用程式生成方面的重大飛躍,但它並不會使零信任、攻擊面縮減以及強大的漏洞管理等基本安全優先事項失效。