rowboat:具備持續本地知識圖譜與整合工作介面的桌面 AI 同事
一款桌面 AI 同事,將工作資料索引至本地知識圖譜,提供持久記憶與整合的電子郵件、程式碼與會議工作介面。
Google DeepMind $40M 承諾支持創世任務
Google 正承諾提供 4000 萬美元的 AI 代幣與雲端積分,以支持美國能源部的創世任務,為研究人員提供存取前沿 AI 工具的機會,如 AlphaEvolve 與 AlphaFold 3。
Read the Tape: A Gamified Approach to S&P 500 Chart Prediction
Read the Tape 是一款每日交易遊戲,玩家透過預測五張隱藏資訊的 S&P 500 股票圖表走勢,來相對於名為 Monkey Index 的隨機基準線生成 alpha。
The Space Project: A Self-Running Space Economy Simulator in Rust and Bevy
The Space Project 是一個由代理人驅動的經濟模擬系統,使用 Rust 與 Bevy 建立,其特色是自主太空船、動態市場與複雜的太陽系經濟,且不設玩家目標。
透過意識來克服監視資本主義
分析透過個人意識來對抗監視資本主義的提案,包括關於機構力量規模與個人行動之間對比的批判性反論。
創意工作的貶值:為什麼「內容」is a Dangerous Term
作者 mtlynch 主張,採用如「內容」和「流量」之類的企業術語會使創意工作商品化,並剝奪其人類意義,因此敦促創作者重新奪回如作家或部落客等特定的稱呼。
歐盟與美國協商加強邊境安全夥伴關係 – 生物特徵資料與基本權利的風險
歐盟即將完成與美國的加強邊境安全夥伴關係,該協議將允許美國當局無限制存取歐洲的生物特徵資料庫以維持免簽證旅行,因而引發嚴重的隱私與人權關切。
MNN
MNN 是一個輕量級、高性能的深度學習框架,針對手機、PC 和 IoT 平台上的裝置端推理與訓練進行了優化。
OpenAI Project Camellia: AI 基礎設施開發於埃芬漢縣
OpenAI 正在開發 Project Camellia,這是一項位於喬治亞州埃芬漢縣的私人資助數據中心項目,擁有 3.2 GW 電力合約以及 8000 萬美元的社區利益。
新聞機構如何利用 AI 推進其使命 – OpenAI 合作夥伴概覽
OpenAI 報告指出,全球新聞機構正在使用其技術來簡化新聞工作、個人化讀者體驗並加強業務運營,具體詳見其 2026 年 7 月的合作夥伴更新。
TITLE: agency-agents-zh: 適用於 AI 編程工具的 268 個專業 AI 代理角色的綜合函式庫,附帶專業工作流程
SUMMARY: 一個包含 268 個定義人設和工作流程的專業 AI 代理角色函式庫,與 18 個 AI 編程工具相容,以在 20 個業務部門提供專家級輸出。
Ex Situ: 被流失文化資產的開源空間索引
Ex Situ 是一個開源專案,地圖化了全球各地流失文化資產從其原產地到目前博物館館藏的移動路徑。
omlx
一款專為 Apple Silicon Macs 設計的高效能 LLM 推論伺服器,具備分層 KV 快取 (RAM/SSD) 以及原生的 macOS 選單列管理應用程式。
OpenAI 正在推進國家科學的新時代
OpenAI 正與美國政府及 Genesis 任務合作,將前沿 AI 模型整合到國家實驗室和大學中,以加速科學發現。
airllm: 一個記憶體高效的推理引擎,透過一次載入一層來在消費級 GPU 上運行巨大的 LLM
AirLLM 是一個函式庫,透過一次只將單一模型層載入 VRAM,使得在低端 GPU 上運行巨大的 LLM(最高達 671B 參數)成為可能。
bashumerate:可程式化的 Bash 迭代器
bashumerate 是一個輕量級的 Bash 工具,提供一致的語法來迭代檔案、行、範圍與清單,旨在取代使用 for 迴圈、find 與 xargs 時的支離破碎體驗。
AI 智能經濟學:為何中國開源權重模型並非前沿威脅
對 AI 市場的分析顯示,雖然像 Kimi K3 和 Qwen3.8 Max 這樣的中國模型正接近尖端技術水平,但真正的競爭優勢在於智能的成本結構 (COGS) 而非單純的 token 價格或開源權重。
pydantic-ai
由 Pydantic 團隊開發的類型安全 Python 代理框架,使開發者能夠透過結構化驗證和模型無關的支持,構建生產級的 GenAI 應用程式。
llmfit: 一款根據系統 RAM 與 GPU 進行匹配的硬體感知型模型推薦工具
一款能偵測硬體並根據記憶體、速度、品質與上下文長度,推薦最適合的 LLM 模型的終端機工具。
LED 光害:低效使用 LED 如何惡化夜空以及可以採取的措施
LED 路燈雖然便宜且高效,但未遮光、藍光豐富的部署加劇光害,危害健康與生態;透過數位控制與較暖、可調光的設計,可恢復暗夜星空。
Airport Simulator Web Game – A Modern Take on Classic ATC Gameplay
Airport Simulator 是一款基於瀏覽器的空中交通管制遊戲,復刻了早期行動平台如 Flight Control 的簡單、上癮機制,透過拖曳繪製路徑將飛機引導至彩色跑道。
langextract: 一個將數據映射回原始文本以進行精確驗證的結構化資訊提取函式庫
一個使用 LLMs 從非結構化文本文件中提取結構化、有根據的資訊的 Python 函式庫,內建對長文件處理和視覺化的支援。
PCjs Machines – 經典 IBM PC、DEC Minicomputers 及更多內容的瀏覽器內模擬
PCjs 提供一個基於 JavaScript 的模擬器,直接在現代瀏覽器中運行各種歷史悠久的 IBM PC 相容機、DEC Minicomputers、計算機、街機遊戲和軟體,保存了計算歷史並實現了親手探索的可能性。
為何過度設計實際上是需求問題
本文主張過度設計源於需求模糊或錯誤,而非對完美的執著;明確的限制會在特定情境下產生唯一的完美解決方案。
美國保險制度的失敗如何導致一場悲劇性的自殺
一篇個人隨筆揭示了複雜的保險拒賠與精神科承保範圍的缺口,在丈夫的自殺事件中扮演了關鍵角色,凸顯了美國醫療保險制度的系統性缺陷。
Nativ: Apple Silicon 本地 AI 模型執行器
Nativ 是一款開源、採用 MIT 授權的桌面應用程式,讓使用者透過 MLX-VLM 框架在 Apple Silicon (M1+) 上本地執行來自 Google, Cohere, 和 Liquid AI 的精選開源權重模型。
Jelly UI: 為原生 HTML 表單控制項引入軟體物理效果
Jelly UI 是一個 UI 函式庫,它將軟體物理效果動畫應用於原生 HTML 表單控制項,儘管其目前的示範網站存在效能問題與具爭議性的 `scroll-snap` 實作。
Phantomdrive USB – 開源隱藏加密金庫
Phantomdrive 是一款開源 USB 隨身碟,表面上顯示為 8 GB 的可見分區,並隱藏了第二個 AES-256 加密卷,當寫入包含密碼的純文本文件時,該加密卷會被解鎖。
OpenCode 分析:安全性漏洞與架構缺陷
對 OpenCode 的技術深度分析,強調了包括 RCE 漏洞與無效的指令過濾在內的關鍵安全性風險,以及與提示詞快取失效相關的重大效能問題。
OpenAI Presence: 企業級 AI 代理人部署框架
OpenAI Presence 是一個可投入生產的框架,用於在語音和聊天渠道部署可信的 AI 代理人,結合模型推理、政策、防護欄以及 Codex 驅動的改進迴路。
NotFair: 透過嚴謹的本地迴圈優化業務指標的目標驅動型自主行銷代理人
一個本地優先的自主行銷代理人框架,能將業務目標轉化為可衡量的指標,並透過執行嚴謹的改進迴圈來優化 SEO 和廣告支出。
xtuner: 支援高達 1T 參數與多模態訓練的超大型 MoE 模型訓練引擎
一款針對高達 1T 參數的超大型 MoE 模型進行優化的次世代 LLM 訓練引擎,支援多模態訓練與進階強化學習。
vllm:它是什麼、解決了什麼問題以及為何受到熱捧
vLLM 是一個高吞吐量的 LLM 推理與服務庫,利用 PagedAttention 高效管理記憶體並最大化效能。
dify:它是什麼、解決了什麼問題以及為何受到關注
Dify 是一個開源的 LLM 應用開發平台,結合 AI 工作流程、RAG 管線與代理人功能,協助開發者從原型快速走向正式上線。
新宿站 3D 可視化演示
基於日本國土交通省 (MLIT) 開放數據,使用 Three.js 演示新宿站複雜的室內地圖數據可視化。
Google之聲:洞悉 Google 早期文化的興起與衰落
New Yorker 的文章《Google之聲》揭示了 Google 曾經的無階級、使命驅動文化如何逐漸被企業同質化所侵蝕,說明了公司現在的進步形象為何與員工的異議與公眾批評產生衝突。
Searchlight Cyber wp2shell WordPress RCE 於 GPT‑5.6 Sol Ultra 發現
Searchlight Cyber 使用 GPT‑5.6 Sol Ultra 並耗費約 25 美元的運算資源,發現 WordPress 批次 API 中的預驗證 SQL 注入,並將其串接至遠端程式碼執行(RCE),此漏洞據稱可為利用者帶來 50 萬美元的報酬。
LLM 幻覺產生 404 錯誤 – 為何驗證至關重要
LLM 產生的 URL 返回 404 錯誤,揭示生成式 AI 自信捏造資訊的問題,凸顯對 AI 輸出進行系統化驗證的必要性。
Measuring AI-Generated Writing on arXiv: Trends and Limitations
對 12,750 篇 arXiv 論文的研究顯示,最近的投稿中約有 32% 被標記為機器寫作,其中 Computer Science 的盛行率最高,達到 65%。
Xiaomi-Robotics-1: 使用 100,000 小時數據擴展視覺-語言-動作模型
Xiaomi-Robotics-1 是一款機器人基礎模型,透過在 100,000 小時的軌跡數據上進行「非具身」預訓練,打破了機器人技術中的數據瓶頸,並在移動操作任務中達到了尖端(SOTA)的性能。
AI 與前沿技術綜述 – Kimi K3、代理基準與向混合、具成本效益 AI 系統的轉變
Kimi K3 在代理基準上表現優異,結合新路由技巧、開放權重發布與工具管理最佳實踐,顯示出 AI 堆疊正快速向混合模式轉變:以低成本模型處理日常工作,將昂貴的前沿模型保留給規劃階段。
AI × 加密貨幣綜述:代理付款、去中心化運算、代幣化代理、可驗證 AI 與市場
AI 代理正透過加密鐵路實現付款、運算、代幣化執行、零知識驗證與去中心化市場,重塑自主軟體的交易與證明方式。
Claude Fable 與 Jacobian 猜想的反例
一個名為 Claude Fable 的 AI 模型據稱提供了 Jacobian 猜想的反例,這是一個長達 85 年未解的數學難題。
NTT DATA Group Codex 實施與成果
NTT DATA Group 透過將 Codex 部署給 9,000 名員工,作為更廣泛 AI 轉型策略的一部分,將複雜的事件分析流程從三天縮短至 30 分鐘。
vLLM Kimi K3 支援預覽
vLLM 正在為 Moonshot AI 的 Kimi K3(一個具有混合 KDA/完整注意力架構和原生視覺支援的 2.8 兆參數模型)準備 day-0 開源服務支援。
astron-rpa: 一個具備低程式碼視覺化設計與原生 AI agent 整合的企業級 RPA 平台
一款企業級機器人流程自動化 (RPA) 桌面應用程式,可實現 Windows 桌面軟體和網頁的低程式碼自動化,並具備原生 AI agent 整合功能。
Airbus 將關鍵應用程式從 AWS 遷移至 Scaleway
Airbus 正在將約 900 個應用程式(包括關鍵的 ERP 與 CRM 系統)從 AWS 遷移至法國供應商 Scaleway,以確保數位主權並防止敏感資料受到外國司法管轄的影響。
Reddit 現在要求登入才能存取舊版 Reddit
Reddit 已針對存取 old.reddit.com 的使用者實施了登入要求,有效地結束了舊版介面的匿名瀏覽功能。
EFF 警告:德州監控與數位隱私權
電子前沿基金會 (EFF) 正提醒德州居民,注意健康影響監控的風險,以及利用自動化車牌辨識器追蹤涉嫌自行管理墮胎的人士。
X-Cell 4.9B 參數擴散模型實現虛擬細胞中的因果擾動預測
X-Cell 是一個 4.9 十億參數的擴散語言模型,使用 25 百萬細胞的 X‑Atlas/Pisces CRISPRi Perturb‑seq 數據集進行訓練,能準確預測未見基因擾動的基因表達反應,證明因果數據而非模型規模是虛擬細胞泛化的主要瓶頸。