01

用于递归自我改进的 Harness Engineering

Harness engineering 专注于优化围绕基础 AI 模型系统的环境——包括工作流、上下文管理和工具编排——以实现递归自我改进 (RSI),而无需直接更新权重。

02

Xbox 故障凸显了实体介质所有权的幻象

最近的一次 Xbox 故障导致用户无法游玩基于实体光盘的游戏,引发了关于数字权利管理 (DRM) 的侵蚀以及现代游戏中从所有权转向授权的辩论。

03

为什么 AI 生成的图像会让读者反感,以及博主可以怎么做

AI 生成的图像在个人博客中经常会让读者反感,因为它们传递了低投入感、潜在的不诚实以及人类情感的缺失。

04

雷·布拉德伯里(Ray Bradbury)的《万物终将逝去》(There Will Come Soft Rains)与 2026 年的时间线

雷·布拉德伯里(Ray Bradbury)的短篇小说《万物终将逝去》(There Will Come Soft Rains)描绘了一座在核末日后继续执行其日常程序的全自动化房屋,文本的某些版本明确将事件日期定在 2026 年 8 月。

05

达尼·克鲁格效应:心理偏差还是统计伪影?

最近的分析表明,达尼·克鲁格效应可能统计噪声和测量误差的结果,而不是指无技能个体高估其能力的认知偏差。

06

FFmpeg 9.0 发行说明

FFmpeg 9.0 "Lei" 引入了对 AMF 和 Vulkan 的重大硬件加速更新,新增了对 Animated WebP 和 Playdate 的编解码器支持,并扩展了 DNN 后端功能。

07

雷·布拉德伯里(Ray Bradbury)的《温柔的细雨终将降临》('There Will Come Soft Rains')与自动化荒凉的遗产

雷·布拉德伯里 1950 年的短篇小说《温柔的细雨终将降临》('There Will Come Soft Rains')探讨了一个在核末日后继续执行其日常程序的完全自动化房屋,作为现代智能家居技术和 AI 的一个令人难忘的前兆。

08

OpenAI 回应苹果诉讼中关于前员工的指控

OpenAI 表示,苹果针对前员工 Chang Liu 和 Tang Tan 涉嫌商业秘密滥用的诉讼建立在错误的联系、未经证实的指控之上,并且在提起诉讼之前从未提出过这些具体指控。

09

Ask HN: 谁想被雇佣? – 2026 年 8 月候选人汇总

2026 年 8 月,超过 140 名工程师在 Hacker News 上发布了结构化的 “who‑is‑hiring” 列表,揭示了一个以远程工作、AI/ML、云基础设施和全栈开发为重点的全球高级人才库。

10

Swiftlet: 在 Mac 和 iPhone 上运行 80B 和 35B Qwen MoE 模型

Swiftlet 是一个基于 Swift 和 Metal 的运行时,通过从存储设备流式传输路由专家,使得 80B 和 35B Qwen MoE 模型能够在 Apple 设备上运行,从而将 RAM 使用率降低至 2.6 GB 到 4.3 GB。

11

OpenAI Astra: 数学与理论计算机科学领域的十项进展

OpenAI 使用其 Astra 模型的内部版本,发布了十项解决或在数学和理论计算机科学领域长期悬而未决的开放问题上的取得实质性进展的结果。

12

Taylor Farms Cyclospora Statements Rewritten Four Times in Sixteen Days – What Changed?

Taylor Farms 就其 2026 年 7 月的环孢子虫爆发发布了五份公开声明,在十六天内四次改写信息,但未解释自 2013 年爆发以来其中国墨西哥工厂的任何运营变化。

13

通过手动重打 LLM 生成的代码来防止认知债务

Ankur Sethi 建议通过手动重打 LLM 生成的代码来避免“认知债务”,这种做法优先考虑对代码库的深度理解和心理模型构建,而非单纯的生产力提升。

14

比许多德国人更德国 – 一名移民在德国的工作、文化和公民身份之旅

一名土耳其计算机科学毕业生描述了他在汉堡的实习如何转变为全职工作、深度文化融合,最终获得德国国籍,说明了他为何感觉‘比许多德国人更德国’。

15

SwiftUI 七年后:平庸的故事

SwiftUI 发布七年后,因无法达到生产级稳定性、布局引擎不可预测以及 API 不稳定性,而受到资深工程师的批评。

16

eBay 骚扰运动导致 5600 万美元赔付及员工定罪

eBay 员工对批评者发起骚扰运动,最终导致 5600 万美元赔付及数名安保人员被刑事定罪。

17

orca: 用于在并行隔离的工作树中运行多个 CLI 代理的 AI 编排器

一个 AI 编排器,让开发者能够在统一的桌面和移动端界面中,在并行隔离的工作树中运行多个 CLI 代理。

18

pentagi: 一个用于自动化安全测试和渗透测试的自主多智能体系统

一个由 AI 驱动的自主渗透测试平台,通过使用多智能体系统在隔离环境中实现安全漏洞研究和利用的自动化。

19

n8n-skills: 用于构建和部署生产级 n8n 工作流的专家级 Claude Code 技能

包含 14 个专门的 Claude Code 技能和一个强制执行层,教导 AI 助手如何使用 n8n-mcp 服务器构建、验证和部署生产级 n8n 工作流。

20

CloakBrowser: 一个带有源码级 C++ 补丁的隐身 Chromium 二进制文件,可绕过高级机器人检测

一个带有源码级 C++ 补丁的隐身 Chromium 浏览器二进制文件,可在保持与 Playwright 和 Puppeteer 兼容的同时,绕过高级机器人检测系统。

21

TencentDB-Agent-Memory: TencentDB Agent Memory

AI agent 用于保留/重用经验(聊天记忆、技能、Wiki、CodeGraph)以减少重复工作的系统。

22

Soup: 通过层流式传输在 4 GB 笔记本 GPU 上微调 8B LLM

Soup 是一个开源 CLI,通过将冻结的基础模型层从主机 RAM 一次一层地流式传输到 GPU,从而实现 8B 参数模型在 4 GB VRAM GPU 上的微调。

23

semantica: 一个为具有确定性推理和完整决策溯源的可问责 AI Agent 提供的图原生基础设施层

一个为 AI Agent 提供的图原生基础设施层,为受监管行业提供确定性推理、决策溯源和可审计的上下文图。

24

不要成为“肉身代理”——为什么不加价值地转发 LLM 输出会损害团队

该文章警告不要充当“肉身代理”,即在没有个人理解的情况下直接转发原始 LLM 回复,认为这会增加认知负荷且不增加任何价值。

25

Bonsai: Jane Street 为 OCaml 开发的增量 UI 库

Bonsai 是一个用于在 OCaml 中构建高性能、响应式 Web 和终端应用的 UI 库,它利用纯函数式状态机和增量渲染来优化性能。

26

ICE DNA 采集扩张与 CODIS 集成

Immigration and Customs Enforcement (ICE) 在 2025 年显著扩张了其 DNA 采集规模,可能向 FBI 的 CODIS 数据库添加近 100 万个谱系,包括来自儿童和没有犯罪记录的人员的样本。

27

EU 年龄验证项目强制要求硬件绑定证明

欧盟的开源年龄验证项目要求硬件绑定证明,引发了关于数字主权、开源操作系统被排除在外以及潜在永久设备追踪的争议。

28

Shitty Terminal Emulator: High-Performance C++23 Terminal

Shitty 是一个用 C++23 编写的高性能终端模拟器,利用 Vulkan 和 Metal 进行 GPU 加速渲染,并使用 Ragel 生成快速、确定性的状态机解析器。

29

OpenBidKit_Yibiao: 一个用于生成技术方案和商务标书的开源 AI 投标助手

一款开源的 AI 驱动投标助手,通过使用企业知识库和灵活的 AI 模型集成,帮助用户生成技术和商务方案。

30

open-design: 一个开源的 Claude Design 替代方案,将编程智能体转化为原型设计和动态图形的设计引擎

一个开源、智能体原生的设计平台,允许编程智能体基于共享的设计系统生成原型、仪表盘、演示文稿和动态图形。

31

NemoClaw: 在沙盒环境中安全运行 AI agent 的参考技术栈

一个用于在 NVIDIA OpenShell 沙盒中安全运行 AI agent 的参考技术栈,通过 CLI 提供安全控制和生命周期管理。

32

C‑Kermit 11 发布 – 时隔15年的首个新版本让45年历史的协议重获新生

C‑Kermit 11,时隔15年的首个新版本,通过安全修复、IPv6、广泛的测试和精简的代码库,现代化了这款有45年历史的Kermit文件传输协议。

33

Andy Pavlo Joins ClickHouse to Establish ClickHouse Labs

Andy Pavlo 教授已加入 ClickHouse,领导 ClickHouse Labs,这是一个致力于推进数据库内部机制研究并将其 DBMS 技术与 AI agents 集成的新型行业研究机构。

34

dagu: 一个面向运维自动化和 AI 辅助运维的本地优先工作流引擎

一个本地优先、单二进制文件的工作流引擎,可将现有的脚本和容器转化为具有调度、重试和 AI agent 集成功能的、可观测的 DAG 流水线。

35

DeepTutor: 一个面向个性化辅导和终身掌握的智能体原生学习工作区

一个面向个性化辅导、深度研究和掌握练习的智能体原生学习工作区,它使用三层记忆系统和高级 RAG。

36

zvec: 一个用于低延迟相似度和混合搜索的轻量级进程内向量数据库

Zvec 是一个开源的进程内向量数据库,它直接嵌入到应用程序中,提供低延迟的相似度搜索和混合搜索功能。

37

hcker.news: 一个带有 AI 内容过滤功能的 Hacker News 阅读器

hcker.news 是一个第三方 Hacker News 阅读器,允许用户从其馈送中过滤掉 AI 相关的文章,以恢复更传统的技术体验。

38

AirLLM 使单个 4GB GPU 能够进行 70B LLM 推理

AirLLM 让你能够通过一次流式传输一个层在单个 4 GB GPU 上运行 70B 参数的 LLM,并提供可选的 4‑bit/8‑bit 压缩以实现最高 3× 的加速。

39

幻觉 SQLite CVEs:漏洞报告中 LLM Slop 的兴起

JFrog 研究人员发现,为 SQLite 发行的多个关键 CVEs 完全由 LLM 捏造,这暴露了当前 CVE 验证管道的系统性失效。

40

video-shotcraft: 一个包含 104 种镜头配方库和生产级模板的、用于制作电影感产品视频的智能体技能

一种 AI 智能体技能,使 AI 编程智能体能够使用 Remotion 进行电影感产品宣传视频的分镜、动画制作和声音设计。

41

agenta: 一个用于构建和运行具有后台执行和人机交互权限的智能体开源工作空间

一个用于构建和运行 AI 智能体的开源工作空间,可以通过聊天、后台计划和与外部应用程序的集成来实现工作自动化。

42

plannotator: 一个供 AI 编程智能体用于标注计划和代码 diff 的浏览器端评审界面

一个供 AI 编程智能体使用的浏览器端评审界面,允许用户标注计划、HTML artifacts 和代码 diffs,从而向智能体提供结构化反馈。

43

openui: 一个与渲染器无关的 Generative UI 框架,用于高效能地流式传输交互式组件

一个全栈 Generative UI 框架,使用一种紧凑的、流式优先的语言,让 LLM 以极高的 Token 效率渲染交互式组件。

44

paseo: 一个用于编排多个自托管 AI 编程代理的统一跨设备接口

一个统一的、自托管的接口,用于在桌面、移动端和 CLI 上编排 Claude Code 和 Copilot 等多个 AI 编程代理。

45

SurfSense: 一个通过 REST API 和 MCP server 提供 AI agent 实时结构化网络数据的开源研究平台

一个开源研究平台和 NotebookLM 的替代方案,通过 REST API 和 MCP server 为 AI agent 提供实时、结构化的网络数据。

46

LFM2.5-2.6B 发布说明 / 新特性

Liquid AI 发布了 LFM2.5-2.6B,这是一款专为设备端智能体设计的小型、高性能模型,具有同类最佳的工具使用和指令遵循能力。

47

agents: 一个用于构建具有集成任务调度功能的实时可编程多模态语音智能体的框架

一个用于构建能够看、听、并说话的实时、可编程多模态 AI 智能体的框架,具有集成的任务调度和电话支持功能。

48

wisp-science: Wisp Science

Wisp Science 是一个开源、本地优先的 AI 研究工作台,提供桌面 AI 助手和科学计算环境。它连接到 AI 模型(兼容 OpenAI 和 Anthropic),运行持久化的 Python/R 环境,并通过 MCP 服务器访问生物信息学数据库,同时保持数据本地化。

49

strix: 一个通过真实概念验证(PoC)验证漏洞的自主 AI 渗透测试工具

一款使用多智能体编排来发现、通过 PoC 验证并修复应用程序安全漏洞的自主 AI 渗透测试工具。

50

maxun: Maxun

一个开源的无代码平台,通过抓取、爬取、搜索和LLM驱动的提取将任何网站转换为结构化数据。