2001

openrag: 一個由代理驅動的 RAG 平台,用於智慧文件搜尋與 AI 對話

一個由智慧代理驅動的文件搜尋平台,讓使用者能透過 RAG,經由聊天介面來上傳、處理並查詢文件。

2002

azure-search-openai-demo: 一個用於查詢私有文件並提供引用與多模態支援的參考 RAG 對話應用程式

一個參考 RAG 對話應用程式,允許使用者透過 Azure OpenAI 與 Azure AI Search 與自己的文件進行互動。

2003

US Supreme Court Trump v. Slaughter Decision Impacts EU-US Data Transfers

nUS Supreme Court 在 *Trump v. Slaughter* 一案中的裁決,因違反了歐盟對獨立資料監督的要求,威脅了 EU-US Data Privacy Framework 的法律基礎。

2004

verl-agent: 一個用於訓練長程 LLM agent 的強化學習框架,具備可自定義的記憶與步進獨立的 rollouts

veRL 的擴展版本,用於透過強化學習訓練 LLM agent,其特色是具備步進獨立的 rollout 機制,能有效處理長程、多輪任務。

2005

comfyui_LLM_party: 一套用於構建複雜 LLM 與代理工作流的全面 ComfyUI 節點套件

一套用於構建 LLM 工作流的全面 ComfyUI 節點,支持將 AI 代理、RAG 和 VLMs 集成到視覺化圖像生成管線中。

2006

OpenManus-RL:用於提升 LLM 推理與決策的 RL 代理調校框架

一個開源框架,利用強化學習優化 LLM 代理,提升其推理、工具使用與決策能力。

2007

AI 時代下技術熟悉度的侵蝕

一篇關於從高摩擦運算轉向 AI 驅動的無縫體驗,如何將與機器搏鬥的「親密熟悉度」替換為對不透明抽象化的依賴之反思。

2008

llm-beginner:透過從頭實作的漸進式實作課程,掌握 LLM 與 AI 代理人

一套完整、實作導向的教學系列,讓初學者透過六個漸進式實作任務,從構建 mini‑GPT 到打造程式碼代理人,學習 LLM 與 AI 代理人。

2009

SkillOpt:一種使用類深度學習優化迴圈來實現代理技能自我演化的執行策略

SkillOpt 是一個將代理技能文件視為可訓練狀態的框架,使用類深度學習的優化迴圈來演化並提升代理性能,而無需修改模型權重。

2010

Knoppix:Live Linux 發行版的先驅

Knoppix 是一個可開機的 Live Linux 系統,允許使用者在 CD、DVD 或 USB 隨身碟上執行完整作業系統而無需安裝,開創了用於系統復原與教育目的的「live」發行模型。

2011

南韓宣布 1 兆美元投資記憶體晶片、資料中心與類人機器人

南韓承諾投入 1 兆美元,於 2028 年前擴大記憶體晶片產能、建置 AI 資料中心,並商業化類人機器人,以確保在實體 AI 領域的全球領先。

2012

Webernetes:使用大型語言模型將 Kubernetes 移植至瀏覽器

Webernetes 是將 Kubernetes 部分移植至 TypeScript 的專案,讓開發者能在瀏覽器中完整執行模擬叢集,以提供互動式教學內容。

2013

加密貨幣產業斥資 1.89 億美元以影響 2026 年美國中期選舉

加密貨幣公司已斥資 1.89 億美元以影響 2026 年美國中期選舉,使其成為企業政治支出最高者,並佔了所有企業捐款總額的三分之一以上。

2014

CERN LHC 長期停機 3 與轉型至高亮度 LHC

CERN 已啟動長期停機 3 (LS3) 以將大型強子對撞機 (LHC) 升級為高亮度 LHC (HiLumi LHC),預計運作將於 2030 年恢復。

2015

Qwen 3.6 27B:本地 LLM 開發的最佳切入點

Qwen 3.6 27B 正逐漸成為一款高度能幹的本地模型,兼具智慧與效能,然而其硬體需求引發了本地與雲端推理成本效益的討論。

2016

mrpt:一個完整的 C++ 行動機器人框架,具備 SLAM、導航與 3D 可視化功能

一個穩健且模組化的 C++ 行動機器人框架,提供 SLAM、導航與感測器整合等關鍵工具。

2017

unrealcv: 一個連接 Unreal Engine 與 AI 框架以建立合成電腦視覺環境的橋樑

UnrealCV 是 Unreal Engine 的一個插件,讓電腦視覺研究人員能夠以程式化方式與虛擬世界互動,以生成合成數據,並整合了 PyTorch/Tensorflow。

2018

paperlib: 一款具備 AI 摘要功能與語義圖書館搜尋功能的開源學術論文管理器

一款開源的學術論文管理工具,簡化了元數據抓取與組織,並具備 LLM 驅動的摘要功能與語義搜尋。

2019

bgslibrary:一個用於視訊串流前景‑背景分離的完整 C++ 框架

一個用於電腦視覺背景減除的完整 C++ 框架,提供超過 40 種演算法來偵測視訊串流中的移動物體。

2020

emgucv:跨平台的 .NET 包裝器,用於 OpenCV 影像處理函式庫

跨平台的 .NET 包裝器,用於 OpenCV 影像處理函式庫,使 .NET 相容語言能在多種作業系統上使用 OpenCV 功能。

2021

MaaNTE: 一款基於圖像與音頻識別的自動化工具,用於簡化遊戲 *異環* 中的重複性任務

一款針對遊戲 *異環* (The Ring) 的自動化工具,利用圖像與音頻識別來模擬用戶交互,以簡化重複性的遊戲玩法。

2022

stitching: 一個用於快速於快速且強健的圖像拼接與全景圖製作的 Python 套件

一個用於快速且強健的圖像拼接的 Python 套件,使用 OpenCV 將多張重疊的圖像組合在一起,形成單一的全景圖。

2023

Moondream Photon: 透過管線化解碼消除 GPU Bubble

Moondream 的 Photon 推論引擎透過使用管線化解碼來重疊 CPU 維護工作與 GPU 計算,在 NVIDIA B200 GPU 上將解碼吞吐量提升了高達 35%。

2024

LongCat-2.0 MoE Model Analysis

LongCat-2.0 是一個大規模混合專家 (MoE) 模型,具有 1.6 兆總參數與 480 億活躍參數,是使用 AI ASIC superpods 開發的。

2025

.self TLD:HCCF 對以人為本領域的願景

人本計算基金會(HCCF)正爭取 .self 頂級域名(TLD),以支援倫理、以人為本的技術與自我託管。

2026

CV-CUDA:高吞吐量 GPU 加速的電腦視覺函式庫,用於 AI 前處理管線

NVIDIA 提供的 GPU 加速電腦視覺函式庫,為 AI 管線提供高吞吐量、低延遲的影像與影片處理。

2027

comic-translate:一款利用 LLM 與 inpainting 技術在漫畫格子內翻譯文字的 AI 漫畫翻譯器

一款利用 LLM、OCR 與 inpainting 技術,將多語言漫畫翻譯成其他語言,同時保留原始畫面之 AI 漫畫翻譯器。

2028

habitat-lab: 一個用於在室內環境中訓練與評估具身智能代理的模組化框架

一個用於具身智能端到端開發的模組化高階函式庫,用於訓練與評估在室內環境中執行任務的代理。

2029

WebPlotDigitizer: 一款利用電腦視覺輔助從數據視覺化圖像中提取數值數據的工具

WebPlotDigitizer 是一款利用電腦視覺輔助,為研究人員和科學家從數據視覺化圖像中提取數值數據的工具。

2030

ComputeLibrary:針對 Arm 硬體優化的低階機器學習函式集合

一套針對 Arm Cortex‑A、Neoverse 與 Mali GPU 架構優化的低階機器學習函式集合,旨在提供高效能的 ML 推論。

2031

LichtFeld-Studio:一個模組化工作站,用於訓練、編輯與自動化 3D Gaussian Splatting 場景

一個模組化的 3D Gaussian Splatting 工作站,將訓練、即時可視化、編輯與匯出整合於單一原生應用程式中。

2032

anylabeling: 一款透過 YOLOv8 與 Segment Anything 提供自動標記功能的 AI 輔助影像標記工具

一款 AI 驅動的影像標記工具,整合了 YOLOv8 與 Segment Anything Model (SAM) 系列,以自動化並加速電腦視覺的數據標記流程。

2033

AliceVision: 一個用於 3D 重建與相機追蹤的攝影測量電腦視覺框架

一個用於從照片或影片中進行 3D 重建與相機追蹤的攝影測量電腦視覺框架,提供相關演算法。

2034

habitat-sim:一個高效能、具物理模擬的 3D 模擬器,供具身 AI 研究使用

一個高效能、具物理模擬的 3D 模擬器,供具身 AI 研究使用,提供快速渲染與剛體動力學,以在真實 3D 環境中訓練代理人。

2035

scenic: 一個基於 JAX 的研究函式庫,用於開發大型注意力機制電腦視覺模型的原型

一個基於 JAX 和 Flax 的電腦視覺研究函式庫,為開發跨圖像、影片和音訊的注意力機制模型提供可擴展的函式庫和專案範本。

2036

torchgeo: 一個用於處理多光譜地理空間與遙感數據深度學習的 PyTorch 領域函式庫

一個專為地理空間與遙感數據設計的 PyTorch 領域函式庫,提供數據集、取樣器和預訓練模型。

2037

VLMEvalKit: 一個支援 70+ 基準測試的大型視覺語言模型統一評估工具包

一個用於大型視覺語言模型評估的開源工具包,可實現跨 70+ 基準測試和 200+ 模型的指令式評估。

2038

ARC-AGI-3: 在沒有指令的情況下解決基準測試

Tufa Labs 討論了 ARC-AGI-3 的挑戰,強調解決此問題需要超越暴力破解,透過高階抽象來實現動作效率與目標獲取。

2039

obs-backgroundremoval: 一個用於 OBS Studio 的虛擬綠幕與低光源增強插件

一個使用神經網路為人像影片與圖像提供虛擬綠幕背景移除與低光源增強功能的 OBS Studio 插件。

2040

webots: 一款用於建模與編寫機械系統程式的開源機器人模擬器

一款開源機器人模擬器,提供完整的開發環境來對機器人、車輛和機械系統進行建模、編寫程式與模擬。

2041

ceres-solver: 一個用於解決大規模非線性最小平方法與一般優化問題的成熟 C++ 函式庫

Ceres Solver 是一個用於建模與解決大型且複雜的非線性最小平方法與一般無約束優化問題的 C++ 函式庫。

2042

sparrow: 一個用於結構化數據提取與代理工作流的 API-first 文件智能平台

一個專為企業文件智能設計的 API-first 平台,利用 Vision LLMs 和代理工作流將發票、收據和對帳單轉換為結構化 JSON。

2043

Chinese-CLIP:大型中文視覺語言模型,用於跨模態檢索與零樣本圖像分類

一個中文版本的 CLIP 模型,於 2 億條圖文對上訓練,用於跨模態檢索與零樣本圖像分類。

2044

scikit-image: 一個用於科學影像處理與分析的全面 Python 函式庫

scikit-image 是一個用於影像處理的 Python 函式庫,提供了一系列用於分析與操作影像的演算法。

2045

Final2x: 一款支援自定義模型與 Nvidia 50 系列 GPU 的跨平台影像超解析度工具

一款使用 AI 模型來放大影像並提升其解析度的跨平台影像超解析度工具。

2046

gocv:Go 語言綁定 OpenCV 4 計算機視覺函式庫

GoCV 為 OpenCV 4 提供 Go 語言綁定,使 Go 開發者能將先進的計算機視覺與硬體加速影像處理整合到他們的應用程式中。

2047

librealsense:一個跨平台的函式庫,用於從 RealSense 相機串流深度與彩色資料

一套跨平台的 RealSense 深度相機 SDK,能實現深度與彩色串流,並提供校正資料,適用於電腦視覺與機器人領域。

2048

rerun: 實體 AI 與機器人技術的多模態數據層與視覺化除錯器

一個針對實體 AI 的多模態數據層與視覺化除錯器,讓開發者能夠即時記錄、查詢並視覺化多速率感測器數據。

2049

pcl: 一個用於 // 2D 和 3D 影像與點雲處理的大型開源程式庫

一個用於 2D/3D 影像與點雲處理的大型開源程式庫,廣泛應用於機器人技術與 3D 感知。

2050

segmentation_models.pytorch:一個高階 PyTorch 函式庫,用於影像語意分割,提供超過 800 個預訓練編碼器

一個 PyTorch 函式庫,提供高階 API,讓使用者能輕鬆建立與訓練影像語意分割模型,支援多種預訓練編碼器與架構。