alan-sdk-web:一个智能应用平台 SDK,能够实时生成业务逻辑和 UI
一个用于将智能层嵌入 Web 应用的 SDK,能够实时生成业务逻辑和 UI 组件。
presentation-ai: 一个支持本地 LLMs 和自定义主题的开源 AI 演示文稿生成器
一款开源的、由 AI 驱动的演示文稿生成器,通过“大纲优先”的工作流,根据一个话题即可创建可定制的幻灯片。
TTS-WebUI: 一个用于运行和管理数十种开源文本转语音和音频生成模型的统一 Web 界面
一个用于管理和运行各种开源文本转语音、音频生成和音频转换 AI 模型的统一 Web 界面。
Gemini-API: 一个针对 Google Gemini Web 应用的逆向工程异步 Python 封装库
一个针对 Google Gemini Web 应用的逆向工程异步 Python 封装库,支持通过编程方式访问图像生成、深度研究和自定义 Gems 等功能。
hallucination-leaderboard: 一个追踪 LLM 在摘要任务中幻觉率的公开排行榜
一个使用 Vectara 的 Hallucination Evaluation Model (HHEM) 来衡量和比较不同 LLM 在对文档进行摘要时产生幻觉频率的公开排行榜。
semantic-router: 一个为 LLMs 和 agents 使用语义向量空间进行路由的超快速决策层
一个为 LLMs 和 agents 提供的高速决策层,它使用语义向量空间根据含义而非缓慢的 LLM 生成来路由请求。
transformer-explainer: 一个用于学习 GPT-2 内部操作的交互式浏览器可视化工具
一个在浏览器中运行实时 GPT-2 模型的交互式可视化工具,旨在帮助用户学习基于 Transformer 的模型如何预测文本。
ChatGPT-Shortcut: 一个用于在多个平台提升 AI 输出质量的精选提示词库和管理工具
一款 AI 提示词管理工具,提供包含 5,000 多个提示词的精选库,并提供各种工具来在不同 AI 平台中组织、创建和分享自定义提示词。
morphic: 一个具有生成式 UI 的 AI 搜索引擎,可从流式 JSON 渲染丰富的内联组件
一款由 AI 驱动的搜索引擎,使用生成式 UI 渲染丰富的、带有引用的回答,并包含交互式组件,而非纯文本。
krita-ai-diffusion: 一个为 Krita 开发的生成式 AI 插件,集成了扩散模型以实现精确的图像编辑和绘画
一个为 Krita 开发的插件,将生成式 AI 扩散模型集成到绘画工作流中,提供局部重绘、实时绘画和精确结构控制的工具。
outlines: 一个通过类型约束生成来保证 LLM 结构化输出的库
一个通过将生成过程约束为匹配特定 Python 类型或 Pydantic 模型,从而保证 LLM 结构化输出的库。
Open-Generative-AI: 一个具有本地推理和多模型支持的、不受限制的 AI 视频平台开源替代方案
一个开源、不受限制的 AI 工作室,可使用 200 多种模型生成图像和视频,具有本地推理选项和可视化工作流构建器。
openui:一个开源的 AI 驱动 UI 生成器,可将实时描述渲染为框架就绪代码
一款开源工具,允许你使用自然语言描述 UI 组件并实时渲染,同时支持将其转换为 React、Svelte 或 Web Components。
TurboDiffusion:一种将视频生成扩散延迟降低 100‑200 倍的加速框架
TurboDiffusion 是一种视频生成加速框架,通过注意力优化和时间步蒸馏,在单 GPU 上实现 100‑200 倍的扩散生成加速。
MAGI-1: 一种用于可扩展高保真视频生成且具有强物理准确性的自回归世界模型
MAGI-1 是一种自回归视频生成模型,通过逐块生成高保真视频来确保时间一致性和物理准确性。
ComfyUI-LTXVideo: 用于高级 LTX-2 视频生成和音频合成的自定义 ComfyUI 节点
一套自定义 ComfyUI 节点和工作流集合,通过 HDR 输出、对口型和生成式放大等功能扩展了 LTX-2 视频生成模型。
transformerlab-app:一个统一 AI 研究工具和集群编排的开源机器学习平台
一个统一训练、微调、推理和评估为单一界面的开源机器学习平台,适用于个人和研究实验室。
当运行 CUDA 核心时会发生什么:从源码到 SASS
深入探讨 CUDA 核心的生命周期,追踪其从 `nvcc` 编译、PTX/SASS 生成到在 RTX 4090 上硬件层面的执行全过程。
HackerRank 招聘代理:AI 简历筛选中的非确定性分析
对 HackerRank 开源 `hiring-agent` 工具的分析揭示了显著的评分不一致性和设计缺陷,同一份简历在多次运行中可能得到截然不同的分数。
maestro: 一个加速多模态视觉语言模型微调的精简工具
一个用于加速 Florence-2、PaliGemma 2 和 Qwen2.5-VL 等多模态视觉语言模型微调的精简工具。
SimpleTuner: 一个用于微调多模态生成式模型并具备企业级编排功能的统一训练框架
一个用于微调图像、视频和音频生成式模型的全面训练框架,支持广泛的架构,并专注于简单性和内存效率。
OneTrainer: 训练和微调多种扩散模型的全方位解决方案
一套全面的扩散模型训练套件,通过 GUI 或 CLI 提供数据集准备、微调和模型转换工具。
OpenDeepWiki: 一个由 AI 驱动的仓库知识库,可从代码库生成结构化文档、聊天界面和 MCP 端点
一个由 AI 驱动的知识库生成器,可将 Git 仓库和本地目录转换为结构化文档、可搜索的聊天界面和 MCP 端点。
MetaClaw:一个通过真实世界对话实现 AI 助手元学习与进化的智能体代理
一种通过技能注入和异步 RL 微调,使 AI 助手能够通过真实世界对话进行元学习与进化的智能体代理。
Kiln: 一个面向提示词优化、评估和智能体编排的本地优先 AI 开发工作台
一个面向提示词优化、评估、RAG 和微调的本地优先 AI 开发工作台,为团队提供单一的工作流。
h2o-llmstudio:一个无需编码的 GUI 和框架,用于在支持内存高效训练的情况下微调大语言模型
一个无需编码的 GUI 和框架,用于微调大语言模型,支持 LoRA 等内存高效技术以及 DPO 等高级优化方法。
CosyVoice: 基于大语言模型的可扩展多语言零样本文本转语音合成器
一种基于 LLM 的文本转语音系统,用于实现具有高说话人相似度和低延迟流式传输的零样本多语言语音合成。
欧洲 ISP 呼吁让权利人对过度封锁造成的损害承担责任
EuroISPA 正在敦促欧盟委员会让权利人对过度宽泛的盗版站点封锁令导致的附带损害承担经济责任。
年龄验证法作为自动化言论归属的框架
年龄验证法规被分析为一种将数字身份与物理身份绑定的机制,从而实现将言论自动归属于现实世界个人的过程。
Hugging Face 和 Cerebras 使用 Gemma 4 的实时语音 AI
Hugging Face 和 Cerebras 开发了一个使用 Gemma 4 31B 的开放级联语音到语音管道,以实现自然的低延迟语音 AI 交互。
vLLM-Omni 为 Qwen3-Omni-30B-A3B-Instruct 推理服务的优化方案
vLLM-Omni 通过 Thinker、Talker 和 Code2Wav 的三阶段流水线提供 Qwen3-Omni-30B-A3B-Instruct 服务,并通过阶段分解、CUDA Graphs、异步分块交接、异步输出、阶段副本和热路径清理提升了吞吐量和延迟。
Genesis Molecular AI: 利用 PEARL 和扩散模型推进药物研发
Genesis Molecular AI 正在利用扩散模型和名为 PEARL 的新型结构预测模型,在蛋白质-配体结合方面实现亚埃级精度,从而为此前无法成药的目标提供药物研发的可能性。
any-llm: 一个无需代理、使用官方 SDK 访问任何 LLM 提供商的统一 API
一个统一的 Python SDK,提供单一接口以访问 OpenAI、Anthropic 和 Mistral 等多个 LLM 提供商,而无需更改代码。
dstack:跨多个云和本地集群的 GPU 供应与编排统一控制平面
一个统一的 GPU 供应与编排控制平面,简化了在任何 GPU 云、Kubernetes 或本地集群上的开发、训练和推理流程。
XNNPACK: 一个为跨平台推理提供优化神经网络原语的底层加速库
XNNPACK 是一个高度优化的底层性能原语库,用于在 ARM、x86、WebAssembly 和 RISC-V 平台上加速神经网络推理。
optimum: 一个用于在各种 AI 加速器上最大化训练和推理效率的硬件优化工具包
Hugging Face 生态系统的扩展,提供优化工具,以便在目标硬件加速器上以最高效率训练和运行 AI 模型。
zml: 一个将 AI 工作负载与专用硬件解耦的生产级推理栈
一个将 AI 工作负载与专用硬件解耦的生产级推理栈,允许使用单一代码库在 NVIDIA、AMD、Intel 以及 TPU/Trainium 加速器上运行模型。
FastDeploy: 一个具备 PD 分离和广泛硬件加速能力的生产级 LLM 和 VLM 部署工具包
基于 PaddlePaddle 的 LLM 和 VLM 生产级部署工具包,提供高性能推理和广泛的硬件兼容性。
csghub:类似 Hugging Face 的私有本地部署 LLM 资产管理平台
一个开源的本地部署替代方案,类似 Hugging Face,用于管理、存储和分发 LLM 资产、数据集和代码。
typedb:一种强类型数据库,将关系、文档和图模型统一在声明式查询语言中
TypeDB 是下一代数据库,将关系、文档和图模型统一为单一强类型系统,以简化复杂、相互关联数据的管理。
open_model_zoo:一套用于高性能推理的优化预训练深度学习模型和工具集合
一套用于加速高性能推理应用开发和部署的优化预训练深度学习模型及工具集合。
CTranslate2: 一个具有先进量化和硬件优化的 Transformer 模型高性能推理引擎
一个用于高效 Transformer 模型推理的 C++ 和 Python 库,通过使用量化和自定义运行时来加速 CPU 和 GPU 上的执行并减少内存使用。
whichllm: 一个基于硬件感知的推荐引擎,根据系统规格和真实基准测试对最佳本地 LLMs 进行排名
一种硬件感知的 LLM 推荐工具,根据您的特定 GPU/CPU/RAM 和真实基准测试性能对最佳 HuggingFace 模型进行排名。
argmax-oss-swift: 为 Apple 平台提供语音转文本、文本转语音和说话人日志功能的端侧音频推理框架
一套为 Apple 平台提供的端侧推理框架集合,使用 Core ML 提供语音转文本、文本转语音和说话人日志功能。
TensorRT: 用于在 NVIDIA GPU 上加速 AI 模型的高性能推理优化器和运行时
一种 AI 推理优化器和运行时,可在 NVIDIA GPU 上加速各种模态的深度学习模型执行。
ncnn:面向移动、嵌入式和桌面部署的高性能神经网络推理框架
面向移动、嵌入式和桌面部署的高性能神经网络推理框架,无第三方运行时依赖。
ColossalAI: 一个用于高效大规模模型训练和推理的分布式深度学习框架
一个分布式深度学习框架,通过先进的并行和内存管理,使大型 AI 模型的训练和推理变得更快、更便宜。
Fil-C 内存安全上下文切换
Fil-C 实现了 setjmp/longjmp 和 ucontext API 的内存安全版本,以防止栈损坏和悬空栈执行,并将这些机制与它的能力模型和垃圾回收器集成在一起。
丹尼尔·桑切斯·埃斯特拉达案:言论自由 vs. 证据篡改
丹尼尔·桑切斯·埃斯特拉达因运输小册子被判 30 年监禁,引发了关于此行为是受保护的言论自由还是通过隐藏证据而构成妨碍司法的刑事行为的争论。
Sandia National Labs SA3000 辐射硬化 CPU
Sandia SA3000 是 Intel 8085 处理器的辐射硬化 CMOS 转换版,专为核武器和深空任务设计。