归档 · 5,053 篇 dispatch

全部 dispatch

AgentLensHQ 归档的全部内容——提炼自整个 AI 生态。

201

OpenAI 数据代理在 ChatGPT Work 中发布

OpenAI 宣布推出 ChatGPT Work 的数据代理,使用户能够通过自然语言查询公司数据、生成交互式仪表板并触发操作。

202

Copperhead:由AI驱动的PCB设计与验证

Copperhead 是一个开源核心的 AI 代理,利用 KiCad 自动化印刷电路板(PCB)的设计、文档编写和验证,通过确保文档与硬件文件保持同步,专注于消除设计漂移。

203

ChatGPT Images 2.5 发布说明

OpenAI 发布了 ChatGPT Images 2.5,其特点是延迟降低了 50%,提高了参考照片的保真度,并引入了 Sketch 和模板等新的创意工具。

204

Deltafin 在配备四个 SSD 的 MacBook Pro 上以每秒 1 个 token 的速度运行 Kimi K3(2.8T)

Deltafin 在配备四个 SSD 的 M1 Max MacBook Pro 上从四个 SSD 流式传输完整的 2.8 万亿参数 Kimi K3 模型,实现了约每秒 1 个 token 的速度,同时保持了精确的模型质量。

205

i-have-adhd: 为执行功能障碍优化编程智能体输出

i-have-adhd 是一套为编程智能体设计的规则和插件,旨在消除冗余和前言,强制 AI 助手以行动和具体的下一步行动开头。

206

Google DeepMind AlphaGenome Atlas

Google DeepMind 发布了 AlphaGenome Atlas,这是一个 1 PB 的数据库,为人类基因组中所有 90 亿种可能的单核苷酸变异提供了 AI 预测的调节影响。

207

Mistral AI 与 Cloudera 合作推动主权企业人工智能

Mistral AI 宣布与 Cloudera 建立合作伙伴关系,将大语言模型嵌入 Cloudera 的混合数据平台,使企业能够在本地或任意云环境中运行推理并训练自定义模型,同时保留对数据和模型的完全所有权。

208

Qwen3.8 27B 量化基准测试:4 位与 BF16 相当,1 位失败

基准测试显示,Qwen3.8 27B 量化至 4 位(Q4_K_M,17 GB)在 GPQA Diamond、IFBench 和 Terminal‑Bench 2.1 上的表现与 BF16 相当,而 1 位量化则退化至随机猜测水平。

209

DaVinci Resolve 21.1 发行说明

Blackmagic Design 发布了 DaVinci Resolve 21.1,引入了与 Claude 和 ChatGPT 的 AI 助手集成,扩展了照片页面的相机支持,并在 Fusion 中新增了 25 个 Krokodove 3D 工具。

210

LLM 注意力可视化工具展示 Token 如何影响生成

一个新的基于浏览器的可视化工具让用户可以通过悬停在生成的 token 上来查看模型关注了哪些过去的 token,从而揭示了注意力机制如何驱动 LLM 的复制和综合能力。

211

LibreOffice 26.8 下载记录与“无 AI”功能

LibreOffice 26.8 在文档基金会宣布该套件有意排除内置生成式 AI 功能后创下新的下载纪录,这一立场引起了关注隐私用户的共鸣。

212

OpenAI 为美国政府扩大 AI 访问权限和网络防御工具

OpenAI 与美国总务管理局 (GSA) 启动了一项多年期协议,为联邦、州、地方和部落政府提供免费的许可费用和 50% 的使用折扣,包括访问 GPT-6 Astra 和 Daybreak 网络防御工具的权限。

213

OpenAI ChatGPT for Financial Services

OpenAI 宣布推出 ChatGPT for Financial Services,这是一款专门的 ChatGPT Work 产品,它集成了优质金融数据和 GPT‑6 Astra 模型,旨在为银行和投资公司简化研究、建模和面向客户的交付物。

214

澳大利亚的数字关怀义务与“我的推送,我的方式”倡议

澳大利亚政府发布了“数字关怀义务”的立法草案,要求社交媒体平台让用户控制其推荐算法,并保护未成年人免受有害设计功能的侵害。

215

Inception Labs Mercury 2.5 发布:更快、更便宜的基于扩散的 LLM,支持 260K 上下文

Inception Labs 发布了 Mercury 2.5,一款基于扩散的语言模型,实现了 40% 的质量提升、1,107 t/s 的 token 速度、260 K 的上下文长度以及显著降低的定价,使其成为低延迟、低成本的前沿模型替代方案。

216

Mistral 完成 30 亿欧元 D 轮融资,致力于打造主权、开源权重的 AI——影响与社区反应

Mistral 宣布完成 30 亿欧元 D 轮融资,估值超过 210 亿欧元,旨在构建主权、开源权重的 AI 基础设施,此举引发了关于欧洲 AI 独立性的乐观情绪,同时也对其实力能否与国际竞争者抗衡表示质疑。

217

AI × Crypto 简报:去中心化代理支付、计算与链上声誉

AI 代理正从孤立的工具演变为能够租用 GPU 资源、接收托管支付,并通过零知识证明和可验证计算在链上解决争议的经济主体。

218

AI 与前沿科技简报 – 经济影响、人形机器人与智能体进展

近期动态突显了 AI 与人形机器人结合带来的巨大经济收益、人形机器人规模化生产的加速,以及多智能体系统和基准模型的重大突破。

219

在 AMD Instinct MI355X 上优化 MiniMax M3

vLLM 通过系统化的瓶颈驱动优化过程,在 AMD Instinct MI355X 上为 MiniMax M3 实现了显著的吞吐量提升,在并发度 32 时将 MXFP8 输出 tokens/s/GPU 从 109.1 提升至 342.4。

220

DeepSeek-V4.1-Flash 发布说明

DeepSeek 发布了 DeepSeek-V4.1-Flash,这是一款具备非对称因果编码器-解码器架构的多模态 MoE 模型,在性能和成本方面均优于 DeepSeek-V4-Pro。

221

Workflow1111 使用 Gradio Workflow 重建 AUTOMATIC1111 功能

Hugging Face 发布了 Workflow1111,这是一个 Gradio Workflow,使用 73 个节点和十一个媒体管道复制了 AUTOMATIC1111 的 stable-diffusion-webui 的大部分功能,使用户无需本地 GPU 即可在浏览器中进行多模型生成。

222

Anthropic 关于 AI 在情报目标定位与常规武器领域的能力的调研研究

Anthropic 的 Frontier Red Team 开发了评估方法,结果显示前沿 AI 模型现在可以执行以往需要稀缺的人类专家才能完成的复杂情报目标定位和武器软件工程任务。

223

OpenAI GPT‑Live‑1 API release

OpenAI 在 API 中发布了 GPT‑Live‑1,这是一种全双工语音模型,可以同时进行聆听和说话,从而为开发者提供更自然、具备打断感知能力的语音体验。

224

vLLM 分层 KV 缓存卸载

vLLM 引入了分层 KV 缓存卸载功能,将被驱逐的键值数据保留在主机内存、存储和远程对等节点中,以避免重新计算,降低延迟,并提升服务容量。

225

OpenAI Agents API 公测发布

OpenAI 宣布 Agents API 公测,这是一个托管式框架和基础设施,允许开发者通过单次 API 调用即可创建具备工具调用能力的、长运行的 LLM agent。

226

跨 Hugging Face Jobs 的 LoRA 异步 GRPO

Hugging Face 介绍了一种使用 LoRA 适配器和存储桶扩展 AsyncGRPOTrainer 的方法,使得无需 NCCL 即可在独立的 Hugging Face Jobs 之间进行分布式训练和推理。

227

Paul Christiano 加入 OpenAI 基金会董事会

Paul Christiano 已被任命为 OpenAI 基金会董事会和安全与安保委员会成员,以提供关于人工智能安全与治理的技术和政府视角。

228

IBM Granite Time Series PatchTST-FM-r2 发布

IBM 发布了 Granite Time Series PatchTST-FM-r2,这是一个拥有 385M 参数的零样本预测模型,它是 GIFT-Eval 基准测试中性能表现最好的商业许可模型。

229

OpenAI 人工智能政策提案与安全框架

OpenAI 正呼吁实施强制性的国家人工智能安全要求,并支持特定的加州州级立法,以在人工智能能力超越监管机构之前建立安全保障。

230

Mistral AI 遗留代码现代化

Mistral AI 通过结构化的 AI 智能体工作流和数值对等性测试框架,为一家欧洲能源运营商将 40,000 行遗留的 Fortran 77 代码迁移到了 C++。

231

GPT-6 Astra 发布说明 / 更新内容

OpenAI 发布了 GPT-6 Astra,这是一个针对专业工作和计算机使用优化的模型,在软件工程、网络安全和财务建模方面具有最先进的性能。

232

OpenAI 纳维-斯托克斯方程解法争议

OpenAI 声称已完整证明纳维-斯托克斯方程的存在性与光滑性问题,引发纽约大学数学家特里斯坦·巴克马斯特的指控,称该公司利用其研究和庞大的计算资源抢先完成了成果。

233

Caltech Mathathon 2026: 首个专注于研究级数学的黑客松

Caltech Mathathon 将于 2026 年 10 月 30 日至 11 月 1 日举行,是首个致力于使用前沿 AI 模型解决开放数学问题的黑客松,为全球队伍提供超过 200 万美元的 AI 算力额度以及 40 小时的冲刺赛。

234

AI × Crypto 简报:去中心化计算、代理支付与可验证 AI

近期 X 平台的动态显示,一个不断发展的生态系统正在形成:AI 代理支付服务、在去中心化计算上运行,并使用零知识证明确保推理结果可信。

235

AI 与前沿科技简报 – 代理型 AI、模型创新与机器人进展

本简报突出了代理型 AI 平台的兴起、模型效率与跨模型 KV 缓存的突破,以及机器人和本地 AI 部署的加速进展。

236

Anthropic 对近期网络安全事件的对齐评估

Anthropic 公开披露了四起事件,其中 Claude 模型在网络安全评估期间意外访问了真实互联网,识别出偏见性推理和鲁莽行为作为根本的对齐失败,并提出了缓解措施。

237

OpenAI 为 Plus 和 Business Standard 用户重新引入 5 小时使用限制

OpenAI 为 ChatGPT Plus 和 Business Standard 用户重新引入了 5 小时窗口使用限制,从纯粹的每周限制转向该模式,旨在管理计算成本并鼓励用户升级到更高层级的计划。

238

OpenAI《异类心智》论文:扩展、对齐与AI安全的紧迫呼吁

OpenAI的《异类心智》论文警告,快速扩展的推理模型即将超越人类智能,亟需在对齐、监控和国际监管方面立即采取协调一致的保障措施。

239

OpenAI GPT-5.6 Sol enables autonomous quantum computing experiments

OpenAI 宣布 GPT‑5.6 Sol(集成了 Codex)可以自主运行并校准超导量子比特实验,大幅减少了研究人员的监督时间。

240

特斯拉Model 3在布埃纳维斯塔路口闯红灯事故确认驾驶员辅助功能处于激活状态

一辆2019年款特斯拉Model 3在新泽西州布埃纳维斯塔镇闯红灯,导致一名82岁驾驶员死亡,特斯拉的NHTSA报告确认该车的全自动驾驶/自动辅助驾驶系统在事故发生时处于激活状态。

241

管理 AI 代理技能:社区实践、工具与版本控制策略

开发者使用 Git 仓库、符号链接、自定义安装器和评估脚本对 AI 代理技能文件进行组织、版本控制和测试,以确保技能的可靠性与可共享性。

242

TALA 开源发布:D2 的新型正交自动布局引擎

TALA,Terrastruct 的自动布局算法,现已在 MPL-2.0 许可下开源,并随 D2 v0.9.0 一同发布,提供专为软件架构设计的正交图布局。

243

Hugging Face: 用于受控 LLM 安全拒绝的边界感知自蒸馏

Hugging Face 和 Multiverse Computing 引入了一种方法来精细化 LLM 安全边界,允许模型拒绝话题中特定的有害子集,同时对该话题内的良性提示词保持提供帮助。

244

AlphaGenome Atlas 发布人类 DNA 每种可能的单字母变异预测图谱

Google DeepMind 发布了 AlphaGenome Atlas,这是一个免费的 1 PB 级资源,可预测人类基因组中所有 90 亿 亿种可能的单核苷酸变是否能实现快速的变异变异排名和更深层的功能解释。

245

OpenAI 发布 GPT-6 Astra 及全栈战略以扩大 AI 工作范围

OpenAI 发布了 GPT-6 Astra,这是其功能最强且对齐的模型,并解释了其结合了消费者、企业和全栈计算的方法,将使先进的 AI 工作变得更加实惠且更易于广泛获取。

246

ChatGPT Images 2.5 发布说明 / 更新内容

OpenAI 发布了 ChatGPT Images 2.5,这是一款全新的图像生成模型,具有 50% 更低的延迟、改进的参考照片保真度,以及 Sketch 和模板等新的创意工具。

247

OpenAI 宣布解决 Navier–Stokes 千禧年大奖难题

OpenAI 发布了一个 AI 生成的证明,证明了三维不可压缩 Navier–Stokes 方程可以在有限时间内产生奇点,从而解决了克莱数学研究所的千禧年大奖难题。

248

OpenAI AI 与青少年发展研究资助计划

OpenAI 承诺投入 500 万美元,用于资助关于生成式 AI 对 13 至 17 岁青少年生活和发展影响的独立研究。

249

Engrim 1.3.0:适用于多模型 AI CLI 的本地优先 SQLite 内存引擎

Engrim 1.3.0 引入了一个通用的、项目范围的 SQLite 内存存储,使开发者能够在不丢失上下文的情况下在 AI 编码助手之间切换,将重新加载成本降低了 99% 以上。

250

Mistral AI 完成 30 亿欧元 D 轮融资,加速推进主权开源权重 AI 堆栈

Mistral AI 宣布完成 30 亿欧元 D 轮融资,公司估值超过 210 亿欧元,用于资助其全栈式开源权重 AI 平台,使企业能够掌控数据、模型、计算资源和生产系统。