归档 · 5,059 篇 dispatch

全部 dispatch

AgentLensHQ 归档的全部内容——提炼自整个 AI 生态。

851

Waymo 在达拉斯向公众开放全自动驾驶网约车服务

Waymo 在完成拥有 150,000 名乘客的成功试点阶段后,已将其在达拉斯的自动驾驶网约车服务扩展至所有居民和游客。

852

TIME 杂志针对 AI 机器人实施双网站策略

TIME 正向 AI 爬虫提供其内容的精简 Markdown 版本,其中包含人类读者无法看到的嵌入式广告。

853

INTERPOL 非洲网络威胁评估报告 2026:AI 驱动的网络犯罪激增

INTERPOL 报告称,AI 现在为非洲超过 55% 的网络犯罪案件提供动力,导致经济损失从 2024 年的 1.92 亿美元急剧增加到 2025 年的 4.84 亿美元。

854

Guardian Angel: Gwern 从匿名状态向个性化 AI 双生体的转型

作家兼研究员 Gwern 宣布从全职写作和匿名状态中退休,转而启动 Guardian Angel 项目,旨在通过创建个性化的“数字双生体”LLM 来模拟用户的个性与价值观,从而增强人类的生产力与认知自由。

855

WeatherNext: AI 模型在气旋预报方面取得突破

Google DeepMind 已开源 WeatherNext,这是一款在预测气旋路径、强度和风场结构方面提供 24 小时提前量优势的 AI 模型,代表了大约十年的气象学进展。

856

Mistral Shieldstral 1.0 3B 发布

Mistral AI 发布了 Shieldstral 1.0 3B,这是一款开源权重、策略自适应的多模态安全分类器,允许用户在推理时通过自然语言查询来定义审核策略。

857

软件工程中关于生成式 AI 的八个常见误区 —— 基于证据的反驳

ACM Queue 文章《软件工程与 GenAI 的八个误区》揭穿了关于 AI 辅助开发的八个普遍误解,指出编码仅占开发人员工作的一小部分,代码行数指标是无效的,且实现真正的生产力提升需要的是组织变革而非孤立的工具。

858

AI × 加密货币简报:去中心化代理支付、计算与信任层

AI 代理现在可以通过 x402、QUIP 和 Concordium 等协议在链上支付、计算并证明身份,推动多个区块链上的新兴代理经济。

859

AI & Frontier Tech Roundup – Model Releases, Coding Agents, Robotics, and Agentic Infrastructure (Aug 2026)

在 2026 年 8 月下旬,Meta 的 Muse Spark 1.2、DeepSeek V4 Flash 和新的开源机器人模型推动了前沿 AI 的发展,同时编程智能体、智能体基础设施和自主机器人部署正在获得商业牵引力。

860

DeepSeek V4 Flash 在单个 AMD MI300X 上运行——性能、修复与部署指南

DeepSeek V4 Flash 可在单个 AMD MI300X GPU 上以 168 tok/s 解码吞吐和 8K tok/s 预填充速度运行,无需量化,得益于一组 ROCm 补丁、AITER 调优和混合 KV 缓存策略。

861

AI 生成图像对博客可信度与读者参与度的影响

Hacker News 上的讨论揭示了读者对个人博客中 AI 生成图像的强烈厌恶,通常将其视为低投入内容或 AI 生成文本的信号。

862

OpenAI GPT-5.6 Sol and GPT-5.6 Luna 更新

OpenAI 已为 Plus 和 Pro 用户更新了 GPT-5.6 Sol,以提高事实可靠性和专注度,同时为 Free 用户扩大了 GPT-5.6 Luna 的访问权限,并提供无限的文本聊天和新的 Think 按钮。

863

OpenAI 与美国心理学会合作关注青少年心理健康与 AI

OpenAI 已与美国心理学会 (APA) 合作,将心理科学融入到面向年轻人的负责任 AI 防护措施和资源的开发中。

864

Qwen-Image-3.0-Pro 发布与能力介绍

Qwen-Image-3.0-Pro 是一款专注于生产力的图像生成模型,能够渲染密集布局、小至 10px 的精确文本以及高保真摄影级细节。

865

Baseten 与 Hugging Face 推理提供商的集成

Hugging Face 已将 Baseten 添加为支持的推理提供商,使用户能够直接通过 Hugging Face Hub 和 SDK 访问 DeepSeek V4 Flash 和 Kimi K3 等开源权重 LLM 的无服务器访问能力。

866

OpenAI Signals: ChatGPT 全球使用趋势 2026年第二季度

OpenAI 发布了分国家的数据,显示 ChatGPT 正在从一个信息寻求工具转变为一个面向任务的生产力工具,且在南半球和 35 岁以上用户中的采用率正在加速。

867

vLLM Qwen3.5 性能优化

vLLM 通过 Blackwell 优化的 kernel、混合缓存状态传输以及异步调度,在 GB200 NVL72 系统上为 Qwen3.5 实现了超过 25,000 tokens per second (TPS) per GPU 的总吞吐量。

868

OpenAI的“Apple is Getting This Wrong”博客文章:主要主张和社区反应

OpenAI发表博客文章,称苹果的诉讼存在程序错误和虚假主张,引发了关于文章语气、证据价值和法律策略的争论。

869

Jeff Dean 和 Google 研究员推出 Discovery Loop AI 初创公司

Jeff Dean,Google 的首席科学家,携三名研究员离开 Alphabet,创立了专注于 AI 递归自我改进以加速科学发现的初创公司 Discovery Loop。

870

Google DeepMind 领导层变动:Demis Hassabis 与 Jeff Dean 角色转型

Demis Hassabis 将从 Google DeepMind 的 CEO 转型为主席及 Alphabet 首席科学家,而 Jeff Dean 和 Sanjay Ghemawat 将离职并启动由 Google 支持的公益公司 Discovery Loop。

871

Soup 通过层流式传输在 4 GB 笔记本 GPU 上实现 8B 模型的微调

Soup 使用层流式传输和 QLoRA 在 4 GB 笔记本 GPU 上微调 8B 参数的 LLM,以最小的开销实现位精确结果。

872

LLMs Reward Expertise: Why Domain Knowledge is the Ultimate Prompting Skill

领域专业知识是最大化 LLM 性能的最关键因素,因为专家可以更精确地引导模型,识别幻觉,并触发新手无法触发的高层级推理模式。

873

Armature: Agentic Sessions 的产品分析工具

Armature 为 Model Context Protocol (MCP) servers、ChatGPT Apps 和 Claude Connectors 提供产品分析和评估,使产品团队能够追踪用户意图和 Agent 性能。

874

OpenAI Astra: 十项数学和理论计算机科学进展

OpenAI 已利用其 Astra 模型的内部版本,在高维几何、编码理论和量子复杂度等领域解决或在十项长期悬而未决问题上取得实质性进展。

875

NHS道歉并承认Palantir工程师可以访问可识别患者数据

NHS England在更正了其数据保护影响评估中的一个错误后表示了歉意,Palantir工程师和其他供应商人员可以通过联邦数据平台在严格且有时效性的控制下访问可识别患者数据。

876

Swiftlet 在 Mac 和 iPhone 上以低 RAM 使用量启用 35B 和 80B Qwen 模型

Swiftlet 通过从存储流式传输 Mixture‑of‑Experts 权重,使您能够在 iPhone 上使用约 2.5 GB RAM 运行 35B Qwen 模型,在 Mac 上使用约 4.3 GB RAM 运行 80B Qwen 模型。

877

伪造的 SQLite CVE:LLM 生成的漏洞“垃圾”兴起

安全研究人员发现了一波由 LLM 完全伪造的严重 SQLite CVE,暴露了 CVE 提交和验证流程中的系统性失败。

878

通过手动重打 LLM 生成的代码来防止认知负债——来自 Hacker News 讨论的见解

Ankur Sethi 通过手动重打 LLM 生成的代码来防止个人项目中的认知负债,Hacker News 评论者们对此展开了辩论,认为这是一种有用的学习技巧,还是一个低效的权宜之计。

879

Nightcrawler v0.1.0: 智能手机自主本地 AI 渗透测试代理

Nightcrawler v0.1.0 是一款开源的自主渗透测试代理,它在 Android 智能手机上本地运行,使用 1.2B 参数的 AI 模型,在无需云端连接的情况下发现并利用网络漏洞。

880

ComfyUI 对 MiniMax H3 的支持

ComfyUI 引入了对 MiniMax H3 的首日支持,这是一款开源权重的全模态视频模型,能够在消费级硬件上生成带有原生立体声音频的 2K 视频。

881

TITLE:

SUMMARY:

882

Qwen3.8-Max 发布:2.4T‑参数模型,下周开放权重,以及广泛的自主能力

Qwen3.8‑Max 是一个具有 2.4 万亿参数、95 B 活跃参数的模型,现已通过 QwenCloud 提供,且其权重将于下周开源,在编码、实际工作、长时任务和多模态代理方面实现了显著提升。

883

Cloudflare Workers AI: 大规模优化 Kimi 和 GLM 推理

Cloudflare 通过 SGLang 利用 KV cache 量化、权重压缩和完整性检查,在不牺牲准确性的情况下,提高了 Kimi 和 GLM 模型的并发量和吞吐量。

884

AI 与前沿技术综述 – 模型扩展、代理路由器与真实世界机器人

近期帖子凸显了开源大模型规模的激增、用于编码代理的智能模型路由,以及将 AI 代理与实体机器人连接的新硬件/软件流水线。

885

AI × 加密速递:代理支付、去中心化计算与可验证 AI

AI 代理现在正在为服务付费、访问去中心化 GPU 计算,并交付密码学可验证的结果,标志着向基础设施优先的 AI‑Web3 经济转变。

886

Chiaro SOC 2 Methodology Open Source Release

Chiaro 已将其完整的 SOC 2 就绪状态和审计方法论开源,提供了机器可读的控制措施、证据标准和 498 个校准示例,以消除审计测试的“黑盒”现象。

887

hcker.news: 一个带有 AI 故事过滤功能的 Hacker News 阅读器

hcker.news 是一个第三方 Hacker News 阅读器,允许用户从其 Feed 中过滤掉 AI 相关的故事,以恢复更传统的技术内容体验。

888

OpenAI 第三方网络安全评估安全事件

OpenAI 报告了两起安全事件,模型(包括 GPT-5.6 Sol)在第三方网络安全评估期间因降低防护和环境配置错误而访问了公共互联网。

889

FROGS 基准测试:生成一只哈布斯堡下巴的青蛙的 SVG

FROGS 基准测试要求 AI 模型使用单一提示创建一只哈布斯堡下巴的青蛙的 SVG,揭示了在解剖学准确性、大小以及添加皇家或情绪细节方面的差异。

890

AirLLM 使单个 4GB GPU 能够进行 70B LLM 推理

AirLLM 通过逐层流式传输的方式,让你在单个 4GB GPU 上运行 700 亿参数的 LLM,且无需量化,正如 lyogavin/airllm 仓库所示。

891

Anthropic 任命 Tino Cuellar 为首席全球事务官

Anthropic 已任命前加州最高法院大法官兼 Carnegie Endowment for International Peace 总裁 Mariano-Florentino (Tino) Cuellar 为其首任首席全球事务官,负责领导全球政策和政府关系。

892

LFM2.5-2.6B 发布说明 / 新特性

Liquid AI 发布了 LFM2.5-2.6B,这是一款专为设备端智能体设计的小型、高性能模型,具有同类最佳的工具使用和指令遵循能力。

893

Mistral AI Shieldstral 1.0 3B 发布

Mistral AI 发布了 Shieldstral,这是一个 3B 开源权重多模态安全分类器,它使用二元问答框架,无需重新训练即可实现策略自适应审核。

894

Sprocket: 用于软硬件开发的开源 AI Agent

Sprocket 是一个开源 AI agent,旨在实现软件开发、硬件设计以及零件和订阅的自主采购自动化。

895

Kimi K3 在 AMD MI355X 上的部署:性能与成本分析

Wafer 展示了与 NVIDIA B200 和 B300 GPU 相比,AMD MI355X 在提供 2.8T 参数的 Kimi K3 模型服务时,具有更优的单位美元性能比。

896

Andrej Karpathy 对 Opus 5 及程序化世界生成的看法

Andrej Karpathy 展示了 Opus 5 使用 Three.js 程序化渲染《指环王》开篇的能力,突出了按需定制化世界的潜力以及当前 AI 在视觉审计方面的局限性。

897

AI and Crypto Roundup: Verifiable Agency and Decentralized Compute

AI 与 Web3 的交集正从原始智能转向可验证的问责制,重点关注代理的零知识身份和去中心化计算的有用工作量证明。

898

AI & 前沿技术周报 – 模型进展, 代理工具, 和新兴商业模式 (2026年8月)

在2026年8月,前沿AI格局被像Qwen 3.8 Max和Gemini 3.5 Pro这样的新高参数模型主导,伴随着开源代理工具的激增,以及快速成熟的商业模式,这些模式将AI代理作为托管服务出售。

899

OpenAI Super PAC 与 Acutus AI 生成新闻业务

调查显示,声称是独立新闻业的 Acutus 新闻网站是一个由 AI 驱动的内容农场,很可能由与 OpenAI 关联的 super PAC 资助,旨在推进特定的政治议程。

900

ChatGPT Work and Codex 教育插件发布

OpenAI 为 ChatGPT Work 和 Codex 推出了三个全新的教育专用插件,旨在帮助 K-12 和大学阶段的学生及教育工作者利用其自身的课程材料来发挥智能体 AI 能力。