Mistral AI 美国专利 12,670,045: Code Implemented Tool Calls

Mistral AI 已获得美国专利 12,670,045,题为 "Code implemented tool calls",该专利涵盖了一种在大型语言模型 (LLM) 生成的代码块中封装工具调用并执行这些调用的方法。这项专利代表了这家法国 AI 实验室在美国市场保护知识产权的战略举措,因为在美国,软件专利比在欧盟更被广泛接受。

Technical Mechanism of the Patent

该专利的核心描述了一个系统,其中 LLM 不仅仅是输出一个工具调用,而是生成一个包含一个或多个工具调用的编程语言完整代码块。

根据主要权利要求,该过程遵循以下步骤:

  1. Request Reception: 服务器接收用户执行工具调用的请求。
  2. Code Generation: LLM 生成一个封装了所需工具调用的代码块。
  3. Sandboxed Execution: 服务器在沙盒中执行此代码块。
  4. Execution Pause: 当系统遇到待处理的工具调用时,它会暂停代码块的执行。
  5. Client Communication: 待处理的工具调用被传输给客户端进行执行,并将结果数据发回服务器。
  6. Resumption: 服务器将工具调用结果代入代码块并恢复执行。
  7. Final Output: 执行完毕的代码块最终结果返回给 LLM。

Advanced Implementation: Stateless Resumable Sandboxes

虽然主要权利要求范围很广,但从属权利要求表明其技术重点更具体地集中在 "stateless resumable sandbox"(无状态可恢复沙盒)上。这种实现方式通过执行代码直到遇到此类操作(例如随机数或日期),然后从头开始重新播放代码,同时缓存之前非确定性操作的结果,以确保一致性和效率。

Industry Reaction and Prior Art

该专利的授予引发了技术社区内的激烈辩论,许多人认为所描述的模式是一种基础的软件工程实践,而非一项新颖的发明。

Claims of Prior Art

几位社区成员指出了实现类似 "CodeAct" 模式的现有框架和研究:

  • CodeAct: 一篇研究论文 (arXiv:2402.01030) 描述了 LLM 通过代码与计算机进行交互。
  • LangGraph-CodeAct: 据报道,该框架在 2026 年 2 月就已交付此功能,早于该专利 2026 年 3 月 4 日的申请日期。
  • Cloudflare Code Mode: 一种较早的 LLM 驱动的代码执行实现。
  • Scala Community: 对 "tracked capabilities" 和 tacit 项目的研究,探索了类似的智能体执行模式。

Community Perspectives on Software Patents

Hacker News 上的批评者将该专利定性为试图建立 "moat"(护城河)或作为 "lawfare"(法律战)工具,暗示其技术新颖性极低。

"Is 'by an LLM' the new 'on a computer' for lame patents?"

相反,一些分析师认为该专利是一种防御性的商业策略。由于 Mistral 是一个在全球范围内运营的开源权重公司,持有美国专利可以提供 "defensive leverage, cross-licensing, and one more asset on the books to make it attractive to investors"(防御性杠杆、交叉许可和账面上多一项资产以增加对投资者的吸引力),无论该专利是否能在严苛的法庭挑战中站得住脚。

Summary of Patent Status

与最初认为这只是一个待处理申请的假设不同,该专利 (US 12,670,045 B1) 已被正式授予。它于 2026 年 3 月 4 日提交,并于 2026 年 6 月授予,这表明了一个加速审查过程。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch