webmachinelearning/webmcp

🤖 WebMCP

解決的問題

WebMCP 解決了 AI 代理在與現代網頁應用互動時所面臨的困難。傳統上,代理依賴於脆弱的技術,如 DOM 抓取或模擬滑鼠點擊,這些方法不可靠,且經常跳過應用程式的內部狀態與驗證。WebMCP 允許網頁開發者將特定網站功能作為結構化的「工具」公開,讓代理可以直接呼叫,從而確保更可靠的作動,同時讓使用者保持知情。

工作原理

WebMCP 引入了一個客戶端 API(document.modelContext),讓開發者可以將 JavaScript 函數或 HTML <form> 元素註冊為工具。每個工具都包含自然語言描述與結構化輸入模式。當 AI 代理(無論是內建於瀏覽器中,還是託管於 iframe 中)需要執行某項動作時,它會發現這些已註冊的工具,並以正確的參數呼叫它們。瀏覽器負責中介呼叫,執行客戶端邏輯,並將結果回傳給代理,代理隨後更新 UI 或通知使用者。

適用對象

適用於希望在不建構獨立後端整合的情況下,使自己的應用「支援代理」的網頁開發者,以及需要一種穩定、由開發者定義的方式與網頁內容互動的 AI 代理開發者。

主要亮點

  • 客戶端執行:重用現有的 JavaScript 邏輯,無需額外的後端伺服器即可維持使用者驗證與會話狀態。
  • 人在回路中:專為協作式工作流程設計,使用者在代理執行任務時仍能保持對頁面的可見性與控制權。
  • 混合方法:同時支援透過 JavaScript 的命令式註冊與透過 HTML 表單的宣告式註冊。
  • 安全委派:使用 Permissions Policy(allow="tools")控制哪些 iframe 或來源可以存取已註冊的工具。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案