Google DeepMind AI 啟用指標
Google DeepMind 正在開發一款由 Gemini 驅動的 AI 啟用指標,將傳統的滑鼠游標轉變為具備情境感知的工具。此系統使用簡單的指向與語音指令,讓使用者能在任何應用程式中與 AI 互動,免除手動將資料移至獨立 AI 視窗或撰寫詳細文字提示的需求。
核心互動原則
Google DeepMind 制定了四項指導原則,將提供情境的負擔從使用者轉移到電腦,從而實現更自然的人機協作。
保持流程
AI 功能被設計為跨所有應用程式運作,以防止「AI 迂迴」的情況。AI 啟用指標使用戶能在當前工作流程中完成任務,例如:
- 請求 PDF 的要點摘要,並貼入電子郵件。
- 將統計表格滑過時轉換為圓餅圖。
- 將已選取的食譜中的食材量加倍。
展示與說明
為了消除對精確、詳細提示的需求,AI 啟用指標會捕捉游標周圍的視覺與語意情境。這使系統能自動辨識使用者所指的特定單字、段落、程式碼區塊或圖像區段,無需明確描述。
善用「這」與「那」的力量
系統結合指向手勢與語音,允許使用自然的簡寫,例如「修正這個」或「把那個移到這裡」。透過共享的視覺情境,AI 能解析模糊代名詞,免除在文字提示中長篇說明的需求。
將像素轉化為可操作實體
AI 不僅僅追蹤座標,而是了解指標下物件的身份。這將靜態像素轉變為結構化、可互動的實體,包括:
- 將手寫筆記的照片轉換為互動式待辦清單。
- 將旅遊影片中暫停的畫面轉為所示餐廳的直接預訂連結。
產品整合與可用性
Google 正將這些 AI 指標原則整合至多項現有與即將推出的產品中:
- Chrome:使用者現在可以使用指標在 Chrome 中向 Gemini 詢問網頁的特定部分,例如比較所選商品或在房間內視覺化家具。
- Googlebook:名為「Magic Pointer」的功能將在 Googlebook 筆記型電腦體驗中推出,以提供直觀的 Gemini 整合。
- Google AI Studio:提供實驗性示範,讓使用者測試 AI 啟用指標在編輯影像、在地圖上尋找地點等任務中的應用。
- Google Labs:未來概念將持續透過 Google Labs 的 Disco 進行測試。