OpenSenseNova/SenseNova-Skills

Modular SenseNova skills for building AI-powered office assistants and productivity workflows

解決的問題

SenseNova-Skills 為 AI Agent 提供了一套端到端的辦公能力,使其能夠執行複雜的專業任務,例如生成高品質的簡報、分析大型 Excel 數據集、進行深度網路研究以及建立結構化的資訊圖。它彌合了通用大語言模型(LLM)與具體、生產就緒的辦公工作流之間的差距。

工作原理

該專案遵循 Agent Skills 規範,每個能力都被定義為一個獨立的「技能(skill)」,具有各自的觸發器和執行流程。這些技能旨在插入到 OpenClaw 或 hermes-agent 等 Agent 執行環境中,並與 SenseNova 模型 API 配對使用。

能力按層級組織:

  • Image & Visualization:包括文本生成圖像、圖像識別工具,以及一個利用 VLM 審查和品質分級來生成出版級視覺效果的專用資訊圖生成器。
  • Presentations (PPT):一個將簡報或文件轉換為大綱、將其渲染為逐頁 HTML 並最終匯出為 PPTX 檔案的流水線。
  • Data Analysis (DA):用於多工作表 Excel 編排、透過 Parquet 轉換處理大檔案以及透過 OCR 從圖像/圖表中提取數據的工具。
  • Deep Research:一個使用依賴關係 DAG 和基於證據的內容單元來生成 Markdown 或 HTML 格式綜合研究報告的編排器。
  • Search:跨多個平台聚合的學術、開發者和社群媒體搜尋介面。

適用對象

構建辦公生產力 AI Agent 的開發者、尋求自動化研究和報告的企業用戶,以及希望透過具體工具擴展其 Agent 能力的 SenseNova 模型家族用戶。

亮點

  • 端到端工作流:可以將數據分析、深度研究和 PPT 建立串聯成一個統一的流水線。
  • 資訊圖生成:將複雜數據壓縮為結構化、視覺化資訊圖的專用系統。
  • 專業 PPT 流水線:支援多種模式(快速、標準、創意),具備基於 VLM 的品質控制和 HTML 轉 PPTX 匯出功能。
  • 高性能數據處理:針對大型 Excel 檔案(1萬+ 列)進行了優化,採用串流讀取和記憶體優化。
  • 廣泛的搜尋整合:統一存取學術(ArXiv, PubMed)、開發者(GitHub, Stack Overflow)和社群(Reddit, X)資源。