Haervwe/open-webui-tools

Open‑WebUI Tools is a modular toolkit designed to extend and enrich your Open WebUI instance, turning it into a powerful AI workstation. With a suite of over 15 specialized tools, function pipelines, and filters, this project supports academic research, agentic autonomy, multimodal creativity, workflows, and more

What it solves

このプロジェクトは、Open WebUI の機能を拡張するために設計されたモジュラーなツール、関数パイプ、フィルタのコレクションを提供します。標準的な AI チャットインターフェースを、学術研究、メディア検索、画像・動画生成、そして自律的なエージェント行動のための専門機能を追加した多目的ワークステーションに変換します。

How it works

ユーザーは Open WebUI Hub からこれらのコンポーネントをインストールするか、Python ファイルを手動で自分の Open WebUI インスタンスにコピーして使用できます。コレクションは主に以下の 3 つのカテゴリに分かれています:

  • Tools:LLM が arXiv、YouTube、Pexels の検索や、さまざまなバックエンド(Hugging Face、Cloudflare など)を介した画像生成など、特定のタスクを実行できるスタンドアロン関数。
  • Function Pipes:自律的な計画(Planner Agent)や複雑な研究ワークフロー(MCTS)、マルチモデル会話を可能にする高度なロジック層。
  • Filters:プロンプトを修正したり応答をクリーンアップしたりするミドルウェア。例としてプロンプトエンハンサーやモデル選択のためのセマンティックルーターがあります。

Who it’s for

このツールキットは、単なるチャットを超えて AI を外部 API、クリエイティブツール(ComfyUI など)、高度なエージェントフレームワークと統合し、研究やコンテンツ作成を自動化したい Open WebUI ユーザー向けです。

Highlights

  • Academic & Research:arXiv 検索と Monte Carlo Tree Search(MCTS)を統合し、深い研究を支援。
  • Media Integration:YouTube 動画、Pexels メディア、X(Twitter)データの検索と埋め込みツール。
  • Creative Suite:ComfyUI と Google Veo を使用した画像から画像、テキストから動画、音楽生成をサポート。
  • Agentic Capabilities:マルチエージェント委任とリアルタイム実行トラッキングを備えた Planner Agent。
  • Plug-and-Play:ほとんどのツールは最小限の設定で設計されており、Open WebUI インターフェースへのシームレスな統合が可能です。