aws/context-ontology-accelerator

An open-source, ontology-based semantic context accelerator that enables AI agents to make more accurate, consistent, and explainable decisions.

✦ Context Ontology Accelerator – 何であるか

Context Ontology Accelerator は、AWSに焦点を当てたオープンソースプラットフォームであり、組織のデータ上に 意味的 レイヤーを構築します。自動的にスキーマを発見し、構造化および非構造化データソースをインジェストし、統合された知識グラフ(オントロジー)を作成した後、SPARQLベースのクエリとカスタムの MCP(Message Control Protocol)インターフェースを通じて、AIエージェントやアプリケーションにそのグラフを提供します。目的は、下流のAIシステムが適切な「コンテキスト」を取得し、ビジネスルールに基づいて検証し、何らかの行動を決定できるようにすることです。


コアコンセプトとワークフロー

ステップ 内容 主なコンポーネント
スキャン データベース、ドキュメントストアなどに接続;スキーマとメタデータを抽出;タグで拡張。 sources/ パッケージ – コネクタおよびインジェストパイプライン
モデル化 オントロジーを生成またはインポートし、推論エンジンを実行し、メトリクスを計算し、すべてを単一の 仮想 知識グラフに統合。 ontology-engine/(HermiT/ELK推論エンジン)、metric-service/vkg/(Ontop仮想KG)
提供 SPARQLフェデレーションと軽量なMCPサーバーを通じてグラフを公開し、AIエージェントがコンテキストを要求し、検証済みの結果を受け取れるようにする。 mcp-server/context-manager/(クエリオーケストレーション)

リポジトリ構成(概要)

  • semantic-context/models/ – すべてのAPIのソースオブトラゥスとなるSmithy定義。
  • semantic-context/smithy-generated/ – Smithyモデルから生成されたコード(OpenAPI仕様、Pythonクライアントスタブ、TypeScript SDK)。
  • infra/ – AWS CDK(TypeScript)スタックで、必要なサービス(Lambda、DynamoDB、Neptune、IAMロールなど)をプロビジョニング。
  • packages/ – 上記の機能モジュール(コントロールプレーン、データレイヤー、sources、ontology-engineなど)。
  • web-app/ – AWS Cloudscapeで構築されたReactフロントエンドで、オントロジーの可視化とネームスペースの管理が可能。
  • libs/ – PythonおよびTypeScript用の共有ユーティリティ。
  • external-docs/ – 公開されたユーザーガイドおよびデプロイドキュメント。

技術スタック

レイヤー 技術
言語 Python 3.12、TypeScript
API契約 Smithy → OpenAPI + 生成されたPythonインターフェース + TypeScriptクライアント
インフラストラクチャとしてのコード AWS CDK(TypeScript)
フロントエンド React + Cloudscape Design System
パッケージマネージャー uv(Python)、pnpm(Node)
モノレポツール Nx
推論エンジン HermiT、ELK(owlready2経由)
仮想KG Ontop(SPARQLフェデレーション)
テスト/Lint pytest、ruff、mypy(厳格)
ビルド Smithy CLI(Java 17 + Gradle)

クイックスタート

  1. リリースタグを選択mainブランチは最新版;GitHubのリリースページから安定版を使用。
  2. そのタグでリポジトリをクローンし、cdで移動。
  3. 提供された make コマンドを実行:
    make setup   # uvでPythonをインストール、pnpmでCDK/TS依存関係をインストール
    make format  # コードベースを自動フォーマット
    make lint    # ruff/mypyおよびTSのLintを実行
    make test    # 単体テストと統合テストを実行
    
  4. external-docs/content/getting-started.md に記載の完全な開発者ガイドに従い、CDKスタックのデプロイ、サンプルデータのロード、Web UIの起動を行う。

どのような人が使うか?

  • 大規模言語モデル(LLM)エージェントに信頼性があり、管理されたコンテキスト知識を提供する必要がある エンタープライズAIチーム
  • AWS内にデータを移動せずに、統合された意味的グラフを公開したい データエンジニア
  • AIシステムが見えるコンテキストに対してロールベース、ネームスペーススコープのアクセス制御を望む コンプライアンス担当者
  • 検証済みでビジネスロジックを意識した事実を必要とする RAG(リトリーバー・オーガメントド・ジェネレーション)パイプライン を構築する アプリケーション開発者

ライセンスと貢献

  • Apache 2.0 ライセンス。
  • リポジトリは 読み取り専用のミラー であり、プルリクエストは受け付けません。バグやフィードバックについてはIssueをオープンできます。Amazon社員は別途の貢献経路を持っています。

まとめ

Context Ontology Acceleratorは、多様なデータを管理された知識グラフに変換し、AIエージェントが安全にクエリできるプロダクショングレードのAWSネイティブスタックを提供します。古典的なセマンティックウェブツール(オントロジー、SPARQL、推論エンジン)と現代的なクラウドインフラストラクチャおよび開発者ツールを組み合わせることで、企業データと次世代AIアプリケーションの間の実用的な橋渡しを実現しています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト