aws/context-ontology-accelerator
An open-source, ontology-based semantic context accelerator that enables AI agents to make more accurate, consistent, and explainable decisions.
✦ Context Ontology Accelerator – 何であるか
Context Ontology Accelerator は、AWSに焦点を当てたオープンソースプラットフォームであり、組織のデータ上に 意味的 レイヤーを構築します。自動的にスキーマを発見し、構造化および非構造化データソースをインジェストし、統合された知識グラフ(オントロジー)を作成した後、SPARQLベースのクエリとカスタムの MCP(Message Control Protocol)インターフェースを通じて、AIエージェントやアプリケーションにそのグラフを提供します。目的は、下流のAIシステムが適切な「コンテキスト」を取得し、ビジネスルールに基づいて検証し、何らかの行動を決定できるようにすることです。
コアコンセプトとワークフロー
| ステップ | 内容 | 主なコンポーネント |
|---|---|---|
| スキャン | データベース、ドキュメントストアなどに接続;スキーマとメタデータを抽出;タグで拡張。 | sources/ パッケージ – コネクタおよびインジェストパイプライン |
| モデル化 | オントロジーを生成またはインポートし、推論エンジンを実行し、メトリクスを計算し、すべてを単一の 仮想 知識グラフに統合。 | ontology-engine/(HermiT/ELK推論エンジン)、metric-service/、vkg/(Ontop仮想KG) |
| 提供 | SPARQLフェデレーションと軽量なMCPサーバーを通じてグラフを公開し、AIエージェントがコンテキストを要求し、検証済みの結果を受け取れるようにする。 | mcp-server/、context-manager/(クエリオーケストレーション) |
リポジトリ構成(概要)
semantic-context/models/– すべてのAPIのソースオブトラゥスとなるSmithy定義。semantic-context/smithy-generated/– Smithyモデルから生成されたコード(OpenAPI仕様、Pythonクライアントスタブ、TypeScript SDK)。infra/– AWS CDK(TypeScript)スタックで、必要なサービス(Lambda、DynamoDB、Neptune、IAMロールなど)をプロビジョニング。packages/– 上記の機能モジュール(コントロールプレーン、データレイヤー、sources、ontology-engineなど)。web-app/– AWS Cloudscapeで構築されたReactフロントエンドで、オントロジーの可視化とネームスペースの管理が可能。libs/– PythonおよびTypeScript用の共有ユーティリティ。external-docs/– 公開されたユーザーガイドおよびデプロイドキュメント。
技術スタック
| レイヤー | 技術 |
|---|---|
| 言語 | Python 3.12、TypeScript |
| API契約 | Smithy → OpenAPI + 生成されたPythonインターフェース + TypeScriptクライアント |
| インフラストラクチャとしてのコード | AWS CDK(TypeScript) |
| フロントエンド | React + Cloudscape Design System |
| パッケージマネージャー | uv(Python)、pnpm(Node) |
| モノレポツール | Nx |
| 推論エンジン | HermiT、ELK(owlready2経由) |
| 仮想KG | Ontop(SPARQLフェデレーション) |
| テスト/Lint | pytest、ruff、mypy(厳格) |
| ビルド | Smithy CLI(Java 17 + Gradle) |
クイックスタート
- リリースタグを選択 –
mainブランチは最新版;GitHubのリリースページから安定版を使用。 - そのタグでリポジトリをクローンし、
cdで移動。 - 提供された
makeコマンドを実行:make setup # uvでPythonをインストール、pnpmでCDK/TS依存関係をインストール make format # コードベースを自動フォーマット make lint # ruff/mypyおよびTSのLintを実行 make test # 単体テストと統合テストを実行 external-docs/content/getting-started.mdに記載の完全な開発者ガイドに従い、CDKスタックのデプロイ、サンプルデータのロード、Web UIの起動を行う。
どのような人が使うか?
- 大規模言語モデル(LLM)エージェントに信頼性があり、管理されたコンテキスト知識を提供する必要がある エンタープライズAIチーム。
- AWS内にデータを移動せずに、統合された意味的グラフを公開したい データエンジニア。
- AIシステムが見えるコンテキストに対してロールベース、ネームスペーススコープのアクセス制御を望む コンプライアンス担当者。
- 検証済みでビジネスロジックを意識した事実を必要とする RAG(リトリーバー・オーガメントド・ジェネレーション)パイプライン を構築する アプリケーション開発者。
ライセンスと貢献
- Apache 2.0 ライセンス。
- リポジトリは 読み取り専用のミラー であり、プルリクエストは受け付けません。バグやフィードバックについてはIssueをオープンできます。Amazon社員は別途の貢献経路を持っています。
まとめ
Context Ontology Acceleratorは、多様なデータを管理された知識グラフに変換し、AIエージェントが安全にクエリできるプロダクショングレードのAWSネイティブスタックを提供します。古典的なセマンティックウェブツール(オントロジー、SPARQL、推論エンジン)と現代的なクラウドインフラストラクチャおよび開発者ツールを組み合わせることで、企業データと次世代AIアプリケーションの間の実用的な橋渡しを実現しています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト