yusukebe/ax
The AI-era curl
何を解決するか
ax は、通常のコーディングエージェントが行う効率の悪いウェブからのデータ取得・理解・抽出のループを置き換えます。curl を脆弱なパーススクリプトにパイプするか、膨大な量の生のHTMLをコンテキストウィンドウにダンプするのではなく、ax は1つのコマンドでページの取得、構造の発見、LLMのトークン制限に最適化された形式での構造化データの抽出を提供します。
動作方法
このツールは、ローカルで動作する決定論的なバイナリとして機能し、以下の複数の機能を統合しています:
- 取得:各リクエストに対してステータス、ヘッダー、リダイレクトを含む完全なレポートを提供し、ボディが空になったときにエージェントが推測を余儀なくされないよう保証します。
- 発見:
--outlineなどのフラグを使用して繰り返し構造を表示し、--locateを使って全HTMLページをダンプせずに特定のセレクタを検索できます。 - 抽出:複数フィールドの行を取得する(
--row)、HTMLテーブルをキー付き行に変換する(--table)、安全な式言語(--where)を使って結果をフィルタリングできます。 - トークン管理:
--budgetによるトークン予算と結果の上限を実装し、コンテキストウィンドウのオーバーフローを防ぎ、エージェントが重複せずに残りのデータを取得できる正確なオフセットを提供します。
対象ユーザー
ウェブとのやり取りを通じて情報を収集したり、ドキュメントを読んだり、構造化データをスクレイピングしたりする必要があるAIコーディングエージェント向けに主に設計されています。毎回カスタムPythonスクリプトを書いたりデバッグしたりする必要はありません。
特徴
- エージェント最適化出力:LLMのコンテキストウィンドウに最適化された、トークンコストが低い構造化出力。
- 統合ワークフロー:取得、構造発見、抽出を1つのツールに統合し、複数のバイナリやスクリプトの必要性を排除。
- ローカルかつ決定論的:APIキーもクラウドベースのMarkdown変換も不要なローカルで動作。
- ページネーション対応:
--json-envelopeと--offsetを使って、大規模データセットの機械可読な継続をサポート。 - Markdown変換:
--mdフラグでページを直接読みやすいMarkdownに変換可能。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト