yusukebe/ax

The AI-era curl

何を解決するか

ax は、通常のコーディングエージェントが行う効率の悪いウェブからのデータ取得・理解・抽出のループを置き換えます。curl を脆弱なパーススクリプトにパイプするか、膨大な量の生のHTMLをコンテキストウィンドウにダンプするのではなく、ax は1つのコマンドでページの取得、構造の発見、LLMのトークン制限に最適化された形式での構造化データの抽出を提供します。

動作方法

このツールは、ローカルで動作する決定論的なバイナリとして機能し、以下の複数の機能を統合しています:

  • 取得:各リクエストに対してステータス、ヘッダー、リダイレクトを含む完全なレポートを提供し、ボディが空になったときにエージェントが推測を余儀なくされないよう保証します。
  • 発見--outline などのフラグを使用して繰り返し構造を表示し、--locate を使って全HTMLページをダンプせずに特定のセレクタを検索できます。
  • 抽出:複数フィールドの行を取得する(--row)、HTMLテーブルをキー付き行に変換する(--table)、安全な式言語(--where)を使って結果をフィルタリングできます。
  • トークン管理--budget によるトークン予算と結果の上限を実装し、コンテキストウィンドウのオーバーフローを防ぎ、エージェントが重複せずに残りのデータを取得できる正確なオフセットを提供します。

対象ユーザー

ウェブとのやり取りを通じて情報を収集したり、ドキュメントを読んだり、構造化データをスクレイピングしたりする必要があるAIコーディングエージェント向けに主に設計されています。毎回カスタムPythonスクリプトを書いたりデバッグしたりする必要はありません。

特徴

  • エージェント最適化出力:LLMのコンテキストウィンドウに最適化された、トークンコストが低い構造化出力。
  • 統合ワークフロー:取得、構造発見、抽出を1つのツールに統合し、複数のバイナリやスクリプトの必要性を排除。
  • ローカルかつ決定論的:APIキーもクラウドベースのMarkdown変換も不要なローカルで動作。
  • ページネーション対応--json-envelope--offset を使って、大規模データセットの機械可読な継続をサポート。
  • Markdown変換--md フラグでページを直接読みやすいMarkdownに変換可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト