vercel-labs/ai-cli

Generate anything from your terminal

何を解決するか

このプロジェクトは、さまざまなモダリティのAIモデルに一貫したコマンドラインインターフェース(CLI)でアクセスできるようにします。画像、動画、音声、テキストの生成といった簡単なタスクにカスタムスクリプトを書く必要がなくなり、標準的なターミナルパイプを使って複数のAI操作を連鎖させるプロセスも簡素化されます。

動作方法

Vercel AI SDKとAI Gatewayに基づいて構築されたCLIは、ai textai imageai videoai audioなどの簡単なコマンドを実行することで、さまざまなモデルを呼び出せます。標準入力(stdin)をサポートしており、git diffcatなどの他のターミナルコマンドからデータを直接AIモデルにパイプできます。また、1つのAI生成の出力を別のAIの入力として扱えるため、画像を生成してそれを動画にアニメーションさせるような複雑なワークフローも可能になります。

対象ユーザー

Web UIではなくターミナルを好む開発者やパワーユーザー、複数のAPIキーを管理したり、別々のツールセットを使ったりせずに、さまざまなプロバイダーのモデルを素早く試したい人向けです。

特徴

  • マルチモーダル対応:テキスト、画像、動画、音声(スピーチと音声認識)の生成をサポート。
  • パイプと参照:標準入力(stdin)と参照画像/ファイルをサポートし、複雑なエージェントネイティブなワークフローを実現。
  • 統一されたモデルアクセス:AI Gatewayを介して1つのインターフェースで数百のモデルにアクセス可能。
  • インラインプレビュー:Kitty、Ghostty、WezTermなど、サポートされるターミナルで画像、動画、音声波形を直接表示。
  • モデル比較:複数のモデルを同時に実行して出力を比較できる機能。
  • 詳細なモデル情報:利用可能なモデルの価格、レイテンシ、スループットなどのリアルタイムデータを提供。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト