トークン・リレー市場:トークン転売業者と詐欺エコシステムがいかにしてAIモデルを悪用しているか
トークン・リレー市場:トークン転売業者と詐欺エコシステムがいかにしてAIモデルを悪用しているか
Anthropic、OpenAI、Googleなどの最先端AIモデルへのアクセスを、公式価格から最大97.8%もの大幅な割引で転売するための、高度で多層的なリレー市場が出現しています。このエコシステムは、アカウントの悪用、盗まれた金融手段、そしてオープンソースのゲートウェイソフトウェアを利用して、地理的制限を回避し、開発者やモデル蒸留業者に安価な推論を提供しています。
トークン・リレーの4層アーキテクチャ
トークン・リレー市場は、生ののアカウント調達からエンドユーザーへの配信に至るまで、構造化されたサプライチェーンとして機能しています:
- アップストリーム(カード&アカウント業者): これらのアクターは、米国や欧州の請求チェックを回避するように設計されたバーチャルクレジットカードや、大量に登録されたアカウントといった「原材料」を提供します。
- ミッドストリーム(アカウント・プール): プールは数百ものアップストリーム・アカウントを集約します。これらは認証トークンを管理し、レート制限を処理し、アカウントがフラグを立てられた際のフェイルオーバー・メカニズムを提供します。これらは、直接的なラボAPIではなく、消費者向けAIアプリケーションへの「リバースエンジニアリング」されたアクセスを組み込んでいることがよくあります。
- ダウンストリーム(リレー/転送ステーション): これらは消費者向けのエンティティです。アカウント・プールのAPIをブランド化された(多くの場合、中国語の)製品でラップし、WeChatなどのプラットフォームを通じて請求、インボイス発行、カスタマーサポートを管理します。
- エンドユーザー: 主な購入者には、安価な推論を求める個人開発者、スタートアップ、SaaS企業、およびモデル蒸留(最先端モデルの出力を利用して国内モデルをトレーニングすること)にインフラを使用する商業団体が含まれます。
技術的インフラ:one-api と new-api
ほとんどのリレーは、OpenAI互換の2つのオープンソース・ゲートウェイのいずれかを使用しています:one-api または new-api(one-apiのより商用向けにフォークされたもの)です。これらのツールにより、オペレーターは以下のことが可能になります:
- チャネルの管理: 各チャネルは、プロバイダーとAPIキーのプールで構成されます。
- エンドポイントの標準化: ゲートウェイは単一のOpenAI互換APIを公開するため、購入者は既存のSDKの接続先をリレーのURLに変更するだけで済みます。
- 価格設定の制御: オペレーターは「マルチプライヤー(乗数)」を使用して価格ティアを設定し、使用量に基づいてクォータを差し引きます。
ソフトウェア自体は中立的であり、チームの支出追跡のために正当な企業によっても使用されていますが、リレー業者はプロバイダーの利用規約に違反して、盗まれた、漏洩した、またはプールされたキーを収益化するためにこれを利用しています。
一般的な詐欺および悪用手法
リレー業者は、安価または無料のトークンを確保するためにいくつかの戦術を採用しています:
- 無料トライアルの悪用: 大量のアカウント作成を自動化して、無料クレジットを取得する。
- チャージバック攻撃: 盗まれたカードを使用するか、使用期間の後にチャージバックを開始してコストを回収する。
- プリペイドカードの現金化: 長期的な請求の紐付けを避けるために、上限のあるプリペイドカードでアカウントに資金を投入する。
- オープン推論の搾取: 厳格なガードレールがないサポートチャットボットを介してトラフィックをプロキシする。
- Denial of Wallet (DoW): 非金融的な攻撃であり、アクターがプロバイダーの計算コストを意図的に消費させるために、リクエストを大量に送りつける。
市場の成熟度と「証明可能な公平性」を持つロト
市場は、価格比較サイト(例:getcheapai.com)やアフィリエイト・プログラムを備えたプロフェッショナルなエコシステムへと成熟しています。hvoy.ai のような一部のディレクトリでは、100ドルのAPIキーを50枚提供する日替わりのロトまで実施しています。これらの抽選は、「証明可能な公平性(provably fair)」を持つ暗号学的スキーム(最新のBitcoinブロックのハッシュを乱数シードとして使用し、Partial Fisher-Yatesシャッフルを利用するもの)を使用しており、結果が操作されていないことを証明しています。
AIプロバイダーのための防御戦略
詐欺は継続的な「いたちごっこ」であるため、プロバイダーには多層的な防御戦略の実装が推奨されます:
アカウント作成とエントリー
- 参入コストの引き上げ: ブラウザベースの自動化検知を実装し、新規アカウントの支出に上限を設ける。
- 財務モニタリング: バーチャルカード、プリペイドカード、および不一致の請求情報をフラグ立てする。
行動検知
- 異常の特定: 登録から最初のトークン使用までの時間、特定のモデル選択、IPシグナル(VPN/プロキシ)などの不自然なパターンを監視する。
被害コントロール
- 厳格な制限の適用: 突然のコスト急増を防ぐため、支出上限、同時実行制限、および実行中のリクエストに対する予約予算を実装する。
- 段階的な信頼構築: 新規アカウントは低い制限から開始し、アカウントの経過期間や検証済みカードの提供に応じて制限を増やす。
- サイレント・スロットリング: 悪用が検知された場合、クリーンなエラーを返すのではなく、静かにスロットリング(帯域制限)を行う。これにより、攻撃者が修正すべき正確なシグナルを特定することを防ぐ。
コミュニティの洞察と反論
業界の実務家やオブザーバーは、この問題のさらなる側面を指摘しています:
「同じような転売市場は、前世代のインターネット巨人の製品でも展開されています。非常に洗練されたアクターが……転売用に割引されたインプレッションの巨大な市場を作り出しています。」
ユーザーがサブスクリプションの料金を支払い、残りのトークンを転売する場合、特に「詐欺」と「裁定取引(アービトラージ)」の境界線は曖昧であると主張する者もいます。また、エンドユーザーにとっての重大なリスクを指摘する者もいます。リレーが広告されている本物のモデルを提供している保証はないということです(例:Opusのようなハイエンドモデルを販売しながら、実際にはFableやDeepSeekのような安価なモデルを配信している場合)。
さらに、クラウドプロバイダー(AWS、Azure)がスタートアップ向けに提供する無料クレジットの悪用が、報告は少ないものの、安価な推論の重要な供給源になっていることが一部のユーザーによって指摘されています。