Claude 2.1 リリースノート
Anthropicは、大幅に拡張されたコンテキストウィンドウ、向上した事実の正確性、および新しい統合機能を備え、エンタープライズアプリケーション向けに設計された更新モデルであるClaude 2.1をリリースしました。このリリースは、大規模なデータセットを処理するモデルの能力を強化し、誤った記述の頻度を減らすことで、ビジネス運用における信頼性を高めることに焦点を当てています。
200K トークン コンテキストウィンドウ
Claude 2.1は、以前の容量を倍増させ、200,000トークンのコンテキストウィンドウを実現しました。これは、約150,000単語、または500ページ以上のテキストに相当します。この拡張により、ユーザーはコードベース全体、財務諸表(S-1など)、および長い文学作品を分析のために入力できるようになります。
このウィンドウによって可能になる主な機能は以下の通りです:
- 大規模な要約: 大量のコンテンツを処理し、凝縮すること。
- 複雑なQ&A: 提供された広範なデータに基づいて質問に答えること。
- トレンド予測: 長期的なデータを分析してパターンを予測すること。
- ドキュメント比較: 複数の大規模なドキュメントを同時に比較すること。
Anthropicは、200Kの長さのメッセージを処理することは業界初であると述べていますが、通常であれば人間が数時間かかるタスクを完了するには数分かかる場合があります。同社は、技術の進化とともにレイテンシが減少することを期待しています。
ハルシネーション(幻覚)率の低減
Claude 2.1は、Claude 2.0と比較して、誤った記述が2倍減少しています。この「誠実さ」の向上は、モデルが誤った主張を行うのではなく、不確実性を認める(辞退する)能力に基づいて評価された、厳選された複雑な事実に関する質問セットを使用して測定されました。
一般的な誠実さに加えて、モデルは法律や財務報告書のような複雑なドキュメントの理解と要約において、特定の利点を示しています:
- 誤った回答: 30%減少。
- 誤った主張: ドキュメントが特定の主張を支持していると誤って結論付ける割合は、以前のバージョンよりも3-4倍低くなっています。
API ツール使用 (Beta)
Claude 2.1は、ベータ機能としてツール使用を導入し、モデルが外部API、製品、および開発者が定義した関数と統合できるようにします。これにより、Claudeは特定のタスクに必要なツールがどれであるかを判断することで、ユーザーに代わってアクションをオーケストレートすることが可能になります。
ツール使用アプリケーションの例は以下の通りです:
- 数値推論: 複雑な数学のために計算機を使用すること。
- API 翻訳: 自然言語のリクエストを構造化されたAPIコールに変換すること。
- 情報検索: データベースを検索したり、ウェブ検索APIを使用して質問に答えること。
- ソフトウェア自動化: プライベートAPIを介してソフトウェア内で単純なアクションを実行すること。
- 製品の推奨: データセットに接続して、ユーザーの購入を完了するのを支援すること。
開発者体験とシステムプロンプト
Anthropicは、プロンプトの反復作業や、保存されたリビジョンを使用して複数のプロジェクトを管理するためのプレイグラウンド形式の環境であるWorkbenchを導入することで、開発者体験を更新しました。開発者は、プロンプトをSDKに直接統合するためのコードスニペットを生成することもできます。
さらに、このリリースではシステムプロンプトを導入しており、これにより開発者はClaudeの性格、役割、および応答構造を定義するためのカスタム指示を提供でき、、特定のユーザーニーズに合わせた、より一貫性のあるカスタマイズ可能な出力を確保できます。
利用可能範囲と価格設定
Claude 2.1は、Anthropic ConsoleのAPI経由で利用可能であり、claude.aiでのチャット体験を支えています(無料およびProティアの両方)。200Kトークン コンテキストウィンドウは、特にClaude Proユーザー向けに予約されています。Anthropicはまた、モデル全体のコスト効率を向上させるために、価格設定を更新しました。
Sources
- OriginalIntroducing Claude 2.1
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch