GPT-NL: オランダのための主権的言語モデル
概要
GPT-NLは、非欧州のAIプロバイダーへの依存を減らし、AI技術がオランダおよび欧州の法律、価値観、および社会目標に沿ったものであることを確実にするために、オランダのために開発された主権的言語モデルです。このプロジェクトは、TNO、SURF、およびNetherlands Forensic Institute (NFI) による共同作業であり、職場、教育、および公共サービスにおける責任あるAIアプリケーションのための独立したエコシステムを構築することを目指しています。
コアバリューとガバナンス
GPT-NLは、主権、透明性、信頼性、および相互互恵性の4つの主要な柱に基づいています。
デジタル主権
モデルをオランダおよび欧州内で開発することにより、プロジェクトはモデル、使用されるデータ、およびアーキテクチャの選択肢に対して完全な制御を確保します。このアプローチは、外部プロバイダーへの依存を排除し、この地域と法的および倫理的に一致する持続可能なAIエコシステムを醸成します。
透明性とオープンネス
GPT-NLは、ソースからモデルに至るまでの洞察を重視しています。プロジェクトチームは、バイアスや倫理的懸念にどのように対処するかを含め、すべてのデータ収集およびトレーニングの選択肢を文書化しています。この透明性を維持するために、ソースコードはオープンソースとして公開され、データセットに関する詳細な洞察が共有されます。モデルの重みは、使用状況を追跡し、ユーザーにアップデートやデータのオプトアウトを通知するために、管理されたライセンスの下で配布されます。
信頼性とデータの整合性
不明確なデータの出所や、既存のモデルからの個人データの継承に関連するリスクを避けるため、GPT-NLは完全にゼロからトレーニングされています。データ収集プロセスは、以下の厳格な基準に従います:
トレーニング前の個人データの削除および匿名化。 \n* 知的財産の保護。
機密および有害なコンテンツの除外。
データセット内での重複の防止。
相互互恵性と公正な価値
GPT-NLは、合法的なデータサプライチェーンを利用します。データプロバイダーおよび権利保持者は、Content Boardを通じて開発プロセスに関与し、モデルの将来における彼らの声を反映させることができます。さらに、モデルによって生成される収益の一部は、これらのクリエイターに還元される仕組みになっており、価値共有型のイノベーションモデルを構築しています。
リソース効率と資金提供
AIのエネルギーおよびコンピューティング需要を認識し、プロジェクトは、科学的研究に基づき、エネルギーと水の消費を最小限に抑えるためにモデルのサイズとトレーニングプロセスを最適化することに焦点を当てています。
GPT-NLは、経済・気候政策省を代表してNetherlands Enterprise Agency (RVO) により公的に資金提供されており、総額1,350万ユーロが割り当てられています。この公的投資により、モデルは公的に説明責任を果たし、公的な価値観に沿ったものとなります。