✷ アーカイブ · ラボ 11 拠点 · ディスパッチ 3,059 件
ラボ
毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。
Qwen2-Math リリースノート
QwenはQwen2-Mathをリリースしました。これは1.5B、7B、72Bの専門的な数学LLMシリーズで、GPT-4oを含む複数のクローズドソースモデルを数学ベンチマークで上回ります。
楽天とOpenAIのパートナーシップ:生成AIを活用した顧客インサイトの創出
楽天はOpenAIのAPI、RAG、Code Interpreterを活用し、非構造化データを自動顧客サービス、レビュー要約、B2B市場インサイトへと変換しています。
Mistral AI モデルのカスタマイズと Agents のリリース
Mistral AI は、Mistral Large 2 や Codestral を含むフラッグシップモデルのモデルカスタマイズ、Agents のアルファリリース、およびクライアント SDK の安定版 1.0 を導入しました。
OpenAI Structured Outputs API 機能発表
OpenAIは2024年8月6日にStructured Outputsを導入しました。この新しいAPI機能は、モデルの応答が開発者提供のJSONスキーマと正確に一致することを保証し、データ中心のアプリケーションの信頼性を向上させます。
Hugging Face TextImage Augmentation パイプラインリリース
Hugging Face と Albumentations AI は、文書画像とテキストを同時に変更する TextImage Augmentation パイプラインをリリースしました。これにより、現実的な合成データ生成と、限られた文書データセット上でのビジョン‑言語モデルの堅牢なファインチューニングが可能になります。
Hugging Face 2024 セキュリティ機能ハイライト
Hugging Face は 2024 年のセキュリティ状況を詳述し、すべてのユーザー向けのデフォルト保護スイートと Enterprise Hub ユーザー向けの高度なガバナンス制御を導入しました。
Claude AI Brazilでの利用可能性
Anthropicは、AIアシスタントであるClaudeの利用可能性を、ウェブ、モバイルアプリ、およびAPIを通じて、ブラジルの消費者および企業に拡大しました。
GoogleがGemma 2 2B、ShieldGemma、Gemma Scopeをリリース
GoogleはGemma 2 2B、ShieldGemma安全分類器、そしてGemma Scopeスパースオートエンコーダーをリリースし、オープンソースLLMの機能、モデレーションツール、解釈可能性リソースを拡充しました。
Anthropic Circuits Updates July 2024
Anthropicは、2024年7月に、解釈可能性、マルチエージェント・システムの失敗、および未発表のClaude研究用バージョンにおける数学的進展に焦点を当てた一連の予備的な研究アップデートを公開しました。
Quanto 量子化で Transformer ディフュージョンパイプラインのメモリ削減
Hugging Face の量子化(Quanto)は、Transformer ディフュージョンモデルの GPU メモリを約 12 GB から約 5 GB に削減し、レイテンシと品質への影響を最小限に抑えます。
Hugging Face NVIDIA NIM API (serverless) の開始と廃止
Hugging Face は Enterprise Hub ユーザー向けに NVIDIA NIM API(サーバーレス)を開始し、OpenAI 互換 API を通じて NVIDIA DGX Cloud H100 GPU 上でオープンソース LLM の従量課金サーバーレス推論を可能にしました。
LAVE: LLM を用いた Docmatix のゼロショット VQA 評価
Hugging Face は、従来の VQA メトリクスの硬直性に対処するために LAVE(LLM 支援 VQA 評価)を導入し、Docmatix データセットにおけるゼロショット性能の評価で 50% の精度向上を実証しました。
OpenAI SearchGPT プロトタイプ発表
OpenAIは、AIモデルとリアルタイムのウェブ情報を組み合わせ、明確な情報源の引用とともに直接的な回答を提供する一時的なプロトタイプであるSearchGPTを導入しました。
Ollama ツールサポートのリリース
Ollama は、Llama 3.1 のようなモデルに対してツール呼び出しのサポートを導入しました。これにより、ローカル LLM が外部 API、関数、およびコードインタープリターとやり取りできるようになります。
Mistral Large 2 リリースノート / 新機能
Mistral AIは、コーディング、推論、および多言語能力において競争力のあるパフォーマンスを備え、高スループットのシングルノード推論向けに設計された123Bパラメータのモデル、Mistral Large 2をリリースしました。
OpenAIのモデル安全性のためのルールベース報酬
OpenAIはRule-Based Rewards(RBR)という手法を導入しました。これは、明示的で段階的なルールを用いてAIの安全な振る舞いを整合させ、人間データの大規模な収集を不要にするものです。
Llama 3.1 リリースノート:多言語対応、長コンテキスト、そして 405B モデル
Meta は Llama 3.1 をリリースしました。8B、70B、405B のサイズのモデルを提供し、コンテキスト長は 128K トークン、8 言語に対応する多言語サポート、そして合成データ生成を可能にする寛容なライセンスが特徴です。
Core ML で Mistral 7B を実行する
Hugging Face は、WWDC 24 の新しい Core ML 機能を使用して Mac で Mistral 7B を実行する方法を示し、4 ビットブロック単位の量子化によりモデルサイズを 4GB 未満に削減しました。
GPT-4o mini リリースノート / 新機能
OpenAIは、GPT-4o mini をリリースしました。この小型モデルは、コスト効率が非常に高く、主要な推論およびマルチモーダルベンチマークで GPT-3.5 Turbo や他の小型モデルを上回ります。
Mistral NeMo リリースノート
Mistral AI と NVIDIA は、128,000 トークンのコンテキスト窓と、新しい高効率多言語トークナイザー「Tekken」を備えた 120億パラメータのモデルである Mistral NeMo をリリースしました。
Docmatix データセットリリース
Hugging Face は、2.4 百万枚の画像と 9.5 百万件の Q/A ペアを備えた Document Visual Question Answering(DocVQA)データセットである Docmatix をリリースしました。これにより、従来のデータセットと比較して規模が 240 倍に拡大しました。
TGI Multi-LoRA: 1回デプロイで30モデルを提供
Hugging Face は Text Generation Inference (TGI) に Multi‑LoRA サービングを導入し、組織が単一のベースモデルをデプロイして多数の専門化ファインチューニングアダプタを動的に提供できるようにし、コストと運用の複雑さを削減します。
ChatGPT Enterprise コンプライアンスおよび管理ツールの更新
OpenAIは、コンプライアンスAPI、ユーザー管理の自動化のためのSCIM、そして細分化されたGPTコントロールを導入し、エンタープライズ顧客が規制要件を満たし、AI導入を安全に拡大できるよう支援します。
OpenAI プローバー‑ベリファイヤーゲームは言語モデル出力の可読性を向上させる
OpenAIは、強力な言語モデルが弱いモデルでも検証できる解答を生成するようにするプローバー‑ベリファイヤーゲームのトレーニング手法を発表し、正確性と人間の可読性の両方を向上させました。
AnthropicとMenlo Ventures、1億ドル規模のAnthologyファンドを共同で設立
AnthropicとMenlo Venturesは、インフラ、業界特化型ツール、信頼性と安全性の分野におけるAIアプリケーションの開発を加速するため、1億ドル規模のAnthologyファンドを設立しました。
Codestral Mamba リリースノート
Mistral AI は、Mamba アーキテクチャを活用した 7B パラメータのモデルである Codestral Mamba をリリースしました。これにより、線形時間の推論と高パフォーマンスなコード作成および推論能力が実現されています。
Mathstral 7B リリース
Mistral AIは、Project Numinaとの共同開発により、STEM分野および高度な数学的推論に特化化した7Bパラメータのモデル、Mathstralをリリース-しました。
distilabel を使用した Argilla SDK チャットボット – エンドツーエンドチュートリアル
Hugging Face は、distilabel で生成した合成データ、ファインチューニングされた埋め込み、lancedb ベクトルストレージ、そして Spaces にデプロイされた Gradio アプリを使用して Argilla 2.0 チャットボットを構築する方法を示すチュートリアルを公開しました。
SmolLM リリース: 高性能小型言語モデル
Hugging Face は、厳密にキュレーションされた高品質データセットでトレーニングされた、最先端の小型言語モデル(135M、360M、1.7B パラメータ)ファミリーである SmolLM を紹介します。
NuminaMath 7B TIR が AIMO Progress Prize を受賞 – 技術的まとめ
NuminaMath 7B TIR は、隠された 50 問の数学問題のうち 29 問を解くことで、初の AIMO Progress Prize を受賞し、2 段階のファインチューニングレシピ、大規模で高品質な数学データ、ツール統合推論による自己整合性(SC‑TIR)戦略の威力を示しました。
OpenAI とロスアラモス国立研究所のバイオサイエンス研究パートナーシップ
OpenAI とロスアラモス国立研究所は、GPT-4o のようなマルチモーダル最先端 AI モデルが、バイオサイエンス研究を推進するために、物理的な実験室環境で科学者を安全に支援できるかを評価するために提携しました。
Hugging Face の Presidio を用いた PII 検出実験
Hugging Face は、Microsoft Presidio を Dataset Hub に統合する実験を行っており、自動 PII 検出レポートを提供し、実務者が機械学習データセットにおけるプライバシーリスクを特定・軽減できるよう支援しています。
TRL が視覚言語モデル向けに Direct Preference Optimization をサポート
Hugging Face は TRL ライブラリに視覚言語モデル向けの Direct Preference Optimization (DPO) サポートを追加し、bfloat16 量子化と LoRA を活用して、Idefics‑2 などのモデルを1台の GPU 上で好みデータでファインチューニングできるようにしました。
Hugging Face と KerasHub の統合
Hugging Face と KerasHub は今ではモデル保存フォーマットを共有しており、これにより KerasHub ユーザーは Hugging Face Hub から 300,000 を超える Transformers ライブラリのモデルを直接ロードできるようになります。
Google Cloud TPU を Hugging Face Inference Endpoints と Spaces で使用
Hugging Face は Google Cloud TPU v5e のサポートを Inference Endpoints と Spaces に統合し、ユーザーがコスト効率の高い高性能ハードウェアで AI モデルをデプロイおよびスケールできるようにしました。
Banque des Territoires、Polyconseil、そしてHugging FaceがEduRénovプログラム向けに主権的RAGソリューションを展開
Hugging Face、Polyconseil、Banque des Territoiresは、フランスのEduRénov学校改修プログラム向けにメールサポートを自動化する主権的なオープンソースRAGシステムを立ち上げ、データ所在性を確保しつつ、公共政策向けに生成AIをスケールさせました。
Hugging Face データセットハブ検索機能のアップデート
Hugging Face は、モダリティ、サイズ、形式、ライブラリ互換性の 4 つの新しい検索フィルタを導入し、データセットハブ上の 180,000 を超える公開データセットの発見性を向上させました。
Intel Gaudi 2上でのタンパク質言語モデルProtSTの高速化
IntelとMILAは、ProtSTマルチモーダルタンパク質言語モデルをIntel Gaudi 2アクセラレータ向けに最適化し、NVIDIA A100 GPUと比較して最大2.92倍高速なファインチューニングを実現しました。
Hugging Face Transformers コードエージェント GAIA ベンチマーク結果
Hugging Face は、transformers.agents ライブラリで構築されたコードエージェントを使用して GAIA ベンチマークでトップランクを獲得し、コードベースのアクションが JSON ベースのツール呼び出しよりも効率的かつ効果的であることを示しました。
Anthropic 第三者モデル評価イニシアチブ
Anthropicは、高度なAI能力および安全リスクを測定する高品質な評価の開発を支援する第三者向け資金提供イニシアチブを開始しました。
Anthropic Circuits Updates June 2024
Anthropicの2024年6月のCircuitsアップデートは、解釈可能性、マルチエージェント・システムの失敗、およびリーマンゼータ関数に関する数学的能力の進展に関する予備的な研究結果を提供します。
GPT-4でGPT-4のミスを見つける
OpenAIは、RLHFプロセス中に人間のトレーナーを支援するために、ChatGPTのコード出力のエラーを特定するよう設計されたGPT-4ベースのモデル、CriticGPTを導入しました。
OpenAI と TIME の戦略的コンテンツパートナーシップ
OpenAI と TIME は、TIME の 101 年にわたるジャーナリズムアーカイブを OpenAI 製品に統合し、TIME に対して製品開発のための OpenAI 技術へのアクセスを提供する、複数年にわたる戦略的パートナーシップを締結しました。
Google Gemma 2 リリースノート
GoogleはGemma 2をリリースしました。これは9Bと27Bパラメータサイズで利用可能なオープンウェイトLLMのファミリーで、蒸留とアテンションメカニズムにおける技術的進歩により性能が向上しています。
Ollama での Google Gemma 2 リリース
2B, 9B, 27B パラメータのバリエーションで提供される Google Gemma 2 が、クラス最高のパフォーマンスと効率性を実現する新しいアーキテクチャとともに Ollama でリリースされました。より大きなオープンモデルを凌駕します。
Anthropic Expands Claude Access for Government Agencies
Anthropicは、安全で専門的なサービス契約を通じて政府の任務を支持するため、Claude 3 HaikuおよびClaude 3 Sonnetを米国のインテリジェンス・コミュニティおよびAWS GovCloudで利用可能にしました。
XLSCOUT ParaEmbed 2.0 リリース
XLSCOUTは、専門家がキュレーションした特許データでファインチューニングされた独自の埋め込みモデル、ParaEmbed 2.0をリリースしました。これにより、ParaEmbed 1.0に比べて精度が23%向上しています。
Anthropic、コラボレーションAIワークフローのためのClaude Projectsを導入
Anthropicは、Claude ProおよびTeamユーザー向けにProjectsをリリースしました。これにより、200Kのコンテキストウィンドウ内で、厳選されたナレッジセットとカスタム指示を使用してチャットを整理できるようになります。
Hugging Face Ethics and Society Newsletter #6: データ品質の重要性
Hugging Face は、データ品質に対して包括的かつ責任あるアプローチを示し、データはその目的に適合していることが AI モデルの性能、公平性、科学的再現性を確保する上で不可欠であると強調しています。
Microsoft Florence-2 の DocVQA に対するファインチューニング
Hugging Face は、Microsoft の Florence-2 ビジョン・ランゲージモデルを DocVQA データセットでファインチューニングし、7 エポック後に検証時の類似度を 0 から 57.0 に向上させる方法を示しています。