アーカイブ · ラボ 11 拠点 · ディスパッチ 3,059 件

ラボ

毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。

2101

Qwen2-Math リリースノート

QwenはQwen2-Mathをリリースしました。これは1.5B、7B、72Bの専門的な数学LLMシリーズで、GPT-4oを含む複数のクローズドソースモデルを数学ベンチマークで上回ります。

2102

楽天とOpenAIのパートナーシップ:生成AIを活用した顧客インサイトの創出

楽天はOpenAIのAPI、RAG、Code Interpreterを活用し、非構造化データを自動顧客サービス、レビュー要約、B2B市場インサイトへと変換しています。

2103

Mistral AI モデルのカスタマイズと Agents のリリース

Mistral AI は、Mistral Large 2 や Codestral を含むフラッグシップモデルのモデルカスタマイズ、Agents のアルファリリース、およびクライアント SDK の安定版 1.0 を導入しました。

2104

OpenAI Structured Outputs API 機能発表

OpenAIは2024年8月6日にStructured Outputsを導入しました。この新しいAPI機能は、モデルの応答が開発者提供のJSONスキーマと正確に一致することを保証し、データ中心のアプリケーションの信頼性を向上させます。

2105

Hugging Face TextImage Augmentation パイプラインリリース

Hugging Face と Albumentations AI は、文書画像とテキストを同時に変更する TextImage Augmentation パイプラインをリリースしました。これにより、現実的な合成データ生成と、限られた文書データセット上でのビジョン‑言語モデルの堅牢なファインチューニングが可能になります。

2106

Hugging Face 2024 セキュリティ機能ハイライト

Hugging Face は 2024 年のセキュリティ状況を詳述し、すべてのユーザー向けのデフォルト保護スイートと Enterprise Hub ユーザー向けの高度なガバナンス制御を導入しました。

2107

Claude AI Brazilでの利用可能性

Anthropicは、AIアシスタントであるClaudeの利用可能性を、ウェブ、モバイルアプリ、およびAPIを通じて、ブラジルの消費者および企業に拡大しました。

2108

GoogleがGemma 2 2B、ShieldGemma、Gemma Scopeをリリース

GoogleはGemma 2 2B、ShieldGemma安全分類器、そしてGemma Scopeスパースオートエンコーダーをリリースし、オープンソースLLMの機能、モデレーションツール、解釈可能性リソースを拡充しました。

2109

Anthropic Circuits Updates July 2024

Anthropicは、2024年7月に、解釈可能性、マルチエージェント・システムの失敗、および未発表のClaude研究用バージョンにおける数学的進展に焦点を当てた一連の予備的な研究アップデートを公開しました。

2110

Quanto 量子化で Transformer ディフュージョンパイプラインのメモリ削減

Hugging Face の量子化(Quanto)は、Transformer ディフュージョンモデルの GPU メモリを約 12 GB から約 5 GB に削減し、レイテンシと品質への影響を最小限に抑えます。

2111

Hugging Face NVIDIA NIM API (serverless) の開始と廃止

Hugging Face は Enterprise Hub ユーザー向けに NVIDIA NIM API(サーバーレス)を開始し、OpenAI 互換 API を通じて NVIDIA DGX Cloud H100 GPU 上でオープンソース LLM の従量課金サーバーレス推論を可能にしました。

2112

LAVE: LLM を用いた Docmatix のゼロショット VQA 評価

Hugging Face は、従来の VQA メトリクスの硬直性に対処するために LAVE(LLM 支援 VQA 評価)を導入し、Docmatix データセットにおけるゼロショット性能の評価で 50% の精度向上を実証しました。

2113

OpenAI SearchGPT プロトタイプ発表

OpenAIは、AIモデルとリアルタイムのウェブ情報を組み合わせ、明確な情報源の引用とともに直接的な回答を提供する一時的なプロトタイプであるSearchGPTを導入しました。

2114

Ollama ツールサポートのリリース

Ollama は、Llama 3.1 のようなモデルに対してツール呼び出しのサポートを導入しました。これにより、ローカル LLM が外部 API、関数、およびコードインタープリターとやり取りできるようになります。

2115

Mistral Large 2 リリースノート / 新機能

Mistral AIは、コーディング、推論、および多言語能力において競争力のあるパフォーマンスを備え、高スループットのシングルノード推論向けに設計された123Bパラメータのモデル、Mistral Large 2をリリースしました。

2116

OpenAIのモデル安全性のためのルールベース報酬

OpenAIはRule-Based Rewards(RBR)という手法を導入しました。これは、明示的で段階的なルールを用いてAIの安全な振る舞いを整合させ、人間データの大規模な収集を不要にするものです。

2117

Llama 3.1 リリースノート:多言語対応、長コンテキスト、そして 405B モデル

Meta は Llama 3.1 をリリースしました。8B、70B、405B のサイズのモデルを提供し、コンテキスト長は 128K トークン、8 言語に対応する多言語サポート、そして合成データ生成を可能にする寛容なライセンスが特徴です。

2118

Core ML で Mistral 7B を実行する

Hugging Face は、WWDC 24 の新しい Core ML 機能を使用して Mac で Mistral 7B を実行する方法を示し、4 ビットブロック単位の量子化によりモデルサイズを 4GB 未満に削減しました。

2119

GPT-4o mini リリースノート / 新機能

OpenAIは、GPT-4o mini をリリースしました。この小型モデルは、コスト効率が非常に高く、主要な推論およびマルチモーダルベンチマークで GPT-3.5 Turbo や他の小型モデルを上回ります。

2120

Mistral NeMo リリースノート

Mistral AI と NVIDIA は、128,000 トークンのコンテキスト窓と、新しい高効率多言語トークナイザー「Tekken」を備えた 120億パラメータのモデルである Mistral NeMo をリリースしました。

2121

Docmatix データセットリリース

Hugging Face は、2.4 百万枚の画像と 9.5 百万件の Q/A ペアを備えた Document Visual Question Answering(DocVQA)データセットである Docmatix をリリースしました。これにより、従来のデータセットと比較して規模が 240 倍に拡大しました。

2122

TGI Multi-LoRA: 1回デプロイで30モデルを提供

Hugging Face は Text Generation Inference (TGI) に Multi‑LoRA サービングを導入し、組織が単一のベースモデルをデプロイして多数の専門化ファインチューニングアダプタを動的に提供できるようにし、コストと運用の複雑さを削減します。

2123

ChatGPT Enterprise コンプライアンスおよび管理ツールの更新

OpenAIは、コンプライアンスAPI、ユーザー管理の自動化のためのSCIM、そして細分化されたGPTコントロールを導入し、エンタープライズ顧客が規制要件を満たし、AI導入を安全に拡大できるよう支援します。

2124

OpenAI プローバー‑ベリファイヤーゲームは言語モデル出力の可読性を向上させる

OpenAIは、強力な言語モデルが弱いモデルでも検証できる解答を生成するようにするプローバー‑ベリファイヤーゲームのトレーニング手法を発表し、正確性と人間の可読性の両方を向上させました。

2125

AnthropicとMenlo Ventures、1億ドル規模のAnthologyファンドを共同で設立

AnthropicとMenlo Venturesは、インフラ、業界特化型ツール、信頼性と安全性の分野におけるAIアプリケーションの開発を加速するため、1億ドル規模のAnthologyファンドを設立しました。

2126

Codestral Mamba リリースノート

Mistral AI は、Mamba アーキテクチャを活用した 7B パラメータのモデルである Codestral Mamba をリリースしました。これにより、線形時間の推論と高パフォーマンスなコード作成および推論能力が実現されています。

2127

Mathstral 7B リリース

Mistral AIは、Project Numinaとの共同開発により、STEM分野および高度な数学的推論に特化化した7Bパラメータのモデル、Mathstralをリリース-しました。

2128

distilabel を使用した Argilla SDK チャットボット – エンドツーエンドチュートリアル

Hugging Face は、distilabel で生成した合成データ、ファインチューニングされた埋め込み、lancedb ベクトルストレージ、そして Spaces にデプロイされた Gradio アプリを使用して Argilla 2.0 チャットボットを構築する方法を示すチュートリアルを公開しました。

2129

SmolLM リリース: 高性能小型言語モデル

Hugging Face は、厳密にキュレーションされた高品質データセットでトレーニングされた、最先端の小型言語モデル(135M、360M、1.7B パラメータ)ファミリーである SmolLM を紹介します。

2130

NuminaMath 7B TIR が AIMO Progress Prize を受賞 – 技術的まとめ

NuminaMath 7B TIR は、隠された 50 問の数学問題のうち 29 問を解くことで、初の AIMO Progress Prize を受賞し、2 段階のファインチューニングレシピ、大規模で高品質な数学データ、ツール統合推論による自己整合性(SC‑TIR)戦略の威力を示しました。

2131

OpenAI とロスアラモス国立研究所のバイオサイエンス研究パートナーシップ

OpenAI とロスアラモス国立研究所は、GPT-4o のようなマルチモーダル最先端 AI モデルが、バイオサイエンス研究を推進するために、物理的な実験室環境で科学者を安全に支援できるかを評価するために提携しました。

2132

Hugging Face の Presidio を用いた PII 検出実験

Hugging Face は、Microsoft Presidio を Dataset Hub に統合する実験を行っており、自動 PII 検出レポートを提供し、実務者が機械学習データセットにおけるプライバシーリスクを特定・軽減できるよう支援しています。

2133

TRL が視覚言語モデル向けに Direct Preference Optimization をサポート

Hugging Face は TRL ライブラリに視覚言語モデル向けの Direct Preference Optimization (DPO) サポートを追加し、bfloat16 量子化と LoRA を活用して、Idefics‑2 などのモデルを1台の GPU 上で好みデータでファインチューニングできるようにしました。

2134

Hugging Face と KerasHub の統合

Hugging Face と KerasHub は今ではモデル保存フォーマットを共有しており、これにより KerasHub ユーザーは Hugging Face Hub から 300,000 を超える Transformers ライブラリのモデルを直接ロードできるようになります。

2135

Google Cloud TPU を Hugging Face Inference Endpoints と Spaces で使用

Hugging Face は Google Cloud TPU v5e のサポートを Inference Endpoints と Spaces に統合し、ユーザーがコスト効率の高い高性能ハードウェアで AI モデルをデプロイおよびスケールできるようにしました。

2136

Banque des Territoires、Polyconseil、そしてHugging FaceがEduRénovプログラム向けに主権的RAGソリューションを展開

Hugging Face、Polyconseil、Banque des Territoiresは、フランスのEduRénov学校改修プログラム向けにメールサポートを自動化する主権的なオープンソースRAGシステムを立ち上げ、データ所在性を確保しつつ、公共政策向けに生成AIをスケールさせました。

2137

Hugging Face データセットハブ検索機能のアップデート

Hugging Face は、モダリティ、サイズ、形式、ライブラリ互換性の 4 つの新しい検索フィルタを導入し、データセットハブ上の 180,000 を超える公開データセットの発見性を向上させました。

2138

Intel Gaudi 2上でのタンパク質言語モデルProtSTの高速化

IntelとMILAは、ProtSTマルチモーダルタンパク質言語モデルをIntel Gaudi 2アクセラレータ向けに最適化し、NVIDIA A100 GPUと比較して最大2.92倍高速なファインチューニングを実現しました。

2139

Hugging Face Transformers コードエージェント GAIA ベンチマーク結果

Hugging Face は、transformers.agents ライブラリで構築されたコードエージェントを使用して GAIA ベンチマークでトップランクを獲得し、コードベースのアクションが JSON ベースのツール呼び出しよりも効率的かつ効果的であることを示しました。

2140

Anthropic 第三者モデル評価イニシアチブ

Anthropicは、高度なAI能力および安全リスクを測定する高品質な評価の開発を支援する第三者向け資金提供イニシアチブを開始しました。

2141

Anthropic Circuits Updates June 2024

Anthropicの2024年6月のCircuitsアップデートは、解釈可能性、マルチエージェント・システムの失敗、およびリーマンゼータ関数に関する数学的能力の進展に関する予備的な研究結果を提供します。

2142

GPT-4でGPT-4のミスを見つける

OpenAIは、RLHFプロセス中に人間のトレーナーを支援するために、ChatGPTのコード出力のエラーを特定するよう設計されたGPT-4ベースのモデル、CriticGPTを導入しました。

2143

OpenAI と TIME の戦略的コンテンツパートナーシップ

OpenAI と TIME は、TIME の 101 年にわたるジャーナリズムアーカイブを OpenAI 製品に統合し、TIME に対して製品開発のための OpenAI 技術へのアクセスを提供する、複数年にわたる戦略的パートナーシップを締結しました。

2144

Google Gemma 2 リリースノート

GoogleはGemma 2をリリースしました。これは9Bと27Bパラメータサイズで利用可能なオープンウェイトLLMのファミリーで、蒸留とアテンションメカニズムにおける技術的進歩により性能が向上しています。

2145

Ollama での Google Gemma 2 リリース

2B, 9B, 27B パラメータのバリエーションで提供される Google Gemma 2 が、クラス最高のパフォーマンスと効率性を実現する新しいアーキテクチャとともに Ollama でリリースされました。より大きなオープンモデルを凌駕します。

2146

Anthropic Expands Claude Access for Government Agencies

Anthropicは、安全で専門的なサービス契約を通じて政府の任務を支持するため、Claude 3 HaikuおよびClaude 3 Sonnetを米国のインテリジェンス・コミュニティおよびAWS GovCloudで利用可能にしました。

2147

XLSCOUT ParaEmbed 2.0 リリース

XLSCOUTは、専門家がキュレーションした特許データでファインチューニングされた独自の埋め込みモデル、ParaEmbed 2.0をリリースしました。これにより、ParaEmbed 1.0に比べて精度が23%向上しています。

2148

Anthropic、コラボレーションAIワークフローのためのClaude Projectsを導入

Anthropicは、Claude ProおよびTeamユーザー向けにProjectsをリリースしました。これにより、200Kのコンテキストウィンドウ内で、厳選されたナレッジセットとカスタム指示を使用してチャットを整理できるようになります。

2149

Hugging Face Ethics and Society Newsletter #6: データ品質の重要性

Hugging Face は、データ品質に対して包括的かつ責任あるアプローチを示し、データはその目的に適合していることが AI モデルの性能、公平性、科学的再現性を確保する上で不可欠であると強調しています。

2150

Microsoft Florence-2 の DocVQA に対するファインチューニング

Hugging Face は、Microsoft の Florence-2 ビジョン・ランゲージモデルを DocVQA データセットでファインチューニングし、7 エポック後に検証時の類似度を 0 から 57.0 に向上させる方法を示しています。