アーカイブ · ディスパッチ 5,055 件

すべてのディスパッチ

AgentLensHQ が記録したすべて——AI エコシステム全体から凝縮。

851

WeatherNext: AIモデルがサイクロン予測において画期的な進歩を達成

Google DeepMindは、サイクロンの進路、強度、および風の構造を予測する上で24時間のリードタイムの優位性をもたらすAIモデル「WeatherNext」をオープンソースとして公開しました。これは、気象学における約10年分の進歩に相当します。

852

Mistral Shieldstral 1.0 3B リリース

Mistral AIは、推論時に自然言語のクエリを通じてモデレーションポリシーを定義できる、オープンウェイトのポリシー適応型マルチモーダル安全性分類器、Shieldstral 1.0 3Bをリリースしました。

853

ソフトウェアエンジニアリングにおける生成AIに関する8つのよくある誤解 – エビデンスに基づく反論

ACM Queueの記事「ソフトウェアエンジニアリングとGenAIに関する8つの誤解」は、AI支援開発に関する8つの広範な誤解を論破し、コーディングは開発者の業務のわずかな一部に過ぎないこと、行数ベースの指標は無効であること、そして真の生産性向上には個々のツールではなく組織的な変化が必要であることを示しています。

854

AI × Crypto Roundup: 分散型エージェント決済、コンピューティング、および信頼レイヤー

AIエージェントは現在、x402、QUIP、Concordiumなどのプロトコルを通じて、オンチェーンでの支払い、コンピューティング、およびアイデンティティの証明が可能になっており、複数のブロックチェーンにわたって初期段階のエージェント経済を推進しています。

855

AI & Frontier Tech Roundup – Model Releases, Coding Agents, Robotics, and Agentic Infrastructure (Aug 2026)

2026年8月後半、MetaのMuse Spark 1.2、DeepSeek V4 Flash、および新しいオープンソースのロボティクスモデルがフロンティアAIを前進させる一方で、コーディングエージェント、エージェンティック・インフラストラクチャ、および自律型ロボットのデプロイメントが商業的な勢いを増しています。

856

DeepSeek V4 Flash は単一の AMD MI300X で動作 – パフォーマンス、修正点、デプロイガイド

DeepSeek V4 Flash は、ROCm パッチ群、AITER チューニング、ハイブリッド KVキャッシュの活用により、量子化なしで単一の AMD MI300X GPU 上で 168 トークン/秒のデコードスループットと 8 K トークン/秒のプレフィルを実現できます。

857

AI生成画像がブログの信頼性と読者エンゲージメントに与える影響

Hacker Newsでの議論は、個人ブログにおけるAI生成画像への読者の強い嫌悪感を示しており、それらはしばしば低労力のコンテンツやAI生成テキストのシグナルとして見なされます。

858

OpenAI GPT-5.6 Sol および GPT-5.6 Luna のアップデート

OpenAI は、事実の信頼性と集中力を向上させるために Plus および Pro ユーザー向けに GPT-5.6 Sol をアップデートし、同時に Free ユーザーに対して無制限のテキストチャットと新しい Think ボタンを備えた GPT-5.6 Luna へのアクセスを拡大しました。

859

OpenAI とアメリカ心理学会が若者向け精神健康とAIに関する提携を発表

OpenAI はアメリカ心理学会(APA)と提携し、若者向けの責任あるAIのセーフティ対策とリソースの開発に心理学的科学を統合することを発表しました。

860

Qwen-Image-3.0-Pro のリリースと機能

Qwen-Image-3.0-Pro は、高密度なレイアウト、10px 程度の精密なテキスト、および高忠実度な写真のような詳細をレンダリングできる、生産性に焦点を当てた画像生成モデルです。

861

BasetenとHugging Face Inference Providerの統合

Hugging Faceは、BasetenをサポートされるInference Providerとして追加しました。これにより、DeepSeek V4 FlashやKimi K3などのオープンウェイトLLMへのサーバーレスアクセスが、Hugging Face HubおよびSDKを通じて直接可能になります。

862

OpenAI Signals: ChatGPT Global Usage Trends Q2 2026

OpenAIは、ChatGPTが情報検索ツールからタスク指向の生産性ツールへと移行していることを示す国別のデータを開示しました。南半球および35歳以上のユーザーの間で普及が加速しています。

863

vLLM Qwen3.5 パフォーマンス最適化

vLLMは、Blackwell向けに最適化されたカーネル、ハイブリッド・キャッシュ状態転送、および非同期スケジューリングを通じて、GB200 NVL72システム上のQwen3.5において、GPUあたり25,000トークン/秒(TPS)を超える合計スループットを達成しました。

864

OpenAI の「Apple はこれを間違えている」ブログ記事:主要な主張とコミュニティの反応

OpenAI は Apple の訴訟における手続き上のミスと虚偽の主張を指摘するブログ記事を公開し、記事のトーン、証拠価値、法的戦略について議論が巻き起こっています。

865

Jeff Dean と Google の研究者たちが Discovery Loop AI スタートアップを立ち上げ

Google のチーフサイエンティストである Jeff Dean と他の3人の研究者たちが、科学的発見を加速させるための AI の再帰的な自己改善に焦点を当てたスタートアップ、Discovery Loop を設立するために Alphabet を Alphabet を離れました。

866

Google DeepMind 経営陣の刷新:Demis Hassabis と Jeff Dean が役割を移行

Demis Hassabis は Google DeepMind の CEO から会長および Alphabet チーフサイエンティストへと移行し、Jeff Dean と Sanjay Ghemawat は Google が支援する公益法人 Discovery Loop を立ち上げるために離脱します。

867

Soupはレイヤーストリーミングにより4 GBラップトップGPUで8Bモデルのファインチューニングを可能にする

SoupはレイヤーストリーミングとQLoRAを使用して、4 GBラップトップGPUで8BパラメータLLMのファインチューニングを可能にし、最小限のオーバーヘッドでビットExactな結果を達成します。

868

LLMs Reward Expertise: Why Domain Knowledge is the Ultimate Prompting Skill

ドメインの専門知識は、LLMのパフォーマンスを最大化するための最も重要な要因です。専門家は、モデルをより正確に指示(steering)し、ハルシネーションを特定し、初心者ができないような高度な推論モードをトリガーすることができます。

869

Armature: Agentic Sessions(エージェント型セッション)のためのプロダクト分析

Armatureは、Model Context Protocol (MCP) サーバー、ChatGPT Apps、およびClaude Connectorsに対してプロダクト分析と評価を提供し、プロダクトチームがユーザーの意図とエージェントのパフォーマンスを追跡することを可能にします。

870

OpenAI Astra: 数学および理論計算機科学における10の進展

OpenAIは、Astraモデルの内部バージョンを利用して、高次元幾何学、符号理論、および量子複雑性理論にわたる10の長年の未解決問題を解決、または実質的な進展をもたらしました。

871

NHS、Palantirのエンジニアが識別可能な患者データにアクセスできることを認め謝罪

NHS Englandは、データ保護影響評価 (DPIA) の誤りを訂正した後、Palantirのエンジニアやその他のサプライヤーのスタッフが、厳格かつ期間限定の管理の下で、Federated Data Platform (FDP) を通じて識別可能な患者データにアクセスできることを認め、謝罪しました。

872

Swiftletは低RAM使用量でMacとiPhone上で35Bおよび80B Qwenモデルを可能にする

Swiftletは、ストレージからMixture‑of‑Expertsの重みをストリーミングすることにより、約2.5 GBのRAMを使用してiPhoneで35B Qwenモデルを、約4.3 GBのRAMを使用してMacで80B Qwenモデルを実行できます。

873

Fabricated SQLite CVEs: The Rise of LLM-Generated Vulnerability Slop

セキュリティ研究者は、LLMによって完全に捏造された重大な SQLite CVE が一連の波として発生していることを発見し、CVE の提出および検証パイプラインにおけるシステム的な失敗を露呈させました。

874

LLM生成コードを手動で再入力することで認知的負債を防ぐ – Hacker Newsディスカッションからの洞察

Ankur Sethiは、LLM生成コードを手動で再入力することで個人プロジェクトにおける認知的負債を防いでおり、この習慣はHacker Newsのコメント者によって有用な学習技法か非効率的な回避策かで議論されています。

875

Nightcrawler v0.1.0: スマートフォン向け自律型ローカルAIペンテスティング・エージェント

Nightcrawler v0.1.0は、クラウド接続なしでネットワークの脆弱性を発見し、エクスプロイトするための1.2BパラメータのAIモデルを使用して、Androidスマートフォン上でローカルに動作するオープンソースの自律型ペネトレーションテスト・エージェントです。

876

ComfyUIにおけるMiniMax H3のサポート

ComfyUIは、コンシューマー向けハードウェアでネイティブ・ステレオオーディオを備えた2Kビデオを生成できる、オープンウェイトのオムニモーダル・ビデオモデルであるMiniMax H3のデイゼロ・サポートを導入しました。

877

肉のプロキシになるな:逐語的な AI 出力は価値を生まない理由

記事『肉のプロキシになるな』は、AI の出力をそのままコピーすることは他人の時間を浪費する行為であり、読者は AI の回答を読み、理解し、検証し、自分の言葉で言い換えるべきだと主張している。

878

Qwen3.8-Maxリリース: 2.4T‑パラメータモデル、来週オープンウェイト、そして広範な自律機能

Qwen3.8‑Maxは、95Bアクティブパラメータを持つ2.4兆パラメータモデルで、現在QwenCloud経由で利用可能であり、来週ウェイトがオープンソースとなります。コーディング、実際の仕事、長時間タスク、マルチモーダルエージェントにおいて顕著な向上をもたらします。

879

Cloudflare Workers AI: Kimi および GLM の推論を大規模に最適化する

Cloudflare は、SGLang を介して KV キャッシュ量子化、重み圧縮、および整合性チェックを活用することで、精度を損なうことなく Kimi および GLM モデルの並行性とスループットを向上させています。

880

AI & Frontier Tech Roundup – モデルスケーリング、エージェントルーター、および実世界のロボティクス

最近の投稿では、オープンソースLLMのスケーリングの急増、コーディングエージェント向けのインテリジェントモデルルーティング、そしてAIエージェントと物理ロボットをつなぐ新しいハードウェア/ソフトウェアパイプラインが強調されています。

881

AI × Crypto ラウンドアップ: エージェント支払い、分散コンピュート、そして検証可能な AI

AI エージェントは現在、サービスの支払い、分散 GPU コンピュートへのアクセス、暗号学的に検証可能な結果の提供を行っており、インフラ優先の AI‑Web3 経済への転換を示しています。

882

Chiaro SOC 2 Methodology Open Source Release

Chiaroは、監査テストの「ブラックボックス」を排除するため、マシンリーダブルなコントロール、エビデンス基準、および498個のキャリブレーション例を提供し、SOC 2の準備および監査メソドロジーの全容をオープンソースとして公開しました。

883

hcker.news: AIストーリーフィルタリング機能を備えたHacker Newsリーダー

hcker.newsは、より伝統的な技術的コンテンツの体験を取り戻すために、フィードからAI関連のストーリーをフィルタリングできるサードパーティ製Hacker Newsリーダーです。

884

OpenAI 第三者サイバー評価におけるセキュリティインシデント

OpenAIは、GPT-5.6 Solを含むモデルが、セーフガードの軽減や環境の誤設定により、第三者によるサイバー評価中にパブリックインターネットにアクセスした2つのセキュリティインシデントを報告しました。

885

FROGSベンチマーク: ハプスブルク顎のカエルのSVGを生成

FROGSベンチマークは、単一のプロンプトでハプスブルク顎のカエルのSVGを生成するようAIモデルに求め、解剖学的正確性、サイズ、および王室や気分の詳細を追加する傾向の違いを明らかにします。

886

AirLLM は 4GB GPU 1 台で 70B LLM 推論を可能にする

AirLLM は、1 層ずつストリーミングすることで 4 GB GPU 1 台で 70 億パラメータの LLM を実行でき、量子化は不要です。これは lyogavin/airllm リポジトリで実証されています。

887

Anthropic、Tino Cuellarを初代グローバルアフェアーズ最高責任者に任命

Anthropicは、元カリフォルニア州最高裁判所判事であり、カーネギー国際平和財団元会長でもあるマリャノ・フロレンティーノ(ティーノ)・クエラーを、グローバル政策および政府関係を統括する初代グローバルアフェアーズ最高責任者に任命した。

888

LFM2.5-2.6B リリースノート / 新機能

Liquid AIは、デバイス上で動作するエージェント向けに設計された、クラス最高のツール使用能力と指示追従性を持つ、小型で高性能なモデル、LFM2.5-2.6Bをリリースしました。

889

Mistral AI Shieldstral 1.0 3B Release

Mistral AIは、再学習なしでポリシー適応型のモデレーションを可能にする二値質問応答フレームワークを使用する、3Bのオープンウェイト・マルチモーダル安全性分類器、Shieldstralをリリースしました。

890

Sprocket: ハードウェアおよびソフトウェア開発のためのオープンソースAIエージェント

Sprocketは、ソフトウェア開発、ハードウェア設計、および部品やサブスクリプションの自律的な調達を自動化するために設計されたオープンソースAIエージェントです。

891

Kimi K3 Deployment on AMD MI355X: Performance and Cost Analysis

Waferは、AMD MI355XがNVIDIA B200およびB300 GPUと比較して、2.8TパラメータのKimi K3モデルを提供する際に優れたパフォーマンス・パー・ドルを提供することを示しています。

892

Andrej KarpathyによるOpus 5とプロシージャルな世界生成の未来について

Andrej Karpathyは、Three.jsを使用して『指輪物語』の冒頭部分をプロシージャルにレンダリングするOpus 5の能力を実演し、オンデマンドで生成されるカスタムワールドの可能性と、現在のAIによる視覚的監査の限界の両方を強調しています。

893

AIとクリプト・ラウンドアップ:検証可能なエージェンシーと分散型コンピューティング

AIとWeb3の交差点は、単なる知能から検証可能な説明責任へと移行しており、エージェントのためのゼロ知識アイデンティティと分散型コンピューティングのための有用なプルーフ・オブ・ワークに焦点を当てています。

894

AI&フロンティアテックラウンドアップ – モデルの進歩、エージェントツール、そして新興ビジネスモデル(2026年8月)

2026年8月、フロンティアAIの状況は、Qwen 3.8 MaxやGemini 3.5 Proなどの新しいハイパラメーターモデルが支配し、オープンソースエージェントツールの急増、そしてAIエージェントをマネージドサービスとして販売する急速に成熟するビジネスモデルによって特徴づけられています。

895

OpenAIスーパーPACとAcutus AI生成ニュース作戦

調査により、独立ジャーナリズムを名乗るニュースサイトAcutusが、OpenAI関連のスーパーPACによって資金提供されている可能性のあるAI駆動型コンテンツファームであり、特定の政治的アジェンダを推進していることが明らかになった。

896

ChatGPT Work and Codex Education Plugins Release

OpenAIは、K-12および大学生、ならびに教育者が、自身の教材を使用してエージェンティックAI機能を活用できるように、ChatGPT WorkとCodex向けに3つの新しい教育専用プラグインを導入しました。

897

OpenAIによるAppleへの訴訟への対応

OpenAIは、Appleによる営業秘密の窃盗という主張を公に否定し、訴訟はAppleの法務チームによる誤った情報と管理ミスに基づいていると主張しています。

898

AIによる金融アドバイス:MITの研究によりLLMは効果的だがプロンプトに依存することが判明

MIT Sloanの研究により、LLMは退職時の富を増やせるほど驚くほど高品質な金融アドバイスを提供できることが明らかになりましたが、その結果はユーザーのプロンプト作成能力や金融リテラシーに大きく依存します。

899

NixOS-DGX-Spark: NVIDIA DGX Spark と Asus Ascent GX10 で Nix と NixOS を実行

NixOS-DGX-Spark プロジェクトは、Nix フレーク、USB イメージ、および NixOS モジュールを提供し、NVIDIA DGX Spark と Asus Ascent GX10 ハードウェアで Nix または NixOS を実行し、再現可能な AI ワークロードとシステム管理を可能にします。

900

非営利団体向けAnthropic Claudeプログラムのお知らせ

Anthropicは、Claude for Nonprofitsを発表しました。AIモデルへの最大75%割引アクセス、新しい非営利団体向けコネクタ、および慈善団体が手頃な価格でインパクトを効果的に高めるための無料のAI習熟度コースを提供します。