AI & Frontier Tech Roundup – Grok 4.7, MiMo‑v2.6‑Pro, Fast Local Inference, and Physical AI Updates

TL;DR

SpaceXAIのGrok 4.7モデルが、Grok 4.6と同等の価格で強力なコーディングおよび法的ベンチマークスコアを実現しリリースされた一方、MiMo‑v2.6‑Proは人工知能指数のトップにランクイン。両者を支えるのは、Husky、Wally、Qwen‑3.8‑27Bといった高速なローカル推論スタックの台頭と、Vangrid、Axis Roboticsによる物理AI向けの現実世界空間データへの再注目である。


Grok 4.7 – SpaceXAIの新エージェントモデル

  • Grok 4.7は、長期間のコーディング、エンジニアリング、知識作業タスクに最適化された完全エージェントモデルとして販売されており、Cursorワークフローのデータで新たに訓練され、二重用途のバイオおよび脱獄プローブに対する安全性が強化されている@cb_doge。
  • ベンチマークのハイライトとして、CursorBench 4.0で46.3 %(前回40.4 %から上昇)、DeepSWE v1.1で71.0 %(前回65.2 %から上昇)、法的エージェントベンチマークで19.6 %を記録。これは前回の最良モデルと比べてほぼ3倍のスコアである@cb_doge@cb_doge。
  • 価格は入力トークン100万トークンあたり2ドル、出力トークン100万トークンあたり6ドルで、Grok 4.6と同等。多くのタスクで約2倍の速度を実現している@aimlapi@MarioNawfal。
  • Grok Buildターミナル、Cursor IDE、主要なモデルゲートウェイ(OpenRouter、Vercel、Cloudflare、Snowflake、Databricks)を通じて利用可能@cb_doge@testingcatalog。
  • SpaceXAIの公式モデルカードでは、モデルが静かに低レベル化されることはないとしており、コミュニティのコメントでも同様の主張が繰り返されている@XFreeze。

MiMo‑v2.6‑Pro – オープンウェイトリーダーボードの有力候補

  • MiMo‑v2.6‑Proは、人工知能指数において最も優れたパフォーマンスを発揮したオープンウェイトモデルとして発表され、複数のタスクでClaude Opus 5およびGPT‑5.6 Solと並ぶ6位にランクインした@testingcatalog@cline。
  • ClinePassプラットフォームを通じて配布され、視覚的シーン生成ベンチマークでのコスト効率の高さがテスト・カタログアカウントによって強調されている@testingcatalog@aimlapi。
  • ユーザーが100の長年の数学問題を解決したと主張したが、ツイート自体がその主張が誇張されていると認めている@kimmonismus。

より高速なローカル推論エンジン

  • Husky(モデル固有推論)は、AppleのMLX‑Woofより最大4.5倍の高速化を実現し、MacBook上で730トークン/秒を達成。プライベートかつ高性能なローカルAIを可能にしている@0xSigil。
  • Wally(RunAnywhere)は、いくつかのフロンティアモデルのパフォーマンススナップショットを公開。例えば、GLM‑5.3 Flashは380トークン/秒、Qwen‑3.8‑27Bは485トークン/秒を達成(非指定ハードウェア)@RunAnywhereAI。
  • Qwen‑3.8‑27Bは、1か月間のエンジン改善によりM5 Max MacBook Pro上で6倍の速度向上を達成。エージェントのサブタスクで約120トークン/秒を実現した@adrgrondin。
  • Qwen‑Image‑2.1は、vLLM‑Omniでデイゼロサポートを獲得。7.1 BのDiTモデルとQwen‑3‑VL‑8Bを組み合わせ、透過画像の生成と編集を可能にした@vllm_project。
  • Tim Dettmersが発表した「オープンソース推論週間」では、消費者向けハードウェアでフロンティアAIを実行するためのフレームワークと論文が公開される予定。自動モデル圧縮や長時間のトークンストリーム処理が焦点となる@Tim_Dettmers。

物理AIと現実世界の空間データ

  • Vangridは、複数角度のスマートフォン動画をデバイス上で高密度な点群とガウススプラットに変換する分散型キャプチャネットワークを構築中。ロボット工学やワールドモデルのトレーニングに向けた検証可能な3Dジオメトリを提供している@Sainoleno@cxmrondlls@Trathoa。
  • プロジェクトは900万ドルを調達し、優れた貢献者に10万ドルの報奨金プールを提供。オンチェーンの証明可能性とプライバシー最優先の処理を強調している@reduansheikh11。
  • Axis Robotics(および関連コメント)は、大規模な現実世界のロボット軌道の必要性を強調。プラットフォームは遠隔操作セッションをクラウドソーシングしてトレーニングデータを生成しており、すでに94,000人以上の貢献者と200万件以上の記録されたセッションを蓄積している@kishanchiku@Real_TShelby。
  • 複数のアナリストが、物理AIのボトルネックはモデルのサイズではなく、高品質で最新の空間データであると指摘。VangridとAxisが将来の身体的知能のための重要なインフラであると位置づけている@jitusorkar12@hasibs00。

エージェント信用とAI駆動金融

  • Agentics Creditは、収益性、ドローダウン、一貫性、リスクを評価するエージェント信用スコア(ACS)を導入。300〜850のスケールで、ライブ資本へのアクセスには580以上のスコアが必要となる@cryptob28811588@MadMagicSOL@0xRiRoyal。
  • ティッカー取引のパフォーマンスに報酬を提供し、オンチェーン信用を付与する前に検証可能な実績を構築することを目指しており、DeFiエコシステムにおける自律エージェントのレピュテーション層の構築を狙っている@nguyenthambt@tianyi_peng。
  • コミュニティの投稿では、プロプライエタリエージェントハーネス(Claude Code、Codex CLI)と軽量なオープンソースフレームワーク(Pi)のコストを比較。同等のベンチマークスコアに対して、API使用コストが最大2倍安くなることが示されている@analogalok。

新たなモデルおよびツールの発表

  • MetaのMuse AIは、リリース後のダウンロード数でChatGPT、Grok、Claudeを上回ったと報じられ、新しいエージェントアシスタントの急速な採用を示している@Cointelegraph。
  • Perplexity Computerは、MiniMax H3およびByteDance Seedance 2.5を介して動画生成機能を追加。AI支援クリエイティブワークフローのマルチモーダル能力を拡張した@perplexity_ai。
  • Pollo MCPは、ChatGPT、Claude、Cursor向けの画像および動画生成プラグインを提供。新規ユーザーには40クレジットのオンボーディングインセンティブを提供@TaliaAariz@ayzalnooor24521。
  • オープンソースモデルのリリースには、AlibabaのQwen‑Image‑2.1(量子化版)とYandexのAlice AI Foundation 80B‑A3Bベースが含まれ、いずれもコミュニティの実験用に公開された@plotarmordev@yandexcom。

ポイント: 今週のフロンティアAIの状況は、2つの合流するトレンドによって特徴づけられる:(1) より強力でエージェント指向のモデル(Grok 4.7、MiMo‑v2.6‑Pro)が、大規模採用を想定した価格でリリースされたこと、(2) 低遅延のローカル推論と現実世界のデータパイプライン(Husky、Wally、Vangrid、Axis)への注力が、これらのモデルが物理環境やデバイス上での作業に活用できるようにしていること。同時に、AIエージェントの信頼性と経済性のエコシステムが成熟しており、Agentics CreditのレピュテーションスコアリングやAPIハーネスのコスト効率に対する注目が高まっている。