openbrowser: Playwright を使用して自然言語タスクを実行する TypeScript 用自律ウェブブラウジングフレームワーク
自然言語コマンドでエージェントが任意のウェブサイトをナビゲート、操作、データ抽出できる、TypeScript 用の AI 駆動自律ウェブブラウジングフレームワーク。
moltworker: OpenClaw パーソナル AI アシスタント用のマネージド Cloudflare Sandbox デプロイメント
ユーザーが Cloudflare Sandbox コンテナ内で OpenClaw パーソナル AI アシスタントを実行できるようにし、マネージドで常時稼働する体験を提供するデプロイパッケージです。
claude-skills: Claude Code 用の 66 の開発スキルと統合プロジェクトワークフローを備えた専門知識プラグイン
Claude Code 用のプラグインで、66 の専門開発スキルとワークフローを提供し、AI をフルスタックエンジニアリングに特化したコンテキスト対応エキスパートに変換します。
trigger.dev: TypeScript で長時間実行の AI エージェントを構築・デプロイするための耐久性ワークフローエンジン
サーバーレスのタイムアウトなしで、TypeScript で耐久性のある長時間実行 AI エージェントとワークフローを構築できるオープンソースプラットフォーム。
pentagi: 統合されたセキュリティツールとナレッジグラフを備えた自律型マルチエージェント侵入テストプラットフォーム
マルチエージェントシステムとプロフェッショナルなセキュリティツールを活用し、脆弱性発見を自動化する自律型 AI 駆動の侵入テストプラットフォーム。
page-agent: テキストベースの DOM 操作でウェブインターフェースを自然言語制御できるクライアントサイド GUI エージェント
テキストベースの DOM 操作を通じてウェブインターフェースを自然言語で制御できる JavaScript ライブラリ。開発者は AI コパイロットをウェブページに直接埋め込むことが可能です。
ai-website-cloner-template: AI コーディングエージェントを使ってウェブサイトを Next.js コードベースに逆コンパイルする再利用可能テンプレート
AI コーディングエージェントを活用し、デザイン抽出とコンポーネント再構築を自動化してウェブサイトを Next.js コードベースに逆コンパイルする再利用可能テンプレート。
Claude-Code-Game-Studios: Claude Code 用の専門エージェントと自動品質ゲートを備えたプロフェッショナルなゲーム開発スタジオフレームワーク
Claude Code 用の構造化されたゲーム開発スタジオテンプレートで、49 人の専門エージェントと 73 のスキルを提供し、ソロの AI 補助ゲーム開発にプロフェッショナルなスタジオ組織をもたらします。
AIフリーのテックニュースソースへの需要
技術コミュニティの増大する層が、主流のテックメディアやフォーラムにおけるAI関連コンテンツの飽和から脱出するために、ニュースフィルタや代替プラットフォームを求めています。
OpenAI Codex: 機密ファイルの除外をめぐる議論
OpenAI Codex のオープンな課題に関する議論は、ユーザーが要望する '.agentignore' ファイルと、LLMベースのエージェントが機密データにアクセスすることを真に防ぐことができるのは OS レベルのサンドボックス化のみであるという技術的な現実との間の根本的な対立を浮き彫りにしています。
Marfa Public Radio Puts You to Sleep Podcast
Marfa Public Radio は、FCC のコンプライアンスや NPR の倫理コードなどの退屈な運用文書を朗読する睡眠ポッドキャストを開始し、リスナーが眠りにつく手助けをしながら局の資金調達への関心を高めています。
OpenAI コアダンプ疫学: 18 年前の libunwind バグを修正
OpenAI は、Rockset データインフラストラクチャにおける 2 つの異なるクラッシュ集団を特定し、解決しました。これには、サイレントなハードウェア障害と、GNU libunwind におけるまれな 18 年前のレース条件が含まれます。
Inside Genebench-Pro: ゲノムAIベンチマークにおけるケーススタディ
OpenAIのGenebench-Proは、複雑なゲノミックタスクにおけるAIモデルを評価するための専門的なベンチマークを提供し、体性腫瘍学、機能ゲノミクス、および集団遺伝学にわたる十の詳細なケーススタディを特徴としています。
OpenAI は計算生物学の推論のために GeneBench-Pro を発表
OpenAI は、計算生物学における AI エージェントの高レベルの科学的判断と反復分析能力を評価するために設計された研究レベルのベンチマークである GeneBench-Pro をリリースしました。
dolt: テーブル用の Git のようなバージョン管理を備えた MySQL 互換 SQL データベース
MySQL 互換の SQL データベースに組み込みの Git ライクなバージョン管理機能を提供し、テーブルのブランチ、マージ、コミットを可能にします。
cognee: エージェントに自己ホスト型ナレッジグラフを通じて永続的な長期記憶を提供するオープンソース AI メモリープラットフォーム
取り込んだデータから自己ホスト型ナレッジグラフを構築することで、エージェントに永続的な長期記憶を提供するオープンソース AI メモリープラットフォーム。
vibe-kanban: 複数の AI コーディングエージェントからの作業を計画・レビューするためのカンバンベースのオーケストレーションレイヤー
AI コーディングエージェント用の管理レイヤーで、カンバンによる計画とエージェント実行用の専用ワークスペース、レビュー、アプリプレビューを統合します。
open-design: プロトタイプ、デッキ、モーショングラフィックスを生成するためのオープンソースエージェントデザインワークスペース
オープンソースのエージェントネイティブデザインワークスペースで、AI エージェントが共有デザインシステムに基づきプロトタイプ、ダッシュボード、モーショングラフィックスを生成できます。
daytona: AI が生成したコードを分離されたサンドボックスで実行するための安全で弾力的なインフラランタイム
AI が生成したコードを実行し、AI エージェントのワークフローを管理するための分離されたサンドボックスを提供する、安全で弾力的なインフラランタイムです。
Front-End-Checklist: 人間と AI 主導の監査のために標準化されたルールコーパスを提供するフロントエンド品質システム
ベストプラクティスを人間と AI エージェント向けの実用的なレビュー・ワークフローに変換する、ウェブサイトと MCP サーバーを通じたオープンソースのフロントエンド品質システム。
gemini-cli: ターミナルベースの AI エージェント(組み込みシェルツールと開発者ワークフロー向け MCP 対応)
ターミナル向けのオープンソース AI エージェントで、コード解析、Automation、システム統合のために Gemini モデルへの直接アクセスを提供します。
大杉:木から木を育てる日本の技術
大杉は、一本の木を剪定して複数の垂直芽を育てることで、高品質で真っ直ぐな杉材を生産する日本の伝統的な林業技術です。
マックス・プランクの1940年代の論文の撤回:アルゴリズム的エラーと歴史的記録
物理学者マックス・プランクの1940年代の2本の論文が、自動的な著作権・重複チェックにより誤って *Naturwissenschaften* から撤回されました。この事例は、現代の出版基準と歴史的科学記録との間に生じる対立を浮き彫りにしています。
Ozempicと腸脳相関:減量とメンタルヘルスへの影響
Ozempic のような GLP-1 受容体作動薬は、腸脳相関に働きかけてフードノイズを減少させ、気分を改善する可能性がありますが、ユーザーの経験は、大幅な精神的な明晰さから、アンヘドニアやうつ病の報告にまで及びます。
NanoEuler: CとCUDAでゼロから構築されたGPT-2スケールのLLM
NanoEulerは、CとCUDAで完全に記述されたGPT-2スタイルの言語モデルの教育的な実装であり、手書きのバックプロパゲーション、FlashAttention、およびMLライブラリを使用しない完全なプリトレーニングからSFTまでのパイプラインを特徴としています。
パブリックDNSリゾルバの選択:プライバシー、パフォーマンス、およびセキュリティのトレードオフ
プライバシー、セキュリティ、およびパフォーマンスに基づいたパブリックDNSリゾルバの選択に関する包括的なガイド。29のグローバルプロバイダーの比較と、暗号化DNSトランスポートの技術的なトレードオフを分析しています。
mcp-router: Model Context Protocol サーバーの整理と制御を統合したデスクトップマネージャー
Model Context Protocol(MCP)サーバーを集中管理するデスクトップアプリケーションで、サーバーをプロジェクトやワークスペースに整理しながら、ローカルデータのプライバシーを保ちます。
envd: 複雑な Dockerfile を Python 宣言に置き換える AI/ML 用コンテナベース開発環境マネージャー
複雑な Dockerfile の代わりにシンプルな Python 宣言を用いて、コンテナベースの AI/ML 開発環境を作成するコマンドラインツール。
bionic-gpt: エージェント型 RAG パイプラインと厳格なデータ機密性を備えたオンプレミス企業向け AI プラットフォーム
厳格なデータ機密性要件を持つ組織向けに、セキュアでセルフホスト可能な生成 AI とエージェント型 RAG パイプラインを提供する、オンプレミスのエンタープライズグレード ChatGPT 代替ソリューション。
ChainForge: プロンプトエンジニアリングと LLM 仮説テストのためのビジュアルツールキット
体系的なプロンプトエンジニアリングのためのビジュアルデータフロー環境で、複数の LLM とモデル設定にわたってプロンプトをバトルテストし、組み込みの評価・可視化ツールで結果を分析できます。
AGiXT:自然言語でデジタルおよび物理環境を制御する包括的AI自動化プラットフォーム
AGiXT は、豊富な組み込み拡張機能とマルチプロバイダー対応により、自然言語でデジタルおよび物理環境を制御する AI 自動化プラットフォームです。
pezzo: プロンプト管理と AI オペレーション監視のためのクラウドネイティブ LLMOps プラットフォーム
プロンプト管理、可観測性、キャッシュ機能を備えたオープンソースの LLMOps プラットフォームで、AI オペレーションを最適化しコストを削減します。
trulens: LLM 実験とエージェント行動を追跡するための体系的評価・可観測性フレームワーク
LLM アプリケーション向けの評価・可観測性フレームワークで、経験則的テストを体系的な追跡とエージェント評価に置き換えます。
Acontext: エージェントの学習内容を編集可能な Markdown ファイルとして保存する透明なスキルメモリ層
AI エージェント向けのオープンソーススキルメモリ層で、エージェントの実行から学習内容を自動的に取得し、人間が読める Markdown ファイルとして保存します。
lorax: 単一 GPU で数千のファインチューニング済み LLM をスケールさせるマルチ LoRA 推論サーバー
単一 GPU で数千のファインチューニング済み LLM を提供できるマルチ LoRA 推論サーバーで、提供コストを削減します。
cube-studio: 多様な AI コンピュートとストレージリソースを管理するクラウドネイティブなワンストップ機械学習プラットフォーム
オープンソースのクラウドネイティブ機械学習プラットフォームで、AI 開発、トレーニング、推論インフラをワンストップで管理できるソリューションを提供します。
coze-loop: AI エージェントの開発、評価、監視を行うフルライフサイクル管理プラットフォーム
AI エージェントのフルライフサイクル管理を目的とした開発者向けプラットフォームで、プロンプトエンジニアリング、自動評価、実行の可観測性を提供します。
helicone: コスト、レイテンシ、LLM リクエストのルーティングを追跡する AI ゲートウェイおよび可観測性プラットフォーム
AI エンジニア向けの AI ゲートウェイ兼 LLM 可観測性プラットフォーム。100 以上のモデルへの統一 API アクセス、リクエストトレース、プロンプト管理を提供。
plano: エージェント指向のオーケストレーションと可観測性のための AI ネイティブ プロキシサーバーおよびデータプレーン
エージェントオーケストレーション、LLM ルーティング、可観測性を一元化した AI ネイティブのプロキシサーバー兼データプレーンで、プロダクション向けエージェントアプリケーションのデプロイをシンプルにします。
clearml: 実験トラッキング、オーケストレーション、データバージョニングを備えたオールインワン MLOps スイート
オープンソースの MLOps および LLMOps スイートで、実験トラッキング、オーケストレーション、データ管理を提供し、ディープラーニング開発ライフサイクルを効率化します。
openllmetry: OpenTelemetry に基づく LLM アプリケーション向けオープンソース観測フレームワーク
OpenTelemetry 上に構築されたオープンソースの観測フレームワークで、LLM アプリケーション、プロバイダー、ベクトルデータベースの完全なトレースとモニタリングを提供します。
evidently: 機械学習および LLM 搭載システムの評価・テスト・モニタリングを行うオープンソースフレームワーク
機械学習および LLM 搭載システムの評価・テスト・モニタリングを行うオープンソースの Python フレームワークで、開発者がデータドリフトを検出し、出力品質を確保できるよう支援します。
BentoML: 本番環境向け AI 推論 API の構築とデプロイのための統合モデルサービングフレームワーク
任意の AI/ML モデル向けに、高性能なモデル推論 API とマルチモデルサービングシステムを構築・デプロイするための Python フレームワーク。
バットルフ・コレクション:5,000件のレストランメニューの可視化 (1880-1920)
ニューヨーク公共図書館のバットルフ・コレクションから5,000件のレストランメニューをデジタル的に探索することで、1880年から1920年の間の食のトレンドと社会の変化が明らかになります。
DiScoFormer: 分布にわたる密度とスコアのための単一トランスフォーマー
DiScoFormerは、データ点のセットから分布の密度とスコアを単一のフォワードパスで推定し、新しい分布に対して再トレーニングを必要としない新しいトランスフォーマーベースのモデルです。
AIスロップ(AI Slop)に実体験で立ち向かう
情報と知恵の区別は、個人の経験、すなわち実体験を創造的なプロセスに統合することこそが、人間が生成した成果物とAI生成コンテンツとの違いを分ける唯一の方法であることを示唆しています。
Microsoft フロンティア エコシステムとエージェント コンピューティングの未来
Microsoft の CEO Satya Nadella は、企業がライセンスされたモデルと強化学習を活用して独自の AI 知的財産を構築する「フロンティア エコシステム」のビジョンを示し、無制限インテリジェンス向けの新ハードウェアも併せて提案しています。
『Careless People』の著者が沈黙を強いられるために、Metaが12ヶ月間にわたる監視を行っていたとして提訴される
著者Wynn Williamsは、Metaが口止め命令を強いるために彼女を1年間にわたり秘密裏に監視したと主張しており、企業の過剰な権限行使と法的な影響を浮き彫りにしています。
AMD Strix Halo RDMA クラスター セットアップ ガイド
Intel E810 RoCE v2 NIC を使用して、Tensor Parallelism を介した分散 vLLM 推論を可能にする、2 ノードの AMD Strix Halo クラスターの構成に関する技術ガイド。
米国政府、2027年モデル以降のPolestar販売を禁止
米国商務省は、Polestarが2027年モデル以降に新車を販売する認可を拒否しましたが、同じくGeely傘下の姉妹ブランドであるVolvoには同様の認可を付与しました。