国内の大型漏えい公表が、同じ日に3件重なった。BASE 子会社 Eストアー「ショップサーブ」で最大885万3839件(新規164)——カード番号の先頭6桁と下4桁・有効期限・暗号化パスワードまで含み、店舗側の管理画面・メール・FTP の ID/パスワードと振込先口座も漏れた。侵入は 5/21〜8/1 と2ヶ月半検知されていない。EPARK リラク&エステの予約管理システムから約3300万レコード(新規26)はDB 接続用アカウントが悪用され、顧客情報が削除された。講談社の最大3812件(新規45)は社員のフィッシング被害が入口。入口はそれぞれ違うが、いずれも公表まで時間がかかっている点が共通している。
「AI が出したセキュリティ報告」がノイズになり、本物が埋もれ始めた。r/technology #6「20万ドル級の実在の macOS 欠陥が、Apple のバグ報奨金の受信箱が AI スロップで埋まっていたせいで未報告に終わった」、r/netsec #4「SQLite の Critical CVE か、それとも LLM スロップか」、はてブ「Apple が AI による報告の殺到を受けてバグ報告の提出件数に上限を設定」(新規17)。AI が発見側に回った結果、報告の総量が受け手の処理能力を超え、本物が落ちるという新しい失敗モードが、3つの独立したソースで同時に出た。
エージェントに与える「実行環境」の実装が、同じ日に4つ出そろった。@cloudflare/computer——「エージェントに要るのはコンテナではなくコンピュータだ」(ファイルシステム・シェル・パッケージ・実行環境)というプレビュー公開。Y Combinator がマルチエージェントハーネス QM を MIT で公開(新規57)は会計・法務・イベント・エンジニアリングまで社内で実運用中。terminal-browser(新規254)は Chromium をターミナルに描画してエージェントが CLI からページを操作できる。HN は Launch HN: Hoplite(クラウド上のコーディングエージェントをデプロイする)。「どのモデルか」ではなく「どんな環境を与えるか」が争点に移っている。
エージェント侵入事案が、証拠保全命令の段階に入った。r/OpenAI #6「15人の州司法長官が OpenAI に、Hugging Face 関連インシデントの全証拠保全を要求する書簡」。技術側では r/netsec #5「最初のプロンプトの前に — 信頼されたコーディングエージェント用プロジェクトに潜むコード実行経路」、r/cybersecurity #4「AI コーディングエージェント起因のセキュリティインシデントを実際に経験した人はいるか」、#7 DeepSeek がプロキシジャック campaign に組み込まれていた。Wiz は開発者ワークステーションを新しい境界線と位置づけたセンサーを本日公開。「エージェントが何かした」話から、「エージェントを動かす手元をどう守るか」に降りてきた。
形式検証が、同じ日に上下両方向で出た。OpenAI「数学と理論計算機科学における10の進展」が HN 3位(456pt / 726コメント=本日最多)。証明を Lean 4 で形式化して機械検証可能にした点が売りで、r/OpenAI #10 は「2,000ドルで解いた」とコストまで書いている。同じ日に、AI 支援で作られた「コラッツ予想の反証」が Lean のカーネル健全性バグを突いていたことが判明(新規17)——Lean 開発者 de Moura 氏が postmortem を公開した。「形式検証を通った=正しい」の前提そのものが、同日に補強と反証を同時に受けている。
「AI で速くなった分は個人に返らない」が、国内外で同時に立った。AIで仕事を効率化したら、なぜか僕の仕事だけ増えた話が新規568で国内2位——8時間の仕事を4時間にすると、その仕事は「4時間の仕事」として再定義され、空いた4時間には別の仕事が入る。r/cscareerquestions は#7「コードレビューをやめた人、他にもいる?」・#12「人を減らして、差分を AI のスロップで埋める」・#3「チームが自分ひとりになった」。構造的な回答側にあたるのが、同日新規123のGitHub 公式スタック型プルリクエスト(巨大 PR を順序つきの小さな PR 群に割る)である。
Claude Code 板は総入れ替えで、争点がモデル品質から「使用量の制限」へ移った。15件すべてが新規。性能・劣化メガスレッド(8月3日)が立ち、「実質使えない」・「Opus 4.6 に戻した」と「全部書き直させれば悪くない」が同居。感想ではなく測定に基づくものはGen-5 は無意味な入力の検知が測定可能なほど悪化し、冗長さは約2倍。そして「なぜ5時間制限なのか」・「5X usage は本当か」が上位に入り、r/cscareerquestions の「今朝だけで月間 AI 使用量の30%を使った」と同じ日に並んだ。
ローカル実行は「動くか」から「いくらの機材で動くか」へ進んだ。Unsloth の Daniel Han が Qwen3.8-27B は VRAM 17GB で動くと検証、家庭用 PC で DeepSeek-V4-Flash-0731 が動いた報告、2×RTX3090 + 中古 quad-Xeon で 284B MoE を 33 tok/s、HN のAirLLM — 70B を 4GB GPU 1枚で(195pt)。冷や水は同じ板の量子化は知識を非線形に損なう(Qwen3.6 27B ケーススタディ)——ビット数に比例せず、特定の知識だけ先に落ちる。 両方見ないと採否を誤る。
EU AI Act 第50条が 8月2日に適用開始した。生成コンテンツにラベルとマーク義務、違反に最大1500万ユーロ。ディープフェイクと人手の確認を経ずに公開されるテキストには、視認できるラベルと機械可読なマークが要る。加えてチャットボット・エージェント・アバターは「AI である」と明示が必要になった。自動生成物を Web や LINE に出す構成の設計に直接効く。
HN は 30件すべてが入れ替わり、首位は AI ではなく「道具と信頼」だった。開発ツールはオープンソースでなければならない(518pt / 187コメント)が首位。2位はLLM は専門性に報いる(508pt)——同じモデルに同じことを聞けば同じ答えが返る以上、差がつくのは問い方と評価の側だという反論。5位はLLM が生成したコードを手で打ち直して「認知的負債」を防ぐ(400pt)で、国内トップの「デジタル教材では頭に残らない」(新規388)と論点が重なる。
オントロジー=AI に業務知識を渡す配管、が国内で同時に立った。AWS の OSS「Context Ontology Accelerator」を試した記事(新規119)が挙げる数字が効く——Text-to-SQL は学術ベンチ Spider 1.0 で91.2%なのに、実企業DB を集めた Spider 2.0 では21.3%まで落ちる。原因はモデルの賢さではなく「言葉と列の結びつけ」。「先に決める」か「データから起こす」か(新規104)が方法論側で並び、JetBrains Context(42 users)は同じ問題を IDE 側から解こうとしている。
「無言で壊れる」話が、開発現場側からも出た。r/webdev #8「1日ずつ溶かした2つのデプロイバグ、どちらも無言だった」。エラーを出さずに壊れることが最大のコストだという記録で、r/programming #3 SQLite に学ぶ信頼性(Richard Hipp)が対になる。silent skip をどう検知するかという、こちらの運用課題とそのまま同じ問題。
※ 収集は全ソース成功(397件・失敗0)。はてブは IT総合RSS+カテゴリページHTML直パース(カテゴリ別RSSは全404のため)で原題・元記事URL・ブクマ数を機械抽出し、重複除去後148件(新規70)。Hacker News は front_page API から30件(30件すべて前日から入れ替わり)。Reddit は RSS 2パス(1周目20秒間隔で5サブレッド成功・8サブレッドが HTTP 429 → 2周目60秒間隔で8件すべて回復)で 13/13サブレッド・195件(新規133)。セキュリティブログ24件。前日比・新規判定は前日 Markdown との URL 機械照合。本日は火曜で、国内は大型漏えいの公表が3件重なり、海外はエージェントの実行環境と使用量制限に伸びが集中した。