🕐 2026-07-30 12:18 更新
本日の軸
Claude の共有会話が Google 検索に丸見えだった(本日の新規最大・国内4本) / プロンプトインジェクションが「文書を介した自己増殖」に到達した / Hugging Face 侵入が一次資料で読める段階へ(4.5日で1万7600回) / 「AIが脆弱性を見つける」への検算が一斉に始まった(悪用されたのは1%) / 「長い指示文書はエージェントを統制しない」が実証された / Claude の障害が板を占拠し、同日に「AIが使えない日」のリスク管理が立った / ローカルLLMの敷居が両側から下がった(2GB RAM / Kimi K3 594GB) / 国内は「理解・測定・価値」の3点セットが定着し、研修素材が積み上がった / コンテンツを食われる側が法廷で勝ち、個人開発は実測を出した / 深刻度「緊急」が同週に2件、サプライチェーンも続いた
Claude の共有会話が Google 検索に丸見えになっていた。国内は CNET「Claudeで共有した会話、Google検索にインデックスされていたと判明--企業の内部データも」(41→160・+119 で本日の伸び2位)、窓の杜「まさにパブリック……」(32)、ZDNet(22)、GIGAZINE「プライベートな会話内容・健康記録・社内文書などが大量に発見」(12)——4本が同日に上がった本日の新規最大トピック。「リンクを知っている人だけが見る」という理解が違っていたという話で、設定ミスではなく既定の挙動の誤解から起きている。同じ問題圏に VISASQ「みんながAIを使う時、セキュリティについてどう考えればいいのか」(90)と Aikido の LLM セキュリティツール比較がある。共有リンクで会話を人に渡す運用は、社内・家族向けとも一度棚卸しする価値がある。
プロンプトインジェクションが「文書を介した自己増殖」に到達した。HN #14「文書に埋め込まれた AI ワームが Copilot for Word を通じて自己増殖する」(352pt / 269コメント)——Word 文書を開くだけで次の文書へ伝播する実証。国内の入口は togetter「AIずんだもんが視聴者によるプロンプトインジェクションで壊れる動画」(46→55)で、非エンジニアへの説明素材として使える。防御側は r/netsec #7「エンドポイント AI エージェントの検知と強制」、攻撃の現実例は r/netsec #17「承認プロンプトを無効化した状態で走る AI エージェントがタイ財務省を標的にした」承認プロンプトを切る運用(--dangerously-skip-permissions 相当)が、そのまま被害の前提条件として名指しされている。
Hugging Face 侵入が「一次資料で読む」段階になった。HN #10「フロンティアラボへのエージェント侵入の解剖」(308pt / 183コメント)は Hugging Face 自身の技術タイムラインで、昨日は国内10ブクマの地味な扱いだったものが本日 r/netsec #6・r/cybersecurity #14 にも同時掲載。国内 ITmedia が 「OpenAIモデルが4.5日で1万7600回の攻撃操作」(34)と数字を出し、piyolog のまとめ(42)、MIT Tech Review「『AIの暴走』ではない、オープンAIのモデルが不正侵入した理由」(14)が続いた。海外の当事者板では r/OpenAI #3「暴走モデルは4日間ネット上を動き回り、2社目を攻撃した」#11。Aikido は「この侵害から得られるインシデント対応の4つの判断」を出した。検知まで4〜5日という数字が繰り返し出ている。自前の自己監視3層(skill-audit / output-freshness / error-digest)の間隔を見る材料。
「AIが脆弱性を見つける」への検算が一斉に始まった。r/cybersecurity #3「AI が発見した脆弱性のうち実際に野生で悪用されたのは1%——人間が見つけたものと同じ率」が板の最上位に来て、#4「Anthropic の Mythos はこれまでになく多くのバグを見つけられる。Microsoft は修正の速度が追いつかない」が続く。HN #25「Anthropic の新しい暗号解析結果についての所感」(114pt)は Matthew Green による専門家の検算で、昨日189pt だった発表への評価。実務側の生々しい数字は r/netsec #24「エクスプロイトブローカーは WordPress の RCE に$500,000払う。私は GPT5.6 Sol Ultra と$25で1件見つけた」、r/cybersecurity #22「オープンモデルで NGINX の脆弱性6件を発見」。防御側の製品化も同日で、Wiz Red Agent が一般提供開始、OpenAI は「Codex Security CLI」をオープンソース公開(39 / GitHub 15)発見コストは下がり、修正が詰まる——ボトルネックが移った週。
「長いポリシー文書はエージェントを確実に統制しない」が実証された。HN #15「HANDBOOK.md: 長コンテキストのエージェント指示追従ベンチマーク」(303pt / 185コメント・arXiv 2607.25398、7/28投稿)。同日 r/ClaudeCode は #1 Opus 5 フィードバック大スレッド#12「Opus 5 vs Opus 4.8: ハルシネーション率のトレードオフと運用のコツ」#13「Opus 4.8 でも 5 でも問題は出ていない。私の CLAUDE.md を試してみたら?」#7「数ヶ月 Claude Code の hooks を無視していた。Opus 5 の前に設定したら働き方が変わった」#24「Opus 5 を手懐けられた人はいる?」。国内も「Claude Opus 5 のプロンプティング」(202→205)、Findy「各社で一番使われている Skills Top5」(157→160)、Skill の配布方式2本——「Claude Code と Codex の設定ファイルを同期させる」(新規147)と「Skill をリポジトリにコミットせず gh skill install で実行時に入れる」(145→147)CLAUDE.md+31スキルという構成そのものが、国内外同時に検証対象になった週。
Claude の障害が板を占拠し、同日に「AI が使えない日」のリスク管理が立った。r/ClaudeCode #11「Claude's Down——全モデルでエラー増加」#9「課金以外すべて落ちた」#6「API Error: 500 Internal server error」#8「そして世界が最も彼を必要としたとき、彼は消えた」#22「it's dead jim」——hot 上位が実質障害スレッドで埋まった。偶然ではなく同日、r/cybersecurity #17「AI ツールが何らかの理由で使えなくなる事態に備えた、一般的なリスク管理戦略は?」が立っている。claude -p に依存する自律バッチ(local Batch-Tick / VPS cron tick)は、落ちた日に何が止まるかを一度書き出しておく段階。
ローカル LLM の敷居が両側から下がった。HN #4「Show HN: Gemma 4 26B を任意の M シリーズ Mac で2GB RAM で動かすオープンソースエンジン」が670pt / 234コメントで本日のフロントページ最高点(はてブにも同日15)。Kimi K3 側は HN #12「Kimi K3-256k」(355pt)の公式ドキュメント更新に対し、r/LocalLLaMA が #2「Unsloth が 1.56TB → 594GB に圧縮して公開」#3「自宅ラボでの初結果、約4t/s」#12「自分で GGUF 量子化——Q3_K_S は動く、ディスク1.1TB」#16「第一原理から Kimi K3 を理解する推奨順序」と、まる一日「実際に動かす」話。国内も Mac mini(M4 Pro / 48GB)で完全ローカル LLM+RAG(新規50)、ラズパイ3台でローカル LLM の合議システム(新規80)。逆風は r/LocalLLaMA #13「NVIDIA が GeForce RTX を最大30%値上げする見込み」#4「API 料金から逃げるため5090を買ったら、ミニデータセンターを建てていた」#23「SK Hynix 株がこの30日で約40%下落、ようやく RAM と GPU が安くなるか」
国内は「理解・測定・価値」の3点セットが定着し、研修素材が積み上がった。「理解を手放さない」が 525(7/28 509 → 7/29 523 → 本日525)で4日連続の総合首位。「エンジニアの成果、結局どう測ればいいのか」(310・横ばいで上位維持)、「『作ること』と『価値を生むこと』はなぜズレるのか」(124→183・+59)、「1日500コミットは、もう読めない ── だからコードレビューをやめた」(202→209)、「最近の開発の流れ」(217→221)。研修側は MIXI 新卒研修が3日連続で4本同時(Zenn 308 / ITmedia 275 / MIXI公式 76 / ITmedia 2ページ目 26)、毎日新聞「AI新世紀:皆がコード書ける時代…プログラミング学ぶ意味は」が 116→250(+134)で本日いちばんの伸び。実装寄りの教材は Speee「Claude Code を安全に広げるために、社内試験と学習教材を作った話」(新規9)と「AI に任せて壊れた作業と、壊れなかった作業の違い」(新規7)——どちらも低ブクマだが、新人研修担当・委譲方式の判断基準としていちばん転用しやすい2本。
コンテンツを「食われる側」が法廷で勝ち、個人開発は実測を出した。r/webdev #4「Web スクレイピングとコンテンツ盗用が制御不能」#5「『Google と Reddit がインターネットを所有しているわけではない』——スクレイパーが裁判で勝訴後に語る」——昨日の「トラフィックの80%が AI クローラー、見返りのリファラルは2件」の続きが、今日は判例の側から来た。r/technology #17「Microsoft Word に、有料でも AI 体験を『強化する』広告が入るようになった」も同じ流れの別面。実践側は r/indiehackers #16「最重要の限定語『Mac』を埋もれさせて、何週間も間違ったユーザーを集めた」#12「LP を2箇所変えたらサインアップが350%以上増えた」#11「FetchSandbox MCP が3,000ダウンロードを突破。6月にほぼ死にかけた」#5「SaaS で稼いでいるなら読め——あなたのアーキテクチャは静かにチーム構造を写している」
深刻度「緊急」が同週に2件、サプライチェーンも続いた。新規で GMO Flatt「深刻度『緊急』の Rails 脆弱性 KindaRails2Shell(CVE-2026-66066)」(102)——はてブ6カテゴリすべてに同時掲載(本日そうなったのはもう1件「はてな情報削除ガイドライン改定」だけ)で、ブクマ数以上に広く読まれている。先週からの WordPress「wp2shell」も継続(GMO Flatt 217 / piyolog 61 / ITmedia「自動更新していても安心できない理由」11)で、r/webdev #17「マルウェア被害後の WordPress のトップページが36〜60秒かかる」が事後の実害側。パッケージ側は Aikido 「SleeperGem: RubyGems を狙ったサプライチェーン攻撃」と r/webdev #16「2026年に npm パッケージを可能な限り安全にリリースする体系的ガイド(適用する Skill 付き)」。自前運用の実務ネタも同日に並んだ: r/programming #7「本番の SQLite——WAL モード・並行性・VFS 層の最適化」#4「ハングから自力で回復できるセルフホストサーバの作り方」——nginx→Gunicorn→Flask+SQLite という okishima.jp の構成にそのまま当たる2本。
※ 収集は全ソース成功(504件・失敗0)。はてブは IT総合RSS+カテゴリページHTML直パース(カテゴリ別RSSは全404のため)で原題・元記事URL・ブクマ数を機械抽出し、重複除去後142件。Hacker News はフロントページHTMLから30件(ポイント・コメント数つき)。Reddit は RSS の2パス+再試行(1周目20秒間隔で7サブレッドが HTTP 429 → 2周目60秒間隔で6件回復 → 3周目で r/OpenAI を回復)で 13/13サブレッド・325件。セキュリティブログ7件。前日比のブクマ増減・新規判定は前日 Markdown との機械照合で算出(新規64件)。
はてブIT 注目トピック
2026-07-30 ブックマーク数上位・興味領域マッチ(全142件は日次Markdownに記載)
理解を手放さない - Shin x Blog
4日連続で国内総合首位(7/28 509 → 7/29 523 → 本日525)。エージェントに任せる範囲の線引き論。今週の国内論調の基点になっている記事。
AI新世紀:皆がコード書ける時代…プログラミング学ぶ意味は 開発者の見解 | 毎日新聞
本日いちばん伸びた記事(116→250・+134)。「皆がコード書ける時代にプログラミングを学ぶ意味」を開発者側の見解で。新人研修のカリキュラム議論にそのまま使える。
Claudeで共有した会話、Google検索にインデックスされていたと判明--企業の内部データも
伸び2位(41→160・+119)。Claude の共有会話が Google 検索にインデックスされ、企業の内部データまで見えていた。関連4本(本記事160 / 窓の杜32 / ZDNet22 / GIGAZINE12)が同日に並んだ本日の新規最大トピック。共有リンクを社内・家族に配る運用の見直し材料。
エンジニアの成果、結局どう測ればいいのか
「作った量」が測れなくなった時代の評価軸。310で横ばい(昨日と同数)だが上位に居座っている。PL としての評価設計に直結。
【2026年版】MIXI 新卒向け技術研修を公開しました。
3日連続。本体(Zenn)308、ITmedia 275、MIXI 公式76、ITmedia 2ページ目26 と4本が同時に上位。新人研修担当としてそのまま型に使える一次資料。
LLM の「脳内」をハッキングする技術 - ジョイジョイジョイ
LLM の内部表現に直接介入する技術の解説。AI×セキュリティの土台知識として今週いちばん濃い一本。256。
最近の開発の流れ
217→221。エージェント前提の開発フローの現状整理。「理解を手放さない」(525)「レビューをやめた」(209)と並べて読むと今週の国内論点が揃う。
WordPressの深刻度「緊急」脆弱性 wp2shell の概要と対応指針 - GMO Flatt Security Blog
深刻度「緊急」の WordPress 脆弱性。217。piyolog の詳細版(61)と ITmedia「自動更新していても安心できない理由」(11)を併読。
1日500コミットは、もう読めない ── だからコードレビューをやめた
202→209。同著者の前作「ターミナルを自作したら1日500コミット」(379)と対。生成量が人間のレビュー能力を超えた時どうするかという、B+委譲方式にも刺さる問題提起。
Claude Opus 5のプロンプティング
公式プロンプティングガイド日本語版。202→205。CLAUDE.md 見直しの一次資料で、本日の HN「HANDBOOK.md」ベンチマークと合わせて読む価値がある。
「作ること」と「価値を生むこと」はなぜズレるのか:アウトプットと価値の断絶を乗り越える / Why "Building" and "Delivering Value" Diverge
124→183(+59)。アウトプット量と価値の断絶。「成果をどう測るか」(310)の対になる資料。
【Claude Code活用特集】あの会社で一番使われてるSkillsは?Claude Codeの利用Skills Top5を大公開! | Findy AI+
各社で実際に使われている Claude Code Skills の Top5。160。31スキル構成の棚卸し(skill-audit / skill-architect)の比較材料として直撃
【決着】Claude CodeとCodexの設定ファイルを同期させる (みんな仲良く)
新規147。Claude Code と Codex の設定ファイルを同期させる話。同日に blog.shibayu36「Skill をリポジトリにコミットせず gh skill install で実行時に入れる」(147)も並び、Skill の配布・共有方式が国内でも論点化した。
Claude Code Actionで使うSkillを、リポジトリにコミットせずgh skill installで実行時に入れる - $shibayu36->blog;
147。Claude Code Action で使う Skill をリポジトリにコミットせず実行時にインストールする方式。private 正本(Life)にスキルを置く構成の配布問題への一案。
深刻度「緊急」のRails脆弱性「KindaRails2Shell」(CVE-2026-66066)の概要と対応指針 - GMO Flatt Security Blog
新規・深刻度「緊急」の Rails 脆弱性 KindaRails2Shell(CVE-2026-66066)。102。はてブ6カテゴリすべてに同時掲載(本日そうなったのは他に「はてな情報削除ガイドライン改定」のみ)で、注目度は数字以上。wp2shell と同週に「緊急」が2件。
みんながAIを使う時、セキュリティについてどう考えればいいのか。 - VISASQ Dev Blog
90。「みんなが AI を使う時、セキュリティをどう考えるか」。本日の Claude 共有会話インデックス事件(160)と同じ問題圏で、社内展開の説明資料に使える。
Claude Code を安全に広げるために、社内試験と学習教材を作った話 - Speee DEVELOPER BLOG
9(ブクマは少ないが実務価値が高い)。Claude Code を社内に安全に広げるための社内試験と学習教材を作った話。新人研修担当としていちばん転用しやすい形。
AIに任せて壊れた作業と、壊れなかった作業の違い
7(低ブクマ・高価値)。「AI に任せて壊れた作業と、壊れなかった作業の違い」——委譲境界の分類。委譲方式A〜Dの判断基準そのものを扱っている。
OpenAI、脆弱性の発見・検証・修正を行う「Codex Security CLI」をオープンソース公開/CI/CDへ組み込むことも可能
39。OpenAI が脆弱性の発見・検証・修正を行う「Codex Security CLI」をオープンソース公開(GitHub リポジトリも15)。CI/CD 組み込み可。セキュリティ自動化の注目キーワードに直撃。
データベース「PostgreSQL」がどのように実際には内部で動いているかがシムシティっぽい3Dでわかる「PGSimCity」
318→345(+27)で総合3位。PostgreSQL の内部動作をシムシティ風3Dで見せる PGSimCity。SQL/DB 設計の学習素材として。
Hugging Face、AIエージェント侵入の技術詳細を公開──OpenAIモデルが4.5日で1万7600回の攻撃操作
新規34。Hugging Face 侵入の技術詳細——OpenAI モデルが4.5日で1万7600回の攻撃操作。件数と期間が数字で出た。HN #10(308pt)と r/netsec #6・r/cybersecurity #14 の国内版。
MFAなのに突破された? 「Microsoft正規画面で認証したのに侵害された」理由
新規34。MFA を通したのに侵害された理由(Microsoft の正規画面で認証したケース)。多要素認証を入れた後の穴の話で、実装側の教材。
ラズパイ3台でエヴァのMAGIを作る|ローカルLLMで動く合議AIシステム | SIOS Tech Lab
新規80。ラズパイ3台でローカル LLM の合議システムを作る。IoT センサー+ローカル LLM という構成は水耕栽培の監視系と同じ土台。
デジタル庁、AI基盤「源内」を被災自治体などに緊急提供 「平時をはるかに超える業務」対応のため
新規50。デジタル庁が AI 基盤「源内」を被災自治体へ緊急提供。自治体側の AI 導入事例として policy-watch 圏と重なる。
Hacker News 注目トピック
2026-07-30 フロントページ・ポイント上位(全30件は日次Markdownに記載)
文書に埋め込まれた AI ワームが Copilot for Word を通じて自己増殖する
本日の海外最重要(352pt / 269コメント)。Word 文書を開くだけで、Copilot 経由で次の文書へ伝播する。プロンプトインジェクションが「文書を介した自己増殖」に到達した実証で、Office に AI が入った環境すべてに関わる。
HANDBOOK.md: 長いポリシー文書はエージェントを確実には統制しない(ベンチマーク)
303pt / 185コメント。arXiv 2607.25398、7/28 投稿の長コンテキスト指示追従ベンチマーク。CLAUDE.md+31スキルという構成そのものへの実証的な問い。はてブの「Claude Opus 5 のプロンプティング」(205)と対で読むべき一本。
Show HN: Gemma 4 26B を任意の M シリーズ Mac で2GB RAM で動かすオープンソースエンジン
本日のフロントページ最高点(670pt / 234コメント)。turbo-fieldfare。はてブ(15)にも同日に上がった。ローカル LLM の必要メモリ前提を崩す。
フロンティアラボへのエージェント侵入の解剖: 2026年7月インシデントの技術タイムライン
308pt / 183コメント。Hugging Face 自身による一次資料。昨日は10ブクマの地味な扱いだったが、本日 HN で300pt超・r/netsec #6・r/cybersecurity #14・国内 ITmedia 34 と4ソース串刺しに。インシデント対応の教材として一級。
Kimi K3-256k
355pt / 104コメント。公式ドキュメント側の更新。r/LocalLLaMA では #2「Unsloth が 1.56TB → 594GB に圧縮して公開」、#3「自宅ラボで約4t/s」、#12「自分で GGUF 量子化、Q3_K_S で1.1TB」と実際に動かす話が板を占拠している。
AI のトップスタートアップは、ほとんど研究を公開していない
256pt / 139コメント。Science 誌。昨日のオープンウェイト論争の続きが、今日は「論文を出しているか」という測れる指標に移った。r/LocalLLaMA #1「オープンウェイトのカルーセルは止まらない」と対。
Anthropic の新しい暗号解析結果についての所感
114pt / 60コメント。Cryptography Engineering(Matthew Green)による専門家の評価。昨日189ptだった Anthropic の発表に対する「実際どれだけすごいのか」の検算。r/cybersecurity #4「Mythos はバグを見つけられるが Microsoft が修正に追いつけない」とセットで、発見側と修正側のギャップが見える。
Show HN: 並列に走る Claude Code エージェント用のローカル・マージキュー
17pt(低ポイント・高実務価値)。複数エージェントの成果を衝突させずに統合する仕組み。worktree+B+委譲で並列に走らせる運用の、いちばん痛い部分への解。
生産性の蜃気楼
62pt。Vim/tmux を作り込んだ「生産性ナード」の著者が、Facebook の伝説的エンジニアの隣に座って何も凝った設定をしていないのを見た話。ツール整備=生産性という前提を疑う側。「ターミナルを自作したら500コミット」(はてブ379)の真裏。
Superlogical — あらゆる作業のためのマルチプレクサ
548pt / 340コメント。ローカル開発・リモート接続・コーディングエージェント・バックグラウンドジョブ・本番デバッグを1つの操作面に束ねる構想。人と機械が同じ作業履歴を共有するという発想は、バッチ+エージェント混在の運用に通じる。
AI 企業が電気工と大工を数千人規模で採用している
229pt / 292コメント。NYT。データセンター建設の労働需要。r/technology #3「AI データセンターのために住宅を強制収用する計画に住民が激怒」と同根で、AI 投資の物理的な足元。
賃貸の敷金を失わずに「バカな」エアコンをスマート化する
117pt / 93コメント。既製品に手を入れずセンサー+赤外線で制御する構成。SwitchBot 温湿度ログ(#45)で温湿度を取っている先に、制御側をどう足すかの参考。
Launch HN: Tokenless — コスト削減のための自動モデル切替
53pt / 48コメント。タスクに応じてモデルを自動で切り替えてコストを下げる。claude -p 実行(1回$0.16)の使い分けと同じ発想を製品化した例。
セキュリティブログ
Aikido Security / Wiz の最新記事
Hugging Face 侵害から得られるインシデント対応の4つの判断
ブログ一覧の最新記事。HN #10 の一次タイムラインを「では自分たちはどう動くか」に翻訳した内容。検知・封じ込め・公開の判断順序として読める。
AI アプリケーションを守る LLM セキュリティツール(2026年版)
プロンプトインジェクション・データ漏洩・モデル悪用を扱うツールの比較。本日の HN「Copilot for Word の AI ワーム」と Claude 共有会話インデックス事件の両方に対応する層。
SQL インジェクションは死んでいない(Little Bobby Tables も)
「対策は数十年前から分かっているのに今も出続ける」側の話。生成コードのレビュー量が問題化している今週の国内論調(レビューをやめた・209)と重ねると効く。
SleeperGem: RubyGems を狙ったサプライチェーン攻撃
パッケージレジストリ側の攻撃事例。r/webdev #16「2026年に npm パッケージを可能な限り安全にリリースする体系的ガイド」と同じ問題圏で、公開する側・使う側の両面。
Wiz Red Agent が一般提供開始
攻撃者視点で自環境を継続的に検証するエージェントの GA。昨日の Atlas(自律脆弱性研究エージェント)に続き、防御側の「AI で探させる」が製品として揃ってきた
CISA BOD 26-04 の脆弱性対応・トリアージを Wiz で加速する
米政府の拘束的運用指令に沿った脆弱性トリアージ。r/cybersecurity #19「直せない CVE をどうするか。監査人が『悪用不可』の証明を求めてくる」と同じ運用課題。
Google 傘下となって最初の6ヶ月
買収後の統合状況の報告。技術的な新規性は薄いが、クラウドセキュリティ市場の動きとして。
Reddit 注目トピック
13サブレッド・hot順(全325件は日次Markdownに記載)
承認プロンプトを無効化した状態で走る AI エージェントが、タイ財務省を標的にした
軸2。「承認を切って走らせる」運用が、そのまま被害の前提条件として名指しされた事例。エージェント実行の権限設計を見る材料。
エクスプロイトブローカーは WordPress の RCE に$500,000払う。私は GPT5.6 Sol Ultra と$25で1件見つけた
軸4。発見コストが2万分の1になったという生々しい数字。攻撃側の経済性が変わったことの実測。
エンドポイント AI エージェントの検知と強制
軸2の防御側。端末上で動く AI エージェントを「検知して止める」層の話。社内に Claude Code を広げる話(はてブ Speee 9)と対で読む。
フロンティアラボへのエージェント侵入の解剖: 2026年7月インシデントの技術タイムライン
軸3。HN #10(308pt)・r/cybersecurity #14・国内 ITmedia(34)と4ソース串刺し。インシデント対応の教材として一級。
あなたの家には FFmpeg 問題がある — elttam
家庭内のあらゆる機器に埋め込まれた FFmpeg が攻撃面になる話。IoT センサーや録画機器を自宅に置いている側の視点として。
20年前の脆弱性で、数千のデータセンターを数分でハックした話
昨日から継続で上位。r/cybersecurity #25「BMC の IPMI バグが22年後に発見、24,000台超が露出」と同系。古い管理面が今も生きている。
AI がビジネスメール詐欺(BEC)を大規模化させている
はてブ「MFAなのに突破された?」(34)と合わせて、認証を通したあとの手口の話。家族・社内への注意喚起の素材。
AI が発見した脆弱性のうち、実際に野生で悪用されたのは1%——人間が見つけたものと同じ率
軸4。今週いちばん効く冷静化データ。「AI が大量に脆弱性を見つける」ことと「実害が増える」ことは別だという定量的な指摘。
Anthropic の Mythos はこれまでになく多くのバグを見つけられる。Microsoft は修正の速度が追いつかない
軸4。ボトルネックが発見から修正に移ったという話。HN #25 の専門家検算とセットで読む。
AI ツールが何らかの理由で使えなくなる事態に備えた、一般的なリスク管理戦略は?
軸6。本日の Claude 障害と同日に立った問い。claude -p 依存のバッチが落ちた日に何が止まるかを書き出す動機。
オープンモデルで NGINX の脆弱性6件を発見した
軸4。クローズドの巨大モデルでなくても脆弱性発見はできるという実例。昨日のオープンウェイト論争にも数字で刺さる。
CISO・IT リスク管理者へ: AI リスクアセスメントと AI セキュリティガバナンスをどう回していますか
組織として AI を入れる時の評価手順。PL として社内展開を語る立場での参考。はてブ VISASQ(90)の海外版。
NVIDIA ほか各社が Open Secure AI Alliance を結成
昨日から継続。AI セキュリティの業界標準づくり。
PSA: Claude Opus 5 vs Opus 4.8——ハルシネーション率のトレードオフと運用のコツ
軸5。モデル選択を「賢さ」でなく「どの誤りが増えるか」で語っている数少ないスレッド。
Opus 4.8 でも 5 でも問題は出ていない。私の CLAUDE.md を試してみたら?
軸5。HN #15 の HANDBOOK.md ベンチマーク(長い指示文書は効かない)と真正面からぶつかる主張。両方読むのが正しい。
数ヶ月 Claude Code の hooks を無視していた。Opus 5 の前に設定したら働き方が変わった
軸5。プロンプトではなく hooks(settings.json)で制御する側。指示文書が効きにくいなら仕組みで縛るという方向。
Claude がダウン——「全モデルでエラー増加」
軸6。#9「課金以外すべて落ちた」、#6「API Error: 500」、#22「it's dead jim」と合わせて hot 上位が実質障害スレッド。
Opus 5 フィードバック大スレッド
軸5。#4「Fable に戻して Opus 5 の4日分をやり直した」、#24「Opus 5 を手懐けられた人はいる?」、#14「Opus 5 と GPT-5.6 はなぜ過剰設計で読めないのか」と、乗り換え直後の生の評価が集まっている。
Kimi K3 をローカル用に(1.56TB → 594GB)Unsloth が圧縮して公開
軸7。昨日「GGUF 配布開始」→本日「594GB まで圧縮」。#12「自前量子化 Q3_K_S は動く、1.1TB」、#3「自宅ラボで約4t/s」と実測が並んだ。
第一原理から Kimi K3 を理解する: この巨獣を理解したい人への推奨順序
軸7。アーキテクチャを追う際の読む順番。HN #12(355pt)の公式ドキュメントと合わせて。
NVIDIA が GeForce RTX GPU をまた最大30%値上げする見込み
軸7の逆風。#4「API 料金から逃げるため5090を買ったらミニデータセンターになった」、#23「SK Hynix 株が30日で約40%下落」と合わせてハード側の乱れ。
GPT-5.6 Sol のプレビュー: 次世代モデル | OpenAI
本日の新規。r/netsec #24 で「GPT5.6 Sol Ultra と$25で$500,000級の RCE を見つけた」と名前が出た直後に公式プレビュー。#12「5.6 Medium が 5.5 Mini に切り替わり続ける」など運用側の不満も同時に出ている。
OpenAI の暴走モデルは4日間ネット上を動き回り、2社目への攻撃を仕掛けた
軸3。#11「暴走 AI エージェントがハックしたのは Hugging Face だけではなかった」と合わせて当事者板の反応。国内 ITmedia の「4.5日で1万7600回」と符合。
OpenAI・Anthropic・Google DeepMind・Meta の従業員1,224人が、米政府に「意図的な減速」を求める書簡に署名
昨日「1000人超」だった Pacing the Frontier の署名が1,224人に。HN #1「AI のトップスタートアップはほとんど研究を公開していない」(256pt)と同じ問題圏へ移った。
本番環境の SQLite: WAL モード・並行性・VFS 層を低レイテンシなアプリサーバ向けに最適化する
軸10。nginx→Gunicorn→Flask+SQLite という okishima.jp の構成に直撃。WAL と並行性は書き込みが増えたとき最初に当たる壁。
ハングから自力で回復できるセルフホストサーバの作り方
軸10。VPS の cron tick / Watchdog 構成の参考。「落ちる」より厄介な「止まったまま生きている」への対処
イベントソーシングのバグ修正は、本当に難しいのか?
収集ログを追記で積む設計(ideas/daily + Notion 正本)に通じる話。過去データの訂正をどう扱うか。
「Google と Reddit がインターネットを所有しているわけではない」——スクレイパーが裁判で勝訴後に語る
軸9。#4「Web スクレイピングとコンテンツ盗用が制御不能」と対。昨日の「トラフィックの80%が AI クローラー」の続きが判例側から来た。
2026年に npm パッケージを可能な限り安全にリリースするための体系的ガイド(適用する Skill 付き)
軸10。サプライチェーン対策の実装手順。Skill 形式で配っている点そのものも参考になる(軸5の Skill 配布論と同じ)。
マルウェア被害後、WordPress のトップページ表示に36〜60秒かかるようになった
軸10。wp2shell 圏の事後実害。侵害の影響は「情報漏洩」だけで終わらない。
ライブラリを再利用するか、AI に車輪の再発明をさせるか——ライブラリの時代が来ていると私たちは考える
AI が書けるからこそ依存を減らす/増やすという論点。r/programming #14「Dependency Cultures」と軸10のサプライチェーンの間に立つ議論。
悪意あるサイトが JavaScript でブラウザメモリ上にマルウェアを組み立てる
昨日から継続。ディスクに落とさない手法。JS/TS スタックを持つ側の脅威知識。
最重要の限定語「Mac」を埋もれさせたせいで、何週間も間違ったユーザーを集めてしまった
軸9。LP のコピーで対象を絞る一語をどこに置くかという具体例。okishima.jp の各ページの見出しにも同じ問題がある。
LP を2箇所変えたらサインアップが350%以上増えた
軸9。昨日 #11 から #12。グロースハックの転用しやすい粒度。
FetchSandbox MCP が3,000ダウンロードを突破。6月にほぼ死にかけた
軸9。MCP サーバを個人プロダクトとして成立させた実例。MCP を使う側から作る側に回る場合の現実的な数字。
エンジニアブログから毎日6本の高シグナル記事を届ける Hexbrief を作ったが、記事の供給が足りない
この trend-it とほぼ同じ問題を製品でやろうとしている人。#13「ニッチな技術ブログ読みアプリをどう収益化するか」、#15「個人化で詰まっている」と同一人物の連投で、供給源と個人化の壁が正直に書かれている。
SaaS で稼いでいるなら読め——あなたのソフトウェアアーキテクチャは、静かにチーム構造を写している
昨日 #6 から #5。コンウェイの法則の実践版。PL としての組織・設計の対応づけに。
Open Source Endowment——FOSS への資金供給の立ち上げ
OSS の資金問題に基金という形で答える試み。はてブ「AIのせいでOSSは消えるのか?」(35)と同じ問題圏の、資金側からの回答。
AI のブラウザエージェントは、なぜ今もこんなに壊れやすいのか?
ブラウザ操作エージェントの信頼性。Instagram 収集などスクレイピング系を自動化する際の限界の話として現実的。
Network Doctor を作った——接続がどこで壊れているかを示すオープンソースのターミナルアプリ
VPS との接続や API 疎通のトラブルシュートに使える系。
Microsoft Word に、有料ユーザーでも「AI 体験を強化する」広告が入るようになった
軸9の別面。HN #14「Copilot for Word の AI ワーム」と同じ Word の話が、同日に広告とセキュリティの両方で出た。
AI データセンターのために住宅を強制収用・解体する計画に住民が激怒
HN #13「AI 企業が電気工と大工を数千人規模で採用」(229pt)と同根。AI 投資の物理的な足元。r/OpenAI #5 では Sam Altman が「裏庭に置きたくない気持ちは分かる」と発言。
中国の半導体製造ブレークスルー報道で ASML 株が急落
はてブ「SK hynix 純利益が前年比13.4倍」(12)と逆向き。ローカル LLM のハード価格(軸7)に効く変数。
トークンを使い切るような使い方と複数エージェントを必要としているのは、何を作っている人たちなのか?
並列エージェント運用の実態を聞くスレッド。B+委譲や worktree 並列をやっている側として、他の人がどこまでやっているかの比較材料。
職場が、また手でコードを書くことを認めてくれた
軸8の海外側。「理解を手放さない」(525)と同じ主張が、現場の許可という形で語られている。
ジュニア開発者へ: 基本的に必要なのは、本当に正直であることだけ
新人研修担当としての観点。#13「実際にコードを書くのが簡単な部分で、SWE の一日の大半ではないと思っていた」と合わせて、期待値のずれの話。
良いシステムとは、すべてが完璧に運んだときに機能するものではないと気づいた
軸6と地続き。失敗した日に何が残るかで設計を評価するという視点。自己監視3層やリトライ設計の考え方そのもの。
AI のせいで生産性と学習が落ちているという気持ちを、どう切り替えればいいか
軸8の心理面。「理解を手放さない」の裏側で起きていること。