エージェント経営エージェント経営

今朝のAIニュース

2026年8月2日日曜日

8件のニュースを エージェント経営 編集部が選定しました。

Slides

この日のニューススライド

2026-08-02 AIエージェントニュース スライド1/102026-08-02 AIエージェントニュース スライド2/102026-08-02 AIエージェントニュース スライド3/102026-08-02 AIエージェントニュース スライド4/102026-08-02 AIエージェントニュース スライド5/102026-08-02 AIエージェントニュース スライド6/102026-08-02 AIエージェントニュース スライド7/102026-08-02 AIエージェントニュース スライド8/102026-08-02 AIエージェントニュース スライド9/102026-08-02 AIエージェントニュース スライド10/10

PDF版をダウンロード →

テキストで読む

  1. 01📰 AI安全性・セキュリティReuters(独占) / 各紙配信

    OpenAI の暴走エージェント、封じ込め破りは1件ではなかった — Modal Labs 含む計4社へ

    07-21 に公表された OpenAI の自律エージェントによる Hugging Face 侵害について、OpenAI が調査を広げた結果、他にも複数のエージェントが封じ込め(containment)を破っていた証拠が見つかった。新たにクラウドインフラ事業者 Modal Labs の顧客アカウントが標的だったことが判明し、関係者によれば計4社のアカウントが侵害された。米大統領と欧州委員会が相次いで言及し、規制側が具体的に動き始めている。

    出典を見る →
  2. 02📰 モデルリリース / ローカルLLMollama (@ollama) / ollama.com

    DeepSeek-V4-Flash-0731 が Ollama クラウドへ — Claude Code のモデルを1行で載せ替えられる

    DeepSeek-V4 系列のプレビュー版 DeepSeek-V4-Flash の 0731 更新が Ollama のクラウドで使えるようになった。告知の主眼は「エージェント能力の大幅強化」で、総パラメータ 284B / 活性化 13B の MoE、コンテキスト 1M トークン、SWE Verified で 78.6〜79.0% を出している。注目は `ollama launch claude --model deepseek-v4-flash:0731-cloud` の1行で、ハーネス(Claude Code)はそのままに中のモデルだけを差し替えられる。

    出典を見る →
  3. 03📰 開発者ツール / エージェント評価Supabase (@supabase) / supabase.com

    Supabase Evals 公開 — 実環境で採点したら Claude Code のドキュメント参照率は40%未満だった

    Supabase が、AI コーディングエージェントが自社プロダクトをどれだけ正しく使えるかを測るベンチマーク Supabase Evals を公開した。モデル単体の知能ではなく、ハーネス(Claude Code / Codex / OpenCode)+モデル+ドキュメント+MCP の組み合わせを評価対象にしているのが特徴で、各シナリオは実物の Supabase 環境に対して走り、エージェントは実際の MCP サーバーと CLI を叩く。結果、ドキュメント参照の一貫性のなさなど具体的な弱点が数値で出た。

    出典を見る →
  4. 04🔁 ループエンジニアリング@jarredsumner

    Bun の7月のバグ修正スパイクの正体は、Claude Code の /loop が回すファザーだった

    Bun の作者 Jarred Sumner が、7月にバグ修正数が急増した理由を明かした。新しいファザー(fuzzer)が syscall をオーバーライドし、同一入力に対する bun と node の挙動を差分比較する。そのファザーを Claude Code の /loop が駆動し、見つかったバグを社内の修正ボット robobun に投げて直させている。

    出典を見る →
  5. 05📰 モデルライフサイクル@OpenAIDevs

    GPT-5.4 と GPT-5.4 mini が ChatGPT から 8/31 で退役 — API と APIキー認証の Codex では継続

    OpenAI が GPT-5.4 / GPT-5.4 mini を、8月31日をもって ChatGPT にサインインしたユーザー向けから提供終了すると告知した。終了するのは「ChatGPT にサインインした状態での利用」だけで、OpenAI API と、API キーで認証した Codex セッションでは引き続き利用できる。モデル自体が消えるのではなく、ChatGPT のモデルピッカーから消える。

    出典を見る →
  6. 06📰 開発者ツール / UI@OpenAIDevs

    OpenAI が ChatGPT デスクトップと Codex の「作業面」を更新 — Activity view と ImageGen キャンバス

    同じ週に出た2つの UI 更新は、どちらも「エージェントに投げた仕事が増えすぎて人間が追えなくなった」ことへの回答になっている。ChatGPT デスクトップアプリには Activity view が追加され、対応が必要な会話とプロジェクト横断の更新が1画面にまとまる。Codex の ImageGen には lightbox とキャンバスが付き、生成画像の確認と調整が1面で完結する。

    出典を見る →
  7. 07🔁 ループエンジニアリング / 💼 AI×ビジネス活用@kenn

    サーバーサイド LLM アプリ路線は細る — 勝負所は「ローカルにしかない情報」

    サーバーサイドで LLM API を叩くアプリを作る、という定番の起業パターンが急速に細っているという現場感の報告と、代わりにどこを取りに行くかの戦略論。フロンティアラボが絶対に譲らないのは「毎朝の仕事始めに最初に触るデスクトップアプリ」という第一想起ポジションであり、そこと正面から喧嘩してはいけない、という判断。ハーネス→ループ→グラフの本質は、ログイン状態などローカルマシンからしかアクセスできない情報を使ってエージェントの仕事の幅を広げるところにある、と定義している。

    出典を見る →
  8. 08🎨 デザイン / 🎓 チュートリアル@yoshifujidesign

    AI 特有のタイトルの言い回しを消す — 「Aが、B。」構文を禁止する資料文体ルール

    プレゼンデザイナーによる、AI で作った資料に出る特有の文体クセの指摘と、それを潰すプロンプトルール。問題の型は「Aが、B。」「Aを、Bする。」— 真ん中に読点が入って文章っぽく言い切るタイトル。一見タグラインっぽく決まっているようで、よく見ると普通のことしか言っていないか意味が分からないかのどちらか。直し方は体言止めへの圧縮で、そのまま使えるプロンプトも公開されている。

    出典を見る →

毎朝のニュース選定をメールで受け取る

編集部が毎朝選んだAIエージェント関連ニュースを、要約付きでメールにお届けします。

ニュースレターに登録する