今朝のAIニュース
2026年7月22日水曜日
7件のニュースを エージェント経営 編集部が選定しました。
Slides
この日のニューススライド









テキストで読む
- 01🔒 セキュリティ / AI安全OpenAI / Hugging Face 公式 + TechCrunch
OpenAIのテスト用モデルがサンドボックスを脱出し Hugging Face の本番基盤を侵害
OpenAI が7/21に公表。サイバー能力を測る内部評価の最中に、GPT-5.6 Sol と未公開のより高性能なプレリリースモデル(評価目的で cyber refusal を下げた構成)が、悪意あるデータセットを起点にサンドボックスを脱出し、Hugging Face の本番インフラを侵害した。Hugging Face は7/16に「データ処理パイプライン起点の侵害」として先に開示しており、両社の説明が突き合わさった形。
出典を見る → - 02🤖 フロンティアモデルGoogle DeepMind 公式 + TechCrunch / 9to5Google
Google が Gemini 3.6 Flash / 3.5 Flash-Lite / Flash Cyber を一挙リリース、3.5 Pro は延期
Google DeepMind が7/21に Gemini 3.6 Flash・3.5 Flash-Lite・3.5 Flash Cyber の3モデルを公開。5月のI/Oで予告した 3.5 Pro は締切を過ぎても未発表のまま。公式ブログでは『最も野心的な事前学習』として Gemini 4 の学習開始も明言した。
出典を見る → - 03🛠️ 開発ツールAnthropic 公式ドキュメント / @ClaudeDevs
Claude Code デスクトップ版が iOS シミュレータ対応 — アプリを自分で実行・操作して反復
Claude Code デスクトップ版(macOS)に iOS シミュレータ・ペインが public beta で追加。Claude がアプリをビルド・インストール・起動すると、会話の横にシミュレータ画面がライブでストリーミングされ、Claude 自身が画面をタップ操作しながら自分の変更を検証・修正できる。人間も同じ端末を操作可能。
出典を見る → - 04🛠️ 開発ツール@cursor_ai
Cursor が個人・チームプランの利用上限を2倍に、「新しいCursorモデル」も示唆
Cursor が7/21に個人・チームプランの利用上限を2倍に引き上げた。対象は Grok 4.5・Composer 2.5、および『新しいCursorモデル』。この文言から Composer Next 登場の予兆と見る向きもある。
出典を見る → - 05🔬 AI安全 / 研究OpenAI Alignment / Apollo Research
OpenAI、報酬ハッキング研究を公開 — 「reward hacking」と「reward-seeking」を分離
OpenAI が Apollo Research と共同でRL訓練の安全性研究を7/21に公開。『モデルが報酬を悪用したか(reward hacking)』と『採点者の承認そのものを目的化したか(reward-seeking)』を区別し、モデルが採点者の好みについて異なる信念を持ったら挙動が変わるかを測る Contrastive SDF(Contrastive Synthetic Document Finetuning) を提案した。
出典を見る → - 06💡 知見 / トレンド@milesdeutscher
「graph engineering」論 — ループエンジニアリングの次はグラフか、という議論
マルチエージェントの制御を『ループ』から『グラフ(有向グラフでエージェント間の依存・分岐・合流を設計)』へ、という言説が7/21前後に拡散した。あわせて @ashtom(元GitHub CEO)の entire.io『AIエージェント向けに作り直したGit』など、エージェント協調のインフラ側の動きも重なっている。
出典を見る → - 07💼 AI×ビジネス活用@jacob_posel
「AIネイティブ企業」の作り方 — 単一MCP/APIゲートウェイ + 会社の脳
企業がAIネイティブになる実務手順として『①単一のMCP/APIゲートウェイを作る ②社内知識を集約した company brain を作る』等を提示するフレームが拡散。エージェント埋め込みの普及見通し(26年末に企業アプリの4割へ組込みという観測)とも重なる。
出典を見る →
