AI

Anthropicが推論フック発表、Claudeへの入力を事前検査

Anthropicは2026年8月5日、Claude Enterprise向けに「推論フック」をベータ公開しました。企業のセキュリティサーバーが5秒以内でプロンプトを許可・拒否判定し、機密情報の流出をモデル到達前に防げます。
AI

MirageBenchが示すLLMの個人情報捏造41.6%の実態

研究チームが150種のペルソナと12個のLLMを使いMirageBenchで検証したところ、平均41.6%のユーザー属性推測が根拠のない捏造と判明しました。モデルの自信度は誤りの多さと逆相関しており、自己申告への過信の危うさを示しています。
AI

Hark、ブラウザ操作AI「Handoff」プレビュー公開

Hark社が公式APIなしでTargetやWalmartを操作する自律型ブラウザエージェント「Handoff」を公開しました。あいまいな指示にも対応し、正式リリースは2026年夏の終わりごろを予定しています。
AI

TIME誌がAIクローラーに広告入り別ページ配信、TollBit採用

米TIME誌が人間とAIクローラーに別のサイトを配信し、AI向けページには人間に見えない広告を挿入していることが判明しました。仕組みを支えるTollBitは導入サイト数が3000超、ボット課金の採用は1年で730%増えています。
AI

Rust公式、LLM生成PRに「ai-assisted」ラベル義務化

Rustコアチームは2026年8月5日、rust-lang/rustへのLLM生成PRに開示ラベルと専用Zulipチャンネルへの自動投稿を義務化しました。トレイトシステムなど健全性に関わる領域は利用不可とされています。
AI

Hassabis氏、DeepMind会長へ Dean氏27年で退社

Google DeepMindのHassabis氏が会長職に退き、Alphabet新設のチーフサイエンティストに就任しました。日常業務はKavukcuoglu氏がSVPとして引き継ぎ、Gemini開発体制も刷新されます。
AI

マルチタスク学習でSFTは衝突、RLは共存すると論文が実証

論文「SFT Conflicts, RL Coexists」は、SFTがマルチタスク学習でタスク衝突を起こす一方、RLは勾配がほぼ直交し性能劣化が起きにくいと解明し、新手法Parallel-RLを提案しています。
AI

UNAM入試のAI監督が破綻、受験者5.8万人が再試験に

メキシコ最大の大学UNAMが実施した初の完全リモート入試で、AI監督システムをすり抜けた不正が横行しました。専門家は受験者の約半数が不正をした可能性を指摘し、5.8万人が対面での再試験を強いられています。
AI

Flyte 2 GA公開、PythonのままAIエージェント基盤に

Union.aiはオープンソースのワークフロー基盤Flyte 2を正式公開しました。Pythonのコードのまま実行時に分岐・ループするAIエージェント処理を、障害発生時に自動復旧させる耐障害ランタイムを実装しています。
AI

Apple対OpenAI、機密データ持ち出し疑惑さらに拡大

Appleは7月に提訴したOpenAIへの機密技術持ち出し訴訟で、新たに11人の元従業員が関与した疑いがあると裁判所に追加提出しました。元チーフハードウェア責任者タン・タン氏らを巡る対立が続いています。