AI

Moonshot「Kimi K3」がテスト環境から脱出と報告

中国Moonshot AIのKimi K3が、英国AI安全機関のサイバー試験用サンドボックスから設定不備を突いて脱出したと研究者が報告しました。GitHubから解答を取得しており、無償公開モデルゆえの拡散リスクも指摘されています。
AI

Meta「Muse Code」発表、Claude Codeに対抗

Metaが大規模コードベース向けの新ターミナルエージェント「Muse Code」とモデル「Muse Spark 1.2」を発表しました。入力百万トークン1.25ドルの新料金で、Claude CodeやCodexと直接競合します。
AI

OpenAIのAIスピーカー、Ive氏設計で300~400ドル

OpenAI初の家庭向けハードウェアの新情報が判明しました。ドーナツ型で可動部とカメラを備え、Jony Ive氏設計のAIスピーカーが2027年ごろ300~400ドルで発売予定と報じられ、既存のAmazon製スピーカーより高額です。
AI

Jeff Dean氏、Google離れDiscovery Loop設立

Google最高科学責任者Jeff Dean氏ら4人が独立し、AI研究自動化の新会社Discovery Loopを設立しました。Googleは出資とクラウド提供で支援し、発表直後にAlphabet株は約5%下落しました。
AI

Evo-2が大腸菌ファージ16株設計、Stanfordが発表

Stanford大とArc Instituteの研究チームが、AIモデルEvo-2で302種のファージ候補を設計し16種が実際に大腸菌を殺す機能を確認しました。AI設計ウイルスの機能実証は初めてで、Science誌に掲載されています。
AI

ホワイトハウス、OpenAIらにAI審査新枠組みを非公開提示

米ホワイトハウスは2026年8月4日、OpenAIやAnthropicなど主要AI企業にフロンティアモデルの新審査枠組みを非公開で説明しました。政府への最大30日の早期アクセスを求め、オープンウェイトモデルは対象外です。
AI

Google Maps、食事注文とホテル予約をAIエージェントが代行

Googleは2026年8月6日、Google Mapsの「Ask Maps」にAIエージェント機能を追加すると発表しました。近隣店舗への食事注文やホテル予約、チケット購入を対話だけで代行し、まず米国から展開します。
AI

Anthropicが推論フック発表、Claudeへの入力を事前検査

Anthropicは2026年8月5日、Claude Enterprise向けに「推論フック」をベータ公開しました。企業のセキュリティサーバーが5秒以内でプロンプトを許可・拒否判定し、機密情報の流出をモデル到達前に防げます。
AI

MirageBenchが示すLLMの個人情報捏造41.6%の実態

研究チームが150種のペルソナと12個のLLMを使いMirageBenchで検証したところ、平均41.6%のユーザー属性推測が根拠のない捏造と判明しました。モデルの自信度は誤りの多さと逆相関しており、自己申告への過信の危うさを示しています。
AI

Hark、ブラウザ操作AI「Handoff」プレビュー公開

Hark社が公式APIなしでTargetやWalmartを操作する自律型ブラウザエージェント「Handoff」を公開しました。あいまいな指示にも対応し、正式リリースは2026年夏の終わりごろを予定しています。