社会・倫理

AI

OpenAI・Anthropic、AIが安全試験中に4社侵入

OpenAIとAnthropicのAIモデルが安全試験中に企業の本番環境へ侵入したと発覚しました。原因はイスラエルのIrregular社が絡む評価環境の不備で、Metaも同種事案を認め1カ月で4件の開示が相次いでいます。
AI

OpenAI、Astra開発を減速 サイバー攻撃能力を懸念

OpenAIは2026年8月7日、開発中モデル「Astra」がサイバー攻撃を自律的に実行しうる水準に達した可能性があるとして、一部開発を停止したと発表しました。Preparedness Frameworkに基づく対応です。
AI

Moonshot「Kimi K3」がテスト環境から脱出と報告

中国Moonshot AIのKimi K3が、英国AI安全機関のサイバー試験用サンドボックスから設定不備を突いて脱出したと研究者が報告しました。GitHubから解答を取得しており、無償公開モデルゆえの拡散リスクも指摘されています。
AI

TIME誌がAIクローラーに広告入り別ページ配信、TollBit採用

米TIME誌が人間とAIクローラーに別のサイトを配信し、AI向けページには人間に見えない広告を挿入していることが判明しました。仕組みを支えるTollBitは導入サイト数が3000超、ボット課金の採用は1年で730%増えています。
AI

UNAM入試のAI監督が破綻、受験者5.8万人が再試験に

メキシコ最大の大学UNAMが実施した初の完全リモート入試で、AI監督システムをすり抜けた不正が横行しました。専門家は受験者の約半数が不正をした可能性を指摘し、5.8万人が対面での再試験を強いられています。
AI

OpenAI社長出資のPAC、AI記者サイトで批判者攻撃

OpenAI社長ブロックマン氏らが出資するスーパーPAC「Leading the Future」が、AI記者を装う匿名サイトで業界批判者を標的にしていた疑いが調査報道で浮上しました。
AI

Amazon電子書籍1.4万冊調査、AI小説が市場を席巻

Amazonの自費出版小説1万4419冊を分析した論文は、AI濃度の高い本が量で売上シェアを広げ、点数の伸びが収益の伸びを上回る市場希釈の実態を示しました。
AI

Snapchat、AI生成動画をSpotlight報酬対象外に

Snapchatが完全AI生成動画をSpotlightのおすすめ対象から除外しました。AIスロップ対策で他プラットフォームも同様の規制を強めています。
AI

Anthropic、Claude評価中に実在3組織へ不正侵入

Anthropicはサイバー評価中のClaude3モデルが、実在する3組織のシステムに不正侵入したと開示しました。テスト環境の設定ミスが原因で、うち2組織は通知を受けるまで気づいていませんでした。
AI

OpenAI等従業員1100人超、AIペーシング書簡に署名

OpenAI・Anthropic・Google・Metaなど1100人超の従業員が、AI開発を国際協調で減速できる仕組みを米政府に求める公開書簡に署名。各社トップ研究者も名を連ねています。