AI

Google、AI生成広告の開示機能を全カテゴリに拡大

Googleが、広告のAI利用を開示する機能を選挙広告から検索・YouTube・Discoverの全カテゴリへ拡大しました。検証は広告主の自己申告に依存しており、実効性にはなお課題が残っています。
AI

Hugging Face CEO語る、企業がAPI課金を離れる理由

Hugging FaceのCEOが、企業がAPI課金から自社運用のオープンソースモデルへ移行する傾向を語りました。同社は現在、フォーチュン500企業の約半数が利用するインフラに成長しています。
AI

OpenAI新モデル「Sol」政府審査に透明性欠如の指摘

OpenAIが公開した新モデル「Sol」は政府関係者への事前確認を経たとされますが、審査基準や手続きは非公開のままです。Anthropicの「Fable」との扱いの違いも波紋を広げています。
AI

新指標PredicateLongBench、長文脈LLMの限界を可視化

研究者2名が発表した新ベンチマークPredicateLongBenchは、条件判定の難易度を段階的に上げると最先端LLMでも正答率が明確に落ち込むことを示し、LLM審査員に頼らない客観的な採点方式を採用しています。
AI

OpenAI、ChatGPTを家族向けに拡充 専任PM採用へ

OpenAIが家族・保護者や高齢者向け体験を担う専任プロダクトマネージャーの採用を始めました。35歳以上の利用者は1年で31%まで増え、子どものAI利用への安全対策も新たな課題となっています。
AI

ボコ・ハラム、複数AIチャットボットを作戦運営に活用

ケンブリッジ大学の調査で、テロ組織ボコ・ハラムがChatGPTなど複数のAIを作戦立案から振り返りまで幅広く使っている実態が判明しました。
AI

Meta、AIコーディング新モデルMuse Spark 1.1公開

Metaがエージェント型コーディングモデルMuse Spark 1.1を発表しました。大規模なコード移行を得意とし、価格はAnthropicやOpenAIの同種製品に近い水準です。
AI

Apple、OpenAIを提訴 元社員通じ機密流出と主張

AppleがOpenAIを営業秘密盗用で提訴しました。元Apple社員2人を通じ、未発表デバイスの設計情報が流出した疑いが背景にあります。
AI

OpenAI、GPT-5.6発表 3モデルでコード効率54%改善

OpenAIがGPT-5.6ファミリーを発表。上位モデルSolはコーディング指数で新記録を達成し、出力トークンは競合の半分以下に抑えています。
AI

LLM審査員の信頼性を実測、モデル刷新でも精度不安定

AIに評価させるLLM-as-Judge手法で、審査役モデルを新版に替えても評価精度が一様に向上しないと論文が実証しました。バイアス検証と監査記録の必要性を指摘しています。