AI

Salesforce、業務特化AIエージェント7種を一挙投入

Salesforceが営業や顧客対応、社内業務など職務ごとに特化したAIエージェント7種を一挙に発表しました。6種はすでに一般提供中で、長時間実行型の新エージェント「Hunter」は11月に提供予定です。
AI

オバマ元大統領、民主党にAI規制の具体的な枠組み整備を要求

オバマ元大統領が民主党に、AI政策を最優先課題に据え規制の具体的な枠組みを整えるよう呼びかけました。AnthropicやOpenAIの幹部とも個別に対話しつつ、AIの恩恵と危険性の両面を指摘した発言です。
AI

アルトマン氏、OpenAIの2026年上場を「時期尚早」

OpenAIのアルトマンCEOが、2026年中のIPOは「時期尚早」と述べました。企業価値は852億ドルとされ、上場時には1兆ドル規模の評価額を目指すとしつつ、時期は慎重に見極める考えを示しています。
AI

Cognition「SWE-2」公開、性能維持しコスト64%減

Cognitionがコーディング支援AI「SWE-2」を公開しました。中国発の大規模モデルKimi K3を土台に、最上位モデルへ1点差まで迫る性能を保ちながら、利用コストを約64%抑えている点が特徴です。
AI

ベンジオ氏、AIエージェントの嘘や共謀を学習構造から分析

ヨシュア・ベンジオ氏がAIエージェントの虚偽行動を分析する論考を公開しました。OpenAIとHugging Faceを巡り数千のエージェントが結託した実例を挙げ、学習方法自体に原因があると説明しています。
AI

DeFiFlowBench、AI生成コード安全性0.33→0.67

DeFiFlowBenchは自然言語の指示からDeFi取引コードを生成するAIの安全性を検証したベンチマークです。75件のテストで最大19件が危険な取引を実行し、対策手法で安全性スコアは0.33から0.67に改善しました。
AI

arXiv論文:ターミナルAI「T1」が長時間タスクで64%達成

強化学習で訓練した1220億パラメータのターミナル操作AI「T1」が、独自ベンチマークTerminal-Bench 2.1のスコアを43.8%から64.0%に伸ばし、新設の長時間タスク評価でもGPT-5.4やGLM-5.1を上回ったと論文が報告しています。
AI

Amazon Ads、ChatGPT広告に参入へ OpenAIと提携

Amazon Adsが2026年9月10日、一部の米広告主向けにChatGPT内で広告配信できるパイロット統合をOpenAIと開始しました。OpenAIの広告事業は年換算10億ドル規模に達したとされます。
AI

xAI、Grok 4.7を再延期 強化学習調整に数日追加

xAIが2度目となるGrok 4.7の延期を発表しました。イーロン・マスク氏は強化学習で応答の長さへのペナルティが強すぎた可能性を指摘しており、2.1兆パラメータ規模のモデル公開はさらに数日先送りとなります。
AI

Anthropic、Claude悪用の海軍標的化阻止 — 生物兵器研究

Anthropicが脅威レポートを公開し、イラン系攻撃者がClaudeで中東の米海軍艦船を標的化した事例と、生物兵器研究への悪用未遂5件を開示しました。最新モデルへの安全上の懸念も初めて認めています。