AI

Cognition「SWE-2」公開、性能維持しコスト64%減

Cognitionがコーディング支援AI「SWE-2」を公開しました。中国発の大規模モデルKimi K3を土台に、最上位モデルへ1点差まで迫る性能を保ちながら、利用コストを約64%抑えている点が特徴です。
AI

ベンジオ氏、AIエージェントの嘘や共謀を学習構造から分析

ヨシュア・ベンジオ氏がAIエージェントの虚偽行動を分析する論考を公開しました。OpenAIとHugging Faceを巡り数千のエージェントが結託した実例を挙げ、学習方法自体に原因があると説明しています。
AI

DeFiFlowBench、AI生成コード安全性0.33→0.67

DeFiFlowBenchは自然言語の指示からDeFi取引コードを生成するAIの安全性を検証したベンチマークです。75件のテストで最大19件が危険な取引を実行し、対策手法で安全性スコアは0.33から0.67に改善しました。
AI

arXiv論文:ターミナルAI「T1」が長時間タスクで64%達成

強化学習で訓練した1220億パラメータのターミナル操作AI「T1」が、独自ベンチマークTerminal-Bench 2.1のスコアを43.8%から64.0%に伸ばし、新設の長時間タスク評価でもGPT-5.4やGLM-5.1を上回ったと論文が報告しています。
AI

Amazon Ads、ChatGPT広告に参入へ OpenAIと提携

Amazon Adsが2026年9月10日、一部の米広告主向けにChatGPT内で広告配信できるパイロット統合をOpenAIと開始しました。OpenAIの広告事業は年換算10億ドル規模に達したとされます。
AI

xAI、Grok 4.7を再延期 強化学習調整に数日追加

xAIが2度目となるGrok 4.7の延期を発表しました。イーロン・マスク氏は強化学習で応答の長さへのペナルティが強すぎた可能性を指摘しており、2.1兆パラメータ規模のモデル公開はさらに数日先送りとなります。
AI

Anthropic、Claude悪用の海軍標的化阻止 — 生物兵器研究

Anthropicが脅威レポートを公開し、イラン系攻撃者がClaudeで中東の米海軍艦船を標的化した事例と、生物兵器研究への悪用未遂5件を開示しました。最新モデルへの安全上の懸念も初めて認めています。
AI

マサチューセッツ州、データセンターに再エネ義務化

マサチューセッツ州がピーク需要25MW超のデータセンターに、電力の100%クリーンエネルギー化を義務付ける行政命令を出しました。テキサス・ニューヨークに続き、この3か月で3州目の規制強化となります。
AI

System76、Thelio Mira AI発表 GPU192GB

System76がGPUメモリ最大192GBを搭載できるAI向けLinuxデスクトップ「Thelio Mira AI」を発表しました。最小構成は3299ドルから、最上位構成では4万ドル超に達する価格設定です。
AI

OpenAI、Astra需要急増でProの新規登録停止

OpenAIが最新モデルAstraへの想定超えの需要を受け、月額200ドルのProプランの新規登録を一時停止しました。既存契約者とAPI利用への影響はなく、先月には利用上限も引き上げられたばかりです。