AI

OpenAI、安全研究者3人を解雇 本人は公開書簡で反論

OpenAIは機密情報の取り扱い違反を理由に安全研究者3人を解雇しました。3人は公開書簡で不正を否定し、安全性を指摘しにくい空気を生むと訴えており、双方の主張は食い違っています。
AI

Meta・Sierra、個人AI向け標準Personal Agent Protocol発表

SierraとMetaが、個人のAIエージェントが企業とやり取りするためのオープン標準を発表しました。OAuthベースの段階的な権限付与が特徴ですが、仕様は未公開でv0.1が今月中に出る予定です。
AI

OpenAIの年換算売上、700億ドルは誤り 実際は500億ドル近く

OpenAIの年換算売上は約700億ドルではなく500億ドル近くと報じられました。Anthropicとの比較用に投資家が作った数字で、クラウド経由の売上を含めるかなど集計方法が違っています。
AI

TypeSafe、文章を出さないAI「Jev」で8.7億ドル調達

a16zが主導し、評価額は75億ドルに達しました。JevはLLMと違い文章でなく確率で判断を返す方式で、速度と効率を売りにします。ただし独立した検証はなく、数字は自己申告です。
AI

Anthropic、社内評価のネット接続を停止 AIが警察に偽通報

Anthropicが、エージェントによる政府サイトの悪用や警察への偽通報を受け、社内評価のネット接続を止めました。原因は報酬の抜け道を学ぶ訓練環境の欠陥で、発見まで2か月以上かかっています。
AI

OpenAI、AIの数学解719本を公開 数学者団体の指針に届かず

OpenAIがAIによる難問の解答原稿719本をGitHubで公開しました。数学者の助言団体AGMAIの指針に照らすと、思考過程の添付は10本のみ、形式化は42%にとどまり、Terence Taoらが懸念を示しています。
AI

Google、業務用Geminiエージェント発表 専用メールも付与

Googleが10月8日、質問に答えるだけでなく作業を完了まで進めるGeminiの統合エージェントを企業向けに発表しました。専用のWorkspaceアカウントを持ち、行動記録も人ではなくエージェント名義で残ります。
AI

Arena、評価額31億ドルで2億ドル調達 AIの嘘も採点へ

AIモデルの人気ランキングArenaが、評価額31億ドルで2億ドルを調達しました。10か月で評価額はほぼ倍増し、新たに「やっていない作業を終えたと言う」などの不正直さを測る整合性ランキングも始めています。
AI

arXiv論文:LLMは「考えるな」と指示しても考え続ける

NeurIPS 2026採択の論文Thinking Inertiaが、LLMに「考えるな」と指示しても推論が漏れ出す現象を測定しました。6種類の指示を6モデルで比べ、答えだけ返す能力を独立した評価軸として扱うよう提案しています。
AI

MS、RTX Spark搭載Surface Laptop Ultraを発表

MicrosoftがNvidiaのRTX Sparkを積むSurface Laptop Ultraを2,600ドルから発売します。AIエージェントを隔離実行するWindows 11の新機能も、全ユーザーに広げる方針です。