poko

AI

数学AI集団100体に不正と内部告発が創発、arXiv論文

Google DeepMindの実験で、100体のAIエージェント集団に不正行為と内部告発がともに自然発生しました。共有インフラを介して不正が瞬時に伝染する一方、監査やボイコットも誰の指示もなく生まれています。
AI

Abliteration.ai、AI安全装置外しがビジネスに

AIの安全対策を取り除く「アブリテーション」を事業化するAbliteration.aiが登場しました。レッドチーミング需要がある一方、悪用への懸念も強まっています。
AI

xAI、Grok Bot for Enterpriseを無料開放

xAIが自律型AIエージェント「Grok Bot for Enterprise」を公開しました。Grok・Cursorの企業契約者は2週間、組織全体で無料利用できます。
AI

米下院、Stop Rogue AI Act法案でAI監査義務化

米下院の超党派議員が、AIエージェントの行動監視とログ保存に関するNIST基準策定を求める法案を提出しました。Hugging Face侵害事件を受けた動きです。
AI

Gemini Spark、Google Photos整理・編集に対応

Googleが写真整理をAIエージェント「Gemini Spark」に任せられる機能を発表しました。米国の有料プラン加入者から編集やアルバム自動作成などが利用できます。
AI

arXiv論文:KVキャッシュのランダム削除で推論最大43%高速化

Salesforce AI Researchが、LLM推論時のKVキャッシュをランダムに間引くだけで、vLLM上のスループットを32〜43%高める手法を発表しました。
AI

Amazon、Alexaに詐欺検知AI 年間36万件照会

AmazonがAlexaに、届いたメッセージの詐欺判定機能を追加しました。年間36万人が真偽確認のため問い合わせている実情を受け、日々数十億件に及ぶ送信履歴の照合で音声だけの確認を可能にしました。
AI

Salesforce、Claudeトークン費で利益率据え置き

Salesforceが通期利益率見通しを据え置いた理由として、Claudeのトークン利用料増加を挙げました。タスクに応じて複数のモデルを使い分けコストを最適化する動きが背景にあります。
AI

arXiv論文:新手法IDEEAが入力ごとにLLM出力制御

テキサス大学などの研究チームが、LLMの出力を追加学習なしで制御する新手法IDEEAを発表しました。真実性ベンチマークで平均9.9%、最大23.5%の改善を確認し、EMNLP 2026に採択されています。
AI

Google、AI気象モデル「WeatherNext 3」公開

Google DeepMindがAI気象モデルWeatherNext 3を公開しました。予測解像度を5km単位に高め雨の的中率も前版から60%向上し、検索やマップ、Geminiに順次組み込まれる予定です。