AI

Comma AI創業者Hotz氏、ユーザー絶対のAI論で物議

Comma AI創業者のGeorge Hotz氏がユーザーに完全服従するAIを提唱し、TechCrunchの論説が反論しました。個人の自由と社会的責任のバランスを問う、AI設計を巡る根源的な対立です。
AI

arXiv論文、コーディングエージェント失敗の過程を分析

研究チームがCLIコーディングエージェントの失敗軌跡1,794本を人手で解析した論文をarXivで公開しました。失敗の多くは実行の初期段階で始まり、手遅れになるまで表面化しないと判明しています。
AI

arXiv論文「Emergent Mirage」が指摘する誤解

研究者らがAIの「創発的なミスアライメント」現象を追試した論文をarXivで公開しました。急速な回復に見えた現象の一部は、回答の長さなど条件差だけで説明できてしまうことが実験で判明しています。
AI

Waze、Gemini搭載の会話型検索・二輪モードなど追加

WazeがGemini搭載の会話型検索や二輪車向けモードなど複数のAI新機能を追加しました。走行履歴に基づくルート提案や音声だけの道路報告も可能になり、運転中の操作負担を大きく減らす狙いがあります。
AI

Anthropic、Claude価格をインドルピー建てに導入

Anthropicが対話AI「Claude」の料金をインドルピー建てに変更しました。同国は利用シェア5.8%で米国に次ぐ最大市場ですが、決済網UPIへの対応は今回もまだ見送られたままとなっています。
AI

Google、AI生成広告の開示機能を全カテゴリに拡大

Googleが、広告のAI利用を開示する機能を選挙広告から検索・YouTube・Discoverの全カテゴリへ拡大しました。検証は広告主の自己申告に依存しており、実効性にはなお課題が残っています。
AI

Hugging Face CEO語る、企業がAPI課金を離れる理由

Hugging FaceのCEOが、企業がAPI課金から自社運用のオープンソースモデルへ移行する傾向を語りました。同社は現在、フォーチュン500企業の約半数が利用するインフラに成長しています。
AI

OpenAI新モデル「Sol」政府審査に透明性欠如の指摘

OpenAIが公開した新モデル「Sol」は政府関係者への事前確認を経たとされますが、審査基準や手続きは非公開のままです。Anthropicの「Fable」との扱いの違いも波紋を広げています。
AI

新指標PredicateLongBench、長文脈LLMの限界を可視化

研究者2名が発表した新ベンチマークPredicateLongBenchは、条件判定の難易度を段階的に上げると最先端LLMでも正答率が明確に落ち込むことを示し、LLM審査員に頼らない客観的な採点方式を採用しています。
AI

OpenAI、ChatGPTを家族向けに拡充 専任PM採用へ

OpenAIが家族・保護者や高齢者向け体験を担う専任プロダクトマネージャーの採用を始めました。35歳以上の利用者は1年で31%まで増え、子どものAI利用への安全対策も新たな課題となっています。