AI Nemotron-TwoTower:拡散LMが品質維持で2.42倍高速化
Nvidiaの研究チームが、拡散言語モデルと自己回帰モデルを2塔構成で組み合わせるNemotron-TwoTowerを発表しました。品質は自己回帰ベースラインの98.7%を維持しながら生成スループットが2.42倍に向上し、コードとモデル重みはオープンソースで公開されています。
AI
AI
AI
AI
AI
AI
AI
AI
AI
AI