NVIDIAの研究チームは、補助的なドラフトモデルを一切必要とせずに、LLMの推論速度を大幅に向上させる新しい言語モデルファミリー「Nemotron-Labs-Diffusion」を発表した。このモデルは1つの重み(ウェイト)セットから3つの異なる生 ...