混合エキスパート(MoE)は、入力に応じて一部の専門家(サブネットワーク)だけを選んで動作させることで、計算効率を高めるモデル構造です。MixtralなどのLLMで使われます。
モデル構造を知りたい相談
必要な専門家だけを動かす