クローズドなマルチモーダルAIはAPI経由でのみ利用できるのに対し、LLaVAはコード・学習データ・ウェイトが公開されており、自分の環境で実行・再現・拡張できます。研究コミュニティ発のオープンモデルとして、NeurIPS採択論文で手法が公開されている点も特徴です。
マルチモーダルAIのオープン/クローズド比較
再現・拡張可能なオープンな視覚言語モデル