LLaVA

Product

視覚言語モデル(オープン)

最終更新: 2026-07-18

3 References

https://www.refbase.ai/entity/llava

Knowledge Dossier

公開済みEvidenceをIdentity / Capability / Credibility / Use Case / Constraints・Current Statusの軸で機械的に集約したものです(新規の主張・推測は含みません)。

Identity

  • LLaVAは視覚エンコーダと言語モデルを接続したオープンの視覚言語モデルで、画像についての対話・指示応答ができる。検証待ち LLaVA — Project Page

Capability

  • LLaVAは視覚エンコーダと言語モデルを接続したオープンの視覚言語モデルで、画像についての対話・指示応答ができる。検証待ち LLaVA — Project Page
  • LLaVAのコード・学習データ・ウェイトはGitHubで公開されており、オープンな視覚言語モデルとして再現・拡張が可能である。検証待ち GitHub — haotian-liu/LLaVA

Credibility

Use Case

公開Evidence未整備

Constraints / Current Status

  • LLaVAのコード・学習データ・ウェイトはGitHubで公開されており、オープンな視覚言語モデルとして再現・拡張が可能である。検証待ち GitHub — haotian-liu/LLaVA

Key References

Knowledge Graph

References — 問い別の知識

データアクセス

各APIエンドポイントはJSON形式でデータを返します。生成AIのツール呼び出し・RAG連携での利用を想定しています。