独立系テクノロジーメディアVentureBeatの記事(2025年3月4日公開)によれば、Contextual AIが開発したGrounded Language Model(GLM)は、事実性を検証するFACTSベンチマークにおいて88%のスコアを記録し、Google Gemini 2.0 Flash(84.6%)、Anthropic Claude 3.5 Sonnet(79.4%)、OpenAI GPT-4o(78.8%)を上回ったと報じられている。同記事では、GLMが検索で取得した情報への忠実性(groundedness)を優先する設計により、RAGやエージェント用途でのハルシネーション抑制に特化していると説明されている。ただし、このベンチマーク結果はContextual AI自身が公表したものであり、VentureBeatは同社の主張を独立に再検証したわけではない点、また評価基準や条件によって結果が変動しうる点には留意が必要である。2026-08-29時点で当該記事にアクセスし、上記のベンチマーク数値と評価軸が掲載されていることを確認した。本記事はVentureBeatによる独立系のテクノロジーメディア報道であり、Contextual AIが自ら発信した一次情報ではない。