Mistral AI公式サイトの発表によれば、Codestral 25.01はHumanEvalベンチマークで86.6%、Fill-in-the-Middle(FIM)タスクのpass@1平均で95.3%のスコアを記録し、前バージョンのCodestral 22B(2405)と比較してHumanEvalで5.5ポイント、FIM pass@1平均で3.5ポイント向上したと発表しています。同社はまた、より効率的なアーキテクチャとトークナイザーの改善により、コード生成・補完の速度が約2倍になったとしています。ただしこれらの数値はMistral AI自身が発表したベンチマーク結果であり、第三者による再現実験や独立した検証結果ではない点に留意が必要です。2026-08-29時点でMistral AI公式サイト上の該当ページの内容を確認しました。この情報源はモデル開発元であるMistral AI自身が発信する公式発表です。