Modal公式ブログ『How we achieved truly serverless GPUs』によると、同社のGPUメモリスナップショット機能は典型的に4〜10倍の高速化を実現し、コンテナ起動時間を数分から数十秒へ短縮する。1万件超のコールドスタートを対象とした検証では、vLLMで1GiBモデルを提供する場合、スナップショットなしの平均起動遅延95,679ミリ秒に対し、スナップショットありでは13,797ミリ秒(約7倍高速化)だった。SGLangでも同様に、83,713ミリ秒から17,486ミリ秒(約4.8倍高速化)へ改善した。同記事はまた、実際の顧客事例として文書処理プラットフォームのReductoでは、コールドスタートが約70秒から約12秒へと約6分の1に短縮されたと紹介している。