変換ベンチマーク

これらは参考値であり、すべての machine や document に対する約束ではありません。比較は両方が正常に変換できた file だけを使い、各測定の version と revision を残します。

Coverage、performance、output preservation を分ける

3 つの問いを混ぜません。coverage は実際に変換できる file、performance は起動、変換時間、CPU 時間、peak memory、output preservation は形式ごとの検査です。曖昧な総合 score にはまとめません。CLI、browser WebAssembly、常駐 HTTP server も別々に測ります。

正しさを確認してから時間を測る

native CLI と browser は output check を通過した結果だけを timing に含めます。server は現在、成功 response と空でない body だけを確認するため、その timing は意味上の品質検査の代わりにはなりません。Docling は parser backend のみを使い、OCR、VLM、ASR、layout model、table model、enrichment、accelerator は無効です。

ベンチマークを再現する

corpus は license の異なる第三者文書から成るため再配布しません。manifest に source、format、size、SHA-256 を記録しています。benchmarks/fetch_corpus.sh は同じ file を取得し、すべての digest を検証します。

英語の完全な表と生データを見る