往下拉回到首頁
我們測試了 18 個大型語言模型的 OCR 效能(7000+ 次調用)——便宜和舊款模型經常勝出。完整資料集和框架已開源。

我們測試了 18 個大型語言模型的 OCR 效能(7000+ 次調用)——便宜和舊款模型經常勝出。完整資料集和框架已開源。

We benchmarked 18 LLMs on OCR (7k+ calls) — cheaper/old models oftentimes win. Full dataset + framework open-sourced.

簡單說:我們發現自己在 OCR 上花太多錢了,所以拿最新旗艦模型跟便宜款、舊款模型比一比。結果出爐了,還有免費工具讓你測試自己的文件。全部開源。 我們在研究 OCR 和文件提取的工作流程時,發現了一個共同的問題:太多團隊要麼還在用老舊的 OCR 系統,要麼就是盲目選最新最大的模型,結果花了一堆冤枉錢在大型語言模型(LLM)的 API 調用上。 我們整理了 42 份標準文件,每個模型都跑了 10 次測試