顯示具有 vLLM 標籤的文章。 顯示所有文章
顯示具有 vLLM 標籤的文章。 顯示所有文章

2026年2月22日 星期日

在 arch linux 以 vLLM 使用輕量型 OCR 模型 GLM-OCR

看到報導說GLM-OCR 0.7B參數模型效果不錯,

https://github.com/zai-org/GLM-OCR

有個書本幾頁照片想要轉成文字,就可以用這個離線辨識圖片中的文字。

原本丟給 ChatGPT,但是每個對話第一個還算正確,第二個開始就ChatGPT自己解釋成和照片文字不同的內容。