看到報導說GLM-OCR 0.7B參數模型效果不錯,
https://github.com/zai-org/GLM-OCR
有個書本幾頁照片想要轉成文字,就可以用這個離線辨識圖片中的文字。
原本丟給 ChatGPT,但是每個對話第一個還算正確,第二個開始就ChatGPT自己解釋成和照片文字不同的內容。