python读图上文字的代码。linux
我完全按照AI给的思路进行。
1、安装工具
sudo apt update
sudo apt install -y tesseract-ocr tesseract-ocr-chi-sim xclip
验证:输tesseract --version,能看到版本号就说明装对了
这些分别是:OCR识别引擎、中文语言包、剪贴板读取工具,缺一个都用不了
后续代码其实不需要安装剪贴板读取工具。
2、建Python虚拟环境(避免污染系统Python,规范操作)
建专属项目文件夹,以后代码都放这
mkdir -p ~/ocr-tool && cd ~/ocr-tool
建虚拟环境
python3 -m venv .venv
激活虚拟环境(激活后终端前面会多出 (.venv) 的标志,很重要!)
source .venv/bin/activate
装Python依赖包
pip install pytesseract pillow pyperclip
3、写OCR代码
在VS Code里点「文件→新建文件」,保存为 ocr_clipboard.py,放到刚才的~/ocr-tool目录里
import pytesseract
from PIL import Image
def ocr_image_file():
# 直接读取桌面上的图片
img_path = "/home/kali/Desktop/test.png"
try:
img = Image.open(img_path)
# 识别文字
text = pytesseract.image_to_string(img, lang='chi_sim+eng')
print("✅ 识别成功!结果如下:")
print("-" * 30)
print(text.strip())
print("-" * 30)
except FileNotFoundError:
print(f"❌ 没找到图片,请确认 {img_path} 是否存在")
if name == 'main':
ocr_image_file()
保存后运行
python ./orc_clipboard.py
浙公网安备 33010602011771号