思考车牌号的提取
一辆车的照片如何提取车牌号码?(OCR仅仅是获取数字,怎么能确定该数字是车牌号呢)通用 OCR 只负责 “识别文字内容”,它不知道哪段文字属于车牌。完整车牌识别 =车牌检测(找到车牌在哪) + OCR 字符识别(读出号码) + 格式校验(判断是不是合法车牌)三大块。如果你直接把整张车照片丢给 PaddleOCR,图片里会识别出:车身贴纸、广告牌、地面文字、车窗贴纸、车牌字符一大堆文本。OCR 分不清哪个才是车牌。完整流水线(一张车辆照片提取车牌)1️⃣ 车牌检测(最重要:确定哪一块区域是车牌)两种实现方式:深度学习方案(工程最常用)用 YOLO 训练一个专门检测车牌的模型,输出车牌的矩形框x1,y1,x2,y2,类别就是license_plate,直接把车牌从整张图抠出来(ROI 裁剪)。只把裁剪出来的车牌小图送给 OCR,其他区域全部丢弃。传统 OpenCV 方案通过轮廓、颜色(蓝 / 黄 / 绿底色)、宽高比(国内车牌宽高比大约 3:1)过滤候选矩形,筛选出疑似车牌区域。2️⃣ 图像矫正裁剪出来的车牌可能倾斜、透视畸变,做透视变换转正车牌图像。3️⃣ OCR 识别(仅仅读出字符)把转正后的车牌小图送入 OCR (PaddleOCR/EasyOCR/LPRNet),得到一串文字,例如:粤A12345。这一步只做字符读取,不知道这是不是车牌。4️⃣ 后处理校验:判断读到的数字文字到底是不是合法车牌号
