주요 콘텐츠

텍스트, 바코드, 기준 마커(fiducial marker) 검출 및 인식

AI 모델을 사용한 텍스트(OCR), 바코드, 기준 마커(fiducial marker) 검출 및 인식

Computer Vision Toolbox™는 딥러닝 모델과 고전적인 컴퓨터 비전 기법을 조합하여 영상과 비디오 내의 텍스트, 바코드, 기준 마커(fiducial marker) 검출을 지원합니다. 이러한 기능은 자율주행, 산업 자동화, 문서 분석, 증강현실과 같은 응용 분야에 필수적입니다.

텍스트 검출의 경우, 2단계 절차를 사용할 수 있습니다. 먼저 영상에서 텍스트가 포함된 영역을 검출한 다음, OCR(광학 문자 인식)을 사용하여 해당 영역 내의 텍스트를 인식합니다. 이 툴박스는 블롭 분석, MSER(maximally stable extremal regions) 특징 검출기, 딥러닝 기반 CRAFT 모델 등 여러 가지 텍스트 검출 접근 방식을 제공합니다. 이러한 방법은 복잡한 장면에서 텍스트가 포함된 영역을 찾는 데 도움을 줍니다. 또는 영상 레이블 지정기 앱과 비디오 레이블 지정기 앱을 사용하여 영상 내 텍스트 영역에 대해 대화형 방식으로 AI 지원 주석을 추가할 수 있습니다.

영상에서 텍스트 영역을 식별했으면, 여러 언어를 지원하는 사전 훈련된 언어 모델을 사용하여 OCR을 통해 텍스트를 인식할 수 있습니다. 사용자 지정 응용 사례의 경우, trainOCR 함수를 사용하여 사용자 고유의 OCR 모델을 훈련시킬 수 있습니다. 자세한 내용은 Getting Started with OCR 항목과 Train Custom OCR Model 항목을 참조하십시오.

바코드 검출과 기준 마커(fiducial marker) 검출의 경우, 이 툴박스는 1차원 및 2차원 바코드의 읽기와 디코딩, AprilTags 마커 및 ArUco 마커와 같은 기준 마커(fiducial marker)의 검출을 지원합니다. 또한 ArUco 마커를 프로그래밍 방식으로 생성할 수 있으며, 이는 로보틱스 및 AR 시스템의 보정 작업과 추적 작업에 유용합니다.

영상 레이블 지정기컴퓨터 비전 응용 분야에서 영상에 레이블 지정
비디오 레이블 지정기Label video for computer vision applications

함수

모두 확장

detectTextCRAFTDetect texts in images by using CRAFT deep learning model (R2022a 이후)
detectMSERFeaturesDetect MSER features
vision.BlobAnalysisProperties of connected regions
extractHOGFeaturesExtract histogram of oriented gradients (HOG) features
ocrRecognize text using optical character recognition
ocrTextStore OCR results
visionSupportPackages인스톨러를 시작하여 Computer Vision Toolbox 데이터 다운로드, 설치 또는 제거
readAprilTag영상에서 AprilTag 검출 및 자세 추정
readArucoMarkerDetect and estimate pose for ArUco marker in image (R2024a 이후)
generateArucoMarkerArUco 마커 영상 생성 (R2024a 이후)
readBarcodeDetect and decode 1-D or 2-D barcode in image
trainOCRTrain OCR model to recognize text in image (R2023a 이후)
evaluateOCREvaluate OCR results against ground truth (R2023a 이후)
ocrMetricsStore OCR quality metrics (R2023a 이후)
ocrTrainingOptionsOptions for training OCR model (R2023a 이후)
ocrTrainingDataCreate training data for OCR from ground truth (R2023a 이후)
quantizeOCRQuantize OCR model (R2023a 이후)

도움말 항목

시작하기

추천 예제