텍스트, 바코드, 기준 마커(fiducial marker) 검출 및 인식
Computer Vision Toolbox™는 딥러닝 모델과 고전적인 컴퓨터 비전 기법을 조합하여 영상과 비디오 내의 텍스트, 바코드, 기준 마커(fiducial marker) 검출을 지원합니다. 이러한 기능은 자율주행, 산업 자동화, 문서 분석, 증강현실과 같은 응용 분야에 필수적입니다.
텍스트 검출의 경우, 2단계 절차를 사용할 수 있습니다. 먼저 영상에서 텍스트가 포함된 영역을 검출한 다음, OCR(광학 문자 인식)을 사용하여 해당 영역 내의 텍스트를 인식합니다. 이 툴박스는 블롭 분석, MSER(maximally stable extremal regions) 특징 검출기, 딥러닝 기반 CRAFT 모델 등 여러 가지 텍스트 검출 접근 방식을 제공합니다. 이러한 방법은 복잡한 장면에서 텍스트가 포함된 영역을 찾는 데 도움을 줍니다. 또는 영상 레이블 지정기 앱과 비디오 레이블 지정기 앱을 사용하여 영상 내 텍스트 영역에 대해 대화형 방식으로 AI 지원 주석을 추가할 수 있습니다.
영상에서 텍스트 영역을 식별했으면, 여러 언어를 지원하는 사전 훈련된 언어 모델을 사용하여 OCR을 통해 텍스트를 인식할 수 있습니다. 사용자 지정 응용 사례의 경우, trainOCR 함수를 사용하여 사용자 고유의 OCR 모델을 훈련시킬 수 있습니다. 자세한 내용은 Getting Started with OCR 항목과 Train Custom OCR Model 항목을 참조하십시오.
바코드 검출과 기준 마커(fiducial marker) 검출의 경우, 이 툴박스는 1차원 및 2차원 바코드의 읽기와 디코딩, AprilTags 마커 및 ArUco 마커와 같은 기준 마커(fiducial marker)의 검출을 지원합니다. 또한 ArUco 마커를 프로그래밍 방식으로 생성할 수 있으며, 이는 로보틱스 및 AR 시스템의 보정 작업과 추적 작업에 유용합니다.
앱
| 영상 레이블 지정기 | 컴퓨터 비전 응용 분야에서 영상에 레이블 지정 |
| 비디오 레이블 지정기 | Label video for computer vision applications |
함수
도움말 항목
시작하기
- Getting Started with OCR
Detect and recognize text in multiple languages, train OCR models to recognize custom text. - Train Custom OCR Model
Train an optical character recognition (OCR) model to recognize custom text. - OCR 언어 데이터 파일 설치하기
광학 문자 인식(OCR) 언어에 대한 지원 파일입니다. - Camera Calibration Using Custom Planar Calibration Patterns
Detect and localize AprilTags in a calibration pattern.







