컴퓨터 비전

Computer Vision
별칭: CV · 기계 시각 · 객체 탐지 · 이미지 분류 · 시맨틱 세그멘테이션 · 3D 비전 · 포즈 추정
AI 기술 공통AI 공통 역량·기술●○○ 기본기본

AI가 이미지·영상을 인식하고 분석하는 기술

정의와 배경

컴퓨터 비전은 디지털 이미지·동영상·센서 데이터로부터 의미 있는 정보를 추출하고 이해하는 AI 기술 분야다. 인간은 눈으로 사물을 보는 순간 그 형태·색상·맥락을 자연스럽게 파악하지만, 컴퓨터에게 이미지란 단순한 숫자(픽셀값)의 배열에 불과하므로 이를 의미 있는 정보로 변환하는 알고리즘이 필요하다. 초기에는 에지(edge) 검출이나 히스토그램 같은 수작업 특징 추출 방식에 의존했으나, 딥러닝과 대규모 학습 데이터의 결합으로 인간 수준에 근접하는 인식 성능이 가능해졌다.

작동 원리와 주요 기술

컴퓨터 비전의 핵심 구조는 합성곱 신경망(CNN)으로, 이미지를 계층적으로 처리하며 선·형태·질감·객체 등 점점 추상적인 특징을 자동으로 학습한다. 대표적인 세부 기술로는 이미지 내 특정 물체의 위치와 종류를 찾아내는 '객체 탐지(Object Detection)', 이미지 전체를 하나의 범주로 분류하는 '이미지 분류(Image Classification)', 픽셀 단위로 영역을 구분하는 '시맨틱 세그멘테이션(Semantic Segmentation)', 3차원 공간 정보를 추론하는 '3D 비전', 사람·동물의 관절 위치를 추정하는 '포즈 추정(Pose Estimation)' 등이 있다. 최근에는 트랜스포머(Transformer) 구조가 비전 분야에도 적용되어 이미지와 텍스트를 함께 처리하는 멀티모달 AI와 결합하는 방향으로 발전하고 있다.

산업·정책적 활용과 중요성

컴퓨터 비전은 제조업의 불량품 자동 검사, 의료 영상 판독 보조, 자율주행 차량의 도로 인식, 스마트시티의 교통량 분석, 보안 시스템의 안면 인식 등 다양한 분야에서 실질적인 가치를 창출하고 있다. 공공 부문에서는 재난·재해 피해 파악, 위성 이미지 분석을 통한 토지 이용 변화 감지, 공항·항만 보안 강화 등에 활용되며 행정 효율화의 수단으로 주목받는다. 특히 대규모 학습 데이터와 GPU 연산 자원의 확보가 성능을 좌우하므로, 데이터 구축 및 컴퓨팅 인프라에 대한 정책적 지원이 기술 경쟁력의 핵심 요소로 꼽힌다.

📌 출처: AI 리터러시 용어 목록(기본+파생)

🤖 AI 해설

AI 해설은 이 항목의 근거에 기반한 보조 자료입니다. 중요한 수치·사실은 원문 출처로 검증하세요.

확인 문제

Q1. 다음 설명에 해당하는 것은? “컴퓨터 비전은 AI가 이미지와 영상 데이터를 인식·분석·해석하도록 하는 기술 분야로, 인간의 시각 능력을 기계로 구현하는 것을 목표로 한다. 딥러닝 기반의 합성곱 신경망(CNN) 등이 등장하면서 정확도가 비약적으로 향상되었으며, 제조·의료·교통·보안 등 광범위한 산업 분야에서 핵심 기반 기술로 활용된다.”
Q2. ‘컴퓨터 비전’이(가) 속한 계열은?