[컴퓨터비전] 8. 기계 학습
2025-06-07
1분 분량
컴퓨터비전
8.1 기계학습의 기초
- 기계 학습(Machine Learning): 경험(E)을 통해 주어진 작업(T)에 대한 성능(P)이 향상되면 학습이 이루어진 것으로 간주
- 지도 학습 vs 비지도 학습
- 재샘플링 기법: 학습 집합이 적을 때 성능 평가를 위해 사용하는 방법
8.2 신경망
- 퍼셉트론: 가장 기초적인 신경망 구조. 입력층과 출력층으로 구성된 이진 분류기
- 다층 퍼셉트론 (MLP): 여러 은닉층을 추가한 구조. 퍼셉트론의 한계를 극복
- 활성 함수: 노드 출력을 비선형으로 변환하는 함수 (예: Sigmoid, ReLU)
- 역전파 알고리즘 (Backpropagation): 오차를 출력에서 입력으로 역전달하며 가중치를 조정
- 딥러닝(Deep Learning): 은닉층이 많은 신경망 구조. 영상 인식 등에서 강력한 성능 발휘
8.3 SVM (Support Vector Machine)
- 기본 개념: 두 부류를 가장 잘 구분하는 결정 초평면을 찾는 분류기
- 여백(Margin): 분류 경계와 가장 가까운 샘플 간의 거리. 이를 최대화하는 것이 목표
- 선형 SVM: 선형 초평면으로 분류
- 비선형 SVM: 커널 트릭(Kernel Trick)을 통해 비선형 분류 가능
- 다중 클래스 확장: 1대 M-1 방식이나 1대1 방식으로 다중 분류 구현
8.4 분류기 앙상블
- 앙상블 기법: 여러 개의 분류기를 조합하여 더 나은 성능을 얻는 방법
- 에이다부스트 (AdaBoost)
- 임의 숲 (Random Forest)
8.5 기계 학습을 이용한 얼굴 검출
- 비올라-존스 얼굴 검출기: 대표적인 실시간 얼굴 검출 알고리즘
- 얼굴 검출 → 얼굴 인식의 전처리 단계
- 기타 얼굴 검출 알고리즘들도 연구되고 있으며 성능 비교 논문도 존재
함께 읽으면 좋은 글
CS2025-06-10
[컴퓨터비전] 12. 장면 이해
1981년 노벨의학상은 Hubel과 Wiesel의 시각 신경망 연구에 수여됨 이들은 고양이의 시각 피질에 마이크로 전극을 삽입하여, 특정 에지 방향에 반응하는 뉴런이 존재함을 발견 이는 시각 피질이 에지 정보를 추출하는 구조로 되어 있음을 의미 깡충 거미는 네 쌍의 눈으로…
CS2025-06-10
[컴퓨터비전] 11. 3차원 비전
본질 영상은 명암값에서 조명, 그림자 등의 외부 요인을 제거하고 물체의 고유한 성질만을 표현한 영상 사람은 외관과 본질을 구별할 수 있지만 컴퓨터는 일반적으로 외관만을 인식 본질 영상의 주요 예: Barrow(1978)가 본질 영상의 개념을 제안했지만, 명암 영상에서 본질…
CS2025-06-09
[컴퓨터비전] 10. 모션
현실 세계는 정적인 이미지보다 움직이는 장면이 훨씬 많음 움직임은 두 가지로 나뉨: 움직임 분석을 통해 동작 인식, 물체 추적, 장면 이해 등 다양한 작업이 가능 대표적인 응용: 광류: 연속된 영상 프레임 사이에서 화소의 움직임을 추정하는 기법 기본 가정: 밝기 불변 가정…
CS2025-06-08
[컴퓨터비전] 9. 인식
인식은 컴퓨터 비전의 핵심 목표로, 사람처럼 물체를 구별하고 인식하는 기능을 의미함 인식 기술의 성능을 평가하고 경쟁하기 위한 표준 데이터베이스와 국제 대회 존재 대표적인 대회: 인식 기술은 아직 어린아이보다 못한 수준이며, 지속적인 연구와 경쟁이 필요한 분야 사례…