Ⅰ단원 · 5 / 5차시

데이터 편향과 단원 정리

인공지능의 판단이 한쪽으로 치우치는 데이터 편향성 문제를 사례로 살펴보고, Ⅰ단원에서 배운 내용을 문제 풀이로 정리합니다.

학습목표

  • 데이터 편향성의 의미를 알고 실제 사례를 설명할 수 있다.
  • 데이터 편향을 최소화하기 위해 노력해야 하는 이유를 말할 수 있다.
  • Ⅰ단원에서 배운 인공지능·퍼셉트론·빅데이터 개념을 종합적으로 적용할 수 있다.

시간 배분

단계활동
도입인공지능의 판단은 항상 공정할까?5분
활동1데이터 편향성 사례 살펴보기15분
활동2Ⅰ단원 정리 퀴즈20분
정리Ⅰ단원 되돌아보기10분
도입 · 5분

인공지능의 판단은 항상 공정할까?

빅데이터를 효과적으로 분석하고 처리하면 미래를 예측하고 의사를 결정하는 데 도움이 됩니다. 하지만 인공지능이 예측·추론한 값을 신뢰하려면 인공지능이 학습한 원본 데이터의 양과 질이 매우 중요합니다.

데이터 편향성 : 인공지능이 인간의 주관적인 판단이 들어간 입력 데이터를 학습하여 판단 결과가 한쪽으로 치우치거나 왜곡되는 것.
활동 1 · 15분

데이터 편향성 사례 살펴보기

데이터는 인공지능이 학습하는 수단이자 도구이기 때문에, 원본 데이터에 존재하는 편향이나 불균형은 인공지능에서도 그대로 나타납니다.

사례 1 · 불균형적인 데이터를 학습한 경우

하얀 백조만 학습한 인공지능

인공지능에게 백조를 학습시키면서 하얀 백조 이미지만 제공했다면, 인공지능은 검은 백조를 백조로 인식하지 못하는 편향성을 보일 것입니다. 실제로 서양권에서 개발한 얼굴 인식 시스템은 백인 남성을 가장 잘 인식한다고 알려져 있습니다.

사례 2 · 사회적 차별을 학습한 경우

여성 지원자를 차별한 AI 채용 시스템

2018년 한 다국적 기업이 10년간의 데이터를 바탕으로 지원자의 이력서를 검토하는 인공지능 채용 시스템을 도입했는데, 여성보다 남성 지원자를 선호한다는 것이 발견되었습니다. 이 기업은 개발직군이 전체 직원의 70% 이상이었고 그중 남성이 훨씬 많아, 성과 높은 직원의 데이터를 학습한 인공지능이 '여성'이라는 단어가 포함된 이력서에 감점을 준 것입니다. 이후 특정 용어에 중립적으로 평가하도록 개선했지만 같은 문제가 반복되지 않으리라는 확신을 주지 못해, 결국 이 시스템은 폐기되었습니다.

활동 2 · 20분

Ⅰ단원 정리 퀴즈

지금까지 배운 인공지능, 퍼셉트론, 빅데이터 개념을 문제로 정리해 봅시다.

단원 마무리 문제
맞힌 개수
0 / 5
정리 · 10분

Ⅰ단원 되돌아보기

Ⅰ단원 '인공지능과 빅데이터'에서 다룬 5개 차시의 핵심 내용을 정리하면 다음과 같습니다.

1차시
인공지능이란?
데이터·모델·학습, 지도·비지도·강화학습, AI⊃ML⊃DL
2차시
퍼셉트론
가중치·임곗값·활성화함수로 출력 $y$ 계산하기
3차시
논리 연산
OR·AND 구현, XOR의 한계와 다층 퍼셉트론
4차시
빅데이터
정형·비정형 데이터, 5V, 사회 문제 해결 사례, 알고리즘
5차시
데이터 편향
편향성의 의미와 사례, 편향을 줄이려는 노력
다음 Ⅱ단원 '자료의 표현'에서는 이미지와 데이터를 벡터와 행렬로 표현하는 방법을 배웁니다.

Ⅰ단원을 마치며

인공지능의 개념과 학습 방법, 퍼셉트론의 계산 원리, 빅데이터의 특징과 활용 사례, 데이터 편향 문제까지 살펴보았습니다. 수고 많았습니다!

← 4차시 — 빅데이터와 인공지능 Ⅰ단원 목록으로 →