내 퀴즈
오답노트
캘린더
탐색
로그인
회원가입
QUIZ · 문제 풀이
빅데이터 분석기사 필기 : 빅데이터 탐색 (2과목) 문제은행
자격증
·
총 10문제
·
낱말카드
📝
한번에 풀기
1 / 10문제
0:00
Q1.
다음 상황에서 가장 적절한 개념은?
배송 시간 데이터에서 '24시간 이내 배송' 비율이 전체 건수의 몇 %인지 한 번에 파악하려 한다.
1
누적 도수(Cumulative Frequency)
2
히스토그램
3
박스플롯
4
워드 클라우드
정답 처리
(₩)
복습 큐
💡 해설
특정 값 이하 관측값의 비율을 파악할 때 누적 도수(또는 누적 상대도수·ECDF)가 적합하다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q2.
'교차표(Cross Table)'에 대한 설명으로 가장 옳은 것은?
1
두 범주형 변수의 결합 빈도를 행·열 형태로 정리해 변수 간 관계와 분포를 파악하는 요약 도구다.
2
연속형 변수를 구간별로 나눠 빈도를 나타내는 도구다.
3
두 연속형 변수 간 공분산과 상관계수를 정리한 표다.
4
회귀 모델의 계수와 유의확률을 정리한 출력 결과표다.
정답 처리
(₩)
복습 큐
💡 해설
교차표(분할표)는 카이제곱 독립성 검정의 기초이며, 이진 분류 결과의 혼동 행렬도 교차표의 특수 형태다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q3.
'데이터 편향(Data Bias)'에 대한 설명으로 가장 옳은 것은?
1
수집 방식·표본 설계·레이블링 과정에서 특정 집단이 과대 또는 과소 대표돼 모델이 불공정한 예측을 하게 되는 체계적 오류다.
2
피처 수가 샘플 수보다 많아 회귀 계수 추정이 불안정한 문제다.
3
학습 데이터에 노이즈가 많아 모델이 과적합되는 문제다.
4
테스트 데이터가 학습 데이터와 분포가 달라 성능이 저하되는 문제다.
정답 처리
(₩)
복습 큐
💡 해설
데이터 편향은 표본 편향·확인 편향·측정 편향 등으로 분류되며, AI 공정성 문제의 주요 원인이다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q4.
'데이터 불일치 해소'에 대한 설명으로 가장 옳은 것은?
1
서로 다른 소스에서 수집된 데이터의 형식·단위·정의가 충돌할 때 하나의 기준으로 통일하는 작업이다.
2
학습 데이터와 검증 데이터를 교대로 사용해 모델을 평가하는 기법이다.
3
고차원 데이터를 저차원으로 변환해 시각화를 용이하게 하는 기법이다.
4
데이터를 여러 파티션으로 나눠 병렬 처리하는 기법이다.
정답 처리
(₩)
복습 큐
💡 해설
데이터 불일치 해소는 이기종 소스 간 포맷·단위·코드 차이를 표준화해 통합 정합성을 확보하는 정제 작업이다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q5.
'최대우도추정(MLE)'에 대한 설명으로 가장 옳은 것은?
1
관측된 데이터가 나타날 확률(우도)을 최대화하는 모수 값을 추정량으로 선택하는 방법이다.
2
사전 분포와 우도를 결합한 사후 분포의 최빈값을 추정량으로 사용하는 방법이다.
3
추정량의 기댓값이 모수와 일치하는 성질을 이용해 모수를 추정하는 방법이다.
4
최소 제곱 원리로 회귀계수를 추정하는 방법이다.
정답 처리
(₩)
복습 큐
💡 해설
MLE는 대표적 점추정 방법으로 회귀·분류·혼합모델 등 다양한 통계·머신러닝 모델의 학습 기준 함수가 된다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q6.
'정규분포'에 대한 설명으로 가장 옳은 것은?
1
평균을 중심으로 좌우 대칭인 종 모양(Bell Curve) 연속 확률분포로, 평균과 분산 두 모수로 완전히 정의된다.
2
성공 확률 p인 베르누이 시행을 n번 반복할 때 성공 횟수의 이산 확률분포다.
3
단위 시간·면적당 발생 횟수를 모델링하는 이산 확률분포다.
4
연속 균등분포로 구간 [a,b] 내 모든 값이 동일한 확률밀도를 갖는 분포다.
정답 처리
(₩)
복습 큐
💡 해설
정규분포 N(μ,σ²)는 통계 추론의 기초이며, 표준정규분포 Z=N(0,1)은 z-점수 계산의 기준이 된다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q7.
'이동평균(Moving Average)'에 대한 설명으로 가장 옳은 것은?
1
시계열 데이터의 연속된 구간 내 평균을 구하고 이를 이동시키며 계산해 단기 변동을 평활화하고 추세를 추출하는 방법이다.
2
전체 데이터셋의 평균값을 산출하는 기술통계 방법이다.
3
여러 분류 모델을 결합해 예측 성능을 높이는 앙상블 기법이다.
4
계절 성분을 제거한 후 잔차의 자기상관을 분석하는 방법이다.
정답 처리
(₩)
복습 큐
💡 해설
이동평균은 주가·기후 등 시계열 데이터에서 노이즈를 줄이고 중기 추세를 시각화하는 기본 평활화 기법이다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q8.
다음 상황에서 가장 적절한 개념은?
카이제곱 검정으로 각 피처의 독립성을 검사하고 p-값 기준으로 상위 30개 피처를 선택했다.
1
필터 기법
2
래퍼 기법
3
임베디드 기법
4
차원축소
정답 처리
(₩)
복습 큐
💡 해설
카이제곱 검정 등 통계 지표로 모델 없이 피처를 평가·선택하는 방식이 필터 기법이다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q9.
'정규성 검정'에 대한 설명으로 가장 옳은 것은?
1
표본 데이터가 정규분포에서 추출됐는지 통계적으로 검정하는 방법으로, Shapiro-Wilk·Kolmogorov-Smirnov 검정 등이 사용된다.
2
두 집단의 분산이 동일한지 검정하는 방법이다.
3
범주형 변수 간 독립성을 교차표로 검정하는 방법이다.
4
한 변수의 자기상관 구조를 검정하는 방법이다.
정답 처리
(₩)
복습 큐
💡 해설
t-검정·ANOVA 등 모수 검정 적용 전 정규성 가정을 확인하기 위해 정규성 검정을 사전에 실시한다.
🤔
정답 확인
(Enter)
다음 문제
→
(Tab)
Q10.
'평균 대체법'에 대한 설명으로 가장 옳은 것은?
1
결측값을 해당 변수의 관측값 평균으로 채우는 단순 대체 방법이다.
2
결측값이 있는 레코드 전체를 삭제하는 방법이다.
3
다른 변수와의 회귀 관계를 이용해 결측값을 추정하는 방법이다.
4
결측 패턴에 따라 다중 데이터셋을 생성해 분석하는 방법이다.
정답 처리
(₩)
복습 큐
💡 해설
평균 대체법은 구현이 간단하지만 분산을 축소하고 변수 간 상관관계를 왜곡하는 단점이 있다.
🤔
정답 확인
(Enter)
채점 및 종료
🏁
(Tab)
홈
학습
라이브러리
프로필
전체 메뉴
✕
학습
홈
탐색
캘린더
공식자료
회원가입
로그인