제1유형의 모의문제 입니다.
다양한 문제를 많이 풀어보는 것이 시험에 가장 큰 도움이 되기에 아래 문제들도 꼭 풀어보시기 바랍니다.

[문제 1번]
① f1 컬럼의 결측치는 중앙 값으로 대체
② 나머지 결측치가 있는 데이터(행)을 모두 제거
③ 앞에서부터 70% 데이터 중 views 컬럼의 3사분위 수에서 1사분위 수를 뺀 값을 구하시오.
(단, 데이터 70% 지점은 정수형(int) 변환)
(100, 10)
id 0
age 0
city 0
f1 31
f2 0
f3 28
f4 0
f5 0
subscribed 0
views 4
dtype: int64
(72, 10)
50
3261.0
[문제 2번]
① 주어진 데이터에서 결측치가 30% 이상인 컬럼을 A, 결측치가 30% 미만, 20% 이상인 컬럼을 B라고 가정
② A에 해당하는 컬럼은 결측치가 있는 데이터(행)를 삭제
③ B에 해당하는 컬럼은 결측치를 최빈값으로 대체
④ 'f3'컬럼의 'gold' 값을 가진 데이터 수를 구하시오.
id 0
age 0
city 0
f1 31
f2 0
f3 28
f4 0
f5 0
subscribed 0
views 4
dtype: int64
30.0
(100, 10)
(69, 10)
id 0
age 0
city 0
f1 0
f2 0
f3 0
f4 0
f5 0
subscribed 0
views 2
dtype: int64
56
[문제 3번]
① views 컬럼에 결측치가 있는 데이터(행)을 삭제
② f3 컬럼의 결측치는 0, silver는 1, gold는 2, vip는 3 으로 변환
③ f3 컬럼의 총 합을 정수형으로 출력하시오.
(100, 10)
(96, 10)
133
[문제 4번]
① 주어진 데이터에서 자료형(type)이 object인 컬럼은 삭제
② 결측치는 0으로 대체
③ 행 단위로 더하기
④ 그 값이 3000보다 큰 값의 데이터 수를 구하시오. ('age', 'f1', 'f2', 'f5', 'views'의 각 행별 합)
<class 'pandas.core.frame.DataFrame'>
RangeIndex: 100 entries, 0 to 99
Data columns (total 10 columns):
# Column Non-Null Count Dtype
--- ------ -------------- -----
0 id 100 non-null object
1 age 100 non-null float64
2 city 100 non-null object
3 f1 69 non-null float64
4 f2 100 non-null int64
5 f3 72 non-null object
6 f4 100 non-null object
7 f5 100 non-null float64
8 subscribed 100 non-null object
9 views 96 non-null float64
dtypes: float64(4), int64(1), object(5)
memory usage: 7.9+ KB
<class 'pandas.core.frame.DataFrame'>
RangeIndex: 100 entries, 0 to 99
Data columns (total 5 columns):
# Column Non-Null Count Dtype
--- ------ -------------- -----
0 age 100 non-null float64
1 f1 69 non-null float64
2 f2 100 non-null int64
3 f5 100 non-null float64
4 views 96 non-null float64
dtypes: float64(4), int64(1)
memory usage: 4.0 KB
0 6913.297791
1 2674.339826
2 7418.252986
3 622.667078
4 1478.269869
...
95 8909.297791
96 4534.667078
97 6854.886373
98 1062.429899
99 6235.381034
Length: 100, dtype: float64
73
[문제 5번]
IQR을 활용해 views 컬럼의 이상치를 찾고, 이상치 데이터 개수를 구하시오.
4
[문제 6번]
① 'age' 컬럼의 이상치(소수점 나이와 0과 음수 나이)를 제거
② 제거 전 후의 views 컬럼 표준편차를 더하시오.
(최종 결과 값은 소수 둘째자리까지 출력, 셋째자리에서 반올림)
(100, 10)
(96, 10)
(90, 10)
8420.69
[문제 7번]
① index '2001' 데이터(행)의 평균보다 큰 값의 개수
② index '2003' 데이터(행)의 평균보다 작은 값의 개수를 더하시오.
202
[문제 8번]
① 결측 값을 가진 데이터는 바로 뒤에 있는 값으로 대체
(바로 뒤가 결측값이라면 뒤에 있는 데이터 중 가장 가까운 값)
② city와 f2 컬럼 기준으로 그룹합을 계산
③ views가 세번째로 큰 city(도시) 이름은?
대구
[문제 9번]
① 구독(subscribed)의 월별 데이터 개수
② 가장 작은 구독 수가 있는 월을 구하시오.
11
[빅데이터분석기사/실기] 제1유형. 판다스 실습 - 날짜 변환
제1유형의 날짜를 변환하는 실습 내용입니다.날짜 및 시각 형식 변환, 날짜 계산, 기간 계산 등 날짜에 관한 다양한 유형들이 있습니다. 문1-1. Date1 형식 변환 (2024-02-17)print(df['Date1'])df['Date1'] = pd.t
dataslog.tistory.com
[빅데이터분석기사/실기] 제1유형. 판다스 실습 - 날짜 변환
제1유형의 날짜를 변환하는 실습 내용입니다.날짜 및 시각 형식 변환, 날짜 계산, 기간 계산 등 날짜에 관한 다양한 유형들이 있습니다. 문1-1. Date1 형식 변환 (2024-02-17)print(df['Date1'])df['Date1'] = pd.t
dataslog.tistory.com
[빅데이터분석기사/실기] 제1유형. 판다스 실습 - 조건필터, 결측치 처리, 통계분석, 데이터 개수
제1유형의 기초 학습에 이어,이번에는 실제 문제 유형을 풀어보는 실습에 대한 내용입니다.응용력이 중요하기 때문에, 다양한 문제를 많이 풀어보는 것이 합격하는데 가장 큰 도움이 되는 것 같
dataslog.tistory.com
[빅데이터분석기사/실기] 제1유형. 판다스 기초 - 데이터 불러오기/추가/삭제/정렬, 인덱싱/슬라
빅데이터분석기사 실기 문제는 3가지 유형이 있습니다. 먼저, 제1유형은 데이터 전처리에 대한 문제이며, 총 3문제가 출제됩니다.주어진 데이터셋에 대해 결측치 처리, 이상치 제거, 컬럼 생성,
dataslog.tistory.com
'빅데이터 분석기사 > 실기 요약' 카테고리의 다른 글
| [빅데이터분석기사/실기] 제2유형. 평가지표 (0) | 2025.06.08 |
|---|---|
| [빅데이터분석기사/실기] 제2유형. 머신러닝 및 평가지표 (0) | 2025.06.08 |
| [빅데이터분석기사/실기] 제1유형. 판다스 실습 - 문자열 (0) | 2025.06.06 |
| [빅데이터분석기사/실기] 제1유형. 판다스 실습 - 날짜 변환 (0) | 2025.06.06 |
| [빅데이터분석기사/실기] 제1유형. 판다스 실습 - 조건필터, 결측치 처리, 통계분석, 데이터 개수확인 (0) | 2025.05.26 |