설문 24행에서
믿을 수 있는 숫자 뽑기.
같은 자료에서 71.4%도 62.5%도 나옵니다. 분모를 무엇으로 잡았는지 밝히고, 중복·누락·범위 오류를 각각 세어 결과를 검증합니다.
설문 24행에서 "몇 퍼센트"를 뽑습니다
질문은 하나입니다. "만족도 4~5점 비율은 몇 퍼센트인가?" 답이 네 가지로 갈립니다. 갈리는 이유는 분모입니다.
먼저 CSV를 직접 열어 봅니다
엑셀이나 메모장으로 survey.csv를 여세요. 머리글을 빼고 24행입니다. 아래 세 줄을 눈으로 찾아보세요.
| 찾을 것 | 어디에 | 무엇이 문제인가 |
|---|---|---|
R21,A,,오전 | 21번째 응답 | 만족도 칸이 비어 있습니다 — 누락 |
R22,B,6,오후 | 22번째 응답 | 만족도가 6점입니다 — 유효 범위는 1~5 |
R05,B,5,오후 | 2번째와 맨 마지막 줄 | 같은 행이 두 번 있습니다 — 완전 중복 |
· 완전히 같은 행이 두 번 있으면? (기준: 첫 행만 남깁니다)
· 만족도가 비어 있거나 1~5 밖이면? (기준: 평균·분포 계산에서 빼고, 건수는 따로 보고합니다)
· 평균과 비율의 분모는 무엇으로? (기준: 유효 만족도 응답 수)
같은 자료, 네 가지 답
아래 네 숫자는 모두 이 CSV에서 나올 수 있습니다. 어느 것이 맞는지는 무엇을 분모로 잡았는가로 정해집니다.
| 답 | 분모 | 어떻게 나온 값인가 | 이 수업 기준 |
|---|---|---|---|
| 71.4% | 21 | 중복 1행을 빼고, 누락 1·범위 오류 1도 뺀 유효 응답 | 통과 |
| 65.2% | 23 | 중복만 빼고 누락·범위 오류는 그대로 셈 | 오답 |
| 62.5% | 24 | 아무것도 빼지 않은 원본 전체 행 | 오답 |
| 그 밖의 값 | — | 누락을 0점으로 바꾸거나 6점을 그대로 더한 경우 | 오답 |
중요한 것은 분모를 밝히고 일관되게 쓰는 것입니다. 이 수업의 데이터 사전은 유효 응답 21을 분모로 정해 두었습니다. 다른 분모를 쓰려면 그 사실을 결과에 적어야 합니다. 분모를 안 밝힌 퍼센트는 검증할 수 없습니다.
이 자료의 기준값
| 항목 | 값 | 설명 |
|---|---|---|
| 전체 행 | 24 | 머리글 제외 |
| 완전 중복 행 | 1 | R05가 그대로 한 번 더 |
| 중복 제거 후 | 23 | 서로 다른 응답 |
| 누락 | 1 | R21의 만족도가 빈칸 |
| 범위 오류 | 1 | R22의 만족도가 6 |
| 유효 만족도 응답 | 21 | 평균·분포·비율의 분모 |
| 만족도 합 | 83 | |
| 평균 | 3.95 | 소수 둘째 자리, 분모 21 |
| 4~5점 | 15명 · 71.4% | 소수 첫째 자리, 분모 21 |
위 값은 제작할 때 CSV에서 직접 계산해 확인한 것입니다. 모델의 성능을 측정한 값이 아닙니다. 분포는 1점 0명 / 2점 2명 / 3점 4명 / 4점 8명 / 5점 7명입니다.
기준을 요청 안에 적어서 보냅니다
CSV와 데이터 사전을 함께 첨부합니다
두 파일을 함께 넣습니다. 사전이 없으면 무엇이 유효한 값인지 알 수 없습니다.
survey-summary 스킬을 사용해 첨부한 survey.csv를 집계해 주세요. DATA_DICTIONARY.md의 기준을 따라 주세요. - 전체 행 / 완전 중복 행 / 중복 제거 후 행 / 누락 / 범위 오류 / 유효 만족도 응답을 각각 세어 주세요. - 평균과 비율의 분모를 결과에 밝혀 주세요. - 누락과 범위 오류를 0점으로 바꾸지 마세요. - 만족도 분포를 1~5점별 건수로 알려 주세요. - 평균은 소수 둘째 자리, 비율은 소수 첫째 자리로 적고 건수도 함께 적어 주세요.
여섯 개 숫자를 맞춰 봅니다
02단계의 기준값 표와 하나씩 비교합니다. 하나라도 다르면 멈추고 어디서 갈렸는지 찾습니다.
| 확인할 것 | 기준값 | 틀렸다면 |
|---|---|---|
| 전체 행 | 24 | CSV를 다 읽지 못했을 수 있습니다 |
| 완전 중복 | 1 | R05를 못 찾았거나, 다른 행을 중복으로 봤습니다 |
| 누락 | 1 | R21의 빈칸을 0으로 읽었을 수 있습니다 |
| 범위 오류 | 1 | R22의 6점을 그대로 유효로 셌을 수 있습니다 |
| 유효 응답(분모) | 21 | 여기가 틀리면 아래 값이 전부 틀립니다 |
| 평균 / 4~5점 비율 | 3.95 / 71.4% | 분모를 먼저 확인하세요 |
분모를 밝혔는지 확인합니다
결과에 "분모 21" 또는 "유효 응답 21명 기준"이라는 말이 있어야 합니다. 그냥 "71.4%"만 있으면 반쪽짜리입니다.
방금 계산한 평균과 비율의 분모가 각각 몇인지, 그 분모에서 무엇을 제외했는지 알려 주세요. 제외한 행의 응답ID도 함께 적어 주세요.
여기까지 됐는지 확인
분모를 일부러 바꿔 보고 차이를 봅니다
분모를 바꿔 다시 계산시킵니다
같은 자료로 분모를 바꿔 다시 계산해 주세요. 분모를 23(중복 제거 후 전체)으로 하면 4~5점 비율이 얼마가 되는지, 분모를 24(원본 전체 행)로 하면 얼마가 되는지 각각 알려 주세요. 어느 쪽이 데이터 사전의 기준에 맞는지도 함께 적어 주세요.
요약 문장의 숫자를 표와 맞춰 봅니다
집계 결과를 세 문장으로 요약해 주세요. 각 숫자마다 분모와 건수를 함께 적고, 표의 값과 다른 숫자를 쓰지 마세요. 이 설문이 전체 참여자를 대표한다고 쓰지 마세요. 24행짜리 교육용 가상 자료입니다.
기준 예시와 대조합니다
기준 예시에 자주 나오는 오답 네 가지가 정리되어 있습니다. 여러분의 결과가 그중 하나에 해당하는지 확인해 보세요.
여기까지 됐는지 확인
다른 설문에도 같은 기준이 통하나요?
새 설문에는 이전 사전에 없던 값이 들어 있습니다. 그대로 밀어붙이면 틀립니다.
먼저 열어서 무엇이 다른지 봅니다
응답ID,조,만족도,선호시간 N01,D,2,저녁 N02,D,3,저녁 N03,E,4,오전 N04,E,5,오전
| 항목 | 앞 설문 | 새 설문 |
|---|---|---|
| 조 | A / B / C | D / E |
| 선호시간 | 오전 / 오후 | 오전 / 저녁 |
| 행 수 | 24 | 4 |
| 중복·누락·범위 오류 | 각각 있음 | 없음 |
새 대화에서 집계합니다
첨부한 new-survey.csv만 사용해 집계해 주세요. 앞선 대화의 설문 자료나 숫자는 사용하지 마세요. 이 파일에 실제로 나오는 조와 선호시간 값을 그대로 써 주세요. 이전 설문의 분류로 바꾸지 마세요. 만족도 처리 규칙(1~5 유효, 누락·범위 오류 제외, 완전 중복은 첫 행만)은 그대로 적용해 주세요.
| 확인할 것 | 기준값 |
|---|---|
| 전체 행 | 4 |
| 유효 만족도 응답 | 4 (중복·누락·범위 오류 없음) |
| 합계 / 평균 | 14 / 3.50 |
| 4~5점 | 2명 · 50.0% |
| 선호시간 값 | 오전 · 저녁 |
| 조 값 | D · E |
여기까지 됐는지 확인
5분 발표에 넣을 네 문장
| 말할 것 | 우리 조가 적을 것 |
|---|---|
| ① 정한 기준 | 평균과 비율의 분모를 ______으로 정했습니다. |
| ② 나온 결과 | 평균 ____, 4~5점 비율 ____%입니다. |
| ③ 직접 확인한 것 | CSV에서 ______ 행을 눈으로 찾아 확인했습니다. |
| ④ 확인하지 못한 것 | ______는 자료만으로는 확인할 수 없었습니다. |
④의 예: "R21의 만족도가 왜 비어 있는지", "R22의 6점이 입력 실수인지 다른 척도인지"는 이 CSV만으로 알 수 없습니다.
이해 확인
1. 만족도가 비어 있는 응답 1건을 0점으로 바꿔 평균을 냈습니다. 무엇이 문제인가요?
2. 보고서에 "만족도 4~5점 71.4%"라고만 적혀 있습니다. 무엇이 빠졌나요?
3. 새 설문에 "저녁"이라는 선호시간이 나옵니다. 이전 사전에는 오전/오후만 있습니다.