투명하게 공개해요
진단 방식과 한계
점수는 추정치예요. 무엇을 어떻게 재고, 어디까지 믿을 수 있는지 그대로 적었어요.
1. 무엇을 재나요
진단은 6개 파트로 구성돼요. 결과는 SPA 평가영역 5개로 묶어서 보여 주고, 같은 데이터를 영어학 관점(듣기·문법·발음·어휘·유창성의 하위 기술)으로도 풀어 보여 줘요.
| SPA 평가영역 (추정 가중치) | 측정 방법 |
|---|---|
| 청취력과 답변 내용 (25%) | 받아쓰기 정확도 · 듣기 이해 문항(세부·요지·추론) · 질문 핵심어와 그래프 수치를 답변에 반영한 정도 |
| 어휘 사용 능력 (20%) | 말하기 답변의 어휘 다양도·긴 단어 비율·교재급 어휘 사용량 + 어휘 객관식 |
| 문장 구성 능력 (20%) | 문법 객관식 + 말하기 답변의 문법 오류 규칙 검사 + 절 연결(복문) 사용량 |
| 언어 구사력·유창성 (20%) | 실제로 말한 구간의 분당 단어 수 · 군말 비율 · 제한 시간 중 말한 비율 · 첫 마디까지의 시간 · 결론 문장 |
| 발음 (15%) | 문장 소리 내어 읽기를 음성 인식 결과와 비교한 정확도 · 인식 신뢰도 · r/l, f/p, v/b, th, 끝소리, 강세 유형별 정확도 |
2. 점수는 어떻게 계산하나요
- 영역마다 0~100점을 계산하고, 가중치를 곱해 합쳐 종합 점수(0~100)를 만든 뒤 96점 만점으로 환산해요 (× 0.96).
- 45점을 받으려면 5개 영역의 가중 평균이 약 47(=45÷96)이어야 해서, 리포트의 세로선을 47 근처에 그려요.
- 등급은 교재의 등급표를 따라요: Level 3 = 25–34, Level 4 = 35–49, Level 5 = 50–64 … 45점은 Level 4의 상단이에요.
- 측정이 부족하면(답변이 짧거나 일부 파트를 건너뜀) 추정 범위를 넓게 보여 줘요.
- “개선 폭(+점)”은 약점별 심각도에 따라, 그 영역이 45점선에 못 미치는 만큼을 나눠 배분한 추정이에요.
3. 한계 — 꼭 읽어 주세요
- 공식 점수가 아니에요. S.P.A. 시행 기관은 배점표를 공개하지 않아요. 가중치와 환산식은 교재의 등급표와 평가영역 정의를 바탕으로 잡은 추정이며, 실제 성적과 차이가 날 수 있어요. 실제 응시 결과가 쌓이면 보정할 계획이에요.
- 발음은 원어민 판정이 아니에요. 브라우저의 음성 인식이 들은 대로 적은 문장을 목표 문장과 비교해요. 인식기가 틀린 발음을 알아서 고쳐 적기도 하고, 잘 말해도 다르게 적기도 해요. 같은 소리에서 반복해서 걸릴 때만 의미가 커요.
- 문법 검사는 규칙 기반이에요. 한국인 학습자가 자주 틀리는 유형(전치사, 3인칭 -s, 시제, 관사 등)을 찾아요. 음성 인식이 문법을 고쳐 적으면 오류가 실제보다 적게 보여요. 잡히지 않았다고 정확하다는 뜻은 아니에요.
- 짧은 답변은 불안정해요. 말하기 답변이 합쳐서 80단어 미만이면 어휘·문법 추정이 흔들려요.
- 환경 영향이 있어요. 소음, 마이크 품질, 스피커 소리 유입은 받아쓰기·발음·인식 결과에 영향을 줘요. 이어폰과 조용한 환경을 권해요.
- 이 서비스는 시험 결과를 보장하지 않아요. 학습 방향을 잡는 참고 자료로 써 주세요.
4. 데이터는 어떻게 쓰이나요
녹음된 음성은 서버에 저장하지 않아요. 브라우저가 인식한 텍스트와 점수만 계정에 저장해서 리포트와 추이를 보여 줘요. 자세한 내용은 개인정보처리방침을 보세요.
5. 출처 표기
- 영어 음성: 서버 낭독 음성은 오픈소스 음성 합성 엔진 Piper(GPL-3.0)와, LibriTTS-R 말뭉치로 학습된 음성 모델(CC BY 4.0)을 사용해요. LibriTTS-R: Koizumi et al., “LibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus”, 2023. 모델은 Piper 프로젝트가 ONNX 형식으로 변환해 배포한 것을 그대로 사용해요.
- 실제 발음 영상: 구동사 스터디의 영상은 YouGlish 임베드를 통해 제공되며 영상의 저작권은 각 게시자에게 있어요.
- 문항·지문·그래프는 이 서비스를 위해 새로 작성한 것이에요.