교육평가퀴즈시험 준비

평가 생성기: 수업 자료를 퀴즈, 평가 루브릭, 진단 테스트로 변환

평가 생성기는 노트, 슬라이드, 강의 녹음에서 진단, 형성 평가, 퀴즈, 채점 루브릭을 직접 생성합니다. 작동 원리와 학습 성과를 실제로 향상시키는 검토 루프를 구축하는 방법을 알아보세요.

Notelyn Team 작성2026년 8월 1일에 게시됨9분 읽기

평가 생성기란 무엇이고 퀴즈 생성기와 어떻게 다른가

평가 생성기는 학급 자료(노트, 슬라이드, PDF, 교과서 장, 또는 강의 녹음)를 읽고 학급이 실제로 필요로 하는 모든 유형의 확인을 생성하는 도구입니다. 단원 시작 전의 짧은 진단, 단원 중간의 형성 평가 퀴즈, 마지막의 총괄 평가, 그리고 개방형 문제 채점용 루브릭입니다. 반면 퀴즈 생성기나 시험 생성기는 하나의 출력 형식을 중심으로 구축됩니다. 이러한 좁은 범위는 필요한 것을 이미 정확히 알고 있을 때는 유용하지만, 평가 유형이 변할 때마다 도구를 전환해야 한다는 의미입니다.

이러한 구분이 중요한 이유는 단일 수업이나 단원이 오직 한 가지 유형의 확인만을 필요로 하는 경우는 드물기 때문입니다. 새로운 주제를 소개하는 교사는 학생들이 이미 무엇을 알고 있는지 확인하기 위해 짧은 진단이 필요합니다. 단원을 통해 짧은 형성 평가 퀴즈는 현재의 진행 속도가 효과적인지를 보여줍니다. 마지막에 총괄 평가는 가르친 전체 내용에 대한 숙달도를 측정합니다. 객관식 이상의 것(에세이, 프로젝트, 실험 보고서)의 경우 루브릭은 채점을 시작한 후가 아니라 시작하기 전에 "좋다"가 무엇인지를 정의합니다. 평가 생성기는 각 작업을 별도로 처리하는 대신 동일한 원본 자료에서 이러한 형식 간에 이동하도록 구축되었습니다.

기본 프로세스는 다른 모든 AI 질문 생성 도구와 유사합니다. 평가 생성기는 원본 콘텐츠를 구문 분석하고, 핵심 개념, 정의 및 관계를 식별하며, 각각을 난이도와 질문 유형으로 분류합니다. 다른 점은 출력 단계입니다. 고정 형식 하나를 조립하는 대신 생성기는 개념을 요청한 평가 유형에 매핑합니다(5개 질문의 진단, 10개 질문의 형성 퀴즈, 완전한 총괄 시험, 또는 성과 수준 설명자가 있는 루브릭). 과목별 연습 문제 형식은 참/거짓 생성기빈칸채우기 생성기의 가이드를 참조하세요. 이들은 평가 생성기가 생성할 수 있는 특정 질문 유형 중 두 가지를 다룹니다.

평가 생성기는 단일 형식 도구가 아닙니다. 동일한 원본 자료를 필요한 모든 확인(진단, 형성 퀴즈, 총괄 시험, 루브릭)에 매핑합니다.
  1. 1

    원본 구문 분석

    생성기는 노트, 슬라이드, PDF 또는 강의 필사본을 읽고 테스트할 가치가 있는 개념, 정의 및 관계를 추출합니다.

  2. 2

    난이도 및 유형 분류

    각 개념은 인지 수준(회상, 이해, 적용)으로 태그되어 가장 적합한 평가 형식을 결정합니다.

  3. 3

    형식 매핑

    동일한 분류된 개념은 요청에 따라 진단, 형성 퀴즈, 총괄 시험 또는 루브릭에 매핑되며, 원본 자료를 재처리할 필요가 없습니다.

평가 생성기는 어떤 종류의 평가를 구축할 수 있는가

대부분의 교실은 단원 전체에서 4가지의 서로 다른 유형의 확인이 필요하며, 평가 생성기는 동일한 가져온 자료에서 이 4가지 모두를 생성하도록 구축되었습니다.

진단 평가는 지도가 시작되기 전에 실행됩니다. 짧습니다(5~10개 질문), 목적은 학생들을 채점하는 것이 아니라 학생들이 이미 알고 있는 것과 어디에 격차가 있는지를 드러내어 단원 교도를 시작하기 전에 속도나 강조를 조정할 수 있도록 하는 것입니다. 형성 평가는 지도 중에 실행됩니다. 짧은 종료 티켓 퀴즈, 단원 중간 확인, 또는 현재 설명이 효과적인지 실시간으로 보여주는 워밍업 질문 세트입니다. 총괄 평가는 단원이나 과정의 끝에 실행되며, 대부분의 사람들이 "시험"을 의미하는 바입니다. 가르친 전체 범위를 다루는 포괄적인 세트이며, 채점에 사용됩니다. 루브릭은 다른 3가지와는 다릅니다. 질문을 생성하는 대신 평가 생성기는 채점 구조(기준, 성과 수준, 설명자)를 구축합니다. 이는 에세이, 프레젠테이션, 실험 보고서 등 학생의 개방형 작업을 평가하는 데 사용됩니다.

이러한 각 출력은 동일한 원본 자료에서 가져올 수 있습니다. 왜냐하면 기본 개념은 변하지 않기 때문입니다. 형식과 의미만 변합니다. 주제의 진단과 동일한 주제의 총괄 시험은 동일한 개념 풀을 공유할 수 있으며, 진단은 더 쉽고 단일 개념 질문을 사용하고 총괄 시험은 적용 및 다단계 추론을 계층화합니다. 단일 질문 형식을 대규모로 필요로 하는 경우, 혼합 평가가 아닌 위의 연습 시험 생성기 가이드 및 2개의 질문 유형 가이드가 이러한 더 좁은 사용 사례를 더 자세히 다룹니다.

교실 사용이 아닌 자기 학습의 경우, 동일한 4가지 유형의 구조가 여전히 적용됩니다. 진단은 시작하기 전에 검토할 내용을 보여주고, 학습 세션 중간의 형성 확인은 효과가 있는지를 보여주며, 총괄 연습 시험은 실제 시험에 대비할 준비가 되었는지를 보여줍니다.

동일한 개념 풀은 진단, 형성 확인, 총괄 시험을 생성할 수 있습니다. 난이도와 의미만 변합니다. 평가 생성기를 사용하면 단일 가져온 원본을 이 세 가지 모두에 재사용할 수 있습니다.
  1. 1

    진단

    지도 전에 실행되는 짧고 저위험의 확인으로, 사전 지식과 격차를 드러냅니다. 계획하기 위해 사용되며, 채점하기 위한 것이 아닙니다.

  2. 2

    형성 확인

    지도 중에 실행되는 짧은 퀴즈 또는 종료 티켓입니다. 이해도가 교도 진행 속도와 동보하는지 확인합니다.

  3. 3

    총괄 시험

    단원이나 과정의 끝에 실시되는 포괄적인 평가로, 가르친 전체 자료를 다루며 채점에 사용됩니다.

  4. 4

    루브릭

    기준과 성과 수준이 있는 채점 구조로, 에세이, 프로젝트, 프레젠테이션 등의 개방형 작업을 일관되게 채점하는 데 사용됩니다.

평가 생성기는 채점용 루브릭을 어떻게 구축하는가

루브릭은 질문 기반 평가와는 다른 문제를 해결합니다. 객관식 시험은 항목당 하나의 정답을 가집니다. 에세이, 실험 보고서 또는 프로젝트는 많은 가능한 수용 가능한 답변을 가지며, 30명의 학급에 걸친 채점 일관성 또는 채점되지 않은 논문 더미는 사후가 아니라 사전에 정의된 기준을 갖는 것에 달려 있습니다.

평가 생성기는 먼저 원본 자료에 포함된 학습 목표(과제가 실제로 측정하려는 기술 또는 개념이지, 단순한 주제 레이블이 아님)를 식별하여 루브릭을 구축합니다. 그 다음 일반적으로 3~5개의 작은 기준 세트를 정의하며, 각각은 작업의 한 가지 차원을 다룹니다. 예를 들어 에세이 과제의 경우 주장의 명확성, 증거 사용, 구성, 기계성입니다. 각 기준에 대해 생성기는 성과 수준 설명자를 작성합니다. 일반적으로 4개 수준으로, "좋음" 또는 "요개선" 같은 모호한 레이블이 아닌 구체적이고 관찰 가능한 용어로 상위 점수 응답을 개발 중인 응답과 구분하는 것을 설명합니다.

루브릭에 대한 Wikipedia 항목)은 동일한 구조(기준 및 성과 수준)을 교육 연구에서 사용되는 표준 형식으로 설명합니다. 이는 루브릭 기반 채점을 채점자 간에 재현 가능하게 만들고 한 과제에서 다음 과제까지 일관성이 있기 때문입니다.

생성된 루브릭은 최종 문서가 아니라 출발점입니다. 실제 과제 지시문에 대해 검토하고, 생성된 질문 또는 루브릭 기준을 검토하여 필요한 조정을 하고, 생성기가 놓친 주제에 항목을 추가합니다. 채점 후가 아니라 학생이 과제를 시작하기 전에 학생과 루브릭을 공유하는 것이 채점 도구에서 교도 도구로 변하는 이유입니다. 학생들은 당신이 찾는 것을 추측하는 대신 볼 수 있는 기준을 향해 글을 씁니다.

과제의 학습 목표에서 생성된 루브릭은 채점 기준을 학생 작업을 읽은 후가 아니라 전에 정의하는 것으로 변환합니다.

학습을 실제로 향상시키는 평가 검토 루프를 어떻게 실행하는가

평가 생성기는 개별 확인을 생성하지만, 학습을 전진시키는 워크플로는 이러한 확인이 형성하는 루프입니다. 진단, 교도, 확인, 조정, 재시험. 평가 생성기를 사용하여 하나의 퀴즈를 격리하여 생성하는 것은 스냅샷을 얻습니다. 단원 전체의 루프로 실행하면 평가는 단순히 이를 측정하는 것이 아니라 더 나은 결과를 추진하는 것으로 변합니다.

루프는 단원 전 진단으로 시작됩니다. 결과는 어떤 개념이 더 많은 시간을 필요로 하고 어떤 학급이 이미 이해하고 있는지를 보여줍니다. 학생들이 이미 알고 있는 것에 관계없이 모든 주제를 같은 깊이로 가르치는 대신 수업 계획을 조정합니다. 도중에 형성 확인은 조정된 속도가 효과적인지를 확인합니다. 학급의 대부분이 같은 질문을 놓친 경우, 이는 진행하기 전에 그 특정 개념을 재교도하기 위한 신호입니다. 채점을 기록하는 대신입니다. 단원 끝에 총괄 시험은 전체 범위에 대한 숙달도를 측정하고, 그 결과는 다음 단원의 진단에 직접 공급됩니다. 지속적인 격차가 있는 주제는 새로운 자료가 그 위에 구축되기 전에 검토에 포함됩니다.

이 루프는 교육 연구자들이 형성 평가라고 부르는 것을 반영합니다. 최후가 아니라 실시간에 교도를 조정하기 위해 평가 데이터를 사용합니다. 형성 평가에 대한 Wikipedia 요약은 상당한 연구 본문을 설명합니다. 가장 주목할 만한 것은 Black과 Wiliam의 검토로, 빈번한 저위험 확인과 피드백 루프를 사용하는 교실은 단원 종료 시험에만 의존하는 교실보다 측정 가능하게 더 나은 결과를 보았다는 것입니다.

이 루프를 실행하기 위한 실질적인 요구 사항은 각 확인을 생성하는 것이 실제 교도 시간과 경쟁하지 않을 속도여야 한다는 것입니다. 진단을 구축하는 데 수업 자체를 작성하는 것만큼 오래 걸리면 루프는 정상 업무량 하에서 일주일 또는 이주 후에 분해됩니다. 이는 평가 생성기가 각 확인을 손으로 구축하는 것보다 가진 주요 장점입니다. 진단, 형성 퀴즈, 총괄 시험은 모두 동일한 가져온 자료에서 가져오므로, 루프의 각 새로운 확인은 완전한 계획 세션이 아니라 몇 분이 걸립니다.

형성 평가에 관한 Black과 Wiliam의 연구는 빈번한 저위험 확인과 피드백 루프를 사용하는 교실이 단원 종료 시험에만 의존하는 교실보다 측정 가능하게 더 나은 결과를 보았다는 것을 발견했습니다.
  1. 1

    단원 전에 진단하기

    짧은 진단 평가를 실행하여 교도가 시작되기 전에 학생들이 이미 무엇을 알고 있고 어디에 격차가 있는지 확인합니다.

  2. 2

    수업 계획 조정하기

    진단 결과를 사용하여 실제로 약한 영역에 더 많은 시간을 보내고 학생들이 이미 이해하는 자료를 더 빠르게 진행합니다.

  3. 3

    단원 중간에 이해도 확인하기

    단원 중간에 짧은 형성 평가를 실행합니다. 학급 전체의 같은 틀린 답변은 즉시 재교도할 개념을 나타냅니다.

  4. 4

    시험 실시 및 숙달도 측정하기

    단원 끝에 총괄 평가를 실행하여 가르친 전체 내용을 다룹니다.

  5. 5

    격차를 다음 진단으로 이어가기

    지속적인 오류가 있는 주제를 다음 단원의 진단에 포함하여 새로운 자료가 그 위에 구축되기 전에 강화되도록 합니다.

Notelyn의 평가 생성기는 어떻게 작동하는가

Notelyn의 평가 생성기는 워크스페이스에 가져오는 모든 것에서 작동합니다. 입력한 노트, PDF 장, 슬라이드 데크, 강의 오디오 또는 비디오, 또는 손으로 쓴 자료의 이미지입니다. 가져오기 단계는 전체 플랫폼에서 공유되므로 AI 요약 및 플래시카드를 생성하는 동일한 원본은 평가 생성기가 가져오는 것이기도 합니다. 각 평가 유형에 대한 별도의 업로드 단계는 없습니다.

자료를 가져온 후 해당 원본에서 진단, 형성 퀴즈, 완전한 총괄 시험 또는 루브릭을 직접 생성할 수 있습니다. 질문 형식에는 객관식, 참/거짓, 단답형, 빈칸채우기가 포함되며, 생성 전에 혼합 및 길이를 조정할 수 있으므로 5개 질문 워밍업과 40개 질문 최종 시험 모두 동일한 기본 개념 풀에서 올 수 있습니다. 루브릭의 경우, 생성기는 자료에 포함된 목표와 연결된 기준 및 성과 수준 설명자를 생성하며, 이는 학생과 공유하기 전에 편집할 수 있습니다.

생성된 모든 평가에는 각 항목의 짧은 설명이 포함된 답안지가 포함되어 있으며, 원본 콘텐츠에 다시 연결되어 있습니다. 결과를 검토하면 별도의 학습 단계가 아니라 대상이 지정된 재읽기로도 이중으로 작동합니다. 학생이나 자신이 퀴즈 모드에서 평가를 완료한 후, 주제 수준의 결과 분류는 오류가 어디에 클러스터되었는지를 표시합니다. 이는 검토 루프의 다음 진단이 필요로 하는 정확한 입력입니다.

Notelyn은 모든 것(노트, 요약, 플래시카드, 생성한 모든 평가)을 하나의 워크스페이스에 유지하므로 이전 가이드의 진단-교도-확인-재시험 루프를 실행하기 위해 매번 자료를 다시 업로드할 필요가 없습니다. 한 번 가져온 후 단원의 다음 단계가 요구하는 모든 평가 유형을 생성합니다.

Notelyn의 평가 생성기는 모든 형식(진단, 형성, 총괄, 루브릭)에서 동일한 가져온 노트, PDF, 녹음에서 가져오므로 아무것도 두 번 업로드할 필요가 없습니다.
  1. 1

    수업 자료 가져오기

    노트, PDF, 슬라이드, 강의 녹음 또는 이미지를 업로드합니다. Notelyn은 모든 형식을 처리하고 기본 개념을 자동으로 추출합니다.

  2. 2

    평가 유형 선택하기

    진단, 형성 퀴즈, 총괄 시험 또는 루브릭을 선택합니다. Notelyn은 어떤 형식을 선택하든 동일한 가져온 개념에서 가져옵니다.

  3. 3

    길이 및 질문 혼합 설정하기

    질문 수 및 형식 혼합(객관식, 참/거짓, 단답형, 빈칸채우기)을 조정하여 평가의 목적에 맞춥니다.

  4. 4

    공유 전에 검토 및 편집하기

    생성된 질문 또는 루브릭 기준을 확인하고, 조정이 필요한 항목을 편집하며, 생성기가 놓친 주제의 항목을 추가합니다.

  5. 5

    결과를 사용하여 다음 확인 계획하기

    평가가 완료된 후, 주제 수준의 분류를 검토하고 루프의 다음 평가가 초점을 맞춰야 할 내용을 결정하는 데 사용합니다.

평가 생성기로 시작하기

평가 생성기는 단일 퀴즈를 생성하기 위한 도구로 생각하는 것을 멈추고 단원이 실제로 필요로 하는 전체 평가 주기를 실행하기 시작할 때 가장 유용합니다. 교도 전 진단, 도중 형성 확인, 끝의 총괄 시험, 그리고 객관식이 아닌 모든 루브릭입니다. 이들 각각은 다른 목적을 가지며, 4개의 별개 작업이 아닌 하나의 연결된 루프로 처리하는 것이 평가를 단순히 측정하는 것이 아니라 그 순간에 교도를 향상시키는 것으로 변하는 이유입니다.

평가 생성기를 사용해본 적이 없다면 작게 시작하세요. 단일 예정된 단원의 자료를 가져온 후 진단만 생성합니다. 그것이 드러내는 것을 사용하여 첫 번째 수업을 조정하고, 다음에는 단원을 통해 형성 확인을 생성한 후, 끝에 도달했을 때 총괄 시험을 생성합니다. 완전한 루프를 한 번 실행했으며, 이후의 각 단원은 패턴이 설정되었기 때문에 더 빨라집니다.

자기 학습 사용의 경우, 동일한 구조가 더 작은 규모에 적용됩니다. 주제 검토를 시작하기 전의 짧은 진단, 학습 세션 중간의 짧은 형성 확인, 시험 전의 완전한 연습 시험입니다. Notelyn의 평가 생성기는 동일한 가져온 콘텐츠에서 교실 및 자기 학습 워크플로를 지원하므로, 루프는 30명의 학급을 교도하고 있든 자신의 최종 시험에 대비하고 있든 작동합니다.

평가 생성기를 단일 도구가 아닌 루프로 생각하세요. 진단, 교도, 확인, 시험, 그리고 격차를 다음 단원으로 이어갑니다.

관련 글

이 기능 사용해 보기

사용 사례 탐색

AI로 더 나은 노트 작성

Notelyn은 강의, 회의 및 PDF를 자동으로 구조화된 노트, 플래시카드 및 퀴즈로 변환합니다.