더에듀 | 객관식이 교육개혁의 심판대에 올랐다.
이재명 대통령은 지난 8월 5일 교육부와 국가교육위원회 업무보고에서 초보 컴퓨터도 쉽게 답할 수 있는 객관식 수능을 계속할 것이냐고 물으며, AI 시대에 필요 없는 것을 가르치고 학생을 규격화하는 것은 아이들을 망치는 것 같다고 말했다.
최교진 교육부 장관도 앞서 “AI 시대를 표방하면서도 학생을 계속 오지선다형 객관식으로 평가한다는 건 적절치 않다”며 학생이 직접 분석하고 글을 쓰는 서·논술형 평가가 미래 시대의 주역을 키우는 데 맞는 방향이라고 밝혔다. 국가교육위원회도 수능 서·논술형 도입 여부를 대입개편 의제로 검토하고 있다.
세 기관의 표현에는 공통된 방향이 있다. 객관식에는 암기, 문제풀이, 규격화, 낡은 평가라는 부정적 이미지가 붙고, 서·논술형에는 사고, 질문, 창의성, 미래역량이라는 긍정적 가치가 놓인다. 평가방법의 차이가 어느 순간 사실과 기능의 차이가 아니라 과거와 미래, 낡음과 혁신을 가르는 가치대립으로 바뀐 것이다.
이는 평가방법의 ‘이념화’에 가깝다. 여기서 말하는 이념화는 정치적 이념이라는 뜻이 아니다. 본래 무엇을 측정하려는지, 어떤 기능을 수행해야 하는지에 따라 선택해야 할 평가도구가 특정한 교육가치와 결합해 선악의 대립항처럼 굳어지는 현상을 말한다.
이런 이분법이 반복되면 평가방법은 더 이상 하나의 측정도구에 머물지 않고 특정한 교육철학과 가치지향을 상징하는 언어가 된다. 무엇을 실제로 측정하고 어떤 조건에서 효과적인가보다, 어떤 가치를 대표하는가가 먼저 판단의 기준이 되기 쉽다.
객관식은 언제부터 학생의 사고를 망치는 평가방법이 되었고, 서·논술형은 언제부터 사고력을 기르는 평가방법이 되었는가.
평가방법에도 선과 악이 있는가
문제는 서·논술형 평가 자체가 아니다. 학생이 자신의 생각을 구성하고 근거를 들어 설명하며 문제해결 과정을 드러내게 하는 평가는 학습에서 중요하다. 학교에서도 이미 서·논술형 평가와 수행평가를 시행하고 있다.
문제는 평가방법에 가치가 먼저 붙고 있다는 데 있다. 평가방법은 무엇을 측정하려는가에 따라 선택하는 도구다. 그런데 지금의 정책담론에서는 객관식은 과거의 평가이고 서·논술형은 미래의 평가라는 식으로 평가형식 자체가 교육의 가치를 대표하기 시작했다. 그러나 문항의 응답형식과 그 문항이 요구하는 사고수준은 같은 개념이 아니다.
미국의 국가학업성취도평가 NAEP는 이를 분명하게 보여준다. 선택형과 구성형 문항을 함께 사용하면서, 문항의 응답형식과 학생에게 요구되는 사고수준을 별개의 차원으로 다룬다. 선택형이라고 저차 사고, 서술형이라고 고차 사고로 간주하지 않는다. 이 글에서는 한국 정책당국이 주로 사용하는 표현에 따라 선택형 문항을 ‘객관식’으로 통칭한다.
프랑스 교육부도 선다형과 개방형 문항을 각각 장단점이 다른 평가방법으로 다루고, IB 역시 에세이·단답형·자료응답형뿐 아니라 객관식 문항도 목적에 따라 사용한다. 어느 한 평가방법에 ‘낡은 평가’라는 부정적 가치를, 다른 평가방법에 ‘미래의 평가’라는 긍정적 가치를 부여해 둘을 선악의 대립항으로 놓는 방식이 아니다.
평가방법은 측정하려는 능력과 시험의 목적에 따라 선택하고 조합하는 도구다. 그렇다면 문제는 다시 원점으로 돌아온다. 왜 한국에서는 평가방법의 차이가 어느 순간 교육의 가치 차이로 바뀌었는가.
반복된 정책언어는 어떻게 사실처럼 굳어졌나
그 과정은 하루아침에 만들어진 것이 아니다. 2009년 이후 경기혁신학교를 비롯한 혁신교육은 경쟁과 서열 중심의 교수·평가체제를 비판하며 과정과 성장에 주목하는 평가를 강조했다.
2015 개정 교육과정은 핵심역량과 과정중심평가를 국가교육과정의 주요 언어로 확장했고, 2018년 교육부 정책문서에서는 서·논술형·과정중심평가를 학생의 창의력과 문제해결력 함양과 직접 연결했다.
2019년 이후 일부 시·도교육청에서 IB가 미래형 교수학습의 모델로 확산되면서 질문·탐구·토론·서술형 평가와 미래역량의 연결은 더욱 강해졌다. 여기에 생성형 AI가 등장하면서 질문과 비판적 사고가 인간에게 필요한 핵심역량으로 강조됐고, 2026년 교육부 업무계획에서는 ‘AI 시대에 필요한 질문하는 힘, 비판적 사고력’을 기르기 위한 수단으로 ‘질문중심 수업과 서·논술형 평가 확대’가 하나의 정책문장 안에 놓였다.
이렇게 약 15년 동안 경쟁·서열 비판, 과정중심평가, 서·논술형, 창의력·문제해결력, IB·미래교육, AI 시대의 질문·비판적 사고가 하나의 방향으로 반복해서 연결됐다. 그 과정에서 서로 다른 개념들은 하나의 정책적 가치사슬로 묶였고, 반복된 정책언어는 어느 순간 검증된 사실처럼 굳어졌다.
그러나 이 연결은 주장 하나가 아니라 서로 다른 여러 개의 명제로 이루어져 있다.
객관식이라는 응답형식이 실제로 암기능력만을 측정하는가. 문제를 많이 푸는 것이 학생의 사고력을 떨어뜨리는가. 서·논술형이 사고력을 더 잘 측정할 수 있다는 것과, 서·논술형 평가를 확대하면 학생의 사고력이 실제로 길러진다는 것은 같은 명제인가.
각각 별도의 검증이 필요하다. 특히 측정하는 것과 기르는 것은 다른 일이다. 학생의 사고력을 측정하는 데 서·논술형이 유용하다는 사실이 확인되더라도, 그것만으로 서·논술형 시험을 확대하면 사고력이 향상된다는 결론은 나오지 않는다.
정책언어의 반복이 위험한 이유는 검증해야 할 명제를 더 이상 질문하지 않는 상식으로 만들 수 있기 때문이다. 그러나 반복된 정책가설이 곧 사실이 되는 것은 아니다.
그렇다면 이제 실제 결과를 봐야 한다.
객관식과 문제풀이 중심 교육이 한국 학생의 사고력을 실제로 떨어뜨려 왔다는 정부의 정책진단이 맞다면, 한국 학생들이 사고력 평가에서 어떤 결과를 보였는지도 설명할 수 있어야 한다.
한국 학생의 창의적 사고 성취는 낮지 않았다
OECD가 PISA 2022에서 처음으로 별도 평가한 ‘창의적 사고(creative thinking)’에서 한국 학생의 평균점수는 38점으로 OECD 평균 33점보다 높았다. 최상위 수준인 Level 5·6 학생도 46%로 OECD 평균 27%를 크게 웃돌았다. OECD는 한국 학생의 창의적 사고 성취가 수학과 읽기 성취수준으로 예상되는 것보다도 높았다고 분석했다.
이 결과가 한국 교육에 문제가 없다는 뜻은 아니다. 그러나 국가가 객관식·문제풀이 중심 교육이 학생의 사고를 저해해 왔다고 진단한다면, PISA가 보여준 높은 창의적 사고 성취와 그 진단이 어떻게 함께 성립하는지 설명해야 한다.
더구나 PISA 역시 평가방법을 선악으로 나누지 않고, 평가목적에 따라 선택형과 구성형을 함께 활용한다. 사고의 수준과 답을 쓰는 형식이 일대일로 대응하는 것이 아니라는 점에서는 NAEP와 다르지 않다.
다만 여기에는 또 하나의 구분이 필요하다. PISA와 미국 NAEP는 수능과 같은 대학선발시험이 아니다. 이들 평가는 학생 개인의 합격과 불합격을 결정하기 위한 시험이 아니다. 따라서 이 사례가 보여주는 것은 객관식을 사용하면서도 고차적 사고를 측정할 수 있다는 사실이지, 서·논술형을 수십만 명의 당락을 결정하는 국가 대입시험에 도입해도 된다는 근거는 아니다.
사고력을 측정하는 데 좋은 문항과 학생을 선발하는 데 좋은 시험은 같은 것인가. 이 질문 역시 별도로 검증되어야 한다.
학교에서는 이미 서·논술형을 하고 있다
여기서 더 근본적인 질문이 생긴다. 서·논술형 평가가 학교에 없어서 수능에 도입하려는 것이 아니다. 학교에서는 이미 서·논술형 평가를 시행하고 있고 정부 역시 오랫동안 이를 확대해 왔다. 그런데 이제는 수능을 서·논술형으로 바꾸어야 학교의 평가와 수업이 바뀐다는 논리가 등장한다.
전남·광주 K-교육특별시 준비위원회가 제시한 서·논술형 평가 전환은 이 논리를 선명하게 보여준다. 준비위는 평가방식의 변화를 수업과 교육과정의 변화로 연결하고, 2027학년도 일부 학년·과목·학교부터 서·논술형 평가를 우선 도입해 단계적으로 확대한다는 구상을 내놓았다.
중요한 것은 ‘100%’라는 숫자보다 이 정책을 떠받치는 인과논리다. 평가를 바꾸면 수업이 바뀌고, 수업이 바뀌면 교육과정도 달라진다는 판단이다. 그러나 준비위원회는 서·논술형 평가가 문해력 향상으로 이어졌다는 객관적 결과가 있느냐는 기자회견 질문에 아직 시행해 본 바가 없어 데이터로 입증되지 않았다는 취지로 답했다.
그렇다면 ‘평가를 바꾸면 수업이 바뀐다’는 것은 이미 확인된 정책효과인가, 앞으로 검증해야 할 정책가설인가.
더구나 학교에서는 이미 오랫동안 과정중심평가와 서·논술형 평가를 확대해 왔다. 그럼에도 기대한 수업 변화가 충분히 일어나지 않았기 때문에 다시 수능까지 바꾸어야 한다는 것이라면, 먼저 물어야 할 것은 왜 기존의 학교평가 정책이 원하는 결과를 만들지 못했는가이다. 그 원인을 분석하지 않은 채 더 강력한 영향력을 가진 수능을 바꾸는 것은 원인을 찾은 것이 아니라 더 강한 지렛대를 찾은 것에 가깝다.
서·논술형 수능 도입의 목적은 무엇인가
수능 서·논술형 논쟁에서 먼저 답해야 할 것은 찬반이 아니라 도입 목적이다.
대학이 학생을 더 잘 선발하기 위한 것이라면 서·논술형은 선발도구다. 그렇다면 현행 평가보다 대학수학에 필요한 능력을 더 타당하게 측정하는지, 전국 단위에서 채점 신뢰성과 공정성을 확보할 수 있는지, 변별력과 시행 가능성을 감당할 수 있는지를 입증해야 한다. “학교수업이 바뀐다”는 말은 좋은 선발도구라는 증거가 아니다.
반대로 학교수업을 바꾸는 것이 목적이라면 서·논술형 수능은 학교교육 개혁을 위한 정책수단이 된다. 그렇다면 왜 학교의 수업을 바꾸는 문제를 교육과정과 학교평가, 교사의 전문성, 교수·학습환경과 같은 학교교육정책으로 해결하지 않고 대학선발시험을 이용해 해결하려 하는가. 대입이 학교에 막대한 영향을 미친다는 것은 현실이다. 그러나 대입이 학교를 움직인다는 사실과 학교를 움직이기 위해 대입을 이용해도 된다는 당위는 같은 명제가 아니다.
둘 다 목적이라면 검증부담은 더 커진다. 학생의 학습과 성장을 확인하는 교육적 평가와 수십만 명의 대학 입학자를 선발하는 고부담 평가는 요구하는 조건이 다르다. 하나의 시험에 서로 다른 두 기능을 함께 맡길 수 있는지부터 증명해야 한다.
일본의 경험은 이 구분의 중요성을 보여준다. 일본은 대학입학공통테스트에 기술형 문항을 도입하려 했지만, 50만 명 이상이 동시에 응시하고 단기간에 성적을 제공해야 하는 공통시험에서 대규모 답안을 안정적으로 채점하기 어렵다고 판단해 도입을 철회했다. 동시에 마크식 문항에서도 사고력·판단력·표현력을 요구하는 문항을 발전시켜야 한다고 보았다. 서·논술형의 가치가 없어서가 아니었다. 어디에서, 어떤 목적으로 사용하는 것이 적절한가를 구분한 것이다.
국가가 먼저 증명해야 한다
서·논술형 평가에 찬성할 수도 있고 반대할 수도 있다. 객관식의 한계를 지적할 수도 있다. 그러나 국가정책은 한 평가방법에 ‘미래’라는 이름을 붙이는 것으로 완성되지 않는다.
객관식이 학교교육의 어떤 문제를 만들었는지, 그 문제가 실제로 객관식 때문에 발생했는지, 서·논술형으로 바꾸면 그 문제가 해결되는지, 그리고 무엇보다 왜 그것을 학교가 아니라 수능에서 해야 하는지를 먼저 증명해야 한다.
그 질문에 답하지 않은 채 “수능을 바꾸면 학교수업이 바뀐다”고 말한다면, 그것은 아직 정책의 근거가 아니다. 검증되지 않은 정책가설이다.
더구나 이 정책이 2033학년도 대입부터 적용된다면 첫 대상은 지금 초등학교 6학년 학생들이다. 검증되지 않은 정책가설을 50만 명 안팎이 응시하는 국가 대입시험에 적용하는 것은 교육개혁이라기보다 고위험 정책실험에 가깝다.
정책은 가치에서 출발할 수 있다. 그러나 정책이 원인으로 지목한 것은 사실로 증명되어야 한다. 아름다운 가치나 듣기 좋은 말이 그 증명을 대신할 수 없다.
수능이 학교를 움직일 수 있다는 사실은, 학교를 움직이기 위해 수능을 사용해야 한다는 근거가 아니다.<계속>








































