2026년 8월 27일, 사단법인 국제인공지능윤리협회는 아래와 같은 성명서를 발표합니다. 전문은 아래와 같으며, 첨부파일로 다운로드 받으실 수 있습니다.
수능 서·논술형 답안의 AI 채점 도입 논의, 원점에서의 재검토를 촉구합니다
사단법인 국제인공지능윤리협회는 2026년 8월 11일 국가교육위원회가 대입제도 개편안 공론화를 위해 개최한 첫 토론회에서 제시한 ‘서·논술형 답안의 인공지능 1차 채점’ 방안과, 8월 18일 한국교육과정평가원이 발간한 ‘교육광장’에 실린 평가원장의 인터뷰에서 ‘단위학교 AI 채점 도입·활용 로드맵 및 가이드라인 제안’ 계획에 대하여 깊은 우려를 표하며, 다음과 같이 협회의 입장을 밝힙니다.
먼저 분명히 해 둘 것이 있습니다. 본 협회는 수능과 내신에 서·논술형 평가를 도입하거나 확대하는 것 자체의 찬반을 말하고자 하는 것이 아닙니다. 평가 방식의 개편은 교육계와 우리 사회가 충분한 논의를 통해 결정할 사안입니다. 본 협회가 문제를 제기하는 지점은, 그렇게 도입된 서·논술형 답안의 채점을 인공지능에게 맡기는 것이 지금의 기술 수준과 제도적 준비 상태에서 과연 타당한가 하는 것입니다. 토론회에서는 “서·논술 평가를 막아온 중요한 병목은 채점”이라는 진단이 제시되었습니다. 그러나 병목을 해소할 기술적 수단이 존재한다는 것과, 그 수단을 대학 입시에 사용해도 좋다는 것은 전혀 다른 문제입니다.
하나, 인공지능은 아직 기술적으로 불완전합니다. 현재의 인공지능은 학습 데이터와 설계자의 관점에서 비롯된 편향과 편견에서 자유롭지 못하며, 아직까지 해결되지 못한 환각(할루시네이션) 현상으로 인해 사실이 아닌 정보를 생성하고 잘못된 답변과 오류 있는 결과를 내놓고 있습니다. 본 협회는 오래전부터 AI 알고리즘이 현재의 기술 단계에서 완벽하거나 중립적일 수 없음을 지속적으로 지적해 왔으며, 그 문제는 생성형 AI 시대에 들어와 오히려 더 복잡한 형태로 남아 있습니다. 이처럼 불완전한 기술에 한 사람의 인생을 좌우하는 수능의 채점을 맡기는 것은 매우 위험한 일입니다.
하나, ‘채점 초안을 만드는 도구’라는 설명만으로 블랙박스(내부의 판단 과정을 알 수 없는 시스템) 문제는 해소되지 않습니다. 토론회에서는 “인공지능은 점수만 내는 블랙박스가 아니라 채점 초안을 만드는 도구”라는 설명이 있었습니다. 그러나 블랙박스 문제의 본질은 산출물의 형태가 점수인지 초안인지에 있는 것이 아니라, 그 판단이 어떤 근거와 경로를 거쳐 도출되었는지를 설명할 수 없다는 데 있습니다. 잘못된 채점이 이루어지더라도 왜 그런 판단을 했는지, 어느 지점에서 오류가 발생했는지 알 수 없으며, 학생도 교육 당국도 이를 인지하지 못한 채 입시 결과가 확정될 수 있습니다. 뒤늦게 오류가 드러난다 하더라도 그 피해를 구제할 절차는 마련되어 있지 않고, 수능 성적 전체를 되돌려야 하는 상황이라면 피해의 회복을 장담할 수 없어 감당하기 어려운 사회적 혼란이 예상됩니다.
하나, 학생 평가에 활용되는 인공지능은 AI 기본법상 고영향 인공지능에 해당합니다. 올해부터 시행 중인 AI 기본법은 제2조 제4호에서 사람의 생명, 신체의 안전 및 기본권에 중대한 영향을 미치거나 위험을 초래할 우려가 있는 인공지능시스템을 고영향 인공지능으로 규정하면서, 채용·대출 심사 등 개인의 권리·의무 관계에 중대한 영향을 미치는 판단 또는 평가와, 「교육기본법」 제9조제1항에 따른 유아교육·초등교육 및 중등교육에서의 학생 평가를 명시하고 있습니다. 수능 채점은 학생에 대한 평가인 동시에 대학 입학이라는 개인의 권리 관계를 결정짓는 평가로서 고영향 인공지능에 해당한다고 보아야 합니다. 특히 국가교육위원회 토론회에서 제시된 의견인 “내신과 수행평가 등 저부담 평가에 우선 적용한 뒤 고부담 평가로 확대”하겠다는 단계적 접근은 이 규율에서 제외되는 것이 아닙니다. 내신과 수행평가는 그 자체로 중등교육에서의 학생 평가이며, 평가원이 준비 중인 단위학교 AI 채점 로드맵 역시 마찬가지입니다. 따라서 대입 수능, 내신, 수행평가 모두 AI 채점을 도입하려면 제34조에 따른 고영향 인공지능 관련 사업자의 책무, 즉 위험관리 방안의 수립·운영, 이용자 보호 방안의 수립·운영, 고영향 인공지능에 대한 사람의 관리·감독, 안전성·신뢰성 확보를 위한 조치의 내용을 확인할 수 있는 문서의 작성과 보관 등의 의무가 빠짐없이 이행되어야 합니다.
하나, ‘1차는 AI, 최종 확정은 교사’라는 설계만으로는 안전장치가 되지 못합니다. 사람은 자동화된 시스템의 판단을 신뢰하고 그대로 수용하는 경향, 이른바 자동화 편향을 가지고 있습니다. 수십만 건의 답안을 제한된 기간 안에 확인해야 하는 검토 과정에서 AI가 제시한 초안 점수는 사실상의 기준점으로 작용하기 쉬우며, 한 건 한 건에 대한 인간의 재검토는 현실적으로 담보되기 어렵습니다. “최종 확정 권한은 항상 교사에게 있다”는 원칙이 형식이 아니라 실질이 되려면, 그것을 어떻게 보장할 것인지에 대한 답이 제시되어야 합니다.
하나, 해외의 선행 사례를 먼저 살펴야 합니다. 호주는 2018년 전국 학업성취도 평가인 NAPLAN의 글쓰기 영역에 AI 채점 도입을 추진하였으나, AI가 학생의 글을 타당하고 공정하게 평가할 수 있는지, 그 평가 근거를 설명할 수 있는지가 입증되지 않아 이를 철회하였습니다. 영국 역시 2020년 코로나19로 A-level과 GCSE 시험이 취소되자 알고리즘을 통해 대학입시 성적을 예측·산정하려 하였으나, 산정의 불공정성과 학생과 학부모의 대규모 반발 속에 이를 철회한 바 있습니다. 우리보다 앞서 AI 평가 도입을 시도했던 국가들이 왜 멈춰 섰는지를 충분히 연구하고 논의하는 일이 먼저입니다.
하나, 근원적으로 인공지능이 인간을 평가하고 판단하는 것이 옳은지를 물어야 합니다. 편리함과 효율성을 이유로 AI가 인간을 평가하고 판단하는 일이 아무런 의문 없이 일상이 된다면, 우리는 인간이 AI를 통제하는 사회가 아니라, AI가 인간을 관리하고 통제하며 지배하는 사회로 나아가게 될 것입니다. 어떤 일이 있어도 인간이 AI를 통제해야 하며, AI가 인간을 통제해서는 안 됩니다. AI는 문제를 해결하고 결과를 예측하는 역할을 할 수 있지만, 그 역할이 인간을 판단하고 평가하는 데까지 확장되어서는 안 됩니다. 특히 생명·신체·정신·재산과 같이 인간의 존엄과 인격에 관한 중요한 영역, 그리고 입시·채용·선발·평가와 같이 한 사람의 일생을 좌우할 수 있는 판단과 결정에 AI를 사용할 때에는 지극히 신중해야 하며, 안전성과 신뢰성에 대한 철저한 검증과 담보 없이 이루어져서는 안 됩니다. 그럴 경우 큰 사회적 혼란과 함께 국민에게 되돌릴 수 없는 피해를 남기게 될 것입니다.
한편 한국교육과정평가원장은 “학생에 대한 종합적 이해와 교육적 판단은 교사의 전문성을 바탕으로 이뤄져야” 한다고 밝혔으며, 국가교육위원회는 토론회에서 “제도를 발표해 놓고 현장이 뒤따라오게 하는 방식이 아니라, 준비를 마친 뒤에 제도를 시행하겠다”는 원칙을 언급한 바 있습니다. 본 협회는 그 원칙이 AI 채점에도 동일하게, 그리고 엄격하게 적용되어야 한다고 생각합니다.
결론적으로 본 협회는 서·논술형 답안에 대한 AI 채점 도입 방안이 원점에서 다시 철저하게 검토되어야 한다고 촉구합니다. 기술적으로 구현이 가능한지와, 그것을 도입해도 되는지는 전혀 다른 문제입니다. 대학 입시는 전 국민의 삶과 맞닿아 있는 사안이며, 편의성과 효율성을 이유로 쉽게 결정해서는 안 됩니다. ‘백년지대계’의 초석으로서 대학 입시의 평가 방식은 신뢰성과 공정성은 물론 예측 가능하고 지속 가능한 안정성을 가져야 하기 때문에, 그 어떤 사회적 제도보다도 신중한 검토와 사회적 합의가 필요합니다. 단 한 명의 학생에게도 문제가 생기지 않고 피해가 발생하지 않도록, 학생 중심·인간 중심의 관점에서 충분히 고민하고 연구하며 사회적 논의와 합의를 거쳐 결정해야 할 문제임을 다시 한번 강조합니다.
본 협회는 2019년 설립 이래 AI 윤리 가이드라인 등 규범의 제정과 AI 윤리 연구 및 교육을 통한 올바른 AI의 개발과 활용의 확산, AI 윤리 분야의 공공기관과 기업 지원 등을 위해 노력해 왔습니다. 앞으로도 교육 현장에서의 AI 도입과 활용이 안전하고 신뢰할 수 있는 방향으로 나아갈 수 있도록, 국가교육위원회와 한국교육과정평가원을 비롯한 관계 기관 및 교육계와의 논의에 적극 참여하고 협력할 것임을 밝힙니다.
2026. 8. 27.
사단법인 국제인공지능윤리협회 일동
2026년 8월 27일, 사단법인 국제인공지능윤리협회는 아래와 같은 성명서를 발표합니다. 전문은 아래와 같으며, 첨부파일로 다운로드 받으실 수 있습니다.
수능 서·논술형 답안의 AI 채점 도입 논의, 원점에서의 재검토를 촉구합니다
사단법인 국제인공지능윤리협회는 2026년 8월 11일 국가교육위원회가 대입제도 개편안 공론화를 위해 개최한 첫 토론회에서 제시한 ‘서·논술형 답안의 인공지능 1차 채점’ 방안과, 8월 18일 한국교육과정평가원이 발간한 ‘교육광장’에 실린 평가원장의 인터뷰에서 ‘단위학교 AI 채점 도입·활용 로드맵 및 가이드라인 제안’ 계획에 대하여 깊은 우려를 표하며, 다음과 같이 협회의 입장을 밝힙니다.
먼저 분명히 해 둘 것이 있습니다. 본 협회는 수능과 내신에 서·논술형 평가를 도입하거나 확대하는 것 자체의 찬반을 말하고자 하는 것이 아닙니다. 평가 방식의 개편은 교육계와 우리 사회가 충분한 논의를 통해 결정할 사안입니다. 본 협회가 문제를 제기하는 지점은, 그렇게 도입된 서·논술형 답안의 채점을 인공지능에게 맡기는 것이 지금의 기술 수준과 제도적 준비 상태에서 과연 타당한가 하는 것입니다. 토론회에서는 “서·논술 평가를 막아온 중요한 병목은 채점”이라는 진단이 제시되었습니다. 그러나 병목을 해소할 기술적 수단이 존재한다는 것과, 그 수단을 대학 입시에 사용해도 좋다는 것은 전혀 다른 문제입니다.
하나, 인공지능은 아직 기술적으로 불완전합니다. 현재의 인공지능은 학습 데이터와 설계자의 관점에서 비롯된 편향과 편견에서 자유롭지 못하며, 아직까지 해결되지 못한 환각(할루시네이션) 현상으로 인해 사실이 아닌 정보를 생성하고 잘못된 답변과 오류 있는 결과를 내놓고 있습니다. 본 협회는 오래전부터 AI 알고리즘이 현재의 기술 단계에서 완벽하거나 중립적일 수 없음을 지속적으로 지적해 왔으며, 그 문제는 생성형 AI 시대에 들어와 오히려 더 복잡한 형태로 남아 있습니다. 이처럼 불완전한 기술에 한 사람의 인생을 좌우하는 수능의 채점을 맡기는 것은 매우 위험한 일입니다.
하나, ‘채점 초안을 만드는 도구’라는 설명만으로 블랙박스(내부의 판단 과정을 알 수 없는 시스템) 문제는 해소되지 않습니다. 토론회에서는 “인공지능은 점수만 내는 블랙박스가 아니라 채점 초안을 만드는 도구”라는 설명이 있었습니다. 그러나 블랙박스 문제의 본질은 산출물의 형태가 점수인지 초안인지에 있는 것이 아니라, 그 판단이 어떤 근거와 경로를 거쳐 도출되었는지를 설명할 수 없다는 데 있습니다. 잘못된 채점이 이루어지더라도 왜 그런 판단을 했는지, 어느 지점에서 오류가 발생했는지 알 수 없으며, 학생도 교육 당국도 이를 인지하지 못한 채 입시 결과가 확정될 수 있습니다. 뒤늦게 오류가 드러난다 하더라도 그 피해를 구제할 절차는 마련되어 있지 않고, 수능 성적 전체를 되돌려야 하는 상황이라면 피해의 회복을 장담할 수 없어 감당하기 어려운 사회적 혼란이 예상됩니다.
하나, 학생 평가에 활용되는 인공지능은 AI 기본법상 고영향 인공지능에 해당합니다. 올해부터 시행 중인 AI 기본법은 제2조 제4호에서 사람의 생명, 신체의 안전 및 기본권에 중대한 영향을 미치거나 위험을 초래할 우려가 있는 인공지능시스템을 고영향 인공지능으로 규정하면서, 채용·대출 심사 등 개인의 권리·의무 관계에 중대한 영향을 미치는 판단 또는 평가와, 「교육기본법」 제9조제1항에 따른 유아교육·초등교육 및 중등교육에서의 학생 평가를 명시하고 있습니다. 수능 채점은 학생에 대한 평가인 동시에 대학 입학이라는 개인의 권리 관계를 결정짓는 평가로서 고영향 인공지능에 해당한다고 보아야 합니다. 특히 국가교육위원회 토론회에서 제시된 의견인 “내신과 수행평가 등 저부담 평가에 우선 적용한 뒤 고부담 평가로 확대”하겠다는 단계적 접근은 이 규율에서 제외되는 것이 아닙니다. 내신과 수행평가는 그 자체로 중등교육에서의 학생 평가이며, 평가원이 준비 중인 단위학교 AI 채점 로드맵 역시 마찬가지입니다. 따라서 대입 수능, 내신, 수행평가 모두 AI 채점을 도입하려면 제34조에 따른 고영향 인공지능 관련 사업자의 책무, 즉 위험관리 방안의 수립·운영, 이용자 보호 방안의 수립·운영, 고영향 인공지능에 대한 사람의 관리·감독, 안전성·신뢰성 확보를 위한 조치의 내용을 확인할 수 있는 문서의 작성과 보관 등의 의무가 빠짐없이 이행되어야 합니다.
하나, ‘1차는 AI, 최종 확정은 교사’라는 설계만으로는 안전장치가 되지 못합니다. 사람은 자동화된 시스템의 판단을 신뢰하고 그대로 수용하는 경향, 이른바 자동화 편향을 가지고 있습니다. 수십만 건의 답안을 제한된 기간 안에 확인해야 하는 검토 과정에서 AI가 제시한 초안 점수는 사실상의 기준점으로 작용하기 쉬우며, 한 건 한 건에 대한 인간의 재검토는 현실적으로 담보되기 어렵습니다. “최종 확정 권한은 항상 교사에게 있다”는 원칙이 형식이 아니라 실질이 되려면, 그것을 어떻게 보장할 것인지에 대한 답이 제시되어야 합니다.
하나, 해외의 선행 사례를 먼저 살펴야 합니다. 호주는 2018년 전국 학업성취도 평가인 NAPLAN의 글쓰기 영역에 AI 채점 도입을 추진하였으나, AI가 학생의 글을 타당하고 공정하게 평가할 수 있는지, 그 평가 근거를 설명할 수 있는지가 입증되지 않아 이를 철회하였습니다. 영국 역시 2020년 코로나19로 A-level과 GCSE 시험이 취소되자 알고리즘을 통해 대학입시 성적을 예측·산정하려 하였으나, 산정의 불공정성과 학생과 학부모의 대규모 반발 속에 이를 철회한 바 있습니다. 우리보다 앞서 AI 평가 도입을 시도했던 국가들이 왜 멈춰 섰는지를 충분히 연구하고 논의하는 일이 먼저입니다.
하나, 근원적으로 인공지능이 인간을 평가하고 판단하는 것이 옳은지를 물어야 합니다. 편리함과 효율성을 이유로 AI가 인간을 평가하고 판단하는 일이 아무런 의문 없이 일상이 된다면, 우리는 인간이 AI를 통제하는 사회가 아니라, AI가 인간을 관리하고 통제하며 지배하는 사회로 나아가게 될 것입니다. 어떤 일이 있어도 인간이 AI를 통제해야 하며, AI가 인간을 통제해서는 안 됩니다. AI는 문제를 해결하고 결과를 예측하는 역할을 할 수 있지만, 그 역할이 인간을 판단하고 평가하는 데까지 확장되어서는 안 됩니다. 특히 생명·신체·정신·재산과 같이 인간의 존엄과 인격에 관한 중요한 영역, 그리고 입시·채용·선발·평가와 같이 한 사람의 일생을 좌우할 수 있는 판단과 결정에 AI를 사용할 때에는 지극히 신중해야 하며, 안전성과 신뢰성에 대한 철저한 검증과 담보 없이 이루어져서는 안 됩니다. 그럴 경우 큰 사회적 혼란과 함께 국민에게 되돌릴 수 없는 피해를 남기게 될 것입니다.
한편 한국교육과정평가원장은 “학생에 대한 종합적 이해와 교육적 판단은 교사의 전문성을 바탕으로 이뤄져야” 한다고 밝혔으며, 국가교육위원회는 토론회에서 “제도를 발표해 놓고 현장이 뒤따라오게 하는 방식이 아니라, 준비를 마친 뒤에 제도를 시행하겠다”는 원칙을 언급한 바 있습니다. 본 협회는 그 원칙이 AI 채점에도 동일하게, 그리고 엄격하게 적용되어야 한다고 생각합니다.
결론적으로 본 협회는 서·논술형 답안에 대한 AI 채점 도입 방안이 원점에서 다시 철저하게 검토되어야 한다고 촉구합니다. 기술적으로 구현이 가능한지와, 그것을 도입해도 되는지는 전혀 다른 문제입니다. 대학 입시는 전 국민의 삶과 맞닿아 있는 사안이며, 편의성과 효율성을 이유로 쉽게 결정해서는 안 됩니다. ‘백년지대계’의 초석으로서 대학 입시의 평가 방식은 신뢰성과 공정성은 물론 예측 가능하고 지속 가능한 안정성을 가져야 하기 때문에, 그 어떤 사회적 제도보다도 신중한 검토와 사회적 합의가 필요합니다. 단 한 명의 학생에게도 문제가 생기지 않고 피해가 발생하지 않도록, 학생 중심·인간 중심의 관점에서 충분히 고민하고 연구하며 사회적 논의와 합의를 거쳐 결정해야 할 문제임을 다시 한번 강조합니다.
본 협회는 2019년 설립 이래 AI 윤리 가이드라인 등 규범의 제정과 AI 윤리 연구 및 교육을 통한 올바른 AI의 개발과 활용의 확산, AI 윤리 분야의 공공기관과 기업 지원 등을 위해 노력해 왔습니다. 앞으로도 교육 현장에서의 AI 도입과 활용이 안전하고 신뢰할 수 있는 방향으로 나아갈 수 있도록, 국가교육위원회와 한국교육과정평가원을 비롯한 관계 기관 및 교육계와의 논의에 적극 참여하고 협력할 것임을 밝힙니다.
2026. 8. 27.
사단법인 국제인공지능윤리협회 일동