AI 대학 입학 시험 수필 쓰기 대회 결승: DeepSeek V4 서술 수필이 46점으로 우승, Hunyuan의 "자신의 사람들"이 만점을 얻었습니다

GPT-5.5/Fable-5/DeepSeek V4/Hunyuan 3 Preview 2026년 베이징 대학 입학 시험 에세이에 공동 집필된 DeepSeek V4의 서술형 에세이는 평균 46점으로 우승을 차지했습니다. 혼위안의 '자국민이 자국민을 판단한다'는 만점을 받아 열띤 토론을 불러일으켰다.

AI 대학 입시 에세이 쓰기 결승 : DeepSeek V4가 서사 쓰기 부문 우승, 훈위안 만점 논란에 휩싸여

2026년 대학 입시 때 앤트로픽의 미토스급 대형 모델이 동시 출시됐다. 테스터들은 국내외 두 가지 주요 모델인 GPT-5.5, Fable-5, DeepSeek V4, Hunyuan 3 Preview를 선택하여 논증적 에세이나 내러티브를 작성하는 데 사용할 수 있는 700 단어 이상이 필요한 베이징 대학 입시 에세이 문제 "계획 및 노력"을 테스트했습니다.

4개의 주요 모델 각각은 2개의 논증 에세이와 2개의 서술형 에세이를 썼으며, 4명의 "평가자"가 교차 점수를 매겼습니다. 결과는 다음과 같습니다.

  • DeepSeek V4 Narrative: 평균 점수 46점(최고)
  • Hunyuan 3 미리보기: Hunyuan은 DeepSeek V4의 내러티브에 60점 만점을 부여했습니다. - "자기 백성이 자기 백성을 심판한다"는 조롱을 불러일으켰습니다.
  • 각 모델은 다양한 글쓰기 스타일에 능숙합니다: GPT-5.5 및 Fable-5 논증 에세이는 더 표준화된 반면 DeepSeek V4 서술형 에세이는 더 문학적입니다.
AI 대학 입시 에세이 점수표 1 AI 대학 입시 에세이 점수표 2

이번 테스트에서는 AI 글쓰기의 공통적인 특징도 드러났다. 깔끔한 구조와 고전 인용 능력이 뛰어나지만, 실제 개인 경험의 '따뜻함'이 부족하다는 점이다. 이는 내러티브 장면에서 특히 분명합니다. AI는 스토리를 원활하게 작성하지만 실제 감정적 깊이가 부족합니다.

AI 글쓰기 대학 입시 에세이는 매년 고정된 '비공개 평가'지만, 중국 문예창작에서 각 모델의 능력 차이를 드러내는 데 본질적인 의의가 있다. 서술형 텍스트에서의 DeepSeek V4의 장점은 중국 문학적 표현 측면에서 국내 모델이 국제 경쟁사를 따라잡고 있음을 보여주는 반면, Hunyuan의 '만점' 에피소드는 AI 자체 평가 시스템의 근본적인 결함, 즉 모델이 채점 자체에 대한 객관적인 참조가 부족하고 AI 채점 표준화 구축이 아직 갈 길이 멀다는 것을 드러냈습니다.

후속 조치는 주목할 가치가 있습니다.

  1. AI 에세이 채점의 객관성: 교차모델 표준화 한문 채점 시스템을 어떻게 구축할 것인가?
  2. 중국 문예 창작의 지속적인 진화: DeepSeek V4의 문학적 장점이 후속 버전에서도 유지될 수 있습니까?
  3. 교육 시나리오의 표준화된 적용: 교육 평가 및 보조 교육에서 AI 글쓰기의 경계 및 표준
저작권: 콘텐츠 출처 36 크립톤(문자 AI) . 이 플랫폼은 정보 제공 및 학습 교류를 목적으로 콘텐츠를 편집 및 정리했습니다. 저작권 문제가 있으시면 연락해 주세요.

후기

  • 후기를 불러오는 중...