IELTS.international

Как работает наша система оценки с ИИ

Мы считаем, что вы имеете право точно знать, как оценивается ваше эссе. На этой странице описана наша методология, что именно оценивает ИИ, известные ограничения и как мы совершенствуем систему.

Обзор

Когда вы отправляете эссе в любом из наших 993 практических упражнений, модель ИИ оценивает его по тем же четырём критериям, которые используют экзаменаторы IELTS. Вы получаете оценку Band по каждому критерию, общий балл и одну конкретную рекомендацию по повышению результата.

Бесплатная версия оценки использует DeepSeek — большую языковую модель, настроенную для структурированной оценки. Подписчики платной версии получают второй, более глубокий анализ от Gemini, включающий обратную связь на уровне абзацев, переработку предложений и образцовый ответ.

4 критерия оценки

Каждое эссе IELTS Writing Task 2 оценивается по четырём критериям с равным весом. Наш ИИ оценивает каждый критерий независимо, а затем вычисляет среднее арифметическое (с округлением до ближайших 0.5) для общего балла Band.

TR

Task Response (TR)

Раскрывает ли эссе все аспекты вопроса? Содержит ли оно чёткую позицию, выдержанную на протяжении всего текста? Развиты ли идеи и подкреплены ли они примерами?

CC

Coherence and Cohesion (CC)

Логично ли организовано эссе? Плавно ли идеи переходят между предложениями и абзацами? Используются ли связующие слова уместно, а не механически?

LR

Lexical Resource (LR)

Использует ли автор достаточно широкий диапазон лексики? Употребляются ли слова точно и естественно, включая менее распространённые? Редки ли орфографические ошибки?

GR

Grammatical Range and Accuracy (GR)

Использует ли эссе сочетание простых и сложных грамматических конструкций? Достаточно ли редки ошибки, чтобы не мешать пониманию?

Как работает калибровка

ИИ откалиброван по официальным дескрипторам шкалы IELTS, опубликованным British Council, IDP и Cambridge. Мы используем явные оценочные ориентиры:

7.0+

Band 7.0+: Чёткая позиция, хорошая организация, широкий словарный запас, хороший контроль грамматики. Для любой оценки выше 7.0 ИИ обязан привести подтверждение из текста эссе.

6.0–6.5

Band 6.0–6.5: Раскрыты все части задания, логичное развитие мысли, достаточный словарный запас с некоторыми ошибками, сочетание простых и сложных предложений.

5.0–5.5

Band 5.0–5.5: Частичный ответ на задание, ограниченный словарный запас, ограниченные грамматические конструкции.

< 5.0

Ниже 5.0: Минимальный ответ со значительными ограничениями по всем критериям.

Оценки выставляются только с шагом 0.5 балла Band — тот же шаг, что используется на реальном экзамене.

Правила оценки

Эти правила обеспечивают последовательность оценки ИИ:

  1. 1

    Эссе объёмом менее 250 слов штрафуются только по критерию Task Response (минус 1.0 балла Band), что соответствует штрафу на реальном экзамене.

  2. 2

    Эссе с чёткой позицией, двумя аргументированными основными абзацами и использованием сложных предложений получает не менее 6.0 — ИИ не может поставить ниже при наличии этих элементов.

  3. 3

    Общий балл Band — это среднее арифметическое четырёх критериев, округлённое до ближайших 0.5.

Бесплатная и платная оценка

Обе версии используют одни и те же критерии. Разница — в глубине анализа:

Бесплатная

  • Оценки Band по всем 4 критериям
  • Общая оценка Band
  • Одна конкретная рекомендация по улучшению
  • Доступна для всех 993 упражнений — без регистрации

Платная

  • Всё из бесплатной версии, плюс:
  • Сильные и слабые стороны на уровне абзацев с цитатами из текста
  • Конкретные исправления предложений в формате «до и после»
  • Образцовый ответ на Band 9 по тому же заданию
  • Топ-3 приоритета для подготовки, ранжированные по влиянию на результат

Известные ограничения

Мы открыто говорим о том, чего не может оценка с помощью ИИ:

Это не официальная оценка IELTS

Наши оценки являются приблизительными. Только официальный центр тестирования IELTS может выставить реальный балл Band. Используйте наши оценки для практики и отслеживания прогресса.

Почерк не оценивается

ИИ анализирует печатный текст. На бумажном экзамене неразборчивый почерк может снизить вашу оценку — ИИ не может это смоделировать.

Точность оценки

По результатам нашего внутреннего тестирования, оценки ИИ обычно отличаются от оценки живого экзаменатора не более чем на 0.5 балла Band. В отдельных случаях расхождение может составлять 1.0 балла.

Поддержка Writing Task 1 пока отсутствует

Текущая система оценки откалибрована только для эссе Writing Task 2. Задания Writing Task 1 (графики, письма) используют другие критерии и пока не поддерживаются.

Эссе не по теме

Если эссе полностью не относится к заданию, ИИ всё равно может выставить оценку. Живой экзаменатор, скорее всего, оценил бы такое эссе значительно ниже.

Почему мы это публикуем

Большинство инструментов оценки с ИИ — это чёрные ящики. Вы отправляете эссе, получаете число и понятия не имеете, как оно было рассчитано. Мы считаем, что это неправильно.

Если вы понимаете, как работает оценка, вы можете учиться эффективнее — целенаправленно работая над конкретным критерием, который сдерживает ваш балл. Именно в этом суть нашей платформы.

Read the current publication standard, withdrawn-claim policy, and public activity data definitions on our Research and Data Methodology page.

Как мы совершенствуем систему

Мы регулярно проверяем точность оценки, сравнивая результаты ИИ с эссе, оценёнными живыми экзаменаторами. Когда мы обнаруживаем закономерности завышения или занижения оценок, мы обновляем промпт для оценки и проводим повторное тестирование.

Если вы считаете, что ваше эссе было оценено несправедливо, напишите нам. Каждое обращение помогает нам улучшить калибровку.

Вопросы об оценке?

Если у вас есть вопросы о том, как было оценено конкретное эссе, или вы хотите сообщить о неточных результатах, свяжитесь с нами.

Связаться с нами
На главную