Тест объёма словарного запаса: сколько английских слов вы знаете?
Пятьдесят вопросов, около трёх минут. Настоящие слова берутся из разных частотных групп, а среди них — псевдослова, поэтому результат исправляется на завышение, а не раздувается из-за него.
Это тест по списку «да/нет», иногда его называют тестом лексического решения. Вы видите одну строку за раз и говорите, знаете ли её. Звучит слишком просто для измерения, и само по себе так и было бы — кто угодно может заявить, что знает всё. Работает это благодаря тому, что часть вопросов — вовсе не слова.
Четырнадцать из пятидесяти вопросов — это псевдослова: произносимые, похожие на английские строки, которых ни один носитель языка никогда не встречал, — это проверено по полному словарю, чтобы убедиться, что ни одно из них не является реальным редким словом. То, как часто вы отвечаете «да» на них, даёт вашу долю ложных срабатываний, и по ней система понижает вашу долю «да» по настоящим словам. Ответьте «да» на всё — и получите ноль, а не идеальный результат.
Настоящие вопросы берутся из шести частотных групп, по четыре гарантированно из каждой, плюс ещё двенадцать добавляются адаптивно там, где ваши ответы менее всего определены. Это даёт профиль, а не единственный порог, и именно поэтому в результате указывается не только количество слов, но и уровень CEFR.
Вы будете видеть по одному слову за раз. Отвечайте честно: если вы можете примерно объяснить, что оно значит, отвечайте «да»; если вы только видели его и не смогли бы определить, отвечайте «нет».
50 вопросов, около трёх минут.
Часть вопросов — придуманные слова. Ответ «да» на них снижает результат.
Угадывать невыгодно. Коррекция это устраняет.
Всё работает прямо в вашем браузере. Ваш текст никогда не покидает эту страницу, никуда не отправляется и нигде не сохраняется.
Что на самом деле считает «объём словарного запаса»
Единица измерения — словесная семья, а не словарная статья. "Know", "knows", "knowing", "knew" и "known" — это одна семья, потому что изучающий язык, знающий одну форму, обычно способен вывести остальные. Подсчёт отдельных форм умножил бы каждую цифру примерно в три раза и сделал бы сравнение с опубликованными исследованиями невозможным.
Для примерной калибровки: взрослый носитель английского знает от 15 000 до 20 000 словесных семей и достигает около 10 000 к концу среднего образования. Изучающий язык на уровне B2 обычно владеет 4000–5000; на C1 — около 8000. Первые 2000 семей покрывают примерно 80% слов в обычном тексте, первые 3000 — около 90%, а первые 5000 — около 95%.
Эти цифры покрытия и есть практический смысл. Исследования понимания текста ставят порог для следования за текстом примерно на уровне 95% охвата слов, а для комфортного самостоятельного чтения — ближе к 98%. Разница между 4000 и 8000 семьями — это разница между тем, чтобы продираться через статью, и тем, чтобы её просто читать.
Почему псевдослова — это весь смысл теста
Тест «да/нет» измеряет самооценку, а самооценка смещена. Одни люди осторожны и отвечают «нет» на слова, которые знают наполовину; другие узнают форму и отвечают «да». Без контроля тест измерял бы уверенность не меньше, чем знания.
Псевдослова и есть этот контроль. Поскольку их никто не знает, каждое «да» на псевдослове — это измеримая ошибка, и частота этих ошибок оценивает, как часто тот же человек отвечал «да» на настоящее слово, которого на самом деле не знал. Применяемая здесь коррекция — стандартная: скорректированная доля для группы равна доле правильных ответов минус доля ложных срабатываний, делённой на единицу минус доля ложных срабатываний, с нижней границей в ноль.
Стоит знать одно следствие: если доля ложных срабатываний превышает 40%, коррекция делит на маленькое число, и оценка становится нестабильной. Инструмент сообщает об этом, а не тихо выдаёт цифру, в которую сам не верит.
Как увеличить это число
Рост словарного запаса определяется количеством встреч со словом, а не временем учёбы. Большинство оценок сходятся на том, что для изучения слова из контекста нужно от восьми до двадцати встреч, поэтому объём чтения побеждает списки слов для всего, что выходит за пределы первых пары тысяч семей.
Эффективнее всего читать чуть выше своего текущего уровня, там, где уже известно примерно 95–98% слов. Ниже этого вы не узнаёте ничего нового; выше — тратите время сессии на словарь вместо чтения. Именно поэтому материал, подобранный по уровню, важнее любой конкретной техники запоминания.
Интервальное повторение стоит добавить для слов, которые встречаются, но не запоминаются, особенно в диапазоне 3000–8000, где встречи по природе редки. Это дополнение к объёму чтения, а не замена ему: слово, выученное по карточке и ни разу не встреченное в контексте, обычно не удерживается в памяти.
Результат показывает, на границе какой частотной группы вы находитесь — группы, где одни слова вы знаете, а другие нет. Именно там чтение приносит наибольшую пользу быстрее всего. LingoRead создаёт тексты на вашем уровне, извлекает из каждого новую лексику и возвращает эти слова снова и снова, пока они не закрепятся.