Как устроен этот тест
Что тест меряет, как он это делает и чего не говорит. Здесь же — откуда взяты слова и кто поставил ступени в каждом из трёх тестов.
Как идёт заход
На экране проходит 60 слов, по одному за раз, и вопрос у каждого один: знаю или не знаю. Времени на ответ не отмеряется: это вопрос на узнавание, а не экзамен на память, и торопить тут нечего.
У половины слов, которым вы сказали «знаю», спросим и значение: четыре варианта, один верный. Так знакомое на вид слово отделяется от знакомого на самом деле, и половина балла держится именно на этой проверенной половине.
Зачем выдуманные слова
Двадцать слов из шестидесяти в языке теста не существуют. Они собраны по его звуковым и структурным правилам, но не стоят ни в одном словаре; сказать про такое «знаю» — показать, насколько можно верить остальным вашим «знаю», и потерять баллы.
Строка «Честность» на экране итога — ровно этот множитель. Предупреждение по ходу захода не выскакивает намеренно: увидев его, вы стали бы осторожнее во второй половине, то есть помешали бы измерению ровно там, где оно идёт.
Что считалось словом
Общепринятого ответа на этот вопрос нет, поэтому мы называем свой. Словом здесь считается заглавное слово словаря — то, чему издание отвело отдельную статью. Форма слова отдельной позицией не бывает никогда: падеж, число и время — это то же слово.
А производное — бывает, и считается другим словом, если словарь дал ему собственную статью. Это решение видно в счёте: словарь, разошедшийся с нашим, насчитает у вас другое число знакомых слов, и спорить тут не о чем — спор о том, что такое слово, старше любого теста.
Чего балл не говорит
Числа «вы знаете N слов» отсюда не выходит, и мы его не выводим: такой расчёт требует модели, которой у нас нет.
Балл меряет вещь поуже и почестнее — как далеко ваш словарный запас заходит за пределы обиходного слоя.
Что уходит на сервер
Ни аккаунта, ни куки, ни персональных данных. Ваш балл остаётся в браузере: кто проходил, сколько набрал и в каком порядке отвечал — не записывается нигде.
У турецкого и казахского тестов на сервер уходят счётчики по словам: какое слово показали, сколько человек сказали «знаю», сколько выбрали верное значение. Они нужны, чтобы поправить ступени, которые там поставил словарь. У чеченского теста не уходит ничего — его ступени поставил носитель, и второй свидетель им не нужен.
Три теста, три разных словаря
Прибор один, а данные у каждого свои: слова взяты из разных изданий, и ступени трудности в них поставлены по-разному.
Türkçe
781 слово, все — заглавные слова «Güncel Türkçe Sözlük» Турецкого лингвистического общества (TDK); значения и варианты на экране — определения оттуда же.
Четыре ступени трудности собраны из трёх свидетелей: пометы самого словаря (устарелое, разговорное, диалектное), частота слова в корпусе и то, выходит ли оно за обиходное ядро языка.
Нохчийн мотт
267 слов из открытого чеченско-русского словаря; написание каждого сверено с орфографическим эталоном Академии наук ЧР. Значения даются на языке этой страницы, а не по-чеченски: чеченско-чеченского толкового словаря в открытом доступе нет, поэтому значение приходит языком-посредником.
Ступени здесь поставил носитель языка, пройдя весь банк. Спрашивали не о трудности, а о собственной речи: «говорят все, и молодые» / «говорят редко, больше старшие» / «знаю, но в речи не слышу» / «не знаю». Эти четыре ответа и есть четыре ступени. О трудности прямо не спрашивают потому, что трудность — величина о чужом словаре: слова своего детства человек честно поставит лёгкими, и целая эпоха уедет вниз.
Қазақ тілі
157 слов — заглавные слова «Словаря казахского литературного языка», значения и варианты оттуда же. В доступном издании нет нескольких томов, поэтому слов на п, р, с, ш, ы, і, ү, ө в тесте в разы меньше: не встретив ни одного слова на «п», вы вправе знать, что дело не в вас.
Ступени поставлены пометами издания (устарелое, редкое, книжное, диалектное) и частотой слова в корпусе.