Словарный запас

Первые 1000 слов: какую лексику учить первой и почему она покрывает так много

Небольшой набор очень частых слов делает большую часть работы в любом языке. Как устроено покрытие, откуда берутся цифры и как выбрать свою первую тысячу.

Языки несправедливы способом, который на руку новичкам. Частотность слов идёт по крутой кривой: несколько сотен слов встречаются постоянно, несколько тысяч – регулярно, а остальные десятки тысяч – редко. Выучите частые первыми – и вы будете понимать удивительно большую долю услышанного задолго до большого словарного запаса.

Что такое «покрытие»

Покрытие – это процент слов в тексте или разговоре, которые вы знаете. Корпусные исследования разных языков рассказывают одну и ту же историю: тысяча самых частых семей слов покрывает примерно три четверти повседневной речи и около 80 % обычного письменного текста, а точная цифра зависит от языка и жанра. Вторая тысяча добавляет ещё несколько пунктов. Дальше каждая тысяча даёт всё меньше.

Пол Нейшен, чьи исследования лежат в основе большинства этих оценок, показал и другую сторону кривой: чтобы комфортно читать романы или газеты, с покрытием 98 %, нужно порядка 8 000–9 000 семей слов. Так что первая тысяча – не беглость. Это разница между «слышу шум» и «слышу предложения с пробелами».

Почему первая тысяча важнее любой другой

  • На ней построен каждый текст. Артикли, местоимения, предлоги, вспомогательные глаголы, самые частые существительные и глаголы – каркас каждого предложения, которое вы когда-либо встретите.
  • Она открывает угадывание. Когда известно 80 % слов, контекста вокруг незнакомого обычно хватает, чтобы его угадать. При 50 % – нет.
  • Её дёшево встречать снова. Частые слова по определению повторяются, поэтому каждое получает многократное предъявление, превращающее «видел» в «знаю», без дополнительных усилий.

Какие слова в неё входят

Частотный список для вашего языка найти легко, но не все из тысячи одинаково стоят вашего времени в первый день. Практический порядок:

  1. Служебные слова. Местоимения, слова «и», «но», «потому что», «в», «на», «с», вопросительные слова. Скучные, крошечные и в каждом предложении.
  2. Ядро глаголов. Быть, иметь, идти, хотеть, делать, говорить, знать, видеть, давать, брать, плюс модальные. В большинстве языков несколько десятков глаголов несут почти весь разговор.
  3. Числа, время и место. Дни, месяцы, часы, «сегодня», «завтра», «здесь», «там», «налево», «направо».
  4. Существительные вашей настоящей жизни. Еда, дом, работа, семья, транспорт, тело. Универсальный список включит «правительство» и «развитие»; вашей жизни, возможно, раньше нужны «чайник» и «арендодатель».
  5. Социальный клей. Приветствия, благодарности, извинения, «я не понимаю», «повторите, пожалуйста», «как сказать».

Где можно, учите их блоками. «Где находится» – более полезная единица, чем «где» и «находится» по отдельности.

Чего избегать

Типичная ошибка – учить частотные списки как списки. Слово номер 412, заученное с переводом и ничем больше, обычно выпадает обратно. Встречайте слова в предложениях, слушайте их и используйте: они частые именно потому, что они везде, так что input сам обеспечит повторения, если input потреблять.

Другая ошибка – остановиться на списке. Тысяча слов доводит до «пробелов». Закрывать пробелы – дело чтения и слушания в объёме, где следующие несколько тысяч усваиваются в основном через встречи.

В LinguaPair

Курсы выстроены так, что ранние блоки учат высокочастотный каркас первым: местоимения, важнейшие глаголы, вопросительные формы, числа и лексику повседневной жизни, каждое – внутри предложений и коротких диалогов, а не списком. Переводчик добавляет слова, нужные лично вам, потому что они рождаются из ваших собственных разговоров с партнёром. А тренажёр интервальных повторений держит оба набора в обороте, пока они не станут вашими.