Источники данных English Word Recognition
Последнее обновление: 12 августа 2026 года.
Набор английских слов и русских переводов опубликован на условиях Creative Commons Attribution-ShareAlike 4.0 International.
1. wordfreq 3.1.1
- Назначение в наборе: частотное ранжирование английских слов.
- Автор проекта: Robyn Speer.
- Проект wordfreq и подробные acknowledgements источников.
- Код: Apache License 2.0.
- Включённые частотные данные: CC BY-SA 4.0.
В acknowledgements проекта перечислены использованные им источники, включая Google Books Ngrams, Leeds Internet Corpus, Wikipedia, ParaCrawl, OPUS OpenSubtitles и наборы SUBTLEX.
2. FreeDict English–Russian 2025.11.23
- Назначение в наборе: справочный источник черновых русских переводов.
- Издатель и сопровождающий: Karl Bartel / FreeDict.
- Проект FreeDict.
- Зафиксированный выпуск словаря eng-rus.
- Лицензия, указанная в TEI-заголовке: CC BY-SA 3.0 Unported.
- Указанный источник словаря: WikDict; данные Wiktionary, обработанные через DBnary.
3. Что изменено
Исходные материалы не публикуются без изменений. Для этого инструмента слова отобраны по частотному списку, технический шум и неоднозначные без контекста карточки исключены, переводы сокращены и вручную проверены, отдельные формулировки исправлены, а итоговый список ограничен 300 карточками с собственными стабильными идентификаторами и рангами.
4. Область лицензии
Условия набора данных не меняют лицензию программного кода сайта. Код и данные остаются отдельно идентифицируемыми материалами. Сторонние исходные материалы продолжают регулироваться указанными выше лицензиями и атрибуцией их правообладателей.