База данных по части речи «союзы» получена из общей базы морфологии слов русского языка. Т.к. союзы не обладают какой либо морфологией, то получилась одна таблица с перечнем слов.
SQL скрипт размещены на github. Переходим, жмем download.
words-russian-conjunctions.sql.gz — база союзов, таблица conjunctions.
Внимание! Скрипт содержит «DROP TABLE if exists».
Описание таблицы conjunctions
База содержит 322 союза. Наряду с простыми союзами вроде «и», «но», тут вы найдете сложные союзы вроде «в результате того что» и «с таким расчетом, чтоб». Т.е. они включают в себя последовательность из нескольких слов и даже знаки препинания.
- IID, int — суррогатный ключ
- word, varchar[100] — словоформа.
- code, int — код словоформы.
База данных
Данная запись опубликована в 14.03.2017 17:05 и размещена в рубрике На первой полосе.
Вы можете перейти в конец страницы и оставить ваш комментарий.
Мало букафф? Читайте есчо !
Март 15, 2017 г.
Здесь представлены две выборки, полученные из общей базы морфологии. "Нормализованная" выборка содержит инфинитивы глаголов, а вторая таблица - инфинитивы + словоформы.
SQL скрипты размещены на github. Переходим, ищем файлы words-russian-verbs, ...
Читать
Март 15, 2017 г.
База данных предикативов сформирована выборкой из базы морфологии слов русского языка. Мы в школе не изучали эту часть речи. Думаю, лингвисты тоже с трудом отличают предикативы то от междометий, то от наречий.
SQL скрипт размещен на github. Переходим ...
Читать
Март 15, 2017 г.
Список частиц извлечен из полной базы морфологии слов русского языка. Никаких изменений в морфологии частицы не предполагают, потому получился простой список.
SQL скрипт размещен на github. Переходим, ищем words-russian-particles, жмем download. ...
Читать
Март 14, 2017 г.
База наречий получена из общей базы морфологии слов русского языка. Она состоит их двух таблиц : только нормализованные наречия и наречия + словоформы.
SQL скрипты размещены на github. Переходим, жмем download.
words-russian-adverbs.sql.gz - ...
Читать