База данных «вводных слов» извлечена из базы морфологии слов русского языка. Вводные слова не обладают какой либо морфологией, я сформировал только одну таблицу.
SQL скрипт размещен на github. Переходим, жмем download.
words-russian-introductors.sql.gz — база вводных слов, таблица introductors.
Внимание! Скрипт содержит «DROP TABLE if exists».
Описание таблицы introductors
Перечень содержит 210 слов и словосочетаний. Список, наверняка, не полный, т.к. определение слова или словосочетания как «вводного слова», зависит от контекста.
- IID, int — суррогатный ключ, скопирован из основной базы.
- word, varchar[100] — словоформа.
- code, int — код словоформы.
База данных
Написать комментарий
Данная запись опубликована в 14.03.2017 17:21 и размещена в рубрике На первой полосе.
Вы можете перейти в конец страницы и оставить ваш комментарий.
Мало букафф? Читайте есчо !
Март 14, 2017 г.
Числительные извлечены из базы морфологии слов русского языка. Произведено две выборки - нормализованный список и числительные с морфологией.
SQL скрипты баз размещены на github. Переходим, ищем в списке "words-russian-numerals", жмем download. ...
Читать
Март 14, 2017 г.
База наречий получена из общей базы морфологии слов русского языка. Она состоит их двух таблиц : только нормализованные наречия и наречия + словоформы.
SQL скрипты размещены на github. Переходим, жмем download.
words-russian-adverbs.sql.gz - ...
Читать