Местоимения, база в виде sql скрипта

Местоимения извлечены из базы морфологии русского языка. Они могут склоняются по родам, падежам и образуют три видовые группы. Я не стал вдаваться в детали склонения, чтобы создавать «нормализованную» выборку. Возможно, сделаю это в следующем релизе на GIT.

SQL скрипт размещен на github. Переходим, ищем words-russian-pronouns, жмем download.

words-russian-pronouns-morf.sql.gz — база местоимений, таблица pronouns_morf.

Внимание! Скрипт содержит «DROP TABLE if exists».

Описание таблицы pronouns_morf

Таблица хранит 1916 словоформ местоимений. Некоторые их них допускают склонение по падежам, роду, могут иметь ед/мн число.

  • IID, int — суррогатный ключ, скопирован из основной базы.
  • word, varchar[100] — словоформа.
  • code, int — код словоформы.
  • code_parent, int — код родителя словоформы, согласно иерархии в исходном файле.
  • type, set(’прл’,’сущ’,’нар’,’мест’) — часть речи. В данной таблице вы встретите комбинации местоимение + прилагательное, местоимение + существительное, местоимение + наречие, характеризующие тип местоимения.
  • plural, boolean — множественное число.
  • gender, enum(‘муж’,’жен’,’ср’) — род.
  • wcase, enum(‘им’,’род’,’дат’,’вин’,’тв’,’пр’) — падежи.

Мало букафф? Читайте есчо !

База причастий и деепричастий русского языка

Март 14, 2017 г.

В данной базе объединены причастия и деепричастия. Таблицы получены из общей базы морфологии. В первой таблице содержится перечень "нормализованных" слов, а вторая база включает их морфологию. SQL скрипты в виде дампа размещены на github. Переходим, ...

Читать

База данных русских наречий, SQL скрипт

Март 14, 2017 г.

База наречий получена из общей базы морфологии слов русского языка. Она состоит их двух таблиц : только нормализованные наречия и наречия + словоформы. SQL скрипты размещены на github. Переходим, жмем download. words-russian-adverbs.sql.gz - ...

Читать

Морфологический словарь русского языка в виде SQL скрипта

Март 13, 2017 г.

Нашел словари на сайте speakrus.ru. Все круто, но почему то распространяется в виде текстовых файлов. К примеру, морфологический словарь из 4 159 394 словоформ для 142 792 лемм - это текстовая портянка 220 мегабайт! Такой файл сложно вообще чем-либо ...

Читать

База прилагательных в виде MySQL скрипта

Март 14, 2017 г.

Здесь представлены две таблицы, полученные из общей базы морфологии слов русского языка. Одна содержит все прилагательные в "нормальной форме", т.е. в мужского рода, ед. числа, именительного падежа. Вторая таблица содержит морфологию прилагательных, все ...

Читать
 

Комментарии к «Местоимения, база в виде sql скрипта»

Понравилась статья? Есть вопросы? - пишите в комментариях.



Комментарий: