Местоимения, база в виде sql скрипта

Местоимения извлечены из базы морфологии русского языка. Они могут склоняются по родам, падежам и образуют три видовые группы. Я не стал вдаваться в детали склонения, чтобы создавать «нормализованную» выборку. Возможно, сделаю это в следующем релизе на GIT.

SQL скрипт размещен на github. Переходим, ищем words-russian-pronouns, жмем download.

words-russian-pronouns-morf.sql.gz — база местоимений, таблица pronouns_morf.

Внимание! Скрипт содержит «DROP TABLE if exists».

Описание таблицы pronouns_morf

Таблица хранит 1916 словоформ местоимений. Некоторые их них допускают склонение по падежам, роду, могут иметь ед/мн число.

  • IID, int — суррогатный ключ, скопирован из основной базы.
  • word, varchar[100] — словоформа.
  • code, int — код словоформы.
  • code_parent, int — код родителя словоформы, согласно иерархии в исходном файле.
  • type, set(’прл’,’сущ’,’нар’,’мест’) — часть речи. В данной таблице вы встретите комбинации местоимение + прилагательное, местоимение + существительное, местоимение + наречие, характеризующие тип местоимения.
  • plural, boolean — множественное число.
  • gender, enum(‘муж’,’жен’,’ср’) — род.
  • wcase, enum(‘им’,’род’,’дат’,’вин’,’тв’,’пр’) — падежи.

Написать комментарий

Мало букафф? Читайте есчо !

База предикативов

Март 15, 2017 г.

База данных предикативов сформирована выборкой из базы морфологии слов русского языка. Мы в школе не изучали эту часть речи. Думаю, лингвисты тоже с трудом отличают предикативы то от междометий, то от наречий. SQL скрипт размещен на github. Переходим ...

Читать

Русские глаголы, sql база

Март 15, 2017 г.

Здесь представлены две выборки, полученные из общей базы морфологии. "Нормализованная" выборка содержит инфинитивы глаголов, а вторая таблица - инфинитивы + словоформы. SQL скрипты размещены на github. Переходим, ищем файлы words-russian-verbs, ...

Читать

 

Комментарии к «Местоимения, база в виде sql скрипта»

Понравилась статья? Есть вопросы? - пишите в комментариях.



Комментарий: