stemmerru/README.md

36 lines
1.6 KiB
Markdown
Raw Normal View History

2018-05-10 03:00:52 +03:00
# Стеммер Портера для русского языка
2018-05-10 03:19:19 +03:00
[![Build Status](https://travis-ci.org/NeonXP/StemmerRu.svg?branch=master)](https://travis-ci.org/NeonXP/StemmerRu)
2018-05-10 03:23:17 +03:00
[![codecov](https://codecov.io/gh/NeonXP/StemmerRu/branch/master/graph/badge.svg)](https://codecov.io/gh/NeonXP/StemmerRu)
2018-05-10 03:19:19 +03:00
2018-05-10 03:00:52 +03:00
Стемминг - процесс получения основы слова из любой его формы. Иными словами, отсекает лишние суффиксы и окончания.
Самое очевидное применение - в полнотекстовом поиске, где нужно, чтобы слово находилось, даже если у него другое окончание.
Этот пакет - реализация [стеммера Портера](https://ru.wikipedia.org/wiki/Стемминг#Стеммерортера) для русского языка на Go.
## Использование
`основа := StemmerRu.StemWord("слово")`
Преобразует слово на входе в его основу на выходе
## Пример
```
package main
import (
"fmt"
"github.com/neonxp/StemmerRu"
)
func main() {
fmt.Println(StemmerRu.StemWord("безмолвны") // выведет: безмолвн
fmt.Println(StemmerRu.StemWord("безмолвные") // выведет: безмолвн
fmt.Println(StemmerRu.StemWord("безмолвный") // выведет: безмолвн
fmt.Println(StemmerRu.StemWord("безмолвным") // выведет: безмолвн
fmt.Println(StemmerRu.StemWord("безмолвных") // выведет: безмолвн
}
2018-05-10 03:19:19 +03:00
```