2018-05-10 03:00:52 +03:00
|
|
|
|
# Стеммер Портера для русского языка
|
|
|
|
|
|
2018-05-10 03:19:19 +03:00
|
|
|
|
[![Build Status](https://travis-ci.org/NeonXP/StemmerRu.svg?branch=master)](https://travis-ci.org/NeonXP/StemmerRu)
|
2018-05-10 03:23:17 +03:00
|
|
|
|
[![codecov](https://codecov.io/gh/NeonXP/StemmerRu/branch/master/graph/badge.svg)](https://codecov.io/gh/NeonXP/StemmerRu)
|
2018-05-10 03:19:19 +03:00
|
|
|
|
|
2018-05-10 03:00:52 +03:00
|
|
|
|
Стемминг - процесс получения основы слова из любой его формы. Иными словами, отсекает лишние суффиксы и окончания.
|
|
|
|
|
|
|
|
|
|
Самое очевидное применение - в полнотекстовом поиске, где нужно, чтобы слово находилось, даже если у него другое окончание.
|
|
|
|
|
|
|
|
|
|
Этот пакет - реализация [стеммера Портера](https://ru.wikipedia.org/wiki/Стемминг#Стеммер_Портера) для русского языка на Go.
|
|
|
|
|
|
|
|
|
|
## Использование
|
|
|
|
|
|
|
|
|
|
`основа := StemmerRu.StemWord("слово")`
|
|
|
|
|
|
|
|
|
|
Преобразует слово на входе в его основу на выходе
|
|
|
|
|
|
|
|
|
|
## Пример
|
|
|
|
|
|
|
|
|
|
```
|
|
|
|
|
package main
|
|
|
|
|
|
|
|
|
|
import (
|
|
|
|
|
"fmt"
|
|
|
|
|
"github.com/neonxp/StemmerRu"
|
|
|
|
|
)
|
|
|
|
|
|
|
|
|
|
func main() {
|
|
|
|
|
fmt.Println(StemmerRu.StemWord("безмолвны") // выведет: безмолвн
|
|
|
|
|
fmt.Println(StemmerRu.StemWord("безмолвные") // выведет: безмолвн
|
|
|
|
|
fmt.Println(StemmerRu.StemWord("безмолвный") // выведет: безмолвн
|
|
|
|
|
fmt.Println(StemmerRu.StemWord("безмолвным") // выведет: безмолвн
|
|
|
|
|
fmt.Println(StemmerRu.StemWord("безмолвных") // выведет: безмолвн
|
|
|
|
|
}
|
2018-05-10 03:19:19 +03:00
|
|
|
|
```
|