我最近开始使用 ElasticSearch,但似乎无法让它搜索单词的一部分。
示例: 在 ElasticSearch 中,我有三个来自 couchdb 的索引文档:
{
"_id" : "1",
"name" : "John Doeman",
"function" : "Janitor"
}
{
"_id" : "2",
"name" : "Jane Doewoman",
"function" : "Teacher"
}
{
"_id" : "3",
"name" : "Jimmy Jackal",
"function" : "Student"
}
现在,我要搜索所有包含“ Doe”的文档
curl http://localhost:9200/my_idx/my_type/_search?q=Doe
没有任何结果,但如果我搜索
curl http://localhost:9200/my_idx/my_type/_search?q=Doeman
它确实返回了一份文件(约翰杜曼)。
我尝试过将不同的分析器和过滤器设置为索引的属性。我还尝试使用一个完整的查询(例如:
{
"query": {
"term": {
"name": "Doe"
}
}
}
) 但似乎没什么效果。
当我搜索“ Doe”时,如何让 ElasticSearch 同时找到 John Doeman 和 Jane Doewoman?
更新
我尝试使用 nGram 标记器和过滤器,就像 Igor 建议的那样,像这样:
{
"index": {
"index": "my_idx",
"type": "my_type",
"bulk_size": "100",
"bulk_timeout": "10ms",
"analysis": {
"analyzer": {
"my_analyzer": {
"type": "custom",
"tokenizer": "my_ngram_tokenizer",
"filter": [
"my_ngram_filter"
]
}
},
"filter": {
"my_ngram_filter": {
"type": "nGram",
"min_gram": 1,
"max_gram": 1
}
},
"tokenizer": {
"my_ngram_tokenizer": {
"type": "nGram",
"min_gram": 1,
"max_gram": 1
}
}
}
}
}
我现在遇到的问题是,每个查询都返回所有文档。 有什么建议吗? 使用 nGram 的 ElasticSearch 文档不是很好..。