位置:首页 > 进阶教程 > Elasticsearch别名功能详解:基础用法与实用场景

Elasticsearch别名功能详解:基础用法与实用场景

时间:2026-08-21  |  作者:318050  |  阅读:0

题记

本文从别名分类、索引别名实践、索引别名的好处、索引别名常见问题及坑解读、字段别名实践一把五个方面进行详细解读。

1、别名分类

别名在Elasticsearch中有两种分类。

1.1 索引别名

官方释义:索引别名可以指向一个或多个索引,并且可以在任何需要索引名称的API中使用。

别名为我们提供了极大的灵活性。它们允许我们执行以下操作:

  • 在正在运行的集群上的一个索引和另一个索引之间透明切换;

  • 对多个索引进行分组组合,比如给 lastthreemonths 这样的索引别名指定一组索引(如过去3个月的 logstash201903logstash201904logstash_201905);

  • 在索引中的文档子集上创建“视图”(结合业务场景,会提升检索效率)。

通俗解释:索引别名类似:windows的快捷方式,linux的软链接,mysql的视图。

前提:Elasitcsearch创建索引后,索引名不允许改。很多业务场景下,单一索引可能无法满足要求。

注意:实际业务场景使用别名会很方便、灵活、快捷、业务松耦合!!

1.2 字段别名

在Elasticsearch Mapping定义的6.4 版本才有的字段类型。

通俗解释:

试想一种业务场景。在实际开发中,需要对Facebook、twitter行采集,采集入库的是两个业务团队。

他们对content,分别使用了两个字段。其中一个是content,另外一个是cont。这时候存储到elasticsearch会有两个字段。

这样如果我们在检索、写业务代码的时候,就要写两个不同的字段来处理。

如果有可能写成一个字段,代码方面就很避开业务耦合,也会很方便。

我认为这是字段别名的由来。

2、索引别名实践

2.1 假设没有别名,如何处理多索引检索?

常见有两种方式:

  • 方式一:多索引逗号分隔检索。

POST visitor_logs_2017,visitor_logs_2018/_search
  • 方式二:通配符索引检索。

POST visitor_logs_*/_search

2.2 有了别名后,操作变得简单

实战中,我们不需要知道操作的实际索引名称。

我们可以透明地更改别名引用的索引,而不会影响使用别名的用户。

步骤1:别名关联已有索引

POST /_aliasespretty{"actions": [{"add": {"index": "visitor_logs_2017","alias": "visitor_logs"}},{"add": {"index": "visitor_logs_2018","alias": "visitor_logs"}}]}

步骤2:使用别名检索

GET /visitor_logs/_search

3、索引别名的好处

3.1 大数据量的管理

场景:实战中,可能需要基于时间的数据保留策略(利用rollover机制实现),并从系统中删除旧数据。

使用索引别名后,管理会更灵活。

基于时间索引的实现机制如下:
7D1F4380-E6E5-4c58-9632-EB202064D876.png

推荐阅读:

https://gitbook.cn/books/5c52c6923417565017a61ce0/index.html

试想一下:如果不是基于时间的索引,而使用大索引,删除历史数据会发生什么?

答案:

3.2 用户无感知的重建索引

实战中,索引的设计可能不是一步到位。

随着业务的扩展,可能会在开发的中后期调整索引Mapping结构,比如:

  • iksmart改成ikmax_word分词以高效分词,

  • long类型改成keyword以提升检索效率,

  • 修改索引分片数以便于机器横向扩展,

  • 索引分成更小粒度的索引等以提升性能。

通常的做法,都需要借助:reindex操作完成索引的迁移。

如果要确保线上环境的可靠运行,且用户无感知,即无需告知用户、不影响用户业务,使用别名指向更改前和更改后的索引是绝佳方案。

实战举例

POST /_aliasespretty{"actions": [{"remove": {"index": "visitor_logs_2018","alias": "visitor_logs"}},{"add": {"index": "visitor_logs_2018_01","alias": "visitor_logs"}}]}

试想一下,如果没有索引别名呢?

答案:

4、索引别名常见问题及坑解读

问题1:ES批量插入可以使用别名插入吗?

会报错:

no write index is defined for alias[xxx]....

注意:索引别名不是在任何地方都通用。

写入或更新数据的时候需要指明物理索引,不要向别名写入数据。

问题2:ES怎么获取所有别名信息 alias

或者问题:如何通过索引别名查找实际索引名称?

GET _cat/aliases

返回信息:

visitor_logs visitor_logs_2017 - - -.kibana.kibana_1 - - -visitor_logs visitor_logs_2018 - - 

问题3:使用别名和基于索引效率一样吗?

是一致的。

前提:索引和别名指向相同的数据,相同的检索条件。

原理:索引别名只是物理索引的软链接名称而已。

问题4:如何使用别名提升检索效率?

可以从两种方式入手:

方式一:基于时间创建索引,指定多索引别名

比如分为:近1年索引别名,近3个月索引别名,近1个月索引别名,近1周索引别名,近3天索引别名。

检索的时候,先敲定时间范围,然后在指定范围的别名下检索。

核心原理:物理上基于时间做了分隔,再加上冷热数据分离机制,会极大缩小了检索样本。

方式二:使用filter 别名或者 路由别名机制,提升效率

filter Alias上代码,实际业务中极易被忽视,但会极大提升效率。

POST /_aliases{"actions" : [{"add" : { "index" : "test1", "alias" : "alias2", "filter" : { "term" : { "user" : "kimchy" } }}}]}

路由机制参考官方文档即可。

5、字段别名实践一把

字段别名原理第一部分已详细解释,不再赘述。

这里实践一把,加深理解。

PUT trips{"mappings": {"_doc": {"properties": {"distance": {"type": "long"},"route_length_miles": {"type": "alias","path": "distance"},"transit_mode": {"type": "keyword"}}}}}

注意:当用户使用检索时,实际可以使用routelengthmile字段替代distance做检索,以达到distance一样的效果。

6、小结

实战中,一般在开发中后期才发现索引别名的妙处。

正如文中分析:

  • 1、高效索引管理;

  • 2、用户无感知维护数据修改更新。

建议:相同索引别名的物理索引有一致的Mapping和数据结构,以提升检索效率。

注意:发挥索引别名在检索方面的优势,在写入和更新还得使用物理索引。

你的实际Elasticsearch业务场景,有哪些非常基础但实战开发非常有用的技术点呢?欢迎留言留下你的思考,让我们一起精进!

参考

关于索引别名的更多高级用法,可以深入参考这篇详细解析:Our Fa vorite Elasticsearch Features Part 2: Index Aliases

20190117225823895.png

加入星球,更短时间更快习得更多干货

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多