ES官方提供了各种不同语言的客户端,用来操作ES。这些客户端的本质就是组装DSL语句,通过http请求发送给ES。官方文档地址:https://www.elastic.co/guide/en/elasticsearch/client/index.html
我们用的是Java HighLevel Rest Client客户端API。

SQL表结构

  1. CREATE TABLE `tb_hotel` (
  2. `id` bigint(20) NOT NULL COMMENT '酒店id',
  3. `name` varchar(255) NOT NULL COMMENT '酒店名称;例:7天酒店',
  4. `address` varchar(255) NOT NULL COMMENT '酒店地址;例:航头路',
  5. `price` int(10) NOT NULL COMMENT '酒店价格;例:329',
  6. `score` int(2) NOT NULL COMMENT '酒店评分;例:45,就是4.5分',
  7. `brand` varchar(32) NOT NULL COMMENT '酒店品牌;例:如家',
  8. `city` varchar(32) NOT NULL COMMENT '所在城市;例:上海',
  9. `star_name` varchar(16) DEFAULT NULL COMMENT '酒店星级,从低到高分别是:1星到5星,1钻到5钻',
  10. `business` varchar(255) DEFAULT NULL COMMENT '商圈;例:虹桥',
  11. `latitude` varchar(32) NOT NULL COMMENT '纬度;例:31.2497',
  12. `longitude` varchar(32) NOT NULL COMMENT '经度;例:120.3925',
  13. `pic` varchar(255) DEFAULT NULL COMMENT '酒店图片;例:/img/1.jpg',
  14. PRIMARY KEY (`id`)
  15. ) ENGINE=InnoDB DEFAULT CHARSET=utf8mb4;

mapping映射分析

创建索引库,最关键的是mapping映射,而mapping映射要考虑的信息包括:

  • 字段名
  • 字段数据类型
  • 是否参与搜索
  • 是否需要分词
  • 如果分词,分词器是什么?

其中:

  • 字段名、字段数据类型,可以参考数据表结构的名称和类型
  • 是否参与搜索要分析业务来判断,例如图片地址,就无需参与搜索
  • 是否分词呢要看内容,内容如果是一个整体就无需分词,反之则要分词
  • 分词器,我们可以统一使用ik_max_word

酒店数据的索引库结构

  1. PUT /hotel
  2. {
  3. "mappings": {
  4. "properties": {
  5. "id": {
  6. "type": "keyword"
  7. },
  8. "name":{
  9. "type": "text",
  10. "analyzer": "ik_max_word",
  11. "copy_to": "all"
  12. },
  13. "address":{
  14. "type": "keyword",
  15. "index": false
  16. },
  17. "price":{
  18. "type": "integer"
  19. },
  20. "score":{
  21. "type": "integer"
  22. },
  23. "brand":{
  24. "type": "keyword",
  25. "copy_to": "all"
  26. },
  27. "city":{
  28. "type": "keyword",
  29. "copy_to": "all"
  30. },
  31. "starName":{
  32. "type": "keyword"
  33. },
  34. "business":{
  35. "type": "keyword"
  36. },
  37. "location":{
  38. "type": "geo_point"
  39. },
  40. "pic":{
  41. "type": "keyword",
  42. "index": false
  43. },
  44. "all":{
  45. "type": "text",
  46. "analyzer": "ik_max_word"
  47. }
  48. }
  49. }
  50. }

:::warning 几个特殊字段说明:

  • location:地理坐标,里面包含精度、纬度

image-20210720222110126.png

  • all:一个组合字段,其目的是将多字段的值 利用copy_to合并,提供给用户搜索

image-20210720222221516.png :::

初始化RestClient

在elasticsearch提供的API中,与elasticsearch一切交互都封装在一个名为RestHighLevelClient的类中,必须先完成这个对象的初始化,建立与elasticsearch的连接。
分为三步:

  1. 引入es的RestHighLevelClient依赖,因为第二步指定了版本,所以引入依赖不用指定版本:

    1. <dependency>
    2. <groupId>org.elasticsearch.client</groupId>
    3. <artifactId>elasticsearch-rest-high-level-client</artifactId>
    4. </dependency>
  2. 因为SpringBoot默认的ES版本是7.6.2,我们要使用和es同一个版本的,所以我们需要覆盖默认的ES版本,写在项目的pom文件里面,指定es的版本:

    1. <properties>
    2. <java.version>1.8</java.version>
    3. <elasticsearch.version>7.12.1</elasticsearch.version>
    4. </properties>
  3. 初始化RestHighLevelClient:

    1. RestHighLevelClient client = new RestHighLevelClient(RestClient.builder(
    2. HttpHost.create("http://ip:9200")//服务器搭建的es的地址
    3. ));

    为了单元测试方便,我们创建一个测试类HotelIndexTest,然后将初始化的代码编写在@BeforeEach方法中: ```java package cn.itcast.hotel;

import org.apache.http.HttpHost; import org.elasticsearch.client.RestHighLevelClient; import org.junit.jupiter.api.AfterEach; import org.junit.jupiter.api.BeforeEach; import org.junit.jupiter.api.Test;

import java.io.IOException;

public class HotelIndexTest { private RestHighLevelClient client;

  1. @BeforeEach
  2. void setUp() {
  3. this.client = new RestHighLevelClient(RestClient.builder(
  4. HttpHost.create("http://ip:9200")
  5. ));
  6. }
  7. @AfterEach
  8. void tearDown() throws IOException {
  9. this.client.close();
  10. }

}

  1. <a name="R2GBt"></a>
  2. # 创建索引库
  3. 因为mapping映射的json太长了,我们定一个常量用来放mapping映射字符串
  4. ```java
  5. package cn.itcast.hotel.constants;
  6. public class HotelConstants {
  7. public static final String MAPPING_TEMPLATE = "{\n" +
  8. " \"mappings\": {\n" +
  9. " \"properties\": {\n" +
  10. " \"id\": {\n" +
  11. " \"type\": \"keyword\"\n" +
  12. " },\n" +
  13. " \"name\":{\n" +
  14. " \"type\": \"text\",\n" +
  15. " \"analyzer\": \"ik_max_word\",\n" +
  16. " \"copy_to\": \"all\"\n" +
  17. " },\n" +
  18. " \"address\":{\n" +
  19. " \"type\": \"keyword\",\n" +
  20. " \"index\": false\n" +
  21. " },\n" +
  22. " \"price\":{\n" +
  23. " \"type\": \"integer\"\n" +
  24. " },\n" +
  25. " \"score\":{\n" +
  26. " \"type\": \"integer\"\n" +
  27. " },\n" +
  28. " \"brand\":{\n" +
  29. " \"type\": \"keyword\",\n" +
  30. " \"copy_to\": \"all\"\n" +
  31. " },\n" +
  32. " \"city\":{\n" +
  33. " \"type\": \"keyword\",\n" +
  34. " \"copy_to\": \"all\"\n" +
  35. " },\n" +
  36. " \"starName\":{\n" +
  37. " \"type\": \"keyword\"\n" +
  38. " },\n" +
  39. " \"business\":{\n" +
  40. " \"type\": \"keyword\"\n" +
  41. " },\n" +
  42. " \"location\":{\n" +
  43. " \"type\": \"geo_point\"\n" +
  44. " },\n" +
  45. " \"pic\":{\n" +
  46. " \"type\": \"keyword\",\n" +
  47. " \"index\": false\n" +
  48. " },\n" +
  49. " \"all\":{\n" +
  50. " \"type\": \"text\",\n" +
  51. " \"analyzer\": \"ik_max_word\"\n" +
  52. " }\n" +
  53. " }\n" +
  54. " }\n" +
  55. "}";
  56. }

在HotelIndexTest测试类中,编写单元测试,实现创建索引:

  1. @Test
  2. void createHotelIndex() throws IOException {
  3. // 1.创建Request对象
  4. CreateIndexRequest request = new CreateIndexRequest("hotel");
  5. // 2.准备请求的参数:DSL语句
  6. request.source(HotelConstants.MAPPING_TEMPLATE, XContentType.JSON);
  7. // 3.发送请求
  8. client.indices().create(request, RequestOptions.DEFAULT);
  9. }

删除索引库

  1. @Test
  2. void testDeleteHotelIndex() throws IOException {
  3. // 1.创建Request对象
  4. DeleteIndexRequest request = new DeleteIndexRequest("hotel");
  5. // 2.发送请求
  6. client.indices().delete(request, RequestOptions.DEFAULT);
  7. }

判断索引库是否存在

判断索引库是否存在,本质就是查询

  1. @Test
  2. void testExistsHotelIndex() throws IOException {
  3. // 1.创建Request对象
  4. GetIndexRequest request = new GetIndexRequest("hotel");
  5. // 2.发送请求
  6. boolean exists = client.indices().exists(request, RequestOptions.DEFAULT);
  7. // 3.输出
  8. System.err.println(exists ? "索引库已经存在!" : "索引库不存在!");
  9. }

总结

JavaRestClient操作elasticsearch的流程基本类似。核心是client.indices()方法来获取索引库的操作对象。
索引库操作的基本步骤:

  • 初始化RestHighLevelClient
  • 创建XxxIndexRequest。XXX是Create、Get、Delete
  • 准备DSL( Create时需要,其它是无参)
  • 发送请求。调用RestHighLevelClient.indices().xxx()方法,xxx是create、exists、delete