《深入理解Elasticsearch（原书第2版）》一1.3　在线书店示例-低调大师

《深入理解Elasticsearch（原书第2版）》一1.3　在线书店示例

2017-05-01 687

本节书摘来自华章出版社《深入理解Elasticsearch（原书第2版）》一书中的第1章，第1.3节，作者[美]拉斐尔·酷奇（Rafal Ku）　马雷克·罗戈任斯基（Marek Rogoziski），更多章节内容可以访问云栖社区“华章计算机”公众号查看

1.3　在线书店示例

本书可作为《Elasticsearch server, Second Edition》一书的延续。因此，我们在这里也沿用在那本书中的案例。总的来说，假设自己正在实现和运作一个在线书店。
首先需要一个library索引，它的映射定义如下：

5c2a3acd27b9c05aca4ad860aad29f4ebaf8c329

66afb3e900db064ea5754e14ba4f447224f80573

这段映射代码位于随书提供的library.json文件。
我们将要使用的数据也可以在随书提供的books.json文件中找到。这个文件中的文档示例如下：

df63aa0047d5834206bf6af772811b316e2cafb3

　读者可以从自己在http://www.packtpub.com 的个人账户中下载所

微信关注我们

原文链接：https://yq.aliyun.com/articles/90277

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

使用 Elasticsearch 的 NGram 分词器处理模糊匹配

接到一个任务：用 Elasticsearch 实现搜索银行支行名称的功能。大概就是用户输入一截支行名称或拼音首字母，返回相应的支行名称。比如，用户输入"工行"或者"gh"，我需要返回"工行XXX分行"类似这样的结果。我心里嘀咕着：数据库不是支持通配符查询吗？为什么不直接用数据库查询？说归说，但是任务还是要完成的。之前有在网上看过一篇文章，主要就是说用 Elasticsearch 处理通配符查询不太适合，然后我在评论中看到作者推荐了一个分词器 NGram。这个分词器可以让通配符查询和普通的查询一样迅速，因为该分词器在数据索引阶段就把所有工作做完了： An n-gram can be best thought of as a moving window on a word. The n stands for a length. If we were to n-gram the word quick, the results would depend on the length we have chosen: Length 1 (unigram): [ q, u, i, c, k ] ...

2017-05-01

1037

1.1　运行环境准备考虑到大部分公司的开发和生成环境都采用Linux操作系统，所以笔者选用了64位的Linux。在正式安装Spark之前，先要找台好机器。为什么？因为笔者在安装、编译、调试的过程中发现Spark非常耗费内存，如果机器配置太低，恐怕会跑不起来。Spark的开发语言是Scala，而Scala需要运行在JVM之上，因而搭建Spark的运行环境应该包括JDK和Scala。 1.1.1　安装JDK 使用命令getconf LONG_BIT查看Linux机器是32位还是64位，然后下载相应版本的JDK并安装。下载地址： http://www.oracle.com/technetwork/java/javase/downloads/index.html 配置环境： cd ~ vim .bash_profile 添加如下配置： export J

2017-05-01

695

资源下载

更多资源

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题，腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构，目前腾讯云软件源站支持公网访问和内网访问。

Spring

Spring框架（Spring Framework）是由Rod Johnson于2002年提出的开源Java企业级应用框架，旨在通过使用JavaBean替代传统EJB实现方式降低企业级编程开发的复杂性。该框架基于简单性、可测试性和松耦合性设计理念，提供核心容器、应用上下文、数据访问集成等模块，支持整合Hibernate、Struts等第三方框架，其适用范围不仅限于服务器端开发，绝大多数Java应用均可从中受益。

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能，例如代码缩略图，Python的插件，代码段等。还可自定义键绑定，菜单和工具栏。Sublime Text 的主要功能包括：拼写检查，书签，完整的 Python API ， Goto 功能，即时项目切换，多选择，多窗口等等。Sublime Text 是一个跨平台的编辑器，同时支持Windows、Linux、Mac OS X等操作系统。

WebStorm

WebStorm 是jetbrains公司旗下一款JavaScript 开发工具。目前已经被广大中国JS开发者誉为“Web前端开发神器”、“最强大的HTML5编辑器”、“最智能的JavaScript IDE”等。与IntelliJ IDEA同源，继承了IntelliJ IDEA强大的JS部分的功能。