必要性详解 | 学习笔记

简介: 快速学习必要性详解

开发者学堂课程【ElasticSearch 入门精讲必要性详解学习笔记,与课程紧密连接,让用户快速学习知识。

课程地址https://developer.aliyun.com/learning/course/631/detail/10011


必要性详解


内容介绍:

一、讲义

二、演示


一、讲义

先不安装任何中文分词的插件,使用 termQuery 查询,看能否查询到需要的结果。

新建索引库 ok

##添加数据

curl-H'Content-Type:application/json'-XPOST http://JANSON01:9200

/ok/news/1 -d'{"content":"美国留给伊拉克的是个烂摊子吗"}'

curl -H 'Content-Type:application/json' -XPOST http://JANSON01:9200

/ok/news/2 -d {"content":公安部:各地校车将享最高路权"}'

curl-H'Content-Type:application/json'-XPOST http://JANSON01:9200

/ok/news/3 -d'{"content ":中韩渔警冲突调查:韩警平均每天扣1艘中国渔船"}'

curl-H'Content-Type:application/json'-XPOST http://JANSON01:9200

/ok/news/4 -d {"content":"中国驻洛杉矶领事馆遭亚裔男子枪击 嫌犯已自首"}'


二、演示

打开插件,点击索引,新建索引 ok

image.png

建好之后,往 ok 这个索引库里添加数据

打开客户端 FinalShell,连接一下

image.png

然后粘贴以上代码,回车,然后通过客户端浏览数据,先刷新,看到有一个 ok 的索引库,里面有一个 news 的 type,有加进去的数据。

image.png

检索一下,在 TestES.java 中输入

/**

*测试中文分词插件(没有安装中文分词插件的情形)

*<p>

*查询 ok 索引库中 type 之 news 中的字段 content 中包含有中的索引信息

*发现: 可以单独查询出包含个别字的索引信息,但是:若是词,查询失败。如:中国。

*原因: 默认的分词法中,认为一个汉字是一个词

*/

@Test

public void testChinesePlugin() {SearchResponseresponse= client.prepareSearch( ...indices:"ok")

.setTypes("news")

.setQuery(QueryBuilders.termQuery(name:"content", value:"中"))

.get();

for (SearchHit hit : response.getHits()) {

System.out.println(hit.getSourceAsString());

}

}

运行结果显示:

{“content”: “中国驻洛杉矶领事馆遭亚裔男子枪击 嫌犯已自首”}

{“content”: “中韩渔警冲突调查:韩警平均每天扣1艘中国渔船”}

但是中国能不能查询出来呢?试着修改代码

.setQuery(QueryBuilders.termQuery(name:"content", value:"中国"))

查询不出结果,这里就强调安装中文分词插件的重要性

相关文章
|
3天前
|
数据采集 人工智能 安全
|
12天前
|
云安全 监控 安全
|
4天前
|
自然语言处理 API
万相 Wan2.6 全新升级发布!人人都能当导演的时代来了
通义万相2.6全新升级,支持文生图、图生视频、文生视频,打造电影级创作体验。智能分镜、角色扮演、音画同步,让创意一键成片,大众也能轻松制作高质量短视频。
1043 151
|
4天前
|
编解码 人工智能 机器人
通义万相2.6,模型使用指南
智能分镜 | 多镜头叙事 | 支持15秒视频生成 | 高品质声音生成 | 多人稳定对话
|
17天前
|
机器学习/深度学习 人工智能 自然语言处理
Z-Image:冲击体验上限的下一代图像生成模型
通义实验室推出全新文生图模型Z-Image,以6B参数实现“快、稳、轻、准”突破。Turbo版本仅需8步亚秒级生成,支持16GB显存设备,中英双语理解与文字渲染尤为出色,真实感和美学表现媲美国际顶尖模型,被誉为“最值得关注的开源生图模型之一”。
1732 9
|
9天前
|
人工智能 自然语言处理 API
一句话生成拓扑图!AI+Draw.io 封神开源组合,工具让你的效率爆炸
一句话生成拓扑图!next-ai-draw-io 结合 AI 与 Draw.io,通过自然语言秒出架构图,支持私有部署、免费大模型接口,彻底解放生产力,绘图效率直接爆炸。
680 152
|
11天前
|
人工智能 安全 前端开发
AgentScope Java v1.0 发布,让 Java 开发者轻松构建企业级 Agentic 应用
AgentScope 重磅发布 Java 版本,拥抱企业开发主流技术栈。
645 13
|
6天前
|
SQL 自然语言处理 调度
Agent Skills 的一次工程实践
**本文采用 Agent Skills 实现整体智能体**,开发框架采用 AgentScope,模型使用 **qwen3-max**。Agent Skills 是 Anthropic 新推出的一种有别于mcp server的一种开发方式,用于为 AI **引入可共享的专业技能**。经验封装到**可发现、可复用的能力单元**中,每个技能以文件夹形式存在,包含特定任务的指导性说明(SKILL.md 文件)、脚本代码和资源等 。大模型可以根据需要动态加载这些技能,从而扩展自身的功能。目前不少国内外的一些框架也开始支持此种的开发方式,详细介绍如下。
406 4