关于nlp:java-如何计算两个汉字的相似度如何获得一个汉字的相似汉字

作者：

jiezi

在

nlp

计算汉字类似度

情景

有时候咱们心愿计算两个汉字的类似度，比方文本的 OCR 等场景。用于辨认纠正。

实现

引入 maven

<dependency>
    <groupId>com.github.houbb</groupId>
    <artifactId>nlp-hanzi-similar</artifactId>
    <version>1.3.0</version>
</dependency>

java 实现

double rate1 = HanziSimilarHelper.similar('末', '未');

返回对应的类似度：

0.9629629629629629

返回一个汉字的类似列表

情景

找到类似的汉字，有很多乏味的场景。

实现

List<String> list = HanziSimilarHelper.similarList('爱');
Assert.assertEquals("[爰, 爯, 受, 爭, 妥, 憂, 李, 爳, 叐, 雙]", list.toString());

开源地址

为了便于大家学习，上述代码已开源

https://github.com/houbb/nlp-hanzi-similar

在线体验

在线体验

拓展浏览

NLP 中文形近字类似度计算思路

中文形近字类似度算法实现，为汉字 NLP 尽一点绵薄之力

当代中国最贵的汉字是什么？

NLP 开源形近字算法补完打算（完结篇）

NLP 开源形近字算法之形近字列表（番外篇）

开源我的项目在线化中文繁简体转换/敏感词/拼音/分词/汉字类似度/markdown 目录

发表回复取消回复

这个站点使用 Akismet 来减少垃圾评论。了解你的评论数据如何被处理。

关于nlp:java-如何计算两个汉字的相似度如何获得一个汉字的相似汉字

计算汉字类似度

情景

实现

返回一个汉字的类似列表

情景

实现

开源地址

在线体验

拓展浏览

评论

发表回复取消回复

更多文章

苹果iOS打包的ipa应用无法安装？一篇文章带你了解可能的原因及排查方法

图解Golang：从零开始实现简易版过期LRU缓存

深入解析：基于Delta的线性数据结构模型，打造高效富文本编辑器

轻松管理社交媒体：使用Automa插件实现一键拉黑功能

关于nlp:java-如何计算两个汉字的相似度如何获得一个汉字的相似汉字

计算汉字类似度

情景

实现

返回一个汉字的类似列表

情景

实现

开源地址

在线体验

拓展浏览

评论

发表回复 取消回复

更多文章

苹果iOS打包的ipa应用无法安装？一篇文章带你了解可能的原因及排查方法

图解Golang：从零开始实现简易版过期LRU缓存

深入解析：基于Delta的线性数据结构模型，打造高效富文本编辑器

轻松管理社交媒体：使用Automa插件实现一键拉黑功能

发表回复取消回复