【C#】C#匹配两个相似的字符串莱文斯坦距离Levenshtein Distance莱文斯坦距离算法

本文主要是介绍【C#】C#匹配两个相似的字符串莱文斯坦距离Levenshtein Distance莱文斯坦距离算法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

文章目录

  • 一、问题描述
  • 二、代码
  • 三、解释


一、问题描述

需要匹配多个类似的内容,并且要求相似度在70%以上并且长度相近,可以在处理每个匹配项时,将其与所有目标进行比较,并筛选出符合条件的匹配项。

二、代码

using System;
using System.Collections.Generic;
using System.Linq;// 定义页面名称
string pageTitle = "大气压力";// 定义要匹配的内容列表
List<string> targetDescriptions = new List<string>
{"大气层压力","天上的大气层压力","压力大气层"
};// 计算字符串相似度
double CalculateSimilarity(string s1, string s2)
{int maxLength = Math.Max(s1.Length, s2.Length);int distance = LevenshteinDistance(s1, s2);return 1.0 - (double)distance / maxLength;
}// 计算Levenshtein距离
public int LevenshteinDistance(string word1, string word2)  {  int m = word1.Length;  int n = word2.Length;  if (m * n == 0)  {  return Math.Max(m, n);  }  int[,] lev = new int[m + 1, n + 1];  // 字符串word1从空串变为字符串word2前j个字符的莱文斯坦距离  for (int j = 0; j < n + 1; j++)  {  lev[0, j] = j;  }  // 字符串word1从前i个字符变为空串的莱文斯坦距离  for (int i = 0; i < m + 1; i++)  {  lev[i, 0] = i;  }  for (int i = 1; i < m + 1; i++)  {  for (int j = 1; j < n + 1; j++)  {  // 在字符串word1的前i个字符与字符串word2的前j-1个字符完全相同的基础上, 进行一次插入操作  int countByInsert = lev[i, j - 1] + 1;  // 在字符串word1的前i-1个字符与字符串word2的前j个字符完全相同的基础上, 进行一次删除操作  int countByDel = lev[i - 1, j] + 1;  // 在字符串word1的前i-1个字符与字符串word2的前j-1个字符完全相同的基础上, 进行一次替换操作  int countByReplace = word1[i - 1] == word2[j - 1] ? lev[i - 1, j - 1] : lev[i - 1, j - 1] + 1;  // 计算字符串word1的前i个字符与字符串word2的前j个字符的莱文斯坦距离  lev[i, j] = Math.Min(countByInsert, Math.Min(countByDel, countByReplace));  }  }  return lev[m, n];  }  // 遍历所有要匹配的内容
foreach (string targetDescription in targetDescriptions)
{// 检查文本与页面名称的相似度和长度if (CalculateSimilarity(targetDescription, pageTitle) >= 0.7 && Math.Abs(targetDescription.Length - pageTitle.Length) <= 3){Console.WriteLine("匹配成功: " + targetDescription);}
}

三、解释

  1. 首先,定义了一个页面名称pageTitle为"大气压力"。
  2. 然后,定义了一个要匹配的内容列表targetDescriptions,包含了三个待匹配的描述
  3. 接着,定义了一个CalculateSimilarity函数,用于计算两个字符串之间的相似度。在函数内部,首先计算两个字符串的最大长度,然后使用Levenshtein距离算法计算它们之间的编辑距离,最后返回相似度值。
  4. 紧接着,定义了一个LevenshteinDistance函数,用于计算两个字符串之间的Levenshtein距离。该函数通过动态规划算法计算两个字符串之间的编辑距离。
  5. 最后,通过遍历要匹配的内容列表targetDescriptions,对每个描述进行相似度和长度的检查。如果某个描述与页面名称的相似度大于等于0.7并且长度差值不超过3,则输出"匹配成功:"以及匹配的描述内容。

这篇关于【C#】C#匹配两个相似的字符串莱文斯坦距离Levenshtein Distance莱文斯坦距离算法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/897390

相关文章

Springboot3+将ID转为JSON字符串的详细配置方案

《Springboot3+将ID转为JSON字符串的详细配置方案》:本文主要介绍纯后端实现Long/BigIntegerID转为JSON字符串的详细配置方案,s基于SpringBoot3+和Spr... 目录1. 添加依赖2. 全局 Jackson 配置3. 精准控制(可选)4. OpenAPI (Spri

Go语言如何判断两张图片的相似度

《Go语言如何判断两张图片的相似度》这篇文章主要为大家详细介绍了Go语言如何中实现判断两张图片的相似度的两种方法,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 在介绍技术细节前,我们先来看看图片对比在哪些场景下可以用得到:图片去重:自动删除重复图片,为存储空间"瘦身"。想象你是一个

C#如何去掉文件夹或文件名非法字符

《C#如何去掉文件夹或文件名非法字符》:本文主要介绍C#如何去掉文件夹或文件名非法字符的问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录C#去掉文件夹或文件名非法字符net类库提供了非法字符的数组这里还有个小窍门总结C#去掉文件夹或文件名非法字符实现有输入字

C#之List集合去重复对象的实现方法

《C#之List集合去重复对象的实现方法》:本文主要介绍C#之List集合去重复对象的实现方法,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录C# List集合去重复对象方法1、测试数据2、测试数据3、知识点补充总结C# List集合去重复对象方法1、测试数据

C#实现将Office文档(Word/Excel/PDF/PPT)转为Markdown格式

《C#实现将Office文档(Word/Excel/PDF/PPT)转为Markdown格式》Markdown凭借简洁的语法、优良的可读性,以及对版本控制系统的高度兼容性,逐渐成为最受欢迎的文档格式... 目录为什么要将文档转换为 Markdown 格式使用工具将 Word 文档转换为 Markdown(.

使用Python实现base64字符串与图片互转的详细步骤

《使用Python实现base64字符串与图片互转的详细步骤》要将一个Base64编码的字符串转换为图片文件并保存下来,可以使用Python的base64模块来实现,这一过程包括解码Base64字符串... 目录1. 图片编码为 Base64 字符串2. Base64 字符串解码为图片文件3. 示例使用注意

Java调用C#动态库的三种方法详解

《Java调用C#动态库的三种方法详解》在这个多语言编程的时代,Java和C#就像两位才华横溢的舞者,各自在不同的舞台上展现着独特的魅力,然而,当它们携手合作时,又会碰撞出怎样绚丽的火花呢?今天,我们... 目录方法1:C++/CLI搭建桥梁——Java ↔ C# 的“翻译官”步骤1:创建C#类库(.NET

C#代码实现解析WTGPS和BD数据

《C#代码实现解析WTGPS和BD数据》在现代的导航与定位应用中,准确解析GPS和北斗(BD)等卫星定位数据至关重要,本文将使用C#语言实现解析WTGPS和BD数据,需要的可以了解下... 目录一、代码结构概览1. 核心解析方法2. 位置信息解析3. 经纬度转换方法4. 日期和时间戳解析5. 辅助方法二、L

使用C#删除Excel表格中的重复行数据的代码详解

《使用C#删除Excel表格中的重复行数据的代码详解》重复行是指在Excel表格中完全相同的多行数据,删除这些重复行至关重要,因为它们不仅会干扰数据分析,还可能导致错误的决策和结论,所以本文给大家介绍... 目录简介使用工具C# 删除Excel工作表中的重复行语法工作原理实现代码C# 删除指定Excel单元

golang float和科学计数法转字符串的实现方式

《golangfloat和科学计数法转字符串的实现方式》:本文主要介绍golangfloat和科学计数法转字符串的实现方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望... 目录golang float和科学计数法转字符串需要对float转字符串做处理总结golang float