支持 4 种算法,计算两段文本的相似度
你输入两段文本,它帮你算出两者内容的相似程度。解决论文对比、文案查重、内容匹配的初步量化需求。
内置 Levenshtein、Jaccard、Cosine、Sorensen-Dice 四种常用相似度算法,你可以按需切换算法得到不同结果。
单段文本支持最多 10000 字。更长文本会自动截断前部计算,不影响结果范围。
结果范围都是 0 到 1,越接近 1 相似度越高。不同算法计算逻辑不同,结果会有差异。
默认不区分大小写,统一忽略首尾空格。算法计算时不单独处理特殊符号。
不可以。这是基础相似度计算,和专业学术查重的算法、规则完全不同。