博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
java余弦相似度算法_Java基于余弦方法实现的计算相似度算法示例
阅读量:4955 次
发布时间:2019-06-12

本文共 2318 字,大约阅读时间需要 7 分钟。

本文实例讲述了Java基于余弦方法实现的计算相似度算法。分享给大家供大家参考,具体如下:

(1)余弦相似性

通过测量两个向量之间的角的余弦值来度量它们之间的相似性。0度角的余弦值是1,而其他任何角度的余弦值都不大于1;并且其最小值是-1。从而两个向量之间的角度的余弦值确定两个向量是否大致指向相同的方向。所以,它通常用于文件比较。

相关介绍可参考百度百科:余弦相似性

(2)算法实现的中未使用权重(IDF ---逆文档频率),使用词项的出现次数作为向量空间的值。

import java.util.HashMap;

import java.util.Iterator;

import java.util.Map;

public class SimilarDegreeByCos

{

/*

* 计算两个字符串(英文字符)的相似度,简单的余弦计算,未添权重

*/

public static double getSimilarDegree(String str1, String str2)

{

//创建向量空间模型,使用map实现,主键为词项,值为长度为2的数组,存放着对应词项在字符串中的出现次数

Map vectorSpace = new HashMap();

int[] itemCountArray = null;//为了避免频繁产生局部变量,所以将itemCountArray声明在此

//以空格为分隔符,分解字符串

String strArray[] = str1.split(" ");

for(int i=0; i

{

if(vectorSpace.containsKey(strArray[i]))

++(vectorSpace.get(strArray[i])[0]);

else

{

itemCountArray = new int[2];

itemCountArray[0] = 1;

itemCountArray[1] = 0;

vectorSpace.put(strArray[i], itemCountArray);

}

}

strArray = str2.split(" ");

for(int i=0; i

{

if(vectorSpace.containsKey(strArray[i]))

++(vectorSpace.get(strArray[i])[1]);

else

{

itemCountArray = new int[2];

itemCountArray[0] = 0;

itemCountArray[1] = 1;

vectorSpace.put(strArray[i], itemCountArray);

}

}

//计算相似度

double vector1Modulo = 0.00;//向量1的模

double vector2Modulo = 0.00;//向量2的模

double vectorProduct = 0.00; //向量积

Iterator iter = vectorSpace.entrySet().iterator();

while(iter.hasNext())

{

Map.Entry entry = (Map.Entry)iter.next();

itemCountArray = (int[])entry.getValue();

vector1Modulo += itemCountArray[0]*itemCountArray[0];

vector2Modulo += itemCountArray[1]*itemCountArray[1];

vectorProduct += itemCountArray[0]*itemCountArray[1];

}

vector1Modulo = Math.sqrt(vector1Modulo);

vector2Modulo = Math.sqrt(vector2Modulo);

//返回相似度

return (vectorProduct/(vector1Modulo*vector2Modulo));

}

/*

*

*/

public static void main(String args[])

{

String str1 = "gold silver truck";

String str2 = "Shipment of gold damaged in a fire";

String str3 = "Delivery of silver arrived in a silver truck";

String str4 = "Shipment of gold arrived in a truck";

String str5 = "gold gold gold gold gold gold";

System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str2));

System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str3));

System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str4));

System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str5));

}

}

希望本文所述对大家java程序设计有所帮助。

转载地址:http://uzyhp.baihongyu.com/

你可能感兴趣的文章
宏观经济
查看>>
译:面试投行的20个Java问题
查看>>
综合练习:词频统计
查看>>
BZOJ1026: [SCOI2009]windy数
查看>>
ASP.NET应用程序和ASP.NET网站所共有的文件: App_Browsers 等
查看>>
ASP.NET杂货店实战视频 VS2010+SQL2008 三层架构设计开发讲解
查看>>
样板操作数
查看>>
64位UBUNTU下安装adobe reader后无法启动
查看>>
动态缓存技术之CSI,SSI,ESI
查看>>
mac 上将.pem文件转为.pub文件
查看>>
整理下心情
查看>>
iTextSharp带中文转换出来的PDF文档显示乱码
查看>>
阶乘因式分解(一)
查看>>
qt学习记录-----3.信号与槽的问题
查看>>
『ORACLE』 内置约束(11g)
查看>>
Vue--学习过程中遇到的坑
查看>>
组件:slot插槽
查看>>
.net压缩图片质量(附demo)
查看>>
equals和==的区别
查看>>
Android6.0指纹识别开发
查看>>