<address id="ousso"></address>
<form id="ousso"><track id="ousso"><big id="ousso"></big></track></form>
  1. java語言

    Java基于余弦方法實現的計算相似度算法示例

    時間:2025-02-10 07:59:26 java語言 我要投稿
    • 相關推薦

    Java基于余弦方法實現的計算相似度算法示例

      引導語:Java 編程語言的風格十分接近C、C++語言。Java是一個純的面向對象的程序設計語言,以下是小編整理的Java基于余弦方法實現的計算相似度算法示例,歡迎參考閱讀!

      (1)余弦相似性

      通過測量兩個向量之間的角的余弦值來度量它們之間的相似性。0度角的余弦值是1,而其他任何角度的余弦值都不大于1;并且其最小值是-1。從而兩個向量之間的角度的余弦值確定兩個向量是否大致指向相同的方向。所以,它通常用于文件比較。

      相關介紹可參考百度百科:余弦相似性

      (2)算法實現的中未使用權重(IDF ---逆文檔頻率),使用詞項的出現次數作為向量空間的值。

      import java.util.HashMap;

      import java.util.Iterator;

      import java.util.Map;

      public class SimilarDegreeByCos

      {

      /*

      * 計算兩個字符串(英文字符)的相似度,簡單的余弦計算,未添權重

      */

      public static double getSimilarDegree(String str1, String str2)

      {

      //創建向量空間模型,使用map實現,主鍵為詞項,值為長度為2的數組,存放著對應詞項在字符串中的出現次數

      MapvectorSpace = new HashMap();

      int[] itemCountArray = null;//為了避免頻繁產生局部變量,所以將itemCountArray聲明在此

      //以空格為分隔符,分解字符串

      String strArray[] = str1.split(" ");

      for(int i=0; i<strArray.length; ++i)

      {

      if(vectorSpace.containsKey(strArray[i]))

      ++(vectorSpace.get(strArray[i])[0]);

      else

      {

      itemCountArray = new int[2];

      itemCountArray[0] = 1;

      itemCountArray[1] = 0;

      vectorSpace.put(strArray[i], itemCountArray);

      }

      }

      strArray = str2.split(" ");

      for(int i=0; i<strArray.length; ++i)

      {

      if(vectorSpace.containsKey(strArray[i]))

      ++(vectorSpace.get(strArray[i])[1]);

      else

      {

      itemCountArray = new int[2];

      itemCountArray[0] = 0;

      itemCountArray[1] = 1;

      vectorSpace.put(strArray[i], itemCountArray);

      }

      }

      //計算相似度

      double vector1Modulo = 0.00;//向量1的模

      double vector2Modulo = 0.00;//向量2的模

      double vectorProduct = 0.00; //向量積

      Iterator iter = vectorSpace.entrySet().iterator();

      while(iter.hasNext())

      {

      Map.Entry entry = (Map.Entry)iter.next();

      itemCountArray = (int[])entry.getValue();

      vector1Modulo += itemCountArray[0]*itemCountArray[0];

      vector2Modulo += itemCountArray[1]*itemCountArray[1];

      vectorProduct += itemCountArray[0]*itemCountArray[1];

      }

      vector1Modulo = Math.sqrt(vector1Modulo);

      vector2Modulo = Math.sqrt(vector2Modulo);

      //返回相似度

      return (vectorProduct/(vector1Modulo*vector2Modulo));

      }

      /*

      *

      */

      public static void main(String args[])

      {

      String str1 = "gold silver truck";

      String str2 = "Shipment of gold damaged in a fire";

      String str3 = "Delivery of silver arrived in a silver truck";

      String str4 = "Shipment of gold arrived in a truck";

      String str5 = "gold gold gold gold gold gold";

      System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str2));

      System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str3));

      System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str4));

      System.out.println(SimilarDegreeByCos.getSimilarDegree(str1, str5));

      }

      }

    【Java基于余弦方法實現的計算相似度算法示例】相關文章:

    java算法實現排列組合的方法介紹09-23

    權重隨機算法的java實現08-13

    冒泡排序算法原理及JAVA實現代碼方法10-16

    java通用組合算法如何實現09-12

    JAVA簡單選擇排序算法及實現10-02

    快速排序算法及C#版的實現示例07-03

    希爾排序算法的C語言實現示例08-30

    KMP算法的C#實現方法08-29

    java構造函數實現代碼示例08-23

    <address id="ousso"></address>
    <form id="ousso"><track id="ousso"><big id="ousso"></big></track></form>
    1. 日日做夜狠狠爱欧美黑人