91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

信息檢索課程實驗:構建索引并實現對文檔集合的檢索

發布時間:2020-07-05 03:33:55 來源:網絡 閱讀:377 作者:jokance 欄目:web開發
<?php
    $_txts = array('1.txt','2.txt','3.txt');
    $_len = count($_txts);
    for ($i = 0;$i < $_len;$i++){
        $_contents[] = file_get_contents($_txts[$i]);
    }
         
    for ($i = 0;$i < $_len;$i++){
        //分詞
        $_words[] = explode(' ',trim($_contents[$i]));
        foreach ($_words[$i] as $_key=>$_value){
            $_value = trim($_value);
            $_value = preg_replace('/[.|,|(|)|-|;]/','',$_value);
            $_words[$i][$_key]=strtolower($_value);
                 
        }
        //詞頻tf
        $_tf[] = array_count_values($_words[$i]);
        //去重
        $_words[$i]= array_unique($_words[$i]);
    } 
         
    //合并
    $_words_com = array_merge($_words[0],$_words[1],$_words[2]);
    //文檔頻率
    $_df = array_count_values($_words_com);
    //特征向量
    for ($i = 0;$i < $_len;$i++){
        $_vsm[$i] = $_df;
        foreach($_vsm[$i] as $_key=>$_value){
            $_vsm[$i][$_key] = 0;
        }
        for ($j=0;$j<count($_words[$i]);$j++){
            if (in_array($_words[$i][$j],$_words_com)){
                $_vsm[$i][($_words[$i][$j])] = ($_tf[$i][($_words[$i][$j])])*(log($_len/$_df[($_words[$i][$j])]));
                     
            } 
        }
    } 
         
    for($i = 0;$i < count($_vsm); $i++){
        echo '第'.($i+1).'篇文檔的特征向量: ('. implode(",",$_vsm[$i]).')<br/>';
    }
         
    //測試
    $_query = 'java';
    $_vsm_que = $_df;
    foreach($_vsm_que as $_key=>$_value){
        $_vsm_que[$_key] = 0;
    }
    if (in_array($_query,$_vsm_que)){
        $_vsm_que[$_query] = 1;
    }
         
    for ($i = 0; $i < count($_vsm); $i++){
        foreach($_vsm_que as $_key=>$_value){
            $_sim[$i] += ($_vsm[$i][$_key]) * ($_vsm_que[$_key]);
            $_w1 += pow($_vsm_que[$_key],2);
            $_w2 += pow($_vsm[$i][$_key],2);
        }
        //求夾角余弦值
        $_cos[$i] = $_sim[$i]/(sqrt($_w1)*sqrt($_w2));
    }
         
    arsort($_cos);
    foreach($_cos as $_key=>$_value){
        echo '最符合的結果為第'.($_key+1).'篇文檔';
             
        break;
    }
?>


向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

甘谷县| 新营市| 宁晋县| 临泽县| 咸阳市| 依安县| 乌什县| 务川| 越西县| 广州市| 萍乡市| 安义县| 涿州市| 昭通市| 福州市| 保德县| 宁南县| 霸州市| 同仁县| 赤壁市| 镇坪县| 交城县| 庆安县| 南溪县| 游戏| 孙吴县| 武城县| 阳新县| 札达县| 屏边| 邢台县| 阿勒泰市| 浦东新区| 新民市| 深州市| 阿合奇县| 澄江县| 宝丰县| 肥乡县| 盐津县| 鄂尔多斯市|