91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

PHP計算文檔頻率與特征向量

發布時間:2020-07-17 22:01:39 來源:網絡 閱讀:848 作者:jokance 欄目:web開發

步驟:

(1)讀取3txt格式的英文文檔;

(2)對每篇文檔進行分詞;

(3)利用正則表達式去掉逗號、句號等標點符號;

(4)計算文檔頻率;

    (5)統計特征向量

<?php
    $_txts = array('1.txt','2.txt','3.txt');
    $_len = count($_txts);
    for ($i = 0;$i < $_len;$i++){
        $_contents[] = file_get_contents($_txts[$i]);
    }
      
    for ($i = 0;$i < $_len;$i++){
        //分詞
        $_words[] = explode(' ',trim($_contents[$i]));   
        foreach ($_words[$i] as $_key=>$_value){
            $_value = trim($_value);
            $_value = preg_replace('/[.|,|(|)|-|;]/','',$_value);
            $_words[$i][$_key]=strtolower($_value);
              
        }
        //去重
        $_words[$i]= array_unique($_words[$i]);
    }   
      
    //合并
    $_words_com = array_merge($_words[0],$_words[1],$_words[2]);
    //文檔頻率
    $_df = array_count_values($_words_com);   
    //特征向量
    for ($i = 0;$i < $_len;$i++){
        $_vsm[$i] = $_df;
        foreach($_vsm[$i] as $_key=>$_value){
            $_vsm[$i][$_key] = 0;
        }
        for ($j=0;$j<count($_words[$i]);$j++){
            if (in_array($_words[$i][$j],$_words_com)){
                $_vsm[$i][($_words[$i][$j])] +=1;
            }   
        }
    }   
      
    for($i = 0;$i < count($_vsm); $i++){
        echo '第'.($i+1).'篇文檔的特征向量: ('. implode(",",$_vsm[$i]).')<br/>';
    }
      
    print_r($_df);
?>


向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

江孜县| 恩施市| 丹巴县| 托克逊县| 安平县| 齐河县| 满洲里市| 西乌珠穆沁旗| 上杭县| 托克逊县| 拉萨市| 黑河市| 沿河| 田阳县| 望奎县| 荥经县| 棋牌| 夏邑县| 镇巴县| 石楼县| 合川市| 阜平县| 高唐县| 平舆县| 正安县| 安岳县| 来凤县| 洛扎县| 新邵县| 通城县| 阿巴嘎旗| 固阳县| 崇文区| 达日县| 云南省| 随州市| 通辽市| 敦煌市| 钟山县| 二连浩特市| 丰县|