python搜索模塊的查詢方法

發布時間：2021-04-29 10:30:31 來源：億速云閱讀：204 作者：小新欄目：編程語言

小編給大家分享一下python搜索模塊的查詢方法，希望大家閱讀完這篇文章之后都有所收獲，下面讓我們一起去探討吧！

python的數據類型有哪些?

python的數據類型：1. 數字類型，包括int（整型）、long（長整型）和float（浮點型）。2.字符串，分別是str類型和unicode類型。3.布爾型，Python布爾類型也是用于邏輯運算，有兩個值：True（真）和False（假）。4.列表，列表是Python中使用最頻繁的數據類型，集合中可以放任何數據類型。5. 元組，元組用”()”標識，內部元素用逗號隔開。6. 字典，字典是一種鍵值對的集合。7. 集合，集合是一個無序的、不重復的數據組合。

1、說明

獲取原始數據并構建倒排索引后，可根據用戶輸入查找相關內容。

先對用戶的輸入進行分詞。

然后根據倒排索引獲取與每個單詞相關的文章。

最后，計算每個單詞和相關文章之間的分數。分數越高，相關性越大。

2、實例

def search(self, query):
    BM25_scores = {}
 
    # 對用戶輸入分詞
    # 并將其變成 {word: frequency, ...} 的形式
    query = jieba.lcut_for_search(query)
    word2freq = self.format(query)
 
    # 遍歷每個詞
    # 計算每個詞與相關文章之間的得分（計算公式參考 BM25 算法）
    for word in word2freq:
        data = self.iindex.get(word)
        if not data:
            continue
        BM25_score = 0
        qf = word2freq[word]
        df = data['df']
        ds = data['ds']
        W = math.log((self.N - df + 0.5) / (df + 0.5))
        for doc in ds:
            doc_id = doc['id']
            tf = doc['tf']
            dl = doc['dl']
            K = self.k1 * (1 - self.b + self.b * (dl / self.AVGDL))
            R = (tf * (self.k1 + 1) / (tf + K)) * (qf * (self.k2 + 1) / (qf + self.k2))
            BM25_score = W * R
            BM25_scores[doc_id] = BM25_scores[doc_id] + BM25_score if doc_id in BM25_scores else BM25_score
 
    # 對所有得分按從大到小的順序排列，返回結果
    BM25_scores = sorted(BM25_scores.items(), key = lambda item: item[1])
    BM25_scores.reverse()
    return BM25_scores

看完了這篇文章，相信你對“python搜索模塊的查詢方法”有了一定的了解，如果想了解更多相關知識，歡迎關注億速云行業資訊頻道，感謝各位的閱讀！

向AI問一下細節

91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

python搜索模塊的查詢方法

python的數據類型有哪些?

猜你喜歡

91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

python搜索模塊的查詢方法

python的數據類型有哪些?

猜你喜歡

最新資訊

相關推薦

相關標簽