91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

怎么使用Python3實時操作處理日志文件

發布時間:2023-03-28 17:14:16 來源:億速云 閱讀:140 作者:iii 欄目:開發技術

這篇文章主要講解了“怎么使用Python3實時操作處理日志文件”,文中的講解內容簡單清晰,易于學習與理解,下面請大家跟著小編的思路慢慢深入,一起來研究和學習“怎么使用Python3實時操作處理日志文件”吧!

一、簡單的實時文件處理(單一文件)

假設我們要實時讀取的日志的路徑為: /data/mongodb/shard1/log/pg.csv

那么我們可以在python文件中使用shell腳本命令tail -F 進行實時讀取并操作

代碼如下:

import re
import codecs
import subprocess
 
def pg_data_to_elk():
    p = subprocess.Popen('tail -F /data/mongodb/shard1/log/pg.csv', shell=True, stdout=subprocess.PIPE, stderr=subprocess.PIPE,)    #起一個進程,執行shell命令
    while True:
        line = p.stdout.readline()   #實時獲取行
        if line:                     #如果行存在的話
            xxxxxxxxxxxx
            your operation

簡單解釋一下subprocess模塊:

subprocess允許你生成新的進程,連接到它們的 input/output/error 管道,并獲取它們的返回(狀態)碼。

subprocess.Popen介紹

該類用于在一個新的進程中執行一個子程序。

subprocess.Popen的構造函數

class subprocess.Popen(args, bufsize=-1, executable=None, stdin=None, stdout=None, stderr=None, 
    preexec_fn=None, close_fds=True, shell=False, cwd=None, env=None, universal_newlines=False,
    startup_info=None, creationflags=0, restore_signals=True, start_new_session=False, pass_fds=())

參數說明:

  • args: 要執行的shell命令,可以是字符串,也可以是命令各個參數組成的序列。當該參數的值是一個字符串時,該命令的解釋過程是與平臺相關的,因此通常建議將args參數作為一個序列傳遞。

  • stdin, stdout, stderr: 分別表示程序標準輸入、輸出、錯誤句柄。

  • shell: 該參數用于標識是否使用shell作為要執行的程序,如果shell值為True,則建議將args參數作為一個字符串傳遞而不要作為一個序列傳遞。

二、復雜的實時文件處理(不斷產生新文件)

如果日志會在滿足一定條件下產生新的日志文件,比如log1.csv已經到了20M,那么則會寫入log2.csv,這樣一天下來大概有1000多個文件,且不斷產生新的,那么如何進行實時獲取呢?

思路如下:

在實時監聽(tail -F)中加入當前文件的大小判定,如果當前文件大小大于20M,那么跳出實時監聽,獲取新的日志文件。(如果有其他判定條件也是這個思路,只不過把當前文件大小的判定換成你所需要的判定)

代碼如下:

import re
import os
import time
import codecs
import subprocess
from datetime import datetime
 
path = '/home/liao/python/csv'
time_now_day = datetime.now.strftime('%Y-%m-%d')
 
def get_file_size(new_file):
    fsize = os.path.getsize(new_file)
    fsize = fsize/float(1024*1024)
    return fsize
 
def get_the_new_file():
    files = os.listdir(path)
    files_list = list(filter(lambda x:x[-4:]=='.csv' and x[11:21]==time_now_day, files))
    files_list.sort(key=lambda fn:os.path.getmtime(path + '/' + fn) if not os.path.isdir(path + '/' + fn) else 0)
    new_file = os.path.join(path, files_list[-1])
    return new_file
 
def pg_data_to_elk():
    while True:
        new_file = get_the_new_file()
        p = subprocess.Popen('tail -F {0}'.format(new_file), shell=True, stdout=subprocess.PIPE, stderr=subprocess.PIPE,)    #起一個進程,執行shell命令
        while True:
            line = p.stdout.readline()   #實時獲取行
            if line:                     #如果行存在的話
                if get_file_size(new_file) > 20:    #如果大于20M,則跳出循環
                    break
                xxxxxxxxxxxx
                your operation
        time.sleep(3)

感謝各位的閱讀,以上就是“怎么使用Python3實時操作處理日志文件”的內容了,經過本文的學習后,相信大家對怎么使用Python3實時操作處理日志文件這一問題有了更深刻的體會,具體使用情況還需要大家實踐驗證。這里是億速云,小編將為大家推送更多相關知識點的文章,歡迎關注!

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

张北县| 泽州县| 临沧市| 如东县| 濉溪县| 南和县| 长垣县| 侯马市| 沐川县| 乌拉特中旗| 迁安市| 四会市| 曲周县| 双辽市| 万安县| 郁南县| 南木林县| 怀集县| 龙山县| 新竹县| 霍林郭勒市| 双城市| 中江县| 资源县| 龙岩市| 奉新县| 安泽县| 冀州市| 长武县| 东乡县| 长宁区| 武清区| 常德市| 菏泽市| 二连浩特市| 开化县| 莎车县| 汝南县| 延边| 民权县| 苏尼特左旗|