欧美bbbwbbbw肥妇,免费乱码人妻系列日韩,一级黄片

Python3實時操作處理日志文件的實現(xiàn)

 更新時間:2023年03月28日 15:13:36   作者:豬笨是念來過倒  
本文主要介紹了Python3實時操作處理日志文件的實現(xiàn),文中通過示例代碼介紹的非常詳細,對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧

最近,需要對日志文件進行實時數(shù)據(jù)處理。

一、簡單的實時文件處理(單一文件)

假設(shè)我們要實時讀取的日志的路徑為: /data/mongodb/shard1/log/pg.csv

那么我們可以在python文件中使用shell腳本命令tail -F 進行實時讀取并操作

代碼如下:

import re
import codecs
import subprocess
 
def pg_data_to_elk():
    p = subprocess.Popen('tail -F /data/mongodb/shard1/log/pg.csv', shell=True, stdout=subprocess.PIPE, stderr=subprocess.PIPE,)    #起一個進程,執(zhí)行shell命令
    while True:
        line = p.stdout.readline()   #實時獲取行
        if line:                     #如果行存在的話
            xxxxxxxxxxxx
            your operation

簡單解釋一下subprocess模塊:

subprocess允許你生成新的進程,連接到它們的 input/output/error 管道,并獲取它們的返回(狀態(tài))碼。

subprocess.Popen介紹

該類用于在一個新的進程中執(zhí)行一個子程序。

subprocess.Popen的構(gòu)造函數(shù)

class subprocess.Popen(args, bufsize=-1, executable=None, stdin=None, stdout=None, stderr=None, 
    preexec_fn=None, close_fds=True, shell=False, cwd=None, env=None, universal_newlines=False,
    startup_info=None, creationflags=0, restore_signals=True, start_new_session=False, pass_fds=())

參數(shù)說明:

  • args: 要執(zhí)行的shell命令,可以是字符串,也可以是命令各個參數(shù)組成的序列。當(dāng)該參數(shù)的值是一個字符串時,該命令的解釋過程是與平臺相關(guān)的,因此通常建議將args參數(shù)作為一個序列傳遞。
  • stdin, stdout, stderr: 分別表示程序標(biāo)準(zhǔn)輸入、輸出、錯誤句柄。
  • shell: 該參數(shù)用于標(biāo)識是否使用shell作為要執(zhí)行的程序,如果shell值為True,則建議將args參數(shù)作為一個字符串傳遞而不要作為一個序列傳遞。

二、復(fù)雜的實時文件處理(不斷產(chǎn)生新文件)

如果日志會在滿足一定條件下產(chǎn)生新的日志文件,比如log1.csv已經(jīng)到了20M,那么則會寫入log2.csv,這樣一天下來大概有1000多個文件,且不斷產(chǎn)生新的,那么如何進行實時獲取呢?

思路如下:

在實時監(jiān)聽(tail -F)中加入當(dāng)前文件的大小判定,如果當(dāng)前文件大小大于20M,那么跳出實時監(jiān)聽,獲取新的日志文件。(如果有其他判定條件也是這個思路,只不過把當(dāng)前文件大小的判定換成你所需要的判定)

代碼如下:

import re
import os
import time
import codecs
import subprocess
from datetime import datetime
 
path = '/home/liao/python/csv'
time_now_day = datetime.now.strftime('%Y-%m-%d')
 
def get_file_size(new_file):
    fsize = os.path.getsize(new_file)
    fsize = fsize/float(1024*1024)
    return fsize
 
def get_the_new_file():
    files = os.listdir(path)
    files_list = list(filter(lambda x:x[-4:]=='.csv' and x[11:21]==time_now_day, files))
    files_list.sort(key=lambda fn:os.path.getmtime(path + '/' + fn) if not os.path.isdir(path + '/' + fn) else 0)
    new_file = os.path.join(path, files_list[-1])
    return new_file
 
def pg_data_to_elk():
    while True:
        new_file = get_the_new_file()
        p = subprocess.Popen('tail -F {0}'.format(new_file), shell=True, stdout=subprocess.PIPE, stderr=subprocess.PIPE,)    #起一個進程,執(zhí)行shell命令
        while True:
            line = p.stdout.readline()   #實時獲取行
            if line:                     #如果行存在的話
                if get_file_size(new_file) > 20:    #如果大于20M,則跳出循環(huán)
                    break
                xxxxxxxxxxxx
                your operation
        time.sleep(3)

到此這篇關(guān)于Python3實時操作處理日志文件的實現(xiàn)的文章就介紹到這了,更多相關(guān)Python3實時操作日志文件內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • Python實現(xiàn)上傳Minio和阿里Oss文件

    Python實現(xiàn)上傳Minio和阿里Oss文件

    這篇文章主要介紹了如何通過Python上傳Minio和阿里OSS文件,文中的示例代碼介紹得很詳細,對我們的工作和學(xué)習(xí)都有一定的價值,感興趣的小伙伴可以了解一下
    2021-12-12
  • 基于Python實現(xiàn)粒子濾波效果

    基于Python實現(xiàn)粒子濾波效果

    這篇文章主要介紹了基于Python實現(xiàn)粒子濾波效果,本文通過實例代碼給大家介紹的非常詳細,對大家的學(xué)習(xí)或工作具有一定的參考借鑒價值,需要的朋友可以參考下
    2020-12-12
  • LyScript尋找ROP漏洞指令片段的方法詳解

    LyScript尋找ROP漏洞指令片段的方法詳解

    ROP可以理解成一個可以關(guān)閉系統(tǒng)自身內(nèi)存保護的一段機器指令。本文將利用LyScript尋找ROP漏洞指令片段,感興趣的小伙伴可以了解一下
    2022-07-07
  • Python 異步協(xié)程函數(shù)原理及實例詳解

    Python 異步協(xié)程函數(shù)原理及實例詳解

    這篇文章主要介紹了Python 異步協(xié)程函數(shù)原理及實例詳解,文中通過示例代碼介紹的非常詳細,對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友可以參考下
    2019-11-11
  • 5款最強且免費的Python IDE小結(jié)

    5款最強且免費的Python IDE小結(jié)

    開發(fā)工具在日常代碼編寫過程中起著至關(guān)重要的作用,一款優(yōu)秀的開發(fā)工具,不僅可以盡可能的減少你在配置方面耗費的精力,本文主要介紹了5種,感興趣的可以了解一下
    2021-07-07
  • python 網(wǎng)絡(luò)編程要點總結(jié)

    python 網(wǎng)絡(luò)編程要點總結(jié)

    Python 提供了兩個級別訪問的網(wǎng)絡(luò)服務(wù):低級別的網(wǎng)絡(luò)服務(wù)支持基本的 Socket,它提供了標(biāo)準(zhǔn)的 BSD Sockets API,可以訪問底層操作系統(tǒng) Socket 接口的全部方法。高級別的網(wǎng)絡(luò)服務(wù)模塊SocketServer, 它提供了服務(wù)器中心類,可以簡化網(wǎng)絡(luò)服務(wù)器的開發(fā)。下面看下該如何使用
    2021-06-06
  • python實現(xiàn)從文件中讀取數(shù)據(jù)并繪制成 x y 軸圖形的方法

    python實現(xiàn)從文件中讀取數(shù)據(jù)并繪制成 x y 軸圖形的方法

    今天小編就為大家分享一篇python實現(xiàn)從文件中讀取數(shù)據(jù)并繪制成 x y 軸圖形的方法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-10-10
  • 淺析python3字符串格式化format()函數(shù)的簡單用法

    淺析python3字符串格式化format()函數(shù)的簡單用法

    這篇文章主要介紹了python3字符串格式化format()函數(shù)的簡單用法,代碼簡單易懂,非常不錯,具有一定的參考借鑒價值,需要的朋友可以參考下
    2018-12-12
  • Pycharm如何返回上一次編輯處的快捷鍵

    Pycharm如何返回上一次編輯處的快捷鍵

    這篇文章主要介紹了Pycharm如何返回上一次編輯處的快捷鍵問題,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教
    2023-03-03
  • tensorflow2.0的函數(shù)簽名與圖結(jié)構(gòu)(推薦)

    tensorflow2.0的函數(shù)簽名與圖結(jié)構(gòu)(推薦)

    這篇文章主要介紹了tensorflow2.0的函數(shù)簽名與圖結(jié)構(gòu),本文給大家介紹的非常詳細,對大家的學(xué)習(xí)或工作具有一定的參考借鑒價值,需要的朋友可以參考下
    2020-04-04

最新評論