发布于2026-07-10 阅读(0)
扫一扫,手机访问
先说说一个很典型的场景:你在 tkinter 实时日志监控工具里,配了个 colors.txt,打算高亮并统计关键词“abc”和“def”出现的次数。但跑了几轮发现问题了——明明日志里有“ABC”却没被统计进去,或者“at”这个词硬把“AT+CGACT?”也算进去了,最后统计结果严重跑偏。这种情况,关键在于统计方式不够严谨。
问题出在哪?通常无外乎这几类:
第一步,安全加载关键词映射表。关键是每行用 .strip() 清掉空白,严格按 = 分割,并且将所有键统一转成小写:
# 推荐:一次性加载并预处理(放在函数外或首次调用时)
myObject = {}
with open('colors.txt', 'r', encoding='utf-8') as f:
for line in f:
line = line.strip()
if not line or '=' not in line: # 跳过空行和无效行
continue
key, color = line.split('=', 1) # 使用 maxsplit=1 防止 value 中含 =
myObject[key.strip().lower()] = color.strip() # 统一转小写作为键
第二步,对实时日志做大小写不敏感的完整词频统计。用正则,并且加上完整单词边界判定:
import re
# 在 while 循环内(注意:myObject 已预加载,无需每次重读!)
for keyword, color in myObject.items():
# \b 表示单词边界,re.IGNORECASE 实现忽略大小写
count = len(re.findall(rf'\b{re.escape(keyword)}\b', new_logs, re.IGNORECASE))
print(f"{keyword}={count}")
这里特别要提一下
re.escape(keyword):如果你的关键词里恰好含有正则元字符,比如"a+b",它能帮你防止语法报错。而\b的作用是保证只匹配独立单词——"abc"绝不会误算到"abc123"或"xabc"里。
open() 一次配置文件。这既拖慢速度,又可能在文件被其他进程修改时引发异常。正确的做法是提前加载一次,存为全局变量或闭包变量。import re
patterns = {kw: re.compile(rf'\b{re.escape(kw)}\b', re.IGNORECASE)
for kw in myObject}
# 后续:count = len(patterns[keyword].findall(new_logs))
经过这些调整,日志关键词统计就能做到精准、稳定、可维护。你再也不会拿到类似“abc=1245, def=0, ghi=0”这种谜之结果——每个配置项都能如实反映它在日志中的实际出现频次。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
7
8