From a976dc931bd02d3b52e4af430f1aa459bda0631c Mon Sep 17 00:00:00 2001 From: ViperEkura <3081035982@qq.com> Date: Mon, 25 Aug 2025 19:36:59 +0800 Subject: [PATCH] =?UTF-8?q?refactor(utils):=20=E6=9B=B4=E6=96=B0=20compreh?= =?UTF-8?q?ensive=5Fnormalization=20=E5=87=BD=E6=95=B0?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- modules/utils.py | 8 +++----- 1 file changed, 3 insertions(+), 5 deletions(-) diff --git a/modules/utils.py b/modules/utils.py index 6956447..31ab8ab 100644 --- a/modules/utils.py +++ b/modules/utils.py @@ -28,11 +28,9 @@ def fetch_folders(root_dir, filter_func=None): def comprehensive_normalization(text): replacements = { - '\u2018': "'", '\u2019': "'", '\u0060': "'", - '\u201C': '"', '\u201D': '"', - '\u2013': '-', '\u2014': '--', '\u2212': '-', - '\u00A0': ' ', - '\u2026': '...' + "\\[": "$$", "\\]": "$$", "\\(": "$", "\\)": "$", + '\u2018': "'", '\u2019': "'", '\u0060': "'", '\u201C': '"', '\u201D': '"', + '\u2013': '-', '\u2014': '--', '\u2212': '-', '\u00A0': ' ', '\u2026': '...' } pattern = re.compile('|'.join(re.escape(k) for k in replacements)) return pattern.sub(lambda m: replacements[m.group()], text)