From be0bc603b767c9cd44aa205e2e435acd0e3a4f36 Mon Sep 17 00:00:00 2001 From: caibotmini Date: Thu, 9 Apr 2026 23:22:23 +0800 Subject: [PATCH] =?UTF-8?q?fix:=20=E5=B8=96=E5=AD=90=E6=97=B6=E9=97=B4?= =?UTF-8?q?=E8=A7=A3=E6=9E=90=E8=BF=87=E6=BB=A42053=E7=AD=89=E5=BC=82?= =?UTF-8?q?=E5=B8=B8=E5=B9=B4=E4=BB=BD=EF=BC=8C=E4=BD=BF=E7=94=A8crawled?= =?UTF-8?q?=5Fat=E5=85=9C=E5=BA=95?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- crawlers/crawl_today.py | 9 ++++++++- 1 file changed, 8 insertions(+), 1 deletion(-) diff --git a/crawlers/crawl_today.py b/crawlers/crawl_today.py index edc1dcf..4f3325d 100644 --- a/crawlers/crawl_today.py +++ b/crawlers/crawl_today.py @@ -179,7 +179,14 @@ class YichensTodaySpider(PaginationSpider): created_at = None m = re.search(r"(\d{4}/\d{1,2}/\d{1,2}\s+\d{1,2}:\d{2}:\d{2})", page_text) if m: - created_at = m.group(1).replace("/", "-") + date_str = m.group(1).replace("/", "-") + try: + from datetime import datetime + dt = datetime.strptime(date_str, "%Y-%m-%d %H:%M:%S") + if 2020 <= dt.year <= 2030: + created_at = date_str + except: + pass phones = re.findall(r'1[3-9]\d{9,10}', page_text) contact = ",".join(dict.fromkeys(phones[:5])) if phones else None