优化
This commit is contained in:
@@ -13,7 +13,7 @@
|
||||
from __future__ import annotations
|
||||
|
||||
from app.core.logger import log
|
||||
from app.tool.browser import open_page, query
|
||||
from app.tool.browser import close_page, open_page, query
|
||||
from app.tool.cv import has_qr
|
||||
from app.tool.image_download import download_image
|
||||
from app.tool.ocr import ocr
|
||||
@@ -39,12 +39,17 @@ def extract_page(url: str) -> str:
|
||||
if not url or not url.startswith("http"):
|
||||
return ""
|
||||
|
||||
page_id: str | None = None
|
||||
try:
|
||||
page_id = open_page(url, _WAIT_MS)
|
||||
nodes = query(page_id, _SELECTOR)
|
||||
except Exception as exc:
|
||||
log.error(f"公告页打开失败: {url} | {exc}")
|
||||
return ""
|
||||
finally:
|
||||
# 页面数据已取出,尽早释放浏览器上下文,不占着资源等后续 OCR
|
||||
if page_id is not None:
|
||||
close_page(page_id)
|
||||
|
||||
texts: list[str] = []
|
||||
image_urls: list[str] = []
|
||||
|
||||
Reference in New Issue
Block a user