#!/usr/bin/env python3
"""测试衢州市API列表获取"""
import requests, json, re

url = "https://www.qz.gov.cn/api-gateway/jpaas-publish-server/front/page/build/unit"
params = {
    "parseType": "bulidstatic",
    "webId": "3084",
    "tplSetId": "i58lqHVn2cokOgipAEjQF",
    "pageType": "column",
    "tagId": "组配分类list",
    "pageId": "1229039395",
    "rows": "20",
    "pageNo": "1",
}
headers = {
    "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36",
    "Accept": "*/*",
    "Referer": "https://www.qz.gov.cn/col/col1229039395/index.html?number=A09",
}
r = requests.get(url, params=params, headers=headers, timeout=15)
data = r.json()
html = data["data"]["html"]

# Extract items
items = re.findall(r"<a[^>]+href='([^']+)'[^>]*title='([^']*)'>([^<]*)</a>\s*<span class='fr'>([^<]+)</span>", html)
print(f"Page 1: {len(items)} items")
for href, title, display, date in items[:3]:
    print(f"  {date} {title[:50]}")
    print(f"  URL: {href}")
