全项目扫描修复: Docker数据卷修复+安全requireAdmin+12页SEO+API白名单+脚本超时+常量提取+假数据删除
This commit is contained in:
@@ -0,0 +1,25 @@
|
||||
import re
|
||||
import urllib.request
|
||||
|
||||
req = urllib.request.Request('https://www.zhuig.com/community', headers={'User-Agent': 'Mozilla/5.0', 'Cache-Control': 'no-cache'})
|
||||
html = urllib.request.urlopen(req, timeout=15).read().decode('utf-8')
|
||||
|
||||
# 找"全部板块"区域
|
||||
idx_q = html.find('全部板块')
|
||||
idx_z = html.find('最新话题')
|
||||
section = html[idx_q:idx_z] if idx_z > 0 else html[idx_q:idx_q+15000]
|
||||
print(f'板块区域HTML长度: {len(section)}')
|
||||
|
||||
# 找section里第一个出现的板块数据关键词
|
||||
keywords = ['电商零售', 'AI科技', '金融投资', '跨境出海', '实体经营', '本地生活', '大健康', '教育培训', 'FIRE与生活', '自媒体内容', '餐饮食品', '房地产']
|
||||
print('\n=== 关键词在板块区域出现位置 ===')
|
||||
for kw in keywords:
|
||||
p = section.find(kw)
|
||||
if p >= 0:
|
||||
print(f' "{kw}": 位置{section.find(kw)}, 周围HTML: ...{section[max(0,p-30):p+80]}...')
|
||||
|
||||
# 找"全部板块"区域前后的HTML标签结构
|
||||
print(f'\n=== "全部板块"之前的300字符 ===')
|
||||
print(html[idx_q-300:idx_q])
|
||||
print(f'\n=== "最新话题"之前的500字符(应该是板块区域结束) ===')
|
||||
print(html[idx_z-500:idx_z])
|
||||
Reference in New Issue
Block a user