This commit is contained in:
hibiki
2021-06-04 18:01:33 +08:00
parent 9e401e7a83
commit 8c5e0bd381
43 changed files with 1605 additions and 426 deletions
+35 -52
View File
@@ -7,21 +7,16 @@ from nonebot.adapters.cqhttp import PrivateMessageEvent
from util.utils import get_message_text
from nonebot.adapters.cqhttp.permission import PRIVATE
from util.utils import UserExistLimiter
from asyncio.exceptions import TimeoutError
__plugin_name__ = '磁力搜索'
__plugin_usage__ = r"""
* 请各位使用后不要转发 *
* 有时可能搜不到,再试一次就行了 *
参数: -U(时间) -H(热度) -S(大小)
-V(仅视频) -P(仅图片) -A(仅压缩包)
-R (R18懂的都懂)
num(页数, 如果不知道页数请不要填,并且是倒叙,比如页数总数是29,你想查看第一页的内容, 就使用 bt 29 xxx)
-按相关度检索(默认)
bt [关键词]
-按更新时间检索(参数不区分大小写,但要注意空格)
bt -U [关键词]
-搜索第10页数
bt 10(倒着) [关键词]
* 拒绝反冲斗士! *
bt [关键词] [页数](默认为1)
示例:
bt 钢铁侠
bt 钢铁侠 3
""".strip()
_ulmt = UserExistLimiter()
@@ -36,16 +31,8 @@ async def _(bot: Bot, event: PrivateMessageEvent, state: T_State):
msg = get_message_text(event.json())
if not msg:
await bt.reject('你想搜索什么呢?', at_sender=True)
mp = msg.split(" ")
if len(mp) > 1:
args = ''
for i in range(len(mp) - 1):
args += mp[i] + ' '
state['args'] = args
state['bt'] = mp[1]
else:
state['bt'] = get_message_text(event.json())
state['args'] = ''
state['keyword'] = msg
state['page'] = '1'
@bt.handle()
@@ -55,41 +42,37 @@ async def _(bot: Bot, event: PrivateMessageEvent, state: T_State):
if _ulmt.check(event.user_id):
await bt.finish('您有bt任务正在进行,请等待结束.', at_sender=True)
mp = get_message_text(event.json()).split(" ")
if len(mp) > 1:
args = ''
for i in range(len(mp) - 1):
args += mp[i] + ' '
state['args'] = args.strip()
state['bt'] = mp[-1]
if len(mp) == 2:
state['keyword'] = mp[0]
state['page'] = mp[1]
else:
state['bt'] = get_message_text(event.json())
state['args'] = ''
state['keyword'] = mp[0]
state['page'] = '1'
@bt.got('bt', prompt='虚空磁力?查什么GKD')
@bt.got('keyword', prompt='虚空磁力?查什么GKD')
async def _(bot: Bot, event: PrivateMessageEvent, state: T_State):
_ulmt.set_True(event.user_id)
keyword = state['bt']
args = state['args']
keyword = state['keyword']
page = state['page']
await bt.send('开始搜索....', at_sender=True)
send_flag = False
try:
if args.find('-R') == -1 and args.find('-r') == -1:
bt_report = await get_bt_info(keyword, args)
else:
bt_report = await get_bt_info(keyword, args, '0')
if bt_report:
if len(bt_report.split("\n")) < 2:
await bt.finish(bt_report + '搜索失败了,再试一次也许能成', at_sender=True)
else:
await bt.send("如果有页数没资源请再试一次\n" + bt_report)
logger.info(
f"(USER {event.user_id}, GROUP {event.group_id if event.message_type != 'private' else 'private'})"
f" 搜索bt {args} {keyword}")
else:
logger.error("没查询到资源")
await bt.send("没有查询到资源(也有可能是超时,再试一次?)", at_sender=True)
_ulmt.set_False(event.user_id)
except Exception as e:
_ulmt.set_False(event.user_id)
await bt.send("bt出错啦,再试一次?", at_sender=True)
logger.info(f'bt {keyword} 出错 e:{e}')
async for title, itype, create_time, file_size, link in get_bt_info(keyword, page):
await bt.send(f'标题:{title}\n'
f'类型:{itype}\n'
f'创建时间:{create_time}\n'
f'文件大小:{file_size}\n'
f'种子:{link}')
send_flag = True
except TimeoutError:
pass
if not send_flag:
await bt.send(f'{keyword} 超时或未搜索到...')
logger.info(f'USER {event.user_id} BT搜索 {keyword} 第 {page} 页')
_ulmt.set_False(event.user_id)
+24 -79
View File
@@ -1,96 +1,41 @@
from util.user_agent import get_user_agent
import aiohttp
from lxml import etree
from lxml.etree import Element
from configs.config import MAXINFO_BT
from urllib import parse
from html import unescape
from util.utils import get_local_proxy, is_number
import time
from bs4 import BeautifulSoup
from util.utils import get_local_proxy
import platform
if platform.system() == 'Windows':
import asyncio
asyncio.set_event_loop_policy(asyncio.WindowsSelectorEventLoopPolicy())
url = 'https://www.btmet.com/search.php'
url = 'http://www.eclzz.world'
async def get_bt_info(keyword: str, args: str, r18: str = '1') -> str:
cookiesDit = {
'r18': r18
}
s_time = time.time()
params = get_params(keyword, args)
async with aiohttp.ClientSession(headers=get_user_agent(), cookies=cookiesDit) as session:
async with session.get(url, proxy=get_local_proxy(), params=params, timeout=30) as response:
html = etree.HTML(await response.text())
print(response.url)
num = html.xpath('//div[@id="wall"]//span/b/text()')[0]
print(num)
if num.find(",") != -1:
num = num.split(',')[0]
if num == '0':
return "没有找到记录"
div_all = html.xpath('//div[@class="search-item"]')[1:]
div_all = div_all[:MAXINFO_BT] if len(div_all) > MAXINFO_BT else div_all
line_list = [await get_item_line(div) for div in div_all]
clist = []
for line in line_list:
if line.strip() != '':
clist.append(line)
return f"搜索 {keyword} 结果(共 {int(int(num.text) / 10) if int(num) % 10 == 0 else int(int(num) / 10) + 1} " \
f"页)(耗时 {int(time.time() - s_time)} 秒):\n" + "\n\n".join(clist)
async def get_bt_info(keyword: str, page: str):
async with aiohttp.ClientSession(headers=get_user_agent()) as session:
async with session.get(f"{url}/s/{keyword}_rel_{page}.html", proxy=get_local_proxy(), timeout=5) as response:
text = await response.text()
if text.find('大约0条结果') != -1:
return
soup = BeautifulSoup(text, 'lxml')
item_lst = soup.find_all('div', {'class': 'search-item'})
for item in item_lst[:MAXINFO_BT]:
divs = item.find_all('div')
title = str(divs[0].find('a').text).replace('<em>', '').replace('</em>', '').strip()
spans = divs[2].find_all('span')
itype = spans[0].text
create_time = spans[1].find('b').text
file_size = spans[2].find('b').text
link = await get_download_link(divs[0].find('a')['href'], session)
yield title, itype, create_time, file_size, link
async def get_item_line(div: Element) -> str:
try:
magent = div.xpath('./div[2]/a/@href')[0]
size = div.xpath('./div[@class="f_left"]/div[@class="item-bar"]/span/b/font/text()')[0]
type = div.xpath('./div[@class="f_left"]/div[@class="item-bar"]/span[@class="cpill blue-pill"]/text()')[0].strip()
title_doc = div.xpath('.//a[@class="smashTitle"]//text()')[0]
title_code = title_doc[title_doc.find('("') + 2: title_doc.find('")')]
title_xml_code = parse.unquote(title_code)
title_xml = etree.HTML(unescape(title_xml_code))
title = title_xml.xpath('string(.)')
except Exception:
return ''
return "【{}】| {}\n【{}】| {}".format(type, title, size, magent)
async def get_download_link(_url: str, session) -> str:
async with session.get(f"{url}{_url}", proxy=get_local_proxy(), timeout=30) as response:
soup = BeautifulSoup(await response.text(), 'lxml')
return soup.find('a', {'id': 'down-url'})['href']
# https://www.btmet.com/search.php?q=%E9%92%A2%E9%93%81%E4%BE%A0&c=5&o=0&l=&p=2
def get_params(keyword: str, args: str) -> dict:
params = {
'q': keyword,
'c': '',
'l': '',
'o': 0,
'p': ''
}
if not args:
return params
args = args.split(" ")
for arg in args:
if '-U' == arg.upper():
params['o'] = 1
if '-S' == arg.upper():
params['o'] = 2
if '-H' == arg.upper():
params['o'] = 3
if '-V' == arg.upper():
params['c'] = 1
if '-P' == arg.upper():
params['c'] = 2
if '-A' == arg.upper():
params['c'] = 5
if is_number(arg):
params['p'] = arg
return params
# print(asyncio.get_event_loop().run_until_complete(get_bt_info('钢铁侠', '')))