# -*- coding: utf-8 -*- # Copyright 2015, 2016 Mike Fährmann # # This program is free software; you can redistribute it and/or modify # it under the terms of the GNU General Public License version 2 as # published by the Free Software Foundation. """Extract manga-chapters and entire manga from http://kissmanga.com/""" from .common import Extractor, Message from .. import text, cloudflare, cache import re class KissmangaExtractor(Extractor): """Base class for kissmanga extractors""" category = "kissmanga" directory_fmt = ["{category}", "{manga}", "c{chapter:>03}{chapter-minor} - {title}"] filename_fmt = "{manga}_c{chapter:>03}{chapter-minor}_{page:>03}.{extension}" url_base = "http://kissmanga.com" def __init__(self, match): Extractor.__init__(self) self.url = match.group(0) self.session.headers["Referer"] = self.url_base self.cookies = cache.cache(maxage=365*24*60*60, keyarg=0)(_cache_helper) def request(self, url, cookies=None): cookies = self.cookies(self.url_base, cookies) if cookies: self.session.cookies = cookies response = self.session.get(url) if response.status_code != 200: self.cookies.invalidate(self.url_base) cookies = cloudflare.solve_challenge(self.session, self.url_base) response = self.request(url, cookies) return response class KissmangaMangaExtractor(KissmangaExtractor): """Extractor for mangas from kissmanga.com""" subcategory = "manga" pattern = [r"(?:https?://)?(?:www\.)?kissmanga\.com/Manga/[^/]+/?$"] test = [("http://kissmanga.com/Manga/Dropout", { "url": "992befdd64e178fe5af67de53f8b510860d968ca", })] def items(self): yield Message.Version, 1 for chapter in self.get_chapters(): yield Message.Queue, self.url_base + chapter def get_chapters(self): """Return a list of all chapter urls""" page = self.request(self.url).text return reversed(list( text.extract_iter(page, '\n