yt-dlp/yt_dlp/extractor/yourporn.py

from __future__ import unicode_literals

from .common import InfoExtractor
from ..compat import compat_str
from ..utils import (
    parse_duration,
    urljoin,
)


class YourPornIE(InfoExtractor):
    _VALID_URL = r'https?://(?:www\.)?sxyprn\.com/post/(?P<id>[^/?#&.]+)'
    _TESTS = [{
        'url': 'https://sxyprn.com/post/57ffcb2e1179b.html',
        'md5': '6f8682b6464033d87acaa7a8ff0c092e',
        'info_dict': {
            'id': '57ffcb2e1179b',
            'ext': 'mp4',
            'title': 'md5:c9f43630bd968267672651ba905a7d35',
            'thumbnail': r're:^https?://.*\.jpg$',
            'duration': 165,
            'age_limit': 18,
        },
        'params': {
            'skip_download': True,
        },
    }, {
        'url': 'https://sxyprn.com/post/57ffcb2e1179b.html',
        'only_matching': True,
    }]

    def _real_extract(self, url):
        video_id = self._match_id(url)

        webpage = self._download_webpage(url, video_id)

        parts = self._parse_json(
            self._search_regex(
                r'data-vnfo=(["\'])(?P<data>{.+?})\1', webpage, 'data info',
                group='data'),
            video_id)[video_id].split('/')

        num = 0
        for c in parts[6] + parts[7]:
            if c.isnumeric():
                num += int(c)
        parts[5] = compat_str(int(parts[5]) - num)
        parts[1] += '8'
        video_url = urljoin(url, '/'.join(parts))

        title = (self._search_regex(
            r'<[^>]+\bclass=["\']PostEditTA[^>]+>([^<]+)', webpage, 'title',
            default=None) or self._og_search_description(webpage)).strip()
        thumbnail = self._og_search_thumbnail(webpage)
        duration = parse_duration(self._search_regex(
            r'duration\s*:\s*<[^>]+>([\d:]+)', webpage, 'duration',
            default=None))

        return {
            'id': video_id,
            'url': video_url,
            'title': title,
            'thumbnail': thumbnail,
            'duration': duration,
            'age_limit': 18,
            'ext': 'mp4',
        }
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00			`from __future__ import unicode_literals`

			`from .common import InfoExtractor`
[yourporn] Fix extraction (closes #21645, closes #22255, closes #23459) 2019-12-20 00:02:39 +01:00			`from ..compat import compat_str`
[yourporn] Fix extraction and extract duration (closes #18815, closes #18852) change cdn to cdn4 for the video_url 2019-01-29 00:42:49 +01:00			`from ..utils import (`
			`parse_duration,`
[yourporn] Improve (closes #19061) 2019-01-29 17:56:42 +01:00			`urljoin,`
[yourporn] Fix extraction and extract duration (closes #18815, closes #18852) change cdn to cdn4 for the video_url 2019-01-29 00:42:49 +01:00			`)`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00

			`class YourPornIE(InfoExtractor):`
[yourporn] Fix extraction (closes #21645, closes #22255, closes #23459) 2019-12-20 00:02:39 +01:00			`_VALID_URL = r'https?://(?:www\.)?sxyprn\.com/post/(?P<id>[^/?#&.]+)'`
[yourporn] Add support for sxyprn.com (#20646) 2019-04-13 10:02:09 +02:00			`_TESTS = [{`
[yourporn] Fix extraction (closes #21645, closes #22255, closes #23459) 2019-12-20 00:02:39 +01:00			`'url': 'https://sxyprn.com/post/57ffcb2e1179b.html',`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00			`'md5': '6f8682b6464033d87acaa7a8ff0c092e',`
			`'info_dict': {`
			`'id': '57ffcb2e1179b',`
			`'ext': 'mp4',`
			`'title': 'md5:c9f43630bd968267672651ba905a7d35',`
			`'thumbnail': r're:^https?://.*\.jpg$',`
[yourporn] Improve (closes #19061) 2019-01-29 17:56:42 +01:00			`'duration': 165,`
			`'age_limit': 18,`
			`},`
			`'params': {`
			`'skip_download': True,`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00			`},`
[yourporn] Add support for sxyprn.com (#20646) 2019-04-13 10:02:09 +02:00			`}, {`
			`'url': 'https://sxyprn.com/post/57ffcb2e1179b.html',`
			`'only_matching': True,`
			`}]`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00
			`def _real_extract(self, url):`
			`video_id = self._match_id(url)`

			`webpage = self._download_webpage(url, video_id)`

[yourporn] Fix extraction (closes #21645, closes #22255, closes #23459) 2019-12-20 00:02:39 +01:00			`parts = self._parse_json(`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00			`self._search_regex(`
			`r'data-vnfo=(["\'])(?P<data>{.+?})\1', webpage, 'data info',`
			`group='data'),`
[yourporn] Fix extraction (closes #21645, closes #22255, closes #23459) 2019-12-20 00:02:39 +01:00			`video_id)[video_id].split('/')`

			`num = 0`
			`for c in parts[6] + parts[7]:`
			`if c.isnumeric():`
			`num += int(c)`
			`parts[5] = compat_str(int(parts[5]) - num)`
			`parts[1] += '8'`
			`video_url = urljoin(url, '/'.join(parts))`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00
			`title = (self._search_regex(`
			`r'<[^>]+\bclass=["\']PostEditTA[^>]+>([^<]+)', webpage, 'title',`
			`default=None) or self._og_search_description(webpage)).strip()`
			`thumbnail = self._og_search_thumbnail(webpage)`
[yourporn] Improve (closes #19061) 2019-01-29 17:56:42 +01:00			`duration = parse_duration(self._search_regex(`
			`r'duration\s:\s<[^>]+>([\d:]+)', webpage, 'duration',`
			`default=None))`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00
			`return {`
			`'id': video_id,`
			`'url': video_url,`
			`'title': title,`
			`'thumbnail': thumbnail,`
[yourporn] Improve (closes #19061) 2019-01-29 17:56:42 +01:00			`'duration': duration,`
			`'age_limit': 18,`
[yourporn] Fix extraction (closes #21645, closes #22255, closes #23459) 2019-12-20 00:02:39 +01:00			`'ext': 'mp4',`
[yourporn] Add extractor (closes #17298) 2018-08-21 20:44:22 +02:00			`}`