youtube-dl/youtube_dl/downloader/f4m.py

from __future__ import division, unicode_literals

import base64
import io
import itertools
import os
import time
import xml.etree.ElementTree as etree

from .fragment import FragmentFD
from ..compat import (
    compat_urlparse,
    compat_urllib_error,
)
from ..utils import (
    encodeFilename,
    sanitize_open,
    struct_pack,
    struct_unpack,
    xpath_text,
)


class FlvReader(io.BytesIO):
    """
    Reader for Flv files
    The file format is documented in https://www.adobe.com/devnet/f4v.html
    """

    # Utility functions for reading numbers and strings
    def read_unsigned_long_long(self):
        return struct_unpack('!Q', self.read(8))[0]

    def read_unsigned_int(self):
        return struct_unpack('!I', self.read(4))[0]

    def read_unsigned_char(self):
        return struct_unpack('!B', self.read(1))[0]

    def read_string(self):
        res = b''
        while True:
            char = self.read(1)
            if char == b'\x00':
                break
            res += char
        return res

    def read_box_info(self):
        """
        Read a box and return the info as a tuple: (box_size, box_type, box_data)
        """
        real_size = size = self.read_unsigned_int()
        box_type = self.read(4)
        header_end = 8
        if size == 1:
            real_size = self.read_unsigned_long_long()
            header_end = 16
        return real_size, box_type, self.read(real_size - header_end)

    def read_asrt(self):
        # version
        self.read_unsigned_char()
        # flags
        self.read(3)
        quality_entry_count = self.read_unsigned_char()
        # QualityEntryCount
        for i in range(quality_entry_count):
            self.read_string()

        segment_run_count = self.read_unsigned_int()
        segments = []
        for i in range(segment_run_count):
            first_segment = self.read_unsigned_int()
            fragments_per_segment = self.read_unsigned_int()
            segments.append((first_segment, fragments_per_segment))

        return {
            'segment_run': segments,
        }

    def read_afrt(self):
        # version
        self.read_unsigned_char()
        # flags
        self.read(3)
        # time scale
        self.read_unsigned_int()

        quality_entry_count = self.read_unsigned_char()
        # QualitySegmentUrlModifiers
        for i in range(quality_entry_count):
            self.read_string()

        fragments_count = self.read_unsigned_int()
        fragments = []
        for i in range(fragments_count):
            first = self.read_unsigned_int()
            first_ts = self.read_unsigned_long_long()
            duration = self.read_unsigned_int()
            if duration == 0:
                discontinuity_indicator = self.read_unsigned_char()
            else:
                discontinuity_indicator = None
            fragments.append({
                'first': first,
                'ts': first_ts,
                'duration': duration,
                'discontinuity_indicator': discontinuity_indicator,
            })

        return {
            'fragments': fragments,
        }

    def read_abst(self):
        # version
        self.read_unsigned_char()
        # flags
        self.read(3)

        self.read_unsigned_int()  # BootstrapinfoVersion
        # Profile,Live,Update,Reserved
        flags = self.read_unsigned_char()
        live = flags & 0x20 != 0
        # time scale
        self.read_unsigned_int()
        # CurrentMediaTime
        self.read_unsigned_long_long()
        # SmpteTimeCodeOffset
        self.read_unsigned_long_long()

        self.read_string()  # MovieIdentifier
        server_count = self.read_unsigned_char()
        # ServerEntryTable
        for i in range(server_count):
            self.read_string()
        quality_count = self.read_unsigned_char()
        # QualityEntryTable
        for i in range(quality_count):
            self.read_string()
        # DrmData
        self.read_string()
        # MetaData
        self.read_string()

        segments_count = self.read_unsigned_char()
        segments = []
        for i in range(segments_count):
            box_size, box_type, box_data = self.read_box_info()
            assert box_type == b'asrt'
            segment = FlvReader(box_data).read_asrt()
            segments.append(segment)
        fragments_run_count = self.read_unsigned_char()
        fragments = []
        for i in range(fragments_run_count):
            box_size, box_type, box_data = self.read_box_info()
            assert box_type == b'afrt'
            fragments.append(FlvReader(box_data).read_afrt())

        return {
            'segments': segments,
            'fragments': fragments,
            'live': live,
        }

    def read_bootstrap_info(self):
        total_size, box_type, box_data = self.read_box_info()
        assert box_type == b'abst'
        return FlvReader(box_data).read_abst()


def read_bootstrap_info(bootstrap_bytes):
    return FlvReader(bootstrap_bytes).read_bootstrap_info()


def build_fragments_list(boot_info):
    """ Return a list of (segment, fragment) for each fragment in the video """
    res = []
    segment_run_table = boot_info['segments'][0]
    fragment_run_entry_table = boot_info['fragments'][0]['fragments']
    first_frag_number = fragment_run_entry_table[0]['first']
    fragments_counter = itertools.count(first_frag_number)
    for segment, fragments_count in segment_run_table['segment_run']:
        for _ in range(fragments_count):
            res.append((segment, next(fragments_counter)))

    if boot_info['live']:
        res = res[-2:]

    return res


def write_unsigned_int(stream, val):
    stream.write(struct_pack('!I', val))


def write_unsigned_int_24(stream, val):
    stream.write(struct_pack('!I', val)[1:])


def write_flv_header(stream):
    """Writes the FLV header to stream"""
    # FLV header
    stream.write(b'FLV\x01')
    stream.write(b'\x05')
    stream.write(b'\x00\x00\x00\x09')
    stream.write(b'\x00\x00\x00\x00')


def write_metadata_tag(stream, metadata):
    """Writes optional metadata tag to stream"""
    SCRIPT_TAG = b'\x12'
    FLV_TAG_HEADER_LEN = 11

    if metadata:
        stream.write(SCRIPT_TAG)
        write_unsigned_int_24(stream, len(metadata))
        stream.write(b'\x00\x00\x00\x00\x00\x00\x00')
        stream.write(metadata)
        write_unsigned_int(stream, FLV_TAG_HEADER_LEN + len(metadata))


def _add_ns(prop):
    return '{http://ns.adobe.com/f4m/1.0}%s' % prop


class F4mFD(FragmentFD):
    """
    A downloader for f4m manifests or AdobeHDS.
    """

    FD_NAME = 'f4m'

    def _get_unencrypted_media(self, doc):
        media = doc.findall(_add_ns('media'))
        if not media:
            self.report_error('No media found')
        for e in (doc.findall(_add_ns('drmAdditionalHeader')) +
                  doc.findall(_add_ns('drmAdditionalHeaderSet'))):
            # If id attribute is missing it's valid for all media nodes
            # without drmAdditionalHeaderId or drmAdditionalHeaderSetId attribute
            if 'id' not in e.attrib:
                self.report_error('Missing ID in f4m DRM')
        media = list(filter(lambda e: 'drmAdditionalHeaderId' not in e.attrib and
                                      'drmAdditionalHeaderSetId' not in e.attrib,
                            media))
        if not media:
            self.report_error('Unsupported DRM')
        return media

    def _get_bootstrap_from_url(self, bootstrap_url):
        bootstrap = self.ydl.urlopen(bootstrap_url).read()
        return read_bootstrap_info(bootstrap)

    def _update_live_fragments(self, bootstrap_url, latest_fragment):
        fragments_list = []
        retries = 30
        while (not fragments_list) and (retries > 0):
            boot_info = self._get_bootstrap_from_url(bootstrap_url)
            fragments_list = build_fragments_list(boot_info)
            fragments_list = [f for f in fragments_list if f[1] > latest_fragment]
            if not fragments_list:
                # Retry after a while
                time.sleep(5.0)
                retries -= 1

        if not fragments_list:
            self.report_error('Failed to update fragments')

        return fragments_list

    def _parse_bootstrap_node(self, node, base_url):
        if node.text is None:
            bootstrap_url = compat_urlparse.urljoin(
                base_url, node.attrib['url'])
            boot_info = self._get_bootstrap_from_url(bootstrap_url)
        else:
            bootstrap_url = None
            bootstrap = base64.b64decode(node.text.encode('ascii'))
            boot_info = read_bootstrap_info(bootstrap)
        return (boot_info, bootstrap_url)

    def real_download(self, filename, info_dict):
        man_url = info_dict['url']
        requested_bitrate = info_dict.get('tbr')
        self.to_screen('[%s] Downloading f4m manifest' % self.FD_NAME)
        manifest = self.ydl.urlopen(man_url).read()

        doc = etree.fromstring(manifest)
        formats = [(int(f.attrib.get('bitrate', -1)), f)
                   for f in self._get_unencrypted_media(doc)]
        if requested_bitrate is None:
            # get the best format
            formats = sorted(formats, key=lambda f: f[0])
            rate, media = formats[-1]
        else:
            rate, media = list(filter(
                lambda f: int(f[0]) == requested_bitrate, formats))[0]

        base_url = compat_urlparse.urljoin(man_url, media.attrib['url'])
        bootstrap_node = doc.find(_add_ns('bootstrapInfo'))
        boot_info, bootstrap_url = self._parse_bootstrap_node(bootstrap_node, base_url)
        live = boot_info['live']
        metadata_node = media.find(_add_ns('metadata'))
        if metadata_node is not None:
            metadata = base64.b64decode(metadata_node.text.encode('ascii'))
        else:
            metadata = None

        fragments_list = build_fragments_list(boot_info)
        if self.params.get('test', False):
            # We only download the first fragment
            fragments_list = fragments_list[:1]
        total_frags = len(fragments_list)
        # For some akamai manifests we'll need to add a query to the fragment url
        akamai_pv = xpath_text(doc, _add_ns('pv-2.0'))

        ctx = {
            'filename': filename,
            'total_frags': total_frags,
        }

        self._prepare_frag_download(ctx)

        dest_stream = ctx['dest_stream']

        write_flv_header(dest_stream)
        if not live:
            write_metadata_tag(dest_stream, metadata)

        self._start_frag_download(ctx)

        frags_filenames = []
        while fragments_list:
            seg_i, frag_i = fragments_list.pop(0)
            name = 'Seg%d-Frag%d' % (seg_i, frag_i)
            url = base_url + name
            if akamai_pv:
                url += '?' + akamai_pv.strip(';')
            if info_dict.get('extra_param_to_segment_url'):
                url += info_dict.get('extra_param_to_segment_url')
            frag_filename = '%s-%s' % (ctx['tmpfilename'], name)
            try:
                success = ctx['dl'].download(frag_filename, {'url': url})
                if not success:
                    return False
                (down, frag_sanitized) = sanitize_open(frag_filename, 'rb')
                down_data = down.read()
                down.close()
                reader = FlvReader(down_data)
                while True:
                    _, box_type, box_data = reader.read_box_info()
                    if box_type == b'mdat':
                        dest_stream.write(box_data)
                        break
                if live:
                    os.remove(encodeFilename(frag_sanitized))
                else:
                    frags_filenames.append(frag_sanitized)
            except (compat_urllib_error.HTTPError, ) as err:
                if live and (err.code == 404 or err.code == 410):
                    # We didn't keep up with the live window. Continue
                    # with the next available fragment.
                    msg = 'Fragment %d unavailable' % frag_i
                    self.report_warning(msg)
                    fragments_list = []
                else:
                    raise

            if not fragments_list and live and bootstrap_url:
                fragments_list = self._update_live_fragments(bootstrap_url, frag_i)
                total_frags += len(fragments_list)
                if fragments_list and (fragments_list[0][1] > frag_i + 1):
                    msg = 'Missed %d fragments' % (fragments_list[0][1] - (frag_i + 1))
                    self.report_warning(msg)

        self._finish_frag_download(ctx)

        for frag_file in frags_filenames:
            os.remove(encodeFilename(frag_file))

        return True
[YoutubeDL] Use a progress hook for progress reporting Instead of every downloader calling two helper functions, let our progress report be an ordinary progress hook like everyone else's. Closes #4875. 2015-02-17 21:37:48 +01:00			`from __future__ import division, unicode_literals`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`import base64`
			`import io`
			`import itertools`
			`import os`
			`import time`
			`import xml.etree.ElementTree as etree`

[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`from .fragment import FragmentFD`
Fix imports and general cleanup · Import from compat what comes from compat. Yes, some names are available in utils too, but that's an implementation detail. · Use _match_id consistently whenever possible · Fix some outdated tests · Use consistent valid URL (always match the whole protocol, no ^ at start required) · Use modern test definitions 2014-12-13 12:24:42 +01:00			`from ..compat import (`
			`compat_urlparse,`
[f4m] Tolerate missed fragments on live streams 2015-02-23 20:56:35 +01:00			`compat_urllib_error,`
Fix imports and general cleanup · Import from compat what comes from compat. Yes, some names are available in utils too, but that's an implementation detail. · Use _match_id consistently whenever possible · Fix some outdated tests · Use consistent valid URL (always match the whole protocol, no ^ at start required) · Use modern test definitions 2014-12-13 12:24:42 +01:00			`)`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`from ..utils import (`
[f4m] Add missing imports 2015-08-30 22:20:29 +02:00			`encodeFilename,`
			`sanitize_open,`
Fix f4m downloading on Python 2.6 2014-02-15 16:24:43 +01:00			`struct_pack,`
			`struct_unpack,`
[downloader/f4m] If <pv-2.0> is in the manifest, add it to the fragments urls query (fixes #3176) It's used in some akamai videos (for example for theplatform.com). 2014-09-21 15:43:09 +02:00			`xpath_text,`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`)`


			`class FlvReader(io.BytesIO):`
			`"""`
			`Reader for Flv files`
			`The file format is documented in https://www.adobe.com/devnet/f4v.html`
			`"""`

			`# Utility functions for reading numbers and strings`
			`def read_unsigned_long_long(self):`
Fix f4m downloading on Python 2.6 2014-02-15 16:24:43 +01:00			`return struct_unpack('!Q', self.read(8))[0]`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`def read_unsigned_int(self):`
Fix f4m downloading on Python 2.6 2014-02-15 16:24:43 +01:00			`return struct_unpack('!I', self.read(4))[0]`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`def read_unsigned_char(self):`
Fix f4m downloading on Python 2.6 2014-02-15 16:24:43 +01:00			`return struct_unpack('!B', self.read(1))[0]`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`def read_string(self):`
			`res = b''`
			`while True:`
			`char = self.read(1)`
			`if char == b'\x00':`
			`break`
			`res += char`
			`return res`

			`def read_box_info(self):`
			`"""`
			`Read a box and return the info as a tuple: (box_size, box_type, box_data)`
			`"""`
			`real_size = size = self.read_unsigned_int()`
			`box_type = self.read(4)`
			`header_end = 8`
			`if size == 1:`
			`real_size = self.read_unsigned_long_long()`
			`header_end = 16`
PEP8: E225,E227 2014-11-23 21:23:05 +01:00			`return real_size, box_type, self.read(real_size - header_end)`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`def read_asrt(self):`
			`# version`
			`self.read_unsigned_char()`
			`# flags`
			`self.read(3)`
			`quality_entry_count = self.read_unsigned_char()`
			`# QualityEntryCount`
			`for i in range(quality_entry_count):`
			`self.read_string()`

			`segment_run_count = self.read_unsigned_int()`
			`segments = []`
			`for i in range(segment_run_count):`
			`first_segment = self.read_unsigned_int()`
			`fragments_per_segment = self.read_unsigned_int()`
			`segments.append((first_segment, fragments_per_segment))`

			`return {`
			`'segment_run': segments,`
			`}`

			`def read_afrt(self):`
			`# version`
			`self.read_unsigned_char()`
			`# flags`
			`self.read(3)`
			`# time scale`
			`self.read_unsigned_int()`

			`quality_entry_count = self.read_unsigned_char()`
			`# QualitySegmentUrlModifiers`
			`for i in range(quality_entry_count):`
			`self.read_string()`

			`fragments_count = self.read_unsigned_int()`
			`fragments = []`
			`for i in range(fragments_count):`
			`first = self.read_unsigned_int()`
			`first_ts = self.read_unsigned_long_long()`
			`duration = self.read_unsigned_int()`
			`if duration == 0:`
			`discontinuity_indicator = self.read_unsigned_char()`
			`else:`
			`discontinuity_indicator = None`
			`fragments.append({`
			`'first': first,`
			`'ts': first_ts,`
			`'duration': duration,`
			`'discontinuity_indicator': discontinuity_indicator,`
			`})`

			`return {`
			`'fragments': fragments,`
			`}`

			`def read_abst(self):`
			`# version`
			`self.read_unsigned_char()`
			`# flags`
			`self.read(3)`
[f4m] Clean up 2014-02-22 23:03:00 +01:00
			`self.read_unsigned_int() # BootstrapinfoVersion`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`# Profile,Live,Update,Reserved`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`flags = self.read_unsigned_char()`
			`live = flags & 0x20 != 0`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`# time scale`
			`self.read_unsigned_int()`
			`# CurrentMediaTime`
			`self.read_unsigned_long_long()`
			`# SmpteTimeCodeOffset`
			`self.read_unsigned_long_long()`
[f4m] Clean up 2014-02-22 23:03:00 +01:00
			`self.read_string() # MovieIdentifier`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`server_count = self.read_unsigned_char()`
			`# ServerEntryTable`
			`for i in range(server_count):`
			`self.read_string()`
			`quality_count = self.read_unsigned_char()`
			`# QualityEntryTable`
[f4m] Clean up 2014-02-22 23:03:00 +01:00			`for i in range(quality_count):`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`self.read_string()`
			`# DrmData`
			`self.read_string()`
			`# MetaData`
			`self.read_string()`

			`segments_count = self.read_unsigned_char()`
			`segments = []`
			`for i in range(segments_count):`
			`box_size, box_type, box_data = self.read_box_info()`
			`assert box_type == b'asrt'`
			`segment = FlvReader(box_data).read_asrt()`
			`segments.append(segment)`
			`fragments_run_count = self.read_unsigned_char()`
			`fragments = []`
			`for i in range(fragments_run_count):`
			`box_size, box_type, box_data = self.read_box_info()`
			`assert box_type == b'afrt'`
			`fragments.append(FlvReader(box_data).read_afrt())`

			`return {`
			`'segments': segments,`
			`'fragments': fragments,`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`'live': live,`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`}`

			`def read_bootstrap_info(self):`
			`total_size, box_type, box_data = self.read_box_info()`
			`assert box_type == b'abst'`
			`return FlvReader(box_data).read_abst()`


			`def read_bootstrap_info(bootstrap_bytes):`
			`return FlvReader(bootstrap_bytes).read_bootstrap_info()`


			`def build_fragments_list(boot_info):`
			`""" Return a list of (segment, fragment) for each fragment in the video """`
			`res = []`
			`segment_run_table = boot_info['segments'][0]`
			`fragment_run_entry_table = boot_info['fragments'][0]['fragments']`
			`first_frag_number = fragment_run_entry_table[0]['first']`
[downloader/f4m] build_fragments_list: Support videos with more than 1 segment 2015-01-23 16:31:52 +01:00			`fragments_counter = itertools.count(first_frag_number)`
			`for segment, fragments_count in segment_run_table['segment_run']:`
			`for _ in range(fragments_count):`
			`res.append((segment, next(fragments_counter)))`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00
			`if boot_info['live']:`
			`res = res[-2:]`

Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`return res`


[downloader/f4m] The last value in a tag is the tag length 2015-01-05 19:22:17 +01:00			`def write_unsigned_int(stream, val):`
			`stream.write(struct_pack('!I', val))`


[downloader/f4m] Minor cleanup 2015-01-05 19:30:40 +01:00			`def write_unsigned_int_24(stream, val):`
			`stream.write(struct_pack('!I', val)[1:])`


[downloader/f4m] <metadata> is optional according to the F4M specs 2015-01-05 19:12:29 +01:00			`def write_flv_header(stream):`
			`"""Writes the FLV header to stream"""`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`# FLV header`
			`stream.write(b'FLV\x01')`
			`stream.write(b'\x05')`
			`stream.write(b'\x00\x00\x00\x09')`
			`stream.write(b'\x00\x00\x00\x00')`
[downloader/f4m] <metadata> is optional according to the F4M specs 2015-01-05 19:12:29 +01:00

			`def write_metadata_tag(stream, metadata):`
			`"""Writes optional metadata tag to stream"""`
[downloader/f4m] Minor cleanup 2015-01-05 19:30:40 +01:00			`SCRIPT_TAG = b'\x12'`
[downloader/f4m] The last value in a tag is the tag length 2015-01-05 19:22:17 +01:00			`FLV_TAG_HEADER_LEN = 11`

[downloader/f4m] <metadata> is optional according to the F4M specs 2015-01-05 19:12:29 +01:00			`if metadata:`
[downloader/f4m] Minor cleanup 2015-01-05 19:30:40 +01:00			`stream.write(SCRIPT_TAG)`
			`write_unsigned_int_24(stream, len(metadata))`
[downloader/f4m] <metadata> is optional according to the F4M specs 2015-01-05 19:12:29 +01:00			`stream.write(b'\x00\x00\x00\x00\x00\x00\x00')`
			`stream.write(metadata)`
[downloader/f4m] The last value in a tag is the tag length 2015-01-05 19:22:17 +01:00			`write_unsigned_int(stream, FLV_TAG_HEADER_LEN + len(metadata))`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00

			`def _add_ns(prop):`
			`return '{http://ns.adobe.com/f4m/1.0}%s' % prop`


[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`class F4mFD(FragmentFD):`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`"""`
			`A downloader for f4m manifests or AdobeHDS.`
			`"""`

[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`FD_NAME = 'f4m'`

Filter DRM protected media in f4m downloader 2014-05-28 18:19:23 +02:00			`def _get_unencrypted_media(self, doc):`
Fix flake8 errors 2015-01-31 10:51:39 +01:00			`media = doc.findall(_add_ns('media'))`
Filter DRM protected media in f4m downloader 2014-05-28 18:19:23 +02:00			`if not media:`
			`self.report_error('No media found')`
			`for e in (doc.findall(_add_ns('drmAdditionalHeader')) +`
			`doc.findall(_add_ns('drmAdditionalHeaderSet'))):`
			`# If id attribute is missing it's valid for all media nodes`
			`# without drmAdditionalHeaderId or drmAdditionalHeaderSetId attribute`
[downloader/f4m] Clarify that we should eventually just implement the DRM scheme (#3000) 2015-01-30 16:06:55 +01:00			`if 'id' not in e.attrib:`
			`self.report_error('Missing ID in f4m DRM')`
Filter DRM protected media in f4m downloader 2014-05-28 18:19:23 +02:00			`media = list(filter(lambda e: 'drmAdditionalHeaderId' not in e.attrib and`
			`'drmAdditionalHeaderSetId' not in e.attrib,`
			`media))`
			`if not media:`
[downloader/f4m] Clarify that we should eventually just implement the DRM scheme (#3000) 2015-01-30 16:06:55 +01:00			`self.report_error('Unsupported DRM')`
Filter DRM protected media in f4m downloader 2014-05-28 18:19:23 +02:00			`return media`

[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`def _get_bootstrap_from_url(self, bootstrap_url):`
			`bootstrap = self.ydl.urlopen(bootstrap_url).read()`
			`return read_bootstrap_info(bootstrap)`

			`def _update_live_fragments(self, bootstrap_url, latest_fragment):`
			`fragments_list = []`
			`retries = 30`
			`while (not fragments_list) and (retries > 0):`
			`boot_info = self._get_bootstrap_from_url(bootstrap_url)`
			`fragments_list = build_fragments_list(boot_info)`
			`fragments_list = [f for f in fragments_list if f[1] > latest_fragment]`
			`if not fragments_list:`
			`# Retry after a while`
			`time.sleep(5.0)`
			`retries -= 1`

			`if not fragments_list:`
			`self.report_error('Failed to update fragments')`

			`return fragments_list`

			`def _parse_bootstrap_node(self, node, base_url):`
			`if node.text is None:`
			`bootstrap_url = compat_urlparse.urljoin(`
			`base_url, node.attrib['url'])`
			`boot_info = self._get_bootstrap_from_url(bootstrap_url)`
			`else:`
			`bootstrap_url = None`
[downloader/f4m] Fix use of base64 in python 3.2 (fixes #5132) b64decode needs a byte string, but on 3.4 it also accepts strings. 2015-03-08 18:25:11 +01:00			`bootstrap = base64.b64decode(node.text.encode('ascii'))`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`boot_info = read_bootstrap_info(bootstrap)`
			`return (boot_info, bootstrap_url)`

Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`def real_download(self, filename, info_dict):`
			`man_url = info_dict['url']`
[bloomberg] Extract the available formats (closes #2776) It uses a helper method in the InfoExtractor class. The downloader will pick the requested formats using the bitrate in the info dict. 2014-07-28 15:25:56 +02:00			`requested_bitrate = info_dict.get('tbr')`
[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`self.to_screen('[%s] Downloading f4m manifest' % self.FD_NAME)`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`manifest = self.ydl.urlopen(man_url).read()`

			`doc = etree.fromstring(manifest)`
Filter DRM protected media in f4m downloader 2014-05-28 18:19:23 +02:00			`formats = [(int(f.attrib.get('bitrate', -1)), f)`
			`for f in self._get_unencrypted_media(doc)]`
[bloomberg] Extract the available formats (closes #2776) It uses a helper method in the InfoExtractor class. The downloader will pick the requested formats using the bitrate in the info dict. 2014-07-28 15:25:56 +02:00			`if requested_bitrate is None:`
			`# get the best format`
			`formats = sorted(formats, key=lambda f: f[0])`
			`rate, media = formats[-1]`
			`else:`
			`rate, media = list(filter(`
			`lambda f: int(f[0]) == requested_bitrate, formats))[0]`

Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`base_url = compat_urlparse.urljoin(man_url, media.attrib['url'])`
[f4m] Support bootstrap URLs 2014-10-28 17:27:41 +01:00			`bootstrap_node = doc.find(_add_ns('bootstrapInfo'))`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`boot_info, bootstrap_url = self._parse_bootstrap_node(bootstrap_node, base_url)`
			`live = boot_info['live']`
[downloader/f4m] <metadata> is optional according to the F4M specs 2015-01-05 19:12:29 +01:00			`metadata_node = media.find(_add_ns('metadata'))`
			`if metadata_node is not None:`
[downloader/f4m] Fix use of base64 in python 3.2 (fixes #5132) b64decode needs a byte string, but on 3.4 it also accepts strings. 2015-03-08 18:25:11 +01:00			`metadata = base64.b64decode(metadata_node.text.encode('ascii'))`
[downloader/f4m] <metadata> is optional according to the F4M specs 2015-01-05 19:12:29 +01:00			`else:`
			`metadata = None`
[f4m] Support bootstrap URLs 2014-10-28 17:27:41 +01:00
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`fragments_list = build_fragments_list(boot_info)`
[f4m] Download only the first fragment with the `--test` option 2014-02-15 17:09:49 +01:00			`if self.params.get('test', False):`
			`# We only download the first fragment`
			`fragments_list = fragments_list[:1]`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`total_frags = len(fragments_list)`
[downloader/f4m] If <pv-2.0> is in the manifest, add it to the fragments urls query (fixes #3176) It's used in some akamai videos (for example for theplatform.com). 2014-09-21 15:43:09 +02:00			`# For some akamai manifests we'll need to add a query to the fragment url`
			`akamai_pv = xpath_text(doc, _add_ns('pv-2.0'))`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`ctx = {`
			`'filename': filename,`
			`'total_frags': total_frags,`
			`}`

			`self._prepare_frag_download(ctx)`

			`dest_stream = ctx['dest_stream']`
[YoutubeDL] Use a progress hook for progress reporting Instead of every downloader calling two helper functions, let our progress report be an ordinary progress hook like everyone else's. Closes #4875. 2015-02-17 21:37:48 +01:00
[downloader/f4m] <metadata> is optional according to the F4M specs 2015-01-05 19:12:29 +01:00			`write_flv_header(dest_stream)`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`if not live:`
			`write_metadata_tag(dest_stream, metadata)`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`self._start_frag_download(ctx)`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`frags_filenames = []`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`while fragments_list:`
			`seg_i, frag_i = fragments_list.pop(0)`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00			`name = 'Seg%d-Frag%d' % (seg_i, frag_i)`
			`url = base_url + name`
[downloader/f4m] If <pv-2.0> is in the manifest, add it to the fragments urls query (fixes #3176) It's used in some akamai videos (for example for theplatform.com). 2014-09-21 15:43:09 +02:00			`if akamai_pv:`
			`url += '?' + akamai_pv.strip(';')`
[Senate] Add new extractor (#5302) 2015-04-20 20:29:56 +02:00			`if info_dict.get('extra_param_to_segment_url'):`
			`url += info_dict.get('extra_param_to_segment_url')`
[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`frag_filename = '%s-%s' % (ctx['tmpfilename'], name)`
[f4m] Tolerate missed fragments on live streams 2015-02-23 20:56:35 +01:00			`try:`
[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`success = ctx['dl'].download(frag_filename, {'url': url})`
[f4m] Tolerate missed fragments on live streams 2015-02-23 20:56:35 +01:00			`if not success:`
			`return False`
[downloader/f4m] Fragment filenames must be sanitized because the fragment was written to a file with a sanitized name by http_dl.download() 2015-05-03 10:04:14 +02:00			`(down, frag_sanitized) = sanitize_open(frag_filename, 'rb')`
			`down_data = down.read()`
			`down.close()`
			`reader = FlvReader(down_data)`
			`while True:`
			`_, box_type, box_data = reader.read_box_info()`
			`if box_type == b'mdat':`
			`dest_stream.write(box_data)`
			`break`
[f4m] Tolerate missed fragments on live streams 2015-02-23 20:56:35 +01:00			`if live:`
[downloader/f4m] Fragment filenames must be sanitized because the fragment was written to a file with a sanitized name by http_dl.download() 2015-05-03 10:04:14 +02:00			`os.remove(encodeFilename(frag_sanitized))`
[f4m] Tolerate missed fragments on live streams 2015-02-23 20:56:35 +01:00			`else:`
[downloader/f4m] Fragment filenames must be sanitized because the fragment was written to a file with a sanitized name by http_dl.download() 2015-05-03 10:04:14 +02:00			`frags_filenames.append(frag_sanitized)`
[f4m] Tolerate missed fragments on live streams 2015-02-23 20:56:35 +01:00			`except (compat_urllib_error.HTTPError, ) as err:`
			`if live and (err.code == 404 or err.code == 410):`
			`# We didn't keep up with the live window. Continue`
			`# with the next available fragment.`
			`msg = 'Fragment %d unavailable' % frag_i`
			`self.report_warning(msg)`
			`fragments_list = []`
			`else:`
			`raise`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00			`if not fragments_list and live and bootstrap_url:`
			`fragments_list = self._update_live_fragments(bootstrap_url, frag_i)`
[f4m] Tolerate missed fragments on live streams 2015-02-23 20:56:35 +01:00			`total_frags += len(fragments_list)`
			`if fragments_list and (fragments_list[0][1] > frag_i + 1):`
			`msg = 'Missed %d fragments' % (fragments_list[0][1] - (frag_i + 1))`
			`self.report_warning(msg)`
[f4m] Refresh fragment list periodically on live streams 2015-02-22 20:03:49 +01:00
[f4m] Implement f4m fd in terms of fragment fd 2015-07-28 22:27:50 +02:00			`self._finish_frag_download(ctx)`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`for frag_file in frags_filenames:`
[downloader/f4m] Fragment filenames must be sanitized because the fragment was written to a file with a sanitized name by http_dl.download() 2015-05-03 10:04:14 +02:00			`os.remove(encodeFilename(frag_file))`
Add a downloader for f4m manifests 2013-12-23 16:39:49 +01:00
			`return True`