python - Pythonを使用してオンラインディレクトリ内のすべてのファイルを一覧表示しますか？

Question

こんにちは私はインターネットからファイルをダウンロードするPythonアプリケーションを作成しようとしているのだろうかと思っていましたが、現時点では私が知っている名前のファイルを1つだけダウンロードします...ファイルのリストを取得する方法はありますかオンラインディレクトリとそれらをダウンロードしましたか？一度に1つのファイルをダウンロードするための私のコードが表示されないので、私がやりたくないことについて少し知っています。

import urllib2

url = "http://cdn.primarygames.com/taxi.swf"

file_name = url.split('/')[-1]
u = urllib2.urlopen(url)
f = open(file_name, 'wb')
meta = u.info()
file_size = int(meta.getheaders("Content-Length")[0])
print "Downloading: %s Bytes: %s" % (file_name, file_size)

file_size_dl = 0
block_sz = 8192
while True:
    buffer = u.read(block_sz)
    if not buffer:
        break

    file_size_dl += len(buffer)
    f.write(buffer)
    status = r"%10d  [%3.2f%%]" % (file_size_dl, file_size_dl * 100. / file_size)
    status = status + chr(8)*(len(status)+1)
    print status,

f.close()

それで、このWebサイトからtaxi.swfをダウンロードするのは何ですか？しかし、私がしたいのは、そのディレクトリ「/」からすべての.swfをコンピューターにダウンロードすることです。

それは可能ですか、そして事前にどうもありがとうございました。-テリー-

score 6 · Accepted Answer

一度にたくさんのものをダウンロードしようとしているので、ダウンロードしたいものすべてをきちんとリストしているサイトインデックスまたはウェブページを探すことから始めます。ウェブサイトのモバイル版は通常、デスクトップよりも軽量で、こすりやすいです。

このウェブサイトはまさにあなたが探しているものを持っています：すべてのゲーム。

さて、それは本当にとても簡単です。ただ、すべてのゲームページのリンクを抽出します。私はBeautifulSoupを使用して、これを行うように要求します。

import requests
from bs4 import BeautifulSoup

games_url = 'http://www.primarygames.com/mobile/category/all/'

def get_all_games():
    soup = BeautifulSoup(requests.get(games_url).text)

    for a in soup.find('div', {'class': 'catlist'}).find_all('a'):
        yield 'http://www.primarygames.com' + a['href']

def download_game(url):
    # You have to do this stuff. I'm lazy and won't do it.

if __name__ == '__main__':
    for game in get_all_games():
        download_game(url)

後は君しだい。ゲームのURLを指定してゲームをダウンロードするため、DOM内download_game()のタグの場所を把握する必要があります。<object>

python - Pythonを使用してオンラインディレクトリ内のすべてのファイルを一覧表示しますか？

1 に答える 1

Related

Reference