1

こんにちは、スクレイピーに取り組んでいて、初めて xml フィードを試しています。以下は私のコードです

class TestxmlItemSpider(XMLFeedSpider):
    name = "TestxmlItem"
    allowed_domains = {"http://www.nasinteractive.com"}


    start_urls = [
        "http://www.nasinteractive.com/jobexport/advance/hcantexasexport.xml"
    ]
    iterator = 'iternodes'
    itertag = 'job'


    def parse_node(self, response, node):
        title = node.select('title/text()').extract()
        job_code = node.select('job-code/text()').extract()
        detail_url = node.select('detail-url/text()').extract()
        category = node.select('job-category/text()').extract()

        print title,";;;;;;;;;;;;;;;;;;;;;"
        print job_code,";;;;;;;;;;;;;;;;;;;;;"

        item = TestxmlItem()
        item['title'] = node.select('title/text()').extract()
        .......  
        return item

結果:

  File "/usr/lib/python2.7/site-packages/Scrapy-0.14.3-py2.7.egg/scrapy/item.py", line 56, in __setitem__
    (self.__class__.__name__, key))
exceptions.KeyError: 'TestxmlItem does not support field: title'

合計で 200 以上のアイテムがあるため、ループしてノード テキストをアイテムに割り当てる必要がありますが、ここでは印刷時にすべての結果が一度に表示されます。xmlfeedspider

4

1 に答える 1

2

パブロホフマンから:

アイテム(TestxmlItem)で宣言された「タイトル」フィールドがありません。

追加する必要があります:

title = Field()
于 2012-09-09T15:21:18.380 に答える