単一のHtmlNodeCollectionですべてのテーブルtrデータを取得するc#

c# html-agility-pack web-scraping

質問

私は、HTML Agility Packを使用してすべてのテーブルからすべてのtrを取得する必要があります。

HTML:

<section class="content-section" id="more">
    <div class="row">
        <div class="col-xs-6"></div>
        <div class="col-xs-6">
            <h2>Specs</h2>
            <div>
                <div>
                    <table>
                        <thead>
                            <tr><th colspan="2"> test</th></tr>
                        </thead>
                        <tbody>                         
                            <tr><td>2</td><td>b</td></tr>
                            <tr><td>1</td><td>a</td></tr>
                        </tbody>
                    </table>                                    
                    <table>
                        <tbody>
                            <tr><td>3</td><td>c</td></tr>
                            <tr><td>4</td><td>d</td></tr>               
                        </tbody>
                    </table>
                </div>              
            </div>
        </div>      
    </div>  
</section>

C#:

<section class="content-section" id="more">
    <div class="row">
        <div class="col-xs-6"></div>
        <div class="col-xs-6">
            <h2>Specs</h2>
            <div>
                <div>
                    <table>
                        <thead>
                            <tr><th colspan="2"> test</th></tr>
                        </thead>
                        <tbody>                         
                            <tr><td>2</td><td>b</td></tr>
                            <tr><td>1</td><td>a</td></tr>
                        </tbody>
                    </table>                                    
                    <table>
                        <tbody>
                            <tr><td>3</td><td>c</td></tr>
                            <tr><td>4</td><td>d</td></tr>               
                        </tbody>
                    </table>
                </div>              
            </div>
        </div>      
    </div>  
</section>

私は最初のテーブルtrを取得できますが、 HtmlNodeCollection 2つのテーブルtrをすべて取得することはできません。

受け入れられた回答

すべて取得するにはtr内の1つを含むノードthead 、あなたの更新XPathします:

"//*[@id='more']/div/div[2]/div/div[1]/table//tr"

この単純化されたXPathも機能するはずです。

"//*[@id='more']/div/div[2]/div/div[1]/table//tr"

あなたがtbodyからのtrだけを望むなら、以下を使用してください:

"//*[@id='more']/div/div[2]/div/div[1]/table//tr"

または、 theadからtrを除外するには、以下を使用します。

"//*[@id='more']/div/div[2]/div/div[1]/table//tr"



ライセンスを受けた: CC-BY-SA with attribution
所属していない Stack Overflow
このKBは合法ですか? はい、理由を学ぶ
ライセンスを受けた: CC-BY-SA with attribution
所属していない Stack Overflow
このKBは合法ですか? はい、理由を学ぶ