予算
見積り希望
納品希望日
ご相談
募集期限
募集終了 締切日 2019年2月21日 /
掲載日 2019年2月14日
応募状況
応募人数 1
契約人数 0
閲覧数 0
用途・種類
ー
依頼工程
ー
用意してあるもの
ー
開発言語
ー

募集内容

募集内容
https://www.ringtv.com/554415-the-travelin-man-goes-to-gervonta-davis-vs-hugo-ruiz-part-two/ このページの「class="text-wrap"」部分を取得するためのxpathで //div[@class="text-wrap"] こうすると子要素の余計な部分まで取得してしまうので、notで //div[@class="text-wrap"]/*[not(descendant-or-self::div[@class="date-col"]) and not(descendant-or-self::div[contains(@class,'hidden-sm')]) and not(descendant-or-self::div[contains(@class,'posted-by')])] こういう指定をしています。 しかし、そうすると記事部分のpタグがなぜか消えてしまいます。 本文のテキストだけしか取得できなくなってしまいます。 日付部分(赤背景の13/FEB)や、指定したその他要素のみきれいに除外できる方法を知りたいのですが、上記xpathはどこが間違っているのでしょうか? スクレイピング処理はこちらをほぼ流用しています。 動作は問題ないのでxpathが間違っているのでは?と考えています。 http://memopad.bitter.jp/blog/2017/03/05/php%E3%81%A7html%E8%A6%81%E7%B4%A0%E3%81%AE%E4%B8%80%E9%83%A8%E3%82%92%E5%8F%96%E5%BE%97%E3%81%99%E3%82%8B/
添付ファイル
ー
参考URL
ー
求めるスキル
ー
特記事項
ー

応募者一覧

応募者
応募日時
TM10
2019/02/15 09:46

募集内容についての質問

質問と回答の履歴

質問はまだありません。不明なことがあれば質問してみましょう。
募集終了
ブックマーク
予算
見積り希望
募集終了

募集者情報

saki1990
saki1990
認証状況
本人確認
機密保持契約(NDA)

この募集内容に似ている仕事

予算
3万円
〜
5万円
応募者数 120
募集期限 あと 3 日 (9月28日まで)
user
mitsujiro
投稿日時:4日前
予算
見積り希望
応募者数 59
募集期限 あと 9 日 (10月4日まで)
user
Mauna0227
投稿日時:4日前