文章详情页
ruby - nokogiri 怎么获取一个 html 元素自身的 text 文本但不包含起子元素的 text 文本?
浏览:208日期:2023-10-15 14:19:56
问题描述
<body> <p id=’p1’>111</p> <p id=’p2’>222<p id=’p3’>333 <p id=’p4’>444</p></p><p id=’p33’>bbb</p> </p></body>
比如:p2元素自身的text为222.但使用nokogiri获取p2的text文本时,会包含p2的各级子元素的文本,比如p3和p4的text文本也包含在内。而我只想要p2自身的text文本,即只要222。
require ’nokogiri’html = Nokogiri::HTML(open ’test.html’)p2_obj = html.xpath('//*[@id=’p2’]')p2_text = p2_obj.to_s #这样会获取到p2各级子元素的文本
那么怎么样才能只获取到p2自身的text文本(即只要222,不要333 444 bbb)呢?
问题解答
回答1:p2_obj.children[0].text就是p_obj自身的text文本,也就是222,不包含333 444 bbb
标签:
HTML
相关文章:
1. 关于docker下的nginx压力测试2. Docker for Mac 创建的dnsmasq容器连不上/不工作的问题3. docker-compose中volumes的问题4. javascript - vue的element-ui(饿了吗UI) webpack打包时externals无法分离5. 前端 - 类到底该如何去命名 .newsList 这种的命名难道真的不是过度语义化吗?~6. docker - 各位电脑上有多少个容器啊?容器一多,自己都搞混了,咋办呢?7. 如何解决Centos下Docker服务启动无响应,且输入docker命令无响应?8. docker images显示的镜像过多,狗眼被亮瞎了,怎么办?9. docker gitlab 如何git clone?10. docker绑定了nginx端口 外部访问不到
排行榜

网公网安备