脚本之家,脚本语言编程技术及教程分享平台!
分类导航

Python|VBS|Ruby|Lua|perl|VBA|Golang|PowerShell|Erlang|autoit|Dos|bat|

服务器之家 - 脚本之家 - Ruby - Ruby中使用Nokogiri包来操作XML格式数据的教程

Ruby中使用Nokogiri包来操作XML格式数据的教程

2020-05-08 10:32MidSummer Ruby

这篇文章主要介绍了Ruby中使用Nokogiri包来操作XML格式数据的教程,Nokogiri是一个gem包,Nokogiri可以依靠XPath和CSS3选择器方式来实现搜索功能,比较强大,需要的朋友可以参考下

安装

对于Ubuntu,需要安装好 libxml2, libxslt 这两个组件:

?
1
$ apt-get install libxml2 libxslt

然后就可以:

?
1
$ gem install nokogiri

可选项
nokogiri提供了一些解析文件时的可选项,常用的有:

  • NOBLANKS : 删除空节点
  • NOENT : 替代实体
  • NOERROR : 隐藏错误报告
  • STRICT : 精确解析,当解析到文件异常时抛出错误
  • NONET : 在解析期间禁止任何网络连接.

可选项使用方式举例(通过块调用):

?
1
2
3
doc = Nokogiri::XML(File.open("blossom.xml")) do |config|
config.strict.nonet
end

或者

?
1
2
3
doc = Nokogiri::XML(File.open("blossom.xml")) do |config|
config.options = Nokogiri::XML::ParseOptions::STRICT | Nokogiri::XML::ParseOptions::NONET
end

解析

可以从文件,字符串,URL等来解析。靠的是这两个方法 Nokogiri::HTML, Nokogiri::XML:

读取字符串:

?
1
2
html_doc = Nokogiri::HTML("<html><body><h1>Mr. Belvedere Fan Club</h1></body></html>")
xml_doc = Nokogiri::XML("<root><aliens><alien><name>Alf</name></alien></aliens></root>")

读取文件:

?
1
2
3
f = File.open("blossom.xml")
doc = Nokogiri::XML(f)
f.close

读取URL:

?
1
2
require 'open-uri'
doc = Nokogiri::HTML(open("http://www.threescompany.com/"))

寻找节点

可以使用XPATH 以及 CSS selector 来搜索: 例如,给定一个XML:

?
1
2
3
4
5
6
7
8
<books>
 <book>
 <title>Stars</title>
 </book>
 <book>
 <title>Moon</title>
 </book>
</books>

xpath:

?
1
@doc.xpath("//title")

css:

?
1
@doc.css("book title")

修改节点内容

?
1
2
3
4
5
6
7
8
title = @doc.css("book title").firsto
title.content = 'new title'
puts @doc.to_html
 
# =>
...
 <title>new title</title>
...

修改节点的结构

?
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
first_title = @doc.at_css('title')
second_book = @doc.css('book').last
 
# 可以把第一个title放到第二个book中
first_title.parent = second_book
 
# 也可以随意摆放。
second_book.add_next_sibling(first_title)
 
# 也可以修改对应的class
first_title.name = 'h2'
first_title['class']='red_color'
puts @doc.to_html
# => <h2 class='red_color'>...</h2>
 
# 也可以新建一个node
third_book = Nokogiri::XML::Node.new 'book', @doc
third_book.content = 'I am the third book'
second_book.add_next_sibling third_book
puts @doc.to_html
# =>
...
<books>
 ...
 <book>I am the third book</book>
</books>

 

延伸 · 阅读

精彩推荐
  • RubyRuby学习笔记之gem 命令详解

    Ruby学习笔记之gem 命令详解

    gem是一种文件组织的包,一般的ruby的很多插件都有由这种各种的包提供。我们来看看gem的用法 ...

    hebedich8662020-04-16
  • RubyWindows下ruby语言安装教程

    Windows下ruby语言安装教程

    这篇文章主要介绍了Windows下ruby语言安装教程,本文使用rubyinstaller提供的安装包安装,并给出图文说明,非常简单,需要的朋友可以参考下 ...

    脚本之家5522020-04-22
  • RubyRuby on Rails所构建的应用程序基本目录结构总结

    Ruby on Rails所构建的应用程序基本目录结构总结

    Ruby on Rails是Ruby世界中一家独大的Web开发框架,要掌握Rails程序的构建,对其目录结构的了解十分必要,下面就来看一下Ruby on Rails所构建的应用程序基本目录结...

    kevinhua4002020-05-09
  • RubyRuby编程中关于中断和返回的用法教程

    Ruby编程中关于中断和返回的用法教程

    这篇文章主要介绍了Ruby编程中关于中断和返回的用法教程,作者用代码举例讲解了其中需要注意的问题,需要的朋友可以参考下 ...

    李哲3142020-04-27
  • Rubyruby实现修改ubuntu下的hosts

    ruby实现修改ubuntu下的hosts

    本文给大家分享的是通过ruby获取github上的hosts文件内容,修改到本地Ubuntu中,十分的实用,具体你懂得,有需要的小伙伴可以参考下。 ...

    脚本之家3882020-05-03
  • Ruby对Ruby on Rails进行高效的单元测试的教程

    对Ruby on Rails进行高效的单元测试的教程

    这篇文章主要介绍了在Ruby on Rails中进行高效的单元测试的教程,使用到了Ruby的RSpec和Factory Girl框架,需要的朋友可以参考下 ...

    李冠德3562020-04-26
  • RubyRuby中对一元操作符重载实例

    Ruby中对一元操作符重载实例

    这篇文章主要介绍了Ruby中对一元操作符重载实例,实例说明如何对一元操作符进行重载,需要的朋友可以参考下 ...

    junjie1852020-04-14
  • Ruby深入讲解Ruby中Block代码块的用法

    深入讲解Ruby中Block代码块的用法

    这篇文章主要介绍了深入讲解Ruby中Block代码块的用法,block是Ruby学习进阶当中的重要知识,需要的朋友可以参考下 ...

    pringwq4582020-04-27