如何从shell执行XPath一行程序?

是否有一个针对Ubuntu和/或CentOS的包，它有一个命令行工具，可以执行像foo //element@attribute filename.xml或foo //element@attribute < filename.xml这样的XPath一行程序，并逐行返回结果?

我正在寻找一些东西，这将允许我只是apt-get安装foo或yum安装foo，然后只是开箱即用，没有包装或其他必要的适应。

以下是一些很接近的例子:

Nokogiri。如果我写这个包装器，我可以用上面描述的方式调用包装器:

#!/usr/bin/ruby

require 'nokogiri'

Nokogiri::XML(STDIN).xpath(ARGV[0]).each do |row|
  puts row
end

XML:: XPath。将与此包装工作:

#!/usr/bin/perl

use strict;
use warnings;
use XML::XPath;

my $root = XML::XPath->new(ioref => 'STDIN');
for my $node ($root->find($ARGV[0])->get_nodelist) {
  print($node->getData, "\n");
}

xpath从XML:: xpath返回太多噪音，——NODE——和attribute = "value"。

来自XML::Twig的xml_grep不能处理不返回元素的表达式，因此不能在没有进一步处理的情况下用于提取属性值。

编辑:

Echo cat //element/@attribute | xmllint——shell filename.xml返回类似xpath的噪声。

Xmllint——xpath //element/@attribute filename.xml返回attribute = "value"。

xmllint——xpath 'string(//element/@attribute)' filename.xml返回我想要的，但只对第一个匹配。

对于另一个几乎可以满足这个问题的解决方案，下面是一个可以用于计算任意XPath表达式的XSLT(需要XSLT处理器中的dyn:evaluate支持):

<?xml version="1.0"?>
<xsl:stylesheet xmlns:xsl="http://www.w3.org/1999/XSL/Transform" version="1.0"
    xmlns:dyn="http://exslt.org/dynamic" extension-element-prefixes="dyn">
  <xsl:output omit-xml-declaration="yes" indent="no" method="text"/>
  <xsl:template match="/">
    <xsl:for-each select="dyn:evaluate($pattern)">
      <xsl:value-of select="dyn:evaluate($value)"/>
      <xsl:value-of select="'&#10;'"/>
    </xsl:for-each> 
  </xsl:template>
</xsl:stylesheet>

使用xsltproc——stringparam pattern //element/@attribute——stringparam value运行。arbitrary-xpath。xslt filename.xml。

当前回答

下面是一个xmlstarlet用例，从这种类型的XML中从嵌套元素elem1、elem2到一行文本中提取数据(还展示了如何处理名称空间):

<?xml version="1.0" encoding="UTF-8" standalone="yes" ?>
<mydoctype xmlns="http://xml-namespace-uri" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://xml-namespace-uri http://xsd-uri" format="20171221A" date="2018-05-15">

  <elem1 time="0.586" length="10.586">
      <elem2 value="cue-in" type="outro" />
  </elem1>

</mydoctype>

输出将是

0.586 10.586 cue-in outro

在这个代码片段中，-m匹配嵌套的elem2， -v输出属性值(带有表达式和相对寻址)，-o文字文本，-n添加换行符:

xml sel -N ns="http://xml-namespace-uri" -t -m '//ns:elem1/ns:elem2' \
 -v ../@time -o " " -v '../@time + ../@length' -o " " -v @value -o " " -v @type -n file.xml

如果elem1需要更多的属性，可以这样做(也显示concat()函数):

xml sel -N ns="http://xml-namespace-uri" -t -m '//ns:elem1/ns:elem2/..' \
 -v 'concat(@time, " ", @time + @length, " ", ns:elem2/@value, " ", ns:elem2/@type)' -n file.xml

请注意名称空间的复杂性(ns，用-N声明)，这让我几乎放弃了xpath和xmlstarlet，而编写了一个快速的临时转换器。

2018-05-15 11:21:17

其他回答

值得一提的是，nokogiri本身带有一个命令行工具，应该与gem install nokogiri一起安装。

你可能会发现这篇博客文章很有用。

2015-12-23 07:29:57

下面是一个xmlstarlet用例，从这种类型的XML中从嵌套元素elem1、elem2到一行文本中提取数据(还展示了如何处理名称空间):

<?xml version="1.0" encoding="UTF-8" standalone="yes" ?>
<mydoctype xmlns="http://xml-namespace-uri" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://xml-namespace-uri http://xsd-uri" format="20171221A" date="2018-05-15">

  <elem1 time="0.586" length="10.586">
      <elem2 value="cue-in" type="outro" />
  </elem1>

</mydoctype>

输出将是

0.586 10.586 cue-in outro

在这个代码片段中，-m匹配嵌套的elem2， -v输出属性值(带有表达式和相对寻址)，-o文字文本，-n添加换行符:

xml sel -N ns="http://xml-namespace-uri" -t -m '//ns:elem1/ns:elem2' \
 -v ../@time -o " " -v '../@time + ../@length' -o " " -v @value -o " " -v @type -n file.xml

如果elem1需要更多的属性，可以这样做(也显示concat()函数):

xml sel -N ns="http://xml-namespace-uri" -t -m '//ns:elem1/ns:elem2/..' \
 -v 'concat(@time, " ", @time + @length, " ", ns:elem2/@value, " ", ns:elem2/@type)' -n file.xml

请注意名称空间的复杂性(ns，用-N声明)，这让我几乎放弃了xpath和xmlstarlet，而编写了一个快速的临时转换器。

2018-05-15 11:21:17

Saxon不仅将对XPath 2.0这样做，还将对XQuery 1.0和(商业版本)3.0这样做。它不是一个Linux包，而是一个jar文件。语法(您可以轻松地将其包装在一个简单的脚本中)

java net.sf.saxon.Query -s:source.xml -qs://element/attribute

2020年更新

Saxon 10.0包括Gizmo工具，它可以从命令行以交互方式或批处理方式使用。例如

java net.sf.saxon.Gizmo -s:source.xml
/>show //element/@attribute
/>quit

2013-03-17 16:28:28

你也可以试试我的Xidel。它不在存储库中的包中，但您可以从网页下载它(它没有依赖关系)。

对于这个任务，它有简单的语法:

xidel filename.xml -e '//element/@attribute'

它是少数支持XPath 2的工具之一。

2013-03-17 15:08:48

系统上很可能已经安装了python-lxml包。如果是这样，这是可能的，无需安装任何额外的包:

python -c "from lxml.etree import parse; from sys import stdin; print('\n'.join(parse(stdin).xpath('//element/@attribute')))"

2013-03-18 07:05:58

如何从shell执行XPath一行程序?

推荐文章

最新文章

标签