草庐IT

xml - 如何使用 Scala 计算 XML 文件中的元素

coder 2024-07-03 原文

我在 scala 中使用 assert 函数来比较 xml 文件。 我的问题是我希望能够计算元素的数量,例如:

<recording>
      <mousemove y="53" x="300" t="9031"/>
      <keydown kc="s" t="9759"/>
      <keypress cc="s" t="9759"/>
      <keyup kc="s" t="9829"/>
      <execextern streamID="18" t="9833"/>
      <keydown kc="s" t="10135"/>
      <keypress cc="s" t="10135"/>
      <keyup kc="s" t="10207"/>
      <execextern streamID="19" t="10207"/>
      <keydown kc="s" t="10934"/>
      <keypress cc="s" t="10934"/>
      <keyup kc="s" t="10989"/>
      <execextern streamID="20" t="10989"/>
      <keydown kc="s" t="11362"/>
      <keypress cc="s" t="11366"/>
</recording>

我希望能够计算 keydown 元素、keydown 元素、按键等的数量...

最佳答案

将你的录音标签做成一个Seq[Node],并计算每个标签:

scala> :paste
// Entering paste mode (ctrl-D to finish)

val xml = <recording>
      <mousemove y="53" x="300" t="9031"/>
      <keydown kc="s" t="9759"/>
      <keypress cc="s" t="9759"/>
      <keyup kc="s" t="9829"/>
      <execextern streamID="18" t="9833"/>
      <keydown kc="s" t="10135"/>
      <keypress cc="s" t="10135"/>
      <keyup kc="s" t="10207"/>
      <execextern streamID="19" t="10207"/>
      <keydown kc="s" t="10934"/>
      <keypress cc="s" t="10934"/>
      <keyup kc="s" t="10989"/>
      <execextern streamID="20" t="10989"/>
      <keydown kc="s" t="11362"/>
      <keypress cc="s" t="11366"/>
</recording>

// number of empty entries for whatever reason.
// Not necessary if you're not using children again after this.
val children = xml.child.filterNot(_.toString().trim.isEmpty)

val mousemoveCount = children.count(_.label == "mousemove")
val keydownCount = children.count(_.label == "keydown")
val keypressCount = children.count(_.label == "keypress")
val keyupCount = children.count(_.label == "keyup")
val execexternCount = children.count(_.label == "execextern")

println(s"number of mousemove events: $mousemoveCount")
println(s"number of keydown events: $keydownCount")
println(s"number of keypress events: $keypressCount")
println(s"number of keyup events: $keyupCount")
println(s"number of execextern events: $execexternCount")


// Exiting paste mode, now interpreting.

number of mousemove events: 1
number of keydown events: 4
number of keypress events: 4
number of keyup events: 3
number of execextern events: 3

编辑

要计算 recording 中的所有 XML 节点,保留 .filternot(...) 部分并使用 val allCount = children.size。即:

val children = xml.child.filterNot(_.toString().trim.isEmpty)
val allCount = children.size

此外,要将其变成一个通用函数,您只需将要搜索的子节点变成一个变量即可:

scala> :paste
// Entering paste mode (ctrl-D to finish)

val xml = <recording>
      <mousemove y="53" x="300" t="9031"/>
      <keydown kc="s" t="9759"/>
      <keypress cc="s" t="9759"/>
      <keyup kc="s" t="9829"/>
      <execextern streamID="18" t="9833"/>
      <keydown kc="s" t="10135"/>
      <keypress cc="s" t="10135"/>
      <keyup kc="s" t="10207"/>
      <execextern streamID="19" t="10207"/>
      <keydown kc="s" t="10934"/>
      <keypress cc="s" t="10934"/>
      <keyup kc="s" t="10989"/>
      <execextern streamID="20" t="10989"/>
      <keydown kc="s" t="11362"/>
      <keypress cc="s" t="11366"/>
</recording>

val children = xml.child.filterNot(_.toString().trim.isEmpty)

def countNodes(nodeName: String): Int = children.count(_.label == nodeName)

val allCount = children.size

println(s"number of mousemove events: ${countNodes("mousemove")}")
println(s"number of keydown events: ${countNodes("keydown")}")
println(s"number of keypress events: ${countNodes("keypress")}")
println(s"number of keyup events: ${countNodes("keyup")}")
println(s"number of execextern events: ${countNodes("execextern")}")

println(s"total number of events: $allCount")


// Exiting paste mode, now interpreting.

number of mousemove events: 1
number of keydown events: 4
number of keypress events: 4
number of keyup events: 3
number of execextern events: 3
total number of events: 15

编辑 2

如果你想让它通用,我建议你通过按节点标签分组将它放在一个 Map 中。

例如,如果您只需要节点名称和大小,则可以这样做:

children.groupBy(_.label).map {
      case(k, v) => (k, v.size)
}
// Map(mousemove -> 1, keydown -> 4, execextern -> 3, keypress -> 4, keyup -> 3)

如果你想要整个节点,你可以删除 .map:

import scala.xml.Node
val nodeSizeMap: Map[String, Seq[Node]] = children.groupBy(_.label)
// Map(
//   mousemove -> ArrayBuffer(<mousemove y="53" x="300" t="9031"/>),
//   keydown -> ArrayBuffer(<keydown kc="s" t="9759"/>, <keydown kc="s" t="10135"/>, <keydown kc="s" t="10934"/>, <keydown kc="s" t="11362"/>),
//   execextern -> ArrayBuffer(<execextern streamID="18" t="9833"/>, <execextern streamID="19" t="10207"/>, <execextern streamID="20" t="10989"/>),
//   keypress -> ArrayBuffer(<keypress cc="s" t="9759"/>, <keypress cc="s" t="10135"/>, <keypress cc="s" t="10934"/>, <keypress cc="s" t="11366"/>),
//   keyup -> ArrayBuffer(<keyup kc="s" t="9829"/>, <keyup kc="s" t="10207"/>, <keyup kc="s" t="10989"/>)
// )

在上下文中:

scala> :paste
// Entering paste mode (ctrl-D to finish)

val xml = <recording>
      <mousemove y="53" x="300" t="9031"/>
      <keydown kc="s" t="9759"/>
      <keypress cc="s" t="9759"/>
      <keyup kc="s" t="9829"/>
      <execextern streamID="18" t="9833"/>
      <keydown kc="s" t="10135"/>
      <keypress cc="s" t="10135"/>
      <keyup kc="s" t="10207"/>
      <execextern streamID="19" t="10207"/>
      <keydown kc="s" t="10934"/>
      <keypress cc="s" t="10934"/>
      <keyup kc="s" t="10989"/>
      <execextern streamID="20" t="10989"/>
      <keydown kc="s" t="11362"/>
      <keypress cc="s" t="11366"/>
</recording>

val children = xml.child.filterNot(_.toString().trim.isEmpty)

def countNodes(nodeName: String): Int = children.count(_.label == nodeName)

val allCount = children.size

// if you just want to print
children.groupBy(_.label).foreach {
      case (k, v) => println(s"number of $k events: ${v.size}")
}

println()

// if you want to do something with the values
val nodeSizeMap: Map[String, Int] = children.groupBy(_.label).map {
      case(k, v) => (k, v.size)
}

// ... do something with nodeSizeMap

nodeSizeMap.foreach {
      case (k, v) => println(s"number of $k events: $v")
}


// Exiting paste mode, now interpreting.

number of mousemove events: 1
number of keydown events: 4
number of execextern events: 3
number of keypress events: 4
number of keyup events: 3

number of mousemove events: 1
number of keydown events: 4
number of execextern events: 3
number of keypress events: 4
number of keyup events: 3

编辑 3

要使这个更加通用,并允许通过嵌套标签进行搜索,您可以使用神奇的 XML 通配符 _ 进行搜索。这是一个示例(请原谅 XML 的愚蠢):

scala> :paste
// Entering paste mode (ctrl-D to finish)

val xml = <family>
    <mother name="julie" />
    <father name="harold" />
    <child name="billy" status="good child" />
    <child name="charlie" status="good child" />
    <child name="mandy" status="bad child" />
    <child name="nigel" status="bad child" />
    <extendedfamily>
        <uncle name="jeff" />
        <auntie name="vicky" />
        <cousin name="little boy 1" />
        <cousin name="little boy 2" />
    </extendedfamily>
</family>

val familyMap = (xml \\ "_").groupBy(_.label).map { case (k, v) => (k, v.size) }

familyMap foreach {
    case (k, v) => println(s"$k count: $v")
}


// Exiting paste mode, now interpreting.

mother count: 1
auntie count: 1
uncle count: 1
child count: 4
extendedfamily count: 1
father count: 1
cousin count: 2
family count: 1

关于xml - 如何使用 Scala 计算 XML 文件中的元素,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/52855610/

有关xml - 如何使用 Scala 计算 XML 文件中的元素的更多相关文章

  1. ruby - 如何使用 Nokogiri 的 xpath 和 at_xpath 方法 - 2

    我正在学习如何使用Nokogiri,根据这段代码我遇到了一些问题:require'rubygems'require'mechanize'post_agent=WWW::Mechanize.newpost_page=post_agent.get('http://www.vbulletin.org/forum/showthread.php?t=230708')puts"\nabsolutepathwithtbodygivesnil"putspost_page.parser.xpath('/html/body/div/div/div/div/div/table/tbody/tr/td/div

  2. ruby - 如何从 ruby​​ 中的字符串运行任意对象方法? - 2

    总的来说,我对ruby​​还比较陌生,我正在为我正在创建的对象编写一些rspec测试用例。许多测试用例都非常基础,我只是想确保正确填充和返回值。我想知道是否有办法使用循环结构来执行此操作。不必为我要测试的每个方法都设置一个assertEquals。例如:describeitem,"TestingtheItem"doit"willhaveanullvaluetostart"doitem=Item.new#HereIcoulddotheitem.name.shouldbe_nil#thenIcoulddoitem.category.shouldbe_nilendend但我想要一些方法来使用

  3. ruby - 使用 RubyZip 生成 ZIP 文件时设置压缩级别 - 2

    我有一个Ruby程序,它使用rubyzip压缩XML文件的目录树。gem。我的问题是文件开始变得很重,我想提高压缩级别,因为压缩时间不是问题。我在rubyzipdocumentation中找不到一种为创建的ZIP文件指定压缩级别的方法。有人知道如何更改此设置吗?是否有另一个允许指定压缩级别的Ruby库? 最佳答案 这是我通过查看ruby​​zip内部创建的代码。level=Zlib::BEST_COMPRESSIONZip::ZipOutputStream.open(zip_file)do|zip|Dir.glob("**/*")d

  4. ruby - 为什么我可以在 Ruby 中使用 Object#send 访问私有(private)/ protected 方法? - 2

    类classAprivatedeffooputs:fooendpublicdefbarputs:barendprivatedefzimputs:zimendprotecteddefdibputs:dibendendA的实例a=A.new测试a.foorescueputs:faila.barrescueputs:faila.zimrescueputs:faila.dibrescueputs:faila.gazrescueputs:fail测试输出failbarfailfailfail.发送测试[:foo,:bar,:zim,:dib,:gaz].each{|m|a.send(m)resc

  5. ruby-on-rails - 使用 Ruby on Rails 进行自动化测试 - 最佳实践 - 2

    很好奇,就使用ruby​​onrails自动化单元测试而言,你们正在做什么?您是否创建了一个脚本来在cron中运行rake作业并将结果邮寄给您?git中的预提交Hook?只是手动调用?我完全理解测试,但想知道在错误发生之前捕获错误的最佳实践是什么。让我们理所当然地认为测试本身是完美无缺的,并且可以正常工作。下一步是什么以确保他们在正确的时间将可能有害的结果传达给您? 最佳答案 不确定您到底想听什么,但是有几个级别的自动代码库控制:在处理某项功能时,您可以使用类似autotest的内容获得关于哪些有效,哪些无效的即时反馈。要确保您的提

  6. ruby - 在 Ruby 中使用匿名模块 - 2

    假设我做了一个模块如下:m=Module.newdoclassCendend三个问题:除了对m的引用之外,还有什么方法可以访问C和m中的其他内容?我可以在创建匿名模块后为其命名吗(就像我输入“module...”一样)?如何在使用完匿名模块后将其删除,使其定义的常量不再存在? 最佳答案 三个答案:是的,使用ObjectSpace.此代码使c引用你的类(class)C不引用m:c=nilObjectSpace.each_object{|obj|c=objif(Class===objandobj.name=~/::C$/)}当然这取决于

  7. ruby - 其他文件中的 Rake 任务 - 2

    我试图在一个项目中使用rake,如果我把所有东西都放到Rakefile中,它会很大并且很难读取/找到东西,所以我试着将每个命名空间放在lib/rake中它自己的文件中,我添加了这个到我的rake文件的顶部:Dir['#{File.dirname(__FILE__)}/lib/rake/*.rake'].map{|f|requiref}它加载文件没问题,但没有任务。我现在只有一个.rake文件作为测试,名为“servers.rake”,它看起来像这样:namespace:serverdotask:testdoputs"test"endend所以当我运行rakeserver:testid时

  8. ruby-on-rails - 在 Rails 中将文件大小字符串转换为等效千字节 - 2

    我的目标是转换表单输入,例如“100兆字节”或“1GB”,并将其转换为我可以存储在数据库中的文件大小(以千字节为单位)。目前,我有这个:defquota_convert@regex=/([0-9]+)(.*)s/@sizes=%w{kilobytemegabytegigabyte}m=self.quota.match(@regex)if@sizes.include?m[2]eval("self.quota=#{m[1]}.#{m[2]}")endend这有效,但前提是输入是倍数(“gigabytes”,而不是“gigabyte”)并且由于使用了eval看起来疯狂不安全。所以,功能正常,

  9. ruby-on-rails - Ruby net/ldap 模块中的内存泄漏 - 2

    作为我的Rails应用程序的一部分,我编写了一个小导入程序,它从我们的LDAP系统中吸取数据并将其塞入一个用户表中。不幸的是,与LDAP相关的代码在遍历我们的32K用户时泄漏了大量内存,我一直无法弄清楚如何解决这个问题。这个问题似乎在某种程度上与LDAP库有关,因为当我删除对LDAP内容的调用时,内存使用情况会很好地稳定下来。此外,不断增加的对象是Net::BER::BerIdentifiedString和Net::BER::BerIdentifiedArray,它们都是LDAP库的一部分。当我运行导入时,内存使用量最终达到超过1GB的峰值。如果问题存在,我需要找到一些方法来更正我的代

  10. ruby - 使用 ruby​​ 和 savon 的 SOAP 服务 - 2

    我正在尝试使用ruby​​和Savon来使用网络服务。测试服务为http://www.webservicex.net/WS/WSDetails.aspx?WSID=9&CATID=2require'rubygems'require'savon'client=Savon::Client.new"http://www.webservicex.net/stockquote.asmx?WSDL"client.get_quotedo|soap|soap.body={:symbol=>"AAPL"}end返回SOAP异常。检查soap信封,在我看来soap请求没有正确的命名空间。任何人都可以建议我

随机推荐