中国DOS联盟论坛

中国DOS联盟

-- 联合DOS 推动DOS 发展DOS --
联盟域名:www.cn-dos.net 论坛域名:www.cn-dos.net/forum
游客 | 登录 | 注册 | 会员 | 搜索 | 中国DOS联盟
中国DOS联盟论坛
现在时间是 2026-08-11 07:55
47,811 主题排行 / 349,897 发帖 / 今日 0 篇 / 48,256 会员排行
DOS批处理 & 脚本技术(批处理室) » [已结][NT]如何在超长行中检索关键字?
可打印版本  806 / 8
第1楼 amark 发表于 2009-02-03 15:47
新手上路 发帖 3 积分 3
[已结][NT]如何在超长行中检索关键字?
我要做的事情是这样子的:
有一个XML报文,大小大约是1M左右,最长的一行大约有4000多字节,这样子的话,用find命令无法在这种超长行中检索关键字.
现在的想法.
1,用findstr命令,测试过,可以检索4KB的行
2,把长行割成短行,这基本就是报文解析的事了.
希望有过类似经验的朋友一起探讨.

[ Last edited by amark on 2009-2-9 at 11:20 ]
第2楼 yishanju 发表于 2009-02-03 15:54
银牌会员 发帖 1,357 积分 1,488
. 粘一个样文看看
第3楼 yishanju 发表于 2009-02-03 16:03
银牌会员 发帖 1,357 积分 1,488
xmlstarlet
F http://baiy.cn/utils/f/index.htm

SED
AWK

等等这些工具应该可以胜任
第4楼 HAT 发表于 2009-02-03 20:37
版主 发帖 5,017 积分 9,023
既然findstr命令可以检索4KB的行,为啥不用呢?
第5楼 amark 发表于 2009-02-04 09:08
新手上路 发帖 3 积分 3
呃,是这样的.
当findstr检索并返回这个4KB的行后,仍然需要在这4KB中找到特定关键字段.
如:
<errorfields><field name="date" type="0" value="" value1=今天" value2="昨天" time1="20090204" time2="20090203"/></errorfields>
并把这段中的几个值如"今天""昨天""20090204""20090203"提取出来.
昨天试着用for /f "tokens=31* delims=<> usebackq" %%i in (error.txt)来做这步工作.
结果%%i只能取到第31个节点的内容,如attribute name="television" type="0" value="1"
而想要对%%j也就是含有所需关键字段的字符串做进一步处理时,由于xml是utf-8编码的,echo %%j将会得到一堆乱码.
现在正在整理思路.
PS:条件所限,无法使用第三方工具.对2楼的建议先行谢过

[ Last edited by amark on 2009-2-4 at 09:11 ]
第6楼 netbenton 发表于 2009-02-04 09:31
银牌会员 发帖 752 积分 1,916 来自 广西
那就把它转换成ASCII码再用三方处理吧,
偶觉得for /f可能搞不定4k以上的长字段,节点多更是处理不了。
除非再用其它办法分行。
第7楼 yishanju 发表于 2009-02-04 15:40
银牌会员 发帖 1,357 积分 1,488
最多代码繁杂点,批处理应该是可以从XML中截出需要的字符串的
传个文件上来看看就知道了
第8楼 amark 发表于 2009-02-09 11:25
新手上路 发帖 3 积分 3
上周做好了.调了一个vbs来把>替换成>/n,解决长行的问题.调了另一个vbs把utf8转成unicode,然后再type成ansi.解决乱码的问题,再此谢谢楼上诸位的意见和建议.
第9楼 yishanju 发表于 2009-02-09 12:19
银牌会员 发帖 1,357 积分 1,488
把代码贴一贴嘛,给大家分享一下
[ 联系联盟系统管理团队 - 中国DOS联盟 - 标准版 ]
Sponsored by ifanr Inc | © 2001–2023