中国DOS联盟论坛

中国DOS联盟

-- 联合DOS 推动DOS 发展DOS --
联盟域名:www.cn-dos.net 论坛域名:www.cn-dos.net/forum
游客 | 登录 | 注册 | 会员 | 搜索 | 中国DOS联盟
中国DOS联盟论坛
现在时间是 2026-08-06 17:10
48,039 主题排行 / 350,124 发帖 / 今日 0 篇 / 48,251 会员排行
DOS批处理 & 脚本技术(批处理室) » [已解决]求从html文件中分离出URL的dos工具或脚本
可打印版本  688 / 1
第1楼 scanjet 发表于 2007-12-01 16:05
新手上路 发帖 1 积分 4
[已解决]求从html文件中分离出URL的dos工具或脚本
大概跟flashget的那个"用flashget下载所有链接"的功能差不多,就是给出一个html文件,然后可以列出里面
所有的链接, 最好还可以通过修改参数或表达式来定制精确输出结果.

Dos命令行下面,我试了grep, sed, 没成功.
例如

(表达式是照抄网上的),结果不是没东西出来,就是出来一堆东西....似乎它们是按行来操作的???
可是目标的行数位置都是不确定的话,怎么办??

比如说, 一个html文件test.htm包含以下代码


我打 grep 参数|正则表达式 test.html, 我只要它返回以下结果就够了


谢谢...

[ Last edited by scanjet on 2007-12-1 at 10:58 PM ]
第2楼 junchen2 发表于 2007-12-01 19:50
高级用户 发帖 219 积分 537 来自 杭州--半山
awk -F\042 "$0~/<a href=\042http:\/\/down2.download.com\//{for (i=1;i<=NF;i++){ if($i~/http:\/\/down2.download.com\/2\/5\/52\/6x1196486834x20333071/) print $i}}" test.htm
[ 联系联盟系统管理团队 - 中国DOS联盟 - 标准版 ]
Sponsored by ifanr Inc | © 2001–2023