中国DOS联盟

-- 联合DOS 推动DOS 发展DOS --

联盟域名:www.cn-dos.net 论坛域名:www.cn-dos.net/forum
DOS,代表着自由开放与发展,我们努力起来,学习FreeDOS和Linux的自由开放与GNU精神,共同创造和发展美好的自由与GNU GPL世界吧!

中国DOS联盟论坛
现在时间是 2026-08-06 18:12
中国DOS联盟论坛 » DOS批处理 & 脚本技术(批处理室) » [已解决]求从html文件中分离出URL的dos工具或脚本 查看 690 回复 1
楼 主 [已解决]求从html文件中分离出URL的dos工具或脚本 发表于 2007-12-01 16:05 ·  新加坡 星和视界(StarHub)宽带
新手上路
积分 4
发帖 1
注册 2007-12-01 14:50
18年会员
UID 104355
性别 男
状态 离线
大概跟flashget的那个"用flashget下载所有链接"的功能差不多,就是给出一个html文件,然后可以列出里面
所有的链接, 最好还可以通过修改参数或表达式来定制精确输出结果.

Dos命令行下面,我试了grep, sed, 没成功.
例如
grep -o http://(+.)++(/*)? test.htm

(表达式是照抄网上的),结果不是没东西出来,就是出来一堆东西....似乎它们是按行来操作的???
可是目标的行数位置都是不确定的话,怎么办??

比如说, 一个html文件test.htm包含以下代码
 ......
<a href="http://down2.download.com/2/5/52/6x1196486834x203330712200/tools.rar">
.....


我打 grep 参数|正则表达式 test.html, 我只要它返回以下结果就够了
http://down2.download.com/2/5/52/6x1196486834x203330712200/tools.rar


谢谢...

[ Last edited by scanjet on 2007-12-1 at 10:58 PM ]
2 发表于 2007-12-01 19:50 ·  中国 浙江 杭州 电信
高级用户
★★
积分 537
发帖 219
注册 2007-08-04 09:43
19年会员
UID 94620
性别 男
来自 杭州--半山
状态 离线
awk -F\042 "$0~/<a href=\042http:\/\/down2.download.com\//{for (i=1;i<=NF;i++){ if($i~/http:\/\/down2.download.com\/2\/5\/52\/6x1196486834x20333071/) print $i}}" test.htm
论坛跳转: