中国DOS联盟

-- 联合DOS 推动DOS 发展DOS --

联盟域名:www.cn-dos.net 论坛域名:www.cn-dos.net/forum
DOS,代表着自由开放与发展,我们努力起来,学习FreeDOS和Linux的自由开放与GNU精神,共同创造和发展美好的自由与GNU GPL世界吧!

中国DOS联盟论坛
现在时间是 2026-08-12 02:33
中国DOS联盟论坛 » DOS批处理 & 脚本技术(批处理室) » 【已结】获得文件第69行到倒数第二行间的内容 查看 699 回复 3
楼 主 【已结】获得文件第69行到倒数第二行间的内容 发表于 2009-06-27 21:34 ·  中国 广西 南宁 电信
初级用户
★★
积分 99
发帖 53
注册 2006-08-18 18:44
19年会员
UID 60809
状态 离线
如题。现在有一千多个网页文件,想删除其中多余的网页标记和脚本代码,通过观察发现从第69行到倒数第二行是正文内容,文件分别位于同一个目录下的不同文件夹下,请问批处理如何实现?:)

初步代码如下:


@echo off
setlocal enabledelayedexpansion
for /r %%i in (*.html) do (
set/a n=!n!+1
for /f "delims=" %%a in ('type %%i^|sed -n "69,$p"^|sed "$d"') do (
echo %%a>>%%~dpi!n!.html
)
)

pause




新的代码:


@echo off
setlocal enabledelayedexpansion
for /r %%i in (*.html) do (
set/a n=!n!+1
for /f "delims=" %%a in ('type %%i^|sed -n "69,$p"^|sed "$d"^|sed "s/^</<html>\n<head>\n <meta http-equiv=\"Content-Type\" content=\"text\/html^; charset^=GB2312\">\n <title><\/title>\n <style><\/style>\n<body>\n</"') do (
echo %%a>>%%~dpi!n!.html
)
)

pause


补充:以上代码基本解决问题,但网页中的charset标记被去掉了,所以现在打开生成的网页都是“西方”,请问如何保留原来的编码?{解决}

[ Last edited by asnahu on 2009-6-28 at 21:39 ]
附件
process.7z (8.06 KiB, 下载次数: 5)
2 发表于 2009-06-28 00:02 ·  中国 吉林 延边朝鲜族自治州 延吉市 电信
银牌会员
★★★
正在学习中的菜鸟...
积分 1,039
发帖 897
注册 2009-03-01 15:34
17年会员
UID 140302
性别 男
来自 在地狱中仰望天堂
状态 离线
解析文件时保留第2行,并按语法补全
3 发表于 2009-06-28 00:17 ·  中国 湖北 武汉 电信
版主
★★★★★
积分 11,386
发帖 4,938
注册 2006-07-23 17:10
20年会员
UID 59080
状态 离线
调整浏览器的编码类型,自动或者GB2312。
4 发表于 2009-06-29 00:35 ·  中国 北京 联通
银牌会员
★★★★
[b]看你妹啊[/b]
积分 1,488
发帖 1,357
注册 2006-05-20 12:00
20年会员
UID 55770
状态 离线
尝试改进代码以适应需要就对了

有问题请发论坛或者自行搜索,再短消息问我的统统是SB
论坛跳转: