![]() |
中国DOS联盟-- 联合DOS 推动DOS 发展DOS --联盟域名:www.cn-dos.net 论坛域名:www.cn-dos.net/forum |
| 游客 | 登录 | 注册 | 会员 | 搜索 | 中国DOS联盟 |
|
中国DOS联盟论坛 现在时间是 2026-08-06 19:48 |
共 48,039 主题排行 / 350,124 发帖 / 今日 0 篇 / 48,252 会员排行 |
| DOS批处理 & 脚本技术(批处理室) » [求助]如果将文件中相同的部分替换掉? |
| 可打印版本 1,727 / 20 |
| 第16楼 honghunter | 发表于 2007-12-06 09:09 |
| 中级用户 发帖 135 积分 321 | |
Originally posted by zh159 at 2007-12-6 12:19 AM: 是的,希望处理成类似那样的格式。 |
|
| 第17楼 honghunter | 发表于 2007-12-06 09:15 |
| 中级用户 发帖 135 积分 321 | |
Originally posted by junchen2 at 2007-12-6 01:08 AM: 谢谢, 只是你这个也是先识别出来之后,在写语句来实现替换得到最终格式的。 我现在的问题是如何自动的识别出来。比如识别出“省 市”是一个每行都重复的词。 |
|
| 第18楼 honghunter | 发表于 2007-12-06 09:25 |
| 中级用户 发帖 135 积分 321 | |
Originally posted by lxmxn at 2007-12-6 01:02 AM: 是的,就是想要让程序来找出这些重复的部分,比如找出“省 市”、“物业名称”…… |
|
| 第19楼 honghunter | 发表于 2007-12-06 10:18 |
| 中级用户 发帖 135 积分 321 | |
Originally posted by everest79 at 2007-12-6 02:43 AM: 查询结果是由部分信息,我需要的是全部信息,所以: 1,先抓取查询结果网页, 2,然后提取出其中的详细情况的URL列表, 3,依次下载每一个详细情况的网页,(每一个都类似http://www.fangduo.com/listsell.asp?id=33664) 4,目前的问题点:怎么有效的提取每个详细情况网页中的这些信息? |
|
| 第20楼 lxmxn | 发表于 2007-12-06 19:21 |
| 版主 发帖 4,938 积分 11,386 | |
Originally posted by honghunter at 2007-12-6 09:25: 你这样的要求有点像是人工智能哈。 看看下面被标记的部分,是不是也要剔除呢?如果也要剔除,那也好办了。 上海华泾新村二手房出售(地址:徐汇区华泾路880弄1楼)详情####房产编号: F52532828##省 市: 上海 物业名称: 华泾新村##所在区县: 徐汇 物业地址: 徐汇区华泾路880弄1楼##房 型: 2室1厅1卫 房 龄: 年##产权说明: 个人产权 业主报价: 55 万元/套##建筑面积: 57.2平方米 使用面积: 平方米##面积说明: ##房屋朝向: 南 所在楼层: 1层(共6层)##物业类型: 普通住宅 物业费用: 元/平方米·月##装修情况: 简装修##周边设施: ##交通说明: 770,718,714,804等##中介服务: ##看房时间: 提前联系##登记日期: 2007-12-3 有效期: 不限##备 注: 赠送维修基金,煤气等设备####>>>联系方式 ( 好年华上中西路店 )##联 系 人: 请恰值班人员##联系电话: 54816012 54816013##手机: ##QQ: ##email: ## |
|
| 第21楼 honghunter | 发表于 2007-12-06 20:24 |
| 中级用户 发帖 135 积分 321 | |
|
不是提出同一行中重复的部分,是要找出不同行中重复的部分。
|
|
| 上一页 1 2 |
|
[ 联系联盟系统管理团队 -
中国DOS联盟 -
标准版 ] Sponsored by ifanr Inc | © 2001–2023 |