惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
大猫的无限游戏
大猫的无限游戏
美团技术团队
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园_首页
MyScale Blog
MyScale Blog
N
Netflix TechBlog - Medium
I
InfoQ
Jina AI
Jina AI
Martin Fowler
Martin Fowler
Recent Announcements
Recent Announcements
量子位
月光博客
月光博客
罗磊的独立博客
雷峰网
雷峰网
The Cloudflare Blog
V
V2EX
小众软件
小众软件
人人都是产品经理
人人都是产品经理
博客园 - Franky
T
Tailwind CSS Blog
有赞技术团队
有赞技术团队
S
SegmentFault 最新的问题

博客园 - 一帆(老鼠粮仓之路)

这个壳为什么这么难,这个软件难道就无法破! 得到IP地址的来源,数据库动网纯真ip数据库mdb 给img添加onclick属性 - 一帆(老鼠粮仓之路) - 博客园 漂浮广告,关闭按钮 - 一帆(老鼠粮仓之路) - 博客园 一个漂亮的js轮换图,在ff下只能切换图片 - 一帆(老鼠粮仓之路) - 博客园 截取指定长度的字符串 新文章显示new字样小图标 全球主要城市时区时差转换计算表 - 一帆(老鼠粮仓之路) - 博客园 完美下拉导航条,适应ie6,ie7和firefox - 一帆(老鼠粮仓之路) - 博客园 google站内搜索,没有和博客园一样最上面的图片 - 一帆(老鼠粮仓之路) - 博客园 一种做事的精神,记师傅陕北吴旗娃 在GridView中加入单选按钮RadioButton 图片大小随鼠标滚动而改变的兼容IE和firefox的代码 一个网友的ajax进度条,出现错误的原因 99收藏夹用atlas重新改版及中文分词在线演示 用gmail发送邮件 梅花给俺的代码集合,以做纪念,感谢梅花的无私帮助! 分析百度的中文分词结果 成功将99收藏夹实现基于Lucene的站内全文搜索
蜘蛛中可以用到的正则收集
一帆(老鼠粮仓之路) · 2006-04-03 · via 博客园 - 一帆(老鼠粮仓之路)

1,得到网页上的链接地址:
      string matchString = @"<a[^>]+href=\s*(?:'(?<href>[^']+)'|""(?<href>[^""]+)""|(?<href>[^>\s]+))\s*[^>]*>";
2,得到网页的标题:
      string matchString = @"<title>(?<title>.*)</title>";
3,去掉网页中的所有的html标记:
      string temp = Regex.Replace(html, "<[^>]*>", "");   //html是一个要去除html标记的文档
4, string matchString = @"<title>([\S\s\t]*?)</title>";
5,js去掉所有html标记的函数:
      function delHtmlTag(str)
     {
        return str.replace(/<\/?.+?>/g,"");//去掉所有的html标记
     }

   这个可能IE5会错,那用这个,梅花的:
    function delHtmlTag(str)
{
   return str.replace(/<[^>]+>/g,"");//去掉所有的html标记
}