2月 13
ruby做爬虫好像都不错啊,不过Me不会ruby, 看来也要学习了.

http://www.ibm.com/developerworks/cn/linux/l-spider/
2月 13
这阵子突然好想学用python, 这阵子用perl写爬虫,即网络蜘蛛, 但看了好些文章说perl的线程不好,python的线程处理比它好,所以想尝试下.

学习的一些链接:

http://group.movo.tv/m8/circlediarylook/Sff8080811149c2fc01114afac1b80637.html
2月 13
记录下来:

原文连接:  http://bbs.im286.com/viewthread.php?tid=2243253

******************************************************************
首先,
我们讲讲数字密码的设置
一般的银行卡,手机密码等大多为6位数字
值得提醒的是不要把原始的生日,电话号码,身份证号,手机号等设置为密码
如果真的喜欢用的话,可以这样试试
生日+数字,如:801118 + 121212 = 922330
这样的密码虽然看起来没有什么特别的规则,但是你还能根据规则推算出来
你的银行卡每年换一次密码,这样是比较安全的
先想一下密码规则
手机后6位+今年的年份+生日的月和日
手机号码:159**345926
生日是:1980.12.26
今年是:2007
密码规则为: 345926 + 071226 = 417152
虽然第一次不好记,但是就算你忘记了你也能想得起来,因为这是相对科学的密码

第二就是网站及邮箱的密码
拥有N个网站的邮箱或论坛账号,而且不用同一种密码?
怎么做到?
同样,只要我们找到一种规则就解决了
固定前缀 + 特殊字符 + 所属网站的域名 + 特别标识
126和信箱密码可以设置成:
ilove + * + 126 + xixi
此处的"ilove"是固定前缀,"*"号是特殊字符,"126"是网站的域名,"xixi"是特别的标识
特殊字符"*"号的作用就是,当别人通过穷举法来恶意爆破你的密码时
特殊符号会让他人进程效率变得非常低下
我们可以算算,一个长度为6位的数字密码,
密码的组合种类有6的10次方,即6046万种可能
再加上可能设置为26种字母和特殊字符,这种强行爆破的代价是非常非常巨大的
有这个精力他们都完全可以去研究原子弹的制造了,还来玩什么密码破解啊。
所以呢他们很可能会放弃你这个账号,而去寻找其它更脆弱羔羊的下手。
另外,后面的那个特别标识是为了防止当别人知道你的规则后去猜测你的密码
这个例子里面的规则是这样的
如果域名的最后一位是数据时,则用"xixi"作后缀
如果是字母的,则用"hehe"作后缀
当然你还可以继续细分你的后缀,比如数据有大于"5"的,或者小于"5"的
等等,这个规则只要一次记忆就可以了

通过上面的例子,我们可以设置其它相关的账号如下:
gmail邮箱的密码为:ilove*gmailhaha
163的邮箱的密码为:ilove*163xixi
chinaui论坛的密码为:ilove*chinauihaha
csdn社区的密码为:ilove*csdnhaha

最后就是聊天工具的密码了
同样的方法,先找到一个规则
如:固定前缀 + 聊天工具的名字 + 特殊字符 + 时效标识
此时的因定前缀可是是自己的名字,自己喜欢的代号等等
如这里我所用的acan

时效标识,因为此类工具通过更换密码的周期比较短
如果自己经常在外面上网或者不是特别安全的地方上网
以及电脑经常中病毒之类的话
你最好一个季度换一次密码
这样你的时效标识可以设置为
0712 表示 2007年的第一个季度密码
0724 表示 2007年的第二个季度密码
0736 表示 2007年的第三个季度密码
0748 表示 2007年的第四个季度密码
为什么不用200701,200702呢?
笨啊,这样的密码,别人多试几次,大不了从200701试到200709就进去了嘛
你改成这样估计别人试到200708的时候就已经放弃了
这个规后的聊天工具密码则为
注意"acan@"是前缀,"~"号是特殊字符
QQ的密码为: acan@qq~0712
MSN的密码为: acan@msn~0724

好了,希望看完了能对大家有所启发
***********************************************

看来几有用啊...
2月 13
  在google里搜索过,大概有以下方法:

http://www.programmingtalk.com/archive/index.php/t-6109.html

This will strip all HTML tags:

##############################
use HTML::TreeBuilder;
use HTML::FormatText;

my $s; # the text out of which you wish to strip HTML

my $formatter = HTML::FormatText->new;
my $tree = HTML::TreeBuilder->new;
$tree->parse($s);
if ($tree) {
$formatter->format($tree);
$tree->delete; # DO NOT OMIT THIS STEP!
}
##############################

或者
$code = "ThisshouldbeHTMLfree";
$code =~ s/<.+?>//g;

print "Content-type: text/plain\n\n";
print $code;


在google里输入perl striphtml 查询得来的. 在百度里搜索没什么结果.
有时间实践一下.
2月 13
Ag
形语素
形容词性语素。形容词代码为a,语素代码g前面置以A。

a
形容词
取英语形容词adjective的第1个字母。

ad
副形词
直接作状语的形容词。形容词代码a和副词代码d并在一起。

an
名形词
具有名词功能的形容词。形容词代码a和名词代码n并在一起。

b
区别词
取汉字“别”的声母。

c
连词
取英语连词conjunction的第1个字母。

Dg
副语素
副词性语素。副词代码为d,语素代码g前面置以D。

d
副词
取adverb的第2个字母,因其第1个字母已用于形容词。

e
叹词
取英语叹词exclamation的第1个字母。

f
方位词
取汉字“方”

g
语素
绝大多数语素都能作为合成词的“词根”,取汉字“根”的声母。

h
前接成分
取英语head的第1个字母。

i
成语
取英语成语idiom的第1个字母。

j
简称略语
取汉字“简”的声母。

k
后接成分
 
l
习用语
习用语尚未成为成语,有点“临时性”,取“临”的声母。

m
数词
取英语numeral的第3个字母,n,u已有他用。

Ng
名语素
名词性语素。名词代码为n,语素代码g前面置以N。

n
名词
取英语名词noun的第1个字母。

nr
人名
名词代码n和“人(ren)”的声母并在一起。

ns
地名
名词代码n和处所词代码s并在一起。

nt
机构团体
“团”的声母为t,名词代码n和t并在一起。

nz
其他专名
“专”的声母的第1个字母为z,名词代码n和z并在一起。

o
拟声词
取英语拟声词onomatopoeia的第1个字母。

ba 介词 把、将  
bei 介词 被  
p
介词
取英语介词prepositional的第1个字母。

q
量词
取英语quantity的第1个字母。

r
代词
取英语代词pronoun的第2个字母,因p已用于介词。

s
处所词
取英语space的第1个字母。

Tg
时语素
时间词性语素。时间词代码为t,在语素的代码g前面置以T。

t
时间词
取英语time的第1个字母。

dec 助词 的、之  
deg 助词 得  
di 助词 地  
etc 助词 等、等等  
as 助词 了、着、过  
msp 助词 所  
u
其他助词
取英语助词auxiliary

Vg
动语素
动词性语素。动词代码为v。在语素的代码g前面置以V。

v
动词
取英语动词verb的第一个字母。

vd
副动词
直接作状语的动词。动词和副词的代码并在一起。

vn
名动词
指具有名词功能的动词。动词和名词的代码并在一起。

w
其他标点符号
 
x
非语素字
非语素字只是一个符号,字母x通常用于代表未知数、符号。

y
语气词
取汉字“语”的声母。

z
状态词
取汉字“状”的声母的前一个字母。
分页: 14/16 第一页 上页 9 10 11 12 13 14 15 16 下页 最后页 [ 显示模式: 摘要 | 列表 ]