xushaoxun 发表于 2013-1-27 05:02:41

中文保存,读取,搜索

# -*- coding: utf-8 -*-                这行到底什么作用???
 
#中文字符保存到文件,读取,搜索
f = open('out2.txt', 'w')
f.write('你好吗?')
f.close()
#文件可正常显示中文。

#读取, print 到eclipse cosole
f = open('out2.txt')
s = f.read()
f.close()
print s    #浣犲ソ鍚楋紵. type(s)==<type str>
print s.decode('utf-8')     # 你好吗?
print s.find('好')   # 3

print re.search('好', s).group(0).decode('utf-8')    # 好
 
 
#读取网页
import urllib
url2 = 'http://scn1.travian.cn/login.php'
usock = urllib.urlopen(url2)
c = usock.read()
usock.close()

#读取出的字符流是utf-8编码
#似乎和<meta http-equiv="content-type" content="text/html; charset=UTF-8">有关
#保存之后可正常显示中文
print >>open('page.html', 'w'), c   #文件以utf-8编码保存。
idx = c.find('密码')      #5245
print c.decode('utf-8')         #可显示: 密码
#print c.decode('utf-8')     #错误, 为什么?搞不懂!

print re.search('用户名', c).group().decode('utf8')     #ok
 
 
保存中文到csv文件
# -*- coding: cp936 -*-
import sys
print sys.getdefaultencoding()      #cp936, coding必须和这个值一致

cc = open('2.csv', 'w')
s = '我,你\na,b\n1,2'
print>>cc, s        #用excel打开可查看中文
页: [1]
查看完整版本: 中文保存,读取,搜索