中文保存,读取,搜索
# -*- coding: utf-8 -*- 这行到底什么作用???#中文字符保存到文件,读取,搜索
f = open('out2.txt', 'w')
f.write('你好吗?')
f.close()
#文件可正常显示中文。
#读取, print 到eclipse cosole
f = open('out2.txt')
s = f.read()
f.close()
print s #浣犲ソ鍚楋紵. type(s)==<type str>
print s.decode('utf-8') # 你好吗?
print s.find('好') # 3
print re.search('好', s).group(0).decode('utf-8') # 好
#读取网页
import urllib
url2 = 'http://scn1.travian.cn/login.php'
usock = urllib.urlopen(url2)
c = usock.read()
usock.close()
#读取出的字符流是utf-8编码
#似乎和<meta http-equiv="content-type" content="text/html; charset=UTF-8">有关
#保存之后可正常显示中文
print >>open('page.html', 'w'), c #文件以utf-8编码保存。
idx = c.find('密码') #5245
print c.decode('utf-8') #可显示: 密码
#print c.decode('utf-8') #错误, 为什么?搞不懂!
print re.search('用户名', c).group().decode('utf8') #ok
保存中文到csv文件
# -*- coding: cp936 -*-
import sys
print sys.getdefaultencoding() #cp936, coding必须和这个值一致
cc = open('2.csv', 'w')
s = '我,你\na,b\n1,2'
print>>cc, s #用excel打开可查看中文
页:
[1]