asp网站开发防止中文乱码:codepage的重要小结_建站学-个人建站指南,网页制作,网站设计,网站制作教程

这几天研究UTF-8编码，太晕了，把我的看法和各位讨论讨论。欢迎来批啊。以下都是我的想法，哪里有不对的请不吝赐教，帮忙指出来。

相关的题外话：

一、操作系统
window系统内部都是unicode的。文件夹名，文件名等都是unicode的，任何语言系统下都能正常显示。

二、输入法：
微软拼音输出的是Unicode的，智能ABC输出是简体中文的（所以智能ABC在非简体中文系统根本不能用，只能打英文）。

三、网页的textarea
网页的textarea是用unicode显示的。所以往里打什么字都能显示。而一些flash做的输入框就不行了。

四、Access2000
access里面保存的数据是unicode的，在任何语言系统下都能显示。
如果数据视图查看有些字符不正常，那是因为显示所用的字体不是Unicode字体，
换用Arial Unicode MS 字体就能全部显示了。（access帮助，搜索，输入unicode，有说明）

五、Word
word里的繁简转换，简体转换到繁体后，内码仍是简体中文的，其实只是简体中的繁体字。

六、ASP内部是Unicode的，所有文本都是Unicode存储的。需要时转换到指定字符集。

首先说下结论：
<%@ codepage=936%>简体中文
<%@ codepage=950%>繁体中文
<%@ codepage=65001%>UTF-8

codepage指定了IIS按什么编码读取传递过来的串串（表单提交，地址栏传递等）。

也指定了所有文本变量从Unicode转换到的编码，
也就指定了从数据库取出的数据从Unicode转换到的编码。（注意这个，很重要。）

关键字：
读取：一个串串，按简体读取是一些字，按繁体读取是一些字，串串本身编码没有变。

转换：系统主动的转换，比如从Unicode的“化”字到Big5的“化”字，内码变成Big5的。如果Big5没有对应的字，保留Unicode形式（&#xxxx;）

简体中文：化六个结论
Unicode16进制形式：化六个结论
Unicode10进制形式：化六个结论

下面是我推测出来的编码转换的过程：
客户端：输入法Unicode--输入框unicode--从Unicode按charset转换到对应编码()--表单发送编码

服务器端：IIS解开表单编码--按codepage指定编码读取--转换到对应的Unicode--可以用request("")读取了--进行一些处理--以Unicode编码保存到数据库

服务器端：读取数据库的Unicode数据，转换到codepage指定编码---生成源代码--IE按charset读取显示。

下面举例说明：
例一：
假设有三个asp页面，典型的留言页面：
1.write.asp 简单的输入表单，提交到add.asp。
<META http-equiv="Content-Type" content="text/html; charset=big5">
2.add.asp 接收留言，保存到数据库
<%@ codepage=936%>
3.read.asp 从数据库取得留言，显示。
<%@ codepage=936%> charset=GB2312 或
<%@ codepage=950%> charset=big5

大家可以猜一猜，我在write.asp里用微软拼音输入法输入“化六个讨论”。最后在read.asp里会显示什么样？
是不是晕了。让我们从头分析。

(责任编辑：admin)

搜索

热门标签:

asp网站开发防止中文乱码:codepage的重要小结