找回密碼
 入住家園
查看: 395|回復: 0

【转载】我在北大回复“文字改革为什么不成”的回帖

[複製鏈接]
發表於 2010-10-26 14:03:58 | 顯示全部樓層 |閱讀模式
来源:http://www.pkucn.com/viewthread. ... age=4#pid1218706483
这是我在北大回复“文字改革为什么不成”的回帖。原文是:
汉字拼音化没有成功,应该研究一下为什么。我认为我们的做法离开了我们的汉字实际。什么是汉字,大家可能都有研究。我看到的资料是,文字是记录语音的书面符号,那么汉字是记录汉语语音的书面符号。汉语语音,是什么语音“专家说是"超音段"……也就是汉语语音和西方的语音不是一个层面上的,汉字和西方的文字,并不是一个层面上的。汉语拼音方案,一是受西方文字的影响二是受历史“反切”思路约束,套用西方的文字的做法,离开了汉字的实际。可以用上“南辕北辙”这句话。汉字编码也是套用ASCII的做法,电脑留给编码的空间只是一个字节(八位二进制数中七位码)可是留给我们用的只有九十四个码。(127-32-1=94)因此GB_2312-80利用这94个空间做成平面94X94就是做成94行每行放上94个汉字(这是很了不起的创举)。这就是区位码。但是区位码不能直接用来处理汉字,汉字需要变成机内码,汉字在电脑里面并没有用上我们的区位码,必须转成机内码,才能用来电脑处理,处理完后输出时,还要变成区位码。到此汉字就具有三种码:区位码,机内码,外码(可以说成键码)一、因此可以说,仿照ASCII码的做法,是行不通。如此下去就是出现了GB、GBK、GBK1……GBK5、最后Unicode.关于汉字编码我过去有一篇专门的帖子(现在已经找不到了)帖子的观点就是汉字库里没有的汉字,电脑不能处理(电脑处理文字的原理和机械打字机一样)。因此汉字库必须为所有的汉字编码,编码只有一条路,只有“拉丁字母”为古往今来的汉字一一(一个不能少)作出编码。归根结蒂就是,要想解决电脑处理汉语言信息。必须文字专家和电脑专家双方努力,扩大字库和削减汉字都是不可行的,可以封掉谈论改革的帖子,但是解决不了电脑处理汉语信息的问题。一切只能由实践来验证。
说明:
我在这个帖子里,说出我们一百来年汉字拼音化没有成功的原因呢:
“南辕北辙”如果说汉字是东方语言,欧文是西方语言,“南辕北辙”应改成“东辕西辙”最为贴切了。
“汉语语音”是“超音段”语音,这里主要是说明汉语拼音方案中,没有解决标调符号,是不能用来作为汉语语音的标记符号的;
“仿照ASCII码的做法,是行不通”这说明从事汉字编码的人,都不明白电脑怎么处理汉字的。也就是汉字必须用拉丁字母进行编码。
汉拼方案中没有解决“表意的符号”这是最不成功的地方……
您需要登錄後才可以回帖 登錄 | 入住家園

本版積分規則

手機版|小黑屋|吳語書院

GMT+8, 2026-9-4 16:38 , Processed in 0.030792 second(s), 16 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回復 返回頂部 返回列表