|
|
|
Help:繁简处理/技术方案这个页面主要用来记录如何从技术上解决繁简体问题的一个备忘录。讨论请在对话页进行。 现在大家一致同意通过程序脚本从服务器端自动转换繁简体,这涉及到对mediawiki软件的许多修改,以及兼容性。
[编辑] 系统界面现在可以先解决系统界面的繁简体问题。现在已经有了LanguageZh.php(简体界面,也是当前的系统界面),m:LanguageZh-tw.php(繁体界面,可能需要做一些修改,兼容简体版本),Special:Allmessages可以定制系统界面。需要对程序作一些修改,同时确定繁简体用户的识别机制(参数设置,匿名用户等),并且在Special:Allmessages中生成一个繁体的MediaWiki:名字空间。MediaWiki:名字空间中的内容不做繁简转换。完成这一步之后,解决内容的繁简体问题应该更轻松一些。因为已经对程序有了一定的认识,对繁简体转换中涉及的一些基础工作(例如繁简用户的检测)也有了一定的基础和经验。 [编辑] 跨语言链接
[编辑] 繁简字对照表
[编辑] 繁简词对照表可以有两类对应关系:
对于第一种情况,我们只需考虑包含一对多的单字的词。如“专业”无需包含在转换表中,因为“专”和“业”都只有唯一的繁体对应。但“饼干”则要列在表中,因为“干”可对“乾”或 “幹”。因此,简繁表可以这样构造:搜集一个较全面的繁体词汇表,把包含简繁一对多的繁体字(缺省对应除外)的词找出来,然后翻译成简体。繁简表亦然。见wikipedia:简繁词表 和wikipedia:繁简词表。 对于第二种情况,当然所有词都要包含。以后更新的对应表主要应该是增加这类词。见wikipedia:繁简分歧词表。 [编辑] 数据库
[编辑] 繁简体用户的识别
[编辑] 不自动转换的汉字出于特殊的需要,个别汉字可以不进行自动繁简转换。使用-{文字}-来表示不进行繁简转换的汉字,以及-{zh-hans:简体;zh-hant:繁体}-进行手工转换。 [编辑] 测试站请到http://s87257573.onlinehome.us/wiki/测试。目前测试站采用上述基于Unihan数据库的繁简字转换,以及从SCIM输入平台获取的词表所做的词的转换表来进行自动转换。手工转换使用上述标记。 [编辑] 转换表校对工作请大家到Wikipedia:繁简处理/转换表校对工作帮忙校对转换表! [编辑] 相關技術方案如果想把mediawiki软件的繁簡處理技術整合到你的 PHP 程序中,可以參考http://code.google.com/p/mediawiki-zhconverter/。 |