天下网吧 >> 网吧天地 >> 网吧行业 >> 网络追踪 >> 正文

深蓝词库转换2.0下载:支持仓颉/注音/五笔/郑码等

2013-1-14深蓝居曾毅
分为系统默认组件和Office组件。

设置后单击确定按钮,回到主界面,单击“转换”按钮,即可将源词库转换为繁体中文的仓颉码。

而如果没有设置转换为繁体,系统将会以源词库的字生成仓颉码,可以看到,简体和繁体仓颉码是不同的:

虽然深蓝词库转换能够支持简繁体转换,但是这不是其强项,而且也只是调用外部接口而已,所以术业有专攻,如果需要更精确的简繁体转换,可以使用

TextPro OpenCC

这些工具进行专业的转换。

五、增加了对雅虎奇摩输入法的支持。

雅虎奇摩输入法是一款繁体中文输入中比较常用的输入法软件。雅虎开发,现在已经开源。网站:http://tw.media.yahoo.com/keykey/

这款输入法支持多种输入编码,比如:注音、仓颉、简易等。但是其词库管理中,只支持注音词库的导入导出。深蓝词库转换可以将各种输入法词库转换为雅虎输入法的格式,导入到其中。

以搜狗细胞词库导入雅虎奇摩输入法为例,下载一个搜狗细胞词库scel文件,在深蓝词库转换中选择该scel文件作为源,目标词库设置为雅虎奇摩。单击转换按钮,将词库转换为注音格式的词库,并保存到硬盘上。

打开雅虎奇摩输入法的偏好设置窗口,在词汇选项卡中单击“导入自订词数据库”按钮即可将我们的词库导入其中。我们也可以单击“启动词汇编辑程式”按钮,进入词汇编辑工具,再单击文件菜单的数据库导入选项,导入我们保存的词库文件。

导入成功后,便可在雅虎奇摩输入法中输入我们导入的词汇。

六、增加了对仓颉平台输入法的支持。

仓颉平台输入法是一款基于小小输入法进行开发的输入法。在仓颉之友可以下载,也提供详细的帮助。深蓝词库转换支持仓颉五的编码。使用其他词库可以转换为仓颉平台的词库。对于仓颉平台的词库设置方法与小小输入法非常类似,首先需要将词库转换为仓颉平台的词库保存到硬盘。

接下来将转换的词库文件复制到C:\cjsys\yong\mb,然后在仓颉输入法的设置窗口中,切换到五仓世纪选项卡,为分词库添加我们的分词库文件路径。

添加后即可在仓颉平台中输入我们导入的词汇。

七、增强了对各五笔和郑码输入法的支持。

在之前的版本中,虽然名义上支持五笔输入法和郑码输入法,但是实际上是只取其中的汉字,直接忽略编码,所以各种拼音输入法不支持导出为带编码的五笔或郑码词库。在新版的深蓝词库转换中,可以为每个词生成五笔编码,郑码编码。

所以在2.0版本中,可以选择:极点五笔、极点郑码、小鸭五笔等作为目标数据库,将各种源词库导入其中。

八、增强自定义规则的功能。

自定义规则功能允许用户指定外部的编码文件,指定词语的编码生成规则,词语、编码、词频的排序、分隔符等。

比如我们有一个自定义的编码表,该表中给出了每个汉字的编码,一字一码,Tab分割。然后想对一堆词语进行编码,于是操作如下:

在深蓝词库转换中选择源词库和其输入法。在目标词库中选择“自定义”,系统将弹出自定义词库编码窗口,再单击右上角匹配规则设置按钮,设置匹配规则如下:

是说我们导出的词库文件,编码不是拼音编码,不包含词频,先显示编码,后显示汉字,之间用空格隔开。对于2字词,3字词和4字及以上的词,编码规则为各个字取一部分。下面的文本框中给出了预览效果。

然后回到自定义词库编码窗口,选择一个编码文件,这里我们选中行列30输入法的Mapping表作为编码文件。单击测试编码按钮可以看到在行列30输入法下的编码样子。

单击确定回到主窗口,单击转换按钮便可实现将指定的源词库转换为自定义词库。

九、词库列表增加百度拼音PC版

百度拼音PC版本身支持搜狗、谷歌等输入法的词库格式,所以一直没有将其添加到深蓝词库转换的输入法列表中。这样会让用户觉得是不是不支持百度PC输入法,所以为了避免用户误会,在输入法词库列表中增加了“百度拼音”。

十、重构代码,增强基本功能与命令行功能。

在源词库列表中,去掉了触宝输入法的选项,因为触宝修改了备份文件的格式,而且不支持文本文件词库的导入导出,所有现在暂时没办法支持触宝输入法。期待着触宝对词库导入导出功能的增强。

本来主窗口有2个按钮,一个负责“转换”,转换完成后询问用户是否保存转换结果。另一个“导出”按钮其实就是将下面文本框的内容保存到硬盘。由于支持的词库格式更多,各种格式不一,在文本框中进行编辑再保存就没有那么必要了。所以取消了这个按钮。使用一个更大的“转换”按钮代替,使得操作更简单。

从一个只支持拼音词库的工具到能够支持多种输入编码,多种格式解析的工具,其内部代码也必须进行了大量的调整,使得整个工具能够更易扩展,更强大。由于要支持仓颉、五笔、郑码、二笔等等输入编码的生成,所有必须在内部维护每个汉字与编码的Mapping表,所有也就使得该软件体积变大了不少。

另外,增加的输入法也需要更多的设置窗口,更强大的自定义功能,使得其内部变得复杂了很多,最近几天在写自定义编码的实现时,感觉脑子都要被搅糊了。所以必须要花更多的时间来维护代码的结构,不断重构代码,保持代码的清晰易读。

还有一点在开发上的改变就是将源代码从GoogleCode迁移到了GitHub。使用Git不是很熟悉,不过坚信这个会比原来SVN更好。

最后再重申一下,“深蓝词库转换”是一款完全免费的、开源的软件(项目网站:http://code.google.com/p/imewlconverter/)。经过了2年坚持不懈的更新,终于发展到了2.0版本,希望能够帮助更多的朋友,提高大家的打字效率,为生活带来便利。另外还有一些

本文来源:深蓝居 作者:曾毅

相关文章
没有相关文章
声明
声明:本站所发表的文章、评论及图片仅代表作者本人观点,与本站立场无关。文章是出于传递更多信息之目的。若有来源标注错误或侵犯了您的合法权益,请作者持权属证明与本网联系,我们将及时更正、删除,谢谢。 Email:support@txwb.com,系统开号,技术支持,服务联系微信:_WX_1_本站所有有注明来源为天下网吧或天下网吧论坛的原创作品,各位转载时请注明来源链接!
天下网吧·网吧天下
  • 本周热门
  • 本月热门
  • 阅读排行