前言
近几天在做多语言版本的时候再次发现,区分各种语言真的是一件比较困难的事情,上一次做中文提取工具的就花了不少时间,这次决定用python试一试,结果写起来发现真是方便不少,自己整理了一下方便以后查找使用。
代码
1 | #!/usr/bin/env python3 |
文件
输入:source_ko.txt
3 캐릭터 Lv.50 달성
8 캐릭터 Lv.80 달성
10 캐릭터 Lv.90 달성
…
…
2840 飞黄腾达
4841 同归于尽
8848 캐릭터 Lv.50 달输出:ko_untranslated.txt
2840 飞黄腾达
4841 同归于尽
总结
- 其实这段小小的代码中包含了两个常用的功能,那就是读写文件和正则表达式。
- 这也是两个重要的知识点,其中
with
操作可能防止资源泄漏,操作起来更加方便。 - 正则表达式可是一个文字处理的利器,代码中的正则可能还不太完善,后续我会继续补充更新。