港版书内地校对
出版社编辑拿到一本香港三联书店的繁体原稿,要出内地简体版。原稿用「資訊」「網絡」「程式」等港式用词,内地读者读「信息」「网络」「程序」才顺。编辑把整章粘贴进工具,选「港繁→大陆简」,机器先转字形,再批量替换用词,省去逐条查《两岸常用词汇对照表》的功夫。
在台湾论坛抄一份繁体食谱,贴进大陆群聊前得把「高麗菜」转成「高丽菜」,「馬鈴薯」变成「土豆」。这个工具不只做简繁字符转换,还内置了台湾、香港、大陆三套用词对照表——输入「滑鼠」能输出「鼠标」,输入「士多啤梨」能输出「草莓」。转换全程在浏览器本地完成,文字不上传服务器,适合处理含个人笔记或未公开文档的文本。
出版社编辑拿到一本香港三联书店的繁体原稿,要出内地简体版。原稿用「資訊」「網絡」「程式」等港式用词,内地读者读「信息」「网络」「程序」才顺。编辑把整章粘贴进工具,选「港繁→大陆简」,机器先转字形,再批量替换用词,省去逐条查《两岸常用词汇对照表》的功夫。
独立游戏开发者从 Steam 拿到繁中文本,原始文件用「滑鼠」「硬碟」「伺服器」等台区用词。要发到大陆平台,需改成「鼠标」「硬盘」「服务器」。开发者把 JSON 语言包全文粘进工具,选「台繁→大陆简」,一次跑完 3000 行文本,避免漏改导致玩家投诉「翻译不接地气」。
淘宝卖家想把商品详情页同步到虾皮台湾站。原文写「充电宝」「创可贴」「U盘」,台湾买家看不懂。卖家把文案复制进工具,选「大陆简→台繁」,工具自动转成「行動電源」「OK繃」「隨身碟」。同一批 200 个 SKU 的描述,半小时内完成转换,不用再雇台湾本地翻译。
法务收到一份香港律所发的繁体合同,关键条款写「條文」「訴訟」「證據」。要在大陆法院使用,需转成简体并确认用词准确。法务逐段用工具转换,重点核对「條文→条文」「訴訟→诉讼」等法律术语是否被错误替换。工具保留原文格式,段落编号不乱,省去重排格式的时间。
博士生写好一篇简体中文论文,要投到《台湾社会学刊》。投稿须知要求「繁體字、台灣用語」。作者把正文粘进工具,选「大陆简→台繁」,工具把「分析」「组织」「信息」转成「分析」「組織」「資訊」,同时保留参考文献中的英文和数字不变。投稿前再跑一遍全文,确保无漏转。
| 维度 | 本工具 | 在线繁简转换站 | 手工对照 |
|---|---|---|---|
| 用词转换 | 支持大陆/台湾/香港三套用词差异(如「打印/列印/打印」) | 多数仅做字形转换,不处理用词差异 | 需人工逐词核对,效率低且易遗漏 |
| 隐私 | 纯浏览器端处理,文本不上传服务器 | 文本需提交至服务器处理 | 完全本地,无隐私风险 |
| 速度 | 毫秒级响应,无网络延迟 | 受网络和服务器负载影响 | 依赖个人操作速度,长文本耗时数十分钟 |
| 离线可用 | 完全离线,无需网络 | 必须联网 | 完全离线 |
| 批量处理 | 支持一次性粘贴长文本或批量文件(浏览器拖入) | 多数仅支持单次粘贴,无批量文件上传 | 需逐段手动转换,无批量能力 |
| 收费 | 免费,无使用次数限制 | 部分站点有每日次数限制或需付费去广告 | 零成本,但时间成本高 |
| 输入 | 输出 | 说明 |
|---|---|---|
| 简体:今天下午我们去图书馆借书。 | 繁体:今天下午我們去圖書館借書。 | 常规:简体转繁体,含常用字词转换,验证基本字型映射正确性。 |
| 繁体:計算機科學是一門有趣的學科。 | 简体:计算机科学是一门有趣的学科。 | 常规:繁体转简体,验证「計算機→计算机」「學科→学科」等标准对应。 |
| 简体:这台电脑的硬盘坏了,需要重装系统。 | 台湾用语:這台電腦的硬碟壞了,需要重灌系統。 | 边界:大陆用词「硬盘」「重装系统」在台湾用语中对应「硬碟」「重灌系統」,验证三套用词库的切换能力。 |
| 繁体:我喜歡吃士多啤梨和朱古力。 | 香港用语:我鍾意食士多啤梨同朱古力。 | 边界:香港用语中「喜歡→鍾意」「和→同」的词汇替换,验证港式用词库的准确性。 |
| 简体:软件更新后,界面变成了默认设置。 | 香港用语:軟件更新後,介面變成了默認設置。 | 边界:大陆用词「软件」「界面」「默认」在香港用语中分别对应「軟件」「介面」「默認」,验证三套用词库的完整覆盖。 |
| 简体:这个项目需要一份可行性报告。 | 台湾用语:這個專案需要一份可行性報告。 | 易错:「项目→專案」是台湾用语常见对应,但大陆「项目」在台湾有时也保留,验证工具是否按词库精确替换而非机械字对字。 |
| 繁体:他透過網路搜尋引擎找到了答案。 | 简体:他通过网络搜索引擎找到了答案。 | 易错:「透過→通过」「網路→网络」「搜尋引擎→搜索引擎」,验证多字词组的整体转换而非逐字替换。 |
1.混用台/港/大陆用词,转换后不符合目标地区习惯
将「软件」转为繁体,期望输出「軟體」使用「大陆→台湾」模式,输出「軟體」简繁转换不仅涉及字形,还涉及用词差异。大陆「软件」在台湾是「軟體」,在香港是「軟件」。必须选择目标地区模式,否则仅做字形转换会保留原用词。
2.误将「后」统一转成「後」,忽略「皇后」等特殊用法
输入「皇后」→ 输出「皇後」输入「皇后」→ 输出「皇后」「后」在简体中对应两个繁体字:「後」(时间/方位)和「后」(君主/皇后)。工具依赖上下文判断,但多义词(如「皇后」)需人工确认,自动转换可能出错。
3.忽略异体字差异,直接使用字形转换
将「爲」视为「為」的异体,统一转成「為」保留原字形「爲」或根据目标地区选择标准字形Unicode 中「爲」(U+7232)和「為」(U+70BA)是不同码位。部分工具只做码位映射,不处理异体字,导致输出字形不符合用户预期。
4.输入包含英文/数字混合文本,未考虑标点全半角转换
输入「Hello, 世界」→ 输出「Hello, 世界」输入「Hello,世界」→ 输出「Hello,世界」简繁转换通常只处理汉字,标点符号的全半角需单独设置。如果工具不自动转换标点,用户需手动调整,否则混排文本标点风格不统一。
5.将「干」统一转为「幹」,忽略「乾」和「干」的区分
输入「干燥」→ 输出「幹燥」输入「干燥」→ 输出「乾燥」简体「干」对应三个繁体字:「幹」(主干/才干)、「乾」(干燥)、「干」(干涉/天干)。工具需根据语义判断,但复杂语境(如「干湿」)可能误判。
6.使用方言用词转换后,目标地区读者看不懂
将大陆「土豆」转为台湾繁体「土豆」将大陆「土豆」转为台湾繁体「馬鈴薯」大陆「土豆」在台湾也指「花生」,而「馬鈴薯」才是通用词。简繁转换的用词映射需考虑地区差异,否则会产生歧义。
7.忽略古文/专有名词的繁体保留规则
将「乾隆」转为简体「干隆」保留「乾隆」不变历史人名、地名、古籍中的「干」通常不简化(如「乾隆」「天干地支」)。自动转换工具可能误简化,需用户手动检查或使用专有名词保护功能。
8.将「里」统一转为「裡」,忽略「里」作为长度单位的用法
输入「公里」→ 输出「公裡」输入「公里」→ 输出「公里」简体「里」对应两个繁体字:「裡」(内部)和「里」(长度单位/邻里)。工具需根据上下文区分,但「公里」是固定单位,不应转换。
T = M(S, D, L)
S源字符串,待转换的文本D转换方向:s2t 或 t2sL目标用词体系:大陆/台湾/香港T转换结果字符串源字符串 S = "鼠标点击",方向 D = s2t(简体转繁体),用词体系 L = 台湾。转换过程:先按 Unicode 映射将每个简体字转为对应繁体字("鼠"→"鼠","标"→"標","点"→"點","击"→"擊"),得到中间结果"鼠標點擊";再对中间结果应用台湾用词表替换,将"鼠标"替换为"滑鼠",最终结果 T = "滑鼠點擊"。
5 种主流语言实现,复制即用:
import opencc
# 安装: pip install opencc-python-reimplemented
converter = opencc.OpenCC('s2t.json') # 简体→繁体(台湾标准)
print(converter.convert('鼠标')) # 输出: 滑鼠
converter2 = opencc.OpenCC('s2hk.json') # 简体→香港繁体
print(converter2.convert('软件')) # 输出: 軟件
converter3 = opencc.OpenCC('t2s.json') # 繁体→简体
print(converter3.convert('網絡')) # 输出: 网络// 浏览器环境,使用 OpenCC 的 JS 版本
// 安装: npm install opencc-js
import OpenCC from 'opencc-js';
const converter = OpenCC.Converter({ from: 'cn', to: 'tw' }); // 大陆→台湾
console.log(converter('鼠标')); // 输出: 滑鼠
const converter2 = OpenCC.Converter({ from: 'cn', to: 'hk' }); // 大陆→香港
console.log(converter2('软件')); // 输出: 軟件
const converter3 = OpenCC.Converter({ from: 'tw', to: 'cn' }); // 台湾→大陆
console.log(converter3('網路')); // 输出: 网络package main
import (
"fmt"
"github.com/liuzl/gocc"
)
func main() {
// 安装: go get github.com/liuzl/gocc
s2t, _ := gocc.New("s2t") // 简体→繁体
result, _ := s2t.Convert("鼠标")
fmt.Println(result) // 输出: 滑鼠
t2s, _ := gocc.New("t2s") // 繁体→简体
result2, _ := t2s.Convert("網絡")
fmt.Println(result2) // 输出: 网络
}# 使用 opencc 命令行工具(需安装: apt install opencc 或 brew install opencc)
# 简体→台湾繁体
echo '鼠标' | opencc -c s2tw.json
# 输出: 滑鼠
# 简体→香港繁体
echo '软件' | opencc -c s2hk.json
# 输出: 軟件
# 繁体→简体
echo '網絡' | opencc -c t2s.json
# 输出: 网络
# 文件批量转换
opencc -i input.txt -o output.txt -c s2t.json<?php
// 使用 okvpn/okvpn-opencc-php 库
// 安装: composer require okvpn/okvpn-opencc-php
use Okvpn\OpenCC\OpenCC;
$opencc = new OpenCC();
// 简体→台湾繁体
echo $opencc->s2tw('鼠标') . "\n"; // 输出: 滑鼠
// 简体→香港繁体
echo $opencc->s2hk('软件') . "\n"; // 输出: 軟件
// 繁体→简体
echo $opencc->t2s('網絡') . "\n"; // 输出: 网络可以。本工具内置了大陆、台湾、香港三套用词对照表,不只是逐字转换。选择目标地区(如大陆)后,像‘滑鼠→鼠标’‘硬碟→硬盘’‘計程車→出租车’这类词汇会自动替换。注意:如果原始文本是混合用词(比如台湾文章里偶尔写了大陆词),工具会按你选的目标地区统一处理,不会保留混杂状态。
这是繁体中‘里/裏/裡’的异体字问题,也是简繁转换最常见的困扰。本工具默认输出台湾常用字形‘裡’(如‘房間裡’),香港多用‘裏’(‘房間裏’),大陆简体统一用‘里’。如果你需要特定地区字形,请在转换前选择输出地区(台/港/大陆),工具会按该地区的用字习惯处理,不会混用。如果选了台湾但出现‘裏’,可能是原始文本里已经写了‘裏’,工具会保留不改——你需要先确认原始输入的字形。
本工具主要面向现代汉语的简繁转换,对古文中的通假字和异体字处理有限。例如‘説’(古同‘悦’)如果出现在‘學而時習之不亦説乎’中,工具会按现代繁体规则转为‘說’,不会自动识别为‘悦’。建议古文转换后人工校对关键用字。如果文本包含大量古籍用字,可以先查阅《异体字字典》确认字形后再使用工具。
完全在浏览器本地运行,文本不会被上传到任何服务器。本工具使用纯前端(FE)实现,所有转换逻辑通过 JavaScript 在用户电脑上执行,关闭页面后数据即消失。你可以断网测试:打开页面后拔掉网线,转换功能仍然正常。适合处理合同、论文、聊天记录等敏感文本。
纯前端转换没有硬性字数限制,理论上可以处理任意长度的文本。但实际受浏览器内存和页面响应速度影响:1 万字以内几乎无延迟,10 万字以上可能需要等待 1-2 秒。如果粘贴几十万字的文档(如整本小说),建议分批次转换,避免浏览器标签页卡顿。本工具不会因为字数多而报错或截断内容。
会丢失格式。本工具只处理纯文本,不保留富文本格式(字体、颜色、表格、超链接等)。如果原始内容来自 Word 或网页,建议先粘贴到记事本去掉格式,再复制到本工具转换,最后手动恢复格式。有一种例外:如果原始文本是 Markdown 源码(如 `**加粗**`),转换后 Markdown 标记本身不会变,但内容中的简体字会转成繁体。
不同工具采用的异体字标准和用词表有差异,导致结果不同是正常现象。本工具以《通用规范汉字表》和教育部《两岸常用词典》为基准,台湾用词参考教育部国语推行委员会标准。如果你的文本涉及专业术语(医学术语、法律术语等),建议对照权威文献确认。举例:‘信息’在大陆标准中对应繁体‘資訊’(台湾)或‘信息’(香港),不同工具可能采用不同映射。
‘后’在简体中对应多个繁体字:皇后的‘后’(本身是繁体)、前後的‘後’。如果你希望所有‘后’都变成‘後’,可以用本工具的‘强制转换’功能(如果有的话——当前版本不支持)。建议手动检查:在结果文本中搜索‘后’,根据上下文判断是否需要替换。复杂场景下(如‘后羿’中的‘后’是姓氏,不能变),工具无法自动区分,需要人工校对。
当前版本不支持批量文件上传,每次只能处理一个文本框的内容。如果需要批量转换,可以手动将多个文件的内容逐个粘贴到输入框转换,或者将文件合并成一个文本(注意文件编码统一为 UTF-8)后一次性转换。如果频繁处理大量文件,建议考虑使用支持命令行批量转换的离线工具(如 OpenCC 命令行版),本工具更适合零散文本的快速转换。
隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。