从发音、文字到文化层的系统对比
目录
1. 总览:两条相反的演化路径
| 维度 | 中文 | 英语 |
|---|---|---|
| 演化方向 | 发音统一,文字分化 | 发音分化,文字不追问 |
| 第三人称发音 | tā(全部统一) | he / she / it(全部分化) |
| 第三人称文字 | 他、她、它、祂、牠 | he, she, it |
| 亲属称谓 | 精密(舅舅/叔叔/伯伯…) | 简洁(uncle 全部) |
| 核心逻辑 | 口语不关心性别,书面后来补 | 口语关心性别/生命度,书面本就有 |
这个表格揭示了一个反直觉的事实:
中文在听的时候不区分性别,英文在听的时候必须区分。
但到了亲属称谓,局面完全反转——中文精密到令人发指,英文简洁到令人发指。
2. 发音层:统一 vs 分化
2.1 中文:一个 tā 打天下
现代汉语普通话中,第三人称单数代词在口语中完全同音:
| 汉字 | 拼音 | 指代 |
|---|---|---|
| 他 | tā | 男性 / 性别不明时默认 |
| 她 | tā | 女性 |
| 它 | tā | 动物、无生命物 |
| 祂 | tā | 神明(宗教语境) |
| 牠 | tā | 动物(已基本废弃) |
你在口头上说 "tā",听者完全不知道你指的是男、女、还是东西。所有区分只存在于书面。
这并非偶然。上古汉语第三人称代词本就只有一个"其"(属格)和"之"(宾格),直到中古"他"从旁指代词("其他"之义)转用为第三人称,性别从未进入发音系统。
2.2 英语:he / she / it 严格分化
英语第三人称主格代词:
| 代词 | 发音 | 指代 |
|---|---|---|
| he | /hiː/ | 男性 |
| she | /ʃiː/ | 女性 |
| it | /ɪt/ | 非人类(动物/物体/抽象概念) |
| they(单数) | /ðeɪ/ | 性别不明/非二元(现代用法) |
这三个词发音上毫无关联——不是靠修饰、不是靠变体,而是完全不同的词根。
- he 源自古英语 hē,原始日耳曼语 *hiz
- she 源自古英语 hēo(原意为"她",后发生音变与 he 分化),具体演化路径学界仍有争议,但可以肯定在古英语晚期已经独立
- it 源自古英语 hit,原始日耳曼语 *hit(中性)
古英语有完整的语法性别系统(阳/阴/中),代词的分化是这套系统的残留。
2.3 对比小结
| 中文 | 英语 | |
|---|---|---|
| 第三人称发音种类 | 1 种(tā) | 3 种(he/she/it) |
| 口语能否识别性别 | 不能 | 能 |
| 演化动力 | 古汉语性别语法消失 → 发音趋同 | 古英语性别语法残留 → 发音保留分化 |
3. 文字层:后起之秀"她"的故事
这是整个对比中最精彩的一章。
3.1"她"字只有一百岁
"她"字诞生于 1917–1920 年间,由刘半农(新文化运动干将)正式提出并推广。在此之前,中文书面语用"他"指代所有人——男女不分。
这个时间线意味着:
- 李白写诗时,世上没有"她"
- 曹雪芹写《红楼梦》,也不用"她"
- 鲁迅、胡适的早期作品,用的还是"他"指女性
3.2 为什么突然需要一个"她"?
直接原因是翻译需求。19 世纪末到 20 世纪初,大量西方文学作品被翻译成中文,译者发现:
英语 "he said... she replied..." 翻成中文变成 "他说...他说..." —— 读者完全搞不清谁在说话。
更深层的原因是新文化运动对性别觉醒的推动。当中国人开始讨论"女性作为独立个体"时,连一个专门的文字符号都没有——这让改革者感到焦虑。
3.3"她"的竞争对手们
刘半农的方案并非唯一选项。当时至少有四种方案在竞争:
| 方案 | 提出者 | 文字 | 来源 | 命运 |
|---|---|---|---|---|
| "她"字 | 刘半农 | 她 | 从"他"分化,"女"旁示意 | ✅ 胜出 |
| "伊"字 | 周作人/鲁迅等 | 伊 | 吴语方言中女性第三人称 | ❌ 被淘汰 |
| 注音符号 | 钱玄同 | ㄊㄚ(不同写法) | 纯拼音方案 | ❌ 被淘汰 |
| "那个女人" | 沿用旧法 | (词组) | 描述性指代 | ❌ 被淘汰 |
"伊"一度很有竞争力——鲁迅在 1918–1923 年间的小说中大量使用"伊"指代女性。但"她"最终胜出,原因有三:
- 读音也是 tā,与口语完全兼容
- 字形逻辑清晰:"亻"旁是他 → "女"旁是她 → 类推自然
- 刘半农写了《教我如何不想她》这首歌,让"她"有了文化温度,从抽象符号变成了有情感的字
3.4 英语文字层面:从古英语到现代
英语的代词文字几乎不需要故事——它们从古英语一路传下来,hē → he,hēo → she,hit → it,是自然音变的产物,没经历过"专门造字"这一出。
但有一个有意思的对比:
| 中文 | 英语 | |
|---|---|---|
| 文字分化时间 | 1917 年(人工创造) | 公元 5–11 世纪(自然演化) |
| 动力 | 翻译需求 + 新文化运动 | 语法性别系统的退化与残留 |
| 创造者 | 刘半农(有明确作者) | 无明确作者 |
| 历史长度 | ~100 年 | ~1500 年 |
4. 语法层:有标记 vs 无标记
4.1 中文:方块字内部做文章
中文人称代词的语法区分靠偏旁部首:
亻(人旁)→ 他、们、你
女(女旁)→ 她
牛(牛旁)→ 牠(已废)
礻(示旁)→ 祂(宗教)
宀(宝盖)→ 它
这是一套视觉编码系统——说话时听不出来,但一写就分明。
由于 tā 发音统一,中文发展出了一些独特的歧义消除策略:
- 口语中说"那个男的"、"那个女的"来区分
- 用名字代替代词(中文比英文更频繁使用人名)
- 依赖上下文(听话人自动脑补)
4.2 英语:独立词形 + 格变化
英语人称代词是词形变化系统的残留:
| 格 | 阳性 | 阴性 | 中性 | 复数 |
|---|---|---|---|---|
| 主格 | he | she | it | they |
| 宾格 | him | her | it | them |
| 属格 | his | her | its | their |
| 反身 | himself | herself | itself | themselves |
每个格、每个性别、单复数之间都有不同的词形。这个系统源自原始印欧语的完整屈折体系——现代英语已大幅简化(古英语有更多格),但在代词上顽固地保留了。
4.3 对比
| 特征 | 中文 | 英语 |
|---|---|---|
| 编码方式 | 偏旁部首(视觉) | 独立词形(音形统一) |
| 格变化 | 无(靠语序/介词) | 有(he/him/his) |
| 口语区分度 | 零 | 高 |
| 书面区分度 | 高 | 高 |
5. 人称称谓:简洁 vs 精密
前面说了,中文在代词发音上"懒",英语在亲属称谓上"更懒"。这一节展开。
5.1 直系亲属
| 关系 | 英语 | 中文 |
|---|---|---|
| 父亲的父亲 | grandfather | 爷爷(父系)/ 外公(母系) |
| 母亲的父亲 | grandfather | 同上 |
| 父亲的母亲 | grandmother | 奶奶 / 外婆(外祖母) |
| 父亲的兄弟 | uncle | 伯伯(兄)/ 叔叔(弟) |
| 母亲的兄弟 | uncle | 舅舅 |
| 父亲的姐妹 | aunt | 姑姑 |
| 母亲的姐妹 | aunt | 姨(大姨/小姨) |
| 兄弟的儿子 | nephew | 侄子(兄弟之子)/ 外甥(姐妹之子) |
| 兄弟的女儿 | niece | 侄女 / 外甥女 |
英语一个 uncle 覆盖了中文的伯伯、叔叔、舅舅、姑父、姨父——至少五种不同关系。
5.2 为什么中文亲属称谓如此精密?
根源在于中国几千年的宗法制度:
- 父系 vs 母系:宗族继承沿父系,所以"爷爷"和"外公"必须区分——前者是同族长辈,后者是"外姓人"
- 长幼有序:宗法制度中长子的继承权和祭祀权远高于幼子,"伯伯"和"叔叔"是权力地位的差别,不是年龄差
- 婚姻制度:"姑姑"嫁出去了(属于别的宗族),"舅舅"是母族的代表——两者在法律和礼仪上承担完全不同的角色
英语的亲属系统反映的是核心家庭模式——工业化早期的英国,亲属网络已经收缩到父母+子女,更远的亲缘关系不需要在日常语言中编码。
5.3 对比小结
| 中文 | 英语 | |
|---|---|---|
| 亲属称谓精度 | 极高(十几种类别) | 极低(五六种) |
| 长幼是否编码 | 是(兄/弟/姐/妹) | 否(brother/sister) |
| 父系母系是否区分 | 是 | 否(grandfather 统一) |
| 文化根源 | 宗法制度 | 核心家庭制度 |
6. 文化层:两种文明对"人"的不同想象
语言学家 Sapir-Whorf 假设有争议,但有一点是肯定的:语言并不决定思维,但语言结构确实反映了文化关注的焦点。
6.1 中文:"关系中的位置"最重要
中文人称系统的设计哲学:
人,首先要确定:
- 在宗族中的位置(亲属称谓的精密)
- 在长幼序列中的位置(哥哥/弟弟,姐姐/妹妹)
- 在内外之别中的位置(爷爷/外公,侄子/外甥)
然后再说"这个人是谁"。
这不只是语言习惯,它是儒家"正名"思想的语言学投影——名不正则言不顺,关系没理清,话就没法说。
6.2 英语:"个体的自然属性"最重要
英语人称系统的设计哲学:
人,首先要确定:
- 性别(he/she)
- 生命性/动物性(he/she vs it)
- 数(he vs they)
然后再说"这个人与他人的关系"。
英语关心的是这个个体本身是什么(男?女?非人?),而中文关心的是这个人在关系网中处于什么位置。
6.3 当代演变:两条曲线正在交叉
有趣的是,两种语言都在朝对方的方向移动:
中文:从口语统一走向书面分化
- 1917 年之前:口语 tā,书面只有"他"
- 1917 年之后:新增"她""它""祂",书面分化
- 当代趋势:网络上出现"TA"(大小写混合)——向英语学习用书写弥补口语的模糊
英语:从强制性别标记走向中性化
- 传统:he/she 强制区分
- 当代:单数 "they" 广泛使用(性别不明或非二元)
- 趋势:机构、法律文书越来越倾向用 "they" 替代 "he or she"
时间 →
中文:━━━━━━━━━━━━━━━━━━━━━━→
统一 书面分化 TA?
(tā) (他/她/它) (融合?)
英语:━━━━━━━━━━━━━━━━━━━━━━→
分化 稳定 they单数化
(he/she/it) (现代) (去性别)
6.4 "她"背后的文化隐喻
刘半农在 1920 年写下《教我如何不想她》时可能没意识到:一个字的诞生,本身就标志着一种文化自觉。
"微风吹动了我的头发,教我如何不想她?"
在"她"字出现之前,中文世界里的女性在语言层面是不可见的——被"他"吸收,消失在男性默认值中。一个字的诞生,让一半人口在书面语言中获得了独立的符号身份。
与之对照,英语的 she 古已有之,不是争取来的——但当代英语社群正在争取的,是让单数 they 被接受,让非二元性别者在语言中获得一席之地。两个语言社区,在不同的历史节点,面对同一个问题:谁的代词才算数?
7. 总结对照表
| 对比维度 | 中文 | 英语 | 有趣在哪 |
|---|---|---|---|
| 第三人称发音 | tā × N(统一) | he / she / it(分化) | 中文听不出性别,英语必须听出来 |
| 第三人称文字 | 他/她/它/祂(分化) | he/she/it(分化) | 都分化,但中文是后来补的 |
| "她"字诞生 | 1917–1920,刘半农 | 公元5世纪,自然演化 | 一个有作者,一个没作者 |
| 格变化 | 无 | 有(he/him/his 等) | 英语残留古语法,中文本就没有 |
| 亲属称谓 | 极度精密 | 极度简洁 | 完全颠倒——uncle = 5+ 种中文关系 |
| 编码焦点 | 关系中的位置 | 个体的属性 | 儒家"正名" vs 启蒙"个体" |
| 当代趋势 | 书面继续分化(TA) | 口语向中性化(they) | 都在向对方的方向走 |
| 文化隐喻 | "她"是女性可见性的争夺 | "they"是非二元可见性的争取 | 相似的故事,不同时代 |
延伸阅读建议
- 刘半农《"她"字问题》(1920)
- 黄兴涛《"她"字的文化史》(2009)
- Guy Deutscher, Through the Language Glass (关于语言如何影响思维)
- 吕叔湘《近代汉语指代词》(1985)
写完感想:一个字的诞生可以只有一百年,但它反映的是一整套文明对"人"应该如何被看见的思考。下次你说 tā 的时候,不妨想想——这个声音里,装着一个不存在的性别、一个后来追上的文字、和一个还在进行的文化对话。