有关某个仓颉六代取码规则文档的解读尝试

本文于2025-09-28开始编写,完成于2025-11-12。

如有其他发现,则另外标注日期再追加。

于此同时的成果:蒼頡檢字法《內碼對照表》文本化計劃

前言

关于仓颉六代取码规则的讨论,我能想到的大概就是十多年前的时候有过一次集中讨论,当时还留了一些文档,而之后的进展我就不太清楚了。前些日子,Unicode 17.0横空出世,这边几个人不知为何开始整理起了仓颉六代内码(或许以后会叫做汉文库典内码)与Unicode的映射,我也不知为何开始考虑仓颉六代的规则。之后我翻找到了一个文档,叫做蒼頡檢字法(倉頡六代)官方文檔.doc。官方是吧,希望是吧。尽管不知道真假,我也拿着它开始研究了起来。那么,继续。

文档内容

取碼規則

①字形分左右、上下、內外。

 ⑴左右及內外形分字首(1-2)、字身(1-3)

 ⑵上下形字首除以下各項取首尾碼外,一律取首、2、3及尾碼。

  1.上部為囗、匚、凵、冂、冖等封閉或半封閉字形。

  2.以“八”形與下分離者,如穴、發、祭、春、儍等。

  3.上部字形縱列者如犁、響等字形。

  4.毳(HUHUU)、龘(YPYPP)等二、三或四同形字組成者。

  5.栽、房、廴等形之字首。

  6.複合字首:夢、麻、麻、厭

  除以上字首,其餘上下形一律取四碼(可以少於四碼),如糞(FDTC)、盡(LMFT)

 ⑶以下各字身若在右側,則其字首取三碼。

  鳥HZ  鸛(TRGHZ)

  力KS 動(HJGKS)

  利LN 剩(HDPLN)

  頁MZ 顴(TRGMZ)

  欠NO 歡(TRGNO)

  阝NL 鄎(HUPNL)

  隹OG 難(TLOOG)

  枚OK 敬(TPROK)

  攴YE &~GBNYE;(GBNYE)

②⑴包含省略。

 ⑵複合字首:加“徵微徾”、“膏豪亮毫”。

  複合字首:加“夢瞢薨蘉”。

 ⑶重複字:尾碼+1,2,3……,如:暈(ABJJ1)。

研究方法

仓颉六代内码与字形的对应

仓颉六代内码,从官方好久之前拿到的內碼表.txt(2025/11/13补充:)后称「内码对照表」)就可以看到。表结构比如:

列1列2列3
ABBE1XABBE
&~ABBQ;ABBQABBQ

第1列为官方认为的内码对应文字(如官方认为无法对应,则使用&{内码}~;的形式表示),第2列为仓六内码,第3列为仓五内码。

至于字形,简单来讲,访问https://chidic.eduhk.hk/m4/{内码首字母小写}/{内码字母大写}.BMP就能得到内码对应的字形,比如https://chidic.eduhk.hk/m4/o/OAHR.BMP可以得出「倉(OAHR)」这个字的字形。

仓颉六代字根

仓颉六代字根的内码是^BZ[A-Z][A-Z]$的形式,第三位是字根取码,第四位是排序。

需要说明的是,^BZX[A-Z]$已经填满了26个位置,尚未发现是否穷尽。

杂项

使用微软日文输入法时,在缓冲区中预留出编码在选区之内(比如9d12,字母大小写不论),再按F5键即可找到“鴒”字。稍微注意一下实际行为,别选到其他编码体系中对应的文字了。

仓六内码中^XZ[A-H]$(目测可以对应到Miscellaneous Symbols,U+2630~U+2637)和^XZ[A-H][A-H]$(目测可以对应到Yijing Hexagram Symbols,U+4DC0~U+4DFF)是八卦相关内容,感兴趣的可以看看。

如有必要,我将使用句点和逗点来分别表示文字的字首和次字首取码,如「識(YR.YI,A)」;出现三码字首时次字首当作出现于三码字首之内,如「鶺(EO,B.HZ)」。如果我没做标记,并不意味着没有字首(这有点厉害)或次字首,只因为①文字可看作首二三尾的形式(传统上不必标示)②我疏忽了③我犯懒。

由于现阶段(2025-09-30现在)尚未完成从六代内码到六代全码的补全,所以会有一些序号,敬请见谅。2025-11-12现在,由于六代全码补全已完成,故直接使用全码。

三码字首之内的字首也叫次字首,这样很奇怪?确实,不过我还没想到更好的说法。况且在三码字首之内的字首,的确就是次级的,所以暂且沿用次字首这样的说法。

解读

字形结构分类

左右、上下、內外

①字形分左右、上下、內外。

没从整体字和组合字开始划分?有意思,那这边也不提这两个概念了。

左右好理解,譬如「睦(BU.GC,G)」「順(L.L,LZ)」「氍(BG.HQU)」「鸛(T,RG.HZ)」这类,主体结构是LR(⿰)的就行。

至于上下,譬如「貢(M.BUC)」「夒(M.XU,E)」「臱(HU.JC,S)」「警(TK.YMR)」这类,主体结构是UD(⿱)的就行。

说到内外,能想到的有以下几种:

  • OD(⿵):「周(B.GR)」「閼(AN.YS,Y)」「阅(LS.CRU)」「鬬(LN.BM,L)」
  • OR(⿷):「匱(S.LMC)」「𠥬」
  • OU(⿶):「凾(U.NRE)」「豳(U.MO,O)」「𠚜(U.BX)」「𠚡」
  • OL(⿼):「𨤏(S.HFD)」
  • OC(⿴):「圍(W.DMQ)」「圀(W.CYS)」

尚且有些其他的结构,比如:

  • RD(⿸):「眉(AH.BU)」「廈(I.MUE)」「痙(K.MVM)」「鬳(YP.MRB)」
  • RU(⿺):「遜(Y.NDF)」「趖(GO.OOG)」「𨓶」
  • LD(⿹):「虱(N.HLI)」「氬(ON.MXM)」「𢦷(JI.YHS)」「㡬(VI.HS)」
  • LU(⿽):「⿽𠃎𢆶(L.V?)」

以及另外一些奇奇怪怪的:「睂(OM.BU; OOLU)」「𥆞(WM.WLL)」「𢏚(NMM)」「𠷎(NMMR)」(2025/11/13补充:这里的「OOLU」实为汉文库典中的「OOLU1」,并未在内码对照表中出现)

上下形与否

⑴左右及內外形分字首(1-2)、字身(1-3)

⑵上下形字首除以下各項取首尾碼外,一律取首、2、3及尾碼。

需要说一下,如果这里是模式匹配,根据实际情况,一个文字应该就分为两种情况:⑴上下形以外;⑵上下形。以下的⑴⑵采用我自己的划分。

由于记述十分简练(还很模糊),接下来以推测出来的结果说明。

仓六新增的重要改动就是上下形取码的变更了。如果文字被判定为上下形,并且文字本身并非叠字,需要根据「上下形字首」规则确定字首:若判定起始即出现例外上下形字首,则字首确定(最多2码),字身也确定(最多3码);此外则顺序取码,总码数最多4码。

另外,当判定起始即出现三叠部件,则直接将第一个部件作为字首取码。本质上或为例外上下形字首的判定规则之一,单独拿出来以防忘记。比如「㦌(HU.HU,P)」。

至于「判定起始即出现二叠部件」的情况,是否将两个部件分别视为字首和次字首,现在有正反例,而反例为多。比如正例:「𠵥(MM.MM,R)」;反例:「𡗅(NIND)」「𤈕(NINF)」「𤌉(PUPF)」这些。四叠部件在上部时,行为并不一致,「㫺(OO.A)」和「𡌭(EE.EE,G)」这样的情况都有。而根据最新的研究,六代倾向于将四叠部件看作二叠部件,二叠部件在上部时分别视为字首和次字首。(2025/11/14补充:)我个人还是持保留态度,毕竟如此一来便与五代取码一致,颇有些让人疑惑。在此按下不表。

要注意的是,「顺序取码」也遵循例外上下形字首这样的跳码规则。方便起见,这种情况我会标成次字首。(2026/01/03补充:)这种次字首需要尊重字形来确定,比如可以从「裵(Y.LY,V)」的字形看出次字首是左右形,即「非」;而「蹙(IHYO)」的次字首是「丿」而非「⿰丿尗」,因为无法直接看出后者。

接下来举几个上下形文字的例子:

  • 䨦(MZ.YB,S):字首遵循例外规则,字身最多取3码;字身是上下形,次字首遵循例外规则(上部半封闭)
  • 矍(BU.OGE):字首遵循例外规则,字身最多取3码;字身是上下形,次字首遵循一般规则
  • 褒(Y.OD,V):字首遵循一般规则(取1码),字身最多取3码;字身是上下形,次字首遵循例外规则(上部纵列)
  • 𧓿(T.NZI):字首遵循一般规则(取1码),字身最多取3码;字身是上下形,次字首遵循一般规则
  • 萬(T.WIB):字首遵循一般规则(取1码),字身最多取3码;字身并非上下形
  • 雋(OG.LS):字首遵循一般规则(取2码),字身最多取2码;字身无需判定
  • 柔(NZHD):取得字首的尝试已到3码,放弃尝试,顺序取码
  • 𧮗(YR.YR,P):判定起始出现三叠部件,字首最多取2码,次字首最多取2码

至于叠字:当文字为二叠、三叠或四叠字,则直接将第一个部件作为字首取码。比如「𠐇(DO.DOO)」(「DODO」无对应文字)「哥(MR.MNR)」「龘(YP.YP,P)」「𠓙(HU.HU,U)」(「HUHU」无对应文字)。

至于那些奇奇怪怪的:「睂(OM.BU, OOLU)」的取码分别有⑴和⑵的特征,「𥆞(WM.WLL)」就完全是⑴;「𢏚(NMM)」和「𠷎(NMMR)」虽然都无法分辨⑴和⑵,但这种情况比较像是「噩(MRRR)」,或许比较靠近⑴。如果想判定「睂(OM.BU)」「𥆞(WM.WLL)」为⑴,恐怕就要承认#(丨-一丿)及其之上的部件是𠃜这样的情况了(可参照「𥅱(UM.BU)」)。而「睂(OOLU)」,或许是选取字形不同(尽管在汉文库典字形中看不出来),被当成一般上下形来判定了(可参照「𥄾(UMBU)」)。(2025/11/13补充:这里的「OOLU」实为汉文库典中的「OOLU1」,并未在内码对照表中出现)

另外,「包(PRU)」作为部件如何?那么请看「袌(YPRV)」「𧙘(PRUV)」,形式上明显是并非上下形的情况了。

上下形字首的取码例外

1. 上部封闭或半封闭

  1.上部為囗、匚、凵、冂、冖等封閉或半封閉字形。

  • 囗:「慁(WO.P)」「𧖸(WB.HBT)」「置(WL.JBM)」「𦋳(WL.WL,X)」
  • 匚:「悘(SK.P)」「𠿦(SL.RR,G)」
  • 凵:「鬯(UI.P)」
  • 山:「豐(UJ.MRT)」
  • 冂:「𠬸(BV.E)」「𠕨(BR.OMD)」
  • 冖:「實(J.WJC)」
  • 几:「𤥔(HN.MGI)」
  • 廿:「䗣(TM.LII)」
  • #(-𠃌𠃊x0)(BZWC):「袰(WY.YHV)」

可以看见「冖」似乎很特别,我也不知道为什么,但我想到了「登春帝」三个字。

看到了所谓「半封闭」,可能让人联想到两面包围的情况,比如「䗺(NX.LI,I)」。但这并非本条内容,要放到第5条再解释。

尽管在包含省略中存在,但「𠂊(BZNF)」不参与该规则判定:「夤(NIJC)」「𤈕(NINF)」(疑为错码)

另外「⿱一⿰𠄌㇈(MUN)」也不参与判定:「𡊝(MUNG)」「𤬧(MUNJ)」

「乃(NH)」可能不参与判定:「盈(NHET)」「⿱⿵乃土女(NHGV)」「鼐(NHBX)」

「歹(MN1)」则不敢确定,因为仓六加了「⿴㇇丶(BZNI)」这个根:「𢁳(MN.LB)」「𣍌(MN.MN,A)」

上连作用

仓六依然存在上连的情况。封闭或半封闭部件之上如有某些其他部件能被判定为相连,则一并作为字首:

  • 冖:
    • ⿳亠丷冖:「旁(YB.YHS)」
    • ⿱十冖:「索(JB.VIF)」
    • ⿱⿻十从冖:「賫(JB.BUC)」
    • ⿱𰀉冖:「囊(JB.RR,V)」
    • ⿱⿻𰀁口冖:「⿳⿻𰀁口冖⿱一⿰日⿺乚目(QB.MAU)」
    • ⿱⿴𦥑?冖:「釁(XB.MC,H)」
    • 龸:「裳(FB.RYV)」
    • 𰃮:「覚(FB.BUU)」
    • ⿱爫冖:「愛(BB.PHE)」
  • 冂:
    • ⿳亠丷⿵冂?:「𧛨(YR.HV)」
    • ⿱⺊⿵冂?:「𠨈(YBAMB)」
    • ⿵𰃦?:「奧(HB.K)」
  • 囗:
    • ⿱丿⿴囗?:「粤(HW.MS)」
    • 酋:「奠(TW.K)」
    • 曲:「農(TW.M,MV)」
  • 白:「臱(IVD_02Ha)(HA.JC,S)」
  • 自:「臱(HU.JC,S)」
  • 古:「⿱古堂(JR.FB,G)」

但以下并不行:

  • ⿱爫罒:「爵(B.WL,I)」
  • 血:「衆(HBTO)」
  • ⿻[:-1]艹日:「𧕐(TWAI)」(疑为错码)

2. 八形

  2.以“八”形與下分離者,如穴、發、祭、春、儍等。

「登春帝」补完篇来了。稍微列举一下我找到的。

  • 穴:「窩(JC.BB,R)」「窸(JC.HFP)」
  • 癶:「發(NO.N,HE)」「凳(NO.MRN)」
  • ⿰𱼀龴:「祭(BO.MMF)」「詧(BO.YMR)」
  • 𡗗:「蠢(QK.ALI)」
  • ⿱⿶凵?八:「𡕰(UC.HE)」
  • 六:「衮(YC.IHV)」「㐮(YC.THV)」
  • ⿱土八:「鼀(GC.BAA)」「𧷏(GC.WL,C)」
  • 𡗜:「䙽(KC.BUU)」「𩢙(KC.SQF)」
  • 夾:「𧶘(KO.BUC)」
  • 又:「𧎮(EI.LII)」
  • 夂:「螽(HE.YLI)」
  • ⿺夂?:「咎(HO.R)」「𧊃(HN.LI)」
  • 爪:「坕(HO.G)」
  • ⿱厶大:「参(IK.HHH)」

顺带一提,八形与上相连的情况比起五代要严格一些,比如「夒(M.XU,E)」在五代中能取得到八形(MC.HE)而六代则不能。

「尢」「儿」形状恐怕不行:「𣄳(MKUQ)」「𡙖(NAHK)」「䙷(BUHI)」

3. 上部纵列

  3.上部字形縱列者如犁、響等字形。

这倒是没什么可说:「黧(HH.WFF)」「譬(SL.YMR)」「翠(SS.YOJ)」「𠁮(OO.LN)」

4. 多部件同形

  4.毳(HUHUU)、龘(YPYPP)等二、三或四同形字組成者。

当文字为二叠、三叠或四叠字,或文字起始即为三叠字,则直接将第一个部件作为字首取码,而字身最多三码。之前提过,就不说了。

5. LD、RD、RU等

  5.栽、房、廴等形之字首。

不对吧。

现在来看这三个之中似乎只有RU(⿺)的情况才适用:

  • ⿺廴?:「䗺(NX.LI,I)」
  • ⿺辶?:「蠭(YJ.LI,I)」

另外,LU(⿽)也适用:「蠿(LV.LI,I)」(※上方「𢇍」不够典型,但暂且算入在内)

而LD(⿹)则不适用:「䳣(JIHZ)」「䘁(JIOI)」

RD(⿸)也不适用:「垕(HMRG)」「愿(MHAP)」

6. 复合字首

  6.複合字首:夢、麻、麻、厭

呃,为什么放在这里说。

不太好,我以后再说吧。

左右形的特殊字身

 ⑶以下各字身若在右側,則其字首取三碼。

官方说得很明白了,在这里仅补充一些例子:

  • 鳥:「鸕(YP,T.HZ)」
  • 攴:「敲(YRB.YE)」

这就是所谓「反字身」规则。

三码字首内部可以取到它这个字首自己的字首,由前所述,还是称为次字首。

特殊字身在其他位置即丧失特殊性,如「鷺(RR.HZ)」。

特殊字身(不包含它本身的)左侧若是LR(⿰)结构,则左侧并非三码字首,而特殊字身也被取消特殊性。如「鸂(E.BK,Z)」「鶒(DL.KS,Z)」。

包含省略

②⑴包含省略。

首先需要注意的是,「包含省略」首先要「包含」。而包含是怎样的呢?可以认为是上面提到的「封闭或半封闭」结构。

另外加上「𠂊(BZNF)」「⿱一⿰𠄌㇈(MUN)」,比如「奓(KNIN)」「瓷(IO.MUN)」的尾码。

「乃(NH)」并不确定,未能找到证据。字统有「⿰圡⿵㞧干」这样的字可用来证明,但本字并无对应的仓六内码。

「歹(MN1)」由于加了「⿴㇇丶(BZNI)」这个根,所以不需要包含省略。

然后才是「省略」:以取码为单位,能够省略的才在对象之内。好比说「臱(HU.JC,S)」这个字的字首「自(HBU)」,它确实有包含结构,但它本身连接紧密,没有什么内部部件能被省略掉;而「橘(D.NZB)」的尾码其实取的是「冂(LS; BZBE)」,这个部件既是包含结构,内部又确实有其他部件,同时剩余取码也被压缩得只剩一码,自然就要省略掉内部了。

其他

一些取码的偏好(俗称「老朱/老沈说的道理」)依旧保留,如「不(MF)」。原因可能是避免重码,但谁知道呢。

辅助字形

仓颉字母和辅助字形这些,我个人习惯叫成字根。可能有时术语混用,还请见谅。

方便起见,以下直接把所有字根罗列出来,就不说明哪个字根是新的了。例字根据各地字形区分,不使用官方字形。

字根编码例字备注
BZAA「晚(A.NAU)」
BZAB「冕(A.NAU)」官方字形微妙
BZAC「眉(AH.BU)」
BZAD「黽(BAA)」
BZAE「黽(BAA)」
BZBA「膠(B.SS,H)」
BZBB「靑(QM.B)」
BZBC「誼(YR.J,BM)」
BZBD「赔(BO.YTR)」
BZBE「迥(Y.BR)」
BZBF「旁(YB.YHS)」
BZBG「遙(Y.BOU)」
BZBH「採(Q.BD)」K标字形
BZBI「受(BB.E)」G标字形
BZBJ「豹(BS.PI)」
BZBK「黽(BAA)」
BZBL「脱(B.CRU)」T标字形
BZBM「骨(BB.B)」G标字形
BZBN「骨(BB.B)」T标字形
BZBO疑似未使用。反例如「⿵門𬻞(AN.BXM)」
BZCA「錠(C.J,MO)」
BZCB「曾(CW.A)」
BZCC「益(TCBT)」G标字形
BZCD「匹(SC)」T标字形
BZCE「扒(Q.C)」
BZDA「楷(D.PP,A)」
BZDB「財(BC.DH)」
BZDC「吾(MDMR)」
BZDD「他(O.PD)」只见于「也」部件
BZDE「條(O.LHD)」G标字形
BZEA「沓(EA)」
BZEB「湖(E.JR,B)」
BZEC「泰(QK.E)」
BZED「犀(S.EHQ)」J标字形
BZEE「犀(S.EHQ)」G标字形
BZEF「脊(EO.B)」G标字形。不用于「兆(L.UO)」
BZEG「脊(EO.B)」J标字形
BZEH「伎(O.JE)」
BZFA「炮(F.PRU)」G标字形
BZFB「熬(QK.F)」G标字形
BZFC「絞(VF.YCK)」
BZFD「消(E.FB)」G标字形
BZFE「消(E.FB)」K标字形
BZFF「景(A.YRF)」
BZFG「学(FB.ND)」
BZFH「社(IFG)」不用于「𣎴(MOL)」
BZFI「歲(X.IHF)」不用于「步(XLHH)」
BZFJ「卷(F.SU)」G标字形
BZFK「卷(F.SU)」J标字形
BZGA「呈(R.MG)」G标字形
BZGB「現(MG.BUU)」
BZGC「頡 (GR.MZ)」
BZGD「壿(G.TWI)」G标字形
BZGE「雞(BVK.OG)」
BZHA「筋(H.B,KS)」
BZHB「自(HBU)」
BZHC「梔(D.HMU)」
BZHD「幷(H.H)」
BZHE「啲(R.H)」
BZIA「戲(YT.I)」
BZIB「弋(IP)」
BZIC「廣(I.TMC)」T标字形
BZID「怠(IRP)」
BZIE「禹(HLIB)」
BZIF「郎(IAI.NL)」G标字形
BZIG「㐃(IL)」
BZIL未知
BZIP复合字首
BZJA「故(JR.OK)」
BZJB「實(J.WJ,C)」
BZJC「寢(J.MSE)」
BZJD「㝱(J.BNI)」
BZKA「奪(K.OGI)」
BZKB「刚(B,K.LN)」
BZKC「有(KB)」
BZKD「癭(K.BC,V)」
BZKE「丯(QK)」
BZKF「遰(Y.KBB)」
BZKG「夜(YOK)」
BZKH「琢(MG.MKO)」
BZKI「狸(KH.WG)」
BZKJ「文(YK)」K标字形
BZLA「忠(L.P)」
BZLB「川(L.L,L)」
BZLC「川(L.L,L)」
BZLD「𧟌(L.WL,G)」
BZLE「隶(LE)」
BZLF「唐(I.LR)」J标字形
BZLG「非(L.SY)」
BZLH「兆(L.UO)」
BZLI「𢇍(LVMV)」
BZLJ「業(LTJD)」
BZLK「肃(LF)」
BZLL「南(JBL)」
BZLM「関(AN.LO)」G标字形
BZLN疑似BZLL的假想类推
BZLO「関(AN.LO)」IVD: 02Ha
BZLP与BZLM重复
BZLQ与BZLN重复
BZLR与BZLL重复
BZLS复合字首
BZMA「丁(MN)」
BZMB「次(IM.N,O)」G标字形
BZMC「厥(M.TU,O)」
BZMD「万(MS)」
BZME「貢(MBUC)」
BZMF「𠀌(SMM)」
BZMG「亟(MEM)」
BZMH「丂(MS)」反例如「敢(MLJ.OK)」(T标)
BZMI「函(MUO)」J标字形
BZMK复合字首
BZMV复合字首
BZNA「弱(NM.NIM)」
BZNB「丁(MN)」
BZNC「买(NYK)」
BZND「九(KN)」
BZNE「卂(NJ)」
BZNF「夕(NI)」
BZNG「臽(NX)」G标字形
BZNH「𠂔(LNH)」
BZNI「登(NO.MRT)」
BZNJ「乃(NH)」
BZNK「詹(N.YMR)」T标字形
BZNL「詹(N.YMR)」G标字形
BZNM「殳(HNE)」
BZNN疑似未使用。反例如「⿱⿻[:-1]丨#(𠃍-一𠃑-一)蟲(LSLI)」
BZOA「欠(NO)」
BZOB「付(O.DI)」
BZOC「舍(OMJR)」
BZOD「伤(O.OKS)」
BZOE「丘(OM)」
BZOF「込(Y.O)」
BZOG「久(NO)」
BZOH「尐(FO)」
BZOI「函(MUO)」J标字形
BZOJ「祭(BO.MMF)」
BZOK「登(NO.MRT)」
BZOL「倉(OAHR)」G标字形
BZOM「合(OR)」
BZON「足(RYO)」
BZOO「衆(HBTO)」
BZOPBZOF的另一种字形
BZOQBZOH的另一种字形
BZOR复合字首
BZOSBZOM的另一种字形
BZPA「必(PH)」
BZPB「悅(P.CRU)」
BZPC「忝(MKP)」
BZPD「化(O.P)」J标字形
BZPE「皂(HA.P)」
BZPF「弋(IP)」
BZPG「尧(JPMU)」
BZPH「勾(P.I)」
BZPI「斷(PV.HML)」
BZPJ「比(P.P)」
BZQA「擎(TK.Q)」
BZQB「提(Q.AMO)」
BZQC「牛(HQ)」
BZQD「規(QO.BUU)」
BZQE「丯(QK)」
BZQF未知
BZQG「夅(HE.Q)」
BZQHBZQG的另一种字形
BZQI未知
BZQJ「丰(QJ)」T标字形
BZQK(2026/03/09补充:)「𨧎(MQ.C)」未知,可能在「𫭣」中使用;(2026/01/31补充:)「𤘞」可以适用该辅助字形,但官方码表并未编码该字
BZQL「考(QMS)」
BZRA「呼(R.HFD)」
BZRB「互(MRM)」
BZRC「𡔝(GRH)」
BZRD「桺(D.MRR)」
BZRE「畱(MRRW)」
BZRF「龠(ORBT)」
BZRG「官(J.RR)」
BZRH「㔔(KR.R)」
BZSA「尾(S.HQU)」
BZSB「己(SU)」
BZSC「匣(S.WL)」
BZSD「力(KS)」
BZSE「乍(OS)」
BZSF「長(SMV)」
BZSG「身(HSH)」
BZSH「永(ISE)」
BZSI「豕(MSO)」
BZSJ「𦥑(HP.S)」
BZSK「雪(MZ.S)」
BZSL「录(SE)」
BZSM「羿(SS.T)」
BZSN「羽(SS)」K标字形
BZSO「马(SM)」
BZSP「馬(SQF)」
BZSQ「面(MWS)」
BZSR「斉(YK.S)」
BZTA「堇(TLQM)」
BZTB「草(TAJ)」G标字形
BZTC「草(TAJ)」T标字形
BZTD「𠁬(TSLM)」
BZTE「𠀜(MTC)」
BZTF「黄(TLWC)」
BZTG「弁(IT)」
BZTH「虛(YP.TM)」
BZTI「朔(TU.B)」
BZTJ「華(TMTJ)」
BZTK「畢(WTJ)」
BZTL「冓(TGB)」
BZTM「無(OTF)」
BZTN复合字首
BZTO复合字首
BZUA「崖(UMGG)」
BZUB「㐫(YUK)」
BZUC「児(LA.HU)」
BZUD「出(UU)」
BZUE「逆(Y.TU)」
BZUF「民(RUP)」
BZUG「以(UIO)」J标字形
BZUH「𠚜(U.BX)」反例如「兕(UXHU)」
BZVA「好(V.ND)」
BZVB「巛(VVV)」
BZVC「乆(VO)」
BZVD「亡(YV)」
BZVE「鼠(X.VVV)」
BZVF「鼠(X.VVV)」G标字形
BZVG「鼠(X.VVV)」T标字形
BZVH「畏(W.MV)」
BZVI「收(V.OK)」
BZVJ「亥(YVO)」
BZVK「𠬞(V.E)」J标字形
BZVL「牙(MVH)」
BZVM「𱰭(VW)」
BZVN疑似BZVI的变体
BZVO疑似BZVL的变体
BZVP疑似BZVQ的变体
BZVQ「旡(MVU)」例外如「发(IVKE)」(2025/11/14补充:)「𠀅(MVKS)」「𲏆(VKS)」
BZVR「㡭(PVV)」
BZWA「畳(W.B,BM)」
BZWB「國(W.I,RM)」
BZWC「母(WYI)」
BZWD「亜(MWM)」
BZXA「步(XLHH)」
BZXB「延(NE.HX)」G标字形
BZXC「叟(XLE)」G标字形
BZXD「叟(XLE)」T标字形
BZXE「輿(XJWC)」
BZXF未知,应在「𤬣」中使用
BZXG「兜(XA.HU)
BZXH「𦥓(XK)」
BZXI「鹿(IXPP)」
BZXJ未知,应在「𢈘」中使用
BZXK「㢘(I.TXF)」
BZXL「兼(TXC)」
BZXM「𦦏(YXX)」(2025/11/20补充:)「韲(YXLM)」
BZXN「齊(YX)」
BZXO「卍(SX)」
BZXP「卐(VX)」
BZXQ「亞(MXM)」
BZXR「凸(XU)」
BZXS「凹(UX)」
BZXT「𦥒(XMM)」
BZXU「𡆵(WX)」
BZXV未知
BZXW「淵(E.LXL)」
BZXX「肅(LX)」
BZXY「龜(NXU)」T标字形
BZXZ「鼎(BUX)」
BZYA「赴(GO.Y)」
BZYB「貞(YBUC)」
BZYC「文(YK)」
BZYD「冬(HE.Y)」T标字形
BZYE「追(Y.HRR)」G标字形
BZYF「追(Y.HRR)」K标字形
BZYG「與(XYC)」
BZYH「商(YCR)」
BZYI「育(YIB)」例外如「车(KQ)」
BZYJ「産(Y.HQM)」
BZYK复合字首
BZYL复合字首
BZYM复合字首
BZYN复合字首
BZYO复合字首
BZYP复合字首
BZYQ(2025/11/20修正:)复合字首
BZYR未知
BZZA「島(HZU)」
BZZB「鳥(HZ)」
BZZC「頁(MZ)」
BZZD「亦(YZ)」
BZZE「本(JZ)」
BZZF「甚(TZV)」
BZZG「其(TZ)」例外如「具(BMMC)」
BZZH「雲(MZ.MMI)」
BZZI「予(NZ)」
BZZJ「承(NZO)」
BZZK「𩱡(N.O,RZ)」「𩰲」形从开始到结束被视为左右形

另外:

  • 「竹」应该也是H的辅助字形之一,例如「𣖯(D.HP)」。由于例证不够,只好暂且像这样推测。
  • BZYI更像是复合字。见「复合字」章节。
  • (2025/11/13补充:)BZIL虽然未发现用例,但像是复合字首的废案。
  • (2025/11/20补充:)BZYR虽然存在诸多矛盾,但像是复合字首的废案。
  • (2026/03/09补充:)BZQK很可能在「丮」的某种字形(即「⿹㇈⿻乂丶(pd)」)中使用,但由于同码时如果文字被认为是全同情况则不被另外收录的原因(我猜的),所以即使在汉文库典也看不到「𨧎」字使用该辅助字形时的情况了,不得不说稍有可惜。

「Z」的特殊待遇

有些含有「Z」的编码似乎没有遵循先繁后简原则,比如「頁(MZ)」「本(JZ)」。现在理解成类似复合字那种情况就好(尽管根据字根图,取码并没有跳过的部分)。

「鬻(N.FDZ)」系列的字尤为奇怪,现在理解成以「弓」起始「Z」结束的左右形即可。其他例子如「𩱲(N.SGZ)」「𩱷(N.FDZ)」「𩱡(NORZ)」「𩱱(N.OYZ)」。由于被看作左右形,「Z」之前的部分不一定取成首尾,这点需要特别注意。

复合字首

复合字首单独使用时需取全码,这点请千万注意。

现列举已发现的复合字首:

字根编码仓六内码例字备注
BZIPI.XPP「麘(IP.HDA)」
BZLSLIS「阉(LS.KLU)」
BZMKM.AB,K「靨(MK.MWS)」
BZMVMMMV「䢈(MV.OWA)」
BZOROMN「氰(ON.QMB)」
BZTN「薨(TB.MNP)」
BZTOT.HR,L「躠(TL.RYO)」
BZYK「毫(YB.HQU)」
BZYL应在「⿱吂⿰𱼉几」中使用
BZYMYVRJ「贏(YN.BUC)」T标字形
BZYNYVRN「贏(YN.BUC)」G标字形
BZYO「槀(YB.RD)」反例:「高(YRBR)」
BZYPYH.P「虖(YP.HFD)」
BZYQYX「𪗋(YX.YHV)」(2025/11/20补充)
IDD「䜆(IC.YMR)」G标字形
I.JC,C「䜆(ID.YMR)」T标字形
「黴(HK.MWF)」

疑似复合字首的情况:

  • ⿱爫冖:「愛(BB.PHE)」(※除「⿱爫冖」外,尚未找到「爫」部件下连的证据)

并非复合字首的情况:

  • 羽:「䎈(S.S,LP)」
  • 厥:「鷢(MTOZ)」
  • 𠩵:「厯(M.DD,I)」
  • 厤:「歷(M.HD,X)」
  • 鴈:「贗(M.OZ,C)」
  • 雁:「贋(M.OG,C)」
  • 䧹:「譍(I.OG,R)」
  • 府:「腐(I.OI,B)」
  • 亥:「賌(YVOC)」
  • 合:「龕(ORYP)」

复合字

作为整体出现,只取头尾两码(但单独的每一码并不一定有对应字根)的就算是复合字吧:

  • 門(AN):「閱(AN.CRU)」「捫(Q.AN)」
  • 鬥(LN):「鬪(LN.MT,I)」
  • 阝(NL2):「陒(NL.NM,U)」「郮(B,GR.NL)」

以下存疑,反正我觉得像是:

  • ⿻[:-1]丨⿻口一(LW):「婁(LWLV)」(※「婁」这个字在六代只有这一种编码,而同一字的相同编码并不会重复。根据官方字形,暂且如此猜测)(我写着玩的,建议您别信)
  • 𠫓(YI):说来也巧,BZYI正好是I结尾。另外由于BZYI现在确实只在「𠫓」中使用,故推测「𠫓」整体为复合字。

以下并非复合字,但被作为整体看待:

  • 隹(OG):「讎(OG.YR,G)」(※地位存疑,官方并未指明它并非复合字)
  • ⿶戈𢆶(VI?):「畿(VI.W)」
  • 鬼(HWHI):「塊(G.HWI)」

复合字并未在文档中提及,但实际上确实传承下来了一部分(抛弃此概念后,相关文字的编码无法解释)。

重复部件判定的权衡

「競(YU.YTU)」这种看似文字为上下形,但其实并非。

左右同形的基准有时很难判断。比如「歰(SH.XX; SX.SHX)」,官方甚至做了一些兼容:「澀(E.SX,X; E.SH,X)」「㒊(O.SX,X; O.SH,X)」「𠽼(R.SX,X; R.SH,X)」;但也有尚未覆盖到的,比如「譅(YR.SH,X)」就没有「YR.SX,X?」的编码。

其他

有多种字形的同一个文字,如果取码一致(如「倉(OAHR)」,G标T标虽然字形不同,但取码相同),则只会保留一条记录,当然字形也只会保留一种。这点还请注意。

InSb

InSb

只是跟工作和生活相关的记录