漢藏語系關係樹
Sino-Tibetan/Trans-Himalayan Tree
Sino-Tibetan languages family tree / Trans-Himalayan languages family tree / Sino-Tibetan classification / 漢藏語系關係樹 / 漢藏語系譜系樹 / 漢藏語系語言分類
漢藏語系關係樹(簡樹)
適用:愛好者、科普
Sino-Tibetan languages family tree / Trans-Himalayan languages family tree / Sino-Tibetan classification / 漢藏語系關係樹 / 漢藏語系譜系樹 / 漢藏語系語言分類
漢藏語系關係樹(全樹)
適用:探索者、研究
Sino-Tibetan languages family tree / Trans-Himalayan languages family tree / Sino-Tibetan classification / 漢藏語系關係樹 / 漢藏語系譜系樹 / 漢藏語系語言分類
附:漢藏語系語支關係熱圖
適用:分析語支關係
一、材料
  有1036筆材料參與建樹:
  ① STEDT:449筆,地位如神!太重要了!
  ② 中國語保工程:207筆,近10年中國新调查材料。
  ③ Stevey7788維基詞典:134筆,補充譜系位置重要的藏南、尼泊爾、喜馬拉雅小眾語。
  ④ 长野泰彥團隊「rGyalrongic Languages Database」數據庫:83筆,嘉絨語為主,全部原創。
  ⑤ 李大勤團隊瀕危語(最新公開出版材料):12筆,譜系地位重要的南西藏語言,境外罕見的詳細詞彙記錄。
  ⑥ 內藤丘/游涵/龔勛緬語組數據集:38筆,高質量。
  ⑦ 修至誠STBP:17筆,修至誠網站分享的數據,包含茉魯、烏貢等稀缺材料。
  ⑧ 其他來源(出版物、錄入、友贈送等):96筆。

二、方法
  ① 樹形的確定:語音年輪法(常用詞的語音有序性越好則語言越親)。它貼近歷史語言學重視語音對應的本懷,直面語言核心元素:音位。2025年夏天,我花時間思考和解決詞數、音系結構的影響,現在基本滿意,各種材料可公平對比了。該方法不識別同源詞,也不考量音標的音值,用技術投入換工作量。 方法詳情>> 對比詞詳情>>
  ② 樹齡的確定:採用歷史事件定位。詳情>>
  ③ 安全的逐層聚類:由①形成熱圖(即關係表、可在首頁查詢),聚類程序尋找明顯相似的親緣區塊,區塊之間用集體均值聚類(≠平均連接法)。優點:(1)避免異常數據破壞樹形,加減材料對結果影響小,更安全;(2)解決「數據越多錯誤越大」老問題,由於採用集體均值,材料越多越可靠,有利於大量材料建樹。採用古音小鏡原生程序。詳情>>
  ④ 必要的人工參與:由③加入噪聲產生多種樹形,用虛線合併不確定處,消除激進成分。先做出56個語支內部樹,語支之間亦用成員均值聚類,形成語支樹,最後合併成1036筆材料的大樹。熱圖和關係樹並現,問題較直觀,便於討論。
  ⑤ 特點:(1)獨立方法,和學界常用方法(詞彙貝葉斯、音變衍徵、形態創新)形成互補,從另一個視角觀察漢藏語系,增加新知識;(2)不預設起源論(北方黃河、西南、印度東北…),避免先有結論再找證據,遠離服務型學術,保持自由探索。
簡要比較對「譜系信號」的反映對「借用信號」的屏蔽抗「地理假陽性」人力要求技術要求
詞彙貝葉斯
(學界常用)
取決於人工識別借詞的工作量和專業程度
詞彙易地理傳染、拉攏近地語言譜系

需識別同源詞
中等
成熟技術的應用
語音有序性
(古音小鏡用)
方法自身削弱借詞信號
(同源詞的語音對應性優於借詞,同源詞產生的有序信號高、借詞產生的有序信號低)
注意是只是削弱、屏蔽做不到、大量借用的影響仍然明顯(如白語/昌都/蔡龍)

能較好還原近地譜系、分離川西語言、分離Arunachal語言
中等
不識別同源詞

新技術的探索開發
一種效果中上、能處理大量材料、對借詞有削弱能力的語言分類法
三、語支、語族切分標準
  56語支:以300穩定義項下語音有序性9.7%切分(推測對應4000年分離時間),得到56語支。
  16語族:以105穩定義項下語音有序性7%切分(推測對應6500年分離時間),得到16語族。

四、增補四條原則
  關係樹依據「材料+方法」產生的數值,此外增補四條原則,參與處理樹形:
  原則一:藏文化圈和藏語有數值關係的語言不視為藏語的親戚,除非有過硬證據。(最小Bodish原則)
  原則二:漢文化圈和漢語有數值關係的語言不視為漢語的親戚,除非有過硬證據。(白、蔡龍不歸漢原則)
  原則三:Arunachal和塔尼語有數值關係的語言不視為塔尼語的親戚,除非有過硬證據。
  原則四:差異程度相同的語言,地理距離近的分化時間長。
  前三條用於處理強勢語言和弱勢語言的關係,它是假定的,不是實證的。
  原則四是一條常識,大家都懂,但很難量化,所以不輕易使用,使用時我必會註明。

五、討論
  誰是漢藏語系第一分支?
  為何古音小鏡樹齡更長?
  為何古音小鏡樹形和詞彙年代學的不同?
附:近期漢藏語系優秀分類12種
STEDT分類范德林落葉 2012布倫奇..樹 2013修至誠樹 2019-01
沙加爾..樹 2019-04張夢翰..樹 2019-04張函芝..樹 2020-11吳美欣..樹 2022
高天俊樹 2023高天俊網 2023向-吳樹 2024Glottolog 5.2
出處
  ① STEDT分類 分4個層級,所有1000多筆材料都給定位置,震撼級的工作量!偉大的里程碑!
  ② 范德林落葉(van Driem、2012) 我自己摸了一遍,所得結果和這些落葉非常相似(差異見此)。 這些落葉之間保持了很大差異,我認為都超過中國文明的年齡,而且它們覆蓋全部漢藏語,是一套完備分類。 這42片落葉,除了少數幾片(如Qiangic、Angami-Pochuri、Lhokpu)可商量,大部分已一錘定音,離完美只有稍加調整的小距離。 漢藏語顯然不是侗台語那樣層級分明的梯子樹,而是類似南亞語的耙形樹,各種偽層級讓人心力交瘁,最終學術主流很可能會回歸到范德林落葉。100年後,我們做的各種分類樹都會淘汰,范德林落葉可能永存。如果你是新人,趕緊擁抱它不會有大錯。
  ③ 布倫奇..樹(Roger Blench & Mark W.Post、2013) 雖有矯枉過正,成功打擊傾重語言聲望的舊分類體系,讓重要的小語言站到了前台。學術推進從造反開始!
  ④ 沙加爾..樹(2019-04) 展示了不可思議的Sal-Sinitic分支(後驗0.54),雖然是不對的,但有立場,沒有遷就觀眾。這顆樹的各種時間值我最滿意,虛線處理也很好,我繼承和擴大了這個做法。
  ⑤ 張夢翰..樹(2019-04) 顏值最佳的漢藏樹,適合打印出來掛在墻上細細欣賞。
  ⑥ 張函芝..樹(2020-11) 最誠實的一顆貝葉斯樹,明顯爭議的晚近年代值(原因來自用於校準年代的歷史事件),各種不合常理的聚合… 真貨都有瑕疵(我自己出的樹也常是這樣),它沒有遮掩,是一棵原汁原味的樹,我喜歡!
  ⑦ 修至誠樹(Andy Hsiu、2019-01) 修至誠在自己網站研究漢藏語,不愛和獵奇雜誌攀談文明傳播宏大敘事,保持自由探索。(2019年時,學界已經知道Arunachal語的譜系重要性,兩棵談語言起源的大刊物貝葉斯樹缺席,反而是未刊登的修至誠樹收入了它們,得到驚人但正確的答案。貝葉斯本來是科學家探索真相的,但在語言文明研究中,它更像一個美女的衣櫃(參數靈活、樹形豐富、取捨自便),穿什麼衣服,取決於要講什麼故事,修至誠不講故事,他得到的答案相對純粹)
  ⑧ 吳美欣..樹(2022) 提供了神秘的Arunachal語完整關係,使人們第一次知道它們的可信關係(部分外部漢藏語使用2019「沙加爾..樹」材料)。
  ⑨ 高天俊樹(2023) 中國境內藏緬語新樹。
  ⑩ 高天俊網(2023) 中國境內藏緬語網絡關係。
  ⑪ 向-吳樹(2024) 向柏霖2024年文章中用「吳美欣..樹」論文附件做的樹(外部語言使用2019「沙加爾..樹」材料)。
  ⑫ Glottolog 5.2 → Sino-Tibetan 幾乎天天使用,非常方便,沒有人能掌握這麼多語言,它做到了!它有多達19個一級分支,不以語言小而忽視地位,是大進步,多數一級分支是靠得住的(在我的數據中證實)。
   站長(2026-5-28)
古音小鏡56語支-范德林42落葉 對照表
古音小鏡56語支-7種學界分類 對照表
探索語言不是追求一個光鮮的祖先,而是正視多元的文化。
探索語言不是追求一個體面的文明,而是正視坎坷和苦難。
保持愛心!追求自由!探索真相!
www.kaom.net
 
蘇ICP備17001294號·非盈利網站·0.5MB 2.2MB 12ms·材料冒犯通知即撤
本站知識內容中由古音小鏡原創者遵循CC BY 4.0知識共享協議(可自由複製、傳播)