釋字及憲法法庭資料庫
← 文件與資料

釋字及憲法法庭資料庫 總覽

盤點日期 2026-07-30。本文是全庫的地圖:有什麼、放在哪、哪些能引用、哪些還沒生出來。


一、四層結構

資料庫實際上是四層疊起來的,越往下越遠離原文,引用的謹慎程度要遞增。

內容 資料夾 可引用性
L1 原文層 官網原始 HTML 快照、意見書 PDF 原檔 90_原始存檔/ 原始證據
L2 結構層 逐字解析後的 Markdown 筆記與機器可讀 JSON 10_釋字/ 20_憲判/ 30_法條/ _pipeline/資料庫.json 原文區塊可直接引用
L3 詮釋層 AI 白話解說、大法官姓名推導、意見書類型 嵌在 L2 之內,以獨立區塊標示 不得引用
L4 分析層 案件歷程串接、釋憲結果編碼、合議庭穩定度 40_案件歷程/ 研究產出,須附口徑

二、L1 原文層

這一層是所有東西的根。任何下游數字有疑義,都回這裡核。


三、L2 結構層

項目 數量 位置
釋字筆記 813(第1–813號無缺號) 10_釋字/釋字第0001號.md …
憲判筆記 57(111年第1號–115年第5號) 20_憲判/
法條反向索引 4,238 節點 30_法條/
機器可讀全庫 870 筆 _pipeline/資料庫.json

每則筆記的原文區塊:解釋爭點/案由、解釋文/主文、理由書/理由、意見書全文、相關法條。 段號沿用官網編號未重編。全形空白縮排原樣保留。

索引與速查00_索引/):總索引、爭點速查(一則一行)、年表、資料庫規格、網站設計說明、校驗報告。


四、L3 詮釋層

三種 AI 或推導產物,全部嵌在 L2 筆記與網頁中,但視覺上與原文分離:

  1. 各則白話解說 870 則,四欄(一句話結論/爭點拆解/結論與理由/體系定位)
  2. 各篇意見書白話解說 1,679 篇,五欄(立場/核心主張/與多數意見的差異/論證結構/段落指引), 全文精讀產生,非首尾摘要
  3. 大法官姓名與意見書類型 由標題文字推導,59 人名冊;釋字1–79 另有出席名單

網頁上是黃底加警語區塊,Markdown 裡是 > [!warning] 框。


五、L4 分析層(40_案件歷程/

檔案 內容 筆數
確定終局裁判.csv 釋憲案 → 裁判字號,含未取得者與原因 308 筆裁判,102 件釋憲案可取得
案件歷程.csv 審級樹(確定終局裁判/前審/再前審,含 上層案號 430 列;102 件釋憲案,其中 70 件至少串到一層
來源明細.json 每件裁判在 DisposedCase 的原始整列、當事人組成、全部前審指標 277 件
法官參與.csv 各審級承審法官 455 位法官、277 件裁判、713 組共事關係
法官統計.csv合議庭共事.csv 研究儀表板.py 產生 同上
辯護型態變化.csv 各條根→葉路徑之辯護型態轉換 119 條路徑,48 條有變更
釋憲結果.csv R1–R8 合憲性結論編碼,逐筆附證據句 232 則已編碼
合議庭穩定度_逐案.csv 三項穩定度指標 812,048 列
穩定度診斷.csv穩定度分層檢定.csv 偏誤診斷與 van Elteren 分層

碼表00_索引/碼表_釋憲結果.md,八碼加五條衝突規則。編碼的 70 件串接案,證據句 100% 可在主文中逐字還原。

分析結論00_索引/穩定度分析報告.md):合議庭穩定度與釋憲結果無關聯(r=0.003), 與是否被聲請釋憲亦無關聯(分層後三項指標 p 皆不顯著)。


六、呈現介面

檔案 大小 內容
釋字及憲法法庭資料庫.html 70.6 MB 完整版,意見書全文可全文檢索
釋字及憲法法庭資料庫_輕量版.html 18.4 MB 意見書僅列標題與連結,載入快
研究儀表板.html 2.9 MB L4 分析層,四個分頁

主資料庫(L1–L3)功能:全文檢索與分欄檢索、進階篩選(含排除條件)、篩選條件列、 顯示區塊標籤、跳至列、意見書折疊與單則內比較、多案比較表、複製引用、複製為 Markdown 表格。

研究儀表板(L4)四個分頁:

分頁 內容 互動
案件歷程追蹤 各釋憲案的審級樹與辯護型態變化 搜尋、逐鏈展開、點來源檔看原始欄位、點法官姓名跳到網絡分頁、案名連官網原文
法官橫向網絡 455 位法官的合議庭共事力導向圖 縮放平移、依法院層級與共事次數篩選、點節點看細節
穩定度分析報告 報告全文與四張原始輸出表
釋憲結果編碼 232 則 R1–R8 編碼與逐字證據句 依碼別篩選、搜尋、附碼表

兩邊互相連結:儀表板的每個釋憲案號都可開回主資料庫原文,主資料庫則是原文的唯一權威來源。 建置順序:串接案件歷程.py(掃 DisposedCase,最久)→ 研究儀表板.py接上儀表板.py研究儀表板.py 會順便補寫 法官統計.csv合議庭共事.csv接上儀表板.py 重寫兩個主網頁,在記憶體內重做白話解說合併並帶兩道防縮水閘。


七、目前的缺口

  1. 釋憲結果編碼只做了 232 則(釋字1–58、697–813 及全部憲判),釋字59–696 未編。
  2. 釋字1–58 那批的證據句有 39 筆未做子字串驗證,需重跑該批。
  3. 1 篇意見書(112年憲判字第1號黃昭元部分不同意見書)因檔名過長無文字。
  4. 穩定度診斷.csv加權層內位移 欄採分層大小加權,與 van Elteren 的 1/(N+1) 權重不一致, 兩者符號相反,該欄不可引用,待改寫權重。
  5. 案件歷程只涵蓋 DisposedCase 多年期資料集的年度範圍(103–114), 解析出的 308 筆裁判中有 105 筆早於 103 年,故「未命中」不等於沒有前審。 又:一則釋憲案常合併多位聲請人,因此「審級鏈」是複數的 (釋字第755號有 5 條各自獨立的單審級鏈,113年憲判字第3號有 21 條), 不可把同一案的裁判筆數誤讀為審級數。 鏈本身也可能分叉(13 個節點同時指向兩個前審),因此是樹不是線。
  6. 司法院終結案件資料不含當事人姓名,也沒有跨案的個人識別碼, 無法列出被告姓名,無法以個人為單位追蹤前案。一條鏈=一件裁判,不等於一位被告。
  7. 未收聲請書、憲裁字、不受理決議。