# 釋字及憲法法庭資料庫 總覽 盤點日期 2026-07-30。本文是全庫的地圖:有什麼、放在哪、哪些能引用、哪些還沒生出來。 --- ## 一、四層結構 資料庫實際上是四層疊起來的,越往下越遠離原文,引用的謹慎程度要遞增。 | 層 | 內容 | 資料夾 | 可引用性 | |---|---|---|---| | L1 原文層 | 官網原始 HTML 快照、意見書 PDF 原檔 | `90_原始存檔/` | 原始證據 | | L2 結構層 | 逐字解析後的 Markdown 筆記與機器可讀 JSON | `10_釋字/` `20_憲判/` `30_法條/` `_pipeline/資料庫.json` | 原文區塊可直接引用 | | L3 詮釋層 | AI 白話解說、大法官姓名推導、意見書類型 | 嵌在 L2 之內,以獨立區塊標示 | **不得引用** | | L4 分析層 | 案件歷程串接、釋憲結果編碼、合議庭穩定度 | `40_案件歷程/` | 研究產出,須附口徑 | --- ## 二、L1 原文層 - `90_原始存檔/*.html` 870 份,官網 `#Print_area` 節點的原樣快照,含來源網址與抓取時間戳 - `90_原始存檔/意見書PDF/` 1,680 篇官網 PDF 原檔 這一層是所有東西的根。任何下游數字有疑義,都回這裡核。 --- ## 三、L2 結構層 | 項目 | 數量 | 位置 | |---|---|---| | 釋字筆記 | 813(第1–813號無缺號) | `10_釋字/釋字第0001號.md …` | | 憲判筆記 | 57(111年第1號–115年第5號) | `20_憲判/` | | 法條反向索引 | 4,238 節點 | `30_法條/` | | 機器可讀全庫 | 870 筆 | `_pipeline/資料庫.json` | 每則筆記的原文區塊:解釋爭點/案由、解釋文/主文、理由書/理由、意見書全文、相關法條。 段號沿用官網編號未重編。全形空白縮排原樣保留。 **索引與速查**(`00_索引/`):總索引、爭點速查(一則一行)、年表、資料庫規格、網站設計說明、校驗報告。 --- ## 四、L3 詮釋層 三種 AI 或推導產物,全部嵌在 L2 筆記與網頁中,但視覺上與原文分離: 1. **各則白話解說** 870 則,四欄(一句話結論/爭點拆解/結論與理由/體系定位) 2. **各篇意見書白話解說** 1,679 篇,五欄(立場/核心主張/與多數意見的差異/論證結構/段落指引), 全文精讀產生,非首尾摘要 3. **大法官姓名與意見書類型** 由標題文字推導,59 人名冊;釋字1–79 另有出席名單 網頁上是黃底加警語區塊,Markdown 裡是 `> [!warning]` 框。 --- ## 五、L4 分析層(`40_案件歷程/`) | 檔案 | 內容 | 筆數 | |---|---|---| | `確定終局裁判.csv` | 釋憲案 → 裁判字號,含未取得者與原因 | 308 筆裁判,102 件釋憲案可取得 | | `案件歷程.csv` | 審級樹(確定終局裁判/前審/再前審,含 `上層案號`) | 430 列;102 件釋憲案,其中 70 件至少串到一層 | | `來源明細.json` | 每件裁判在 DisposedCase 的原始整列、當事人組成、全部前審指標 | 277 件 | | `法官參與.csv` | 各審級承審法官 | 455 位法官、277 件裁判、713 組共事關係 | | `法官統計.csv`/`合議庭共事.csv` | 由 `研究儀表板.py` 產生 | 同上 | | `辯護型態變化.csv` | 各條根→葉路徑之辯護型態轉換 | 119 條路徑,48 條有變更 | | `釋憲結果.csv` | R1–R8 合憲性結論編碼,逐筆附證據句 | 232 則已編碼 | | `合議庭穩定度_逐案.csv` | 三項穩定度指標 | 812,048 列 | | `穩定度診斷.csv`/`穩定度分層檢定.csv` | 偏誤診斷與 van Elteren 分層 | — | **碼表**在 `00_索引/碼表_釋憲結果.md`,八碼加五條衝突規則。編碼的 70 件串接案,證據句 100% 可在主文中逐字還原。 **分析結論**(`00_索引/穩定度分析報告.md`):合議庭穩定度與釋憲結果無關聯(r=0.003), 與是否被聲請釋憲亦無關聯(分層後三項指標 p 皆不顯著)。 --- ## 六、呈現介面 | 檔案 | 大小 | 內容 | |---|---|---| | `釋字及憲法法庭資料庫.html` | 70.6 MB | 完整版,意見書全文可全文檢索 | | `釋字及憲法法庭資料庫_輕量版.html` | 18.4 MB | 意見書僅列標題與連結,載入快 | | `研究儀表板.html` | 2.9 MB | L4 分析層,四個分頁 | 主資料庫(L1–L3)功能:全文檢索與分欄檢索、進階篩選(含排除條件)、篩選條件列、 顯示區塊標籤、跳至列、意見書折疊與單則內比較、多案比較表、複製引用、複製為 Markdown 表格。 研究儀表板(L4)四個分頁: | 分頁 | 內容 | 互動 | |---|---|---| | 案件歷程追蹤 | 各釋憲案的審級樹與辯護型態變化 | 搜尋、逐鏈展開、點來源檔看原始欄位、點法官姓名跳到網絡分頁、案名連官網原文 | | 法官橫向網絡 | 455 位法官的合議庭共事力導向圖 | 縮放平移、依法院層級與共事次數篩選、點節點看細節 | | 穩定度分析報告 | 報告全文與四張原始輸出表 | — | | 釋憲結果編碼 | 232 則 R1–R8 編碼與逐字證據句 | 依碼別篩選、搜尋、附碼表 | 兩邊互相連結:儀表板的每個釋憲案號都可開回主資料庫原文,主資料庫則是原文的唯一權威來源。 建置順序:`串接案件歷程.py`(掃 DisposedCase,最久)→ `研究儀表板.py` → `接上儀表板.py`。 `研究儀表板.py` 會順便補寫 `法官統計.csv` 與 `合議庭共事.csv`; `接上儀表板.py` 重寫兩個主網頁,在記憶體內重做白話解說合併並帶兩道防縮水閘。 --- ## 七、目前的缺口 1. **釋憲結果編碼只做了 232 則**(釋字1–58、697–813 及全部憲判),釋字59–696 未編。 2. 釋字1–58 那批的證據句有 39 筆未做子字串驗證,需重跑該批。 3. 1 篇意見書(112年憲判字第1號黃昭元部分不同意見書)因檔名過長無文字。 4. `穩定度診斷.csv` 的 `加權層內位移` 欄採分層大小加權,與 van Elteren 的 1/(N+1) 權重不一致, 兩者符號相反,**該欄不可引用**,待改寫權重。 5. 案件歷程只涵蓋 DisposedCase 多年期資料集的年度範圍(103–114), 解析出的 308 筆裁判中有 105 筆早於 103 年,故「未命中」不等於沒有前審。 又:一則釋憲案常合併多位聲請人,因此「審級鏈」是複數的 (釋字第755號有 5 條各自獨立的單審級鏈,113年憲判字第3號有 21 條), 不可把同一案的裁判筆數誤讀為審級數。 鏈本身也可能分叉(13 個節點同時指向兩個前審),因此是樹不是線。 6. **司法院終結案件資料不含當事人姓名**,也沒有跨案的個人識別碼, 無法列出被告姓名,無法以個人為單位追蹤前案。一條鏈=一件裁判,不等於一位被告。 7. 未收聲請書、憲裁字、不受理決議。