全庫地圖:四層結構、有什麼、放在哪、哪些能引用、哪些還沒生出來。
欄位定義與檔案格式規格。
資料從哪裡來、每個欄位怎麼產生、網頁介面各元件怎麼用。
870 件一則一行的完整索引。
逐則解釋爭點與案由速查表。
依公布日期排列的編年表。
五層結構化標註的編碼手冊(A 程序/B 實體/C 引用/D 相關文件/E 人物)。
釋憲結果 R 碼的編碼規則。
聲請人身分歸屬的編碼規則。
建庫完整性驗證:筆序、字號、數量三方比對。
合議庭穩定度的分析產出與口徑。
案件歷程串接的方法與涵蓋率。
各階段建置進度紀錄。
下表是本站提供的原始資料。可引用性分層請先讀〈資料庫總覽〉: L2 結構層的原文區塊可直接引用,L3 詮釋層(AI 白話解說)任何情況下都不得引用, L4 分析層是研究產出、引用須附口徑。
| 資料 | 路徑 | 格式 | 大小 | 說明 |
|---|---|---|---|---|
| 官網原文存檔 | 90_原始存檔/ | HTML/PDF | 657.9 MB | L1 原始證據:870 份官網 #Print_area 快照與 1,680 篇意見書 PDF 原檔。下游數字有疑義一律回這裡核 |
| 釋字筆記 813 則 | 10_釋字/ | Markdown | 60.6 MB | L2 逐字解析的結構化筆記,段號沿用官網編號 |
| 憲判筆記 57 則 | 20_憲判/ | Markdown | 7.5 MB | 同上,111年第1號–115年第5號 |
| 法條反向索引 | 30_法條/ | Markdown | 1.5 MB | 4,279 個節點檔,其中 508 個是釋字節點=現成的解釋互引網絡 |
| 機器可讀全庫 | _pipeline/資料庫.json | JSON | 67.2 MB | 870 筆完整記錄,做量化統計用這個 |
| 五層標註成果 | annotation/data/成果/ | JSON | 17.2 MB | 870 個檔,A–E 五層含逐字證據句 |
| 標註用全文卡片 | annotation/data/卡片/ | 文字檔 | 13.0 MB | 870 張,證據句的比對基準 |
| 標註併檔長表 | annotation/data/併檔/ | CSV | 1.0 MB | 案件層、逐系爭規定結論、引用網絡邊表等 6 張表 |
| 案件歷程與釋憲結果 | 40_案件歷程/ | CSV/JSON | 11.2 MB | L4 分析層產出,引用須附口徑 |
| 合議庭穩定度逐案 | 40_案件歷程/合議庭穩定度_逐案.csv.gz | CSV (gzip) | 8.2 MB | 812,048 列;原檔 128 MB,超過 GitHub 單檔上限故壓縮 |
| 聲請人歸屬標註 | 50_聲請人標註/ | CSV/JSON | 1.1 MB | 含 QC 報告與抽樣流程 |
| 索引與速查 | 00_索引/ | Markdown | 361 KB | 總索引、爭點速查、年表、碼表、校驗報告 |
| 建置與分析腳本 | _pipeline/ | Python | 232 KB | 重跑整條管線用;已抓過的不會重抓 |
越往下越遠離原文,引用的謹慎程度要遞增。
| 層 | 內容 | 位置 | 可引用性 |
|---|---|---|---|
| L1 原文層 | 官網 HTML 快照、意見書 PDF 原檔 | 90_原始存檔/ | 原始證據 |
| L2 結構層 | 逐字解析的 Markdown 與機器可讀 JSON | 10_釋字/ 20_憲判/ 30_法條/ _pipeline/資料庫.json |
原文區塊可直接引用 |
| L3 詮釋層 | AI 白話解說、姓名推導、意見書類型 | 嵌在 L2 內並以獨立區塊標示 | 不得引用 |
| L4 分析層 | 案件歷程串接、釋憲結果編碼、合議庭穩定度 | 40_案件歷程/ | 研究產出,須附口徑 |
網頁上黃底、左側橘色粗邊、開頭有警語的區塊一律是 L3,看到就不要引。
18 篇意見書是 PDF 無文字層改以 OCR 擷取的,段末有標明;
引用前請以 90_原始存檔/意見書PDF/ 的原檔核對用字。