釋字及憲法法庭資料庫
← 回主資料庫

文件與資料

左欄是說明文件(由 00_索引/ 的 Markdown 產生),下方是可直接下載的資料檔。 所有檔案在本站以原始資料夾名稱存放,因此文件內寫的路徑(例如 10_釋字/釋字第0001號.md) 在本站同樣成立。

說明文件

資料庫總覽

全庫地圖:四層結構、有什麼、放在哪、哪些能引用、哪些還沒生出來。

資料庫規格

欄位定義與檔案格式規格。

網站設計說明

資料從哪裡來、每個欄位怎麼產生、網頁介面各元件怎麼用。

總索引

870 件一則一行的完整索引。

爭點速查

逐則解釋爭點與案由速查表。

年表

依公布日期排列的編年表。

碼表_全文抽取

五層結構化標註的編碼手冊(A 程序/B 實體/C 引用/D 相關文件/E 人物)。

碼表_釋憲結果

釋憲結果 R 碼的編碼規則。

碼表_聲請人歸屬

聲請人身分歸屬的編碼規則。

校驗報告

建庫完整性驗證:筆序、字號、數量三方比對。

穩定度分析報告

合議庭穩定度的分析產出與口徑。

串接報告

案件歷程串接的方法與涵蓋率。

建置進度

各階段建置進度紀錄。

資料檔下載

下表是本站提供的原始資料。可引用性分層請先讀〈資料庫總覽〉: L2 結構層的原文區塊可直接引用,L3 詮釋層(AI 白話解說)任何情況下都不得引用, L4 分析層是研究產出、引用須附口徑。

資料路徑格式大小說明
官網原文存檔90_原始存檔/HTML/PDF657.9 MBL1 原始證據:870 份官網 #Print_area 快照與 1,680 篇意見書 PDF 原檔。下游數字有疑義一律回這裡核
釋字筆記 813 則10_釋字/Markdown60.6 MBL2 逐字解析的結構化筆記,段號沿用官網編號
憲判筆記 57 則20_憲判/Markdown7.5 MB同上,111年第1號–115年第5號
法條反向索引30_法條/Markdown1.5 MB4,279 個節點檔,其中 508 個是釋字節點=現成的解釋互引網絡
機器可讀全庫_pipeline/資料庫.jsonJSON67.2 MB870 筆完整記錄,做量化統計用這個
五層標註成果annotation/data/成果/JSON17.2 MB870 個檔,A–E 五層含逐字證據句
標註用全文卡片annotation/data/卡片/文字檔13.0 MB870 張,證據句的比對基準
標註併檔長表annotation/data/併檔/CSV1.0 MB案件層、逐系爭規定結論、引用網絡邊表等 6 張表
案件歷程與釋憲結果40_案件歷程/CSV/JSON11.2 MBL4 分析層產出,引用須附口徑
合議庭穩定度逐案40_案件歷程/合議庭穩定度_逐案.csv.gzCSV (gzip)8.2 MB812,048 列;原檔 128 MB,超過 GitHub 單檔上限故壓縮
聲請人歸屬標註50_聲請人標註/CSV/JSON1.1 MB含 QC 報告與抽樣流程
索引與速查00_索引/Markdown361 KB總索引、爭點速查、年表、碼表、校驗報告
建置與分析腳本_pipeline/Python232 KB重跑整條管線用;已抓過的不會重抓

四層之中,哪一層可以引用

越往下越遠離原文,引用的謹慎程度要遞增。

內容位置可引用性
L1 原文層官網 HTML 快照、意見書 PDF 原檔 90_原始存檔/原始證據
L2 結構層逐字解析的 Markdown 與機器可讀 JSON 10_釋字/ 20_憲判/ 30_法條/ _pipeline/資料庫.json 原文區塊可直接引用
L3 詮釋層AI 白話解說、姓名推導、意見書類型 嵌在 L2 內並以獨立區塊標示不得引用
L4 分析層案件歷程串接、釋憲結果編碼、合議庭穩定度 40_案件歷程/研究產出,須附口徑

網頁上黃底、左側橘色粗邊、開頭有警語的區塊一律是 L3,看到就不要引。 18 篇意見書是 PDF 無文字層改以 OCR 擷取的,段末有標明; 引用前請以 90_原始存檔/意見書PDF/ 的原檔核對用字。

未收錄