# 建置進度 最後更新:2026-07-27 狀態:**已完成** ## 成品 | 項目 | 數量 | |---|---| | 大法官解釋 | 813 則(第1–813號,無缺號) | | 憲法法庭判決 | 57 則(111年憲判字第1號 至 115年憲判字第5號) | | 意見書全文 | 1,680 篇(1,679 篇有文字,1 篇僅存連結) | | 法條反向索引節點 | 4,238 個 | | 白話解說 | 870 則(AI 生成,獨立區塊並附警語) | | 官網原始 HTML 快照 | 870 份 | | 意見書原始 PDF | 1,680 個 | - `釋字及憲法法庭資料庫.html`  完整版,含意見書全文,約 68 MB - `釋字及憲法法庭資料庫_輕量版.html` 意見書僅列連結,約 16 MB,日常查用建議用這個 兩個網頁版都是單一檔案、完全離線,雙擊即開,內建全文檢索、類型與年代篩選、 命中標黃、複製引用鍵。 ## 資料來源與驗證 唯一來源為司法院憲法法庭網站 `cons.judicial.gov.tw`,每則保留官網網址與 ISO 8601 抓取時間戳。 已通過的驗證: 1. 釋字第1至813號齊全,無缺號、無重號 2. 逐頁比對官網頁面自身標示之「第N筆/共813筆」與頁內「解釋字號」,813 筆全數相符 3. 每則內文區塊與公布日期非空 4. 意見書 PDF 抓取零失敗 5. 白話解說 870 則全數具備四欄位,且全數附「不得引用本區塊」警語 **釋字第813號不適用 `id = 310181 + 號次` 的規則**,實際 id 為 325335, 由釋字第812號頁面的「下一筆」連結取得。此為建置過程實測發現,已寫入腳本。 ## 使用注意 - 原文區塊(解釋爭點/解釋文/理由書/主文/理由/意見書)為逐字照錄,可直接引用。 - `## 白話解說(AI 生成,非官方原文)` 區塊由 AI 依原文撰寫,**不得引用**。 - 18 篇意見書之原始 PDF 無文字層,內容以繁體中文 OCR 擷取,段末已標明, 引用前請以官網 PDF 核對用字。 - `30_法條/` 與 `90_原始存檔/意見書PDF/` 檔案數以千計, 透過裝置橋接列目錄會出現 I/O error,請直接指定完整檔名存取。 ## 尚未納入 - **聲請書/確定終局裁判**:官網有提供,多為掃描 OCR 檔,體積大,目前未收。 - **憲法法庭裁定(憲裁字)**:本次僅收判決(憲判字)。 - **112年憲判字第1號黃昭元大法官部分不同意見書**:官網標題過長, 檔名達 218 字,超出部分檔案系統上限,該篇僅存官網連結。 ## 增補方式 官網有新判決時,重跑一次即可,已抓過的不會重抓: ``` python _pipeline\建置資料庫.py python _pipeline\補完.py ``` 新判決需先把其 id 加入 `建置資料庫.py` 的 `JUD_IDS`。