データパイプライン
正確性とトレーサビリティを確保するため、厳密なデータパイプラインに従っています:
- ソース取得 — 総務省と e-Stat から公式 PDF 文書および構造化データファイルをダウンロード。サードパーティデータソースは使用しません。
- 抽出 — ビルドスクリプトが公式 PDF と JSON ファイルを解析し、JSIC の完全な階層(20大分類、73中分類、281小分類、786細分類)を抽出。
- 検証 — 抽出されたすべてのコードは公式構造に対して検証。親子関係を確認し、欠落や孤立したコードはフラグ付け。
- エンリッチメント — 公式注釈(概要、例示、除外、注記)を各コードにリンク。ISIC、NACE、NAICS への対応表を適用。
- 生成 — ビルドスクリプトがすべてのコード、セクション、分類レベルの静的 HTML ページを生成。各ページには出典参照と階層ナビゲーションを含む。