我要做一個查登山口的功能,需要官方的登山口座標。
政府資料開放平臺上應該有。但它的搜尋要你先想到正確的關鍵字——「登山口」查不到的時候,你不知道是真的沒有,還是它叫「步道服務據點」。
一頁一頁翻不是辦法。
一個網址,整份目錄 ────────────────────────────────── /datasets/export/csv 免金鑰、免註冊 53,191 筆資料集 22 個欄位(含下載網址、格式、更新頻率) 69 MB ──────────────────────────────────
整份拿下來,用文字搜尋
2026-09-17 實測,那個網址直接回 200,沒有任何授權標頭,檔案 69 MB。
打開來是一張 53,191 列的表,22 個欄位——資料集識別碼、名稱、服務分類、檔案格式、資料下載網址、編碼格式都在裡面。
拿到之後你要找的東西就變成一次文字搜尋的事。不用猜關鍵字,因為整份名單都在你手上。 我要的登山口資料,是這樣掃出來的。
掃出來才看得到的分布
整份數過一次,分類是嚴重不平均的:
公共資訊 30,657 佔了將近六成 生活安全及品質 4,703 購屋及遷徙 4,036 交通及通訊 3,572 投資理財 1,671
格式方面,純 CSV 有 23,355 筆,是最大宗;其餘多是 CSV 跟 JSON、XML 混合提供。
這件事的用處在於期待管理。 如果你要的東西落在「公共資訊」那一大坨裡,多半找得到;落在冷門分類的,先看看總量有多少再決定要不要投時間。
有了名單之後真正省下的是什麼
省下的不是下載時間,是確認「到底有沒有」的時間。
以前的流程是:想一個關鍵字、搜尋、沒有、換一個關鍵字、再搜尋。你永遠不知道該停在哪裡,因為查無結果有兩種可能——真的沒有,或是你沒想到它的正式名稱。
拿到整份名單之後,這件事變成確定的:搜過一輪沒有,就是真的沒有,可以放心去找別的來源。能夠明確結案,比多找到一份資料更有價值。
同一份名單還能回答另一個問題:這份資料多久更新一次。欄位裡有更新頻率,先看清楚是每日、每月還是「不定期」,再決定要不要把它接成即時功能——接了一份一年更新一次的資料當即時資訊,比不接更糟。
你一定會踩的那個細節
回應的 Content-Type 標的是 text/html,但內容其實是 CSV。
如果你的程式照 Content-Type 判斷要走哪個解析器,它會把一份 CSV 丟給 HTML 解析器。 不會報錯,只會解出一堆空的。用副檔名或直接看第一行,不要相信那個標頭。
另外一個要有心理準備的:「開放資料」不等於「驗過的資料」。官方欄位本身就會有錯或留空,拿到之後該做的品質檢查一項都不能省。
下載完先做這三件事: 1. 數列數,跟網站上寫的資料集總數對一下 2. 抽 20 筆,實際打開「資料下載網址」看還活不活 3. 你要用的那個欄位,數一下有多少是空的 第 2 項最常出事——目錄裡有紀錄, 不代表那份資料現在還下載得到。
站內延伸
來源: 政府資料開放平臺 /datasets/export/csv,2026-09-17 實測下載並逐欄統計。
找資料最花時間的往往不是下載,是「確認到底有沒有」。把整份目錄拉下來,這個問題從搜尋題變成文字比對題——而後者你自己就能做完,不用來回猜關鍵字。