← 分析報表
報表
政見文本分析
以 523 份政見原文做的兩項文字分析:一是政見裡有多少「事後可以查核」的具體事項,二是不同候選人之間是否出現逐字雷同的政見。
兩項指標皆由本站程式計算;資料來源為中選會選舉公報政見原文。
可查證性
量測「有沒有寫下可被檢驗的事項」,不是評價政見好壞
指標把政見裡的具體訊號(數字、金額、期限、單位量詞、比率、具名設施、地名) 與套語(推動、爭取、持續、加強⋯)各自算成密度後相比。 「三年內新增 500 個公托名額」投票後可以回頭查核,「持續推動托育」不行——這是兩者的差別。
各層級平均
- 縣市長44n=69
- 議員20n=126
- 鄉鎮市長23n=38
- 鄉鎮市民代表9n=65
- 村里長16n=225
層級越高、政見越具體,與「縣市長的政見多由團隊撰寫」的預期一致。
各類具體訊號的出現率
- 具名設施39%
- 地名22%
- 數量17%
- 金額2%
- 單位量詞2%
- 期限1%
- 比率1%
把總分拆開,才知道分數是怎麼來的——例如「期限」出現率偏低,代表少有政見寫明何時完成。
各縣市平均
只列有 5 份以上政見的縣市,否則樣本太小失去意義。
苗栗縣70n=5
基隆市61n=5
彰化縣49n=7
金門縣38n=6
臺南市35n=5
桃園市33n=17
嘉義縣28n=6
臺北市19n=267
新竹市19n=6
臺東縣13n=119
高雄市11n=46
雲林縣6n=12
雷同政見
字元 3-gram 的 Jaccard 相似度,抓的是逐字重複
相似度高不必然代表抄襲:同一地區的候選人本來就會談同一批在地議題,用語也相近。 這份清單的用途是指出值得對照原文閱讀的組合,判斷請點進兩人的政見自行比較。
方法與限制
- 樣本只有 523 份。全站 19,747 位候選人中,只有這些人的政見原文被收錄(公報 OCR 的範圍決策), 因此各項平均只代表這批樣本,不能外推到全體候選人。
- 文字經過辨識與整理。政見原文是掃描件辨識後再結構化的結果,若整理過程壓縮了細節,可查證性會被低估。 指標量的是「本站收錄到的文字」,不完全等於候選人印在公報上的原件。
- 這不是政見品質評分。寫得具體不代表做得到,寫得抽象也可能是理念型政見。指標只回答一個問題: 這段文字有沒有留下可以事後查核的把柄。
- 不提供個人排行。本站不評論特定候選人,因此只呈現分層彙總;要看單一候選人的政見,請到該候選人頁面讀原文。