資料來源與計算方式

資料來源(全站)

媒體 →

資料來源

新聞媒體每 9 分鐘、其他媒體每小時抓取一次新文章,保存標題、摘要、連結、圖片網址、標籤與署名;正文在刊登後 7 天內可於站內閱讀。收錄的媒體與抓取狀態見媒體來源。

標籤是媒體自己在文章頁標記的關鍵字(news_keywords、keywords、article:tag 等)。文章頁沒有標記時,才用其他媒體近期用過的標籤比對標題補上。

媒體摘要卡

滑鼠停留在媒體名稱上(手機點一下)會顯示媒體摘要:藍綠分類,本站過去 24 小時與 7 天收錄的篇數,以及近 24 小時熱門關鍵字。熱門關鍵字統計這家媒體文章的標籤與標題關鍵詞,排除新聞分類詞,每篇每詞計一次,最多取最新 2,000 篇;透過彙整來源收錄的不列關鍵字。

新聞總覽

頁首的新聞量分布為過去 24 小時新聞類媒體有標籤的文章數,依媒體所屬陣營加總,並非逐篇判斷立場。展開後列出各段包含的媒體,淡色表示該媒體過去 24 小時沒有文章。

焦點事件
本小時事件表的前 12 件(同一事件串只列一次),依事件表名次排列。首頁卡片的標籤優先顯示該標題用到的關鍵字;標題一個都沒用到時,改顯示事件的主要關鍵字。上榜時間、「新上榜」、↑↓ 與名次走勢的意思同事件表(見下方「事件表」)。
報導分布
藍綠分布以整個事件分群計算,並非單篇新聞的報導分布:數的是過去 24 小時寫過該事件主要關鍵字的媒體家數。只有差距明顯時才標示:「盲點」表示其中一營幾乎沒有報導,「重點」表示其中一營報導得比平常多很多;門檻見下方「事件表」的重點與盲點。
關鍵字升溫榜
新聞類關鍵字排行依爆發力的前 8 名。爆發力=分數+Σ(現在分數 − N 小時前分數)× 權重(N 為 3、6、12、24、48 小時),缺少可比較的歷史時顯示「歷史不足」。▲▼ 是依分數的名次與 24 小時前相比,「新」表示 24 小時前不在榜上,「-」為名次不變或沒有可比較的快照。小圖是最近 48 小時每小時新聞篇數的 24 小時移動平均。
記者動態
過去 48 小時署名文章最多的 6 位記者,圖示為刊登篇數最多的前三家媒體。「相近 N」是其中內文與其他媒體文章相近(相似度 65% 以上)的篇數;算法見記者頁的說明。
藍綠溫差
目前事件表前 24 件、各自過去 24 小時的報導中,哪一邊的媒體特別在寫、哪一邊幾乎沒報(以同期藍綠各自的發稿家數為基準)。每欄列出該營重點或對方盲點的事件,盲點在前,其餘依偏離基準的程度排序,最多 3 件。
同題不同標
政治事件精選:從事件表前 30 件中,挑主要標籤、標籤或標題提到政黨、立法院、行政院、總統、市長、選舉、兩岸、國防部等政治詞的事件(主要標籤提到的優先,其餘依名次),各找一則藍營與一則綠營媒體的標題並排:兩則刊登相隔 12 小時內,標題彼此相近,也與事件的代表標題相近。最多列 3 件。底線標出兩則標題用字不同的地方(逐字比對)。
新聞關係圖
取新聞關係圖過去 24 小時的比對結果。「相近」以正文片段重疊度計算,門檻 0.65;「引用」為文中明示引用其他媒體的紀錄。左欄是各媒體自己的文章中,內文與其他媒體相近的比例(至少 20 篇才列入),「多與某媒體相近」是相近連線最多的對象;右欄是明示引用中,各來源所占比例。兩欄各取前 5 家。
最近更新的議題
各媒體官方議題入口中最近更新的 6 則(最後更新的定義見議題表)。「近 3 天 N 篇相關」是本站近 3 天從各家媒體收錄、帶有這個議題全部對應標籤的報導數,最多計 500 篇,達上限時標「+」。

升溫榜與篇數的媒體範圍:這是「新聞」類別中符合收錄條件的固定名單,並非預先設定家數,也不是依媒體品質或公信力評選。

本版名單選取已啟用、非僅供探索的來源:在名單凍結前至少 72 小時已成功取得非空新聞列表,且凍結前最近 3 小時內也有成功紀錄。固定同一批媒體,讓不同時間的議題熱度能在相同範圍內比較。當天未發稿的媒體仍保留,新來源待下一版基準再納入。

篇數只計算這批媒體過去 24 小時已收錄的報導,不是全站總量;抓取失敗或補抓仍可能影響數字。

事件表與單一事件

事件表 →存檔 →

事件表

事件每半小時(每小時 04 分與 34 分)以過去 24 小時的文章重新依標籤共現分群:一個標籤出現在另一個標籤過半數的文章裡,就視為同一件事,至少兩個標籤才成一件事;每件事最多選 3 個主要標籤,報導分布與標題對照都依主要標籤計算。標題取自註明的媒體。

爆發力
一件事的爆發力取它所有標籤中最高的標籤爆發力(見關鍵字排行的指標;歷史不足的標籤改用分數),事件表依此排名。爆發力條以本小時第 1 名為滿格。
名次變動
「新上榜」表示前一小時的事件表上沒有這件事,↑↓ 為與前一小時相比的名次變化;先比對是否為同一事件串,否則看主要標籤是否大致相同(共有至少一半,或第一個主要標籤相同)。「上榜 N 小時」是這件事到這個小時為止上過事件表的小時數。
名次走勢
小圖是這件事在最近 24 個事件表小時的名次,第 1 名在最上面,沒上榜的小時留空;滑鼠停留可看逐小時名次。
時段列
事件表上方每個時段的長條高度是該小時第 1 名的爆發力,在當天最低與最高之間拉開比例(最低約四分之一格,最高滿格),讓忙碌的時段看得出來。
標題
每件事列出的報導,優先取近 24 小時帶有最多主要標籤、標籤又較集中的文章。頭條的藍綠對照取其中第一則藍營與第一則綠營報導並排,底線標出兩則標題用字不同的地方(逐字比對)。

存檔:一天的存檔列出當天任一小時上過事件表的事件,依事件期間的最高爆發力排序,爆發力條以當天第 1 名為滿格;名次是這件事在每小時事件表上的最佳名次,時間是它在事件表上的起訖,名次走勢從它第一次上榜的小時畫起。藍綠比例在過去的日子以當天(台北時間)計,今天以過去 24 小時計。

藍綠

藍綠條
每件事的藍綠條是過去 24 小時寫過該事件主要標籤的媒體家數,依綠營、其他、藍營三段排列;判斷重點與盲點時只看藍綠兩營,不含未列藍綠的媒體。
整體條
事件表上方的整體條是同一期間各陣營的文章篇數比例(「其他」只計排行用的新聞媒體);旁邊的「藍綠家數比」是同一期間有發稿的藍營與綠營媒體家數,是判斷重點的基準。
重點
藍綠合計至少 5 家媒體報導,且兩營家數比偏離基準約 1.7 倍以上(|log₂((藍家數 + 0.5) ÷ 基準藍家數 × 基準綠家數 ÷ (綠家數 + 0.5))| ≥ 0.8)時,標為「藍營重點」或「綠營重點」;滑鼠停留在標示上可看各營家數。
盲點
事件表、存檔與首頁:一營至多 1 家報導、另一營至少 4 家時,標為「盲點」,表示那一營的讀者幾乎看不到這件事。單一事件頁的標準不同:整段期間一營完全沒有報導、另一營有報導,才標盲點。
藍綠溫差
每欄列出該營重點或對方盲點的事件,盲點在前,其餘依偏離基準的程度排序,同一標題只列一次,最多 4 件。沒有任何事件達到重點或盲點時,即為「平常範圍」。

單一事件頁

事件與標籤
事件表每半小時依標籤共現分群,每件事每小時列出前 12 個標籤與分數;標籤雲合併這則事件整段期間(最近 72 個上榜小時)的標籤,字越大最高分越高,移到字上可看最高分、出現時間與出現小時數。橘色是主要標籤:這件事各小時最常被選為主要標籤的前 5 個。報導分布與標題對照都依主要標籤計算,其餘標籤只出現在標籤雲與每小時列表。「最高分」取各小時最高分與事件紀錄中的較大者。
時間變化
上圖:各主要標籤每小時的分數(與標籤頁相同,採固定媒體基準,歷史不足留白),虛線為這則事件在事件表上的名次(右軸,第 1 名在最上面,未上榜的小時留空);下圖:所有媒體帶有任一主要標籤的報導篇數。灰底為這則事件出現在事件表上的時段,前後各多顯示 12 小時。每小時列表點時間可看當時整張事件表,標籤後的數字是該小時分數。
各媒體報導量
以主要標籤在事件期間的報導計算(從第一次上榜前 6 小時到最後一次上榜後 1 小時,最多 400 篇);同一家媒體同標題只算一次。「依媒體家數」每家算一次,「依報導篇數」逐篇計;「各陣營最早報導」是各陣營最早刊登的一則。這一頁的盲點指整段期間一方陣營完全沒有報導、另一方有,比事件表的標準(一營至多 1 家、另一營至少 4 家)嚴。表格點欄名可排序,預設顯示前 5 家。
標題對照
同一件事,各家怎麼下標。依時間看事件如何展開;藍綠對照把同一小時三類媒體的標題並排;依媒體看每家的完整報導。圖片為各媒體提供的報導圖片,沒有提供者不顯示。沒有報導分布資料時,只保留事件表每小時挑出的代表標題。
相關事件
兩則事件都結束 7 小時以上後比對:較晚開始的一則若在較早一則結束隔天(台北時間)結束前出現,且主要標籤至少 3 個相同(或包含較早一則的全部主要標籤),就互列為相關事件。「含延續事件共 N 小時」是這些相關事件從最早開始到最晚結束的小時數。

藍綠以媒體為單位,不判斷單篇立場。本站基準名單的 29 家媒體依 Gene Hong 維護的流量試算表(見「媒體流量與收錄比較」的「原始流量表單」)人工標記的分類標為藍營或綠營,標「多元」「內容」的不歸藍綠;其他既有媒體沿用原設定,新加入來源未另行標記政治傾向。各媒體的分類可在媒體來源依傾向篩選。「其他」表示未列藍綠,不代表中立。

關鍵字排行與關鍵字頁

關鍵字排行 →

關鍵字排行的指標

每 10 分鐘以過去 24 小時的文章重算一次。

篇數
過去 24 小時帶有這個標籤的文章數。
媒體
過去 24 小時用過這個標籤的媒體家數。
分數
同一家媒體的第 1 篇記 1 分,第 2、3、4 篇依序記 0.5、0.25、0.125 分(避免單一媒體洗版);各媒體加總後,除以固定基準名單的媒體數,再乘以 50。名單內未發稿的媒體也保留在分母;新來源待下一版基準才納入。分數 50 大約等於「基準內每家媒體都報了一篇」。
爆發力
分數+Σ(現在分數 − N 小時前分數)× 權重;N 為 3、6、12、24、48 小時,權重依序 0.92、0.84、0.70、0.50、0.25,前後使用同一媒體基準。缺少可比較歷史或舊榜截斷而無法確認分數時顯示「—」,不當成零;持平的話題約等於分數,退燒中的話題會低於分數。排行榜與關鍵字頁上爆發力高於分數時以橘字標示。
變動
依分數的名次與 24 小時前同一基準的快照相比:▲ 為上升、▼ 為下降、= 持平。「新」表示 24 小時前的完整榜單裡沒有這個關鍵字;沒有可比較的快照、基準不同或舊榜截斷時顯示「—」。滑鼠停留在變動上可看兩個時間的名次。
一起出現
同一視窗、同一基準媒體中,和這個關鍵字最常掛在同一篇報導的其他關鍵字,依共同篇數排序取前五個,單行顯示放不下的會省略;滑鼠停留可看完整清單與共同篇數佔比。可用來判斷哪幾個關鍵字其實在講同一件事。
文字雲
排行榜上方的文字雲取目前分類分數最高的 500 個關鍵字,依版面放得下的數量顯示(電腦約四百個、手機約一百五十個),字越大分數越高;橘字為爆發力高於分數、正在升溫的關鍵字。
趨勢
小圖以每小時等距顯示最近 48 小時新聞篇數的 24 小時移動平均:當小時及前 23 小時收錄篇數加總除以 24。依「趨勢」排序時比較最新完整小時與 48 小時前的平均值(篇/小時);點關鍵字可看每小時篇數與平均線。爆發力仍依上面的加權分數計算。

關鍵字頁

排行狀態
上方的數字取自新聞媒體排行榜的最新一版:「名次」是依爆發力排列的位置,「變動」則比較依分數的名次與 24 小時前(▲ 上升、▼ 下降、「新」為 24 小時前不在榜上、「—」為沒有可比較的快照);爆發力高於分數時以橘字標示。「報導媒體」是基準媒體中過去 24 小時有報導的家數/基準家數。「一起出現」是同一批基準媒體過去 24 小時最常和這個關鍵字掛在同一篇報導的關鍵字,數字為共同篇數,最多 8 個。
首次上榜、高峰
本站每小時 53 分統計一次新聞媒體過去 24 小時的標籤:至少 3 家報導、其中至少 2 家各報 2 篇以上、且有一家報 3 篇以上的標籤列入統計(沒有達到時,改用至少 2 家各報 2 篇以上的較寬標準)。「首次上榜」是這個關鍵字第一次列入統計的小時;「高峰」是列入統計的小時中,過去 24 小時篇數最多的一小時,括號內為當時的 24 小時篇數。
每小時篇數圖
採「所有媒體」類別的固定基準媒體,期間依所選的 1、3、7 天。灰色長條是每小時篇數;「24 小時移動平均」=當小時及前 23 小時基準媒體收錄篇數總和 ÷ 24,收錄開始後沒有報導的小時以 0 計,開始前留白,只顯示完整小時。「名次」是這個關鍵字在「所有媒體」排行每小時快照中依分數的名次(右軸,第 1 名在最上面,未入榜的小時留空);「24 小時加權分數」是同一基準的分數,預設隱藏,點圖例可顯示。橫軸標示小時起點,歷史不足處留白。
報導列表
最近 48 小時(選 7 天時為 168 小時)帶有這個標籤的最新 80 篇報導,來自所有收錄媒體,不限基準名單,所以篇數可能和上方圖表不同。
媒體分布
依報導列表中的文章計算各媒體篇數,再依媒體所屬陣營加總;圓點顏色為媒體的藍綠分類。
相關事件
最近 72 小時內上過事件表、標籤含這個關鍵字的事件,最多 6 件,最近的在前;「在榜」是這件事上過事件表的小時數。

搜尋新聞

搜尋本站收錄的所有媒體文章,比對標題、摘要與標籤,最多往前 31 天:標題或摘要包含搜尋字詞,或文章有一個與搜尋字詞完全相同的標籤,就算符合;不搜尋正文。結果依刊登時間由新到舊,每頁 30 篇。

藍綠分布
分布條、篇數與媒體清單描述所選期間的全部符合文章,不只是這一頁;選了單一傾向時,分布條仍顯示全部結果,下方只列該傾向的文章。媒體清單列出篇數最多的 16 家。「偏藍」「偏綠」標記依刊登媒體的分類,不判斷單篇立場。
相關焦點事件
目前事件表前 30 件中,主要標籤、標籤或列出的標題含搜尋字詞的事件,最多 3 件。
時間後的 *
來源沒有提供發布時間,顯示的是本站首次看到這篇文章的時間。

單篇文章

單篇文章

本站只提供刊登後 7 天內的正文;之後標題、標籤與原站連結仍會保留,全文請至原站閱讀。本站呈現已擷取的文字與收錄配圖,其他圖片與影音請見原站。閱讀時間以每 500 字約 1 分鐘估計。

內文狀態
「內文較短」表示擷取到的文字不足 200 字,可能不完整;可閱讀保存內容,但不納入全文相似度比對,只有完整正文才比對。「原站僅提供摘要」表示來源提供的是節錄,本站不當成完整正文。
發現來源
「由某來源發現」標示本站經由哪個彙整來源(例如 Google 新聞)找到這篇文章,連結指向該來源上的頁面。
文中引用來源
內文明示提到的其他媒體,附上提到它的原文片段。文章提及的來源,不代表原始作者。
延伸閱讀
刊登前後 3 天內同一題的其他報導:依共同關鍵字的稀有程度與標題相近程度排序,標題幾乎相同的轉載只列一篇。至少共有 3 個關鍵字,或共有 1、2 個關鍵字且標題夠相近,才列入;其他媒體每家最多 2 篇、共 8 篇,同一媒體最多 5 篇,已列在「他站相似報導」的不重複列出。「所屬事件」是刊登前後一天內、主要標籤與本篇關鍵字重疊(至少 2 個,或重疊的關鍵字夠少見)的事件,最多 3 件。相關關鍵字後的數字為前後 3 天內使用這個關鍵字的媒體與報導數。
他站相似報導
與前後 7 天內其他媒體文章的內文比對(新聞關係圖的相似度索引,正規化內文的五字片段),列出相似度 65% 以上的文章;索引每 10 分鐘處理新抓到的正文。「內文相同」表示正規化後全文一致;相差不到一分鐘算同時刊登。

相似不等於抄襲:同一份新聞稿、通訊社稿、授權轉載與註明引用都會讓內文相近;刊登時間以各站標示為準,與寫稿先後無關。

新聞關係圖

新聞關係圖比對不同媒體文章的內文:每篇可用內文都與前後 7 天內其他媒體的全部文章比對,期間內的相似配對只計入兩篇都在期間內刊登的組合。索引每 10 分鐘處理新抓到的正文,配對永久保存;標為「內容」的聯播來源(如蕃新聞)不列入比對。

相似度
內文做 NFKC 正規化並移除標點、空白,以五字片段計算 Dice 相似度。至少 200 個字元、100 個共同片段及連續相同文字才列為候選。正規化全文相等才標為內文相同;相似度不使用標題或刊登時間。門檻可在關係圖的「進階」調整,範圍 0.5–1,預設 0.65;門檻越高,只留下內文越接近的報導。
同組與來源
內文相近的報導連成同一組(甲與乙相近、乙又與丙相近,三篇就同組),完成分組後才以最早刊登時間指定同組來源:全組最早刊登的一篇。幾篇同時最早刊登時,取本站較早收錄(文章編號較小)的一篇。來源依本期全部相似配對指定,完整分組可能包含未顯示在圖上的媒體;組內其他報導都直接連回來源,即使與來源沒有直接比對分數(經同組配對歸源)。這是依刊登時間歸源的規則,不等於查證原創或抄襲;相近內文也可能來自通訊社稿或授權轉載。
明示引用
內文明示提到其他媒體的文章,附上提到它的原文片段;被提及的來源不一定是原始作者。
箭頭與線條
箭頭依內文流向畫:橘色箭頭由同組最早刊登的媒體指向較晚刊登的媒體,紫色箭頭由被明示引用的媒體指向引用它的媒體。線條越粗代表關係文章越多。
圖示
圖示大小依本期已比對的新聞篇數調整,不是網站流量或總發稿量。各媒體的篇數涵蓋本期全部關係,不隨篩選改變;圖上連線與文章只呈現目前篩選的媒體。媒體依連線強度自動分群,分群不代表立場或所有權。
主要連線
總覽只畫每家媒體最強的兩條連線(各家所選的聯集),選定的媒體則畫出它的全部連線;「顯示全部連線」畫出篩選後的所有連線。
篩選
顯示媒體數依本期納入分析篇數取前幾家。選了媒體 tag 時,圖上另含所選分類的直接關係對象,這些對象不計入分類媒體數;tag 選單只列出目前有關係資料的 tag。藍字/綠字與「只看藍」「只看綠」沿用網站媒體資料的藍綠分類,未標註者使用一般字色。
媒體比較
從各家媒體出發,比較相近報導、引用往來與實際新聞。分析篇數為本期已完成比對的內文;同組最早、同組較晚、引用與被引用皆依各欄文章去重,涵蓋本期與所有媒體的關係,不隨圖上篩選改變;主要關係對象只列圖上媒體。同組最早是該組最早刊出的那篇,同組較晚是同組已有更早刊出的報導。主要關係對象依關係篇數列出前三項;依同組最早、同組較晚、引用他媒或被他媒引用排序時,只列該類關係的對象,滑過可看關係類型。同組最早僅依刊登時間判定,不代表原創。
新聞對照
選定一家媒體時,上方四個數字是本期與所有媒體的關係,依文章去重計數;已比對篇數也是圖示大小的依據。下方文章只列圖上媒體之間的關係,每篇標出同組來源與兩篇的相似度;來源媒體未顯示在圖上時,來源仍保持不變。

每日趨勢

每天的比對篇數、相似配對、內文相同與明示引用,依所選相似度門檻計算。相似配對算在較晚刊登那篇的日期、引用算在引用文章的刊登日(台北時間);當天數字仍會增加。「資料自」是比對篇數第一次達到期間最多那天十分之一的日子,更早只有少數媒體的零星文章。

比對篇數
期間內相似度索引已比對的文章數;只被引用、沒有收錄內文的媒體為 0。
被跟進
這家媒體先刊出,之後有其他媒體刊出相似內容的篇數。
跟進他媒
這家媒體刊出時,已有其他媒體相似文章的篇數。被跟進與跟進他媒都依文章去重;同時刊登的配對不計方向。
引用他媒
這家媒體文章內文明示引用其他媒體的次數。
被引用
其他媒體文章內文明示引用這家媒體的次數。
百分比
被跟進、跟進他媒與引用他媒旁的百分比,是佔這家媒體比對篇數的比例;各媒體表為期間合計。

擷取狀態

各媒體本期的文章數與內文狀態。可比較是取得完整內文、長度足以比對的文章;已比對是其中已由相似度索引比對的篇數;缺漏是抓取失敗或內文過短,待抓是尚未處理。可比較比例低於 80% 的媒體以橘色標示。蕃新聞的聯播內容不納入統計,標為「排除統計」,也不計入合計。

記者

記者頁從文章署名整理出人名與筆名,不含媒體、部門、通訊社、職稱與責任編輯;可看每個人在哪些媒體刊登、寫了幾篇,以及文章與其他媒體內文相近時的刊登先後。較晚刊登只是閱讀線索,不是抄襲判定。

相似不等於抄襲:同一份新聞稿、通訊社稿、授權轉載與註明引用都會讓內文相近;刊登時間以各站標示為準,與寫稿先後無關。同名不同人不會分開。

內文相近取自新聞關係圖的相似度索引:每篇有正文的文章(正規化後至少 200 字元)與前後 7 天內其他媒體的文章逐篇比對,以不重複的五字片段計算 Dice 係數,記者頁列出索引中相似度 65% 以上的全部配對。索引每 10 分鐘處理新抓到的正文;標為「內容」的轉載站不列入比對。

組
一組是此人的一篇文章與他站一篇內文相近的文章;同一篇文章可以和好幾家相近,算好幾組。
已比對
相似度索引已比對的篇數。
內文相近
至少一端是此人文章的相近配對;同一新聞稿、通訊社稿、授權轉載與引用都會相近。
對方較早
他站相近文章比此人文章早至少一分鐘刊登的配對;刊登時間以各站標示為準,不含同署名跨站。
本篇較早
此人文章比他站相近文章早至少一分鐘刊登的配對,同樣不含同署名跨站。相差不到一分鐘算同時刊登,兩欄都不計。
同署名
對方文章也署同一名字:同一人把稿件刊在不同媒體。
引用
內文明示引用其他媒體的篇數。
有正文
站內可閱讀正文的篇數(正文在刊登後 7 天內可於站內閱讀);平均字元是這些正文的平均字元數。
未納入比對
有正文但不在相似度索引裡:還在等下一輪比對(即「尚待比對」),或刊登媒體是標為「內容」的轉載站。
常寫主題
這段期間此人文章最常帶的標籤,最多 30 個,數字為篇數。

議題表與專題

議題表 →專題 →

議題表與專題

追蹤媒體官方議題或專題入口,每小時檢查。每個議題或專題下方列出本站近 3 天從各家媒體抓到的相關報導。來源持續擴充中,未列出的媒體不代表沒有議題或專題。

依最後更新排序:最後更新是議題或專題頁上最新一則報導的時間;沒有報導日期的,用本站首次發現時間(不等於媒體上架時間)。本站開始追蹤前就已上架、又沒有報導日期可查的議題或專題,更新時間不明,不列入上方清單(各媒體頁列在最後);已上架的議題或專題有新報導時照樣排到前面。

各家用詞不一(專題、專輯、策展…),本站依有沒有持續新增報導來分類,不照媒體的命名:持續新增報導的新聞串是議題(90 天沒有新報導標為已停更),一次性的新聞包是專題。

關鍵字:從議題與專題的名稱比對站內近 7 天常用的標籤,標籤須構成名稱的主要部分(「懶人包」「專題」這類包裝用語不算)。上方列出未停更議題與專題中最常見的關鍵字,依帶有這個關鍵字的媒體家數排序;點選後列出各媒體帶這個關鍵字的議題與專題(含已停更),議題表與專題頁結果相同。

點選關鍵字後依各家開始做這個關鍵字的時間排序,最早的在前,並標出比最早一家晚幾天(以台灣日期計)。開始時間取媒體議題或專題頁上所列最早一則報導與本站首次發現兩者中較早的;本站開始追蹤前就已上架、又沒有報導日期可查的,標「追蹤前已上架」排在最後。一家有多個時以最早的為準,名稱全部列出。同一關鍵字隔年再出現(如每年的金馬)時,前面各家最後一則報導之後超過 90 天才開始的,另算一輪重新比較先後。 進行中/已停更與最後更新日期只適用於議題。

依媒體瀏覽
媒體名稱後的數字是本站累計追蹤到這家媒體的議題或專題數(含已停更)。綠點表示來源更新正常;黃點表示尚未檢查、最近一次檢查失敗或部分入口未更新,或超過 3 小時沒有成功更新。「更新狀態詳情」列出各家最近一次檢查的時間與抓到的筆數。
更新狀態
「更新正常」:最近一次檢查成功,且 3 小時內有成功更新;「更新延遲」:超過 3 小時沒有成功更新;「部分入口未更新」:有些入口這次沒抓到;「本次未能更新,保留先前資料」:這次檢查失敗,議題或專題清單沿用上次的結果。

單一媒體的議題或專題

列出這家媒體官方入口上的議題或專題,每小時檢查。每個議題或專題下方是本站近 3 天從各家媒體抓到的相關報導:這家媒體把什麼做成議題或專題,其他家又怎麼報。

依最後更新排列:最後更新是議題或專題頁上最新一則報導的時間;沒有報導日期的,用本站首次發現時間(不等於媒體上架時間)。議題分成近期更新(90 天內有新報導)與已停更(超過 90 天沒有新報導);專題沒有停更之分。本站開始追蹤前就已上架、頁上也沒有報導日期可查的,列在最後「更新時間不明」。

各家用詞不一(專題、專輯、策展…),本站依有沒有持續新增報導來分類,不照媒體的命名:持續新增報導的新聞串是議題(90 天沒有新報導標為已停更),一次性的新聞包是專題。

累計追蹤
本站收錄到這家媒體的議題或專題總數,含已停更。
對應站內標籤
名稱比對得到站內標籤的議題或專題數:標籤須構成名稱的主要部分;名稱比對不到時,改用這家媒體在議題或專題頁上自己的報導共同帶的標籤。下方的相關報導依這些標籤比對。
更新狀態
「更新正常」:最近一次檢查成功,且 3 小時內有成功更新;「更新延遲」:超過 3 小時沒有成功更新;「部分入口未更新」:有些入口這次沒抓到;「本次未能更新,保留先前資料」:這次檢查失敗,議題或專題清單沿用上次的結果。

媒體與文章數

「收錄概況」列出所有已登錄媒體與文章發現來源,包含尚未啟用抓取與僅作為引用來源的媒體;新聞類媒體每 9 分鐘、其他媒體每小時抓取一次。「今日」從台北時間 00:00 起算。文章數以發布時間計;列表沒有提供發布時間的文章,會在抓取內文後才計入,在那之前列為「發布時間待確認」。

國家/地區
依媒體營運或在地發行版本標示,不是新聞發生地或母公司國籍;跨國團隊與待確認項目另行標示。
發現來源
「發現來源」的篇數是經該平台發現的原媒體文章;上方全站文章總數、有發稿的媒體與有標籤的文章只按原媒體計算,不重複加總。
24 小時
長條以目前列表中 24 小時篇數最多的媒體為滿格。
7 天
7 天欄下方註明「M/D 起抓取」的媒體,是新系統開始抓它還不滿一週,數字只涵蓋那幾天,不能和其他媒體直接比較。
標籤率
24 小時內的文章中帶有標籤的比例。
狀態
正常=最近有新文章;無近期文章=新聞類 6 小時、其他 24 小時內沒有新文章(來源可能暫停發稿);抓取失敗=近 3 小時的抓取全部失敗;未啟用=尚未啟用定期抓取、已停用或僅作為引用來源。各媒體頁標頭的狀態依同一規則,寫作持續收錄、近期無新文章、暫時無法更新、已停止收錄。
藍綠
「偏藍」「偏綠」標示與「藍營傾向」「綠營傾向」篩選,和首頁新聞量、事件頁的藍綠對照用同一份分類。

媒體頁

各媒體頁的收錄量為本站抓取的報導,非媒體全部發稿量;標頭的今日收錄、近 24 小時、近 7 天與狀態,和「收錄概況」依同一規則計算。「報導關鍵字」統計期間內文章的標籤與標題關鍵詞,排除新聞分類詞,每篇每詞計一次,最多取最新 2,000 篇;字越大,出現在越多篇報導。「媒體關係」取自新聞關係圖同一期間的比對結果(相似度門檻 0.65),依文章去重計數:同組指內文相近的報導,以最早刊登者為來源;引用指內文明示引用的媒體。沒有列出關係,不代表沒有相關新聞,只是比對未達門檻。報導關鍵字與媒體關係依文章列表選的期間計算,選「全部」時為近 7 天。

Google 新聞、動態網等發現來源的頁面,列出經該來源發現的文章,依原始刊登媒體收錄;點選標題可在本站閱讀,刊登時間保留原文日期。

Similar Web:流量與收錄比較

這一頁把各家媒體的本站收錄篇數與 Similarweb 流量並列。Similarweb 資料來自 Gene Hong 維護的人工整理表(頁首的「原始流量表單」),匯入日期 2026-10-03。單位未在新聞欄明示,顯示原表值,不推算造訪人數。人工調整過的數值另行標示(「人工調整」,滑鼠停留可看原表值);同一媒體有多列流量、無法判定主來源時標「待核對」;缺值不補零,顯示「—」。品牌全站與新聞子頻道可能重疊,每家媒體採主來源,不相加,也不推算全台市占。

本站文章數依真實發布月份(台北時間)統計目前已收錄紀錄,並非該媒體完整發稿量;表格顯示最近一個月的篇數。本月資料持續累積中,抓取也可能不完整。流量與篇數是不同指標,不能推算成每篇文章的實際閱讀量。發現來源以關聯計數,不改文章的原媒體歸屬。

原始整理表另有人工標記的分類欄,本站基準名單媒體的藍綠即依此標記(見下);這不是 Similarweb 的政治傾向評分,本頁也不呈現分類。

爬蟲資訊

「爬蟲資訊」列出各媒體的抓取方式、下載工具與程式碼;收錄篇數見收錄概況。新聞類媒體每 9 分鐘、其他媒體每小時抓取一次。

抓取方式
HTML 解析是下載網頁後擷取內容;JSON 是讀取公開結構化資料。自動探索會依站點選用 RSS、Sitemap 或 HTML;最近驗證方式不代表每次都採用相同路徑。標籤提示保留完整抓取說明與最近驗證方式。
內容
正文擷取仍需逐篇驗證;標題、摘要與影片資料依來源提供,並非每篇皆具備。
議題/專題
列出各家官方入口:議題是持續新增報導的新聞串,專題是一次性的新聞包;各家用詞不一,入口未宣告類型時(自動判定)依報導是否持續增加來分類。數字是累計收錄的議題與專題數;綠點表示最近一次檢查正常,橘點表示有入口未能更新,展開可看各入口的結果。