📅 資料查核日 2026 年 8 月 28 日 · 今天是 · 條款隨時可能更新,正式使用前請務必再次查閱各資料庫的最新使用條款。
避免侵權的資料庫使用方式
政大圖書館 · 給師生的資料庫 × AI 指南

下載、探勘、餵給 AI,
是三種不同的權利。

(「下載」=把檔案抓下來;「探勘/TDM」=讓電腦一次讀大量文獻自動分析;「餵給 AI」=把內容交給 ChatGPT 這類工具。)

你還是可以合法用 AI,這頁教你怎麼用得安心。給政大師生的實用指引:搞懂「從資料庫下載的文章,能不能交給 AI 摘要、翻譯或改寫」,往下可查條款、跑決策流程、看法律依據。

一分鐘結論
  • 可以用資料庫「內建」的 AI(如 Scopus AI、JSTOR,本館另有專頁)、你自己寫的東西、公共領域或開放取用內容。
  • 要小心把訂閱文章「全文」貼給外部 AI(ChatGPT 等),多半違反資料庫條款;先查條款,或只貼重點、自己的筆記。
  • 別做用爬蟲/機器人大量下載全文(19 個資料庫幾乎都禁止),或把盜版、來源不明的檔案餵 AI。
  • 想確認自己的情況?下面的自我檢測,選一選就知道。
Self-check

自我檢測:能不能上傳給 AI?

先給你一個快速自我檢測:選一選你的情況,馬上出建議;想看依據,往下都有完整說明。

SELF-CHECK

比較安全的做法

現實層面:就目前公開資訊,尚少見到因個人研讀而把單篇 PDF 貼進 AI 就被追訴的案例,個人非商業研究也有主張合理使用的空間;但「少見被訴」不等於「明確合法」,而且合約的違反、與著作權能否主張合理使用,是兩回事。

1

用機構已授權、且不訓練/不保留的工具

企業或教育版、明確不儲存也不拿去訓練者,風險最低;避免用會保存或抓取內容的免費工具。國科會指引 ↗

2

用資料庫「內建」的 AI 功能

如 ScienceDirect 閱讀助手、Ovid、ProQuest 研究助手,出版社已自行授權。本館 · 資料庫 AI 功能 ↗

3

用開放取用/CC 授權內容

仍要看 CC 條款;NC/ND 對商業性 AI 平台可能不相容。Creative Commons ↗

4

不要上傳全文

貼你自己的筆記、少量引文或重點,而非整篇 PDF。數發部手冊 ↗

5

需要時取得授權

不確定特定資料庫的允許範圍時,直接向出版社或資料庫平台確認、或申請授權。往下查條款 ↓

6

上傳前先停一下

按下夾檔前,先確認是否涉及著作權、隱私或機密。數發部手冊 ↗

資料庫不給的時候,合法怎麼做?

很多人需要大量文本,是為了做數位人文、文獻計量或訓練模型,並非要盜版。與其自己爬、或把全文丟外部 AI,這裡按「你想做什麼 → 改走哪條合法路」整理。(實際可用範圍仍以你機構的授權與各平台條款為準。)

想大量下載/自己寫爬蟲?

→ 改用官方 API 與雲端分析平台
  • 官方 TDM API:合法訂閱者可到 Elsevier ScienceDirect API 申請 API Key,在速率限制內擷取全文與摘要;Crossref TDM API 可統一取多家期刊的中繼資料與 TDM 存取,比自己爬蟲風險低很多。
  • 雲端分析(不必把全文下載到本地):學校若有採購 ProQuest TDM Studio,可用其介面或 Jupyter Notebook 做大量文獻探勘;JSTOR 也提供官方文字分析服務(Constellate 已於 2025/7 停用、由 JSTOR Text Analysis Support 接手)。HathiTrust HTRC 則採「非消耗性研究」:把演算法送進安全伺服器運算、或只釋出統計特徵資料集,受版權保護的全文完全不外流。

想訓練模型/做 RAG/建本地知識庫?

→ 改用著作權明確開放的資料
  • OpenAlex:2.5 億筆以上學術中繼資料,開源、免費 API,社群也已做成 MCP,目前讓 AI 合法檢索學術脈絡的最佳替代。
  • PubMed Central OA Subset/arXiv/Europe PMC:數百萬篇允許機器讀取的開放全文。
  • CORE/Unpaywall:想找某篇付費論文,可用它們找合法的 Green OA(作者自存版)。

只是想請 AI 幫忙綜整、梳理?

→ 用「中繼資料+自己的筆記」,別丟整篇 PDF
  • 用中繼資料代替全文:從 WOS/Scopus 匯出書目檔(RIS/CSV,含標題、摘要、關鍵字),把這些沒有全文重製爭議的摘要交給 AI 做主題分群或趨勢梳理。
  • 引文筆記法:在 Zotero/EndNote 摘記核心概念與方法,只把「你自己的筆記」或少量段落給 AI,避開重製與合約爭議。

非用 AI 分析全文不可?

→ 用原廠內建 AI,或本地離線模型
  • 資料庫原廠 AI:如 Scopus AI、Web of Science Research Assistant,底層已獲出版商授權、附引用回溯,最省事也最合規。
  • 本地離線模型(Ollama/LM Studio):在自己電腦離線運行,不把資料傳給第三方伺服器(無第三方揭露風險),合規上優於傳到 OpenAI/Anthropic 的公有雲。
研究者特別注意:審稿中、未發表的稿件,絕對別餵 AI:你若在幫忙同儕審查(peer review)或擔任編輯,不得把評閱中的未發表稿件、數據或圖表上傳到任何公開或未授權的生成式 AI。這在學術界已被 COPEICMJE 與各大出版社(Elsevier、Springer Nature、Wiley、SAGE 等)明文禁止,理由有二:①審稿內容屬保密資訊,上傳公有雲 AI 等同向第三方外洩;②作者尚未發表的成果若被 AI 記錄、甚至納入訓練,會嚴重損害其權益。為省時間把待審論文丟給 AI 代寫審稿意見,已被視為嚴重的學術倫理違規與洩密。

同一個資料庫,能不能「大量下載」、能不能做「文字探勘(TDM)」、能不能把內容「交給外部生成式 AI/RAG」,往往分屬三套規定。這張表把 19 個常用學術與新聞資料庫的公開條款拆成這三欄,讓你先看結論、再看原文。

大量下載、自動擷取
幾乎全面 禁止
19 個資料庫都不允許自行以爬蟲、機器人批次抓取。
文字探勘 TDM
最多只到「有條件」。
可行者也須合法近用、非商業、走指定 API 或合約。
外部 AI/RAG
沒有一個可直接用。
最好的情況也只是「需另行授權」,多數直接禁止。
i

這是條款整理,不是法律意見。校方簽署的機構授權合約、個別產品條款、開放取用授權(如 CC BY)可能另有規定或優先適用。正式使用前,請再向原出版社或資料庫平台確認。

Comparison

資料庫怎麼規定

點任一列展開,看白話說明、條款原文和官方連結。(「文字探勘/TDM」=讓電腦一次讀大量文獻自動分析,不是人工一篇篇讀。)

查表前,先釐清這五件事
  1. 拿到哪種近用權?校園訂閱、個人帳號、開放取用或 API,能做的事不同。
  2. 要的是全文,還是中繼資料?能抓 DOI/摘要,不代表能抓 PDF 全文。
  3. 用途是非商業研究嗎?多數 TDM 例外只給非商業研究。
  4. 資料會離開核准環境嗎?上傳外部 AI/向量庫,是新的複製與揭露。
  5. 合約有沒有寫到 AI/RAG?傳統 TDM 授權不當然涵蓋訓練、RAG、微調。
禁止:條款明文禁止,且無一般授權管道 有條件:符合條件(合法近用/非商業/指定管道)可行 需另行授權:預設不允許,但有申請/合約管道 未明確:公開條款未明確規定