資訊系統與資訊檢索 申論題歷屆試題與參考架構

高考三級,民國 102~115 年共 14 份試卷、56 題,其中 56 題附參考答題架構。考這一科的類科:圖書資訊管理。本頁列出歷年全部題目,參考架構只列開頭的「破題」,完整的答題架構、關鍵字與作答提醒請到站內查看。

▶ 看完整參考架構(資訊系統與資訊檢索)

115 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    請說明有線網路和無線網路的差異。(25 分)

    (25 分)

    參考架構・破題

    有線與無線網路的差異在於傳輸媒介、穩定性、安全性、移動性與建置成本,作答宜以比較表式分點說明,並連結圖書館的應用情境。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    何謂智慧型資訊檢索技術(Intelligent Information Retrieval, IIR)?(10 分)智慧型資訊檢索技術有那些重要研究課題?(15 分)

    (25 分)

    參考架構・破題

    智慧型資訊檢索是將人工智慧、自然語言處理與機器學習導入檢索系統,使系統能理解使用者意圖與文件語意,而非僅做關鍵字比對。本題兩小題,定義約占三分之一篇幅,研究課題占其餘。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    請試述 Structured Query Language(SQL)常見的五個聚合函數。(25 分)

    (25 分)

    參考架構・破題

    聚合函數(Aggregate Function)對一組資料列運算後回傳單一值,常與 GROUP BY、HAVING 搭配。本題要求五個常見函數,各附功能、語法與例句。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    何謂資訊組織(Information Organization)?(10 分)試述圖書館資訊組織的發展方向。(15 分)

    (25 分)

    參考架構・破題

    資訊組織是對資訊資源進行描述、分類、標引與排列,使其可被有效檢索與利用的過程。圖書館資訊組織正由卡片目錄與 MARC 走向語意化、關聯化與智慧化。

    完整答題架構與關鍵字:到站內看全文

114 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    圖書館服務平台的新興趨勢及未來發展方向為何?(25 分)

    (25 分)

    參考架構・破題

    圖書館服務平台(LSP)是新一代雲端化館藏管理系統,取代傳統整合性圖書館系統(ILS)。作答宜由現況說明趨勢,再推論未來發展方向。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    bibliographic coupling 書目耦合和同被引(Co-citation)的定義是什麼?對文獻分析的影響是什麼?某研究者發現文章 A 與文章 B 有高度書目關聯性,但共被引頻率極低。請問可能的原因為何?(25 分)

    (25 分)

    參考架構・破題

    書目耦合與共被引同屬引文分析中的關聯測度,前者看兩文獻引用相同參考文獻,後者看兩文獻被同一篇文章共同引用。兩者時間方向不同,所反映的意義也不同。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    假設你要建置一個能讓中文使用者搜尋英文學術資料的系統,你會如何實現跨語言檢索功能?這樣的系統會面臨那些挑戰?(25 分)

    (25 分)

    參考架構・破題

    跨語言檢索(CLIR)讓使用者以一種語言提問,檢索另一種語言的文件。本題以中文查詢、英文學術資料為例,需說明實作策略與挑戰。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    請說明搜尋引擎利用那些策略來決定檢索網頁的排序。(25 分)

    (25 分)

    參考架構・破題

    搜尋引擎排序目的在將最符合使用者需求的網頁排在前面。排序綜合文件內容相關性、網頁權威性、使用者情境與品質訊號等多項策略。

    完整答題架構與關鍵字:到站內看全文

113 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    目前已有相關資訊平臺(如 EBSCOHost、Figshare)提供學術文獻中圖表之檢索功能,請論述對學者專家的應用影響。(25 分)

    (25 分)

    參考架構・破題

    圖表檢索讓研究者不需閱讀全文即可直接搜尋論文中的圖、表與數據,改變文獻查找與研究成果再利用的方式。可由正面效益與潛在問題兩面論述。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    Amazon 線上書店提供的購書推薦即是一種共現(co-occurrence)的應用,請從應用的對象、目的與結果等三方面論述 Amazon 購書推薦與書目計量共字分析(co-word analysis)的差異。(25 分)

    (25 分)

    參考架構・破題

    Amazon 購書推薦與書目計量的共字分析都以共現(co-occurrence)為基礎,但前者面向商業使用者、目的在促進購買,後者面向研究者、目的在揭示學科知識結構。題目要求依對象、目的、結果三面向比較。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    隨著圖書館目錄導入應用鏈結資料(Linked Data)技術,請論述 5 項鏈結資料目錄的特色。(25 分)

    (25 分)

    參考架構・破題

    鏈結資料是依 Web 標準把資料以 URI 與 RDF 表達並彼此連結的方式。圖書館目錄導入後,書目由封閉的紀錄轉為開放、可機器理解的資料網。宜列出五項特色並說明其意義。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    請試從圖書館(library)、服務(service)與平臺(platform)等三種觀點論述何謂圖書館服務平臺(Library Service Platform, LSP)。(25 分)

    (25 分)

    參考架構・破題

    圖書館服務平台(LSP)是雲端化、整合多種資源管理與服務的新一代系統。題目要求由圖書館、服務、平臺三種觀點拆解,作答須分三段各自說明,再整合。

    完整答題架構與關鍵字:到站內看全文

112 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    在多種分散式資料來源提供整合查詢(integrated querying)功能是很重要的,請就三種主要類別:基於實際資料的查詢處理(materialization-based query processing, MQP)、基於連結表單查詢處理(lookup-based query processing, LQP),以及聯合查詢處理(federated query processing, FQP),試分別說明其方法,以及其優點。(25分)

    (25 分)

    參考架構・破題

    整合查詢的核心在於「資料放哪裡、查詢在哪裡執行」。三種方式依資料是否集中而分,作答宜先給定義,再比較架構、流程與優點。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    使用者依據搜尋資訊的結果,再以其相關資訊再次搜尋額外的資訊可稱為相關反饋(relevance feedback)。有三種相關反饋搜尋技術:類似(find-like)搜尋、書目掃描(bibliography scanning)搜尋,以及引用參考(cited-reference)搜尋,試分別說明其方法。(25分)

    (25 分)

    參考架構・破題

    相關反饋的精神是利用已找到的相關文獻作為線索,擴大或修正檢索。三種技術差別在於線索的來源:文獻內容、書目後所附文獻、被引用關係。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    試闡述傳統整合圖書館系統(integrated library system)後台館員工作管理模組的功能。 (10分)又符合現在發展趨勢的整合圖書館系統會有什麼樣的特點。(15分)

    (25 分)

    參考架構・破題

    整合圖書館系統(ILS)以館藏與讀者流程為核心。本題分兩部分:傳統後台館員工作模組的功能,以及符合現今趨勢的新一代系統特點。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    使用行動性設備(mobile device)來存取網站資訊已經越來越普遍,在設計建立行動友善(mobile-friendly)網站的原則上,請試列舉五個原則,以增進網站在行動設備上的可用性(usability)。 (25分)

    (25 分)

    參考架構・破題

    行動設備螢幕小、以觸控操作、網路環境不穩,行動友善網站設計必須針對這些限制,從版面、導覽、內容與效能著手,提升可用性。

    完整答題架構與關鍵字:到站內看全文

111 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    請說明人工智慧(Artificial Intelligence)包含那些分支領域?請分別在資訊檢索、圖書館技術服務與讀者服務等三個面向,舉例說明人工智慧分支技術領域如何應用於圖書館。(25 分)

    (25 分)

    參考架構・破題

    人工智慧是讓機器模擬人類學習、推理與理解的技術總稱。本題需先列分支領域,再從資訊檢索、技術服務、讀者服務三個面向各舉例應用。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    圖書資訊學相關學者曾提出各種資訊行為理論,請說明其中一位學者的資訊行為理論,其理論模型、重要因素與影響,以及思考當代資訊檢索現況發展,試圖為該理論模型增加影響因素,並說明原因。(25 分)

    (25 分)

    參考架構・破題

    資訊行為理論說明人如何需要、尋求、使用資訊。宜選一個自己最熟悉的模型,完整交代模型、因素與影響,再結合當代情境提出新因素。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    資源探索服務(Discovery Service)之興起因素與背景環境為何?請說明其運作的機制,包含那些重要的特性?功能評估要項為何?(25 分)

    (25 分)

    參考架構・破題

    資源探索服務(Discovery Service)是讓使用者以單一搜尋框,同時檢索圖書館各類資源的整合檢索平台。作答依序處理興起背景、運作機制與特性、評估要項。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    研究資料管理為開放科學時代重要的實踐方法,研究資料生命週期模型之重要元素,包含設計與計畫、蒐集與組織、儲存與描述、分析與呈現、典藏與公開、檢索與再用等階段,請說明「蒐集與組織階段」之格式結構、檔案儲存架構、資料蒐集過程記錄,以及「儲存與描述階段」之品質確認、記錄描述、儲存共享等要項之內容重點。(25 分)

    (25 分)

    參考架構・破題

    研究資料管理(RDM)貫穿研究資料生命週期。本題要求針對「蒐集與組織」及「儲存與描述」兩階段,逐項說明重點,宜依題目所列細項分點作答。

    完整答題架構與關鍵字:到站內看全文

110 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    請闡述互動性檢索(Interactive Information Retrieval)。(25 分)

    (25 分)

    參考架構・破題

    互動性檢索(IIR)把資訊檢索視為使用者與系統持續互動、共同調整的過程,而非一次性的查詢與回應,強調使用者的認知、情境與回饋。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    使用者介面設計對圖書館自動化系統或資訊檢索系統的使用都是非常重要的。尼爾森(Nielsen)提出了 10 項優使性(usability)經驗法則(heuristics)的一般性原則。請舉出其中 5 項原則並加以說明。(25 分)

    (25 分)

    參考架構・破題

    Nielsen 提出的十項優使性經驗法則,是評估使用者介面的通用原則。本題只要選五項,說明內容並最好結合圖書館系統或檢索系統的例子。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    h-index 是指一個作者(科學家或學者)或一個機構至少有 h 篇所發表的文章被其他作者引用達 h 次。最早由 Hirsch(2005)所提出,因此也稱為 Hirsch index。

    (一)請說明 h-index(或稱 Hirsch index)的意涵。(5 分)

    (二)計算表 1 的 h-index 並說明。(10 分)

    (三)計算表 2 的 h-index 並說明。(10 分)表 1 甲學者文章排名及被引用數文章被引用次數排名 1 2 3 4 5 6 7文章被引用次數 10 8 7 7 6 6 2表 2 A 圖資系文章排名及被引用數文章被引用次數排名 1 2 > 15 16 17文章被引用次數 32 27 > 15 13 12

    (25 分)

    參考架構・破題

    h-index 用一個數字同時衡量研究者的「產量」與「影響力」:把文章依被引用次數由高到低排序,找出最大的 h,使第 h 篇的被引次數仍大於或等於 h。作答重點在定義講清楚、計算過程逐列比對、再說明數值的意義與限制。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    請說明國家圖書館的資訊服務。(5 分)並就其中 4 項服務舉例說明之。(20 分)

    (25 分)

    參考架構・破題

    國家圖書館是國家級圖書館,兼具典藏、書目、閱覽與研究支援等功能。本題分為概述(5 分)與舉例說明四項服務(20 分),篇幅應以後者為主。

    完整答題架構與關鍵字:到站內看全文

109 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    試說明雲端圖書館服務平台(Cloud-based Library Service Platform)的優缺點分別為何?其平台記錄之讀者圖書借閱流通大數據(Big Data) ,對於發展讀者智慧服務的可能應用為何?(25分)

    (25 分)

    參考架構・破題

    雲端圖書館服務平台(LSP)把採訪、編目、流通、電子資源管理與探索服務整合在雲端多租戶架構上,取代傳統的整合式圖書館系統(ILS)。作答先寫平台的特性,再比較優缺點,最後從流通大數據延伸到讀者智慧服務。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    請分別說明詞典法(Dictionary-based Method)及統計法(Statistics-based Method)之中文斷詞方法的原理為何?中文斷詞的歧義性(Ambiguity)對於中文檢索效能的影響為何?(25分)

    (25 分)

    參考架構・破題

    中文書寫詞與詞之間沒有空白,檢索系統必須先斷詞才能建立索引。題目要求說明兩大類斷詞法原理,再分析歧義如何影響查全率與查準率。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    請說明何謂命名實體識別(Named Entity Recognition, NER)?如何將NER應用於改善資訊檢索效能?請舉一個可以實作NER的技術方法?(25分)

    (25 分)

    參考架構・破題

    命名實體識別是資訊擷取的基礎工作,從文本中找出人名、地名、機構名、時間、數量等具特定指涉的詞並分類。作答依「定義→檢索應用→實作技術」三段寫。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    請說明何謂網頁內容探勘(Web Content Mining)、網頁結構探勘(Web,以及網頁使用探勘(Web Usage Mining)?試論如何分Structure Mining)別將其應用於強化網路搜尋引擎的資訊檢索效能?(25分)

    (25 分)

    參考架構・破題

    網路探勘(Web Mining)依探勘對象分為內容、結構、使用三類,分別處理網頁的文字多媒體、超連結關係與使用者行為紀錄。作答先分別定義,再說明各自如何強化搜尋引擎。

    完整答題架構與關鍵字:到站內看全文

108 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    (一)何謂共被引(co-citation)?(10 分)

    (二)何謂書目對(bibliographic coupling)?(10 分)

    (三)兩者有何異同?(5 分)

    (25 分)

    參考架構・破題

    共被引與書目對(書目耦合)都是引用分析中衡量兩篇文獻關聯程度的方法,差別在於看「被誰引用」或「引用了誰」。作答分別定義、舉例,最後比較異同。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    (一)何謂使用性(usability)?(5 分)

    (二) Nielsen 提出的使用性 5 項特性為何?(10 分)

    (三)依據 W3C 的網站內容存取指引(web content accessibility guidelines),網站存取性的 4 個基本原則為何?(10 分)

    (25 分)

    參考架構・破題

    使用性關注系統是否好用,存取性關注所有人(含身心障礙者)是否都能使用。本題分三小題:定義使用性、列出 Nielsen 的五項特性、說明 WCAG 的四大原則。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    請說明人工智慧(Artificial Intelligence)或專家系統(Expert Systems)在資訊檢索中扮演的功能與角色。 (25 分)

    (25 分)

    參考架構・破題

    人工智慧讓檢索系統從單純的字串比對,走向理解使用者需求與文件語意;專家系統則模擬參考館員的知識與推理,擔任檢索中介者。作答先定義,再依檢索流程說明功能與角色。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    (一)何謂跨語言資訊檢索(cross-language information retrieval)?(10 分)

    (二)請說明 Dictionary-Based Method 的作法、優缺點及改善方式。 (15 分)

    (25 分)

    參考架構・破題

    跨語言資訊檢索讓使用者以一種語言查詢、取得另一種語言的文件,核心問題是語言轉換。詞典法是最基本的查詢翻譯方法,作答要寫作法、優缺點與改善方式。

    完整答題架構與關鍵字:到站內看全文

107 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    AI(Artificial Intelligence 或是 Augmented Intelligence)技術近年來發展迅速。AI 在下棋、影像辨識、語音辨識、畫風轉換、作詩、作曲、對話等技術與應用上,都有長足的進步,而被新聞報導。

    (一)試述影響這次 AI 技術與應用有較大突破的三種因素。 (15 分)

    (二)試述 AI 可運用於圖書館服務的兩種應用。(10 分)

    (25 分)

    參考架構・破題

    本波 AI 突破主要來自深度學習,背後有資料、運算、演算法三股力量匯流。第二小題要把 AI 技術連到圖書館的具體服務。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    一般而言,「情書」、「心意」這兩個詞在主題(topic)上是比較相近的詞彙,而「宇宙」、「太空」這兩個詞也是主題或概念(concept)上較接近的詞彙。相對而言,「宇宙」、「心意」這兩詞在概念上,就比較不相關或不相似。試述一種可自動化的方法,來量化前述詞彙的相關度或是相似度,並舉例說明。(25 分)

    (25 分)

    參考架構・破題

    題目要的是詞彙語意相似度的自動計算方法。核心依據是分布假說:出現在相似上下文的詞,意義也相近。作答選一種方法(共現向量或詞嵌入)完整說明步驟,再用題目詞彙舉例。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    請試述專利與法律文件的檢索,以及網頁內容的資訊檢索,有何不同?請從檢索需求、檢索策略兩方面加以比較。(25 分)

    (25 分)

    參考架構・破題

    專利與法律檢索屬高查全、高風險的專業檢索,漏掉一篇可能導致侵權或敗訴;網頁檢索則以一般使用者、快速取得少量相關結果為主。作答依題目要求,從檢索需求與檢索策略兩方面對照比較。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    試述資料庫管理系統(Database Management System)與全文檢索系統之不同。請從檢索需求、索引檔結構加以比較。 (25 分)

    (25 分)

    參考架構・破題

    資料庫管理系統處理結構化資料、追求精確查詢;全文檢索系統處理非結構化文字、追求相關性檢索。作答依題目從檢索需求與索引檔結構兩方面比較。

    完整答題架構與關鍵字:到站內看全文

106 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    試說明大數據(Big Data,或稱巨量資料或是海量資料)的應用如何提升整合式圖書館管理系統(Integrated Library Management System,簡稱 ILMS)的使用者體驗。(25 分)

    (25 分)

    參考架構・破題

    ILMS 每天累積大量流通、檢索、點擊與館藏使用紀錄,大數據的價值在於把這些資料與外部資料整合分析,讓系統從「被動查詢」轉為「主動、個人化、可預測」的服務。作答要扣住「使用者體驗(UX)」,而不是只談後台管理效率。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    一般而言,停用詞可分為二類:通用停用詞(Generic Stop Words) ,專用停用詞(Specific Stop Words,或稱領域停用詞,Domain Stop Words)。請分別說明這二類的停用詞,並說明如何建構這二種停用詞表(Stop-word List)。(25 分)

    (25 分)

    參考架構・破題

    停用詞是出現頻率高但鑑別力低、對檢索幫助不大的詞,建索引時將其排除可縮小索引、加快檢索並降低雜訊。題目要求兩件事:區分通用與專用停用詞,以及說明兩者表的建構方法。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    相關回饋的二種主要形式:一為顯性相關回饋(Explicit Relevance Feedback);一為隱性相關回饋(Implicit Relevance Feedback)。請申論隱性相關回饋的可能形式。(25 分)

    (25 分)

    參考架構・破題

    相關回饋是依使用者對初次檢索結果的判斷修正查詢,以提升檢索效能。顯性回饋需使用者主動標記,負擔大、參與率低;隱性回饋則由系統觀察使用者行為推估相關性。本題重點在「隱性回饋的可能形式」,應分類列舉並評論其可靠度。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    資訊檢索的發展已有數十年的歷史,有眾多學者與專家提出許多資訊檢索理論或模式。請任選二種,首先明確寫出其理論或模式名稱,接著說明其內容並申論優缺點。(25 分)

    (25 分)

    參考架構・破題

    本題為自選題,建議挑「布林模式」與「向量空間模式」(或改選機率模式),兩者對比鮮明、容易寫出優缺點。每個模式依「名稱 → 內容(文件表示、查詢表示、比對方式)→ 優缺點」三段寫。

    完整答題架構與關鍵字:到站內看全文

105 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    何謂 Open Source Software Integrated Library Systems(OSS ILS)?請說明前述系統的功能與特點為何?圖書館為了不同目的導入不同種類的資訊系統,那一種類型圖書館適合導入此種系統?圖書館導入該系統需考量的因素為何?包含那些效益與限制?(25 分)

    (25 分)

    參考架構・破題

    OSS ILS 是原始碼公開、可自由使用與修改的整合式圖書館系統,如 Koha、Evergreen。題目有五問:定義、功能與特點、適合館型、導入考量、效益與限制,作答要逐一對應不可漏答。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    臺灣大學的‟Academic Hub”與清華大學的‟Knowledge Hub”,均具備學術入口網(Research Portal)功能,請問該系統平台之發展背景、目的與功能為何?圖書館如何為學術研究人員提供客製化服務以推展該系統平台之應用?未來效益為何?(25 分)

    (25 分)

    參考架構・破題

    臺大 Academic Hub 與清大 Knowledge Hub 都是以機構典藏為基礎、整合學者研究成果與研究人員資訊的學術入口平台,屬「研究資訊系統/學者知識網」的應用。作答依題目四問:背景、目的、功能、客製化服務與未來效益。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    何謂 Topic Maps?何謂 RDF(Resource Description Framework)?兩者有何異同?前述兩項工具於資訊檢索系統中之效益為何?(25 分)

    (25 分)

    參考架構・破題

    Topic Maps 與 RDF 都是描述資源及其關係、讓機器理解語意的知識表示標準,前者源自索引與知識組織,後者為語意網基礎。作答依序:分別定義、比較異同、說明在資訊檢索系統中的效益。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    學者 Tefko Saracevic 曾提出資訊檢索互動分層模型(The Stratified Model of IR Interaction),試論述該理論模型之核心概念、要素與內容重點,並說明其發展歷程與修正的過程。 (25 分)

    (25 分)

    參考架構・破題

    Saracevic 的分層模型把資訊檢索視為使用者與系統在多個層次上的互動,整合了系統導向與使用者(認知)導向的研究觀點。作答依題目:核心概念、要素與內容、發展歷程與修正。

    完整答題架構與關鍵字:到站內看全文

104 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    資訊檢索系統可供檢索文件的來源是非常多元的,可能是原生數位全文(Born Digital) , 可 能 是 紙 本 文 件 經 過 重 新 打 字 成 為 數 位 全 文 文 件 , 也 可 能 是 採 用光學字元辨識(Optical Character Recognition,OCR)的作法,將紙本文件轉變為數位文件。OCR 的作法顯然會有辨識錯誤的情形,請說明對於資訊檢索系統而言,OCR 的文件是否需要進行校正,如果需要是基於何種使用需求,何種考量因素?如果不需要又是基於何種使用情境,何種考量因素?(25 分)

    (25 分)

    參考架構・破題

    OCR 錯誤會影響索引與比對,但是否校正取決於使用目的、錯誤率、成本效益與檢索技術。答題宜採「需要/不需要」兩面並陳,再提出折衷方案,展現判斷力。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    近年來,鏈結開放資料(Linked Open Data,簡稱 LOD)受到大家的重視,國內外圖書館界亦陸續討論圖書館書目資料轉換為鏈結開放資料的可行性。請敘述何謂LOD,並說明圖書館書目資料轉換為 LOD 後,對於使用者而言,相較於使用傳統的線上公用目錄(Online Public Access Catalogue,OPAC),有何重大的不同?(25 分)

    (25 分)

    參考架構・破題

    LOD 是以語意網技術公開並互相連結的資料,讓書目從封閉的「紀錄」變成網路上可被連結、再利用的「實體與關係」。作答先說明 LOD 定義與原則,再從使用者角度比較 LOD 化書目與傳統 OPAC 的差異。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    當使用者應用資訊檢索系統或是網路搜尋引擎時,可能因為種種原因,輸入錯誤的詞彙或是不合用的詞彙,某些資訊檢索系統或是網路搜尋引擎會提供建議的詞彙或是相關的詞彙。請說明這些資訊檢索系統或是網路搜尋引擎是如何判斷使用者輸入錯誤的詞彙與不合用的詞彙,以及如何產生前述的建議詞彙與相關詞彙?(25 分)

    (25 分)

    參考架構・破題

    題目分兩部分:系統如何「判斷」輸入有誤或不合用,以及如何「產生」建議詞與相關詞。答題可依「錯誤偵測—候選產生—排序呈現」流程,並把拼字錯誤與詞彙不合用(詞彙不一致)分開處理。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    目前資訊檢索系統多為單語資訊檢索系統(Monolingual Information Retrieval System,或稱為 Single Language Information Retrieval System),跨語資訊檢索系統(Cross Language Information Retrieval System)較為罕見。請說明建構跨語資訊檢索系統時,必須處理那些難題,以及處理這些難題可以應用的技術。(25 分)

    (25 分)

    參考架構・破題

    跨語資訊檢索(CLIR)是讓使用者以一種語言查詢、檢索到另一種語言的文件,核心難題是「語言轉換」與其衍生的歧義、詞彙涵蓋不足等問題。作答宜「難題—對應技術」逐項配對。

    完整答題架構與關鍵字:到站內看全文

103 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    以往圖書館資訊系統(或稱為圖書館自動化系統)安裝於圖書館自有的電腦主機,近年雲端運算受到廣泛重視,亦有廠商提出雲端圖書館資訊系統。請由圖書館館員(管理者)的角度,評論前述二種圖書館資訊系統運轉模式的優缺點。(25 分)

    (25 分)

    參考架構・破題

    本題要比較「本地自建主機(on-premise)」與「雲端圖書館資訊系統」兩種運轉模式,重點在館員(管理者)視角:成本、人力、控制權、資料安全與服務延續性。先界定兩種模式,再逐面向比較,最後提出選擇建議。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    資訊檢索系統在接受使用者輸入的「查詢詞彙」(Search Terms 或稱為 Query Terms)後,會依據系統的計算法則,送出「排序的查詢結果」(Ranked Search Result 或稱為 Ranked Query Result)。請討論可以考量那些因素,並據以計算排序查詢結果。(25 分)

    (25 分)

    參考架構・破題

    排序檢索(ranked retrieval)的核心是估計文件與查詢的相關程度。作答應從「文件內容」、「文件外部結構與品質」、「使用者與情境」三類因素切入,再說明如何組合成排序分數。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    許多資訊檢索技術的研究者與開發者認為以詞彙為基礎(Term-based)的資訊檢索系統有許多缺點,紛紛開發以概念為基礎(Concept-based)的資訊檢索系統。請說明如何建構以概念為基礎的資訊檢索系統。(25 分)

    (25 分)

    參考架構・破題

    以詞彙為基礎的檢索只做字面比對,受同義詞、多義詞與詞彙不一致問題所苦;以概念為基礎的檢索把文件與查詢映射到概念層次再比對。作答先點出詞彙式缺點,再說明建構概念式系統的步驟與技術。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    為了提供使用者更好的資訊服務,許多網路書店發展圖書推薦的功能,亦即當使用者檢索或瀏覽特定的圖書時,系統會依據這本特定的圖書,進而推薦其他的圖書。請設想自己為系統開發者,討論如何建構這項圖書推薦的功能。(25 分)

    (25 分)

    參考架構・破題

    圖書推薦屬推薦系統的應用,核心是依「目前瀏覽的書」找出相似或相關的其他書。作答以系統開發者角度,說明資料來源、推薦方法、系統流程與評估,並處理冷啟動等問題。

    完整答題架構與關鍵字:到站內看全文

102 年(考試時間 120 分鐘) 原卷 PDF

  1. 1

    試比較說明以條列式排序搜尋結果之搜尋引擎(ranked list search engine)以及具分群顯示搜尋結果之搜尋引擎(clustering search engine),在搜尋結果呈現上的主要差異為何?分別從檢索效率(efficiency)及檢索效益(effectiveness)兩個面向,評述其對於幫助使用者檢索所需求資訊的優缺點為何?(25 分)

    (25 分)

    參考架構・破題

    兩者差異在結果的組織方式:條列式依相關度排成一維清單;分群式將結果依主題自動分群,以類別樹或群組呈現。題目要求從檢索效率與檢索效益兩面向評述,作答須分項對照。

    完整答題架構與關鍵字:到站內看全文

  2. 2

    試分別說明相關回饋(relevance feedback)中採用的清楚回饋(explicit feedback)及隱含回饋(implicit feedback)的意涵為何?兩者各有何優缺點?試舉三種搜尋引擎採用的隱含回饋方法,並說明其原理?(25 分)

    (25 分)

    參考架構・破題

    相關回饋是利用使用者對初次檢索結果的相關判斷來修正查詢、提升檢索品質。依取得方式分為使用者主動標示的清楚回饋,與系統從行為推論的隱含回饋。作答分定義、優缺點比較、三種隱含回饋方法三段。

    完整答題架構與關鍵字:到站內看全文

  3. 3

    試說明資訊檢索系統所採用字詞索引(vocabulary indexing)技術中的反向索引(inverted indexing)及全反向索引(full inverted indexing),其概念與技術內涵分別為何?主要的優缺點分別為何?如何被應用於支援布林模型檢索及向量空間模型檢索?(25 分)

    (25 分)

    參考架構・破題

    反向索引以「詞彙→含有該詞的文件清單」組織,是檢索系統的核心結構;全反向索引則在清單中進一步記錄詞彙在文件中的出現位置。作答分概念、技術內涵、優缺點,以及如何支援布林與向量空間模型四部分。

    完整答題架構與關鍵字:到站內看全文

  4. 4

    相較於一般文件檢索,試分別從所需處理的資料(data)及面對使用者所需產生的互動(interaction)兩個面向,說明網際網路資訊檢索(Web information retrieval)主要面臨的挑戰為何?網際網路的發展影響了那些面向資訊檢索技術的發展?(25 分)

    (25 分)

    參考架構・破題

    網路檢索與傳統封閉文件集檢索最大不同在於資料規模與性質的異質、動態,以及使用者群的大量多元。作答分資料面與互動面挑戰,最後說明網路發展所帶動的檢索技術演進。

    完整答題架構與關鍵字:到站內看全文

其他等別的「資訊系統與資訊檢索」

題目來源:考選部考畢試題查詢平臺(政府資訊公開資料);參考架構為本站自撰,僅供準備方向參考,非官方標準答案。最後更新:。