Show simple item record

[journal article]

dc.contributor.authorRoy, Dwaipayande
dc.contributor.authorCarevic, Zeljkode
dc.contributor.authorMayr, Philippde
dc.date.accessioned2024-09-11T07:13:38Z
dc.date.available2024-09-11T07:13:38Z
dc.date.issued2024de
dc.identifier.issn1432-1300de
dc.identifier.urihttps://www.ssoar.info/ssoar/handle/document/96545
dc.description.abstractRetrievability measures the influence a retrieval system has on the access to information in a given collection of items. This measure can help in making an evaluation of the search system based on which insights can be drawn. In this paper, we investigate the retrievability in an integrated search system consisting of items from various categories, particularly focussing on datasets, publications and variables in a real-life digital library. The traditional metrics, that is, the Lorenz curve and Gini coefficient, are employed to visualise the diversity in retrievability scores of the three retrievable document types (specifically datasets, publications, and variables). Our results show a significant popularity bias with certain items being retrieved more often than others. Particularly, it has been shown that certain datasets are more likely to be retrieved than other datasets in the same category. In contrast, the retrievability scores of items from the variable or publication category are more evenly distributed. We have observed that the distribution of document retrievability is more diverse for datasets as compared to publications and variables.de
dc.description.abstractDie Wiederauffindbarkeit misst den Einfluss eines Retrievalsystems auf den Zugang zu Informationen in einer bestimmten Sammlung von Elementen. Dieses Maß kann dabei helfen, eine Bewertung des Suchsystems vorzunehmen, auf deren Grundlage Erkenntnisse gewonnen werden können. In diesem Beitrag untersuchen die Autor*innen die Auffindbarkeit in einem integrierten Suchsystem, das aus Elementen aus verschiedenen Kategorien besteht, wobei sie sich insbesondere auf Datensätze, Publikationen und Variablen in einer realen digitalen Bibliothek konzentrieren. Die traditionellen Metriken, d.h. die Lorenz-Kurve und der Gini-Koeffizient, werden verwendet, um die Unterschiede in den Auffindbarkeitswerten der drei auffindbaren Dokumenttypen (insbesondere Datensätze, Publikationen und Variablen) zu visualisieren. Die Ergebnisse zeigen eine signifikante Verzerrung der Popularität, wobei bestimmte Elemente häufiger abgerufen werden als andere. Es hat sich insbesondere gezeigt, dass bestimmte Datensätze mit größerer Wahrscheinlichkeit abgerufen werden als andere Datensätze derselben Kategorie. Im Gegensatz dazu sind die Abrufbarkeitswerte von Elementen aus der Kategorie der Variablen oder Veröffentlichungen gleichmäßiger verteilt. Die Autor*innen konnten feststellen, dass die Verteilung der Auffindbarkeit von Dokumenten für Datensätze im Vergleich zu Veröffentlichungen und Variablen unterschiedlicher ist.de
dc.languageende
dc.subject.ddcPublizistische Medien, Journalismus,Verlagswesende
dc.subject.ddcNews media, journalism, publishingen
dc.subject.otherRetrievability; Dataset retrieval; Interactive IR; Diversityde
dc.titleRetrievability in an integrated retrieval system: an extended studyde
dc.description.reviewbegutachtet (peer reviewed)de
dc.description.reviewpeer revieweden
dc.source.journalInternational Journal on Digital Libraries
dc.source.volume25de
dc.publisher.countryDEUde
dc.source.issue2de
dc.subject.classozInformation und Dokumentation, Bibliotheken, Archivede
dc.subject.classozInformation and Documentation, Libraries, Archivesen
dc.subject.thesozinformation retrievalde
dc.subject.thesozinformation retrievalen
dc.subject.thesozInformationssystemde
dc.subject.thesozinformation systemen
dc.identifier.urnurn:nbn:de:0168-ssoar-96545-7
dc.rights.licenceCreative Commons - Namensnennung 4.0de
dc.rights.licenceCreative Commons - Attribution 4.0en
ssoar.contributor.institutionGESISde
internal.statusformal und inhaltlich fertig erschlossende
internal.identifier.thesoz10047326
internal.identifier.thesoz10040380
dc.type.stockarticlede
dc.type.documentZeitschriftenartikelde
dc.type.documentjournal articleen
dc.source.pageinfo287-301de
internal.identifier.classoz1080501
internal.identifier.journal174
internal.identifier.document32
internal.identifier.ddc070
dc.source.issuetopicSpecial Issue on Selected Papers from the Joint Conference on Digital Libraries (JCDL 2021 and 2022)de
dc.identifier.doihttps://doi.org/10.1007/s00799-023-00363-4de
dc.description.pubstatusVeröffentlichungsversionde
dc.description.pubstatusPublished Versionen
internal.identifier.licence16
internal.identifier.pubstatus1
internal.identifier.review1
ssoar.wgl.collectiontruede
internal.pdf.validtrue
internal.pdf.wellformedtrue
internal.pdf.encryptedfalse
ssoar.urn.registrationfalsede
ssoar.licence.fundFunded by the German Research Foundation (DFG) - Grant MA 3964/10-1, the "Establishing Contextual Dataset Retrieval - transferring concepts from document to dataset retrieval" (ConDATA) project at GESIS


Files in this item

Thumbnail

This item appears in the following Collection(s)

Show simple item record