In mijn vorige blogpost keek ik 10 jaar terug naar de voorloper van ons Omega-systeem, het zoeksysteem waarmee we zelf de Elsevier tijdschriften doorzoekbaar maakten. In deze en volgende blogposts wil ik eens vooruit kijken naar mogelijke nieuwe ontwikkelingen op het terrein van geïntegreerd zoeken.
Al eerder beschreef ik hier en hier dat ook andere UB's intussen een voorkeur beginnen te krijgen voor de oplossing voor geïntegreerd zoeken zoals die bij ons de afgelopen 10 jaar vorm heeft gekregen in Omega.
Die voorkeur voor "integrated search" (zoeken via de index van een eigen zoekmachine waarin je alles integreert), boven "federated search" (een metasearch in een verscheidenheid aan zoeksystemen met nogal diverse indexeertechnieken) zien we overigens ook bij leveranciers doordringen.
Delft en Tilburg gebruiken Meresco (waarvan de ME van "metadata", de RE van "repository" en de S van "search" komt). Dat komt weliswaar uit de Open Source gemeenschap, maar wordt wel door een commercieel bedrijf ontwikkeld, onderhouden en geïmplementeerd.
Als zeer commercieel bedrijf is ook ExLibris een paar jaar geleden met Primo begonnen, een zoeksysteem gebaseerd op dezelfde Open Source zoekmachine Lucene/Solr als Meresco. Dat was aanvankelijk nog stevig gecombineerd met hun MetaLib metasearch. Maar intussen verzet men de bakens meer richting afzonderlijke Primo-indexen, die vanwege toepassing van dezelfde indexeertechniek makkelijk te combineren zijn. En zelfs kun je de te indexeren metadata, of die nu afkomstig zijn van tijdschriftuitgevers of uit je eigen catalogus, extern bij ExLibris laten hosten (en dus ook daar laten indexeren) onder de naam Primo Central. Een oplossing die ExLibris ons uiteraard ook probeert aan te smeren.
En een soortgelijke oplossing wordt nu ook door SerialsSolutions aangeboden onder de naam Summon. Hetgeen niet toevallig erg lijkt op Summa, een ooit bij Deense bibliotheken opgezet systeem op basis van Lucene, waarover ik ook ooit al eens blogde. Summon is intussen onder meer in gebruik bij de Universiteit van Liverpool en bij Dartmouth College en wordt ook een dezer dagen op proef bij onze Rotterdamse collega's in gebruik genomen.
Sommige van deze producten kunnen ons op ideeën brengen voor functionaliteit die we op dit moment nog niet in Omega gerealiseerd hebben. In volgende posts wil ik echter vooral kijken in hoeverre ook wij de integratie van onze zoeksystemen nog verder kunnen verbeteren.
[wordt vervolgd]
dinsdag 5 januari 2010
Het volgende Omega-decennium (1)
Gepost door
Eric
op
15:32
3
reacties
Labels: integrated_search, meresco, omega, Primo, Summon
maandag 17 december 2007
... la SUMMA sapienza e'l PRIMO amore ... (Dante?)
In mijn vorige post noemde ik al de toegenomen belangstelling voor het lokaal indexeren van materiaal, in plaats van het toepassen van metasearch (Federated search).
Nogal wat UKB bibliotheken waren tamelijk gecharmeerd van PRIMO, het product dat ExLibris hiervoor heeft ontwikkeld. Daarin worden lokaal indexeren en Federated search gecombineerd, al houdt men de zoekresultaten van die twee methoden wel strikt gescheiden. Als lokale zoekmachine gebruikt ExLibris de Open Source software Lucene. Toch wordt Primo bij nader inzien door de meeste bibliotheken te duur gevonden. Wat ExLibris om Lucene heen gebouwd heeft, is namelijk bij lange na niet gratis.
Men is dus naarstig op zoek naar iets anders. Bij een paar bibliotheken (Tilburg, Delft) lijkt SUMMA nu hoge ogen te gooien. Dat is een product dat door de State and University Library in Aarhus (Denemarken) is ontwikkeld. De zoekmachine daarin is ook Lucene, maar in dit geval is het hele product als Open Source opgezet. Wat de techniek betreft, lijkt het (uiteraard) nogal op Omega. Wat betreft de inhoud richt Summa zich echter niet specifiek op full-text materiaal zoals Omega doet. Men wil vooral catalogi en van commerciële producenten verkregen bibliografische databases doorzoekbaar maken. Zo heeft men al een overeenkomst met CSA, om hun databases voor CSA-klanten geïntegreerd doorzoekbaar te maken met Summa.
Na een bezoek aan Aarhus, eind september, waren de vertegenwoordigers van eerder genoemde bibliotheken tamelijk enthousiast. Vorige week hoorde ik dat alles toch nog niet zo van een leien dakje loopt als gehoopt was, omdat men nog niet zelf over de broncode kan beschikken en alles nog alleen op de servers in Denemarken schijnt te draaien. Zo lijkt elke oplossing dus weer zijn eigen problemen op te leveren.
Er is voor de collega's (behalve Omega ...) ook nog wel een ander alternatief: VUfind. Ook dat is Open Source, ontwikkeld aan Villanova University (?) in Pennsylvania. Maar dat is wel weer wat verder weg (en die naam klinkt ook wat obscuur ....).

