Start solr with fi-biblio core listening on port 8983.
./docker-run.sh
Start using Voikko with the following filter declaration in Solr schema configuration:
<filter class="fi.nationallibrary.ndl.solrvoikko2.VoikkoFilterFactory" expandCompounds="true" allAnalysis="true"/>
The following options are available for configuring the behavior of Voikko plugin:
See more details here: https://github.com/NatLibFi/SolrPlugins/wiki/Voikko-pluginā (bit outdated?)
Example text field with Finnish language (https://github.com/NatLibFi/NDL-VuFind-Solr/blob/master/vufind/biblio/conf/schema.xmlā )
<fieldType name="text" class="solr.TextField" positionIncrementGap="100">
<similarity class="solr.ClassicSimilarityFactory"/>
<analyzer type="index">
<tokenizer class="solr.ICUTokenizerFactory"/>
<filter class="solr.LowerCaseFilterFactory"/>
<filter class="solr.WordDelimiterFilterFactory" generateWordParts="1" generateNumberParts="1" catenateWords="1" catenateNumbers="1" catenateAll="0" splitOnCaseChange="0" protected="delim_protected.txt"/>
<filter class="fi.nationallibrary.ndl.solrvoikko2.VoikkoFilterFactory" expandCompounds="true" allAnalysis="true" cacheSize="2500" statsInterval="0"/>
<filter class="solr.CommonGramsFilterFactory" words="stopwords.txt" ignoreCase="true"/>
<filter class="solr.StopFilterFactory" ignoreCase="true" words="stopwords.txt"/>
<charFilter class="solr.MappingCharFilterFactory" mapping="mapping-FoldToASCII_fi.txt"/>
<filter class="solr.KeywordMarkerFilterFactory" protected="protwords.txt"/>
<filter class="solr.EnglishMinimalStemFilterFactory"/>
<filter class="solr.RemoveDuplicatesTokenFilterFactory"/>
</analyzer>
<analyzer type="query">
<tokenizer class="solr.ICUTokenizerFactory"/>
<filter class="solr.LowerCaseFilterFactory"/>
<filter class="solr.WordDelimiterFilterFactory" generateWordParts="1" generateNumberParts="1" catenateWords="0" catenateNumbers="0" catenateAll="0" splitOnCaseChange="0" protected="delim_protected.txt"/>
<filter class="solr.SynonymFilterFactory" synonyms="synonyms.txt" ignoreCase="true" expand="true"/>
<filter class="fi.nationallibrary.ndl.solrvoikko2.VoikkoFilterFactory" expandCompounds="true" allAnalysis="true"/>
<filter class="solr.CommonGramsQueryFilterFactory" words="stopwords.txt" ignoreCase="true"/>
<filter class="solr.StopFilterFactory" ignoreCase="true" words="stopwords.txt"/>
<charFilter class="solr.MappingCharFilterFactory" mapping="mapping-FoldToASCII_fi.txt"/>
<filter class="solr.KeywordMarkerFilterFactory" protected="protwords.txt"/>
<filter class="solr.EnglishMinimalStemFilterFactory"/>
<filter class="solr.RemoveDuplicatesTokenFilterFactory"/>
</analyzer>
</fieldType>
Voikko Solr plugin (https://github.com/niilo/SolrPluginsā ) uses LibVoikko (https://github.com/voikko/corevoikko/tree/master/libvoikkoā )
Content type
Image
Digest
Size
371.9 MB
Last updated
over 9 years ago
docker pull niilo/solr-fi