Apache Solri õpetus: mis on Solr? Architektuur
⚡ Nutikas kokkuvõte
Apache Solr on avatud lähtekoodiga, JavaApache Lucene'il põhinev otsinguserver. See indekseerib suuri tekstikesksete andmete mahtusid ja tagastab asjakohaseid tulemusi REST API-de kaudu, pakkudes täistekstiotsingut, tahumist, skaleeritavust ning nii eraldiseisvat kui ka SolrCloudi juurutamisrežiimi.

Mis on Apache Solr?
Apache Solr on avatud lähtekoodiga otsinguserveri platvorm, mis on sisse kirjutatud Java keel Apache tarkvarafondi poolt. See on väga skaleeritav ja valmis juurutama otsingumootorit suure hulga tekstikesksete andmete käsitlemiseks. Apache Solri kasutamise eesmärk on indekseerida ja otsida suurel hulgal veebisisu ning anda otsingupäringu põhjal asjakohast sisu.
Apache Solr on REST-API-põhine HTTP-mähis, mis ümbritseb täistekstiotsingumootorit nimega Apache Lucene. Pööratud register on sõnade loend, kus iga sõnakirje lingib dokumentidele, milles see on salvestatud. Nii saadakse kõik dokumendid otsingupäringu "guru99" jaoks lihtsa hankimistoiminguga.
Apache Solri ajalugu
- 1999: Doug Cutting avaldas Lucene'i
- 2004: Solri töötas CNETis välja Yonik Seeley osalise ettevõttesisese projektina
- 2006: CNET avaldas lähtekoodi, annetades selle Apache tarkvarale Foundation
- 2008: ilmus Solr 1.3 täiustatud otsinguvõimaluste ja jõudluse täiustustega
- 2010: Lucene'i ja Solri ühinemine
- 2012: ilmus Solri versioon 4.0 koos uue Solr Cloudi funktsiooniga
- 2016: ilmus Solr 6.0, mis pakub tuge paralleelsete SQL-päringute täitmiseks
- 2017: Ilmus Solr 7.0, mis lisas automaatse skaleerimise raamistiku ja JSON Facet API.
- 2019: Solr 8.0 avaldati pesastatud dokumentide toega ja täiustatud voogedastusavaldistega
- 2021: Lucene ja Solr eraldusid uuesti ning Solrist sai iseseisev Apache tipptasemel projekt
- 2022: Solr 9.0 ilmus esimese Lucene'ist sõltumatu versioonina, lisades vektorotsingu ja Kubernetes'i toe.
- 2026: Solr 10.0 ilmus uusima põhiversioonina
Apache Solri omadused
Siin on Apache Solri olulised funktsioonid:
- Automaatne koormuse tasakaalustamine
- Standardipõhised avatud liidesed – XML, JSON ja HTTP
- Soovitused ja õigekirja soovitused on toetatud
- Automaatse täitmise ja georuumilise otsingu tugi
- Sisseehitatud turvalisus autentimiseks ja autoriseerimiseks
- Võimaldab teil teha mitmekeelset märksõnaotsingut
- Automaatne täitmine/Ette sisestamise ennustus
- Pakett- ja voogesitustöötlus
- Masinõppemudelite loomine on lihtne
- Spetsiaalselt optimeeritud suure mahuga veebiliikluse jaoks
- Põhjalikud HTML-i imetlusliidesed
- Toetab nii skeemi kui ka skeemita konfiguratsiooni
- Lihvitud otsing ja filtreerimine
- Keskne konfiguratsioon kogu jaoks Cluster
Apache Solris kasutatavad põhiterminid
Nüüd selles Solri otsingumootori õpetuses õpime tundma Apache Solris kasutatavaid võtmetermineid:
| Võtmetermin | Kirjeldus |
|---|---|
| Solr Core | Solr Core'i saab defineerida kui kõigist dokumentidest tuletatud tekstide ja väljade indeksit. Ühel Solr eksemplaril võib olla üks või mitu Solr Core'i. Core = Lucene indeksi eksemplar + Solr konfiguratsioon. |
| Solri näide | Solri eksemplar on Solri eksemplar, mis töötab rakenduses Java Virtuaalne masin (FMV). Eraldiseisvas režiimis pakub see ainult ühte eksemplari, samas kui pilverežiimis võib teil olla üks või mitu eksemplari. |
| Indekseerimine | Indekseerimine on meetod dokumendi sisu lisamiseks Solr Indexi. Apache Solr kasutab Apache Lucene Inverted Indexi tehnikat. |
| Dokument | See on grupp valdkondi ja nende väärtusi. Dokument on Apache Core'i salvestatud andmete põhiühik. Üks Apache tuum võib sisaldada ühte või mitut dokumenti. |
| Väli | Väli on võtme-väärtuse paar, mis salvestab dokumendis tegelikke andmeid. Võti määrab välja nime ja väärtus sisaldab neid väljaandmeid. Dokumendil võib olla üks või mitu välja. Apache Solr kasutab seda dokumendi sisu indekseerimiseks. |
| Rahulikud API-d | Solriga suhtlemiseks ei pea olema kasutatud Java programmeerimine. Selle asemel pakub Apache Solr rahustavad teenused sellega suhelda. Saate dokumente saata ja tulemusi vastu võtta erinevates failivormingutes, nagu JSON, XML ja CSV. |
| Täisteksti otsing | Solr pakub täistekstiotsingu funktsioone, nagu märgid, fraasid, õigekirjakontroll, automaatne täitmine, metamärk jne. |
| Administraatori liides | Solr pakub lihtsalt kasutatavat, kasutajasõbralikku, funktsioonidega töötavat kasutajaliidest. Liidese abil saate täita selliseid toiminguid nagu logide haldamine, dokumentide lisamine, kustutamine, värskendamine ja otsimine. |
| Tekstikeskne ja asjakohasuse järgi sorteeritud | Apache Solri kasutatakse tekstidokumentide otsimiseks ja tulemused edastatakse vastavalt kasutaja päringule. |
| sõlme | Solri pilves nimetatakse iga üksikut eksemplari sõlmeks. |
| Cluster | Klaster on sõlmede kogum. |
| kogumine | Klastril on loogiline indeks, mida nimetatakse ka koguks. |
| Shard | See on kollektsiooni väike ala, mis pakub indeksi ühte või mitut koopiat. |
| Replica | Replica on sõlmes töötava killu koopia. |
| Juht | See on killu koopia, mis saadab Solr Cloudi päringud ülejäänud koopiate jaoks. |
Apache Solr Architektuur
Nüüd selles Solri otsingu õpetuses tutvume Apache Solriga ArchiStruktuur:

Apache Solr kahjustab järgmisi komponente
Query
Päringuparser parsib päringud, mis tuleb Solrile edastada. See kontrollib teie päringut süntaktiliste vigade osas. Pärast päringute parsimist teisendab see need Lucene'ile teadaolevasse vormingusse.
Päringu käsitleja
Apache Solrile saadetud päringuid töötleb päringukäitleja. Päring võib olla päringupäring või indeksi uuendamise päring. Peate valima päringukäitleja vastavalt oma vajadustele. Solrile päringu edastamiseks peate käitleja konkreetsele üksusele siduma. URL lõpp-punkt.
Vastus Writer
Vastuste kirjutaja genereerib sisendpäringute jaoks vormindatud väljundid. See toetab erinevaid vorminguid, nagu XML, JSON, CSV.jne. Erinevat tüüpi päringute jaoks võivad teil olla erinevad vastuste kirjutajad.
Värskenda haldurit
Kui saadate Apache Solrile värskendustaotluse, läbib see pluginate, signatuuri, logimise ja indekseerimise komplekti. Seda protsessi nimetatakse värskendustaotluste protsessoriks. Värskenduste käitleja vastutab ka muudatuste, näiteks lisamise või eemaldamise eest.ping esitatud jne.
Apache Solri rakendused
| taotlus | Kasutus |
|---|---|
| Intraneti portaal |
|
| Liitklient |
|
| Instrumentide andmestikud |
|
| Normatiivdokumendid |
|
| Manustatud PLM-i rakendusse |
|
Kuidas installida Apache Solr?
Step 1) Avage veebisait ja jätkake tellimist
Mine selle juurde link, klõpsake nuppu "Jätka tellimist".
Step 2) Klõpsake nuppu Nõustu tingimustega
Järgmisel lehel klõpsake nuppu Nõustu tingimustega.
Step 3) Oodake mõnda aega
Järgmiseks oodake mõnda aega ja seejärel võetakse taotlus mõne aja pärast vastu.
Step 4) Jätkake jaotisega Seadistused
Värskendage lehte ja klõpsake nuppu "Jätka konfiguratsiooni".
Step 5) Jätkake käivitamisega
Jätke vaikeseaded ja klõpsake nuppu "Jätka käivitamiseks".
Step 6) Hoidke vaikeseaded
Järgmisel lehel hoidke vaikeseaded
- Veenduge, et teil oleks võtme pem-fail
- Klõpsake nuppu "Käivita"
Näete seda eduteadet
Step 7) Pange tähele avalikku DNS-i
EC2 konsoolis märkige üles oma eksemplari avalik DNS
Step 8) Ava allpool URL
Solrile juurdepääsuks kasutage lihtsalt URL
http://publicdns:8983
meie puhul saab sellest
http://ec2-18-221-175-53.us-east-2.compute.amazonaws.com:8983
Märkus. Kui teil on eksemplarile juurdepääsuga probleeme, muutke oma eksemplaris sissetuleva ja väljamineva väljamineku reegleid, et lubada kogu liiklus, nagu on näidatud allolevas Solri päringu näites:
Elasticsearch vs. Apache Solr
| parameetrid | Apache Solr | Elastne otsing |
|---|---|---|
| loodus | See on avatud lähtekoodiga projekt. | Pole avatud lähtekoodiga projekt. |
| Staatiline olek | Staatiline failis shema.xml | Staatiline elasticsearch.yml |
| vorming | XML, CSV, JSON | Ainult JSON |
| indeks | Saab kogumise/tuuma uuesti laadimisega käitusajal uuesti laadida | Määratletakse indeksi/tüübi loomisel REST-kõnega |
| dokumentatsioon | See on hästi dokumenteeritud. | See on halvasti dokumenteeritud. |
| Kildude poolitamine | Võimalik | Pole võimalik |
Apache Solri eelised
- Aitab teil vähendada teabe leidmiseks kuluvat aega
- See on kiire, lihtne, võimas ja paindlik otsingumootor
- Aitab teil muuta oma tooted ja teenused kättesaadavamaks
- Suurendage klientide kulutusi veebirakendusele
- Aitab teil parandada veebirakenduse kasutuskogemust, et suurendada tulusid ja kasumit
- Põhjalik HTML-põhine haldusliides
- Paindlik ja kohandatav XML-konfiguratsiooniga
- Laiendatav pistikprogramm Architektuur
- Väga skaleeritav, töökindel, tõrketaluv otsingumootor
- Toetab hajutatud, varjutamist, replikatsiooni, Clustering ja Multi-Node Architektuur
Apache Solri puudused
- See ei ole ACID-ühilduv andmepood
- See ei ole esmase andmehoidlana kasulik. Kasulik ainult sekundaarse andmehoidlana
- Ei paku tuge tehingute ja hajutatud tehingute jaoks
- Ei toeta liitumisi ja keerulisi päringuid
- Ei ole normaliseeritud andmete jaoks optimaalne










