Apache Solri õpetus: mis on Solr? Architektuur

⚡ Nutikas kokkuvõte

Apache Solr on avatud lähtekoodiga, JavaApache Lucene'il põhinev otsinguserver. See indekseerib suuri tekstikesksete andmete mahtusid ja tagastab asjakohaseid tulemusi REST API-de kaudu, pakkudes täistekstiotsingut, tahumist, skaleeritavust ning nii eraldiseisvat kui ka SolrCloudi juurutamisrežiimi.

  • 🔍 Solri definitsioon: Avatud lähtekoodiga Java Apache Lucene'il ehitatud otsinguserver.
  • 🗂️ Indekseerimine: Kasutab tekstidokumentide salvestamiseks ja kiireks otsimiseks ümberpööratud indeksit.
  • 🌐 REST API-d: Suhtle HTTP kaudu JSON-i, XML-i või CSV-ga; ei Java nõutav.
  • 🧩 ArchiStruktuur: Päringu parser, päringute käitleja, vastuste kirjutaja ja värskenduste käitleja.
  • 🇧🇷 Solr vs Elasticsearch: Solr toetab XML/CSV/JSON-i ja shard-jagamist; mõlemad kasutavad Lucene'i.
  • ☁️ Kasutamine: Eraldiseisev režiim või SolrCloud koos sõlmede, shardide, koopiate ja klastritega.

Apache Solri õpetus

Mis on Apache Solr?

Apache Solr on avatud lähtekoodiga otsinguserveri platvorm, mis on sisse kirjutatud Java keel Apache tarkvarafondi poolt. See on väga skaleeritav ja valmis juurutama otsingumootorit suure hulga tekstikesksete andmete käsitlemiseks. Apache Solri kasutamise eesmärk on indekseerida ja otsida suurel hulgal veebisisu ning anda otsingupäringu põhjal asjakohast sisu.

Apache Solr on REST-API-põhine HTTP-mähis, mis ümbritseb täistekstiotsingumootorit nimega Apache Lucene. Pööratud register on sõnade loend, kus iga sõnakirje lingib dokumentidele, milles see on salvestatud. Nii saadakse kõik dokumendid otsingupäringu "guru99" jaoks lihtsa hankimistoiminguga.

Apache Solri ajalugu

  • 1999: Doug Cutting avaldas Lucene'i
  • 2004: Solri töötas CNETis välja Yonik Seeley osalise ettevõttesisese projektina
  • 2006: CNET avaldas lähtekoodi, annetades selle Apache tarkvarale Foundation
  • 2008: ilmus Solr 1.3 täiustatud otsinguvõimaluste ja jõudluse täiustustega
  • 2010: Lucene'i ja Solri ühinemine
  • 2012: ilmus Solri versioon 4.0 koos uue Solr Cloudi funktsiooniga
  • 2016: ilmus Solr 6.0, mis pakub tuge paralleelsete SQL-päringute täitmiseks
  • 2017: Ilmus Solr 7.0, mis lisas automaatse skaleerimise raamistiku ja JSON Facet API.
  • 2019: Solr 8.0 avaldati pesastatud dokumentide toega ja täiustatud voogedastusavaldistega
  • 2021: Lucene ja Solr eraldusid uuesti ning Solrist sai iseseisev Apache tipptasemel projekt
  • 2022: Solr 9.0 ilmus esimese Lucene'ist sõltumatu versioonina, lisades vektorotsingu ja Kubernetes'i toe.
  • 2026: Solr 10.0 ilmus uusima põhiversioonina

Apache Solri omadused

Siin on Apache Solri olulised funktsioonid:

  • Automaatne koormuse tasakaalustamine
  • Standardipõhised avatud liidesed – XML, JSON ja HTTP
  • Soovitused ja õigekirja soovitused on toetatud
  • Automaatse täitmise ja georuumilise otsingu tugi
  • Sisseehitatud turvalisus autentimiseks ja autoriseerimiseks
  • Võimaldab teil teha mitmekeelset märksõnaotsingut
  • Automaatne täitmine/Ette sisestamise ennustus
  • Pakett- ja voogesitustöötlus
  • Masinõppemudelite loomine on lihtne
  • Spetsiaalselt optimeeritud suure mahuga veebiliikluse jaoks
  • Põhjalikud HTML-i imetlusliidesed
  • Toetab nii skeemi kui ka skeemita konfiguratsiooni
  • Lihvitud otsing ja filtreerimine
  • Keskne konfiguratsioon kogu jaoks Cluster

Apache Solris kasutatavad põhiterminid

Nüüd selles Solri otsingumootori õpetuses õpime tundma Apache Solris kasutatavaid võtmetermineid:

Võtmetermin Kirjeldus
Solr Core Solr Core'i saab defineerida kui kõigist dokumentidest tuletatud tekstide ja väljade indeksit. Ühel Solr eksemplaril võib olla üks või mitu Solr Core'i. Core = Lucene indeksi eksemplar + Solr konfiguratsioon.
Solri näide Solri eksemplar on Solri eksemplar, mis töötab rakenduses Java Virtuaalne masin (FMV). Eraldiseisvas režiimis pakub see ainult ühte eksemplari, samas kui pilverežiimis võib teil olla üks või mitu eksemplari.
Indekseerimine Indekseerimine on meetod dokumendi sisu lisamiseks Solr Indexi. Apache Solr kasutab Apache Lucene Inverted Indexi tehnikat.
Dokument See on grupp valdkondi ja nende väärtusi. Dokument on Apache Core'i salvestatud andmete põhiühik. Üks Apache tuum võib sisaldada ühte või mitut dokumenti.
Väli Väli on võtme-väärtuse paar, mis salvestab dokumendis tegelikke andmeid. Võti määrab välja nime ja väärtus sisaldab neid väljaandmeid. Dokumendil võib olla üks või mitu välja. Apache Solr kasutab seda dokumendi sisu indekseerimiseks.
Rahulikud API-d Solriga suhtlemiseks ei pea olema kasutatud Java programmeerimine. Selle asemel pakub Apache Solr rahustavad teenused sellega suhelda. Saate dokumente saata ja tulemusi vastu võtta erinevates failivormingutes, nagu JSON, XML ja CSV.
Täisteksti otsing Solr pakub täistekstiotsingu funktsioone, nagu märgid, fraasid, õigekirjakontroll, automaatne täitmine, metamärk jne.
Administraatori liides Solr pakub lihtsalt kasutatavat, kasutajasõbralikku, funktsioonidega töötavat kasutajaliidest. Liidese abil saate täita selliseid toiminguid nagu logide haldamine, dokumentide lisamine, kustutamine, värskendamine ja otsimine.
Tekstikeskne ja asjakohasuse järgi sorteeritud Apache Solri kasutatakse tekstidokumentide otsimiseks ja tulemused edastatakse vastavalt kasutaja päringule.
sõlme Solri pilves nimetatakse iga üksikut eksemplari sõlmeks.
Cluster Klaster on sõlmede kogum.
kogumine Klastril on loogiline indeks, mida nimetatakse ka koguks.
Shard See on kollektsiooni väike ala, mis pakub indeksi ühte või mitut koopiat.
Replica Replica on sõlmes töötava killu koopia.
Juht See on killu koopia, mis saadab Solr Cloudi päringud ülejäänud koopiate jaoks.

Apache Solr Architektuur

Nüüd selles Solri otsingu õpetuses tutvume Apache Solriga ArchiStruktuur:

Apache Solr Architektuur
Apache Solr Architektuur

Apache Solr kahjustab järgmisi komponente

Query

Päringuparser parsib päringud, mis tuleb Solrile edastada. See kontrollib teie päringut süntaktiliste vigade osas. Pärast päringute parsimist teisendab see need Lucene'ile teadaolevasse vormingusse.

Päringu käsitleja

Apache Solrile saadetud päringuid töötleb päringukäitleja. Päring võib olla päringupäring või indeksi uuendamise päring. Peate valima päringukäitleja vastavalt oma vajadustele. Solrile päringu edastamiseks peate käitleja konkreetsele üksusele siduma. URL lõpp-punkt.

Vastus Writer

Vastuste kirjutaja genereerib sisendpäringute jaoks vormindatud väljundid. See toetab erinevaid vorminguid, nagu XML, JSON, CSV.jne. Erinevat tüüpi päringute jaoks võivad teil olla erinevad vastuste kirjutajad.

Värskenda haldurit

Kui saadate Apache Solrile värskendustaotluse, läbib see pluginate, signatuuri, logimise ja indekseerimise komplekti. Seda protsessi nimetatakse värskendustaotluste protsessoriks. Värskenduste käitleja vastutab ka muudatuste, näiteks lisamise või eemaldamise eest.ping esitatud jne.

Apache Solri rakendused

taotlus Kasutus
Intraneti portaal
  • Lihtne juurdepääs otsingule
  • Rakenduse käivitamine
  • Uudiste ja sündmuste teavitus
  • Ühekordse sisselogimisega autentimine
Liitklient
  • Lihtsustatud esitlus
  • Otsige kogu sisust
  • Ainult volitatud juurdepääs
  • Dokumendi vaatamine
Instrumentide andmestikud
  • Optimeeritud teadlastele
  • Andmetest sõltuvad menüüd
  • Spetsiaalsed võrgufiltrid
Normatiivdokumendid
  • Mõeldud teadlastele
  • Rikkalik juurdepääs metaandmetele
  • Arvutustabeli eksport
  • Vaata dokumendikiirendit
Manustatud PLM-i rakendusse
  • Pakub paremat otsingukogemust kui RDBMS võiks pakkuda
  • Hiline siduv turvamudel
  • Dokumenteerige tööriistaribal nähtavad toimingud

Kuidas installida Apache Solr?

Step 1) Avage veebisait ja jätkake tellimist
Mine selle juurde link, klõpsake nuppu "Jätka tellimist".

Installige Apache Solr

Step 2) Klõpsake nuppu Nõustu tingimustega
Järgmisel lehel klõpsake nuppu Nõustu tingimustega.

Installige Apache Solr

Step 3) Oodake mõnda aega
Järgmiseks oodake mõnda aega ja seejärel võetakse taotlus mõne aja pärast vastu.

Installige Apache Solr

Step 4) Jätkake jaotisega Seadistused
Värskendage lehte ja klõpsake nuppu "Jätka konfiguratsiooni".

Installige Apache Solr

Step 5) Jätkake käivitamisega
Jätke vaikeseaded ja klõpsake nuppu "Jätka käivitamiseks".

Installige Apache Solr

Step 6) Hoidke vaikeseaded
Järgmisel lehel hoidke vaikeseaded

  • Veenduge, et teil oleks võtme pem-fail
  • Klõpsake nuppu "Käivita"

Installige Apache Solr

Näete seda eduteadet

Installige Apache Solr

Step 7) Pange tähele avalikku DNS-i
EC2 konsoolis märkige üles oma eksemplari avalik DNS

Installige Apache Solr

Step 8) Ava allpool URL
Solrile juurdepääsuks kasutage lihtsalt URL

http://publicdns:8983

meie puhul saab sellest

http://ec2-18-221-175-53.us-east-2.compute.amazonaws.com:8983

Installige Apache Solr

Märkus. Kui teil on eksemplarile juurdepääsuga probleeme, muutke oma eksemplaris sissetuleva ja väljamineva väljamineku reegleid, et lubada kogu liiklus, nagu on näidatud allolevas Solri päringu näites:

Installige Apache Solr

Elasticsearch vs. Apache Solr

parameetrid Apache Solr Elastne otsing
loodus See on avatud lähtekoodiga projekt. Pole avatud lähtekoodiga projekt.
Staatiline olek Staatiline failis shema.xml Staatiline elasticsearch.yml
vorming XML, CSV, JSON Ainult JSON
indeks Saab kogumise/tuuma uuesti laadimisega käitusajal uuesti laadida Määratletakse indeksi/tüübi loomisel REST-kõnega
dokumentatsioon See on hästi dokumenteeritud. See on halvasti dokumenteeritud.
Kildude poolitamine Võimalik Pole võimalik

Apache Solri eelised

  • Aitab teil vähendada teabe leidmiseks kuluvat aega
  • See on kiire, lihtne, võimas ja paindlik otsingumootor
  • Aitab teil muuta oma tooted ja teenused kättesaadavamaks
  • Suurendage klientide kulutusi veebirakendusele
  • Aitab teil parandada veebirakenduse kasutuskogemust, et suurendada tulusid ja kasumit
  • Põhjalik HTML-põhine haldusliides
  • Paindlik ja kohandatav XML-konfiguratsiooniga
  • Laiendatav pistikprogramm Architektuur
  • Väga skaleeritav, töökindel, tõrketaluv otsingumootor
  • Toetab hajutatud, varjutamist, replikatsiooni, Clustering ja Multi-Node Architektuur

Apache Solri puudused

  • See ei ole ACID-ühilduv andmepood
  • See ei ole esmase andmehoidlana kasulik. Kasulik ainult sekundaarse andmehoidlana
  • Ei paku tuge tehingute ja hajutatud tehingute jaoks
  • Ei toeta liitumisi ja keerulisi päringuid
  • Ei ole normaliseeritud andmete jaoks optimaalne

KKK

Mõlemad on loodud Apache Lucene'i baasil. Solr on täielikult avatud lähtekoodiga, toetab XML-i, CSV-d ja JSON-i, võimaldab shardi jagamist ning on hästi dokumenteeritud. Elasticsearch aktsepteerib ainult JSON-i, ei toeta shardi jagamist ja seda valitakse sageli reaalajas analüüsiks.

Solri tuum on dokumentidest tuletatud tekstide ja väljade register koos selle Solri konfiguratsiooniga. Üks Solri eksemplar võib majutada ühte või mitut tuuma, millest igaüks toimib sõltumatu Lucene indeksina.

Apache Solr on REST-API-põhine HTTP-ümbris Apache Lucene'i ümber. Java täistekstiotsingumootor. Lucene pakub ümberpööratud indeksit, samas kui Solr lisab skaleeritavuse, konfigureerimise, REST API-d ja administraatori liidese.

Tehisintellekt saab Solrile lisada semantilise ja vektorotsingu, mudelite järjestamiseks õppimise ja päringute mõistmise. See toob esile asjakohasemaid tulemusi, käsitleb sünonüüme ja kavatsust ning parandab automaatset täitmist ja soovitusi.

Jah. Tehisintellekt saab soovitada skeemivälju, analüsaatoreid ja vahemälu sätteid, tuvastada aeglaseid päringuid ning soovitada killustamis- ja replikatsioonistrateegiaid.ping Meeskonnad häälestavad Solri jõudluse ja asjakohasuse saavutamiseks vähema katse-eksituse meetodiga.

Võta see postitus kokku järgmiselt: