Nagios Tutorial: Hvad er Nagios Værktøj? Archikonstruktion og installation

⚡ Smart opsummering

Nagios er en open source-overvågningsplatform, der kontinuerligt overvåger servere, netværk, applikationer og tjenester og advarer teams om fejl i realtid, så problemer løses hurtigt på tværs af en hel DevOps-infrastruktur.

  • 🔍 Kontinuerlig overvågning: Kontinuerlig overvågning registrerer, rapporterer og reagerer på fejl og angreb på tværs af infrastrukturen, når en applikation er implementeret på serveren.
  • 🧩 Kerne komponenter: Tre dele definerer Nagios — webgrænsefladen eller den grafiske brugergrænseflade, Nagios server og plugins, der kører på eksterne værter.
  • 🏗️ Archilære: En server-side scheduler udløser plugins på eksterne værter, som returnerer statusdata, der opdaterer den grafiske brugergrænseflade og sender notifikationer.
  • 🔌 Plugins: Plugins som NRPE, NSCA og check_nt monitorerer Linux, Mac OS X og Windows værter over sikre SSL-forbindelser.
  • ☁️ Installation: Nagios implementeres hurtigt på AWS ved at abonnere via Marketplace, oprette forbindelse via PuTTY og logge ind som nagiosadmin.
  • 📊 Applikationer: Nagios leverer sundhedstjek på én konsol for datacenterservere, middleware, messaging og komplette forretningsprocesser.
  • ⚠️ Begrænsninger: Avancerede dashboards og guider kræver den betalte version Nagios XI; Nagios Core overvåger kun netværk i stedet for at administrere dem.

Nagios en vejledning, der dækker arkitektur, plugins og AWS-installation til kontinuerlig overvågning

Nagios er et af de mest anvendte open source-værktøjer til kontinuerlig overvågning af IT-infrastruktur. Denne vejledning forklarer, hvad Nagios hvordan dens klient-server-arkitektur og plugins fungerer, hvordan man installerer den på AWS, og hvor den passer ind i en moderne DevOps workflow.

Hvad er kontinuerlig overvågning?

Kontinuerlig overvågning er praksissen med at detektere, rapportere og reagere på ethvert problem eller angreb, der opstår på tværs af en infrastruktur. Når en applikation er implementeret på en server, overtager kontinuerlig overvågning opgaven med at overvåge virksomhedens systemer og reagere passende. Det supplerer kontinuerlige integrationsværktøjer som f.eks. Jenkins ved at udvide automatiseret overvågning til produktionen.

Hvad er Nagios?

Nagios er open source-software til kontinuerlig overvågning af systemer, netværk og infrastrukturer. Den kører plugins, der er gemt på en server og forbundet til en vært eller en anden server på dit netværk eller internettet. Når der opstår en fejl, Nagios udløser en alarm, så det tekniske team kan begynde gendannelsesprocessen med det samme.

Fordi den overvåger systemer, applikationer, tjenester og forretningsprocesser døgnet rundt, Nagios er et populært valg til kontinuerlig overvågning inden for en DevOps-kultur.

Hvorfor har vi brug for Nagios?

Her er de vigtige grunde til at bruge Nagios overvågningsværktøj:

  • Registrerer alle typer netværks- og serverproblemer.
  • Hjælper dig med at finde den grundlæggende årsag til et problem, så du kan anvende en permanent løsning.
  • Overvåger aktivt hele din infrastruktur og dine forretningsprocesser.
  • Giver dig mulighed for at overvåge og fejlfinde problemer med serverens ydeevne.
  • Hjælper dig med at planlægge infrastrukturopgraderinger, før forældede systemer skaber fejl.
  • Hjælper dig med at opretholde sikkerheden og tilgængeligheden af ​​dine tjenester.
  • Kan automatisk løse problemer i kritiske situationer.

Historie Nagios

1996 – Ethan Galstad skaber et simpelt MS-DOS-program, der “pings” Novell NetWare-servere og sender numeriske sider. Det grundlæggende arkitekturkoncept, der senere blev brugt til Nagios er født.

1998 – Ethan bruger ideerne og arkitekturen fra sit tidligere arbejde til at begynde at bygge en ny applikation, der kører på Linux OS.

1999 – Projektet udgives som open source under navnet “NetSaint.” De plugins, der oprindeligt blev distribueret som en del af NetSaint-distributionen, opdeles snart i en separat Nagios Plugins-projekt.

2002 – Ethan omdøber projektet til “Nagios" på grund af varemærkeproblemer med navnet "NetSaint."

2005 - Nagios bliver SourceForgeMånedens .net-projekt i juni.

2007 – Ethan grundlægger Nagios Enterprises, LLC skal levere konsulent- og udviklingstjenester omkring Nagios.

2009 - Nagios Enterprises udgiver sin første kommercielle version, Nagios XIOpen source-projektet er omdøbt Nagios Core.

2010 - Nagios Fusion udgives som et centralt dashboard til flere overvågningsservere.

2013 - Nagios Core 4 udgives sammen med Nagios Network Analyzer og NCPA-agenten på tværs af platforme.

2014 - Nagios Log Server er udgivet til overvågning og administration af virksomhedslogfiler.

2015 - Nagios XI 5 ankommer med over 200 forbedringer og udvidelser.

2016 - Nagios Core overstiger 7,500,000 downloads direkte fra SourceForge.net hjemmeside.

2017 - Nagios Log Server 2 er udgivet, og Nagios krydser 1,200 softwaredownloads om dagen.

2019 – Ethan Galstad træder tilbage som administrerende direktør for Nagios Virksomheder og ansætter en efterfølger.

2022 – Ethan Galstad genoptager sin stilling som administrerende direktør.

2023 – 2024R1-versionerne af Nagios XI, Logserver, Network Analyzerog Fusion udgives med større opdateringer til hvert produkt.

2024 - Nagios Enterprises fejrer sit 25-års jubilæum og Nagios XI dens 15. Nagios Kerne overstiger 8,500,000 SourceForge.net downloads, Nagios Bibliotekswebstedet er genlanceret, og den første version af Nagios Core Services Platform (CSP) sendes til fællesskabet.

2025 – Den sjette Nagios Verdenskonferencen afholdes på virksomhedens hovedkvarter i St. Paul, Minnesota. Nagios rapporterer mere end 10,000 kunder og vokser til 100 medarbejdere. Nagios Log Server 2026 leveres med en ny Simple Search-hjemmeside og en opgradering til OpenSeamarts 3.1.0.

2026 - Nagios Core 4.5.x fortsætter med vedligeholdelses- og sikkerhedsudgivelser (4.5.11 i januar, 4.5.13 i maj), mens Nagios XI går videre til 2026R1-serien med nye konfigurationsguider til Red Hat OpenShift. Nagios Verdenskonferencen 2026 er planlagt til den 14.-17. september i St. Paul, Minnesota.

Funktioner af Nagios

Følgende er de vigtige funktioner ved Nagios overvågningsværktøj:

  • Relativt skalerbar, håndterbar og sikker.
  • Leverer et godt log- og databasesystem.
  • Tilbyder informativ og kl.tracaktive webgrænseflader.
  • Sender automatisk advarsler, når en tilstand ændrer sig.
  • Springer overflødige kontroller over, når tjenesterne allerede kører fint.
  • Hjælper dig med at opdage netværksfejl og servernedbrud.
  • Giver dig mulighed for at fejlfinde problemer med serverens ydeevne.
  • Løser problemer automatisk, når de identificeres under overvågning.
  • Overvåger hele din forretningsproces og IT-infrastruktur i én omgang.
  • Bruger en arkitektur, der gør det nemt at skrive nye plugins i det sprog, du ønsker.
  • Læser sin konfiguration fra en hel mappe, helping Du bestemmer, hvordan du definerer individuelle filer.
  • Bruger topologi til at bestemme værtsafhængigheder.
  • Overvåger netværkstjenester som HTTP, SMTP, SNMP, FTP, SSH og POP.
  • Hjælper dig med at definere et netværksværtshierarki ved hjælp af overordnede værter.
  • Giver dig mulighed for at definere hændelseshandlere, der kører under service- eller værtshændelser, for proaktiv problemløsning.
  • Understøtter implementeringen af ​​redundante overvågningsværter.

Nagios Architecture

Nagios bruger en klient-server-arkitektur. På et typisk netværk er Nagios serveren kører på en vært, mens plugins kører på alle de eksterne værter, der skal overvåges.

Nagios Diagram over klient-server-arkitektur, der viser serveren, planlæggeren og de eksterne plugins

  1. Planlæggeren er en komponent i serverdelen af NagiosDen sender et signal om at køre plugins på den eksterne vært.
  2. Plugin'et henter status fra den eksterne vært.
  3. Plugin'et sender dataene tilbage til procesplanlæggeren.
  4. Procesplanlæggeren opdaterer den grafiske brugergrænseflade, og der sendes meddelelser til administratorer.

plugins

Nagios plugins leverer den lavniveau-intelligens, der fortæller Nagios Core hvordan man overvåger næsten alt. Et plugin fungerer som en selvstændig applikation, men det er designet til at blive udført af Nagios Kerne. Det forbinder til Apache, som styres af CGI for at vise resultatet, mens en tilsluttet database gemmer logfilerne.

Hvordan fungerer plugins?

Diagram, der viser, hvordan en Nagios plugin kommunikerer med overvågningsserveren

Overvej eksemplet ovenfor:

  • Check_nt er et plugin, der bruges til at overvåge en Windows maskine, og den er normalt tilgængelig på overvågningsserveren.
  • NSClient++ bør installeres på alle Windows maskine, du vil overvåge.
  • En SSL-forbindelse mellem serveren og værten udveksler løbende information mellem dem.

Tilsvarende NRPE (Nagios Remote Plugin Executor) og NSCA-plugins bruges til at overvåge henholdsvis Linux- og Mac OS X-værter.

GUI

Nagios Grænsefladen viser websider genereret af CGI. Den kan vise status via farvede knapper (grønne eller røde), lyde, grafer og mere.

Når en blød alarm udløses gentagne gange, bliver den til en hård alarm, og Nagios Serveren sender derefter en besked til administratoren.

Nagios web GUI dashboard, der viser værts- og tjenestestatus

Sådan installeres Nagios Værktøj hos AWS

Trin 1) Abonner på Nagios.
Gå til Nagios notering på AWS Marketplace og klik på Fortsæt for at abonnere.

Abonnerer på Nagios produkt på AWS Marketplace

Trin 2) Læs vilkårene og betingelserne, og accepter dem derefter.

Accept af vilkår og betingelser for Nagios AWS-abonnement

Trin 3) Se beskeden. Du vil se en besked om afventende abonnement.

Besked om afventende abonnement til Nagios på AWS

Trin 4) Udfør konfigurationen. Opdater siden efter et par minutter, og klik på Fortsæt til konfiguration.

Fortsætter til konfigurationstrinnet for Nagios på AWS

Trin 5) Launch NagiosBehold standardindstillingerne, og klik på Fortsæt for at starte.

Lancering af Nagios instans med standardindstillinger på AWS

Trin 6) RevSe indstillingerne, opret en ny nøgle, og klik på Start.

RevVisning af indstillinger og oprettelse af et nøglepar før opstart Nagios

Trin 7) Bemærk den offentlige DNS for din instans.

Noter det offentlige DNS-navn på Nagios EC2 forekomst

Trin 8) Konverter pem-filen til ppk. På din Windows maskine, brug PuTTY-generatoren til at konvertere pem-filen til en ppk-fil.

Konvertering af en pem-nøgle til ppk-format med PuTTYgen

Trin 9) I PuTTY skal du indtaste den offentlige DNS.

Indtastning af den offentlige DNS i PuTTY-sessionsfeltet

Trin 10) I afsnittet Godkendelse skal du indtaste ppk-nøglen og klikke på Åbn.

Tilføjelse af ppk's private nøgle i PuTTY Auth-sektionen

Trin 11) I terminalen skal du indtaste loginnavnet ubuntu og køre kommandoen.

  1. Kør denne kommando: sudo htpasswd -c /etc/nagios3/htpasswd.users nagiosadmin
  2. Indtast en ny adgangskode efter eget valg.

Indstilling af nagiosadmin-adgangskoden med htpasswd-kommandoen i terminalen

Trin 12) Åbn din browser og gå til http:// /nagios3 (i dette eksempel, http://ec2-54-209-48-136.compute-1.amazonaws.com/nagios3/).

Indtast brugernavn: nagiosadmin

Adgangskode: den, der blev angivet i forrige trin.

Logge ind på Nagios webgrænseflade som nagiosadmin

Trin 13) Nagios installationen er udført, og Nagios belastninger.

  Nagios Dashboard indlæst efter en vellykket AWS-installation

Anvendelse af Nagios

Nagios netværksovervågningsværktøj er et sundhedstjek- og overvågningssystem til et typisk datacenter, der dækker alle typer udstyr, såsom:

  • Servere og netværksnoder.
  • Applikationsovervågning fra en enkelt konsol.
  • Applikationsovervågning med indsigt på transaktionsniveau.
  • Middleware og messaging-komponenter.
  • Tilpasselige rapporter og dashboards.
  • UPS-backupsystemer.
  • Biometriske identifikationssystemer.
  • Temperatur- og fugtighedskontrolsystemer (følermekanismer).
  • CCTV- og NVR-systemer.
  • Lagringsundersystemer (NAS og SAN).

Ulemper ved at bruge Nagios

  • Vigtige funktioner såsom guider og interaktive dashboards er kun tilgængelige i Nagios XI, hvilket er et ret dyrt værktøj.
  • Nagios Core har en forvirrende brugerflade for nye brugere.
  • Den bruger mange konfigurationsfiler, der kan være svære at sætte op.
  • Nagios kan ikke overvåge netværksgennemstrømning.
  • Værktøjet giver dig mulighed for at overvåge netværket, men ikke administrere det.
  • Nagios skelner ikke mellem enheder som servere, routere eller switche, fordi den behandler alle enheder som en vært.

Ofte Stillede Spørgsmål

Nagios Core er gratis open source-software udgivet under GNU GPL, så du kan downloade, køre og ændre den uden licensgebyrer. Nagios sælger også Nagios XI, en betalt kommerciel udgave, der tilføjer dashboards, guider og support oven i Core.

Nagios Core er primært skrevet i C for ydeevne, mens mange af dens plugins og tilføjelser er oprettet i Perl, Pythonog shell-scripts. Den kører på Linux og de fleste Unix-lignende systemer, og dens webgrænseflade betjenes via CGI og en webserver.

Nagios Core er den gratis open source-motor, der er afhængig af manuel tekstfilkonfiguration. Nagios XI er den betalte udgave bygget på Core, der tilføjer en konfigurationsguide, grafer, kapacitetsplanlægning, dashboards, planlagte rapporter, en mobilapp og officiel teknisk support.

NRPE står for Nagios Ekstern plugin-eksekutor. Det er en agent installeret på eksterne Linux- eller Unix-værter, der lader Nagios serveren kører plugins der og indsamler lokale målinger såsom CPU-, disk- og hukommelsesforbrug via en sikker forbindelse.

Nagios bruger traditionel checkbaseret alarmering og er velegnet til stabile, mindre ejendomme. Zabbix er en alt-i-en, agentbaseret platform med stærke dashboards, mens Prometheus bruger pull-baserede metrikker, der er ideelle til cloud-native og Kubernetes-miljøer.

Ja. Nagios skærme Windows servere, der bruger NSClient++-agenten med check_nt-pluginnet, og den overvåger Linux-, Unix- og Mac OS X-værter via NRPE- og NSCA-pluginnet. Dette giver en enkelt Nagios Serverovervågning af et blandet operativsystemmiljø.

Analyse af AI og maskinlæringsværktøjer Nagios logfiler og alarmhistorik for at reducere støj, grupperelaterede alarmer og markere uregelmæssigheder før afbrydelser. De kan forudsige fejl ud fra ydeevnetendenser og foreslå tærskler, selvom ingeniører bør gennemgå alle anbefalinger, før de implementeres.

Ja. ChatGPT og GitHub Copilot kan udkaste Nagios objektdefinitioner, værtsgrupper, servicetjek og NRPE-kommandolinjer fra en kort beskrivelse. Gennemgå altid den genererede konfiguration for korrekt syntaks, stier og tærskler, før den implementeres i produktion.

Opsummer dette indlæg med: