Skip to content
Service status

Skriv for å søke

1 artikler · 3 min lesing

Intranett-crawler

Indekser og søk i organisasjonens intranettinnhold med Intrics MCP-baserte intranett-crawler.

Intranett-crawleren gjør det mulig for dine assistenter å søke og hente informasjon fra deres organisasjons interne intranett. Bygget på Model Context Protocol (MCP)-standarden gir den deres team autentisert tilgang til intranettinnhold direkte i Intric-samtaler.

Hver kunde får en separat deployment — en dedikert container, persistent volum, vektordatabase og ingress-søkväg — der dere bare deler containerversion. Deployments kan ikke dele databaser. Onboarding er en prosess som Intric-ingeniører kjører; det finnes ingen selvbetjent onboarding-prosess.

Crawleren indekserer innhold bak innloggingsbeskyttet intranett ved hjelp av autentiseringsopplysninger du oppgir under setup. Dette inkluderer ansattveiledere, policydokumenter, interne wikier og andre ressurser som krever autentisering.

Crawleren eksponerer tre MCP-verktøy og en ressurs:

Returnerer den her brukerguiden. Crawlerens egne instruksjoner sier til assistenten å kalle dette verktøyet først i hvert samtal. Kall det før noen andre crawler-verktøy.

Søk i indekser intranettinnhold og hent relevant informasjon som svar på brukerforespørsler. Hver bruker som kan nå verktøyet ser hver indekser sid. Indexet inneholder bare det som crawl-kontoen kunne nå under crawlingen, så nøye innsnevring av crawl-kontoen er avgjørende for å hindre overindeksering. Det finnes ingen rettighetskontroll ved spørringstid.

Korriger et svar — ikke indexet. Bruk det til å foreslå et bedre svar for et bestemt søkeresultat. Forslaget sendes til administratorer som kan granske, redigere og godkjenne endringer. Godkjente korrigeringer indekseres umiddelbart og har forrang fremfor crawlet innhold i fremtidige svar.

Returnerer informasjon om crawl-tilstanden, inkludert sider indekser, siste crawltid og crawl-feil.

Crawleren opererer som en tilpasset MCP-tjener som du konfigurerer via crawlerens egen adminpanel på https://mcp-servers.intric.ai/<kunde>-intranett/admin. Panelen er norsk-først med en engelsk-toggel, og er beskyttet av HTTP Basic-autentisering. Når den er konfigureret:

  1. Crawleren besøker periodisk konfiguerte URL-er på ditt intranett
  2. Den autentiserer ved hjelp av autentiseringsopplysningene du oppgir
  3. Innhold ekstraheres, behandles og indekseres
  4. Assistenter med Intranett-crawler-verktøyet kan søke i dette innholdet
  5. Brukere kan foreslå korrigeringer via et dedikert grensesnitt
  6. Administratorer gransker korrigeringer i crawlerens adminpanel

Crawleren besøker ditt intranett direkte på en planlagt basis. Planlagte crawls kjøres daglig kl. 02:00 UTC som standard, med en ytterligere inkrementell nyhets-crawl som kjøres hvert 30. minutt. Å endre et intervall krever en pod-omstart. Denne modusen krever nettverkstilgang til ditt intranett og autentiseringsopplysninger som er konfigurert under setup.

En alternativ oppsett der crawleren aldri rører ditt nettverk. I stedet crawler du ditt eget intranett med dine egne verktøy og overleverer en datafil til Intric, som indekserer den. Denne modusen:

  • Krever ingen nettverkstilgang til ditt intranett fra Intrics side
  • Krever ingen crawl-autentiseringsopplysninger
  • Bruker manuelle (ikke planlagte) oppdateringer — send en ny datafil når innholdet endres

Denne modusen er posisjoneret for sikkerhetskritiske kunder som ikke kan gi Intric tilgang til sitt intranett. Advarsel: en for-crawlet re-indeksering ødelegger godkjente korrigeringer, ettersom den sletter vektorsamlingen og erstatter den med en nyoppbygd.

Crawleren opererer under rettighetene til kontoen som er konfigurert under setup. Dette betyr:

  • Indexet inneholder bare innhold som crawl-kontoen kunne nå
  • Allt indekser innhold blir søkbart av hver bruker av en assistent med verktøyet tilknyttet — det finnes ingen per-bruker-filtering ved spørringstid
  • Nøye innsnevring av crawl-kontoen er avgjørende for å hindre overindeksering

Viktig: Gransk ditt intranetts rettighetsmodell før du konfigurerer crawleren. Hvis crawl-kontoen din har bred tilgang, vurder om allt indekser innhold bør være søkbart av alle brukere av assistenten.

Sikkerhetsklassifiseringsregler gjelder for Intranett-crawler-verktøyet akkurat som de gjør for andre verktøy i Intric. En assistent kan bare bruke crawleren hvis den oppfyller sikkerhetskravene til Space den tilhører.

Når et søkeresultat peker på en PDF eller annet dokument, tar klikk på referansen brukeren til foreldresiden som lenket til dokumentet — ikke til selve dokumentet. Dette er bevisst designet.

Ytterligere konfigurasjonsalternativer er tilgjengelige for spesifikke bruksfall. Kontakt oss for detaljer om:

  • Ekstra crawl-kilder — indekser en andre autentisert nettside i samme kunnskapsbase, med egne autentiseringsopplysninger
  • Ytterligere seed-URL-er — sider som ingen lenke på ditt intranett når
  • Ekstern-lenkekrawling — ett steg utenfor intranettet (standard av, max 500 sider)
  • Blokkerte-URL-karantene og skrapside-purging
  • Tvinget JavaScript-rendering
  • SharePoint søkebasert oppdagelse

Reddy for å aktivere intranett-søk for deres organisasjon?

  • Kontakt oss på support@intric.ai for å starte setup og samordne med vårt tekniske team
  • Les artikkelen nedenfor for å forstå setup-prosessen og forberede nødvendig informasjon.