Hoppa till innehåll
Service status

Skriv för att söka

1 artiklar · 3 min läsning

Intranätscrawler

Indeksera och sök i er organisations intranätsinnehåll med Intrics MCP-baserade intranätscrawler.

Intranätscrawlern gör det möjligt för dina assistenter att söka och hämta information från er organisations interna intranät. Byggt på Model Context Protocol (MCP)-standarden ger den er team autentiserad åtkomst till intranätsinnehåll direkt i Intric-samtal.

Varje kund får en separat deployment — en dedikerad container, persistent volym, vektordatabas och ingress-sökväg — där ni bara delar containervidden. Deploymentar kan inte dela databaser. Onboarding är en process som ingenjörer på Intric kör; det finns ingen självständig onboarding-flöde.

Crawlern indexerar innehåll bakom inloggningsskyddade intranät med hjälp av autentiseringsuppgifter som du tillhandahåller under setup. Detta inkluderar anställdhandböcker, policysdokument, interna wikis och andra resurser som kräver autentisering.

Crawlern exponerar tre MCP-verktyg och en resurs:

Returnerar den här användarguiden. Crawlerns egna instruktioner säger till assistenten att anropa detta verktyg först i varje samtal. Anropa det innan någon annan crawler-verktyg.

Sök i indexerat intranätsinnehåll och hämta relevant information som svar på användarfrågor. Varje användare som kan nå verktyget ser varje indexerad sida. Indexet innehåller endast det som crawl-kontot kunde nå under crawlingen, så noggrann skalning av crawl-kontot är avgörande för att förhindra överindexering. Det finns ingen behörighetskontroll vid frågetid.

Korrigera ett svar — inte indexet. Använd det för att föreslå ett bättre svar för en viss sökresultat. Förslaget skickas till administratörer som kan granska, redigera och godkänna ändringar. Godkända korrigeringar indexeras omedelbart och har företräde framför crawlat innehåll i framtida svar.

Returnerar information om crawl-tillståndet, inklusive sidor indexerade, senaste crawltid och crawl-fel.

Crawlern opererar som en anpassad MCP-server som du konfigurerar via crawlerns egen adminpanel på https://mcp-servers.intric.ai/<kund>-intranet/admin. Panelen är svenska-först med en engelsk-toggel, och är skyddad av HTTP Basic-authentisering. När den är konfigurerat:

  1. Crawlern besöker periodiskt konfigurerade URL:er på ditt intranät
  2. Den autentiserar med hjälp av de autentiseringsuppgifter du tillhandahåller
  3. Innehåll extraheras, bearbetas och indexeras
  4. Assistenten med Intranet crawler-verktyget kan söka i detta innehåll
  5. Användare kan föreslå korrigeringar via ett dedikerat gränssnitt
  6. Administratörer granskar korrigeringar i crawlerns adminpanel

Crawlern besöker ditt intranät direkt på en schemalagd basis. Schemalagda crawls körs dagligen kl. 02:00 UTC som standard, med en ytterligare inkrementell nyhetskrawl som körs var 30:e minut. Att ändra ett intervall kräver en pod-omstart. Detta läge kräver nätverksåtkomst till ditt intranät och autentiseringsuppgifter som konfigurerats under setup.

Ett alternativt upprättning där crawlern aldrig rör ditt nätverk. Istället crawlar du ditt eget intranät med dina egna verktyg och överlämnar en datafil till Intric, som indexerar den. Detta läge:

  • Kräver ingen nätverksåtkomst till ditt intranät från Intrics sida
  • Kräver inga crawl-autentiseringsuppgifter
  • Använder manuella (ej schemalagda) uppdateringar — skicka en ny datafil när innehållet ändras

Detta läge är positionerat för säkerhetskänsliga kunder som inte kan ge Intric tillgång till sitt intranät. Varning: en för-crawlad omindexering förstör godkända korrigeringar, eftersom den raderar vektorsamlingen och ersätter den med en nybyggd.

Crawlern opererar under behörigheterna för kontot som konfigurerats under setup. Detta betyder:

  • Indexet innehåller endast innehåll som crawl-kontot kunde nå
  • Allt indexerat innehåll blir sökbart av varje användare av en assistent med verktyget bifogat — det finns ingen per-användare-filtering vid frågetid
  • Noggrann skalning av crawl-kontot är avgörande för att förhindra överindexering

Viktigt: Granska ditt intranäts behörighetsmodell innan du konfigurerar crawlern. Om ditt crawl-konto har breda åtkomsträttigheter, överväg om allt indexerat innehåll bör vara sökbart av alla användare av assistenten.

Säkerhetsklassificeringsregler gäller för Intranet crawler-verktyget precis som de gör för andra verktyg i Intric. En assistent kan endast använda crawlern om den uppfyller säkerhetskraven för Space den tillhör.

När ett sökresultat pekar på en PDF eller annat dokument, tar klickning på citationstecknet användaren till föräldrasidan som länkade till dokumentet — inte till själva dokumentet. Detta är medvetet designat.

Ytterligare konfigurationsalternativ finns tillgängliga för specifika användningsfall. Kontakta oss för detaljer om:

  • Extra crawl-källor — indexera en andra autentiserad webbplats i samma kunskapsbas, med egna autentiseringsuppgifter
  • Ytterligare seed-URL:er — sidor som ingen länk på ditt intranät når
  • Extern-länkcrawling — ett steg utanför intranätet (standard avstängd, max 500 sidor)
  • Blokerade-URL-karantän och skräpsida-purgering
  • Tvingad JavaScript-rendering
  • SharePoint sökbaserad upptäckning

Redo att aktivera intranätssökning för er organisation?

  • Kontakta oss på support@intric.ai för att starta upsetup och samordna med vårt tekniska team
  • Läs artikeln nedan för att förstå setup-processen och förbereda nödvändig information.