1 artiklar · 3 min läsning
Intranätscrawler
Indeksera och sök i er organisations intranätsinnehåll med Intrics MCP-baserade intranätscrawler.
Översikt
Section titled “Översikt”Intranätscrawlern gör det möjligt för dina assistenter att söka och hämta information från er organisations interna intranät. Byggt på Model Context Protocol (MCP)-standarden ger den er team autentiserad åtkomst till intranätsinnehåll direkt i Intric-samtal.
Varje kund får en separat deployment — en dedikerad container, persistent volym, vektordatabas och ingress-sökväg — där ni bara delar containervidden. Deploymentar kan inte dela databaser. Onboarding är en process som ingenjörer på Intric kör; det finns ingen självständig onboarding-flöde.
Crawlern indexerar innehåll bakom inloggningsskyddade intranät med hjälp av autentiseringsuppgifter som du tillhandahåller under setup. Detta inkluderar anställdhandböcker, policysdokument, interna wikis och andra resurser som kräver autentisering.
Verktyg och resurser
Section titled “Verktyg och resurser”Crawlern exponerar tre MCP-verktyg och en resurs:
intranet_get_usage_guide
Section titled “intranet_get_usage_guide”Returnerar den här användarguiden. Crawlerns egna instruktioner säger till assistenten att anropa detta verktyg först i varje samtal. Anropa det innan någon annan crawler-verktyg.
search_intranet
Section titled “search_intranet”Sök i indexerat intranätsinnehåll och hämta relevant information som svar på användarfrågor. Varje användare som kan nå verktyget ser varje indexerad sida. Indexet innehåller endast det som crawl-kontot kunde nå under crawlingen, så noggrann skalning av crawl-kontot är avgörande för att förhindra överindexering. Det finns ingen behörighetskontroll vid frågetid.
correct_intranet_answer
Section titled “correct_intranet_answer”Korrigera ett svar — inte indexet. Använd det för att föreslå ett bättre svar för en viss sökresultat. Förslaget skickas till administratörer som kan granska, redigera och godkänna ändringar. Godkända korrigeringar indexeras omedelbart och har företräde framför crawlat innehåll i framtida svar.
crawler_stats-resurs
Section titled “crawler_stats-resurs”Returnerar information om crawl-tillståndet, inklusive sidor indexerade, senaste crawltid och crawl-fel.
Hur det fungerar
Section titled “Hur det fungerar”Crawlern opererar som en anpassad MCP-server som du konfigurerar via crawlerns egen adminpanel på https://mcp-servers.intric.ai/<kund>-intranet/admin. Panelen är svenska-först med en engelsk-toggel, och är skyddad av HTTP Basic-authentisering. När den är konfigurerat:
- Crawlern besöker periodiskt konfigurerade URL:er på ditt intranät
- Den autentiserar med hjälp av de autentiseringsuppgifter du tillhandahåller
- Innehåll extraheras, bearbetas och indexeras
- Assistenten med Intranet crawler-verktyget kan söka i detta innehåll
- Användare kan föreslå korrigeringar via ett dedikerat gränssnitt
- Administratörer granskar korrigeringar i crawlerns adminpanel
Intranätscrawler-lägen
Section titled “Intranätscrawler-lägen”Standard crawling
Section titled “Standard crawling”Crawlern besöker ditt intranät direkt på en schemalagd basis. Schemalagda crawls körs dagligen kl. 02:00 UTC som standard, med en ytterligare inkrementell nyhetskrawl som körs var 30:e minut. Att ändra ett intervall kräver en pod-omstart. Detta läge kräver nätverksåtkomst till ditt intranät och autentiseringsuppgifter som konfigurerats under setup.
För-crawlad dataläge
Section titled “För-crawlad dataläge”Ett alternativt upprättning där crawlern aldrig rör ditt nätverk. Istället crawlar du ditt eget intranät med dina egna verktyg och överlämnar en datafil till Intric, som indexerar den. Detta läge:
- Kräver ingen nätverksåtkomst till ditt intranät från Intrics sida
- Kräver inga crawl-autentiseringsuppgifter
- Använder manuella (ej schemalagda) uppdateringar — skicka en ny datafil när innehållet ändras
Detta läge är positionerat för säkerhetskänsliga kunder som inte kan ge Intric tillgång till sitt intranät. Varning: en för-crawlad omindexering förstör godkända korrigeringar, eftersom den raderar vektorsamlingen och ersätter den med en nybyggd.
Säkerhet och behörigheter
Section titled “Säkerhet och behörigheter”Crawlern opererar under behörigheterna för kontot som konfigurerats under setup. Detta betyder:
- Indexet innehåller endast innehåll som crawl-kontot kunde nå
- Allt indexerat innehåll blir sökbart av varje användare av en assistent med verktyget bifogat — det finns ingen per-användare-filtering vid frågetid
- Noggrann skalning av crawl-kontot är avgörande för att förhindra överindexering
Viktigt: Granska ditt intranäts behörighetsmodell innan du konfigurerar crawlern. Om ditt crawl-konto har breda åtkomsträttigheter, överväg om allt indexerat innehåll bör vara sökbart av alla användare av assistenten.
Säkerhetsklassificeringsregler gäller för Intranet crawler-verktyget precis som de gör för andra verktyg i Intric. En assistent kan endast använda crawlern om den uppfyller säkerhetskraven för Space den tillhör.
Dokumentcitat
Section titled “Dokumentcitat”När ett sökresultat pekar på en PDF eller annat dokument, tar klickning på citationstecknet användaren till föräldrasidan som länkade till dokumentet — inte till själva dokumentet. Detta är medvetet designat.
Avancerade alternativ
Section titled “Avancerade alternativ”Ytterligare konfigurationsalternativ finns tillgängliga för specifika användningsfall. Kontakta oss för detaljer om:
- Extra crawl-källor — indexera en andra autentiserad webbplats i samma kunskapsbas, med egna autentiseringsuppgifter
- Ytterligare seed-URL:er — sidor som ingen länk på ditt intranät når
- Extern-länkcrawling — ett steg utanför intranätet (standard avstängd, max 500 sidor)
- Blokerade-URL-karantän och skräpsida-purgering
- Tvingad JavaScript-rendering
- SharePoint sökbaserad upptäckning
Nästa steg
Section titled “Nästa steg”Redo att aktivera intranätssökning för er organisation?
- Kontakta oss på support@intric.ai för att starta upsetup och samordna med vårt tekniska team
- Läs artikeln nedan för att förstå setup-processen och förbereda nödvändig information.