Hoe het werkt

Van website naar AI-medewerker in drie stappen

Van een websiteadres naar een werkende AI-medewerker, zonder developer en zonder data-export.

01
Plak je URL< 1 minuut

Meld je aan, plak je website-URL en wij ontdekken automatisch je sitemap en belangrijkste pagina's (over ons, prijzen, FAQ, documentatie). Vink aan wat geïndexeerd moet worden en wij crawlen op de achtergrond — met respect voor robots.txt, zonder ingelogde paden en zonder interne hosts aan te raken.

  • Cloudflare Browser Rendering voor JS-zware sites
  • Eenvoudige HTTP-fallback voor simpele sites
  • Notion- en Google Docs-bronnen via OAuth
02
Wij indexeren je kennis~30 seconden voor de meeste sites

Gecrawlde pagina's worden geëxtraheerd (Readability), opgedeeld langs semantische grenzen (~500 tokens met overlap), ge-embed met Cloudflare bge-base-en-v1.5 of OpenAI text-embedding-3-small en weggeschreven naar Vectorize of Qdrant — elk fragment getagd met workspace + agent zodat retrieval strikt tenant-gebonden is.

  • Recursieve splitter — eerst alinea's, zinnen als fallback
  • Tweetraps-retrieval: ANN-recall + cross-encoder-rerank
  • Strikte workspace-isolatie afgedwongen door een globale query-scope
03
Pas de agent aan5 minuten finetunen

Stel persona, tone of voice, taal, themakleuren, startersuggesties en gedragsregels in. Voeg samengestelde antwoorden toe voor prijzen of terugbetalingen waar parafraseren onacceptabel is. Een live voorbeeld toont precies wat bezoekers zien.

  • Meerdere widgettalen (en, nl, es, fr, de, pt, ja, ar, zh)
  • Gedragsregels: scrolldiepte, inactiviteit, exit-intent, intentie-trefwoord
  • A/B-test regelvarianten en volg conversieverschillen
04
Publiceer een momentopnamedirect

Klik op Publiceren — wij leggen de agent vast in een onveranderlijke versie. De widget leest altijd de gepubliceerde versie, dus conceptwijzigingen raken nooit live bezoekers. Met één klik rol je terug naar elke eerdere versie.

  • Versiegeschiedenis per publicatie
  • Strikte handhaving van toegestane domeinen op /v1/widget/init
  • Met één klik terug naar elke eerdere momentopname
05
Embed één scripttag30 seconden

Plak één &lt;script&gt;-tag vóór &lt;/body&gt;. De widgetbundel is &le; 50KB gzipped, asynchroon en rendert in een Shadow DOM zodat hij nooit botst met de CSS van je site. Werkt met elk framework — WordPress, Shopify, Next.js, kale HTML.

  • Shadow DOM-isolatie — geen CSS-lekken
  • Bezoekerssessies blijven behouden bij herladen
  • Optionele spraakmicrofoon (browser-SpeechRecognition)
06
Bezoeker vraagt, AI antwoordt< 1 seconde tot het eerste woord

Een bezoeker typt een vraag. Hot path: check op samengestelde antwoorden → query embedden → vectorzoekopdracht → herordenen → prompt samenstellen met bronnen getagd tegen prompt-injectie → LLM-antwoord streamen via SSE. Geen databasewrites, geen synchrone webhooks — opslag gebeurt asynchroon nadat de stream is afgerond.

  • Hot-path-contract van 1s p95 tot eerste woord wordt afgedwongen
  • Bronvermeldingen [1] [2] die terugverwijzen naar jouw bronnen
  • Betrouwbaarheidsdrempel per agent — de agent zegt "dat weet ik niet" in plaats van te gokken
07
Leg leads vast, spring live inwanneer de intentie hoog is

Gedragsregels herkennen echte intentie (vraagt naar prijzen, vraagt om een demo, derde gespreksbeurt) en tonen het inline leadformulier. Vastgelegde leads landen direct in je inbox, sturen een Slack-melding en POSTen naar je webhook voor HubSpot / Pipedrive / Mailchimp.

  • Realtime inbox via Reverb-WebSocket
  • Menselijke overname met één klik — de bezoeker ziet "Er is een mens aanwezig"
  • Uitgaande webhooks met HMAC-ondertekende payloads

Wat "direct" werkelijk kost

De limiet waaraan elk bezoekersbericht moet voldoen, van verzoek tot het eerste woord op het scherm.

Receive + auth30 ms
Curated short-circuit5 ms
Embed query120 ms
Vector search80 ms
Rerank120 ms
Prompt assembly10 ms
LLM time-to-first-token500 ms