Billig og hurtig. Fin til korte, ligetil spørgsmål hvor vidensdatabasen har et klart svar. Kan virke overfladisk ved sammensatte eller uklare sager.
Svarmodel: GPT-5.6 Luna via Responses API.
$1 pr. million input tokens og $6 pr. million output tokens.
Søgemodel: Cloudflare Workers AI BGE-M3 sammen med Vectorize. Den finder de mest relevante tekststykker fra vidensdatabasen, før svarmodellen skriver et udkast.
$0,012 pr. million input tokens (svarer til 1.075 "neurons" pr. million tokens). Cloudflare giver 10.000 gratis neurons/dag på tværs af alle Workers AI-modeller; forbrug derover koster $0,011 pr. 1.000 neurons. Bruges ved hvert opslag i vidensdatabasen og ved hvert AI-udkast, uanset hvilken svarmodel der er valgt ovenfor.
6
Genererede AI-svar
1
Cache-træffere
$0.03
Estimeret OpenAI-forbrug
$0.0034
Sparet via cache (~16s ventetid)
Samme spørgsmål på samme domæne genbruger et svar uden nyt OpenAI- eller vector-søgekald. Når model, viden, PDF'er eller dokumentets offentlighed ændres, øges domænets vidensversion automatisk, og et nyt svar genereres.