Modellen & kosten
Instellingen → AI → Modellen & gebruik is waar je bepaalt welk model elke AI-functie gebruikt en hoeveel er per dag uitgegeven mag worden.
Model per AI-functie
Section titled “Model per AI-functie”Elke functie krijgt geen enkel model maar een geordende voorkeurslijst. HQ werkt die lijst af tot er één lukt.
Twee soorten functies, twee soorten lijsten:
- Functies waar consistentie telt — chat, CV-review, match-analyse, vacatureomschrijving verbeteren — staan op één model vastgepind. Twee kandidaten die op verschillende dagen beoordeeld worden, krijgen zo dezelfde meetlat.
- Functies met veel volume en lagere inzet — CV-extractie, kandidaatpitch, socials, VDAB-matching — beginnen bij een gratis model en vallen pas daarna terug op een sterker model.
Per functie staat er een uitklapbare lijst Volgorde bij uitval: de volledige route die HQ nu zou lopen, met de eerste stap gemarkeerd als actief. Dat is geen theorie — het is dezelfde berekening die een echte call gebruikt.
De provider-ladder
Section titled “De provider-ladder”Hetzelfde model kan bij meerdere leveranciers ingekocht worden, tegen heel verschillende prijzen. HQ stuurt elke call naar de goedkoopste plek die het gevraagde model kan leveren — gratis eerst.
| Trede | Bron |
|---|---|
| 0 — gratis | De gratis laag van Google (Gemini) en de gratis tokens van OpenAI (GPT) |
| 1 — Copilot | Het GitHub Copilot-abonnement, binnen het maandquotum |
| 2 — betaald | De betaalde OpenAI-API |
De cruciale eigenschap: de ladder wisselt nooit stiekem van model. Ze zoekt alleen een goedkopere leverancier voor het model dat je gekozen hebt. Een review die op één model staat vastgepind, levert dus overal dezelfde score.
Een gevolg dat verrast: omdat de trede zwaarder weegt dan de modelvoorkeur, kan het tweede model van een functie voorgaan op de Copilot-trede van het eerste. Staat de gratis OpenAI-pot leeg, dan gaat de call liever naar Gemini op de gratis Google-laag dan naar het eerste model op Copilot. De uitklaplijst per functie toont dat, zodat je het niet hoeft af te leiden.
Wat er gebeurt als een trede uitvalt
Section titled “Wat er gebeurt als een trede uitvalt”- Google geeft een limietfout → Gemini-calls slaan Google een tijdje over (standaard vijf minuten, en tot de dagwissel wanneer het patroon zich herhaalt). De afkoeling geldt per model: dat het ene Gemini-model op is, zegt niets over het andere.
- Het Copilot-quotum is op → GPT-calls gaan naar de betaalde OpenAI-trede tot de maandwissel. Gratis Copilot-modellen blijven wel gewoon werken.
Valt een provider uit, dan slaat HQ meteen de rest van de route bij diezelfde provider over in plaats van er één voor één op stuk te lopen.
Handmatig overrulen
Section titled “Handmatig overrulen”De modus pint de provider vast: automatisch (de ladder), of geforceerd op Google, OpenAI of Copilot. Een geforceerde provider wordt gebruikt zolang die het model kán leveren; kan hij dat niet, dan valt HQ terug op een geschikte provider in plaats van het model verkeerd te bedienen.
Daarnaast kan je de “Copilot uitgeput”- en “Google-afkoeling”-toestand met de hand zetten of wissen, als achtervang voor de automatische detectie. Die twee knoppen werken onmiddellijk en gaan niet via de opslaan-balk, zodat ze een concept dat je aan het bewerken bent niet weggooien.
De dagbudgetten
Section titled “De dagbudgetten”Er lopen drie begrenzingen naast elkaar. Ze doen verschillende dingen.
1. Betaalde AI, in euro
Section titled “1. Betaalde AI, in euro”De tredes rekenen in verschillende eenheden — Copilot rekent premium-requests, OpenAI en Google rekenen tokens — dus één limiet over alle drie wordt uitgedrukt in geld.
| Budget | Standaard | Wat het begrenst |
|---|---|---|
| Per gebruiker | € 3 per dag | Wat één gebruiker aan betaalde AI mag uitgeven |
| Bedrijfsbreed | € 12 per dag | Het echte plafond, over alle gebruikers en alle EngiFlex-apps samen |
De kostprijs per call is een schatting uit een handmatig onderhouden prijstabel. Die bestaat om een budget te bewaken, niet om een factuur na te bouwen — vergelijk hem af en toe met de prijslijsten van de leveranciers.
2. De veiligheidsklep op automatische AI
Section titled “2. De veiligheidsklep op automatische AI”Automatische AI (alles wat draait zonder dat iemand klikt) heeft een eigen harde dagcap: een maximum aantal requests (standaard 200) en een maximum aantal tokens (standaard 2 miljoen). Wordt één van beide bereikt, dan pauzeert alle automatische AI voor de rest van de dag. Er wordt niet teruggevallen op een goedkoper model, en handmatige AI blijft gewoon werken.
Bij de eerste overschrijding van de dag krijgen alle admins één mail. De pagina toont het verbruik van vandaag en een badge Gepauzeerd.
3. De gratis dagpot
Section titled “3. De gratis dagpot”Hoeveel gratis OpenAI-tokens er per dag beschikbaar zijn voordat GPT-calls naar Copilot zakken. Die pot wordt gedeeld met de andere EngiFlex-apps: alle apps werken op hetzelfde account, dus de teller staat in een gezamenlijk boek. Een per-app teller zou twee apps elk het volledige budget laten opmaken.
Als een budget op is
Section titled “Als een budget op is”Per functie staat een schakelaar terugvallen op een gratis model:
- Aan (de standaard) — is het betaalde budget op, dan draait de functie op een eenvoudiger gratis model, met een waarschuwing voor de gebruiker.
- Uit — de call wordt niet uitgevoerd. Je krijgt een melding in plaats van een zwakker resultaat. Zo staat vacatureomschrijving verbeteren standaard ingesteld: een slechte herschrijving is erger dan geen herschrijving.
Is er helemaal geen trede meer over, dan toont de uitklaplijst van die functie “geen beschikbare trede”.
Een bereikt budget is uitstel, geen mislukking. HQ behandelt het anders dan een echte fout: een CV-extractie die erop stuit wordt geparkeerd tot na de dagwissel zonder een van haar drie pogingen te verbruiken, en de automatische beoordelingsrondes stoppen vroeg en pikken later op waar ze gebleven waren. Zonder dat onderscheid brandde één uitgeputte dag alle pogingen op binnen het uur, waarna de kandidaat als mislukt werd gemarkeerd.
Budgetten resetten op de dagwissel (Europe/Amsterdam).
Verwant
Section titled “Verwant”- Gratis capaciteit — ongebruikte gratis ruimte alsnog inzetten
- AI-verbruik — wat er effectief verbruikt is
Documentatie laatst bijgewerkt op