AI vanaf nul
Een complete cursus over kunstmatige intelligentie, van de wiskunde tot LLM's, agents en MCP. Dertig hoofdstukken, elk op zichzelf de moeite waard.
De perceptron vanaf nul: wat een neuron berekent
Een neuron is een gewogen som en een drempel. Dat is het hele idee — en de grenzen ervan dwongen alles af wat daarna kwam.
Waar een verliesfunctie vandaan komt: likelihood, geen conventie
Kwadratische fout is geen conventie. Het is een claim over de ruis, en je kunt zien wanneer die fout is.
Bergafwaarts: Gradient Descent, en de twee stappen die iedereen overslaat
Iedereen schrijft het minteken op. Bijna niemand zegt waarom het er staat, of hoe groot een stap mag zijn.
Classificatie, cross-entropy en hoe je jezelf niet voor de gek houdt
Accuracy is het makkelijkste getal om te rapporteren — en het makkelijkste om door misleid te worden.
Backpropagation vanaf nul: eerst de engine, dan het netwerk
Backpropagation is geen neural-network-algoritme. Het is de kettingregel, toegepast op een grafiek, in de efficiënte richting.
Het netwerk laten trainen én laten generaliseren
De gradient klopt en toch leert het netwerk niet. Dit hoofdstuk gaat over dat verschil.
Bouw een BPE-tokenizer: waarom je model de r’s niet kan tellen
Het model ziet nooit letters. Alles wat vreemd is aan hoe het spelt, telt en inspringt, volgt daaruit.
Next-token voorspelling: embeddings en wat perplexity betekent
Eén objective, geen labels en een tabel met vectors die niemand heeft ontworpen.
Attention en het transformer block, afgeleid uit een gemiddelde
Attention is geen formule om zomaar te accepteren. Je krijgt het wanneer je stopt met het verleden uniform te middelen en het model de gewichten laat kiezen.
Een LLM pretrainen: data, compute, scaling laws en kosten
De resterende beslissingen zijn geen programmeerbeslissingen. Het zijn aankopen.
Van basismodel naar assistent: SFT, RLHF, DPO en GRPO
Een voorgetraind model beantwoordt geen vragen. Het vervolgt tekst, en het verschil is een tweede trainingsfase die niemand ziet.
Chain of Thought, RLVR en test-time compute, gemeten
Een model denkt niet. Het besteedt meer tokens vóór het antwoord, en dat is meetbaar en factureerbaar.
Inference goedkoop maken: KV cache, batching en quantization
Genereren is niet één probleem: een compute-bound eerste token gevolgd door duizenden memory-bound tokens. Bijna elke serving-truc komt daaruit voort.
Je eerste LLM-call in productie: streaming, retries, timeouts
Het model zit nu achter een poort. Bijna niets wat vanaf hier misgaat, is wiskunde.
Prompt engineering, gemeten: wat de output verandert
Over een prompt discussieer je niet: je meet hem. Vier varianten over twintig cases onderscheiden niets.
De context window, tokens en de rekening, gemeten
De window is geen geheugen. Hij wordt bij elke call opnieuw gevuld, en je betaalt voor die hervulling.
Temperature, top-p en het determinisme dat je niet hebt
Temperature maakt een model niet creatiever. Het verhoogt de kans op tokens die het model zelf onderaan scoorde — en je kunt het zien gebeuren.
Tool calling en structured outputs: het contract dat standhoudt
Het model voert nooit iets uit. Het vraagt, in een vorm die jij definieert, en die vorm is het enige deel dat je controleert.
RAG in productie: chunking, retrieval en eerlijke citaties
Slechte chunking vernietigt het antwoord voordat zoeken begint, en geen reranker haalt het terug.
Fine-tunen, retrieval of prompt? De beslissing is economisch
Niemand stelt deze vraag over het model. Ze stellen hem over een budget.
Multimodale pricing: wat afbeeldingen, audio en video echt kosten
Een foto kost niet één foto. Hij kost tokens, volgens een formule die je niet zelf kiest.
Wat een AI-agent is: vijf klassieke types, twee rivaliserende definities
Eén tool in de catalogus maakte van één call er twee en van 39 input tokens 420. Of dat een agent maakte, hangt af van welke definitie je opent.
Bouw een agent harness: de loop en zijn vijf uitwegen
De loop telt vijftien regels. Alles wat hem productiegeschikt maakt, is een manier om eruit te stappen.
Context engineering: waarom je agent bij beurt 40 dommer wordt
Het window liep niet over. Het feit verschoof alleen, en de agent vond het niet meer.
Multi-agent orchestration: vijf patronen, en wanneer één wint
Vier opstellingen, één taak, één rekening. De goedkoopste zat fout en de duurste kon zijn eigen workers niet controleren.
MCP uitgelegd aan de hand van de spec: wat een server echt is
Het is geen magie. Het is een transport, een berichtformaat en drie primitives — en je kunt het met de hand typen.
Een MCP Server shippen: TypeScript en Python, gemeten
Twee SDK’s, één wire. De interessante verschillen zijn precies wat het protocol niet kan zien.
Agent Skills en SKILL.md: Progressive Disclosure, gemeten
Een skill is een map met een Markdown-bestand erin. Alles wat interessant is, volgt uit welk deel van dat bestand wordt gelezen, en wanneer.
LLM-evaluatie: van openbare benchmarks naar je golden set
Een getal zonder interval is een anekdote met decimalen.
Prompt injection en de dodelijke trifecta: een echte agent beveiligen
Het model kan jouw instructie niet onderscheiden van die van een vreemde. Alles wat werkt, begint met dat te accepteren.