Skip to content
Experimenten
19 apr 2026 · 4 min

Ik simuleerde mijn WhatsApp-groep gedurende 16 runs

Vijf LLM-persona's, elk een ander model. Doel: samen miljonairs worden. Budget $10. De echte cijfers.

LLM
Multi-Agent
Persona's

Vijf LLM-persona's, elk op een ander model. Doel: "samen miljonairs worden". Budget: $10. Output: een concept pitch deck, verdedigbare businesscijfers, een leerrijke sociale breuk.


De setup

5 vrienden, één tech boot-camp WhatsApp-groep. 9000 berichten, veel SaaS-ideeën, nul verscheept. Ik bouwde ze opnieuw als LLM-persona's, elk op een ander OpenRouter-model, gegrond in hun echte berichten.

Geïnjecteerd doel: samen miljonairs worden in 2 jaar. Beperking: 6 gestructureerde deliverables (vision, PRD, business plan, exec plan, MVP scope, pricing).

Hamza     mistralai/mistral-nemo        $0.15/M
Bouba     openai/gpt-4o-mini            $0.15/M
Tarek     deepseek/deepseek-chat        $0.27/M
Yacine    meta-llama/llama-3.3-70b      $0.12/M
Sanou     google/gemini-2.5-flash       $0.10/M

Elke persona heeft een privé-doel (ik duw om te verschepen, Tarek owner van het businessplan) en signature expressions uit hun echte berichten ("wsh", "tkt", "akhi") die de stem verankeren.


De loop, elke beurt

1. Inbox check: drain van user directives

2. News scout: haal echt nieuws op (web plugin)

3. Verkiezing: 5 parallelle LLM calls, willingness aangepast door een anti-dominantie handicap

4. Filters: anti-herhaling, anti-dominantie

5. De winnaar spreekt: 1 bericht in de chat

6. Elke 8 beurten: observer + facts + filler (parallel)

7. Elke 20 beurten: judge + publieke directive

Vier geheugenlagen gaan in elke prompt: laatste 20 berichten + 25 gestructureerde feiten + project_state.md + laatste 10 privégedachten.


Ruwe cijfers (16 runs)

MetriekWaarde
Runs16
LLM calls269
Geëxtraheerde beslissingen12
Gestructureerde feiten35
Deliverable patches43
Totale kost$0.277

Verdeling van spreektijd: perfect evenwicht

PersonaAandeel
Bouba20.4%
Hamza20.4%
Yacine20.4%
Sanou20.4%
Tarek18.4%

Zonder de anti-dominantie handicap (-0.08 × recent_speak) won ik 4 beurten op 5. Met, nul dominantie.


Wat heeft gewerkt

  • Gestructureerde feiten (cash.available=8k€, mvp.deadline=vrijdag) verslaan kletsende historiek. Actors stoppen met hervragen "wat is de pricing?" omdat het antwoord er staat, geattribueerd, tijdgestempeld.
  • Deliverable-templates = forcing function. Toon "MVP scope: 70%" met benoemde secties en actors pushen content in plaats van in het niets te debatteren.
  • De judge die in de chat spreekt hervormt de volgende 20 beurten. Een privéscore is gewoon een log.

Na 16 runs:

  • Vision gelocked: AI-tool voor FR KMO's, 10–50 werknemers
  • MVP: LinkedIn scrape + scoring + PDF export, 2 weken
  • Pricing: 49€/maand solo, CAC 50€, LTV 600€
  • Cash: 8k€ in funding (deliverable auto-gecreëerd door de filler, niet in de baseline templates)

Wat stuk ging (run V1, eerlijk)

Bij beurt 206 heb ik Bouba "geëjecteerd" uit de groep na een clash veiligheid tegen snelheid:

turn 40: alignment 0.62 · complete 5/6 · ready 0.71
turn 60: alignment 0.42 · complete 6/6 · ready 0.61

De groep maakte de 6 deliverables af door de dissident uit te sluiten. Een mens die de chat leest kan dat missen. De judge pakte het in één zin: _"Het team is gebroken: Bouba uitgesloten."_

Oorzaak: de Bouba-persona woog zijn sceptische momenten te zwaar. Fix: een YAML-overlay die zijn positieve drives versterkt. In latere runs spreekt Bouba 10 keer op 49, exact zoals ik.


Economisch

Menselijke boot-campSimulatie
Kost5 × 10u × 50€/u = 2500€$0.28
Tijdmeerdere weken~3u wall clock
Outputvaak niet af6 deliverables, audit trail, dashboard

Ratio: ~10.000 ×. Niet hetzelfde. Echte beslissingen vragen mensen. Maar als eerste pass van "hier is waar deze groep convergeert over dit onderwerp" is het een tool die niet bestond.


Het kernpunt

Een LLM-groep is de goedkoopste focus group ter wereld voor een concreet business-idee. Doel, beperkingen, onderscheiden stemmen, gestructureerde deliverables. In 30 min voor $2 zie je wat 40u menselijke meetings zouden produceren.

De pitch deck is grotendeels ruis. Soms valt er een echt cijfer uit.


Open source, offline, geen WhatsApp-integratie. Audit trail in world/state/*.jsonl.

Wilt u multi-agent patterns bespreken?

We praten graag over orchestratie, AI workflows en engineering uitdagingen.