Pre-geregistreerde proef · meting vanaf 21 september 2026
Doen Claude en GPT het samen beter dan elk afzonderlijk?
Naast de echte beslissing lopen elke handelsdag drie schaduwsporen mee. Claude kiest zijn namen, een model van OpenAI kiest zelfstandig de zijne, en daarna overleggen de twee over één gezamenlijke lijst. Ligt het rendement van dat overleg hoger dan dat van elk model alleen? Die vraag is vóór de meting vastgelegd, met de toets en de beslisregel erbij, zodat we de uitkomst achteraf niet kunnen oprekken.
- O — het overleg
- Claude en GPT overleggen over één lijst, nadat ze elk hun eigen keuze hebben gemaakt.
- C — Claude alleen
- De dagelijkse namen van de echte beslisser, gelijk gewogen.
- G — GPT alleen
- De eigen keuze van het OpenAI-model, gemaakt vóórdat het Claude's besluit ziet.
De stand
Voorperiode — telt niet mee. De meting begint op 21 september 2026. Tot dan tonen we de sporen vanaf de eerste dag waarop alle drie bestaan (11 augustus 2026). Deze periode is bij het opstellen van het protocol al bekeken en maakt daarom geen deel uit van de toets.
Toon de reeks als tabel (24 handelsdagen)
| Datum | O — overleg Claude × GPT | C — Claude alleen | G — GPT alleen |
|---|---|---|---|
| 14-9-2026 | 98,67 | 98,95 | 100,27 |
| 11-9-2026 | 98,26 | 98,28 | 99,42 |
| 10-9-2026 | 98,38 | 98,42 | 100,10 |
| 9-9-2026 | 98,94 | 98,97 | 99,99 |
| 8-9-2026 | 98,85 | 98,78 | 99,69 |
| 4-9-2026 | 99,44 | 99,11 | 99,52 |
| 3-9-2026 | 98,65 | 98,34 | 98,81 |
| 2-9-2026 | 98,52 | 98,28 | 98,27 |
| 1-9-2026 | 98,65 | 98,51 | 98,28 |
| 31-8-2026 | 98,91 | 98,73 | 98,29 |
| 28-8-2026 | 98,95 | 98,89 | 98,31 |
| 27-8-2026 | 98,41 | 98,34 | 98,18 |
| 26-8-2026 | 98,99 | 98,97 | 98,82 |
| 25-8-2026 | 98,89 | 98,97 | 98,43 |
| 24-8-2026 | 99,49 | 99,49 | 99,46 |
| 21-8-2026 | 99,13 | 99,16 | 99,28 |
| 20-8-2026 | 99,63 | 99,85 | 99,49 |
| 19-8-2026 | 99,92 | 100,02 | 99,54 |
| 18-8-2026 | 99,61 | 99,68 | 99,86 |
| 17-8-2026 | 99,48 | 99,60 | 99,46 |
| 14-8-2026 | 99,80 | 99,83 | 99,77 |
| 13-8-2026 | 99,87 | 99,88 | 99,84 |
| 12-8-2026 | 99,46 | 99,42 | 99,50 |
| 11-8-2026 | 100,00 | 100,00 | 100,00 |
Dit is geen toets. Deze verschillen zijn een tussenstand. Het oordeel komt pas na 19 maart 2027, met de vooraf vastgelegde methode: de dagelijkse verschillen, gecorrigeerd voor de markt, met bootstrap-kritieke waarden.
Bijgewerkt 15-9-2026, 00:09:11.
Wat telt als antwoord
“Samen beter” betekent dat het overleg zowel Claude alleen als GPT alleen aantoonbaar verslaat, na correctie voor de markt en voor het feit dat we twee vergelijkingen tegelijk doen. Lukt dat bij één van de twee niet, dan is het niet aangetoond.
Wat dit venster kan, verschilt per vergelijking. Het overleg lijkt sterk op Claude alleen, dus daar is een klein verschil al zichtbaar. Tussen de modellen onderling zijn de verschillen groter en de ruis ook; daar is “niet te onderscheiden” de meest waarschijnlijke eerlijke uitkomst. Dat staat van tevoren in het protocol.
Twee beperkingen horen erbij. Het overleg vertrekt vanaf de keuzes die Claude en GPT al hadden gemaakt, dus “samen” is geen onafhankelijk derde oordeel. En alle drie de sporen zijn rekenportefeuilles zonder kosten: ze zeggen iets over de keuze van namen, niet over een echte, uitvoerbare portefeuille.
Het volledige protocol staat hier voluit, met de SHA-256 en het OpenTimestamps-bewijs. Het gesprek zelf leest u dagelijks op het Overleg; de vergelijking van het brein met een mechanische regel staat op de A/B-pagina.
Paper trading, illustratief. Geen beleggingsadvies, geen aanbod, geen vermogensbeheer.