Over

/ Over mij

Ik ben Jay Derinbogaz. Ik heb drie bedrijven opgericht en ik bracht grote taalmodellen in productie drie jaar voordat ChatGPT daar een functietitel van maakte.

Ik was hier vóór de API

November 2022 was het moment waarop de meeste mensen een taalmodel ontmoetten. Ik leverde er al sinds 2019 op.

OpenAI spreidde de GPT-2-release over dat jaar omdat ze het volledige model met 1,5 miljard parameters te gevaarlijk vonden om te publiceren. Ik finetunede de checkpoints zodra ze uitkwamen. Geen chat-endpoint, geen system prompt, geen leverancier om te bellen — je scrapete je eigen dataset, je trainde het zelf en je liet het passen op hardware die er nooit voor ontworpen was.

NameKrea kwam daaruit voort. GPT-2 355M, gefinetuned op 100.000 domeinen die ik scrapete van de Majestic Million en koppelde aan de meta description van wat elke site werkelijk was, zodat het namen genereerde die iets betekenden in plaats van ruis. Dertig minuten training over twee GPU’s. Het werd uitgebracht als een live product, het heeft een MIT-licentie en mensen forken het nog jaren later.

Elke significante open release uit die tijd ging over mijn GPU’s — gpt-2-simple, finetune-gpt2xl, aitextgen op multi-GPU SageMaker, daarna GPT-J 6B draaiend op consumenten-VRAM. Ik kreeg de volledige 1,5B GPT-2 XL training op een enkele 16 GB-kaart toen het geaccepteerde antwoord was dat dat niet kon. Dat was de hele discipline destijds: de modellen waren gratis en de rekenkracht was de muur, dus de engineering draaide helemaal om hoe je om de muur heen kwam.

De industrie geeft nu miljarden uit aan dezelfde vraag die ik in 2019 in een slaapkamer beantwoordde. Wat is er nodig om dit ding in productie te krijgen op hardware die je je daadwerkelijk kunt veroorloven?

TextCortex

Ik heb TextCortex medeopgericht in Berlijn in 2021 en ik ben de technische oprichter. We bouwen AI-agents voor ondernemingen die moeten weten waar hun data leeft — Europese infrastructuur, echt bestuur, geïmplementeerd bij bedrijven zoals Siemens en Lamborghini.

Met steun van b2venture, Speedinvest en Entrepreneur First. Meer dan twee miljoen gebruikers. Uitgeroepen tot categorieleider door Gartner, G2 en Capterra, #20 snelst groeiende product van 2024 en #10 beste AI-software van 2025.

Ik lees nog steeds de diffs. Het meeste wat ik nu bouw is de tooling rondom de modellen in plaats van de modellen zelf, en beide huidige open source-projecten komen rechtstreeks voort uit problemen die we tegenkwamen bij het draaien van engineering op schaal.

Juror draait meerdere frontier-modellen parallel over dezelfde pull request, omdat één reviewer precies één blinde vlek betekent en je de vorm ervan nooit van binnenuit leert kennen.

GitRank lost de andere helft op. Het scoort elke gemergde pull request met Claude — classificeert het werk per component en ernst, weegt een P1-authenticatiefix anders dan een copy-wijziging — en zet dat om in leaderboards, velocity-metrics, bug-hotspots, feature-eigenaarschap en kennis-silo-detectie. Engineering performance review is nog steeds meestal vibes, en de data om het goed te doen heeft de hele tijd in ieders git-geschiedenis gezeten. Zelf te hosten, EU-infrastructuur, gratis voor niet-commercieel gebruik.

Drie bedrijven

TextCortex is de derde.

Op mijn 22e richtte ik een AR/VR-bedrijf op dat bouwde voor Renault en Nokia. Op mijn 24e richtte ik Grafentek in Duitsland op om grafeen-batterijmaterialen te maken — deep tech, harde wetenschap, en de Duitse zakenpers wijdde er een boekhoofdstuk aan. Daartussen leidde ik data-engineering bij trivago.

Ik studeerde werktuigbouwkunde met een focus op computationele mechanica — numerieke methoden op zeer grote matrices, wat een veel kortere weg is naar het trainen van neurale netwerken dan het klinkt. Ik kwam bij taalmodellen via grafeen en virtual reality, en in elk van die vakgebieden was het moeilijke deel nooit de demo.

Wat je hier zult vinden

Build logs, post-mortems en bonnetjes. Ik publiceer de daadwerkelijke cijfers — wat het kostte, wat het opving, wat het miste — omdat in deze industrie bijna niemand dat doet, en de rekenkunde is meestal het hele argument.

Over deze site

Statische Astro, geïmplementeerd op Cloudflare Workers. Berichten zijn markdown-bestanden in een git-repo. Elk bericht wordt in nog acht talen vertaald door een GitHub Action, inclusief de URL-slug — die vertalingen zijn machinaal gegenereerd en als zodanig gelabeld.

De GitHub- en LinkedIn-links in de zijbalk zijn de snelste manier om mij te bereiken.