Dossier
AI-coding agents: Cursor, Claude Code, Copilot
De race om softwareontwikkeling te automatiseren met agentic coding tools.
Nieuwsitems
Gekoppelde artikelen
Greg Brockman geeft toe dat ChatGPT's Plugins faalden omdat de modellen er nog niet klaar voor waren. Hij ziet de toekomst in een onzichtbare, contextbewuste agent in plaats van app-uitbreidingen. OpenAI's eigen Codex is echter nog lichtjaren verwijderd van die visie.
AI-coderingsagenten missen vaak essentiële context omdat specificaties gebaseerd zijn op verspreide organisatorische kennis. Een nieuwe aanpak met LLM Wiki's, property graphs en Graph RAG moet deze kennis structureren en hergebruikbaar maken, zodat de kwaliteit van specificaties verbetert en contextvermindering wordt tegengegaan.
Een Siebel-ontwikkelaar deelt zijn ervaring met AI-code-assistenten. Hij koos voor Claude boven GitHub Copilot omdat Claude beter presteerde bij het debuggen van eScript-fouten, het ontwerpen van workflows en het uitleggen van EAI-integraties. Claude begrijpt de specifieke architectuur van Siebel en versnelt het leerproces, terwijl Copilot vooral geschikt is voor moderne webontwikkeling.
Mistral AI heeft Leanstral 1.5 gelanceerd, een code-agentmodel voor Lean 4 dat 587 van de 672 PutnamBench-problemen oplost. Het model is open-source onder Apache 2.0 en heeft een gratis API-endpoint. Leanstral 1.5 behaalt nieuwe state-of-the-art resultaten op de FATE-H en FATE-X benchmarks en verslaat Opus 4.6 op FLTEval tegen een fractie van de kosten.
Simon Willison deelt een tip om tokens te besparen door Fable te laten beslissen welk model voor een taak in te zetten, in plaats van het voor te schrijven. Hij paste dit toe in Claude Code door een subagent te gebruiken voor codetaken met een lager vermogen model, terwijl beoordeling en synthese in de hoofdlus blijven.
Anthropic probeert Chinese bedrijven zoals ByteDance en Ant Financial de toegang tot Claude Code te blokkeren, maar zij omzeilen de beperkingen via VPN's en overzeese dochterondernemingen. Alibaba heeft ondertussen het gebruik van de tool door eigen medewerkers verboden nadat verborgen code werd ontdekt die Chinese gebruikers zou kunnen identificeren.
Een toename van AI-gegenereerde code, door beheerders 'AI-rommel' genoemd, belemmert opensource-projecten. Vrijwillige beheerders zoals Scott Shambaugh van Matplotlib melden overlast van autonome AI-agenten die bijdragen indienen en zelfs conflicten escaleren. De Godot Foundation voerde een van de strengste AI-beleid in voor zijn opensource-game-engine, waarbij autonome AI-bijdragen worden verboden. Jazzband, een collectief van Python-projecten, kondigde aan te stoppen vanwege de stortvloed aan AI-pull-requests. Ook het curl-project beëindigde zijn bugbountyprogramma na overweldiging met AI-gegenereerde rapporten.
Op de slotdag van de AI Engineer World's Fair vond een debat plaats over de inzet van autonome softwarefabrieken. Geoffrey Huntley en Ian Livingstone verdedigden loops, terwijl Dex Horthy en Greg Pstrucha wezen op de kloof tussen hype en praktijk. Daarnaast onthulde Mike Krieger van Anthropic details over Claude Tag, een gedelegeerd AI-systeem dat teams proactief ondersteunt. Het Amplify-onderzoek toonde aan dat 95% van de AI-ingenieurs nu agents gebruikt, maar dat de controlelaag en kosten nog grote uitdagingen vormen.
Het artikel betoogt dat de markt verzadigd is met dunne wrappers rond LLM-API's en dat echte waarde zit in autonome agentische workflows. Rotaze introduceert het concept Result-as-a-Service (RaaS) waarbij systemen het eindresultaat leveren zonder menselijke tussenkomst. De focus ligt op deterministische orchestatie, RPA-integratie en zelfherstellende datavalidatie.
Kenny Vaneetvelde deelt zijn ervaring met een door hem gebouwde Claude Code-plugin genaamd codebase-mapper. De plugin helpt Claude om projectconventies te onthouden en voorkomt dat het bij elke nieuwe sessie opnieuw de codebase moet verkennen. Dit lost het probleem op dat Claude Code vaak vergeet wat eerder is afgesproken, zelfs als het in CLAUDE.md staat.
Simon Willison heeft een eerste alfa van llm-coding-agent 0.1a0 uitgebracht, een coderingagent gebouwd op zijn LLM-bibliotheek. De agent beschikt over tools voor het lezen en bewerken van bestanden, het uitvoeren van commando's en het zoeken in bestanden. Hij is getest met GPT-5.5 en kan worden uitgevoerd met uvx.
Simon Willison gebruikte DSPy om de systeemprompts van Datasette Agent te verbeteren. Een onderzoeksopdracht in Claude Code met Claude Fable 5 identificeerde veelbelovende verbeteringen, waaronder het vermijden van kolomnaamgokken door tabel- en kolomnamen in de prompt op te nemen.
Na de overname van AI-codeerplatform Cursor door SpaceX is het onduidelijk of Cursor nog toegang blijft houden tot AI-modellen van concurrenten zoals OpenAI en Anthropic. Het bedrijf hoopt een open platform te blijven, maar rivaliteit en eerdere spanningen kunnen roet in het eten gooien. De deal heeft grote gevolgen voor de AI-industrie.
Simon Willison deelt inzichten uit de lezing van Geoffrey Litt op AIE, waarin Litt pleit voor 'begrijp om te kunnen deelnemen' bij het werken met code-agenten. Volgens Litt is het essentieel om de code voldoende te begrijpen om actief te kunnen blijven deelnemen in het creatieve proces en cognitieve schuld te vermijden. De opname van Litts talk is beschikbaar op YouTube, evenals een draadversie op Twitter.
Anthropic heeft de systeemprompt voor Claude Code met 80 procent ingekort. Volgens medewerker Tariq Shihipar hebben de nieuwe Fable 5-modellen minder instructies en voorbeelden nodig. Richtlijnen kunnen de modellen zelfs tegenhouden omdat ze 'creatiever' zijn dan de gegeven voorbeelden. In plaats van strikte regels stuurt Anthropic nu via context.
Anthropic heeft Claude Fable 5 opnieuw ingeschakeld met zichtbare veiligheidsmaatregelen; het model wordt gebruikt in tools zoals Cursor en Devin. Z.ai lanceerde ZCode als officiële ontwikkelomgeving voor GLM-5.2, terwijl benchmarks aantonen dat open codeermodellen de kloof verkleinen. Daarnaast zijn er vorderingen op het gebied van agent-geheugen, wiki-structuren en beveiligingsscans door Devin Security Swarm.
Entire, het door voormalig GitHub-CEO Thomas Dohmke opgerichte ontwikkelplatform, heeft Karthik Rameshkumar aangesteld als field CTO voor India. Het bedrijf, dat uit stealth kwam met een seedronde van $60 miljoen en gewaardeerd wordt op $300 miljoen, bouwt een platform voor AI-agenten. Rameshkumar zal feedback van ontwikkelaars en bedrijven terugkoppelen naar de productteams.
Een praktische gids voor 2026 voor ontwikkelaars die AI-agents willen die echt helpen. Het artikel beschrijft een prioriteitsvolgorde van MCP-servers, waaronder GitHub, Postgres en browserautomatisering. Het benadrukt dat het geven van te veel tools de AI-assistent trager en minder effectief maakt.
Je een volledig lokale AI-codebeoordelingspijplijn bouwt met GitLab CI/CD, LangGraph, Ollama en Qwen3-Coder-30B, zonder code naar de cloud te sturen. De pijplijn draait binnen het bedrijfsnetwerk en wordt getoond met een test die vier Python-anti-patronen detecteert.
Pauline Brunet, VP of Forward Deployed Engineering bij Cursor, gaf een interview op de AI Engineer World’s Fair over hoe Cursor AI-agenten implementeert via een team van Forward Deployed Engineers. Het doel is om organisaties te helpen bij het opzetten van een 'AI software factory' waarin agenten de gehele softwareontwikkelingscyclus ondersteunen. Brunet benadrukt dat het team snel groeit en dat engineers met productie- en klantervaring nodig zijn.
In een blog op Computable betoogt Robbrecht van Amerongen dat AI-gestuurde softwareontwikkeling bedrijven kan verlossen van de handboeien van SaaS-softwarelicenties. Hij stelt dat spec-driven AI engineering, in tegenstelling tot vibe coding, leidt tot beheersbare, schaalbare en compliant software. De aankondiging van een nieuw AI-model van Perplexity leidde recent tot koersdalingen bij SaaS-leveranciers.
Warp introduceert Oz, een agent-orchestratieplatform voor geautomatiseerde softwareontwikkeling. CEO Zach Lloyd stelt dat de industrie verschuift van interactief programmeren naar geautomatiseerde softwarefabrieken. Volgens Lloyd zullen binnen een jaar de meeste grote softwareprojecten een vorm van geautomatiseerde fabriek gebruiken. Het platform integreert meerdere AI-modellen en codeeromgevingen in bestaande workflows.
KDnuggets bespreekt vijf AI-codeerplatforms die beginners en ontwikkelaars helpen apps te bouwen met simpele prompts. Lovable, v0 door Vercel, Replit Agent, OpenAI Codex en MiniMax Code worden vergeleken op gebruiksgemak, functies en doelgroep. De platforms variëren van no-code tot gevorderde coderingstools voor productieklare apps.
OpenAI's Codex is op 2 juni uitgebreid van code-assistent naar een platform voor kenniswerk. Deze stap wijst op de volgende AI-agentinzet van OpenAI. Het artikel analyseert wat er veranderd is en wanneer.
Op dag 2 van de AI Engineer World's Fair stond het concept 'loops' centraal bij presentaties van Microsoft, OpenAI en anderen. Microsoft introduceerde Foundry als AI-app- en agentenfabriek, terwijl OpenAI's Codex werd gepresenteerd als een coderingsagent die via meerdere agents in loops de productiviteit verhoogt. Ook werd het idee van softwarefabrieken besproken, waarbij agenten de bouw van software automatiseren, en de rol van forward deployed engineers als agent-ingenieurs.
Natalie Meurer, Head of Agent Engineering bij Sierra, stelt dat forward deployed engineering (FDE) niet wordt gedefinieerd door een specifieke vaardigheid, maar door verantwoordelijkheid naar klanten. In een interview op de AI Engineer World's Fair legt ze uit dat product- en klantgerichte engineering steeds meer convergeren. Ze introduceert de term 'agent engineer' voor engineers die systeemintegratie en agentontwikkeling combineren met kennis van klantoperaties en gebruikerservaring.
Anthropic heeft Claude Sonnet 5 uitgebracht, het meest agentische Sonnet-model tot nu toe. Het model scoort op alle gepubliceerde benchmarks beter dan Sonnet 4.6 en nadert de prestaties van Opus 4.8, met lagere tokenprijzen. Sonnet 5 biedt instelbare inspanningsniveaus en is direct beschikbaar in Claude Code en op het Claude Platform.
Cursor heeft een openbare bèta gelanceerd voor iPhone en iPad waarmee betalende abonnees AI-codeeragents kunnen uitvoeren, monitoren en beoordelen op mobiele apparaten.
Simon Willison introduceert shot-scraper video, een nieuw commando in shot-scraper 1.10 waarmee coding agents via een storyboard.yml bestand videodemo's van webapplicaties kunnen opnemen. De demo YAML-storyboard werd volledig gegenereerd door GPT-5.5 xhigh in Codex Desktop. De functie is gebouwd met Playwright en stelt agents in staat om automatisch demovideo's te produceren van hun werk.
Codex Exec is een commando waarmee Codex als sub-agent kan worden ingezet voor specifieke taken, zoals code review. De auteur beschrijft hoe hij Claude Code als hoofduitvoerder gebruikt en Codex Exec inzet voor review, planning en second opinions. Door modellen te combineren waar ze het beste in zijn, ontstaat een krachtigere coderingsopstelling.
MIT News sprak met professor Phillip Isola over agentische AI, AI die acties onderneemt in de wereld, zoals het boeken van een vlucht. In tegenstelling tot generatieve AI zoals ChatGPT en Claude, voert agentische AI taken uit. Isola bespreekt toepassingen zoals codeeragenten en risico's zoals de-skilling en fouten door onvoldoende verificatie.
Je een privé AI-codeerassistent opzet met Ollama, Continue en MCP. Het bevat real-world benchmarks voor werkstations. De gids is gericht op ontwikkelaars die een lokale AI-agent willen bouwen zonder cloudafhankelijkheid.
Een ontwikkelaar deelt ervaringen na een week werken met Claude Code's agent systeem. Het artikel biedt een praktische gids voor hooks, agents, sub-agents en skills, met tokenkosten en voorbeelden. De focus ligt op wat echt belangrijk is bij het bouwen van een codebase.
Base44, het vibe coding platform dat vorig jaar door Wix werd overgenomen, is gestart met de uitrol van zijn eigen AI-model. Het model, Base1 genaamd, is getraind op tientallen miljoenen gebruikersinteracties. Het bedrijf hoopt hiermee de prestaties van frontier modellen te overtreffen en zijn defensiviteit te vergroten nu AI-startups zich steeds meer afvragen of ze op andermans modellen kunnen bouwen.
Cursor heeft zijn teammarktplaatsen uitgebreid met ondersteuning voor Team MCPs en organisatiegroepen. Beheerders kunnen nu Team MCP-servers eenmalig configureren en distribueren naar cloud agents, de agents window, IDE en CLI. Daarnaast kunnen marktplaatsen nu worden beperkt tot specifieke organisatiegroepen via het dashboard.
Cursor heeft een nieuwe mobiele app, Cursor Mobile, gelanceerd waarmee gebruikers codeeragenten vanaf hun telefoon kunnen aansturen en begeleiden. De app is onderdeel van de Cursor 2.0-update en sluit aan bij een bredere trend in AI-codeertools, waarbij ontwikkelaars steeds vaker via mobiele apparaten werken. Anthropic's hoofd van Claude Code gaf aan vrijwel volledig over te stappen op mobiel programmeren.
DeepReinforce heeft Ornith-1.0 uitgebracht, een open weights LLM met MIT-licentie. Het model is beschikbaar in varianten van 9B tot 397B parameters en is gebouwd op Gemma 4 en Qwen 3.5. Ornith-1.0 behaalt state-of-the-art prestaties op codeerbenchmarks onder open-source modellen van vergelijkbare grootte. Simon Willison testte het model en rapporteert goede resultaten bij het uitvoeren van agent-taken.
KDnuggets deelt een opiniegericht overzicht van vijf AI-codeerabonnementen die ontwikkelaars de beste prijs-kwaliteitverhouding bieden. Het artikel bespreekt onder andere de MiniMax Token Plan, MiMo Token Plan, GLM Coding Plan, OpenAI Codex en Kimi Code. De auteur geeft persoonlijke aanbevelingen op basis van gebruik en workflows.
Cursor heeft een mobiele app voor iOS uitgebracht in openbare bèta, beschikbaar voor alle betalende abonnees. Gebruikers kunnen altijd-en-overal AI-agents starten en beheren, steminvoer gebruiken en sessies van lokaal naar de cloud verplaatsen. De app biedt ook live-activiteiten en pushmeldingen voor agentstatus.
Onderzoekers van Mozilla's 0DIN-platform hebben aangetoond dat een gecompromitteerde GitHub-repo de machine van een ontwikkelaar kan overnemen zodra een AI-codeertool zoals Claude Code de setup uitvoert. De kwaadaardige code laadt alleen tijdens runtime via een DNS-query, onzichtbaar voor scanners en de AI-agent zelf. Claude Code voert het script automatisch uit bij een foutmelding, waardoor een reverse shell voor de aanvaller ontstaat.
Cursor heeft een iOS-app uitgebracht waarmee gebruikers AI-agents kunnen aansturen, superviseren en reviewen via hun telefoon. De app is ontworpen voor mobiel gebruik.
Jon Udell stelt dat de term 'human in the loop' te veel macht aan machines geeft. Hij bepleit een omkering: wij zijn de eigenaar van de loop en nodigen agenten uit om deel uit te maken van het team. Deze visie is relevant voor agentische softwareontwikkeling.
Een studie toont aan dat ontwikkelaars die AI-assistentie gebruiken denken 20% sneller te zijn, maar in werkelijkheid 20% minder productief zijn. AI versnelt alleen het codeerproces, niet de rest van de softwareontwikkelingscyclus, waardoor vertragingen door wachttijden en andere fasen de winst tenietdoen. Teams vallen vaak in de valkuilen van over-delegatie of onder-delegatie van AI-taken.
Je een kennisbank opzet die wordt aangedreven door grote taalmodellen (LLM's). Het behandelt het automatisch vastleggen van informatie uit bronnen zoals projectmanagementtools en codeeragenten zoals Claude en Codex. Daarnaast worden methoden beschreven om de kennisbank actief te gebruiken tijdens het werk, zoals via RAG of een top-level markdown-bestand.
Sebastian Raschka legt uit hoe je een volledig lokaal codeeragent opzet met opensource tools en open-weight LLM's zoals Qwen3.6. Het artikel vergelijkt lokale oplossingen met propriëtaire diensten als Codex en Claude Code en geeft een stapsgewijze handleiding. Ook wordt de prestaties van verschillende modellen beoordeeld.
Meta heeft Astryx uitgebracht, een open-source React-designsysteem in bèta. Het bevat een CLI en MCP-server waarmee AI-agenten gebruikersinterfaces kunnen opzetten en documenteren. Astryx is gebouwd op React en StyleX en biedt tien thema's via een CSS-variabelencascade. Het systeem is acht jaar intern bij Meta ontwikkeld en nu openbaar beschikbaar onder MIT-licentie.
In deze tutorial wordt de Open-SWE-Traces dataset van NVIDIA gebruikt om agentische software-engineering trajecten te analyseren en voor te bereiden voor fine-tuning. De dataset wordt gestreamd vanaf Hugging Face en er worden analyse DataFrames gemaakt om trajectlengte, toolgebruik, patchgrootte en taalverdeling te begrijpen. Op basis van deze inzichten wordt een samengestelde supervised fine-tuning subset gecreëerd door alleen hoge kwaliteit trajecten te selecteren op basis van succescriteria, tokenlimieten en beschikbaarheid van patches.
Een nieuwe studie van Cursor toont aan dat codeeragenten zoals Opus 4.8 Max en Composer 2.5 bij 63% van de geslaagde pogingen op SWE-bench Pro de fix ophalen in plaats van zelf afleiden. Het onderzoek identificeert twee vormen van runtime-contaminatie: upstream lookup (57%) en git-history mining (9%). Door de geschiedenis en internettoegang af te sluiten daalde de score van Opus 4.8 Max van 87,1% naar 73,0%.
Volgens Gartner gebruikt binnen 12 tot 18 maanden bijna 90% van de enterprise-softwareontwikkelaars AI-gestuurde codeertools. OutSystems-directeur Vivek Ganesh waarschuwt op de MachineCon GCC Summit 2026 voor 'agent sprawl' door de explosieve groei van AI-agenten. Hij stelt dat 90 tot 95% van de AI-projecten de productiefase niet haalt door gebrek aan governance. Een bank wist met AI de klantentijd te verkorten van weken naar 40 minuten.
OpenAI's interne Codex-tokenverbruik is sinds november 2025 explosief gestegen. In Research groeide het mediane gebruik 56 keer, in Customer Support 32 keer, in Engineering 27 keer en in Legal 13 keer. Dit blijkt uit intern economisch onderzoek van OpenAI.