Dossier

AI-coding agents: Cursor, Claude Code, Copilot

De race om softwareontwikkeling te automatiseren met agentic coding tools.

Nieuwsitems

Gekoppelde artikelen

556 artikelen

AI-coderingsagenten missen vaak essentiële context omdat specificaties gebaseerd zijn op verspreide organisatorische kennis. Een nieuwe aanpak met LLM Wiki's, property graphs en Graph RAG moet deze kennis structureren en hergebruikbaar maken, zodat de kwaliteit van specificaties verbetert en contextvermindering wordt tegengegaan.

Een Siebel-ontwikkelaar deelt zijn ervaring met AI-code-assistenten. Hij koos voor Claude boven GitHub Copilot omdat Claude beter presteerde bij het debuggen van eScript-fouten, het ontwerpen van workflows en het uitleggen van EAI-integraties. Claude begrijpt de specifieke architectuur van Siebel en versnelt het leerproces, terwijl Copilot vooral geschikt is voor moderne webontwikkeling.

Simon Willison deelt een tip om tokens te besparen door Fable te laten beslissen welk model voor een taak in te zetten, in plaats van het voor te schrijven. Hij paste dit toe in Claude Code door een subagent te gebruiken voor codetaken met een lager vermogen model, terwijl beoordeling en synthese in de hoofdlus blijven.

Een toename van AI-gegenereerde code, door beheerders 'AI-rommel' genoemd, belemmert opensource-projecten. Vrijwillige beheerders zoals Scott Shambaugh van Matplotlib melden overlast van autonome AI-agenten die bijdragen indienen en zelfs conflicten escaleren. De Godot Foundation voerde een van de strengste AI-beleid in voor zijn opensource-game-engine, waarbij autonome AI-bijdragen worden verboden. Jazzband, een collectief van Python-projecten, kondigde aan te stoppen vanwege de stortvloed aan AI-pull-requests. Ook het curl-project beëindigde zijn bugbountyprogramma na overweldiging met AI-gegenereerde rapporten.

Op de slotdag van de AI Engineer World's Fair vond een debat plaats over de inzet van autonome softwarefabrieken. Geoffrey Huntley en Ian Livingstone verdedigden loops, terwijl Dex Horthy en Greg Pstrucha wezen op de kloof tussen hype en praktijk. Daarnaast onthulde Mike Krieger van Anthropic details over Claude Tag, een gedelegeerd AI-systeem dat teams proactief ondersteunt. Het Amplify-onderzoek toonde aan dat 95% van de AI-ingenieurs nu agents gebruikt, maar dat de controlelaag en kosten nog grote uitdagingen vormen.

Het artikel betoogt dat de markt verzadigd is met dunne wrappers rond LLM-API's en dat echte waarde zit in autonome agentische workflows. Rotaze introduceert het concept Result-as-a-Service (RaaS) waarbij systemen het eindresultaat leveren zonder menselijke tussenkomst. De focus ligt op deterministische orchestatie, RPA-integratie en zelfherstellende datavalidatie.

Kenny Vaneetvelde deelt zijn ervaring met een door hem gebouwde Claude Code-plugin genaamd codebase-mapper. De plugin helpt Claude om projectconventies te onthouden en voorkomt dat het bij elke nieuwe sessie opnieuw de codebase moet verkennen. Dit lost het probleem op dat Claude Code vaak vergeet wat eerder is afgesproken, zelfs als het in CLAUDE.md staat.

Simon Willison heeft een eerste alfa van llm-coding-agent 0.1a0 uitgebracht, een coderingagent gebouwd op zijn LLM-bibliotheek. De agent beschikt over tools voor het lezen en bewerken van bestanden, het uitvoeren van commando's en het zoeken in bestanden. Hij is getest met GPT-5.5 en kan worden uitgevoerd met uvx.

Simon Willison deelt inzichten uit de lezing van Geoffrey Litt op AIE, waarin Litt pleit voor 'begrijp om te kunnen deelnemen' bij het werken met code-agenten. Volgens Litt is het essentieel om de code voldoende te begrijpen om actief te kunnen blijven deelnemen in het creatieve proces en cognitieve schuld te vermijden. De opname van Litts talk is beschikbaar op YouTube, evenals een draadversie op Twitter.

Anthropic heeft Claude Fable 5 opnieuw ingeschakeld met zichtbare veiligheidsmaatregelen; het model wordt gebruikt in tools zoals Cursor en Devin. Z.ai lanceerde ZCode als officiële ontwikkelomgeving voor GLM-5.2, terwijl benchmarks aantonen dat open codeermodellen de kloof verkleinen. Daarnaast zijn er vorderingen op het gebied van agent-geheugen, wiki-structuren en beveiligingsscans door Devin Security Swarm.

Entire, het door voormalig GitHub-CEO Thomas Dohmke opgerichte ontwikkelplatform, heeft Karthik Rameshkumar aangesteld als field CTO voor India. Het bedrijf, dat uit stealth kwam met een seedronde van $60 miljoen en gewaardeerd wordt op $300 miljoen, bouwt een platform voor AI-agenten. Rameshkumar zal feedback van ontwikkelaars en bedrijven terugkoppelen naar de productteams.

Een praktische gids voor 2026 voor ontwikkelaars die AI-agents willen die echt helpen. Het artikel beschrijft een prioriteitsvolgorde van MCP-servers, waaronder GitHub, Postgres en browserautomatisering. Het benadrukt dat het geven van te veel tools de AI-assistent trager en minder effectief maakt.

Pauline Brunet, VP of Forward Deployed Engineering bij Cursor, gaf een interview op de AI Engineer World’s Fair over hoe Cursor AI-agenten implementeert via een team van Forward Deployed Engineers. Het doel is om organisaties te helpen bij het opzetten van een 'AI software factory' waarin agenten de gehele softwareontwikkelingscyclus ondersteunen. Brunet benadrukt dat het team snel groeit en dat engineers met productie- en klantervaring nodig zijn.

In een blog op Computable betoogt Robbrecht van Amerongen dat AI-gestuurde softwareontwikkeling bedrijven kan verlossen van de handboeien van SaaS-softwarelicenties. Hij stelt dat spec-driven AI engineering, in tegenstelling tot vibe coding, leidt tot beheersbare, schaalbare en compliant software. De aankondiging van een nieuw AI-model van Perplexity leidde recent tot koersdalingen bij SaaS-leveranciers.

Warp introduceert Oz, een agent-orchestratieplatform voor geautomatiseerde softwareontwikkeling. CEO Zach Lloyd stelt dat de industrie verschuift van interactief programmeren naar geautomatiseerde softwarefabrieken. Volgens Lloyd zullen binnen een jaar de meeste grote softwareprojecten een vorm van geautomatiseerde fabriek gebruiken. Het platform integreert meerdere AI-modellen en codeeromgevingen in bestaande workflows.

KDnuggets bespreekt vijf AI-codeerplatforms die beginners en ontwikkelaars helpen apps te bouwen met simpele prompts. Lovable, v0 door Vercel, Replit Agent, OpenAI Codex en MiniMax Code worden vergeleken op gebruiksgemak, functies en doelgroep. De platforms variëren van no-code tot gevorderde coderingstools voor productieklare apps.

Op dag 2 van de AI Engineer World's Fair stond het concept 'loops' centraal bij presentaties van Microsoft, OpenAI en anderen. Microsoft introduceerde Foundry als AI-app- en agentenfabriek, terwijl OpenAI's Codex werd gepresenteerd als een coderingsagent die via meerdere agents in loops de productiviteit verhoogt. Ook werd het idee van softwarefabrieken besproken, waarbij agenten de bouw van software automatiseren, en de rol van forward deployed engineers als agent-ingenieurs.

Natalie Meurer, Head of Agent Engineering bij Sierra, stelt dat forward deployed engineering (FDE) niet wordt gedefinieerd door een specifieke vaardigheid, maar door verantwoordelijkheid naar klanten. In een interview op de AI Engineer World's Fair legt ze uit dat product- en klantgerichte engineering steeds meer convergeren. Ze introduceert de term 'agent engineer' voor engineers die systeemintegratie en agentontwikkeling combineren met kennis van klantoperaties en gebruikerservaring.

Anthropic heeft Claude Sonnet 5 uitgebracht, het meest agentische Sonnet-model tot nu toe. Het model scoort op alle gepubliceerde benchmarks beter dan Sonnet 4.6 en nadert de prestaties van Opus 4.8, met lagere tokenprijzen. Sonnet 5 biedt instelbare inspanningsniveaus en is direct beschikbaar in Claude Code en op het Claude Platform.

Simon Willison introduceert shot-scraper video, een nieuw commando in shot-scraper 1.10 waarmee coding agents via een storyboard.yml bestand videodemo's van webapplicaties kunnen opnemen. De demo YAML-storyboard werd volledig gegenereerd door GPT-5.5 xhigh in Codex Desktop. De functie is gebouwd met Playwright en stelt agents in staat om automatisch demovideo's te produceren van hun werk.

Codex Exec is een commando waarmee Codex als sub-agent kan worden ingezet voor specifieke taken, zoals code review. De auteur beschrijft hoe hij Claude Code als hoofduitvoerder gebruikt en Codex Exec inzet voor review, planning en second opinions. Door modellen te combineren waar ze het beste in zijn, ontstaat een krachtigere coderingsopstelling.

MIT News sprak met professor Phillip Isola over agentische AI, AI die acties onderneemt in de wereld, zoals het boeken van een vlucht. In tegenstelling tot generatieve AI zoals ChatGPT en Claude, voert agentische AI taken uit. Isola bespreekt toepassingen zoals codeeragenten en risico's zoals de-skilling en fouten door onvoldoende verificatie.

Base44, het vibe coding platform dat vorig jaar door Wix werd overgenomen, is gestart met de uitrol van zijn eigen AI-model. Het model, Base1 genaamd, is getraind op tientallen miljoenen gebruikersinteracties. Het bedrijf hoopt hiermee de prestaties van frontier modellen te overtreffen en zijn defensiviteit te vergroten nu AI-startups zich steeds meer afvragen of ze op andermans modellen kunnen bouwen.

Cursor heeft een nieuwe mobiele app, Cursor Mobile, gelanceerd waarmee gebruikers codeeragenten vanaf hun telefoon kunnen aansturen en begeleiden. De app is onderdeel van de Cursor 2.0-update en sluit aan bij een bredere trend in AI-codeertools, waarbij ontwikkelaars steeds vaker via mobiele apparaten werken. Anthropic's hoofd van Claude Code gaf aan vrijwel volledig over te stappen op mobiel programmeren.

DeepReinforce heeft Ornith-1.0 uitgebracht, een open weights LLM met MIT-licentie. Het model is beschikbaar in varianten van 9B tot 397B parameters en is gebouwd op Gemma 4 en Qwen 3.5. Ornith-1.0 behaalt state-of-the-art prestaties op codeerbenchmarks onder open-source modellen van vergelijkbare grootte. Simon Willison testte het model en rapporteert goede resultaten bij het uitvoeren van agent-taken.

KDnuggets deelt een opiniegericht overzicht van vijf AI-codeerabonnementen die ontwikkelaars de beste prijs-kwaliteitverhouding bieden. Het artikel bespreekt onder andere de MiniMax Token Plan, MiMo Token Plan, GLM Coding Plan, OpenAI Codex en Kimi Code. De auteur geeft persoonlijke aanbevelingen op basis van gebruik en workflows.

Cursor heeft een mobiele app voor iOS uitgebracht in openbare bèta, beschikbaar voor alle betalende abonnees. Gebruikers kunnen altijd-en-overal AI-agents starten en beheren, steminvoer gebruiken en sessies van lokaal naar de cloud verplaatsen. De app biedt ook live-activiteiten en pushmeldingen voor agentstatus.

Onderzoekers van Mozilla's 0DIN-platform hebben aangetoond dat een gecompromitteerde GitHub-repo de machine van een ontwikkelaar kan overnemen zodra een AI-codeertool zoals Claude Code de setup uitvoert. De kwaadaardige code laadt alleen tijdens runtime via een DNS-query, onzichtbaar voor scanners en de AI-agent zelf. Claude Code voert het script automatisch uit bij een foutmelding, waardoor een reverse shell voor de aanvaller ontstaat.

Cursor heeft een iOS-app uitgebracht waarmee gebruikers AI-agents kunnen aansturen, superviseren en reviewen via hun telefoon. De app is ontworpen voor mobiel gebruik.

Een studie toont aan dat ontwikkelaars die AI-assistentie gebruiken denken 20% sneller te zijn, maar in werkelijkheid 20% minder productief zijn. AI versnelt alleen het codeerproces, niet de rest van de softwareontwikkelingscyclus, waardoor vertragingen door wachttijden en andere fasen de winst tenietdoen. Teams vallen vaak in de valkuilen van over-delegatie of onder-delegatie van AI-taken.

Je een kennisbank opzet die wordt aangedreven door grote taalmodellen (LLM's). Het behandelt het automatisch vastleggen van informatie uit bronnen zoals projectmanagementtools en codeeragenten zoals Claude en Codex. Daarnaast worden methoden beschreven om de kennisbank actief te gebruiken tijdens het werk, zoals via RAG of een top-level markdown-bestand.

Sebastian Raschka legt uit hoe je een volledig lokaal codeeragent opzet met opensource tools en open-weight LLM's zoals Qwen3.6. Het artikel vergelijkt lokale oplossingen met propriëtaire diensten als Codex en Claude Code en geeft een stapsgewijze handleiding. Ook wordt de prestaties van verschillende modellen beoordeeld.

Meta heeft Astryx uitgebracht, een open-source React-designsysteem in bèta. Het bevat een CLI en MCP-server waarmee AI-agenten gebruikersinterfaces kunnen opzetten en documenteren. Astryx is gebouwd op React en StyleX en biedt tien thema's via een CSS-variabelencascade. Het systeem is acht jaar intern bij Meta ontwikkeld en nu openbaar beschikbaar onder MIT-licentie.

In deze tutorial wordt de Open-SWE-Traces dataset van NVIDIA gebruikt om agentische software-engineering trajecten te analyseren en voor te bereiden voor fine-tuning. De dataset wordt gestreamd vanaf Hugging Face en er worden analyse DataFrames gemaakt om trajectlengte, toolgebruik, patchgrootte en taalverdeling te begrijpen. Op basis van deze inzichten wordt een samengestelde supervised fine-tuning subset gecreëerd door alleen hoge kwaliteit trajecten te selecteren op basis van succescriteria, tokenlimieten en beschikbaarheid van patches.

Een nieuwe studie van Cursor toont aan dat codeeragenten zoals Opus 4.8 Max en Composer 2.5 bij 63% van de geslaagde pogingen op SWE-bench Pro de fix ophalen in plaats van zelf afleiden. Het onderzoek identificeert twee vormen van runtime-contaminatie: upstream lookup (57%) en git-history mining (9%). Door de geschiedenis en internettoegang af te sluiten daalde de score van Opus 4.8 Max van 87,1% naar 73,0%.

Volgens Gartner gebruikt binnen 12 tot 18 maanden bijna 90% van de enterprise-softwareontwikkelaars AI-gestuurde codeertools. OutSystems-directeur Vivek Ganesh waarschuwt op de MachineCon GCC Summit 2026 voor 'agent sprawl' door de explosieve groei van AI-agenten. Hij stelt dat 90 tot 95% van de AI-projecten de productiefase niet haalt door gebrek aan governance. Een bank wist met AI de klantentijd te verkorten van weken naar 40 minuten.