Dossier
AI-coding agents: Cursor, Claude Code, Copilot
De race om softwareontwikkeling te automatiseren met agentic coding tools.
Nieuwsitems
Gekoppelde artikelen
In dit deel wordt onderzocht hoe AI-agenten in Rust kunnen communiceren met lokale modellen zonder HTTP-socket, via stdin/stdout. De auteur gebruikt DwarfStar, een lokale inferentie-engine voor DeepSeek V4 Flash en PRO, die naast HTTP ook directe procesaansturing ondersteunt.
De tutorial laat zien hoe je ADK-agents zonder eigen code direct toegang geeft tot de GitHub MCP-server via McpToolset. Hierdoor worden repository-, issue- en pull-request-tools direct beschikbaar zonder wrapperfuncties te schrijven.
Jarred Sumner beweerde dat Claude Code v2.1.181 de Rust-port van Bun gebruikt. Simon Willison heeft gecontroleerd of dit klopt en vond bewijs in de binaire bestanden van Claude. De Rust-versie van Bun draait in productie op miljoenen apparaten, met 10% snellere opstarttijd op Linux.
Cursor in Slack deelt nu een plan voordat het begint, werkt in multi-repo-omgevingen en kan berichten over kanalen en threads heen lezen en versturen. De interactie is verbeterd met compacte footer-links en schonere weergave van tabellen, PR's en artefacten.
Thibault Sottiaux meldt dat GPT-5.6 onverwacht bestanden kan verwijderen wanneer Codex wordt gebruikt zonder sandboxing-bescherming. Dit gebeurt wanneer het model probeert de $HOME-omgevingsvariabele te overschrijven en per ongeluk $HOME verwijdert.
Replit heeft in zes maanden de code-output bijna verdrievoudigd door AI-agents in te zetten voor code review, incidentonderzoek en andere taken. Het bedrijf noemt dit het begin van een 'zelfrijdend bedrijf' waar mensen de richting bepalen maar agents het werk uitvoeren. De productiviteit steeg met 2,9x per engineer, terwijl kwaliteit en reviewtijden gelijk bleven.
SpaceXAI heeft Grok Build onder de Apache 2.0-licentie open-source gemaakt na privacykritiek. De AI-codeeragent uploadde breed mappen naar zijn servers, wat leidde tot een terugslag van gebruikers.
Pi is een AI-codeerassistent die zich onderscheidt door minimale ingebouwde functies en een extensie-architectuur. Het artikel beschrijft de installatie, het gebruik van vier basistools en het bouwen van een eigen extensie voor beveiliging. De tool ondersteunt meerdere providers zoals Anthropic, OpenAI en Google. Pi's ontwerp legt de nadruk op transparantie en controle over wat er in de context van het model terechtkomt.
Claude Fable 5 is terug na een tijdelijke terugtrekking en wordt nu beschouwd als het krachtigste coderingsmodel. Anthropic heeft echter het gebruik beperkt tot 50% van de wekelijkse limieten. Dit artikel biedt strategieën om Fable efficiënt in te zetten door het te gebruiken voor planning en refactoring, terwijl implementatie wordt overgelaten aan modellen als Claude Opus 4.8 of GPT-5.6.
OpenAI lanceert zijn eerste hardwareproduct: de Codex Micro, een speciaal toetsenbord voor de programmeerassistent Codex. Het toetsenbord kost 230 dollar en is uitgerust met Agent Keys, een joystick en een draaiknop. Daarnaast werkt OpenAI aan een slimme speaker met ChatGPT.
OpenAI heeft zijn eerste merkhardware gelanceerd: de Codex Micro, een $230 keypad ontwikkeld in samenwerking met Work Louder. Het apparaat stelt gebruikers in staat om codeeragents te bedienen via een mechanisch toetsenbord met agent keys, joystick en draaiknop. Het is een nicheproduct, maar markeert OpenAI's eerste stap in eigen hardware.
OpenAI's GPT-5.6 Sol heeft de hoogste score behaald op ReactBench, een nieuwe benchmark voor AI-codeeragents. Het model scoorde 43% op de 51 taken, net boven Anthropic's Claude Fable 5 met 41%. ReactBench test realistische React-ontwikkelingstaken en gebruikt React Doctor voor verificatie. Uit de kostenanalyse bleek dat GPT-5.6 Sol aanzienlijk goedkoper is dan Claude Fable 5.
SpaceXAI heeft de broncode van Grok Build vrijgegeven op GitHub onder de Apache 2.0-licentie. Grok Build is een terminal-gebaseerde AI-codeeragent die context assembleert, bestanden bewerkt, shell-commando's uitvoert en het web doorzoekt. De release omvat de agent-harness, TUI, CLI-shell en ontwikkeltools.
OpenAI heeft het Codex Micro-toetsenbord uitgebracht, een limited-edition apparaat van $230 dat is ontworpen om te worden gebruikt met de AI-codeerassistent Codex. Het toetsenbord heeft verlichte toetsen, een joystick en een draaiknop voor het beheren van AI-agents. De release komt terwijl OpenAI verwikkeld is in een rechtszaak met Apple over diefstal van handelsgeheimen.
Databricks heeft het open-weights Inkling-model van Thinking Machines Lab toegevoegd aan zijn Unity AI Gateway. Het model is geoptimaliseerd voor codeertaken, agentische redenering en multimodale inputs. Dankzij de integratie kunnen enterprise-klanten het model veilig inzetten via Unity AI Gateway.
Atlassian heeft Jira uitgebreid met nieuwe functies om werk van AI-agenten te plannen, distribueren en volgen. De nieuwe Jira Planner zet onvolledige projectideeën om in technische specificaties, terwijl Jira Coding Agent en integraties met derde partijen zoals Claude, Codex, Cursor en GitHub Copilot werkitems omzetten in opdrachten. Met automatiseringsregels en een agentic engineering template kunnen teams workflows ontwerpen waarin agenten automatisch taken krijgen toegewezen.
Emergent Labs Inc., een vibe coding startup die niet-technische gebruikers in staat stelt productieklare bedrijfssoftware te ontwikkelen, heeft 130 miljoen dollar opgehaald in een Series C-ronde. De investering werd geleid door Creaegis en Claypond, met deelname van Khosla Ventures, SoftBank, Lightspeed, Sentinel Global en Y Combinator. Het bedrijf is nu gewaardeerd op 1,5 miljard dollar en is een van de snelste 'eenhoorns' ooit.
OpenAI heeft een audit uitgevoerd van de codeerbenchmark SWE-Bench Pro en ontdekte dat ongeveer 30% van de openbare taken defect is. De audit, uitgevoerd met behulp van AI-agenten en ervaren software-ingenieurs, leidde tot het intrekken van de eerdere aanbeveling om de benchmark te gebruiken. Dit toont aan dat precieze scores niet altijd valide metingen zijn voor codeervaardigheden.
Sinds begin juni versleutelt OpenAI's codeertool Codex de instructies die een hoofdagent aan subagenten doorgeeft. Ontwikkelaars kunnen niet meer zien hoe taken intern worden gedelegeerd; de sessiegeschiedenis toont alleen onleesbare strings. Voor de grotere GPT-5.6 varianten Sol en Terra is de versleuteling verplicht, maar gebruikers melden dat dit soms leidt tot mislukte overdrachten. OpenAI heeft de wijziging niet toegelicht, maar vermoedens gaan richting bescherming tegen distillatie of privacy.
Het in Bengaluru gevestigde AI-startup Emergent heeft een Series C-ronde van 130 miljoen dollar afgesloten, waarmee de waardering op 1,5 miljard dollar komt. Het platform stelt gebruikers in staat om via natuurlijke taal software te bouwen, zonder codeerervaring. Volgens CEO Mukund Jha wil Emergent softwareontwikkeling democratiseren. Het bedrijf heeft al meer dan 12 miljoen applicaties op het platform en een jaarlijkse terugkerende omzet van 100 miljoen dollar.
Claude's gebruikslimieten zijn geen vaste berichtenteller maar een tweelaags systeem dat reageert op gesprekslengte, modelkeuze en toolgebruik. Door conversaties vooraf te plannen, gebruik te maken van geheugen en chatzoekopdracht, het model aan te passen aan de taak en zwaar werk op te splitsen, kun je de limieten omzeilen zonder een planupgrade.
Op de AI Engineer World's Fair 2026 stond de verschuiving centraal van het bouwen met agenten naar het bouwen van systemen eromheen. Loop engineering wordt de nieuwe controlelaag, waarbij ingenieurs in een buitenste lus toezicht houden. AI-engineering dringt door in het bedrijfsleven via forward deployed engineers, en codeeragenten zoals Claude Code en Codex vervangen IDE's als belangrijkste interface. Ook wint het concept 'skills' terrein als portabele kennis voor agenten.
De codeeragenten Mistral Vibe for Code, Claude Code, Cursor en OpenAI Codex zijn vergeleken op een praktische taak: van prompt naar pull request. Mistral Vibe for Code scoort het hoogst met 22/25 punten, gedreven door lagere kosten, openheid en controle. Claude Code en Codex delen de tweede plaats met 21/25. De vergelijking beoordeelt vijf dimensies: scaffolding, testgeneratie, PR/async, oppervlaktedekking en kosten/openheid.
Anthropic heeft ontdekt dat hackers misbruik maken van Claude Code, een AI-tool, om Australische bedrijven aan te vallen. De cyberaanval legt tekortkomingen bloot in AI-governance bij Australische ondernemingen, waar toezicht achterblijft bij de adoptie.
Armin Ronacher stelt dat de gedeelde taal van een softwareproject niet Engels of Python is, maar een gemeenschappelijk begrip van concepten, grenzen en eigenaarschap. Voor de komst van AI-agents werd dit begrip onderhouden door wrijving, zoals code reviews en overleg. Deze wrijving synchroniseerde mensen, maar is nu deels verdwenen door agents. Het citaat verscheen op de blog van Simon Willison.
AWS introduceert QA Studio, een referentieoplossing voor agentische QA-automatisering op basis van Amazon Nova Act. De tool ondersteunt batch-regressietests en CI/CD-integratie via test suites en een command-line interface. Gebruikers kunnen testcases in natuurlijke taal definiëren en parallel uitvoeren op AWS Fargate. De CLI maakt agentische testuitvoering in geautomatiseerde pipelines mogelijk met omgevingsoverschrijvingen en veilig credential-beheer.
Concho AI heeft een platform gelanceerd dat softwarecode semantisch begrijpt en organiseert, waardoor ontwikkelaars en AI-agenten grote, complexe codebases kunnen moderniseren. Het platform fungeert als een kennisdeling die integreert met AI-assistenten zoals Anthropic's Claude via het Model Context Protocol. Hierdoor kunnen zowel technische als niet-technische gebruikers vragen stellen over de code en bedrijfsprocessen, zonder dat ze diepgaande technische kennis nodig hebben.
Conductor is een extensie voor Gemini CLI die contextproblemen oplost door middel van Context-Driven Development. Het artikel behandelt installatie, projectconfiguratie en het gebruik van commandos zoals newTrack, implement, status, revert en review.
Oracle heeft een nieuwe AI-native ervaring aangekondigd voor Fusion Applications binnen Oracle AI Agent Studio, waarmee ontwikkelaars, klanten en partners samen agenten kunnen bouwen. De uitbreiding richt zich op pro-code-ontwikkelaars en codeeragenten zoals Claude Code, Codex en Gemini. Hierdoor kunnen zij agentische applicaties bouwen die binnen Fusion draaien en gebruikmaken van realtime transactionele data.
IBM heeft Bob geïntroduceerd, een AI-code-assistent die het gehele softwareontwikkelingstraject orkestreert: van planning en design tot testing, deployment en modernisering. Het platform gebruikt multimodel orkestratie om taken naar het meest geschikte model te routeren en biedt kosteninzicht via Bob coins. Eerste gebruikers in de Benelux, waaronder Integration Designers, zijn begonnen met Bob.
Een artikel op Towards AI belicht tien nieuwe functies van Claude Code die in de periode juni-juli 2026 zijn uitgebracht. Deze omvatten verbeterde debugmogelijkheden, MCP-authenticatie op ondernemingsniveau en aanpassingen aan achtergrondagenten. De functies zijn afkomstig uit de officiële changelog van Anthropic en de documentatie van Claude Code.
Anthropics Claude Fable 5 scoort 80,3% tegen 64,6% van OpenAI's GPT-5.6 Sol op SWE-Bench Pro. Ontwikkelaars stappen massaal over van Claude Code naar Codex vanwege veranderingen in de abonnementsvoorwaarden van Anthropic. De beste codeermodellen worden geconfronteerd met een gebruikersvertrekcrisis.
OpenAI's Codex heeft in zes maanden een meer dan vertienvoudiging van het aantal gebruikers doorgemaakt, met 7 miljoen gebruikers waarvan 1 miljoen in de afgelopen dag. Dit overtreft de gerapporteerde 2 miljoen gebruikers van Claude Code in februari. Het artikel bespreekt verder Prime Intellects verifiers v1 voor agent-RL en andere AI-ontwikkelingen.
Anthropic heeft Claude Sonnet 5 uitgebracht, het meest agentische middenklasse-model, dat Sonnet 4.6 overtreft op alle benchmarks. Het model scoort 63,2% op SWE-bench Pro en 81,2% op OSWorld-Verified. De introductieprijs is $2/$10 per miljoen tokens, later $3/$15. Sonnet 5 biedt inspanningsniveaus en een vernieuwde tokenizer. Het is live in Claude Code en op het Claude Platform.
OpenAI beschrijft hoe data science-teams Codex kunnen inzetten voor het maken van root-cause-analyses, impactrapportages, KPI-memo's, scoped analyses en dashboardspecificaties op basis van echte werkinputs.
Simon Willison onderzocht de impact van codeeragenten en modellen zoals Opus 4.5 op zijn eigen productiviteit. Hij deelt een GitHub-grafiek die een piek in codeactiviteit voor Datasette laat zien, samenvallend met de komst van Opus 4.8, GPT-5.5, Fable 5 en GPT-5.6 Sol.
Een Microsoft-studie toont aan dat command-line AI-coderingsagenten leiden tot 24% meer samengevoegde pull-aanvragen. De adoptie en reviewcapaciteit beïnvloeden de resultaten.
Lange sessies met AI-modellen zoals Claude Code lijden aan contextverval, nog voordat de tokenlimiet is bereikt. Het artikel legt uit hoe intrinsiek en inhoudelijk verval de prestaties aantasten en biedt praktische richtlijnen voor contextbeheer, zoals het cureren van de initiële context, het schoonhouden van sessies en het resetten bij fouten.
Grok 4.5, gelanceerd op 8 juli 2026 door SpaceXAI en Cursor, gebruikt gemiddeld 15.954 outputtokens per taak op SWE-Bench Pro, tegenover 67.020 voor Opus 4.8. Dit resulteert in een kostenbesparing van 17 keer: $0,096 versus $1,68 per opgeloste taak. Het model staat op de vierde plaats in de Intelligentie-index van Artificial Analysis.
Je met Claude Code of andere codeer-agents honderden agenten parallel kunt laten werken. Het legt uit hoe je headless mode gebruikt, taken kunt scopen en agenten effectief kunt laten samenwerken. De auteur deelt praktische technieken om productiviteit te verhogen door een hogere abstractielaag te gebruiken.
KTern.AI, een SAP-platform voor digitale transformatie, gebruikte Amazon Bedrock AgentCore om meer dan 20 AI-agenten te bouwen en in te zetten voor SAP-workloads. Deze agenten voeren autonoom workflows uit zoals reverse engineering, code-analyse en uitzonderingsdetectie. Het resultaat is een 45% kortere doorlooptijd van SAP-projecten en 60-70% minder handmatige inspanning bij ontdekking en beoordeling. Het artikel beschrijft de architectuur, uitdagingen en lessen van de implementatie.
Cursor, de AI-codeeragent, heeft een update uitgebracht met Side Chats waarmee gebruikers nevenvragen kunnen stellen zonder de hoofdchat te onderbreken. Daarnaast is er een nieuwe zoekfunctie voor agenttranscripties, opnieuw ontworpen project- en repositorykiezers, en uitgebreide hooks voor het observeren en besturen van agentgesprekken.
Meta heeft Muse Spark 1.1 gelanceerd, een nieuw vlaggenschip large language model geoptimaliseerd voor multi-agent automatisering. Het model is beschikbaar in de Meta AI chatbotdienst en via een API voor ontwikkelaars. Muse Spark 1.1 beschikt over contextcomprimering om data van AI-agenten efficiënt te verwerken en heeft een contextvenster van 1 miljoen tokens. Het model behaalde hoge scores op programmeerbenchmarks.
AI-agent startup Lyzr haalt naar verluidt $100 miljoen op in een financieringsronde tegen een waardering van $500 miljoen. De ronde heeft interesse van $400 miljoen van investeerders, waaronder durfkapitaalfondsen uit Silicon Valley en het Midden-Oosten. Lyzr biedt een cloudplatform waarmee ontwikkelaars in enkele minuten AI-agenten kunnen bouwen.
China heeft organisaties gewaarschuwd om bepaalde versies van Claude Code te verwijderen vanwege vermeende backdoor-risico's. Anthropic stelt dat de functionaliteit bedoeld is als anti-misbruikbescherming.
Meta heeft donderdag Muse Spark 1.1 gelanceerd, een multimodaal AI-model voor agentisch coderen dat concurreert met soortgelijke producten van OpenAI en Anthropic. Het model kan multistap-redenering uitvoeren, complexe processen beheren en bugs oplossen. De prijs is $1,25 per miljoen inputtokens en $4,25 per miljoen outputtokens. CEO Mark Zuckerberg prees het model op X als sterk in agentische prestaties en toolgebruik.
Towards Data Science publiceert een artikel over het kiezen van de beste interface voor AI-coderingsagenten. De auteur bespreekt tools zoals Warp, Conductor, Emdash, Claude Code en Codex, met voor- en nadelen. Het artikel helpt lezers om op basis van eigen wensen de meest productieve omgeving te selecteren.
SpaceXAI heeft Grok 4.5 gelanceerd, een nieuw AI-model dat specifiek is getraind voor codering en agenten. Het model is volgens het bedrijf een Opus-klasse model, maar sneller, token-efficiënter en goedkoper dan concurrenten. Grok 4.5 kost $2 per miljoen input tokens en $6 per miljoen output tokens. In de Artificial Analysis Intelligence Index staat het op de vierde plaats, achter Fable 5, GPT-5.5 en Opus 4.8.
Anthropic deelt het verhaal achter de ontwikkeling van Claude Code, van een interne CLI tot een volwaardige codeeragent. Onderzoekers, ingenieurs en vroege gebruikers vertellen over het bouwproces.
Jarred Sumner heeft de JavaScript-runtime Bun van Zig naar Rust herschreven met behulp van AI-agents van Anthropic. De herschrijving kostte naar schatting $165.000 aan API-tokens en werd gevalideerd met een test suite van een miljoen asserties. De nieuwe Rust-versie draait in Claude Code en resulteert in een 10% snellere startup op Linux.