πŸ“° ChatGPT vervangt modelnamen door een simpele schuifregelaarπŸ“° Rechtszaak tegen Anthropic: leverde Claude Max wel de beloofde capaciteit?πŸ“° MCP wordt stateless: het protocol achter agentic AI krijgt een grote architectuurmakeoverπŸ“° Fable 5: Anthropics nieuwe vlaggenschipmodel verslaat Opus 4.8πŸ“° Claude Sonnet 5 wordt het nieuwe standaardmodel voor gratis gebruikersπŸ“° GPT-5.6 in preview: OpenAI splitst modellen in Sol, Terra en LunaπŸ“° Claude Sonnet 5 wordt de nieuwe standaard, en Claude Desktop landt eindelijk op LinuxπŸ“° Claude Code-automatisering krijgt eigen dollarfacturering los van je abonnementπŸ“° ChatGPT vervangt modelnamen door een simpele schuifregelaarπŸ“° Rechtszaak tegen Anthropic: leverde Claude Max wel de beloofde capaciteit?πŸ“° MCP wordt stateless: het protocol achter agentic AI krijgt een grote architectuurmakeoverπŸ“° Fable 5: Anthropics nieuwe vlaggenschipmodel verslaat Opus 4.8πŸ“° Claude Sonnet 5 wordt het nieuwe standaardmodel voor gratis gebruikersπŸ“° GPT-5.6 in preview: OpenAI splitst modellen in Sol, Terra en LunaπŸ“° Claude Sonnet 5 wordt de nieuwe standaard, en Claude Desktop landt eindelijk op LinuxπŸ“° Claude Code-automatisering krijgt eigen dollarfacturering los van je abonnement

Qwen3-Coder-Next: een gratis, lokale rivaal voor cloud coding agents

Alibaba’s Qwen-team blijft dit jaar in hoog tempo modellen uitbrengen die specifiek zijn afgestemd op coderen, en de reeks rond Qwen3-Coder-Next is daarvan het duidelijkste voorbeeld. Het model, dat een mixture-of-experts-architectuur met 80 miljard totale en slechts 3 miljard actieve parameters gebruikt, is inmiddels uitgegroeid tot een van de populairste keuzes voor wie een agentic coding-assistent volledig lokaal wil draaien. Kleine actieve footprint, grote capaciteit Het aantrekkelijke aan de architectuur van Qwen3-Coder-Next is de verhouding Lees verder

vLLM op de NVIDIA DGX Spark: een datacenter op je bureau

Het vLLM-team publiceerde begin juni 2026 een uitgebreide technische blogpost over het draaien van vLLM op de NVIDIA DGX Spark, het compacte desktopsysteem rond de Grace Blackwell GB10-superchip. Met 128GB unified memory en ongeveer een petaflop aan AI-rekenkracht in een behuizing van 1,2 kilo, positioneert NVIDIA de Spark expliciet als een datacenter op je bureau voor ontwikkelaars die lokaal met grote modellen willen werken. Wat de DGX Spark anders maakt Voor 4.679 dollar krijg je Lees verder

Google Antigravity komt naar VS Code, JetBrains en Zed als extensie

In juli 2026 kondigde Google een uitbreiding aan van Google Antigravity, de AI-first IDE die eerder als fork van VS Code werd gelanceerd. In plaats van gebruikers te dwingen volledig over te stappen naar de eigen editor, brengt Google Antigravity nu als extensies naar de ontwikkelomgevingen die developers al gebruiken: Visual Studio Code, Visual Studio, JetBrains IDE’s (zoals IntelliJ en PyCharm) en Zed. Deze zet volgt op een roerige periode voor Antigravity. Tijdens Google I/O Lees verder

Google Cloud voegt Grok 4.6 toe aan Model Garden, naast eigen Gemini

In augustus 2026 voegde Google Grok 4.6 toe aan het Enterprise Agent Platform, waarmee het model beschikbaar kwam in Model Garden naast Google’s eigen Gemini-modellen en die van andere derde partijen. Voor developers die binnen het Google Cloud-ecosysteem bouwen, betekent dit dat Grok 4.6 nu direct aanspreekbaar is met hetzelfde 500k-contextvenster en dezelfde instelbare redeneerniveaus als via xAI’s eigen API, maar dan binnen de vertrouwde Google Cloud-infrastructuur. Dat is opmerkelijker dan het op het eerste Lees verder

Apple M5 Max maakt 70B-modellen praktisch bruikbaar op een laptop

Met de komst van de Apple M5 Max-chip is het draaien van grote taalmodellen op een laptop dit jaar opnieuw een stuk praktischer geworden. Benchmarks die deze zomer verschenen laten zien dat een MacBook met M5 Max en 128GB unified memory 70B-modellen op Q8-quantisatie haalt met ongeveer 16 tokens per seconde, en MoE-modellen in de 120B-klasse op Q4 met vergelijkbare snelheid draait. Voor developers die serieus met lokale modellen werken, verschuift dat de grens van Lees verder

Grok Bot: xAI geeft AI-teamgenoten hun eigen cloud-computer

Op 11 augustus 2026 opende xAI de beta van Grok Bot: een nieuwe categorie product dat het bedrijf omschrijft als “AI-teamgenoten die je echt werk kunt geven”. Het meest opvallende kenmerk is dat elke Grok Bot een eigen cloud-computer krijgt: een geΓ―soleerde omgeving waarin de bot zelfstandig kan werken, bestanden kan beheren, tools kan draaien en taken kan uitvoeren zonder voortdurend menselijke tussenkomst nodig te hebben. Dit is een duidelijke stap richting wat in de Lees verder

Grok 4.6 introduceert xhigh-redeneerniveau, prijs blijft gelijk

Op 12 augustus 2026, slechts 35 dagen na Grok 4.5, lanceerde xAI Grok 4.6. Het model behoudt de 500K-contextvenster en dezelfde prijsstelling van 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens als zijn voorganger, maar voegt een nieuw “xhigh”-redeneerniveau toe en scoort 61 punten op de Artificial Analysis Intelligence Index, een veelgebruikte samengestelde benchmark voor het vergelijken van grote taalmodellen. Voor developers is vooral dat nieuwe redeneerniveau interessant. Waar eerdere Grok-modellen doorgaans Lees verder

llama.cpp krijgt eigen website en desktopapp llama.app

Begin juni 2026 kreeg llama.cpp, het project dat aan de basis staat van vrijwel elke lokale-LLM-tool inclusief Ollama en LM Studio, een eigen officiele website en een nieuwe desktopapplicatie: llama.app. Voor een project dat al jaren voornamelijk via de command line en GitHub-releases werd gebruikt, is dat een opvallende stap richting toegankelijkheid voor een breder publiek. Van command line naar toegankelijke tool llama.cpp is de C/C++-implementatie die het mogelijk maakt om taalmodellen efficient te draaien Lees verder

Grok Web krijgt enterprise-connectors: Microsoft 365, Google Workspace en X Ads

Eind juli 2026 breidde xAI Grok Web uit met een reeks nieuwe enterprise-connectors, waaronder integraties voor Microsoft 365, Google Workspace en X Ads. Wat op het eerste gezicht een saaie, administratieve uitbreiding lijkt, is voor developers en IT-teams in bedrijfsomgevingen eigenlijk een van de belangrijkere stappen die xAI dit jaar heeft gezet richting de zakelijke markt. Met deze connectors kan Grok rechtstreeks werken met documenten uit Microsoft 365 (denk aan Word, Excel, SharePoint) en Google Lees verder

Grok 4.5: xAI zet zwaar geschut in met 1,5 biljoen parameters

Op 8 juli 2026 bracht xAI Grok 4.5 uit, met een publieke lancering die volgde op 16 juli. Onder de motorkap draait dit model op wat intern V9 wordt genoemd: een codeermodel van 1,5 biljoen parameters. Volgens xAI is dit hun slimste model tot nu toe voor coding, agentic werk en kennistaken. De prijsstelling ligt op 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens. Voor ontwikkelaars die op grote schaal met LLM-API’s Lees verder