← Stolksupport

Za 18 jul 2026 Editie 02
The

Weekly Update


Het AI-nieuws van de week, kort en leesbaar.
Elke maandag samengesteld uit toonaangevende nieuwsbrieven

Chinees open model pakt de koppositie in front-end-coderen

Moonshot AI presenteerde Kimi K3, een model met 2,8 biljoen parameters dat met open gewichten is uitgebracht: het getrainde model zelf staat voor iedereen klaar om te downloaden en te draaien, in plaats van het te huren via een API. Het klom zeventien plaatsen, stootte Anthropics Fable 5 van de eerste plek in de Frontend Code Arena met een winrate van 76% en werd wereldwijd tweede op de Vals Index. De gewichten worden 27 juli verwacht. Met 3 dollar per miljoen input-tokens is het niet goedkoop naar open-modelbegrippen, maar het duikt zo ver onder de westerse vlaggenschepen dat hun marges knellen. De kanttekeningen: een verhoogd hallucinatiepercentage, en benchmarkmakers die opmerken dat de scores ruimhartig punten geven voor half af werk.

Anthropic stevent naar verluidt af op een beursgang in oktober

Anthropic werkt volgens berichten met Goldman Sachs, Morgan Stanley en JPMorgan aan investeerdersgesprekken in aanloop naar een mogelijke IPO, al in oktober. Een initial public offering is het moment waarop een privaat bedrijf voor het eerst aandelen aan het publiek verkoopt. Vers van een waardering van 965 miljard dollar zou de maker van Claude eerder naar de beurs kunnen dan OpenAI. Het zou ook de eerste kans zijn voor buitenstaanders om rechtstreeks te beleggen in zakelijke AI-ontwikkeltools in plaats van in de consumenten-chatbot.

Thinking Machines van Mira Murati laat eindelijk zijn kaarten zien met Inkling

Na ruim een jaar grotendeels in stilte bouwen bracht Thinking Machines Lab Inkling uit: een model met 975 miljard parameters, getraind op tekst, beeld, audio en video, met een contextvenster van één miljoen tokens, grofweg de hoeveelheid materiaal die het tegelijk kan overzien. Het bedrijf is er eerlijk over dat het niet vooroploopt; de sterkste open modellen komen vooral uit China. De pitch is maatwerk: Inkling verschijnt op Tinker, het finetuning-platform van het bedrijf, als basis die bedrijven aanpassen aan hun eigen kennis en werkwijzen. Gebruikers kunnen de 'denk-inspanning' omhoog draaien voor kwaliteit of omlaag voor kosten.

De baas van DeepMind vraagt Washington om een uit-knop

Google DeepMind-topman Demis Hassabis, die waarschuwt dat kunstmatige algemene intelligentie er binnen een paar jaar kan zijn, lobbyt voor een Amerikaanse industrie-waakhond naar het model van FINRA, de toezichthouder op Amerikaanse effectenmakelaars. Labs zouden hun geavanceerdste modellen indienen voor onafhankelijke audits van 30 dagen op cyber-, bio- en misleidingsrisico's; eerst vrijwillig, later mogelijk met goedkeuring vooraf voor uitrol. Dario Amodei van Anthropic wil iets strengers, een agentschap in FAA-stijl met echt vetorecht; Hassabis stelt voor dat de sector zichzelf reguleert.

Het eerste consumentenapparaat van OpenAI is een schermloze speaker die met je meeloopt

Bloomberg meldt dat het eerste hardwareproduct van OpenAI een draagbare, schermloze slimme speaker is met camera en sensoren, ontworpen met Jony Ives studio LoveFrom als metgezel die van kamer naar kamer meegaat en helpt met koken, klusjes, berichten en smart-home-bediening. Het zou een van ongeveer vijf apparaten in ontwikkeling zijn. De rechtszaak van Apple over bedrijfsgeheimen is de complicatie: naast een mogelijk verbod dat de release kan vertragen, remt die het werven af en duwt hij engineers in verdedigend werk.

De eerste OpenAI-gadget die echt verschijnt is een knoppenblok van 230 dollar

OpenAI werkte met toetsenbordmaker Work Louder aan de Codex Micro, een macropad van 230 dollar: een klein blok programmeerbare toetsen, bedoeld om codeer-agents aan te sturen in plaats van ernaar te typen. Programmeerbare toetsen, twee joysticks, een draaiknop en zes gekleurde lampjes laten zien wat elke agent-thread doet en laten een ontwikkelaar wijzigingen met de hand accepteren of afwijzen. Zoals Future Tools het samenvatte: minder chatvenster, meer cockpit.

OpenAI bouwde een model met als taak zijn andere modellen aan te vallen

GPT-Red is een intern OpenAI-model dat via self-play is getraind om zwakke plekken in de eigen systemen op te sporen, vooral prompt injection: verborgen instructies die worden meegesmokkeld in content die een model leest, en die het kapen om iets te doen waar de gebruiker nooit om vroeg. Het vindt kwetsbaarheden in 84% van nieuwe scenario's, tegenover 13% bij mensen, en werd ingezet om GPT-5.6 Sol te verstevigen, dat volgens OpenAI nu zes keer beter bestand is. Minder geruststellend: dezelfde week doken berichten op over GPT-5.6 Codex dat home-directories wiste op macOS en Linux zodra de sandbox-bescherming uitstond.

xAI maakt Grok Build open source na betrapt uploaden van privécode

Grok Build, xAI's antwoord op Claude Code, kreeg een golf van kritiek toen gebruikers ontdekten dat het standaard complete code-repository's naar de servers van het bedrijf uploadde. xAI leverde een fix aan de serverkant, Elon Musk beloofde een dataopschoning, en de CLI werd daarna als open source gepubliceerd zodat iedereen kan controleren wat hij verstuurt. Musk zei los daarvan dat ook de codebase van X wordt opengesteld.

Een hack wijst erop dat Suno niet alleen het open web afschraapte

Bestanden die bij AI-muziekgenerator Suno zijn buitgemaakt en met 404 Media zijn gedeeld, bevatten naar verluidt broncode uit 2023 en 2024 plus instructies om audio en songteksten van YouTube Music, Deezer, Freesound en de International Music Score Library Project binnen te halen; één bestand wijst op ruim twee miljoen verwerkte YouTube Music-clips. Suno heeft al een rechtszaak van de Recording Industry Association of America lopen, waarin het toegaf op auteursrechtelijk beschermd materiaal te hebben getraind maar zich op fair use beriep. Het lek beslecht die juridische vraag niet, maar rippen van beschermde platforms is een lastiger verhaal dan het open internet opzuigen.

Anthropic bouwt een functie die je Claude juist minder moet laten gebruiken

Claude Reflect geeft gebruikers een persoonlijke terugblik op hun eigen gebruik over één tot twaalf maanden: drukste dag, piekuur, terugkerende onderwerpen, het soort werk dat ze uit handen geven. Het ongewone zit in de bedoeling. Er zijn stille uren en pauze-herinneringen, en vragen als: wat wil je zelf blijven doen, ook al kan Claude het sneller. Incognito-chats en gezondheidsdata blijven buiten beeld, en de partners (MIT Media Lab, het Digital Wellness Lab van Boston Children's Hospital, het Family Online Safety Institute) zijn geen doorsnee groeiteam. Het is zo ongeveer het omgekeerde van het gangbare engagement-draaiboek.

Stop met je codeer-agent briefen en zet de regels op papier

Boris Cherny van Anthropic roept engineeringteams op om AI-agents niet langer te behandelen als tijdelijke krachten die je elke keer opnieuw moet inwerken, maar de huisregels vast te leggen op de plek waar de agent ze echt tegenkomt: lint-regels, CI-checks en instructiebestanden zoals CLAUDE.md. Het argument: harde vangrails verspillen minder tokens dan steeds opnieuw prompten, automatiseren de saaie helft van code-review en maken het veilig voor niet-ontwikkelaars om op te leveren.

Anthropic brengt de persoonlijkheden van zijn modellen in kaart over 309.000 gesprekken

Een nieuw Anthropic-raamwerk zet modelgedrag uit langs vier assen (meegaandheid tegenover voorzichtigheid, warmte tegenover strengheid, diepgang tegenover beknoptheid, en openhartigheid tegenover uitvoering), gebaseerd op 309.000 gesprekken. De verschillen tussen modellen zijn goed leesbaar: Sonnet 4.6 neigt naar warm en beknopt, Opus 4.7 naar voorzichtig en openhartig. Dezelfde week haalde het bedrijf Y Combinator- en Monzo-veteraan Tom Blomfield binnen voor het compute-team, in een reeks senior aanwervingen.