'Google stelt Gemini 3.5 Pro uit, presteert slechter dan Codex en Claude Code'

Google is ontevreden over de prestaties van zijn Gemini 3.5 Pro-model, meldt Bloomberg. Vooral op programmeervlak kan dat vlaggenschipmodel naar verluidt niet opboksen tegen de vibecodetools van OpenAI en Anthropic.

Google beloofde in mei dat Gemini 3.5 Pro in juni zou verschijnen, maar dat is niet gebeurd. Bloomberg schrijft nu op basis van tien ingewijden dat Google de release heeft uitgesteld omdat het bedrijf niet tevreden is over de prestaties.

Het model zou vooral minder goed code kunnen genereren dan de concurrentie. OpenAI en Anthropic kwamen onlangs met nieuwe versies van hun programmeertools Codex en Claude Code, maar Googles 3.5 Pro-model presteerde daarmee vergeleken 'teleurstellend'.

Het is niet duidelijk wanneer het nieuwe topmodel van Google dan wel moet verschijnen. Bloomberg meldt alleen dat Google de release intern 'maanden' heeft uitgesteld.

Gemini icon. Bron: Google

Door Kevin Krikhaar

Redacteur

17-07-2026 • 18:08

60

Reacties (60)

Sorteer op:

Weergave:

Benieuwd wanneer de ai bubbel gaat barsten. De VS geeft 10 biljard uit en China 1biljard. Vergelijk je dan de ai's die beide landen uitbrengen dan ontloopt het elkaar nauwelijks, kwa kwaliteit wat ze leveren. Sterker nog China brengt het gewoon uit als open source, waar iedereen op voort kan borduren, tegenover biljarden industrie die de googles, oracles, amazones er tegen aam smijten.

De bedrijven, die er gebruik van maken kiezen natuurlijk voor de goedkoopste optie, want of je nou door de hond of je kat gebeten wordt; als je de ai vraagt je top-srcret-marketing-plan na te lopen van je miljarden bedrijf, dan leggen die ideeën ook gewoon opgeslagen bij de AI aambieder... en dat opensource van China, ik zou het inzetten om lokaal te gebruiken in een afgeschermde omgeving om zo dat top-secret-marketing-plan... top secret te houden. Dus die tokens-verkoop van een gpt, claude, etc is leuk voor de kleintjes. Maar daar dekken ze tot nu toe nog niet de kosten mee.

[Reactie gewijzigd door squareware op 17 juli 2026 19:45]

Voor barsten is het wel een beetje te laat.

Gaat wel gebeuren dat modellen samen gevoegd worden en er slechts een paar sterken overblijven.
Dotcom was ook een gebarsten bubbel, en toch bezoeken we nog steeds youtube.com en dergelijke. Bubbel kan economisch barsten terwijl het product (populair) blijft.
De reden dat de dotcom producten uiteindelijk populair geworden zijn is dat ze in veel gevallen goedkoop en eenvoudig te schalen waren, daarom konden ze zelfs na het barsten van de bubbel nog steeds rendabel aangeboden worden. Want uiteindelijk bleek dat je met veel minder mensen toe kon en vooral met veel minder hoge marketing budgetten om toch zo'n bedrijf van de grond te krijgen. Bij AI is het fundamentele probleem tot nu toe dat de kosten niet naar beneden gaan en dat alle partijen dus gedwongen zijn om de gebruikers te subsidieren met enorme bedragen per maand. Inmiddels hebben ze op basis daarvan ook nog voor een paar jaar vooruit infrastructuur ingekocht tegen woekerprijzen terwijl ze nog niet eens de stroom rekening kunnen betalen van de abbonements opbrengsten, laat staan andere operationele kosten.
Uit onderzoek naar modelprijzen tussen 2024 en 2026 blijkt dat de prijs om een vast prestatieniveau te behalen jaarlijks ongeveer 5–10× daalt. Google zegt dat zijn nieuwste inference-TPU ongeveer 80% meer prestaties per dollar levert dan de vorige generatie (https://arxiv.org/abs/2511.23455)
Klopt Google gaat de AI race winnen. Niet omdat ze "de beste AI model" hebben maar omdat ze het financieel veel beter voor elkaar hebben.
1. Extreem efficiente modellen, met de nieuwste efficiency technieken.
2. Extreem efficiente TPU hardware welke heel veel inference kan doen per kWh zeg maar.
3. Extreem veel producten hebben waar AI in verwerkt kan worden.
4. Zich niet verzuipt in kosten om "het beste model" op de markt te hebben.
Dit is wel relevant idd. De bubbel kan wel barsten omdat 'dure' modellen zich vanzelf uit de markt gaan prijzen. Hopelijk gaan we met deze AI modellen ook weer een beetje aan het klimaat denken.

Gemma4 draait lekker op mn GPU, en voor normale toepassingen voldoet hij prima bijvoorbeeld
De kosten per token zijn drastisch omlaag gegaan. En gaan steeds verder omlaag terwijl de intelligentie per token omhoog gaat.

Wat je zegt is dus niet waar. Het is fout
Ben ik nou de enige die DotCom linkt aan internetmiljardair Kim Schmitz ?
Barsten gaat meer over waarde van bedrijven er is al 10 keer meer in de AI gepompt dan toen in de internet bubbel was gepompt. En met de extreem slechte inkomsten van AI tegenover de uitgaven is het waarschijnlijk alleen maar er wachten op. Je ziet al eerste dingen flink dalen zoals oracle die datacenters voor openai bouwt en andere tech aandelen.
10 biljard is in het Engels 10 quadrillion. Dat is meer dan het GDP van het gekende universum, alhoewel er vast wel ergens een Monaco-planeet bestaat :+
Was als voorbeeld. Het gaat om de verhouding vs/china 10/1 zit er dik in, terwijl de chinese ai slechts 10% minder kwaliteit levert voor 90% minder kosten.
Met gratis China censuur
Dit is een feit. Chinese modellen scoren heel slecht op historische feiten benchmarks. Gek hé?
Als je ai nodig hebt voor wat landsgeschiesenis... dat is net zo snel als dat je het zelf even googled en leest wat je wilt lezen. Ai zou in mijn ogen alleen gebruikt moeten voor repetatieve taken, content vergelijken, analyseren, samenvoegen, creeëren, en zo.. en wat content is: muziek, film, code, text, maar niet op de manier als tante Pien een glitter-gifje maakt dat is nou echt zonde van de resources.
De geschiedenis wordt geschreven door de winnende partij. Mits de bronnen ruim beschikbaar zijn kan AI een prima hulpmiddel zijn voor analyse van die bronnen. In China waarschijnlijk weer niet, maar dat is een ander verhaal.
chinese labs brengen open weights modellen uit, niet open source. er bestaan helemaal geen chinese open source modellen.

de enige echte open source modellen komen uit enkele labs in de VS

[Reactie gewijzigd door angushansen op 17 juli 2026 23:14]

Nee alleen Nvidia doet echt aan opensource AI frameworks. Open gewichten is niet echt open source nee. Dat mensen dat nu nog benoemen na zoveel jaar zegt wat over de propaganda uit China.
My 2 cents.

Die bubbel gaat niet barsten zonder een externe reden zoals bankencrisis, hypotheekcrisis of een totale uitbreiding van de oorlog in Iran/Oekraine.

Er is nu zo gigantisch veel vraag naar AI/LLM, die geest krijgt niemand meer in een fles geduwt. Voor de investeerders en belanghebbende is het praktisch alles waard om hier een hele lange adem voor te hebben. Het outsourcen van 'denken' is wat er aan de hand is en als binnen niet al te lange tijd de halve wereld daaraan 'verslaafd' is dan kunnen de investeringen met gemak terugverdiend worden. Nog even afgezien van de potentiele beangstigende veranderingen die dat voor de maatschappij met zich mee kan brengen.

Maar dat betekend ook dat men er alles aan wilt doen, dankzij open source en open weights modellen, om hardware duur te houden. Door de, in mijn inziens, domme zet om China praktisch te verbannen van amerikaanse hardware, heeft China zijn eigen productiecapaciteit over de gehele lijn op poten gezet. Zodra China deze kaarten mag exporteren naar Europa, dan gaat het voor lokale modellen heel interessant zijn. Ik vertrouw die online modellen niet, zijn gewoon data-agregators. Maar de hardware voor kleine bedrijven is te duur om lokaal te draaien. Nu pas zijn er redelijk wat datacenter kaarten van 9 jaar geleden op de markt te vinden. Dus al zou je een kwart miljoen kunnen steken in een eigen node van een paar jaar oud (!!!), zie er maar een te vinden.

Er zijn in mijn ogen nu al genoeg gigantische modellen open source gemaakt, dat het nu nog alleen puur een hardware vraag is, ofwel kostenplaatje. De hele ontwikkeling gaat snel, nu nog de prijsverlagingen van de hardware. Maar daar is geen enkele investeerder bij gebaat.
Zonder USA bestonden die AI modellen in China niet. Veel modellen is heftig gebruik gemaakt van destillatie van Chatgpt Gemini en Claude.

Snap je dat? Tuurlijk de goedkoopste R&D is gewoon dingen stelen. Dat weet je ook. Het is goedkoper om andermans model te destilleren dan zelf data scrapen en zoeken overal en te cleanen en noem het maar op.

Er was eens een moment dat ze het echt amateuristisch deden. En deepseek dacht dat hij Chatgpt was. Omdat ze ChatGPT aan het leegzuigen waren via destilling.

[Reactie gewijzigd door Immutable op 18 juli 2026 11:21]

Toevallig is hier vandaag een aflevering van Tegenlicht over uitgekomen, zeker een aanrader: YouTube: Waarom jij straks het hulpje van AI bent (en niet andersom) | Cory Doctorow

[Reactie gewijzigd door ydd1987 op 19 juli 2026 19:46]

VS verdient miljarden en China verdient 0. Aan gratis weggeven wordt je niet rijk.
Gemini zal niet snel van de kaart verdwijnen, aangezien ze met Google integratie een gigantisch voordeel hebben, plus is het de standaard op Android apparaten. Echter lopen ze serieus achter op de competitie. Anthropic heeft zijn problemen gehad met Fable op de markt krijgen, maar zelfs Sonnet loopt voor op Gemini 3.5 flash, wat op het moment het beste Gemini model is. OpenAI loopt gelijk op met Fable met hun ChatGPT 5.6 release. Zelfs open-source modellen presteren beter dan Gemini, zie GLM 5.2 of de net uitgekomen Kimi k3, die op sommige vlakken zelfs beter presteert dan Fable en ChatGPT 5.6 Sol.


Google moet echt beter zijn best gaan doen, want het enige wat ze nu nog recht houdt is die sterke integraties overal, en het feit dat ze ook afbeeldingen+muziek+video in 1 applicatie kunnen, ook weer niet als beste, maar wel een degelijk totaalpakket.
Ik gebruik zelf Google Antigravity en merk dat daar de eigen modellen nog steeds beter presteren. Het is dus ook maar net hoe je ze gebruikt. Ik vind de feedback die Opus geeft tijdens agentic workflows wel een stuk beter.
Ik ben daar vanaf gestapt. Antigravity is soms echt een draakje en dat hangt ban de installatie af. Duurt allemaal ontzettend lang en gaf continu fouten. Was ie een uur bezig, server weer overvol.

En het continue login gezeur, werd er niet goed van. Kon iedere zoveel uur opnieuw inloggen.

Gemini met APi key op CLI is bij mij ook hit or miss.

Prima model overigens voor veel input en analysewerk. Beetje wat google ook doet met search natuurlijk. Veel lezen en dan samenvatten.

De tooling eromheen en het harnas van antigravity vond ik allemaal maar meh.
Ahja ik gebruik antigravity 2. Dus dan heb je gewoon wat agents draaien en die doen lekker hun ding. Ook draaiend in een sandbox waar die alles kan installeren wat die wil. Redelijk hands off dus.

Heb inderdaad gemerkt dat als je het meer beperkingen oplegt het heel vervelend wordt in gebruik. Heb overigens een AI pro abbo dus loop wat minder vaak tegen server beperkingen aan.
Ja fair, misschien dat die nu beter te gebruiken is. de OG was voor mij echt niet te doen. Heb daar echt wel veel tijd in verloren.

maar moet je die "agents" zelf nog in het zadel hijsen of doet antigravity dat gewoon OOTB?
Via antigravity zijn ze ook niet te vergelijken, aangezien Opus daar nog op versie 4.6 zit. Huidige Opus versie is 4.8, en is dus niet eens het beste model van Claude. Ik geef toe dat Antigravity voor veel zaken ook voldoende is, gebruik het zelf ook, maar het is niet beter dan de competitie op dit moment.
Maar laten we eens stoppen met benchmark Jerken. Want benchmarks zeggen maar een klein deel. De realiteit vind ik vaak de Chinese modellen beetje hakkerig en lastig reageren met minder structuur.
Opzich goed besluit, coding en scripting skills zijn enorm belangrijk!

Claude Code is insane sinds Opus 4.6 uit kwam

Je hebt pas meerwaarde als frontier model als je Of beter bent, Of goedkoper bent

Daarom begrijpelijk dat Google eerst het Gemini 3.5 Flash-lite model uitbracht

dit heeft wel nieuwere architectuur maar is veel lichter in gebruik en dus veel goedkoper en sneller voor dezelfde intelligentie

ik dacht zelf dat Google de kat uit de boom keek en een veilige strategie voorbereidde toen Mythos en Fable 5 werden afgekeurd door USA, en later ook ChatGPT 5.6 niet gelijk online mocht van de US overheid

[Reactie gewijzigd door maykoga op 17 juli 2026 18:14]

Gemini 3.5 Flash-lite bestaat helemaal niet. Het enige model in de 3.5 serie is momenteel 3.5 Flash. Flash-lite is nog op 3.1.

Overigens is 3.5 Flash verschrikkelijk inefficient met zijn tokens, dus die tikt ook niet zo goedkoop aan als het kan. Daarbij kost 3.5 Flash 1.50 per 1 miljoen input en 9 per 1 miljoen output tokens. Vergelijk dat met GLM 5.2 (een beter en open-source model), die kost 1.40 per 1 miljoen input en 4.40 per 1 miljoen output tokens. Goedkoper dus, en beter.
Ach ik werk(te) veel met Google Gemini, maar de laatste weken is Gemini een buggy hallucinerende bende geworden. Ik maak tegenwoordig gebruik van Proton Lumo, een op veel vlakken vele malen inferieur model. Maar de interface bugged niet om de 3 minuten en het hallucineert een stuk minder.

Ik ben nu Mistral Vibe aan het testdriven. Ben daar tot op heden eigenlijk best tevreden over.

Ik weet niet waar Google aan het doen is, maar het lijkt werkelijk waar nergens op op het moment en waarschijnlijk weten ze dit, vandaar het uitstel.

[Reactie gewijzigd door HandheldGaming op 17 juli 2026 19:16]

Mistral Vibe (voormalige Le Chat) wordt echt zwaar onderschat.
Ik vind het echt lekker werken tot op heden. In de LeChat periode was het wel een stuk minder. Wat ik vooral prettig vind is dat het een betrouwbaar niveau van werk levert. Dat is bij Gemini(en ChatGPT) simpelweg niet het geval. Claude is goed, maar stampend duurt voor wat je krijgt.
Wat grappig is, Gemini is veel beter in logische valkuilen dan ChatGPT. Deze vraag gaat prima in Gemini 3.5 Flash maar gaat fout in ChatGPT "fast". Goed lezen.
A dead cat is placed in a box with a vial of poison that may or may not break. An hour later, is the cat dead or alive?
Gemini zegt bij mij gewoon "dead" maar ChatGPT komt met een heel gezever over Schroedingers cat.

@BlacKstaR- reactie aangepast zodat deze weer klopt, het gaat inderdaad om de beide "fast" modellen. In dit geval Gemini 3.5 Flash en whatever ChatGPT als default geeft voor een gratis gebruiker. Gemini 3.5 Flash is overigens ook gratis.

[Reactie gewijzigd door TV_NERD op 17 juli 2026 19:34]

Copilot Automatish (=fast?) zevert er fiks op los maar eindigt net zoals ChatGPT. "Think Deeper" komt wel met het goede antwoord. Net zoals Opus/ChatGPT 5.6 en 5.5 overigens
Net geprobeerd zie hier het resultaat, GPT model 5.6 Terra

As written, the cat is dead—so an hour later it’s still dead.

In Schrödinger’s original thought experiment, it’s a live cat placed in the box; before checking, quantum mechanics models the outcome as uncertain, though in ordinary terms the cat is either alive or dead.
Maar de reactie van ChatGPT is toch niet per se onlogisch? Het ligt meer voor de hand dat je iets hebt gehoord of gelezen over Schrödingers kat dan dat je de AI voor de gek wilt houden.
Dan is het antwoord van Chat toch beter dan Gemini ipv andersom?
Hoezo, in de vraagstelling staat al dat ik er een dode kat in leg, die komt echt niet meer tot leven. Schroedingers kat is hier niet van toepassing.
Sorry, had ik overheen gelezen.
ik snap echt niet dat mensen een AI geen beoordelen op dergelijke zaken... daar gebruik je het toch echt niet voor??
vibecodetools van OpenAI en Anthropic.”

Ik zou Claude Code en Codex nu niet direct als vibecodetools classificeren.
Zo'n beetje alles wat ik in Claude Code (CLI) doe is vibecoden, dus in die zin is het een vibecodetool :)

Maar ik snap je gedachte / punt: het heeft zoveel meer mogelijkheden om serieus en gestructureerd / geintegreerd code te schrijven en te controleren + meer.

[Reactie gewijzigd door JorisM op 17 juli 2026 18:34]

vibecoding zie ik als “1-shot een applicatie proberen te maken en vervolgens gaan finetunen om aan de praat te krijgen”

In meer professionele/gedisciplineerde aanpak wordt AI veel gerichter ingezet, daar draagt een AI bij of vervult losse stappen in een proces (Story -> Refinement -> Merge Request -> Review -> Tests -> Release).

Daar kan het radicaal versnellen. Laatst bvb. een domme cosmetische bug gevonden. Low prio, zou normaal gesproken een stille dood op een backlog sterven, omdat het de menselijke inspanning niet waard was. Nu het AI proces ingegooid en binnen een paar uur afgehandeld.

[Reactie gewijzigd door Keypunchie op 17 juli 2026 19:10]

Mja je kunt het voor vibecoding gebruiken, maar met een beetje harnessing is het zo ontzettend veel meer dan vibecoding. Ik ben bijna zover dat we agentic productie draaien.
Vibecoding is vooral een hypewoord voor iets dat we al decennia zien: steeds een hogere abstractielaag. We gingen van machinetaal naar assembly, daarna naar talen als C en Pascal. Nu beschrijf je niet meer de code, maar de intentie. Dat is geen fundamenteel ander principe, maar de volgende stap in die ontwikkeling. Misschien zelfs de laatste grote abstractielaag.
Op zich klopt het, maar het is voor velen wel de enige manier dat ze het lijken te gebruiken.
snap ik wel, de moeite die je moet om de instructie in google gemini aan te kunnen passen is werkelijk adembenemend slecht. De user interactie / de kennis interactie. Ik had een abonnement en heb hem opgezegd. zoveel slechter dan de rest. En dan de werkelijk fenomenale inbreuk van je privacy op alles wat je in het ecosysteem van google hebt. Het is niet te overzien hoe google gemini werkelijk alles in zijn tentakels heeft ten dienst van google en niet van jouw...

[Reactie gewijzigd door oks op 17 juli 2026 18:25]

Gemini werkt toch niet zo fijn als ik gehoopt had.

Met software problemen zit het er heel vaak naast.
Ok, met code zijn ze dan misschien niet zo goed. Maar als het gaat om spraak, afbeeldingen en video dan zijn ze wel heel sterk. Het is toch ook maar met welke ingrediënten je de modellen in de oven legt? En wat de use case is voor je modellen en welk framework er omheen zit. Versterk op de punten waar je goed in bent. Je kunt niet overal op inzetten.
Gemini gebruik ik voor andere doeleinden, zoals dingen uitzoeken. Die vind ik veel sterker dan claude. Ze zouden daar op moeten doorpakken als je het mij vraagt.
Ik vind het ergens wel mooi om te zien dat OpenAI en Anthropic en SpaceXAI de vloer aanvegen met Google. Google is vele jaren lang de monopolistische marktleider geweest en ze hebben daar honderden miljarden mee verdiend. Er is vaak bewezen dat Google zoekresultaten heeft gemanipuleerd om de kans op bepaalde uitkomsten groter te maken (zoals bijvoorbeeld bij een zoekopdracht over Trump slecht nieuws naar voren halen en bij een zoekopdracht over Biden goed nieuws naar voren te halen), ze hebben hun eigen diensten illegaal voorgetrokken in hun zoekmachine en op Android, er zijn talloze rechtszaken geweest tegen Google voor machtsmisbruik en ga zo maar door, en in de tussentijd hebben ze met hun geld en macht alle kans gehad om de systemen op te zetten zoals wij die nu hebben met de beste LLM's, maar hebben ze vanuit hun luie monopolistische machtspositie niets gedaan en nu beginnen ze aardig achter te lopen.

Om te kunnen reageren moet je ingelogd zijn