Het Chinese AI-bedrijf DeepSeek heeft V4.1-Flash uitgebracht, een nieuwe versie van zijn AI-model. Wie vanaf komende week nog V4-Pro wil gebruiken, komt automatisch uit bij V4.1-Flash, dat volgens het bedrijf beter presteert en veel goedkoper is.
Het gaat om een mixture-of-experts-model met 552 miljard parameters, meldt DeepSeek. Daarvan zijn er telkens acht miljard actief bij input en zestien miljard bij output. Daardoor gebruikt V4.1-Flash volgens DeepSeek een kwart van het geheugen en een achtste van de opslag om prompts uit te voeren.
Omdat V4.1-Flash sneller en goedkoper is dan V4-Pro, stopt DeepSeek met V4-Pro totdat V4.1-Pro uitkomt. Wanneer dat is, zegt het bedrijf niet. V4-Flash en V4-Flash-Vision-Exp zijn gelijk niet meer beschikbaar. Verzoeken aan die modellen komen direct uit bij V4.1-Flash. V4.1-Flash is fors goedkoper bij gebruik van de api. Klanten betalen 60 dollarcent per miljoen outputtokens, tegenover 1,98 dollar voor V4-Pro.
:strip_exif()/i/2008223304.jpeg?f=imagenormal)
/u/2801/crop5ccb23f820755.png?f=community)
:strip_icc():strip_exif()/u/2503532/crop6a6dcb3844ab6_cropped.jpg?f=community)
/u/127261/crop5dcd39ec2f45d_cropped.png?f=community)
/u/271383/crop5e6b72d2a673b_cropped.png?f=community)
:strip_icc():strip_exif()/u/572004/fox.jpg?f=community)