Snowflake, het toonaangevende bedrijf in AI Data Cloud, heeft de toevoeging van dynamisch modelroutings aangekondigd aan Cortex AI Gateway en zijn belangrijkste AI-producten. Tegelijkertijd breidt het bedrijf zijn aanbod uit met enkele van de meest prominente open modellen op de markt.
Met deze innovaties streeft Snowflake ernaar bedrijven te ondersteunen bij het optimaliseren van AI-uitgaven en het verbeteren van wat zij de “efficiëntie van intelligentie” noemen. Deze metriek meet in hoeverre een organisatie in staat is om middelen zoals verwerkingskracht, AI-modellen, data en zakelijke context te vertalen naar waardevolle bedrijfsresultaten.
De nieuwe functies zijn gebaseerd op Cortex AI Gateway, dat door Snowflake in juli 2026 werd geïntroduceerd als een geïntegreerd platform voor het beheer van connecties van agents, intelligente verzoekafhandeling en optimalisatie van AI-bronnen.
De groei van AI-toepassingen en agents in productiescenario’s brengt nieuwe uitdagingen met zich mee. Het gebruik van een enkel model voor diverse taken kan de kosten aanzienlijk verhogen, terwijl werken met een toenemend aantal modellen de ontwikkelteams meer tijd kost voor evaluatie, configuratie en beheer.
Om deze situatie te tackelen, zet Snowflake in op automatisering van de keuze van het meest geschikte model per verzoek, en breidt het zijn opties uit voor klanten. Organisaties kunnen nu open-source modellen en propriëtaire oplossingen combineren, afhankelijk van de behoeften van elke taak, waardoor AI-toepassingen efficiënter en kosteneffectiever worden ingezet.
Door dynamisch modelroutings toe te voegen, kan Cortex AI Gateway automatisch het model selecteren dat de beste balans biedt tussen kwaliteit en kosten voor een specifieke taak. Deze dynamische routing is geïntegreerd in Snowflake’s vlaggenschip AI-producten, zoals Snowflake CoCo en Snowflake CoWork, en is beschikbaar voor third-party AI-agents die Cortex AI Gateway gebruiken. De functionaliteit schakelt routinetaken of simpele taken automatisch door naar efficiënte modellen, terwijl complexere taken blijven draaien op geavanceerde modellen. Zo besparen klanten onnodige uitgaven aan inferenties, zonder zelf de juiste modellen te hoeven kiezen. Daarnaast verbreedt Snowflake de toegang tot toonaangevende open modellen zoals DeepSeek-V4-Flash 07311 en GLM-5.33, via Snowflake Cortex AI. Dit sluit aan bij de uitgebreide modelbibliotheek van Snowflake, voor optimale afstemming tussen kwaliteit en kosten, en biedt veilige beheeropties binnen Snowflake.
Deze innovaties geven bedrijven meer controle over de kosten-efficiëntie van AI naarmate ze het gebruik ervan opschalen. Ze kunnen de efficiëntie verbeteren door elke taak aan het juiste model toe te wijzen en onnodige uitgaven te reduceren.
“Bedrijven worden steeds kritischer op de kosten en de return on investment van AI. Het gaat niet langer alleen om hoeveel AI ze gebruiken, maar of die AI daadwerkelijk waarde oplevert voor het bedrijf,” zegt Sridhar Ramaswamy, CEO van Snowflake. “Het bereiken van efficiëntie in AI vereist de flexibiliteit om voor elke taak het beste model te gebruiken naarmate het landschap evolueert. Snowflake neemt die complexiteit uit handen zodat klanten zich kunnen richten op resultaat, terwijl wij de modelkeuze optimaliseren achter de schermen.”
“Bedrijven worden overladen door het enorme aantal modellen dat beschikbaar is. Maar de echte uitdaging is niet welke model te kiezen, maar de operationele last van het kiezen van het juiste model op schaal. De dynamische modelrouting van Snowflake pakt deze kloof aan,” aldus Sanjeev Mohan, directeur en oprichter van SanjMo. “Door intelligente modelselectie binnen Cortex AI Gateway te automatiseren, vermindert Snowflake een knelpunt dat doorgaans de adoptie van enterprise AI remt. Het vermogen om workloads af te stemmen op de kostenefficiëntie van modellen, zonder telkens infrastructuur te hoeven vernieuwen bij nieuwe modellen, is precies de efficiëntie die bedrijven nodig hebben om van experimenteren naar grootschalige AI te gaan.”
Cortex AI Gateway optimaliseert AI-kosten door slimme modelkeuze
Dynamisch modelrouting in Cortex AI Gateway is ontworpen om bedrijven toe te laten AI-modellen voor dure grensverleggende taken alleen in te zetten wanneer dit substantieel bijdraagt aan bijvoorbeeld Snowflake CoCo, Snowflake CoWork of third-party AI-agents. Naast automatische modelkeuze per verzoek biedt de dynamische routing ook controle over welke modellen en aanbieders voor gebruikers beschikbaar zijn. Dit is vooral cruciaal voor wereldwijde organisaties die regionale modelbeschikbaarheid moeten beheren of voor gereguleerde sectoren met strikte compliance-eisen. Naarmate de prestaties en prijzen van modellen wijzigen, kan Cortex AI Gateway de routingbeslissingen bijstellen in Snowflake-producten zoals CoCo en CoWork, zonder dat klanten hun toepassingen of agents hoeven herontwerpen. Zo kunnen ze profiteren van nieuwe modelopties terwijl Snowflake de complexiteit van modelkeuze en -optimalisatie op de achtergrond afhandelt.
Interne tests bij Snowflake tonen aan dat een mix van open en propriëtaire modellen voor verschillende taken vergelijkbare kwaliteit kan leveren, terwijl de token-efficiëntie aanzienlijk verbetert. Zo creëerden agents met Cortex AI Gateway een datatransformatiestroom met dbt die tot 3 keer minder tokens verbruikte dan enkel grensverleggende modellen, met behoud van dezelfde kwaliteit. In een andere test voltooiden engineeringteams dezelfde hoeveelheid pull requests met een 25% hogere token-efficiëntie⁴.
Nieuwe open modellen voor bedrijfsdata binnen Snowflake
DeepSeek-V4-Flash 0731 en GLM-5.3 worden de nieuwste toevoegingen aan Snowflake’s groeiende modelportfolio, beschikbaar via Cortex AI, Snowflake CoCo en Snowflake CoWork. In combinatie met modellen van partijen als Anthropic, OpenAI, Google, SpaceXAI, Meta en Mistral biedt dit assortiment klanten meer vrijheid om de beste combinatie van prestaties en kosten per workload te kiezen.
In plaats van elk nieuwe open model als een aparte integratie te behandelen, ontwikkelt Snowflake een ecosysteem dat snel kan meegroeien met de innovatieve open source community. Het platform blijft continu evalueren en optimaliseren hoe deze modellen worden ingezet en geserveerd binnen de AI-producten, zodat klanten kunnen profiteren van de nieuwste en meest capabele modellen zonder constant hun infrastructuur te hoeven aanpassen. Dit brengt de voordelen van nieuwere modellen binnen bereik, onder strikte governance en toegangscontrole.
Het Snowflake AI Research Team heeft DeepSeek-V4-Flash getest op enterprise-taken; recente resultaten tonen dat DeepSeek v4 Flash beter presteerde dan toonaangevende propriëtaire modellen in de evaluatie, met een score van 74,4 procent op datadisciplinetaken. GLM-5.2 behaalde eveneens een sterke score van 62,8 procent, terwijl het minder tokens verbruikte dan andere modellen⁵. Deze resultaten onderstrepen dat open modellen steeds meer in staat zijn om kritische taken uit te voeren tegen lagere kosten.
Snowflake ondersteunt schaalbare AI-efficiëntie voor bedrijven
Met de inzet van meerdere modellen in steeds meer AI-toepassingen en agents, is zichtbaarheid en controle over resourceverbruik essentieel om efficiëntie te vergroten. Cortex AI Gateway biedt beheerders inzicht in tokenverbruik en kosten, en stelt organisaties in staat om uitgavengrenzen te stellen voor alle AI-toepassingen en agents. Snowflake CoCo breidt deze controle uit via het bestaande tagging- en toegangsbeheersysteem, waarbij beheerders vooraf ingestelde modellen kunnen vastleggen, verbruik kunnen relateren aan teams of kostenplaatsen, quotafulbright kunnen stellen en waarschuwingen ontvangen bij het naderen van limieten.
Door dynamisch modelroutings te combineren met een breed scala aan modellen, krijgen organisaties betere grip op kosten en rendabiliteit van AI. Ze kunnen workflows automatisch afstemmen op het juiste model, profiteren van nieuwe opties zodra deze beschikbaar zijn en het AI-resourcegebruik overal binnen de organisatie managen. Zo verbeteren ze de efficiëntie, behouden ze volledige governance volgens Snowflake’s standaarden en eigendom van zowel data als bedrijfscontext.
