Open-weights vs echt open source: het licentiedebat rond AI-modellen

In de snel evoluerende wereld van kunstmatige intelligentie vliegen de termen je om de oren. Een van de meest controversiële debatten van dit moment draait om het label "open source". Grote techbedrijven brengen krachtige taalmodellen uit en bestempelen deze als open source, terwijl puristen beargumenteren dat deze modellen in werkelijkheid "open-weights" zijn. Maar wat is het verschil precies, en waarom maakt het uit voor ontwikkelaars en ondernemers?

Wat is écht Open Source?

Historisch gezien wordt de definitie van open source bewaakt door de Open Source Initiative (OSI). Software is open source als de licentie voldoet aan de Open Source Definition (OSD). Dit betekent dat iedereen de software vrij mag gebruiken, aanpassen, en distribueren voor elk doel, inclusief commerciële toepassingen, zonder discriminatie tegen specifieke personen of groepen.

De OSI werkt momenteel aan een officiële en sluitende definitie specifiek voor Open Source AI, die naar verwachting de scheidslijn in de industrie verder zal standaardiseren [te verifiëren].

De realiteit van Open-Weights

Bij "open-weights" modellen stelt de maker de resulterende gewichten (parameters) van het getrainde neurale netwerk publiek beschikbaar. Dit stelt ontwikkelaars in staat om het model lokaal te draaien of te finetunen. Echter, in tegenstelling tot echte open source, leggen deze licenties vaak beperkingen op.

Veelvoorkomende restricties in open-weights licenties zijn onder andere:

  • Commerciële limieten: Het model mag niet gratis gebruikt worden als uw applicatie of platform meer dan een x-aantal maandelijkse actieve gebruikers heeft.
  • Acceptable Use Policies (AUP): Strikte regels over voor welke doeleinden de AI wel of niet gebruikt mag worden (bijv. verbod op gebruik in bepaalde industrieën of voor het genereren van specifieke content).
  • Verbod op model-training: Het model mag niet gebruikt worden om synthetische data te genereren om daarmee een concurrerend AI-model te trainen.

Veelgebruikte licenties op een rij

Om het verschil tastbaar te maken, kijken we naar veelgebruikte licenties in het AI-ecosysteem:

  • Apache 2.0 / MIT: Dit zijn echte, door OSI goedgekeurde open source licenties. Modellen die hiermee worden vrijgegeven, bieden maximale vrijheid.
  • Llama 3 Community License (Meta): Een schoolvoorbeeld van een open-weights licentie. Het is breed toegankelijk, maar bevat een commerciële drempelwaarde (700 miljoen maandelijkse gebruikers) en een verbod om de output te gebruiken ter verbetering van andere taalmodellen.
  • Gemma License (Google): Toegankelijk voor veel ontwikkelaars, maar vereist instemming met specifieke gebruiksvoorwaarden die afwijken van traditionele open source principes.

Waarom dit debat ertoe doet

Voor hobbyisten maakt de semantiek wellicht weinig uit; zij kunnen de modellen immers gratis downloaden en testen. Maar voor ondernemers die applicaties bouwen, is het verschil cruciaal. Het bouwen van een bedrijfsmodel bovenop een open-weights fundament kan leiden tot onverwachte juridische obstakels (vendor lock-in) wanneer de applicatie schaalt of wanneer de licentievoorwaarden in een volgende model-generatie worden aangepast.

Bent u op zoek naar het juiste model voor uw volgende project en wilt u zeker weten welke vrijheden u heeft? Raadpleeg dan onze AI-modellen directory voor een gecategoriseerd overzicht van actuele modellen en hun exacte licentievoorwaarden.