À chaque fois qu'il y a une nouvelle LLM qui sort (donc à peu près une fois par semaine ces jours-ci), je vois des gens qui parlent de modèles "open source".
Est-ce qu'on peut juste tous être d'accord, ce n'est pas des modèles open source mais open weight parce que c'est juste les poids du réseau neuronal qui sont donnés de façon ouverte ? C'est aussi con que dire "ouais mais ce logiciel est open source, je peux librement télécharger l'exécutable".
Je propose qu'on n'appelle "modèle open source" que les modèles qui:
- rendent public l'intégralité de leur dataset
- rendent public le code source utilisé pour entraîner le modèle (y compris la seed, pour que ce soit reproducible), sous une license approuvée OSI
- rendent public le code source utilisé pour l'inférence (je crois que cette partie est la seule qui est correctement appliquée actuellement, sans quoi on ne pourrait pas utiliser les modèles open weight)