Je n'arrête pas de lire sur différents sites d'actualité : "Les modèles LLM opensource/openweights font de la concurrence aux modèles propriétaires."
Ce concept de LLM "opensource" me fait toujours doucement rigoler. Parce que encore une fois, c'est du marketing vide de sens.
J'explique: Quand un logiciel est opensource, vous pouvez accéder à son code source, le lire, le *comprendre* et le *modifier* (ces deux mots sont importants).
Un modèle de LLM, ce sont des *milliards* de paramètres en virgule flottante que personne ne peut comprendre. Personne n'est capable de dire, par exemple, comment est encodé le concept de "pomme" dans un tel modèle. Et il est donc encore moins possible de le modifier.
Une LLM "opensource", c'est comme si je vous donnais un programme binaire déjà compilé (un .exe) en vous disant : "C'est opensource ! Il contient toutes les instructions en langage machine !" [1]
(À ce titre, Windows est opensource, hein.)
Il serait plus juste de parler de modèles *gratuits*, mais c'est tout.
Et même comme cela, la transparence s'arrête là : En plus de ne pas pouvoir les inspecter, vous n'avez aucune idée des données qui ont servi à entraîner ces modèles "opensource". Vous ne savez donc même pas ce qu'ils contiennent.
Donc merci d'arrêter de parler de "LLM opensource". Concrètement, cela n'a aucun sens.
(Et cela ne règle par le problème que les LLM généralistes ne sont pas tenable sur le long terme, ni économiquement, ni éthiquement, ni écologiquement, ni énergétiquement...)
[1] Et encore, hein ! Un binaire, on peut faire du reverse-engineering dessus, pour en comprendre l'enchaînement des instructions en langage machine vers l'assembleur. Ce qui est impossible avec une LLM.
EDIT: Ah ben justement, bon timing:
https://www.theregister.com/columnists/2026/09/15/open-weights-are-not-open-source-why-ais-favorite-label-is-under-dispute/5295436