"Hace falta un LLM open source".
Vale, voy a atacar a fantasmas y hombres de paja porque yo sé que no es una postura con suficientes defensores como para que merezca ser tomada en consideración, pero el asunto es que no es posible un LLM open source. Los modelos no tienen código, no se escriben, y nadie sabe lo que hay dentro de cada uno o cómo funcionan internamente. Lo que se sabe es lo que se deduce por observación de lo que entra y lo que sale.
Por ejemplo, los LLM entrenados para traducir de idioma A a idioma B y de idioma B a idioma C son capaces, sin que hayan sido entrenados para ello, de traducir de idioma A a idioma C.
Esto implica que el modelo en su interior ha creado un cuarto idioma (D) al cual traduce cualquier input y después de ese idioma traduce al idioma de salida, pero no se puede saber cuál es este idioma D, totalmente encerrado en la caja negra.
(Source: Enabling zero shot lenguaje translation https://arxiv.org/abs/1611.04558 )
Puedes entrenar un LLM sólo con datos open source (¿qué licencia? No puedes mezclar MIT con GNU, por ejemplo) , puedes hacer open source el software para interactuar con el modelo, pero NO es posible hacer open source el modelo a menos que la definición de open source cambie, pero eso es mover la portería.