Probablemente hayas escuchado que los modelos de IA se describen como “abiertos” o “cerrados”. Estas no son descripciones de la personalidad del modelo. Los grandes modelos de lenguaje de IA como el que se encuentra bajo el capó de ChatGPT no tienen personalidades reales, a pesar de las apariencias.
Las etiquetas se refieren a si toda la información sobre cómo funciona el modelo de IA está disponible públicamente y el modelo puede modificarse, o si el desarrollador del modelo mantiene en secreto su funcionamiento interno y el modelo en sí es propiedad privada.
Software de código abierto
El concepto de software de código abierto se originó en el movimiento de software libre de los años 1980 y 1990. Los fundadores del movimiento creían que los creadores y usuarios de software tenían derecho a las “cuatro libertades”: ejecutar un programa, estudiarlo y modificarlo, distribuir copias del original y distribuir copias de versiones modificadas posteriormente. El requisito básico era que el código fuente (las instrucciones básicas) del programa estuviera disponible.
A finales de la década de 1990, los desarrolladores de software asociados con proyectos como el navegador web Netscape y el sistema operativo Linux acuñaron y promovieron el término “código abierto” para referirse a estos ideales.
Como parte del movimiento en evolución, ciertas organizaciones desarrollaron licencias de código abierto que especificaban cómo se podía usar y distribuir una pieza particular de código fuente, incluida la Licencia Pública General Gnu, la Licencia Apache, la Licencia MIT y la Distribución de Software Berkeley. Cada tipo de licencia también especificaba posibles restricciones sobre cómo se aplicaban las patentes de software al código fuente.
¿Código abierto o peso abierto?
La idea del código abierto ha vuelto a ganar protagonismo en los últimos años a medida que han proliferado los modelos de lenguaje de IA a gran escala, en particular OpenAI ChatGPT, lanzado en 2022. Los desarrolladores primero entrenan nuevos modelos en grandes conjuntos de datos y luego implementan los modelos para que los utilicen otras personas.
La inteligencia artificial de código abierto explicada en dos minutos.
Meta fue una de las primeras empresas importantes en lanzar un gran modelo de lenguaje de código abierto, llamado LLaMa. La compañía lanzó LLaMa el 24 de febrero de 2023 y puso a disposición el código fuente de las “cerraduras”, las instrucciones que accionan el modelo. Y liberó los llamados pesos, el conocimiento codificado que el modelo aprendió durante el entrenamiento. Sin embargo, organizaciones de código abierto como Open Source Initiative han declarado que las pautas de licencia de LLaMa prohíben la reutilización comercial, que según la iniciativa no es verdaderamente de código abierto.
Otras empresas han lanzado modelos de “peso abierto”, como DeepSeek de DeepSeek AI y Quen de Alibaba. Los modelos tienen requisitos de reutilización menos restrictivos y han sido adoptados rápidamente por la comunidad de IA. Sin embargo, muchos desarrolladores creen que un verdadero modelo de IA de código abierto debe incluir no sólo el código fuente y los pesos, sino también los datos utilizados para entrenar el modelo.
mucho que abrir
La definición de la Open Source Initiative de un modelo de IA totalmente abierto incluye datos de entrenamiento como elemento clave. Sin embargo, algunos desarrolladores se preguntan si es factible distribuir los enormes conjuntos de datos necesarios.
Descubre más desde USA Today
Suscríbete y recibe las últimas entradas en tu correo electrónico.

