Herramientas de IA Proyectos Directorio
🏆 Tabla de Clasificación 📡 Noticias ✨ Prompts ⚖️ Comparar Modelos 🔧 Herramientas 📦 Proyectos 🚀 Espacios
Blog
Datos del ecosistema

Uno de cada cinco proyectos de IA no tiene una licencia que una máquina pueda leer

De los 8,246 repositorios de software de IA que rastreamos, 1,641 no tienen una licencia identificable, y en conjunto acumulan 8.3 millones de estrellas. La tasa apenas cambia entre un experimento de 200 estrellas y una herramienta de 50,000 estrellas.

Actualizado el 7 de agosto de 2026·6 min de lectura·Sin muro de pago

TL;DR — la versión corta

De los 8,246 proyectos de software de IA que rastreamos — uno de cada cinco — no tienen una licencia que GitHub pueda identificar. Entre ellos acumulan 8.3 millones de estrellas.

La popularidad no lo protege. La tasa es de 21.5 % por debajo de mil estrellas y de 19.1 % por encima de cincuenta mil. Es esencialmente plana.

Sin una licencia identificable, el valor predeterminado legal es que usted no tiene ningún permiso en absoluto. Ni permisiva, ni copyleft — nada.

El open source es un acuerdo de licencia antes que cualquier otra cosa. Un repositorio público no es un permiso: según el Convenio de Berna, el código tiene derechos de autor desde el momento en que se escribe, y el autor conserva todos los derechos que no haya cedido explícitamente.

Así que hicimos una pregunta aburrida al catálogo: ¿cuántos proyectos de IA realmente dicen lo que usted puede hacer con ellos?

Uno de cada cinco no dice nada

De los 8,246 repositorios que clasificamos como software — excluyendo cursos, awesome-lists, roadmaps y libros, usando la misma regla que nuestro análisis de inactividad1,641 no tienen un identificador de licencia SPDX. Eso es el 19.9 %.

El contenido excluido es peor, para que conste: el 39.5 % de los 2,090 cursos y listas tampoco tienen licencia. Los dejamos fuera porque nadie despliega un roadmap.

No es un problema de proyectos hobby

Este fue el hallazgo que no esperábamos. La historia intuitiva — alguien sube un experimento de fin de semana y nunca se anima a agregar un archivo LICENSE — produciría una tasa que cae bruscamente a medida que los proyectos se vuelven serios. No cae.

Share with no machine-readable licence, by popularity under 1k stars 21.5% 3,951 projects 1k – 10k 18.1% 3,405 projects 10k – 50k 19.8% 759 projects over 50k 19.1% 131 projects 8,246 AI software repositories · courses, awesome-lists and books excluded
Proporción de repositorios de software de IA sin licencia legible por máquina, por cantidad de estrellas: menos de 1k 21.5 %, 1k–10k 18.1 %, 10k–50k 19.8 %, más de 50k 19.1 %.

Un repositorio con cincuenta mil estrellas tiene casi exactamente la misma probabilidad de no tener licencia que uno con doscientas. Entre los 175 proyectos sin licencia por encima de 10,000 estrellas hay herramientas que usted probablemente ha instalado.

El lenguaje tampoco lo cambia: Go es el más disciplinado con 15.1 %, C++ el menos con 23.3 %, y todo lo demás se sitúa entre 18 y 22 %.

“Sin licencia” abarca dos situaciones diferentes

Necesitamos ser precisos, porque los dos casos se ven idénticos desde el exterior y tienen consecuencias diferentes.

Algunos proyectos genuinamente no tienen nada. Sin archivo LICENSE, sin términos en el README, sin declaración en ninguna parte. Se aplica el valor predeterminado: todos los derechos reservados. Usted puede mirar el código. No puede copiarlo en su producto.

Otros tienen una licencia que simplemente no es uno de los identificadores estándar. Una variante personalizada, una licencia de código fuente disponible con restricciones comerciales, una BSD modificada, términos escritos por un abogado de empresa. Algunos de los nombres más importantes de nuestra lista sin licencia caen en este segundo grupo — no son ilegales, simplemente no son estándar.

El problema práctico es que ninguna herramienta automatizada puede distinguir entre los dos. Su escáner de dependencias reporta “unknown” para ambos. Su panel de cumplimiento reporta “unknown”. Y cada vez más, el agente de codificación que acaba de extraer ese fragmento a su base de código no reportó nada en absoluto, porque nunca miró.

La versión de este problema en la era de los agentes. Cuando un humano copiaba una función, un humano podía leer la licencia. Los asistentes de codificación de IA sugieren código a una velocidad que ningún revisor revisa línea por línea. Que una quinta parte del ecosistema de IA sea legalmente inclasificable es un problema mucho mayor en 2026 de lo que era en 2022.

Lo que esto significa en la práctica

Si usted mantiene uno de estos

Agregar una licencia toma unos noventa segundos en GitHub: Agregar archivoCrear nuevo archivo → escriba LICENSE → aparece un selector de plantillas. MIT si desea la máxima adopción, Apache-2.0 si desea lo mismo más una concesión explícita de patentes, AGPL-3.0 si desea que cualquiera que ejecute una versión modificada como servicio publique sus cambios.

Es el minuto de mayor apalancamiento que puede invertir en su proyecto. Sin él, toda empresa seria que encuentre su trabajo tiene una política que dice: no tocar.

Cada página de proyecto en olud.ai muestra la licencia detectada junto a la puntuación de salud — y la muestra como desconocida cuando es desconocida, en lugar de adivinar.

Método

10,336 repositorios de IA rastreados al 7 de agosto de 2026. Los identificadores de licencia provienen de la API de GitHub, que devuelve un identificador SPDX cuando reconoce el archivo LICENSE y nada cuando no lo reconoce. Contamos “sin licencia identificable” como la ausencia de ese identificador — lo que, como se explicó anteriormente, fusiona proyectos genuinamente sin licencia con aquellos que usan términos no estándar. Separamos el software del contenido (cursos, listas, libros) con la misma regla de nombre e idioma utilizada en nuestro análisis de inactividad, e informamos la cifra de software.

Este artículo describe lo que nuestros datos muestran sobre los metadatos de licencias. No es asesoramiento legal, y los autores no son abogados.