¿Sabías que los libros de Harry Potter ayudan al desarrollo de la IA?

El logotipo de 'Harry Potter y el legado maldito' en el Palace Theatre de Londres, en 2019. Foto:
Jakub Porzycki / NurPhoto / Gettyimages.ru
Mark Russinovich y Ronen Eldan, investigadores de Microsoft, desarrollaron una técnica que permite que los grandes modelos lingüísticos (LLM, por sus siglas en inglés) que alimentan los chatbots de inteligencia artificial (IA) generativa puedan alterarse o editarse para eliminar de forma selectiva cualquier información relacionada al contenido protegido por derechos de autor que aparece en los datos con los que han sido entrenados.
Los investigadores lograron que un LLM desarrollado por Meta pudiera olvidarse selectivamente de las referencias directas a los libros de Harry Potter de J.K. Rowling, incluidos sus personajes y argumentos. La novedosa técnica propuesta no sacrifica la capacidad general de toma de decisiones y análisis del sistema de IA y permitió al LLM desaprender un subconjunto de datos de entrenamiento, sin tener que volver a entrenarse desde cero.
Un desafío legal y ético

Estreno de 'Harry Potter y las reliquias de la muerte: Parte 2' en el Avery Fisher Hall de Nueva York, en 2011. Foto:
Dimitrios Kambouris / Gettymages.ru
Según los autores del estudio, los LLM se entrenan analizando masivos conjuntos de datos de Internet que a menudo contienen información protegida por derechos de autor, datos privados, contenido sesgado, datos falsos e incluso elementos tóxicos o dañinos.
Esto plantea desafíos legales y éticos para los desarrolladores y usuarios de estos modelos, así como para los autores y editores originales.
Evaluación de la técnica para desaprender
Russinovich y Eldan evaluaron la técnica en la tarea de desaprender los libros de Harry Potter con el LLM Llama2-7b, recientemente desarrollado por Meta.
En un artículo aún no revisado por pares publicado en arXiv, los autores explican que, si bien el modelo tomó más de 184 000 horas de procesamiento para preentrenarse, constataron que, en aproximadamente una hora de ajuste fino, pudieron borrar de manera efectiva la capacidad del modelo para generar o recuperar contenido relacionado con Harry Potter. El rendimiento del modelo prácticamente no se vio afectado.
Un algoritmo de tres pasos
Los investigadores de Microsoft detallaron que la técnica consta de tres componentes principales. Primero, identificaron los tókenes mediante la creación de un modelo reforzado.
“Creamos un modelo cuyo conocimiento del contenido desaprendido se refuerza mediante un mayor ajuste de los datos de destino (como Harry Potter) y vemos qué probabilidades de tókenes han aumentado significativamente. Es probable que se trate de tókenes relacionados con el contenido que queremos evitar generar”, escribieron.
En segundo lugar, reemplazaron expresiones idiosincrásicas en los datos objetivo con contrapartes genéricas en los datos de destino para que, luego, el modelo genere etiquetas alternativas para estos tókenes. Por último, llevaron a cabo un ajuste fino del modelo con estas etiquetas alternativas.
“En esencia, cada vez que el modelo encuentra un contexto relacionado con los datos de destino, 'olvida' el contenido original”, explican los autores.
¿Por qué Harry Potter?

Impresión de la gira de prensa para el estreno mundial de la exposición 'Harry Potter: Visiones de magia en el Odiseo'. Alemania (2023). Foto: xChristophxHardtx / www.globallookpress.com
Los especialistas apuntan que, en los últimos tiempos, cada vez es más frecuente la referencia a Harry Potter en los estudios de IA.
Con la obra de J.K. Rowling, “la abundancia de escenas, diálogos y momentos emocionales la hacen muy relevante para el área específica del procesamiento del lenguaje natural”, expuso Leila Wehbe, investigadora de la Universidad Carnegie Mellon (Australia), en una conversación con Bloomberg esta semana.
Otra razón es que Harry Potter es popular entre los investigadores más jóvenes. “Los habrían leído cuando eran niños o adolescentes, pensando así en ellos a la hora de elegir un corpus de texto escrito o hablado”, concluyó la experta.
(Con información de RT en Español)
Vea además:
- Paula Ali recibió el premio Nacional de Televisión 2026
- Reafirma Presidente Díaz-Canel compromiso de Cuba con la promoción y protección de los derechos humanos
- Marrero Cruz: Las transformaciones son para resolver los problemas de nuestro pueblo
- Diversas voces en EE.UU critican el perverso informe de Marco Rubio contra Cuba
- Irán y Estados Unidos intercambian amenazas de ataques a infraestructuras civiles por el control del estrecho de Ormuz
- ir aNoticias »
- Ocho funciones de Windows que puedes desactivar para mejorar la seguridad de un PC
- China acelera su transformación industrial con la IA como motor del crecimiento
- Cuba y la UNESCO entregan Premio Carlos J. Finlay de Microbiología a científico tailandés en París
- El Guardián Silencioso: por qué RASP está redefiniendo la ciberseguridad desde dentro
- La Soyuz MS-29 se acopla a la Estación Espacial Internacional en un vuelo exprés de dos órbitas (+Video)
- ir aCiencia y Tecnología »

Haga un comentario