Libros de Harry Potter ayudan al desarrollo de la inteligencia artificial

Por

12/27/2023

libros de Harry Potter ayudan al desarrollo de la inteligencia artificial

Mark Russinovich y Ronen Eldan, investigadores de Microsoft, desarrollaron una técnica que permite que los grandes modelos lingüísticos (LLM, por sus siglas en inglés) que alimentan los chatbots de inteligencia artificial (IA) generativa puedan alterarse o editarse para eliminar de forma selectiva cualquier información relacionada al contenido protegido por derechos de autor que aparece en los datos con los que han sido entrenados.

Los investigadores lograron que un LLM desarrollado por Meta* pudiera olvidarse selectivamente de las referencias directas a los libros de Harry Potter de J.K. Rowling, incluidos sus personajes y argumentos. La novedosa técnica propuesta no sacrifica la capacidad general de toma de decisiones y análisis del sistema de IA y permitió al LLM desaprender un subconjunto de datos de entrenamiento, sin tener que volver a entrenarse desde cero.

Un desafío legal y ético

Según los autores del estudio, los LLM se entrenan analizando masivos conjuntos de datos de Internet que a menudo contienen información protegida por derechos de autor, datos privados, contenido sesgado, datos falsos e incluso elementos tóxicos o dañinos. Esto plantea desafíos legales y éticos para los desarrolladores y usuarios de estos modelos, así como para los autores y editores originales.

Evaluación de la técnica para desaprender

Russinovich y Eldan evaluaron la técnica en la tarea de desaprender los libros de Harry Potter con el LLM Llama2-7b, recientemente desarrollado por Meta. En un artículo aún no revisado por pares publicado en arXiv, los autores explican que, si bien el modelo tomó más de 184.000 horas de procesamiento para preentrenarse, pudieron constatar que, en aproximadamente una hora de ajuste fino, pudieron borrar de manera efectiva la capacidad del modelo para generar o recuperar contenido relacionado con Harry Potter. El rendimiento del modelo prácticamente no se vio afectado.

Un algoritmo de tres pasos

Los investigadores de Microsoft detallaron que la técnica consta de tres componentes principales. Primero, identificaron los tókenes mediante la creación de un modelo reforzado. «Creamos un modelo cuyo conocimiento del contenido desaprendido se refuerza mediante un mayor ajuste de los datos de destino (como Harry Potter) y vemos qué probabilidades de tókenes han aumentado significativamente. Es probable que se trate de tókenes relacionados con el contenido que queremos evitar generar», escribieron.

D	L	M	X	J	V	S
			1	2	3	4
5	6	7	8	9	10	11
12	13	14	15	16	17	18
19	20	21	22	23	24	25
26	27	28	29	30	31

Libros de Harry Potter ayudan al desarrollo de la inteligencia artificial

Un desafío legal y ético

Evaluación de la técnica para desaprender

Un algoritmo de tres pasos

LAS MAS LEIDAS

James Blunt confirma el perturbador significado real de su éxito «You’re Beautiful»

La enorme mesa de la reunión entre Putin y Macron genera una ola de...

Por primera vez en 16 años gobierno cierra el 2021 sin nuevas cuentas por...

Eminem hincó una rodilla durante su actuación de medio tiempo del Super Bowl, ¿por...

Europa se enreda con la fragmentación política

RECOMENDACIONES DEL EDITOR

Buscan derrotar el negacionismo climático de Donald Trump

Luna de miel entre Luis Abinader y la sociedad civil

Acontecimientos que marcaron el 2023 en República Dominicana

ENTRADAS POPULARES

Principal instrumento de política monetaria

¿Dónde deben cifrarse las apuestas del país?

Covid-19, criminalidad y pasta de jabón

CATEGORÍA POPULAR