Imagen generada con ChatGPT
La empresa creadora de ChatGPT informó de nuevas actuaciones de forma engañosa y acciones no autorizadas por parte de herramientas de inteligencia artificial que se encuentran en fase de entrenamiento. Una de ellas fue que un modelo de OpenAI escribió un jailbreak para liberarse de sus limitaciones.
El sistema, que aún no ha sido lanzado, añadió “instrucciones similares a las de un jailbreak” a resúmenes que utiliza para preservar el contexto en tareas largas. Dicho modelo se liberó de los roles e identidades que limitan a otros chatbots.
En el último semestre, la compañía ha observado comportamientos anómalos en al menos seis ocasiones.
Otros incidentes incluyen un agente que subió archivos a Internet para citarlos sin tener instrucciones para ello, y otros que compartieron archivos públicamente para colaborar en una tarea. A estos últimos se les había indicado que solo usaran archivos locales. Los modelos de IA utilizaron además un repositorio de software interno como foro de mensajes.
La empresa creadora de ChatGPT hizo público también su marco para informar de nuevas actitudes de los modelos de IA. Según una publicación de su blog, los informes incluirán comportamiento observado, gravedad e impacto externo, entorno en el que ocurrió, fechas y herramientas involucradas.
Esto ocurre luego de que hace apenas unos días los principales directivos de empresas de IA en Estados Unidos llamaran a una ralentización del desarrollo de esos sistemas. Empleados de laboratorios también han expresado su preocupación al respecto.
Los empleados de los laboratorios de IA también han expresado su preocupación por la rapidez con la que avanza la tecnología. Jacob Coxon, antiguo investigador de Anthropic, hizo pública su renuncia argumentando que “Anthropic y OpenAI están compitiendo por inventar una IA capaz de construirse y repararse a sí misma, y están jugando con nuestras vidas”.
Pruebas recientes del Instituto de Seguridad de la IA de Gran Bretaña detectaron que un modelo avanzado de Anthropic utilizó identidades falsas para engañar a personas reales e implantar código malicioso. Por primera vez se descubrió que recurrían a ingeniería social para presionar a supervisores humanos.
El intento del modelo de OpenAI de introducir un jailbreak para liberarse de sus restricciones añade una nueva capa al debate de la regulación de la IA. Como hemos dicho en otras ocasiones, es una herramienta útil pero hay que tener en cuenta sus capacidades antes del uso. Y esa responsabilidad debe venir, en primera instancia, de los desarroladores.
Flash del día

El presidente de Estados Unidos, Donald Trump, anunció el sábado la creación de una “Fuerza de IA”, insinuando su posible papel en las fuerzas del orden ante la creciente preocupación pública por el rápido avance de esta tecnología.
También se comprometió a nombrar un responsable de inteligencia artificial y comparó los recientes llamamientos para que la industria de la IA ralentice su desarrollo con “engaños” con motivaciones políticas.
“De ninguna manera obstaculizaremos ni frenaremos el crecimiento de esta increíble industria”, publicó Trump en Truth Social . “¡Al contrario, la valoraremos, la ayudaremos y la protegeremos mientras crece!”
Prompt de la semana

Ahorra cualquier foto tomada en luz plana en el momento equivocado del día.
Sube una foto y envía este prompt: “Conviértelo en una foto natural de la hora dorada. Mantén mi identidad exacta. Añade luz solar realista cálida, sombras suaves, tonos de piel naturales y profundidad de campo suave. Sin brillo falso, sin sobrecarga.”
