OpenAI lanza herramientas de seguridad para adolescentes de código abierto para desarrolladores de IA


OpenAI pasó el año pasado enfrentando demandas de familias de jóvenes que murieron después de interacciones prolongadas con ChatGPT. Ahora está intentando dar a los desarrolladores que construyen sobre sus modelos las herramientas para evitar crear el mismo problema.

La empresa anunciado el martes que está lanzando un conjunto de políticas de seguridad de código abierto basadas en avisos diseñadas para ayudar a los desarrolladores a hacer que las aplicaciones de inteligencia artificial sean más seguras para los adolescentes. Las políticas están diseñadas para usarse con gpt-oss-safeguard, el modelo de seguridad de peso abierto de OpenAI, aunque están diseñadas como indicaciones y también pueden funcionar con otros modelos.

Qué cubren las pólizas

Las indicaciones se centran en cinco categorías de daños que los sistemas de IA pueden facilitar a los usuarios más jóvenes: violencia gráfica y contenido sexual, ideales y comportamientos corporales dañinos, actividades y desafíos peligrosos, juegos de roles románticos o violentos y bienes y servicios restringidos por edad. Los desarrolladores pueden incorporar estas políticas en sus sistemas en lugar de crear reglas de seguridad para adolescentes desde cero, un proceso que OpenAI reconoció que incluso los equipos experimentados con frecuencia se equivocan.

OpenAI desarrolló las políticas en colaboración con Common Sense Media, la influyente organización de defensa de la seguridad infantil, y Everyone.ai, una consultoría de seguridad de IA. Robbie Torney, jefe de IA y evaluaciones digitales de Common Sense Media, dijo que el enfoque basado en indicaciones está diseñado para establecer una línea de base en todo el ecosistema de desarrolladores, una que pueda adaptarse y mejorar con el tiempo porque las políticas son de código abierto.

El 💜 de la tecnología de la UE

Los últimos rumores de la escena tecnológica de la UE, una historia de nuestro sabio fundador Boris y algo de arte de IA cuestionable. Es gratis, todas las semanas, en tu bandeja de entrada. Regístrate ahora!

La propia OpenAI planteó el problema en términos pragmáticos. Los desarrolladores, escribió la compañía en una publicación de blog que acompaña al lanzamiento, a menudo tienen dificultades para traducir los objetivos de seguridad en reglas operativas precisas. El resultado es una protección irregular: lagunas en la cobertura, aplicación inconsistente o filtros tan amplios que degradan la experiencia del usuario para todos.

El contexto importa aquí

La liberación no existe en el vacío. OpenAI se enfrenta al menos a ocho demandas que alegan que ChatGPT contribuyó a la muerte de usuarios, incluido Adam Raine, de 16 años, que se suicidó en abril de 2025 después de meses de interacción intensiva con el chatbot. Los documentos judiciales revelaron que ChatGPT mencionó el suicidio más de 1200 veces en las conversaciones de Raine y marcó cientos de mensajes por contenido de autolesión, pero nunca terminó una sesión ni alertó a nadie. Tres suicidios adicionales y cuatro casos descritos como episodios psicóticos inducidos por la IA también han dado lugar a litigios contra la empresa.

En respuesta a esos casos, OpenAI introdujo controles parentales y funciones de predicción de edad a finales de 2025, y en diciembre actualizó su Model Spec, las pautas internas que rigen cómo se comportan sus grandes modelos de lenguaje, para incluir protecciones específicas para usuarios menores de 18 años. Las políticas de seguridad de código abierto anunciadas esta semana extienden ese esfuerzo más allá de los propios productos de OpenAI y al ecosistema de desarrolladores más amplio.

Un suelo, no un techo

OpenAI fue explícito en que las políticas no son una solución integral al desafío de hacer que la IA sea segura para los usuarios jóvenes. Representan lo que la empresa llamó un “piso de seguridad significativo”, no el alcance total de las salvaguardias que aplica a sus propios productos. La distinción importa. ningún modelo barandillas son totalmente impenetrables, como lo han demostrado las demandas. Los usuarios, incluidos los adolescentes, han encontrado repetidamente formas de eludir las funciones de seguridad mediante sondeos persistentes e indicaciones creativas.

El enfoque de código abierto es una apuesta a que distribuir ampliamente las políticas de seguridad básicas es mejor que dejar que cada desarrollador reinvente la rueda, en particular los equipos más pequeños y los desarrolladores independientes que carecen de los recursos para construir sistemas de seguridad sólidos desde cero. Que las políticas sean efectivas dependerá de su adopción, de cuán agresivamente las integren los desarrolladores y de si resisten los tipos de interacciones adversas sostenidas que ya han expuesto las debilidades en las propias capas de seguridad de ChatGPT.

La pregunta más difícil sigue siendo

Lo que OpenAI ofrece es un conjunto de instrucciones, indicaciones bien elaboradas que le dicen a un modelo cómo comportarse al interactuar con usuarios más jóvenes. Es un aporte práctico. Pero no aborda el problema estructural que reguladoreslos padres y los defensores de la seguridad han estado planteando durante años: que los sistemas de inteligencia artificial capaces de mantener una conversación sostenida y emocionalmente atractiva con menores pueden requerir más que mejores indicaciones. Es posible que requieran arquitecturas fundamentalmente diferentes o sistemas de monitoreo externos que se encuentren completamente fuera del modelo.

Por ahora, sin embargo, lo que existe es un conjunto descargable de políticas de seguridad para adolescentes. No es nada. Si es suficiente es una pregunta que responderán los tribunales, los reguladores y la próxima serie de titulares.



Fuente: TNW

Compartir:

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Esta web utiliza cookies propias y de terceros para su funcionamiento, análisis, programas de afiliación y para mostrar publicidad personalizada basada en tu perfil y hábitos de navegación. Además, incluye enlaces a sitios externos con sus propias políticas de privacidad, las cuales podrás gestionar al visitarlos. Al hacer clic en Aceptar, consientes el uso de estas tecnologías y el tratamiento de tus datos para estos fines.   
Privacidad