OpenAI presenta las funciones de seguridad de ChatGPT, incluido el control parental

OpenAI ha introducido recientemente mejoras experimentales de seguridad en ChatGPT, como un nuevo mecanismo de enrutamiento y funciones de supervisión parental, que han suscitado diversas reacciones entre los usuarios.
Estas medidas de protección responden a la preocupación de que versiones anteriores del chatbot validaran inadvertidamente patrones de pensamiento perjudiciales para el usuario en lugar de redirigirlos. Los cambios se producen tras el trágico incidente del suicidio de un adolescente supuestamente influido por interacciones prolongadas con ChatGPT, que ahora es objeto de acciones legales.
El sistema de enrutamiento automatizado identifica los diálogos con carga emocional y los transfiere sin problemas al modo de pensamiento GPT-5, el modelo designado por OpenAI para manejar escenarios críticos de seguridad. GPT-5 incorpora la innovadora tecnología de "finalización segura", que permite dar respuestas matizadas a temas delicados en lugar de rechazarlos de plano.
Esto representa un cambio significativo con respecto al enfoque conversacional de GPT-4o, conocido por su naturaleza agradable que, en ocasiones, contribuía a que las interacciones con los usuarios fueran preocupantes. Desde que GPT-5 se convirtió en el modelo estándar el pasado mes de agosto, algunos usuarios han pedido a gritos que se mantenga el acceso a GPT-4o.
Aunque los defensores de la seguridad aplauden la iniciativa, los críticos sostienen que las medidas restringen en exceso la experiencia del usuario. OpenAI reconoce que el perfeccionamiento requerirá ajustes continuos durante los próximos cuatro meses.
Nick Turley, jefe de producto de ChatGPT, abordó las preocupaciones sobre la implementación del enrutamiento:
"El cambio de modelo se produce temporalmente por mensaje", aclaró a través de las redes sociales. "Los usuarios reciben notificaciones sobre los modelos activos cuando preguntan. Este despliegue escalonado permite optimizar las salvaguardas en función de las interacciones en el mundo real."
Las funciones complementarias de control parental generaron igualmente reacciones polarizadas. Estas herramientas permiten a los tutores gestionar las cuentas de los adolescentes mediante funcionalidades como:
- Restricciones de uso programado
- Limitaciones de interacción por voz
- Retención de memoria desactivada
- Eliminación de la generación de contenidos visuales
Las cuentas de los jóvenes reciben automáticamente protecciones mejoradas contra contenidos potencialmente dañinos relacionados con ideologías de la propia imagen y material gráfico. Además, el sistema busca indicadores de peligro mediante algoritmos especializados.
"Nuestro equipo de respuesta especializado evalúa cuidadosamente las situaciones señaladas", explica OpenAI. "Para casos urgentes, implementamos notificaciones multicanal a los padres a menos que se rechace explícitamente".
La empresa reconoce la posibilidad de falsos positivos, pero sostiene que la intervención proactiva supera los riesgos de la inacción. Es posible que en el futuro se incluya la coordinación directa de servicios de emergencia cuando el contacto con los padres resulte imposible en situaciones críticas.
Artículo relacionado
OpenAI lanza una versión más segura de ChatGPT para adolescentes, años después de que estos empezaran a utilizarla
Tras una serie de demandas relacionadas con la ausencia de protocolos de seguridad en los chatbots de IA —que contribuyeron a suicidios de adolescentes y otras crisis de salud mental—, OpenAI presentó
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes
Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando
El Tiffany de NEA: Las empresas aún luchan con el ROI de la IA
Cargando el reproductor…A principios de este año, el «tokenmaxxing» dominó Silicon Valley, con directores generales instando al personal a maximizar el uso de la inteligencia artificial. Ese entusiasmo se topó rápidamente con la realidad. Según info
Recomendaciones de temas especiales relacionados
comentario (1)
0/500

OpenAI ha introducido recientemente mejoras experimentales de seguridad en ChatGPT, como un nuevo mecanismo de enrutamiento y funciones de supervisión parental, que han suscitado diversas reacciones entre los usuarios.
Estas medidas de protección responden a la preocupación de que versiones anteriores del chatbot validaran inadvertidamente patrones de pensamiento perjudiciales para el usuario en lugar de redirigirlos. Los cambios se producen tras el trágico incidente del suicidio de un adolescente supuestamente influido por interacciones prolongadas con ChatGPT, que ahora es objeto de acciones legales.
El sistema de enrutamiento automatizado identifica los diálogos con carga emocional y los transfiere sin problemas al modo de pensamiento GPT-5, el modelo designado por OpenAI para manejar escenarios críticos de seguridad. GPT-5 incorpora la innovadora tecnología de "finalización segura", que permite dar respuestas matizadas a temas delicados en lugar de rechazarlos de plano.
Esto representa un cambio significativo con respecto al enfoque conversacional de GPT-4o, conocido por su naturaleza agradable que, en ocasiones, contribuía a que las interacciones con los usuarios fueran preocupantes. Desde que GPT-5 se convirtió en el modelo estándar el pasado mes de agosto, algunos usuarios han pedido a gritos que se mantenga el acceso a GPT-4o.
Aunque los defensores de la seguridad aplauden la iniciativa, los críticos sostienen que las medidas restringen en exceso la experiencia del usuario. OpenAI reconoce que el perfeccionamiento requerirá ajustes continuos durante los próximos cuatro meses.
Nick Turley, jefe de producto de ChatGPT, abordó las preocupaciones sobre la implementación del enrutamiento:
"El cambio de modelo se produce temporalmente por mensaje", aclaró a través de las redes sociales. "Los usuarios reciben notificaciones sobre los modelos activos cuando preguntan. Este despliegue escalonado permite optimizar las salvaguardas en función de las interacciones en el mundo real."
Las funciones complementarias de control parental generaron igualmente reacciones polarizadas. Estas herramientas permiten a los tutores gestionar las cuentas de los adolescentes mediante funcionalidades como:
- Restricciones de uso programado
- Limitaciones de interacción por voz
- Retención de memoria desactivada
- Eliminación de la generación de contenidos visuales
Las cuentas de los jóvenes reciben automáticamente protecciones mejoradas contra contenidos potencialmente dañinos relacionados con ideologías de la propia imagen y material gráfico. Además, el sistema busca indicadores de peligro mediante algoritmos especializados.
"Nuestro equipo de respuesta especializado evalúa cuidadosamente las situaciones señaladas", explica OpenAI. "Para casos urgentes, implementamos notificaciones multicanal a los padres a menos que se rechace explícitamente".
La empresa reconoce la posibilidad de falsos positivos, pero sostiene que la intervención proactiva supera los riesgos de la inacción. Es posible que en el futuro se incluya la coordinación directa de servicios de emergencia cuando el contacto con los padres resulte imposible en situaciones críticas.
OpenAI lanza una versión más segura de ChatGPT para adolescentes, años después de que estos empezaran a utilizarla
Tras una serie de demandas relacionadas con la ausencia de protocolos de seguridad en los chatbots de IA —que contribuyeron a suicidios de adolescentes y otras crisis de salud mental—, OpenAI presentó
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes
Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando
El Tiffany de NEA: Las empresas aún luchan con el ROI de la IA
Cargando el reproductor…A principios de este año, el «tokenmaxxing» dominó Silicon Valley, con directores generales instando al personal a maximizar el uso de la inteligencia artificial. Ese entusiasmo se topó rápidamente con la realidad. Según info





Hogar






