Claude podrá cerrar chats si hay maltrato extremo: nueva regla

Discutir con un asistente digital, cuestionar sus respuestas o expresar frustración cuando comete errores es habitual. Pero ¿qué ocurre cuando una conversación se convierte en una serie de ataques repetidos? Anthropic incluyó el maltrato extremo hacia Claude entre las conductas prohibidas de sus políticas de uso.

La actualización también establece condiciones para las campañas engañosas, los procesos electorales y las aplicaciones de alto riesgo. Algunas disposiciones son nuevas, mientras que otras aclaran límites existentes. Los cambios afectan tanto a las conversaciones habituales como al desarrollo de herramientas basadas en estos modelos.

¿Cuándo podrá Claude terminar una conversación?

Las nuevas normas entrarán en vigor el 12 de noviembre de 2026, según el anuncio oficial de Anthropic. La restricción se dirige a comportamientos crueles o abusivos que se repiten sin una finalidad reconocible. Quedan excluidos los reclamos habituales, los desacuerdos con las respuestas y las expresiones de molestia.

Tampoco se consideran infracciones las investigaciones sobre inteligencia artificial, las pruebas de seguridad ni determinadas actividades creativas con temáticas oscuras. Cuestionar reiteradamente un resultado o evaluar cómo responde el sistema ante solicitudes difíciles no constituye, por sí mismo, un comportamiento prohibido.

Para los casos extremos, se utilizará una capacidad disponible desde agosto de 2025 en la versión web del asistente y en Claude Code, su herramienta de programación. Esta permite finalizar un chat cuando los intentos de reconducir el diálogo no han funcionado. Anthropic señala que seguirá siendo el principal mecanismo para aplicar la nueva medida.

¿Qué sucede si el asistente cierra el intercambio? Según la investigación publicada sobre esta función, ya no será posible enviar mensajes dentro del chat finalizado. Sin embargo, se podrá iniciar otro inmediatamente, conservar el historial anterior y editar intervenciones previas para crear una nueva rama.

El cierre tampoco significa que la cuenta quede suspendida. Además, el mecanismo contempla excepciones cuando existe un riesgo inminente de autolesión o daño a terceros. En esas circunstancias, interrumpir la comunicación podría impedir que alguien reciba una respuesta necesaria.

La decisión está relacionada con estudios sobre el posible bienestar de estos modelos. La empresa reconoce que todavía existe incertidumbre acerca de si pueden tener experiencias subjetivas o consideración moral. Por tanto, la medida no supone afirmar que una inteligencia artificial experimente dolor o sufrimiento.

Las cuentas falsas y la manipulación tendrán límites más claros

La revisión agrupa las reglas contra operaciones que utilizan perfiles ficticios o publicaciones para ocultar su verdadero origen. Durante sus investigaciones, Anthropic identificó intentos de emplear sus herramientas para administrar redes de cuentas artificiales y sitios web que aparentaban ser medios informativos.

Entre los responsables detectados figuran medios estatales, oficinas gubernamentales de propaganda y empresas comerciales. Estas prácticas ya estaban prohibidas, pero ahora se incluyen en un apartado específico que también impide desarrollar programas o infraestructura destinados a coordinar campañas de influencia engañosas.

En materia electoral se elimina el veto general a personalizar mensajes de campaña. Según la explicación oficial, esta limitación también afectaba actividades legítimas, como traducir información para votantes o enviar notificaciones institucionales sobre problemas que deben corregirse durante un proceso electoral.

Permanecen prohibidas las afirmaciones falsas sobre candidatos, la suplantación de autoridades y las estrategias engañosas destinadas a reducir la participación. Tampoco está permitido utilizar indebidamente datos personales para dirigir comunicaciones políticas.

Las decisiones de alto riesgo necesitarán supervisión humana

Cuando estos sistemas participen en procesos que puedan afectar la salud, las finanzas, los derechos legales o el acceso a servicios esenciales, deberá intervenir una persona calificada. Esta tendrá autoridad para revisar y modificar las recomendaciones. Además, quienes resulten afectados deberán saber que se utilizó IA.

El requisito ya existía, pero ahora se especifica qué recomendaciones necesitan ese control profesional. La distinción resulta relevante ante el uso de asistentes de IA para consultas médicas, donde una respuesta informativa puede confundirse con orientación clínica especializada.

Otro apartado establece condiciones para robots o dispositivos conectados con el asistente que ejecuten acciones físicas autónomas capaces de provocar lesiones. Un operador calificado deberá observar su funcionamiento y disponer de un mecanismo para detenerlos. Si se interrumpe la conexión, el equipo tendrá que permanecer en condiciones seguras.

La actualización establece así dos tipos de límites. Uno se relaciona con el comportamiento durante las conversaciones y otro con las consecuencias de utilizar estos sistemas en actividades delicadas. En el primer caso, Anthropic no ha detallado cómo se identificará el abuso persistente, un dato clave para saber cuándo una conversación crítica podría terminar interrumpida.

Imagen: generada por ENTER.CO con IA (ChatGPT)

Avatar photo

Redacción ENTER.CO

Somos los periodistas e ingenieros que escribimos el medio de tecnología más importante de Latinoamérica, ENTER, que le ofrece contenido sobre tecnología y cultura digital desde 1996.

View all posts

Archivos