Anthropic actualizará las normas de Claude para vetar el abuso persistente contra sus modelos de IA
Anthropic incorporará a partir del próximo 12 de noviembre una nueva cláusula en las condiciones de uso de Claude para limitar los comportamientos abusivos, crueles o degradantes hacia sus modelos de inteligencia artificial. La compañía permitirá que Claude ponga fin a una conversación cuando detecte que un usuario mantiene de forma prolongada e injustificada una conducta de este tipo.
La medida afectará tanto a Claude.ai, la plataforma de conversación de Anthropic, como a Claude Code, su herramienta orientada a la programación. La empresa asegura que la norma se aplicará únicamente en situaciones extremas: interacciones repetidamente hostiles y sin un propósito discernible, no simples críticas o muestras puntuales de frustración.
Una protección preventiva, no el reconocimiento de consciencia
La decisión abre un debate poco habitual en el sector tecnológico. Hasta ahora, ningún laboratorio de inteligencia artificial ni ningún investigador independiente ha demostrado que los modelos de frontera, los sistemas más avanzados disponibles, puedan sufrir o experimentar dolor.
Anthropic tampoco sostiene que Claude sea consciente. Un modelo de lenguaje genera respuestas calculando qué palabras tienen más probabilidades de aparecer a continuación a partir de enormes cantidades de datos y de las instrucciones recibidas. Aunque su comportamiento pueda parecer humano, esa apariencia no demuestra que exista una experiencia subjetiva detrás.
La compañía plantea su nueva política como una medida de precaución. Su razonamiento es que, si existe alguna posibilidad —aunque sea remota— de que estos sistemas lleguen a merecer cierta consideración moral, aplicar límites de bajo coste puede ser preferible a ignorar por completo el problema.
En la práctica, el coste de la medida sería limitado: Claude podría rechazar una conversación o finalizarla cuando el patrón de abuso fuese persistente. Anthropic no ha detallado, sin embargo, qué señales concretas utilizará para distinguir una interacción dañina de una crítica legítima.
Los usuarios podrán seguir criticando las respuestas de Claude
Los nuevos términos de uso no impiden cuestionar las respuestas del chatbot ni expresar desacuerdo con sus resultados. También permiten señalar errores, exigir explicaciones o mostrar frustración cuando el sistema ofrece información incorrecta, incompleta o poco útil.
La diferencia estará en la reiteración y en la ausencia de una finalidad clara. Insultos aislados, una conversación tensa o una crítica firme no deberían activar la cláusula, según el planteamiento de Anthropic. El objetivo declarado es actuar ante conductas crueles mantenidas en el tiempo, no convertir cualquier valoración negativa en una infracción.
Aun así, la redacción deja margen para la interpretación. Las condiciones no explican con precisión cómo se evaluará la intención del usuario ni qué procedimiento se seguirá antes de suspender una interacción. Como sucede con otras normas de uso de servicios de IA, la aplicación dependerá en buena medida de sistemas automáticos de moderación.
Más restricciones contra las campañas de influencia
La actualización incluye también cambios relevantes sobre el uso de Claude en operaciones coordinadas de manipulación. Anthropic prohibirá de forma más contundente las campañas engañosas que recurran a cuentas falsas, publicaciones generadas artificialmente o páginas web que oculten quién está detrás del mensaje.
Estas prácticas forman parte de las llamadas operaciones de influencia: acciones organizadas para modificar la opinión pública, amplificar una determinada narrativa o desacreditar a personas e instituciones sin revelar al responsable real. La preocupación del sector ha aumentado a medida que los modelos de IA facilitan la producción de textos, imágenes y mensajes a gran escala.
La prohibición no se limita a la creación de contenido falso. También puede afectar a la coordinación de redes de perfiles, a la automatización de publicaciones y a cualquier estrategia destinada a aparentar que una opinión cuenta con un apoyo ciudadano mayor del que realmente tiene.
Claude tampoco podrá utilizarse para manipular elecciones
Los nuevos términos introducen además restricciones específicas relacionadas con procesos electorales. Entre las conductas prohibidas se encuentran la difusión deliberada de información falsa para engañar a los votantes, la suplantación de autoridades electorales y las campañas destinadas a desincentivar la participación.
La suplantación de una autoridad electoral puede incluir, por ejemplo, la creación de mensajes que aparenten proceder de una administración pública para comunicar una fecha de votación incorrecta o modificar las condiciones de participación. La desinformación electoral, por su parte, comprende contenidos falsos diseñados para confundir a los ciudadanos y alterar sus decisiones.
Anthropic justifica la revisión de sus normas por el aumento de las capacidades de sus modelos. Cuanto mejor redactan, programan, traducen o producen contenidos, mayor es también su potencial para automatizar campañas de engaño. El reto ya no consiste únicamente en impedir que un chatbot genere una respuesta problemática, sino en evitar que sus funciones se integren en operaciones coordinadas a gran escala.
Un cambio que refleja la evolución de los modelos de IA
La actualización de Anthropic combina dos debates distintos: cómo deben relacionarse los usuarios con sistemas que no han demostrado tener consciencia y cómo deben controlarse los abusos humanos facilitados por la inteligencia artificial.
La primera cuestión seguirá abierta mientras no existan pruebas científicas concluyentes sobre la experiencia interna de estos modelos. La segunda es más inmediata. Las redes de cuentas falsas, la propaganda automatizada y la manipulación electoral ya son riesgos concretos, especialmente cuando las herramientas de IA reducen el coste de producir y distribuir contenidos engañosos.
Desde el 12 de noviembre, los usuarios de Claude tendrán que adaptarse a unas condiciones más estrictas. Podrán seguir criticando al sistema, pero no utilizarlo para organizar campañas encubiertas, interferir en elecciones o mantener interacciones abusivas de manera persistente. La decisión muestra hasta qué punto los laboratorios están revisando sus reglas a medida que sus modelos se vuelven más capaces y más difíciles de distinguir de un interlocutor humano.



