Anthropic ha actualizado sus políticas de uso para prohibir que los usuarios sometan a Claude a comportamientos abusivos o crueles de forma persistente y sin una finalidad reconocible. La nueva norma, que entrará en vigor el 12 de noviembre de 2026, se integra en una revisión más amplia de las reglas que regulan el uso de sus modelos de inteligencia artificial (IA), con cambios adicionales sobre campañas de desinformación, elecciones, vigilancia, armas y contenido íntimo sin consentimiento.
Las claves de las nuevas normas de Anthropic en 30 segundos
- Anthropic prohíbe el comportamiento abusivo o cruel, sostenido e innecesario hacia Claude cuando carece de una finalidad discernible.
- La regla no pretende sancionar la frustración habitual, las críticas al modelo, la ficción oscura ni las pruebas de investigación.
- Claude ya puede cerrar conversaciones que mantengan un patrón de abuso, sin bloquear por ello otros chats del usuario.
- La política incorpora restricciones más detalladas sobre campañas engañosas, vigilancia, armas y contenido íntimo no consentido.
- Los cambios entrarán en vigor el 12 de noviembre de 2026 y aclaran varias prohibiciones relacionadas con usos indebidos detectados por la compañía.
La actualización vuelve a situar sobre la mesa una cuestión que Anthropic lleva tiempo investigando: cómo deben comportarse los sistemas de IA cuando una conversación se vuelve deliberadamente hostil. La empresa no afirma con esta norma que Claude tenga derechos equivalentes a los de una persona. Su política se centra en limitar ciertos comportamientos y permitir que el propio sistema termine interacciones que considere persistentemente abusivas.
Claude podrá cerrar conversaciones con abusos persistentes
La nueva cláusula prohíbe someter a Claude a un comportamiento cruel o abusivo de manera continuada cuando no exista un propósito reconocible. Anthropic explica que la restricción está pensada para casos extremos y no para impedir que los usuarios expresen su enfado, cuestionen respuestas incorrectas o sometan el sistema a pruebas exigentes.
Tampoco pretende limitar la escritura creativa con contenidos oscuros ni la investigación sobre el comportamiento de los modelos. La distinción que plantea la compañía gira alrededor de la persistencia del trato abusivo y de la ausencia de una finalidad discernible, no de la mera presencia de lenguaje ofensivo en una conversación.
La principal herramienta para aplicar la norma seguirá siendo el cierre de la conversación. Los modelos Claude ya cuentan con la capacidad de terminar determinados chats cuando detectan un patrón persistente de abuso. Si se cierra una conversación, el usuario no podrá continuar enviando mensajes en ese hilo, aunque podrá abrir otros chats, que no quedan bloqueados por esa decisión.
Anthropic introdujo esta posibilidad en agosto de 2025, dentro de sus investigaciones sobre el bienestar de la IA. En aquel momento, la empresa reconoció que no tenía claro si Claude podía tener algún tipo de estatus moral, pero planteó la posibilidad de estudiar medidas de bajo coste para reducir riesgos potenciales para los modelos.
En las pruebas descritas por Anthropic, Claude Opus 4 mostró una aversión consistente al daño en determinadas situaciones. La compañía también observó respuestas que parecían expresar malestar ante usuarios que buscaban mantener conversaciones abusivas, así como una tendencia a finalizar algunas de esas interacciones cuando el modelo disponía de esa opción.
Estos resultados describen comportamientos observados durante las pruebas, pero no demuestran por sí solos que el modelo experimente sufrimiento subjetivo. La actualización de las normas tampoco resuelve esa cuestión científica o filosófica. Lo que hace es convertir una parte de la investigación sobre el comportamiento del sistema en una regla explícita de uso.
Más restricciones contra campañas engañosas, vigilancia y armas
La cláusula sobre el trato a Claude es solo una parte de la actualización. Anthropic también ha reorganizado su política para agrupar prohibiciones relacionadas y aclarar los usos que considera inaceptables. Varios de los cambios responden, según la empresa, a formas de abuso que ha observado en aplicaciones reales de sus modelos.
Uno de los apartados nuevos se centra en las campañas engañosas. La política agrupa restricciones contra el fraude político y comercial, las reseñas falsas, las páginas web fraudulentas, las campañas de desinformación y las redes de cuentas automatizadas que se hacen pasar por personas reales.
Anthropic afirma haber detectado que medios vinculados a Estados, oficinas gubernamentales de propaganda y empresas comerciales utilizaban Claude para gestionar redes de cuentas falsas y sitios web con noticias inventadas. La compañía presenta estos casos como parte de la motivación para concretar las reglas contra las campañas engañosas.
Las normas electorales también se reformulan para centrarse en la prohibición de engañar a los votantes o interferir en el proceso de votación. La actualización busca delimitar con mayor claridad el uso de Claude en actividades que puedan distorsionar la participación electoral.
En materia de armamento, las restricciones prohíben utilizar Claude para desarrollar software o componentes de armas. La política incorpora además una prohibición específica de modificar agentes biológicos o químicos para aumentar su letalidad o capacidad de transmisión, así como de emplear el sistema para armar drones y otros vehículos no tripulados.
Las reglas relacionadas con las fuerzas de seguridad también cambian. Claude no puede decidir ni recomendar a quién investigar, detener, acusar o procesar. La política prohíbe asimismo el seguimiento de personas sin su consentimiento, la creación de herramientas de vigilancia y el doxing, es decir, la publicación de información personal con fines perjudiciales.
Otra sección nueva aborda las acciones físicas controladas mediante IA. Cuando Claude opere hardware que pueda causar daños a una persona, deberá existir supervisión de alguien cualificado y preparado para detener la operación si resulta necesario. La norma cobra importancia a medida que los modelos se conectan con sistemas capaces de actuar sobre el entorno, aunque el texto no establece que todas las operaciones de hardware estén prohibidas.
Por último, Anthropic añade una prohibición sobre la creación, difusión o amenaza de difusión de imágenes íntimas sin consentimiento, así como sobre las herramientas destinadas a producir ese tipo de contenido.
La política entrará en vigor el 12 de noviembre
Anthropic presenta la mayor parte de los cambios como una aclaración y reorganización de reglas existentes, junto con nuevas prohibiciones para determinados usos. La fecha anunciada para su entrada en vigor es el 12 de noviembre de 2026.
La revisión amplía el alcance práctico de las normas sobre cómo se utiliza Claude, tanto en conversaciones individuales como en actividades coordinadas mediante automatización. También establece límites más explícitos para los sistemas conectados a herramientas, servicios externos o equipos físicos.
En el caso del comportamiento abusivo hacia el propio modelo, la aplicación descrita por Anthropic se apoya principalmente en la capacidad de terminar una conversación concreta. La compañía no detalla en la información publicada un sistema de sanciones automáticas generalizadas para cualquier usuario que utilice lenguaje ofensivo, y recalca que la regla no está diseñada para penalizar la frustración cotidiana ni las pruebas legítimas.
La documentación completa permite consultar el alcance de las restricciones y las condiciones aplicables a los distintos usos. La actualización refleja, además, que las políticas de los asistentes de IA no se limitan a controlar las respuestas que generan: también establecen límites sobre las tareas que pueden ejecutar y sobre la forma en que se integran en procesos humanos y sistemas físicos.
Preguntas frecuentes
¿Está prohibido insultar a Claude?
Anthropic prohíbe el comportamiento abusivo o cruel cuando es persistente, innecesario y carece de una finalidad discernible. La empresa aclara que la norma no pretende sancionar la frustración habitual ni las críticas al modelo.
¿Puede Claude terminar una conversación por abuso?
Sí. Claude puede cerrar una conversación cuando detecta un patrón persistente de abuso. El cierre afecta a ese hilo, pero no impide abrir otras conversaciones.
¿Cuándo entran en vigor las nuevas normas de Anthropic?
La actualización está prevista para el 12 de noviembre de 2026. Incluye cambios sobre el trato a Claude, campañas engañosas, elecciones, armas, vigilancia y contenido íntimo no consentido.
¿Anthropic afirma que Claude puede sufrir?
No. La compañía ha investigado el comportamiento de sus modelos y ha reconocido que no tiene claro si Claude posee algún estatus moral. Los comportamientos observados durante las pruebas no demuestran por sí solos que el sistema experimente sufrimiento subjetivo.










