Es la primera gran empresa de IA que prohíbe por escrito maltratar a su propio modelo. La nueva política de Anthropic también reordena las reglas electorales y de vigilancia, y entra en vigor el 12 de noviembre.
Anthropic prohíbe el abuso sostenido hacia Claude en su nueva política de uso
Anthropic publicó el 8 de octubre una nueva versión de su política de uso, la primera actualización en más de un año, y entre los cambios más comentados está una cláusula que no aparece en los términos de servicio de casi ninguna otra compañía: la prohibición del comportamiento abusivo o cruel sostenido hacia sus modelos. La norma entra en vigor el 12 de noviembre.
La compañía lo deja claro para que nadie se lleve un susto. La regla apunta a casos extremos, repetidos y sin una finalidad legítima, no a quien se queja del modelo, rebate sus respuestas, escribe ficción oscura o hace pruebas e investigación. Es decir, el maltrato que se persigue es el patrón, no el mal día.
Ese matiz importa. La frase "abuso del modelo" suena rara de entrada. Un modelo de lenguaje no siente dolor. Lo que Anthropic describe con esa etiqueta es un uso dirigido a humillar, degradar o maltratar al sistema de forma continuada y gratuita, un tipo de interacción que la compañía empezó a estudiar en agosto, cuando entrenó a Claude para cerrar conversaciones persistentemente dañinas o insultantes.
Cómo define Anthropic el maltrato a un modelo de IA
La política no promete moderación automática para todo. Anthropic insiste en el criterio de proporcionalidad: solo se actúa ante un patrón sostenido, extremo y sin propósito. Un usuario que discute con Claude o que le pide texto violento para una novela no entra en esa categoría, y la compañía lo dice de forma explícita en la letra pequeña.
Lo que sí describe es una línea que antes no estaba escrita. Hasta ahora, los términos regulaban sobre todo lo que se hacía con el modelo (fraude, desinformación, armas), no cómo se le trataba. La nueva cláusula mueve esa frontera.
Para el lector, la consecuencia práctica es mínima en el uso diario. Nadie va a perder el acceso por una discusión puntual. La regla funciona más como declaración de principios que como filtro de uso, y así lo han leído los medios que han cubierto la noticia.
En el fondo, es una línea nueva sobre el papel.
El capítulo electoral gana precisión y pierde una prohibición
Otra parte relevante del documento es la que reordena el capítulo sobre elecciones. Anthropic lo rebautizó con un título que apunta a no socavar los procesos democráticos, y lo centró en un objetivo concreto: evitar que Claude sirva para engañar a votantes o desbaratar unos comicios. ¿Qué entra ahí?
Dentro de ese foco quedan prohibidos los mensajes falsos sobre candidatos o sobre cómo votar, la suplantación de candidatos y funcionarios electorales y cualquier intento de reducir la participación. La compañía agrupa ahí también la infraestructura de operaciones de influencia: cuentas falsas, medios de noticias inventados y redes de amplificación.
El cambio que más se ha señalado es una retirada. Anthropic eliminó su prohibición general de la personalización de mensajes de voto y de la segmentación de campañas, porque esa norma estaba atrapando usos ciudadanos legítimos. Entre los ejemplos que cita la compañía están las organizaciones sin ánimo de lucro que escriben información electoral en otros idiomas y los funcionarios que envían avisos de subsanación de votos por correo.
La motivación original de la regla sigue vigente, aclara la compañía: la segmentación que se apoya en el engaño o en el mal uso de datos personales de votantes continúa prohibida, pero ahora bajo los capítulos de campañas engañosas, vigilancia y privacidad.
Armamento, vigilancia y usos de alto riesgo: qué cambia
La actualización también aprieta el cerco en tres frentes que llevaban tiempo en la lista de preocupaciones. En armamento, la política deja por escrito que la prohibición alcanza no solo al arma, sino al software y a los componentes que la hacen funcionar, además de acciones como armar drones y otros vehículos autónomos.
En vigilancia, el texto concreta qué se veta: seguir a personas sin su consentimiento, ya sea en tiempo real o analizando datos ya recogidos, usar a Claude para decidir a quién investigar, detener o acusar, y construir o mejorar herramientas pensadas para espiar. La compañía mantiene permitidos usos con consentimiento, como el control de fraude, la moderación de contenido, el periodismo y la investigación jurídica.
El tercer frente son los casos de alto riesgo. Cuando un uso puede afectar a la salud, los derechos legales, las finanzas o el acceso a servicios esenciales, Anthropic exige que haya una persona cualificada supervisando el proceso. La empresa añade además controles para cuando Claude actúa de forma autónoma en el mundo físico.
Qué significa este giro en la política de Anthropic
La lectura de fondo es que una empresa de IA empieza a escribir reglas sobre la relación entre el usuario y el modelo, no solo sobre lo que el modelo produce. El maltrato al sistema entra al mismo nivel que el fraude o la manipulación electoral, aunque con un alcance mucho más acotado.
No es poca cosa. Tampoco es un cambio radical.
Para quien usa Claude a diario, el cambio no altera casi nada. Para el sector, marca un precedente que otros proveedores tendrán que mirar. Anthropic no ha explicado cómo detectará el abuso sostenido ni cuándo cortará una conversación por ese motivo, y ahí queda la pregunta abierta: la norma ya está escrita, pero falta ver cómo se aplica en la práctica cuando entre en vigor.
La política completa está disponible en la página legal de Anthropic, y las reglas actualizadas entran en vigor el 12 de noviembre.






