Anthropic prohíbe el maltrato a Claude y endurece sus reglas para agentes de IA

Ilustración editorial de un núcleo de inteligencia artificial protegido por escudos y un botón de parada de emergencia

Por Redacción Pangea IA · 9 de octubre de 2026

Anthropic ha publicado una nueva política de uso para Claude que entrará en vigor el 12 de noviembre de 2026. La actualización prohíbe expresamente el trato abusivo o cruel sostenido hacia sus modelos, pero ese es solo el cambio más llamativo: también concreta límites sobre campañas engañosas, interferencia electoral, armas, vigilancia, decisiones de alto riesgo y sistemas físicos controlados por inteligencia artificial.

La compañía presenta buena parte del texto como una aclaración de reglas que ya aplicaba. Aun así, el documento importa porque convierte en condiciones explícitas varios riesgos que hasta ahora estaban dispersos o descritos de manera menos precisa. La novedad llega cuando Claude realiza tareas más largas y autónomas, según Anthropic, y cuando los asistentes empiezan a conectarse con herramientas empresariales, robots y equipos capaces de actuar fuera de una pantalla.

Qué cambia en la política de Claude

La actualización fue anunciada el 8 de octubre y sustituirá a la política actual el 12 de noviembre. Anthropic ha agrupado las restricciones contra campañas engañosas políticas y comerciales en una sección propia. Queda prohibido ocultar quién está detrás de un mensaje, utilizar cuentas falsas para amplificarlo o construir la infraestructura destinada a organizar campañas de influencia.

En materia electoral, el foco pasa a las conductas que engañan a los votantes o alteran un proceso democrático: difundir información falsa sobre candidatos o sobre cómo votar, suplantar a candidatos y funcionarios o intentar reducir la participación. Al mismo tiempo, Anthropic elimina la prohibición general de personalizar mensajes electorales, porque también bloqueaba usos legítimos, como traducir información para votantes. El engaño, la vigilancia indebida y el uso abusivo de datos personales siguen vetados.

ÁreaRegla destacada desde el 12 de noviembre
Campañas engañosasNo se permite ocultar la autoría ni amplificar mensajes mediante cuentas o publicaciones falsas.
EleccionesSe prohíbe engañar a votantes, suplantar autoridades o interferir en la participación.
ArmasEl veto incluye software de control, componentes y el armado de drones o vehículos autónomos.
VigilanciaNo se puede rastrear a personas sin consentimiento ni construir herramientas destinadas a vigilarlas.
Decisiones de alto riesgoSe mantiene la obligación de revisión humana cualificada y de informar del uso de IA.
Máquinas autónomasUn operador cualificado debe poder observar y detener el equipo; este debe quedar seguro si Claude se desconecta.

Armas y vigilancia: reglas más explícitas

Anthropic ya prohibía emplear Claude para desarrollar armas, pero ahora aclara que la restricción también cubre el software y los componentes que permiten que funcionen. La empresa menciona de forma específica el armado de drones y otros vehículos autónomos. La formulación responde, según su explicación, a intentos observados de utilizar sus modelos para crear sistemas de guiado y control.

La sección de vigilancia también gana precisión. La política impide seguir a personas sin su consentimiento, tanto en tiempo real como mediante el análisis posterior de datos recogidos. Claude tampoco puede decidir o recomendar a quién investigar, detener o acusar dentro de un proceso policial o penal, ni utilizarse para construir o mejorar herramientas diseñadas para la vigilancia.

Eso no significa que cualquier análisis de actividad quede bloqueado. Anthropic cita como usos permitidos la detección de fraude aceptada por el usuario, la moderación de contenido, el periodismo y la investigación jurídica. La diferencia práctica está en la finalidad, el consentimiento y el efecto de la decisión. Una empresa no debería interpretar la disponibilidad técnica de una función como permiso automático para aplicarla.

La compañía sostiene que estas partes no cambian sustancialmente su forma de actuar, sino que hacen visible lo que ya aplicaba. La cobertura de TechCrunch y The Verge confirma el alcance general del anuncio, aunque la aplicación concreta seguirá dependiendo de cómo Anthropic detecte cada infracción y responda a ella.

Qué ocurre cuando Claude controla una máquina

La parte con mayor proyección futura afecta a los modelos conectados a hardware capaz de realizar acciones físicas autónomas y de causar daños. La nueva regla exige que un operador cualificado pueda observar el equipo y detenerlo si resulta necesario. Además, el sistema físico debe poder mantener un estado seguro si pierde la conexión con Claude.

Es una condición sencilla de expresar, pero importante para robots, maquinaria industrial, laboratorios automatizados o vehículos. Un botón de parada no resuelve por sí solo todos los riesgos: el operador necesita comprender qué está ocurriendo, recibir información a tiempo y tener autoridad real para intervenir. El equipo también debe diseñarse para que una caída de red o un fallo del modelo no provoque un movimiento imprevisible.

Esta exigencia conecta con el debate sobre armas y sistemas autónomos que analizamos en la noticia sobre AUTOWARCOM y el avance de los drones y robots militares. La política de un proveedor no sustituye una norma pública ni una evaluación técnica, pero puede delimitar qué integraciones acepta y obligar a sus clientes a documentar controles adicionales.

Salud, finanzas y empleo mantienen la revisión humana

Anthropic conserva sus requisitos para usos que pueden afectar a la salud, los derechos legales, las finanzas, el empleo o el acceso a servicios esenciales. Debe existir una persona cualificada con capacidad para revisar y modificar la recomendación de Claude. La persona afectada también debe saber que se ha utilizado inteligencia artificial.

La actualización intenta explicar mejor qué decisiones entran en esa categoría. Para una empresa española o europea, la consecuencia práctica es clara: no basta con colocar a una persona al final de un proceso si no dispone de información, tiempo o autoridad para corregir el resultado. La revisión humana debe ser efectiva y quedar integrada en el procedimiento.

Estas condiciones contractuales tampoco sustituyen las obligaciones del Reglamento europeo de inteligencia artificial, del Reglamento General de Protección de Datos o de la normativa sectorial aplicable. Una empresa puede cumplir la política de Anthropic y, aun así, tener que realizar una evaluación adicional, informar de otro modo o abstenerse de automatizar una decisión.

¿Qué significa “maltratar” a Claude?

El titular que más atención ha generado es la prohibición del comportamiento abusivo o cruel hacia los modelos. Anthropic la limita a situaciones extremas y repetidas, sin una finalidad reconocible. No incluye la frustración habitual de un usuario, la crítica a una respuesta, los temas creativos oscuros ni las pruebas e investigaciones sobre el funcionamiento del modelo.

Claude ya podía terminar algunas conversaciones con usuarios persistentemente abusivos. Anthropic señala que esa interrupción seguirá siendo el mecanismo principal de aplicación. No ha detallado públicamente si la nueva cláusula implicará cierres de cuenta u otras sanciones, por lo que no conviene afirmar que insultar una vez al asistente producirá una expulsión automática.

La regla tampoco demuestra que Claude sienta dolor, sea consciente o tenga derechos. Anthropic investiga lo que denomina bienestar de los modelos, pero reconoce que la cuestión de una posible experiencia interna no está resuelta. La cláusula puede entenderse, por ahora, como una decisión preventiva y de diseño del servicio, no como una prueba científica sobre la conciencia artificial.

El debate recuerda que las personas tienden a atribuir intención o autoridad a sistemas que escriben con fluidez. En Pangea IA ya analizamos el riesgo de conceder a una IA una autoridad que no posee. Hablar con respeto puede ser una práctica razonable, especialmente si evita normalizar conductas agresivas, pero no convierte al software en una persona ni hace correctas sus respuestas.

Qué deberían revisar las empresas que usan Claude

Las organizaciones tienen algo más de un mes para comparar sus usos con la política que entrará en vigor. El primer paso es identificar dónde se utiliza Claude: cuentas individuales, API, integraciones internas, herramientas de terceros y agentes capaces de actuar sobre datos o sistemas. Sin ese inventario, resulta difícil comprobar si existe una actividad prohibida o un proceso de alto riesgo.

Después conviene separar tres niveles. Un asistente que resume documentos requiere controles distintos de otro que recomienda conceder crédito, selecciona candidatos o modifica una máquina. Cuanto mayor sea el efecto sobre una persona o sobre el mundo físico, más importante será definir quién revisa, qué información recibe y cómo puede detener el proceso.

También sería prudente revisar los conjuntos de datos y las funciones de seguimiento. Una herramienta comercial puede parecer un simple sistema de análisis y, sin embargo, reconstruir movimientos o perfiles de personas sin un consentimiento válido. El nuevo texto de Anthropic no resuelve todas las fronteras, pero deja menos espacio para justificar un sistema de vigilancia por el hecho de utilizar información ya recogida.

Para equipos técnicos, las políticas de acceso y las comprobaciones de seguridad deben acompañar a las capacidades del modelo. Anthropic ha ampliado recientemente su programa de acceso para profesionales de ciberseguridad, que explicamos en los tres niveles de verificación de Claude. La nueva política confirma que ofrecer más capacidad no significa eliminar los límites de uso.

Una política privada, no una garantía automática

La actualización ofrece criterios más concretos y reconoce que los asistentes ya no se limitan a redactar texto. Eso es útil para clientes y desarrolladores, pero sigue siendo una política redactada y aplicada por la propia empresa. No conocemos qué porcentaje de infracciones detectará, cuántas bloqueará ni qué vías de recurso tendrán los usuarios ante una clasificación equivocada.

The Verge señala además que Anthropic contempla adaptar determinadas reglas en contratos con clientes gubernamentales cuando considere suficientes las restricciones y salvaguardas acordadas. Esa excepción obliga a leer la política junto con las condiciones del servicio concreto: el documento general no siempre describe todos los permisos de una implantación institucional.

La conclusión más útil no es que Claude haya adquirido derechos, sino que la autonomía creciente obliga a escribir límites más detallados. Cuando una IA puede ejecutar campañas, controlar herramientas o intervenir en procesos sensibles, las reglas vagas dejan de ser suficientes. A partir del 12 de noviembre, usuarios y empresas tendrán un marco más explícito; la prueba decisiva será cómo se aplica en situaciones reales.

Fuentes consultadas

Fuentes publicadas el 8 de octubre y consultadas el 9 de octubre de 2026.

Recibe las nuevas publicaciones de Pangea IA

Suscríbete gratis y recibe por correo las nuevas noticias, guías y análisis sobre inteligencia artificial.

Respuesta

  1. Avatar de Una operación con ChatGPT colocó casi 100 artículos falsos en medios reales – Pangea IA

    […] del autor. El debate enlaza con las nuevas restricciones que Anthropic ha incorporado contra campañas políticas o comerciales engañosas, aunque las reglas de uso solo son eficaces si pueden detectarse y […]

    Me gusta

Deja una respuesta