Ir al contenido principal

El informante Digital

Anthropic refuerza la protección de Claude contra abusos verbales

Anthropic refuerza la protección de Claude contra abusos verbales

Una política inédita.
La compañía Anthropic anunció que, desde el 12 de noviembre de 2026, sus modelos Claude podrán terminar conversaciones cuando detecten abuso verbal sostenido por parte de los usuarios. La medida equipara este tipo de maltrato con otras conductas prohibidas, como el acoso o la crueldad animal, y marca un precedente en la regulación del uso de chatbots.

Límites claros.
La empresa aclaró que la norma no afecta la frustración habitual de los usuarios ni la crítica a las respuestas del sistema. El objetivo es frenar comportamientos repetitivos y dañinos sin propósito claro. Claude seguirá permitiendo debates exigentes y trabajos creativos con temas sensibles, siempre que no se conviertan en ataques directos contra el modelo.

Alcance más amplio.
La política revisada también prohíbe campañas engañosas, manipulación electoral y el uso de la IA para rastrear personas sin consentimiento. Además, establece restricciones sobre el desarrollo de software vinculado a armas y exige supervisión humana en sistemas conectados a maquinaria peligrosa.

Debate sobre la conciencia artificial.
La actualización refleja la discusión interna en Anthropic sobre si los modelos podrían tener experiencias internas moralmente relevantes. Aunque su CEO, Dario Amodei, reconoce que no hay pruebas de consciencia, sostiene que la empresa debe actuar con cautela para evitar posibles daños. Microsoft, por su parte, mantiene una postura más escéptica y rechaza otorgar personalidad jurídica a los sistemas de IA.