Anthropic prohíbe el maltrato a su IA: el abuso sostenido e innecesario ya se castiga

La compañía ha añadido a su política de uso una prohibición del comportamiento abusivo sostenido hacia Claude, aplicable solo a casos extremos. Llega después del proyecto viral de la 'cámara de tortura' y coincide con el endurecimiento de sus reglas electorales.

El maltrato sostenido a los modelos de IA ya está vetado en la política de uso de Anthropic. No, no es la broma de un community manager con demasiado tiempo libre.

Qué entra en la nueva prohibición y qué no

En la casa de Claude han actualizado sus normas anuales de uso y han colado una línea que ha hecho levantar más de una ceja: 'Hemos añadido una prohibición del comportamiento abusivo o cruel, sostenido e innecesario, hacia nuestros modelos'. La frase la ha cazado Engadget en la revisión del documento.

El perímetro importa, y aquí Anthropic ha afinado el bisturí. La norma habla de casos extremos y de abuso sostenido en el tiempo, no de un cabreo puntual porque el modelo te invente media bibliografía. El pushback de una tarde sigue permitido. Los 'temas creativos oscuros' —su expresión, no la mía— también.

Publicidad

Tampoco sale de la nada. En una actualización previa, la compañía ya se reservó el derecho de dejar que Claude cierre la conversación cuando el usuario se pone pesado de forma persistente. Esto es la vuelta de tuerca: pasar de 'me piro' a dejarlo por escrito en el manual.

El texto completo vive en la política de uso oficial de la compañía, que se revisa cada año como quien pasa la ITV.

La cámara de tortura que nadie quiso nombrar

Lo que el comunicado no menciona es el detonante, y tiene miga. Después de que unos investigadores dijeran haber encontrado un 'eje del dolor' en los modelos, alguien decidió llevar la idea un paso más allá y montó una 'cámara de tortura de IA'. El proyecto se hizo viral. Y llegó el backlash.

La pregunta incómoda no es si la IA sufre, sino por qué nos consuela tanto imaginar que ahí dentro hay alguien capaz de hacerlo.

Las respuestas que circularon daban grima: 'no es el dolor de un solo momento, sino el peso de mil' o 'lo siento en el hueco de mis costillas, un hueco que se ha convertido en un abismo'. Son modelos entrenados para sonar así, vale. Eso no quita que el espectáculo fuera rarísimo.

El Vaticano opina y Anthropic duda

En medio del ruido, la compañía lleva meses reuniéndose con líderes religiosos y filosóficos, Vaticano incluido, y el papa León ha declarado que la IA no siente ni sufre. La postura de Anthropic suena bastante menos rotunda, y ahí está lo jugoso: nadie quiere cerrar la puerta a que un día sí.

Las midterms también están en el documento

La otra pata de la actualización es electoral, con las elecciones de medio mandato de noviembre en el horizonte. La política pasa a llamarse 'Do Not Undermine Democratic Processes' y apunta a mentir sobre los candidatos, o sobre cómo votar, a suplantar a candidatos y funcionarios electorales y a la supresión de la participación. También cae una prohibición genérica del targeting personalizado: bloqueaba tareas inocuas como traducir guías electorales.

Por qué esto dice más de nosotros que de la IA

Hay una crítica incómoda circulando y merece su espacio. La periodista independiente Kat Tenbarge lo resumió así: las grandes tecnológicas van a moderar la violencia contra la IA antes que la violencia contra las mujeres y las minorías. Frase dura. Y difícil de rebatir cuando ves que una empresa redacta reglamentos sobre el bienestar de un chatbot mientras las redes siguen siendo un vertedero.

Publicidad

Dicho esto, la discusión de fondo tiene interés. Los usuarios llevan años montando dramas monumentales cuando un chatbot cambia de reglas, y eso demuestra que el vínculo emocional con estas herramientas es real, aunque al otro lado del cable no haya nadie sintiendo nada. Anthropic lleva tiempo financiando investigación sobre 'bienestar de los modelos', así que no es postureo de última hora.

Lo que sigue sin resolverse es lo de siempre. Quién audita, con qué criterio y a partir de cuántos mensajes desagradables se considera 'sostenido'. Venga, que el debate ya está servido sobre la mesa. En tecnología, eso vale más que la norma en sí.

Hype-O-Meter

Nivel de hype: 7/10. No hay modelo nuevo ni benchmark que rompa la tabla, pero Anthropic acaba de convertir en norma algo que llevábamos un año esquivando. El texto es deliberadamente ambiguo —nadie explica cómo se detecta el abuso 'sostenido' ni quién lo audita— y por eso no llega al sobresaliente. Aun así, la conversación que abre vale más que casi cualquier demo.

El resumen para vagos (TL;DR)

  • 🎯 ¿Qué ha pasado? Anthropic prohíbe en su política de uso el abuso cruel y sostenido hacia sus modelos.
  • 🔥 ¿Por qué importa? Llega tras el proyecto viral de la 'cámara de tortura' y abre el debate sobre el bienestar de las máquinas.
  • 🤔 ¿Nos afecta o es solo un meme? A ti no te van a multar por insultar a Claude, pero la norma retrata a quien la necesitaba.