La empresa estadounidense de inteligencia artificial Anthropic, creadora del modelo Claude, ha anunciado este jueves que comenzará a informar a los usuarios cuando sus solicitudes sean rechazadas o degradadas por los filtros de seguridad del sistema. La medida responde a las críticas sobre restricciones ocultas en la moderación de contenido y a la creciente presión regulatoria en el sector, en un contexto de preocupaciones de seguridad nacional en Estados Unidos.

Anthropic, competidora de OpenAI, ha explicado en un comunicado que la nueva política busca «ofrecer mayor claridad sobre cómo funcionan los filtros de seguridad» de sus modelos de lenguaje. La compañía señaló que «los usuarios tienen derecho a saber cuándo y por qué se limita una respuesta», en alusión a las quejas de desarrolladores e investigadores que denunciaban barreras opacas al conocimiento.

La decisión se produce en un momento en que Washington intensifica el escrutinio sobre la industria de la IA, tanto por posibles sesgos como por riesgos de seguridad nacional. El anuncio de Anthropic se enmarca en un esfuerzo del sector por adelantarse a una regulación federal que el Congreso debate desde principios de año. La empresa no ha detallado el calendario exacto de implantación ni si la transparencia se aplicará a todos sus modelos por igual. No obstante, fuentes de la compañía confirmaron a medios locales que la función estará operativa en las próximas semanas.

La medida supone un paso hacia una mayor rendición de cuentas en un sector donde la opacidad de los sistemas de moderación ha generado controversia. Anthropic, valorada en más de 18.000 millones de dólares (unos 16.500 millones de euros), ha sido una de las voces más activas en pedir una regulación equilibrada que no frene la innovación pero garantice la seguridad de los usuarios. Con este anuncio, la empresa busca fortalecer la confianza de desarrolladores y usuarios, en un entorno donde la transparencia se ha convertido en un requisito casi indispensable para operar.