La empresa de inteligencia artificial Anthropic ha anunciado el lanzamiento de Claude Opus 4.8, un nuevo modelo que pone el acento en la honestidad del sistema a la hora de reconocer sus propios errores. El lanzamiento, previsto para este jueves, busca abordar uno de los problemas recurrentes en los grandes modelos de lenguaje: la tendencia a «alucinar» o a ofrecer respuestas sin base suficiente.
Según explicó la compañía en un comunicado, Anthropic entrena a todos sus modelos para ser honestos, «por ejemplo, para evitar hacer afirmaciones que no puedan respaldar». Sin embargo, reconocen que «un problema general de los modelos de IA es que a veces saltan a conclusiones». Con Claude Opus 4.8, la empresa afirma haber mejorado la capacidad del modelo para identificar cuándo no está seguro de una respuesta y expresarlo de forma clara.
El anuncio se produce en un contexto de creciente regulación en torno a la inteligencia artificial, tanto en la Unión Europea como en otras regiones. La transparencia en los fallos de los modelos puede convertirse en un factor diferenciador en la competencia con otros actores geopolíticos, especialmente en un mercado donde la confianza del usuario es un activo crítico. Anthropic, con sede en San Francisco, compite directamente con OpenAI, Google y otras empresas en la carrera por los modelos frontera.
El modelo Claude Opus 4.8 estará disponible a partir del jueves para los usuarios a través de la API y las aplicaciones de la compañía. La empresa no ha detallado el tamaño del modelo ni los métodos concretos de entrenamiento, pero ha indicado que estas mejoras en honestidad son parte de una estrategia más amplia para alinear el comportamiento de los sistemas de IA con los valores humanos.




