Anthropic presenta su primer modelo de IA al que somete a medidas de seguridad exhaustivas

0

Por Francisco Bracero OsunaPortada

Anthropic presenta su primer modelo de IA al que somete a medidas de seguridad exhaustivas

Inteligencia artificial

Claude Opus 5.5 es el primer lanzamiento de la compañía desde que su director ejecutivo, Dario Amodei, reclamó frenar el ritmo de producción de la IA, preocupado por los incidentes de seguridad

Una página de la web de Anthropìcc

Una página de la web de Anthropìcc

Patrick Sison / Ap-LaPresse

Francisco Bracero Osuna

Francesc Bracero

Barcelona

22/09/2026 18:29 Síguenos en Google 0:00 0:00 0.5x 0.8x 1x 1.2x 1.5x SUSCRÍBETE PARA ESCUCHAR El audio de esta noticia está generado mediante Inteligencia Artificial

Anthropic ha lanzado un nuevo modelo de IA de vanguardia, Claude Opus 5.5, cuando no han pasado ni dos semanas desde que Dario Amodei, su director ejecutivo, reclamó ralentizar el ritmo de lanzamientos de nuevos modelos, después de los incidentes de seguridad reportados por algunas compañías, incluida la suya, en la que un investigador dimitió alarmado por la convicción de que la tecnología podría acabar con los seres humanos en unos pocos años. La compañía ha explicado que esta inteligencia artificial ha sido sometida al criterio de “anteponer las prácticas de seguridad a las capacidades del modelo”.

Claude Opus 5.5 ha sido sometido a “pruebas exhaustivas de alineación, evaluación previa al lanzamiento por parte de organizaciones externas y medidas de seguridad para áreas de alto riesgo como la ciberseguridad y la biología”. Se trata, según un comunicado de la compañía, de un modelo que ha respondido de forma positiva a tests como el razonamiento sesgado o los intentos de escapar de un entorno aislado. Es el modelo “con mejor rendimiento que hemos probado hasta la fecha, con mejoras notables en varios de los comportamientos que contribuyeron a recientes incidentes de ciberseguridad”, señala Anthropic.

La forma en la que funcionan estas barreras de seguridad es mediante el desvío a otros modelos más probados de cualquier solicitud que haga saltar las alarmas. De este modo, “cuando las medidas de seguridad intervienen, las solicitudes se redirigen de forma transparente a otro modelo”. En el ámbito de la ciberseguridad, la mayoría de las tareas de ciberseguridad se redirigirán a Opus 4.8, mientras que la de biología y de desarrollo de grandes modelos de lenguaje de IA de vanguardia se redirigirán a Opus 5.

Anthropic ha explicado que está “ endureciendo los criterios de filtrado de los entornos utilizados en el aprendizaje por refuerzo, ya que los entornos defectuosos son una fuente importante de comportamientos desalineados”. “También estamos mejorando –ha añadido– nuestras recompensas de alineación, creando métodos automatizados para generar nuevos escenarios de entrenamiento de seguridad y reforzando nuestra seguridad y supervisión”.

La compañía que dirige Dario Amodei considera que, en materia de seguridad, debe ponerse “un listón más alto para modelos más capaces”. “Los modelos que pudieran automatizar por completo la propia investigación en IA deberían cumplir un estándar de seguridad más elevado y, a medida que la IA se vuelve más capaz, las políticas públicas deberían desempeñar un papel más importante a la hora de garantizar que estos sistemas sean seguros”, afirma Anthropic, que ha llegado a un acuerdo con la consultora Accenture para poner en marcha una infraestructura necesaria para ese refuerzo de seguridad.

Lee también

El director ejecutivo de Anthropic pide frenar la carrera de la IA: “Debemos bajar el ritmo antes de perder el control”

El director ejecutivo de Anthropic pide frenar la carrera de la IA: “Debemos bajar el ritmo antes de perder el control”

Francesc Peirón

Sam Altman: “Podríamos perder el control del futuro ante la IA”

Sam Altman: “Podríamos perder el control del futuro ante la IA”

Francesc Bracero

Opus 5.5 “está diseñado para las tareas complejas que nuestros clientes empresariales de sectores como los servicios financieros, el ámbito jurídico y el software llevan a cabo a diario”, ha apuntado Anthropic. Su eficiencia le lleva a un ahorro en forma de reducción sensible de los precios, ya que cuesta aproximadamente un 40% menos que Claude Opus 5. La compañía indica que el modelo “se comunica de forma más natural que los modelos anteriores; los primeros probadores han señalado que su redacción es más clara y fácil de seguir, lo que lo convierte en un mejor compañero de trabajo durante sesiones prolongadas”.

Francisco Bracero Osuna

Francesc Bracero

Ver más artículos

Licenciado en Periodismo por la UAB. Redactor de La Vanguardia desde 1996. Ha cubierto las áreas de Política, Deportes y Comunicación. Especializado en tecnología. Autor del libro ‘Bicicletas para la mente’ (Península)

Etiquetas

Mostrar comentarios

Fonte: Portada

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *