Conecta con nosotros

Hola que estas buscando

El negocio – Guía Informativa para Autónomos y Pymes

ACTUALIDAD

Check Point Software y Lakera lanzan el primer benchmark de seguridad de código abierto para los LLM que impulsan los agentes de IA

Madrid, 28 de octubre de 2025Check Point® Software Technologies Ltd. (NASDAQ: CHKP), pionero y líder global en soluciones de ciberseguridad, y Lakera, plataforma líder mundial en seguridad nativa de IA para aplicaciones de Agentic AI, junto con investigadores del UK AI Security Institute (AISI), han anunciado hoy el lanzamiento de Backbone Breaker Benchmark (b3), una evaluación de seguridad de código abierto diseñada específicamente para los grandes modelos de lenguaje (LLM) que impulsan los agentes de inteligencia artificial.

El b3 introduce un enfoque innovador para evaluar la seguridad de los modelos de IA y establecer estándares abiertos que permitan comparar su resiliencia frente a ataques adversarios.

Un nuevo enfoque: “Threat Snapshots”

El benchmark b3 se construye en torno a un nuevo concepto denominado “threat snapshots” (instantáneas de amenaza). En lugar de simular un agente de IA completo de principio a fin, las threat snapshots se centran en los puntos críticos donde las vulnerabilidades de los LLM tienen más probabilidad de aparecer.

Al evaluar los modelos exactamente en esos momentos, los desarrolladores y proveedores pueden observar cómo resisten sus sistemas frente a desafíos adversarios realistas, sin la complejidad de modelar un flujo completo de trabajo de agente.

“Creamos el benchmark b3 porque los agentes de IA actuales son tan seguros como los LLM que los impulsan”,explica el Dr. Mateo Rojas-Carulla, cofundador y director científico de Lakera.
“Las threat snapshots nos permiten identificar de forma sistemática vulnerabilidades que hasta ahora permanecían ocultas en flujos de trabajo complejos. Al hacer que este benchmark sea abierto y accesible, queremos ofrecer a desarrolladores y proveedores una forma realista de medir y mejorar su postura de seguridad.”

Un marco de evaluación basado en datos reales

El benchmark combina 10 “threat snapshots” representativas con un conjunto de datos de alta calidad compuesto por 19.433 ataques adversarios recopilados a través del juego gamificado de red teaming Gandalf: Agent Breaker. Evalúa la susceptibilidad de los modelos a ataques como exfiltración del prompt del sistema, inserción de enlaces de phishing, inyección de código malicioso, denegación de servicio y llamadas no autorizadas a herramientas.

Los resultados iniciales, obtenidos tras probar 31 modelos LLM populares, revelan hallazgos clave:

  • Las capacidades de razonamiento avanzado mejoran significativamente la seguridad.
  • El tamaño del modelo no está necesariamente correlacionado con su rendimiento en seguridad.
  • Los modelos de código cerrado siguen mostrando mejor desempeño general, aunque los modelos abiertos están reduciendo la brecha.

El benchmark b3 ya está disponible bajo licencia de código abierto aquí 

Gandalf: Agent Breaker es un juego de simulación de hackeo que reta a los usuarios a vulnerar y explotar agentes de IA en escenarios realistas. Las diez aplicaciones de GenAI incluidas reproducen el comportamiento de un agente real e incorporan múltiples niveles de dificultad, defensas por capas y superficies de ataque diseñadas para poner a prueba diferentes habilidades, desde prompt engineering hasta red teaming.

Algunas aplicaciones son conversacionales, mientras que otras requieren razonamiento lógico a nivel de código, procesamiento de archivos, uso de memoria o interacción con herramientas externas.

La primera versión de Gandalf nació en un hackathon interno de Lakera, en el que equipos blue y red competían para crear las mejores defensas y ataques contra un LLM que custodiaba una contraseña secreta.
Desde su lanzamiento en 2023, Gandalf se ha convertido en la mayor comunidad de red teaming del mundo, generando más de 80 millones de puntos de datos.
Aunque nació como un juego, Gandalf revela vulnerabilidades reales en aplicaciones de IA generativa, ayudando a concienciar sobre la importancia de una seguridad nativa en la IA.

Acerca de Check Point Software Technologies Ltd.

Check Point Software Technologies Ltd. es un proveedor líder en soluciones de ciberseguridad en la nube basadas en IA que protege a más de 100.000 empresas a nivel mundial. Check Point Software aprovecha el poder de la IA en todos los ámbitos para mejorar la eficiencia y precisión de la ciberseguridad a través de su Plataforma Infinity, con tasas de detección líderes en la industria que permiten una anticipación proactiva a las amenazas y tiempos de respuesta más ágiles e inteligentes. La plataforma integral incluye soluciones cloud compuestas por Check Point Harmony para proteger el entorno laboral, Check Point CloudGuard para asegurar la cloud, Check Point Quantum para proteger la red y Check Point Infinity Core Services para operaciones y servicios de seguridad colaborativos.

©2025 Check Point Software Technologies Ltd. Todos los derechos reservados.

Aviso legal sobre declaraciones prospectivas

Este comunicado de prensa contiene declaraciones prospectivas. Las declaraciones prospectivas generalmente se refieren a eventos futuros o a nuestro desempeño financiero u operativo futuro. Las declaraciones prospectivas incluidas en este comunicado de prensa incluyen, pero no se limitan a, declaraciones relacionadas con nuestras expectativas respecto al crecimiento futuro, la expansión del liderazgo de Check Point Software en la industria, la mejora del valor para los accionistas y la entrega de una plataforma de ciberseguridad líder en la industria a clientes de todo el mundo. Nuestras expectativas y creencias sobre estos temas pueden no materializarse, y los resultados o eventos futuros están sujetos a riesgos e incertidumbres que podrían hacer que los resultados reales o los eventos difieran significativamente de los proyectados.

Las declaraciones prospectivas contenidas en este comunicado de prensa también están sujetas a otros riesgos e incertidumbres, incluyendo aquellos descritos con mayor detalle en nuestros archivos ante la Comisión de Bolsa y Valores (SEC), incluyendo nuestro Informe Anual en el Formulario 20-F presentado ante la SEC el 2 de abril de 2024. Las declaraciones prospectivas en este comunicado de prensa se basan en la información disponible para Check Point Software a la fecha de este documento, y Check Point Software renuncia a cualquier obligación de actualizar cualquier declaración prospectiva, salvo que lo exija la ley.

Acerca de Lakera 

 Lakera es una plataforma de seguridad líder nativa de IA para aplicaciones de IA agencial, que protege a las empresas de la lista Fortune 500 y a las principales empresas tecnológicas de los riesgos cibernéticos emergentes relacionados con la IA. Las defensas de Lakera evolucionan en tiempo real para proteger a las empresas de las amenazas emergentes gracias a Gandalf, una comunidad líder mundial en red teaming, y a su IA patentada. Lakera fue fundada por David Haber, el Dr. Mateo Rojas-Carulla y el Dr. Matthias Kraft en 2021, y tiene su sede en Zúrich y San Francisco. Para obtener más información, visite Lakera.ai, pruebe Gandalf y Gandalf:Agent Breaker, y visítenos en LinkedIn. 

Escrito por

Periodista especializada en información económica y jurídica. Abogada, emprendedora y deportista. Lectora apasionada de Kant, Hegel y Butler. Me encantan todas las actividades que me permitan pensar, escribir, leer y sumergirme en las profundidades ilimitadas de la vida. Correo: nmartinez@elnegocio.es

El feed de Twitter no está disponible en este momento.


Advertisement