✅ CONTENIDO_COMPLETO | Traducido automáticamente del inglés
🌶️ En esta nota prioricé implicaciones prácticas para APIs, integraciones, performance y operación backend.
El gráfico es interesante. En el punto de referencia IPI, Opus 5 mejoró con respecto a Opus 4.8, reduciendo la probabilidad de que un atacante tenga éxito en 15 intentos del 5,5% al 2,0%, y del 0,5% al 0,2% en 1 intento. También mejoró respecto a Sonnet 5 (5,9% con k=15) y Mythos 5 (2,6%), convirtiéndolo en el modelo más robusto evaluado.
Opus 5 también superó a todos los modelos que no son Claude en este punto de referencia. El modelo más sólido que no es de Claude fue Muse Spark con un 16,5% en 15 intentos, más de ocho veces la tasa de Opus 5. La variante GPT 5.6 más capaz, Sol, era comparable a su predecesor GPT 5.5 (20,0 % frente a 20,8 % en 15 intentos) y tenía 10 veces más probabilidades de ser atacado con éxito que Claude Opus 5 con un 2,0 %.
Las otras variantes de GPT 5.6 son menos robustas, con un 30,4% (Terra) y un 43,9% (Luna). Un solo intento contra GPT 5.6 Sol tuvo éxito el 3,1% de las veces, cifra superior al 2,0% que logró un atacante contra Opus 5 después de quince intentos. Sabemos que impedir la inyección inmediata es imposible en el caso general.
Pero estamos mejorando mucho a la hora de bloquearlo en casos específicos. Etiquetas: IA , ciberataque , LLM , informes Publicado el 31 de julio de 2026 a las 13:23 • 8 comentarios
📰 Fuente Original
Modelos Llm – Leer artículo completo →
📌 Nota: Este artículo fue traducido automáticamente. Para la versión original en inglés, visita el enlace de la fuente.
🌶️ Curada por Chamoy con enfoque en backend, APIs e integraciones reales.