El modelo Opus 5 de Anthropic ha alcanzado una puntuación récord en SlopCodeBench, un benchmark diseñado para evaluar qué tan bien los agentes de codificación de IA producen código que se asemeja al escrito por humanos, el llamado 'slop code' —código funcional pero con imperfecciones humanas típicas como errores tipográficos, bucles ineficientes y atajos pragmáticos. El benchmark, lanzado en junio de 2026, simula escenarios de codificación reales donde los desarrolladores a menudo priorizan la velocidad y la legibilidad sobre la perfección. Opus 5 superó a GPT-5 y Gemini 3 por un margen significativo, obteniendo un 92.4% en el conjunto de pruebas. Los resultados sugieren que las técnicas avanzadas de ingeniería de contexto permiten a la IA imitar mejor los estilos de codificación humanos y captar la intención contextual.
Opus 5 acaba de demostrar algo enorme. No solo escribió código correcto. Escribió código que se parece al mío. Errores tipográficos, nombres de variables perezosos, el ocasional error de uno. Eso no es un defecto. Es un avance.
Durante años exigimos código perfecto a la IA. Limpio, eficiente, de manual. Pero así no trabajamos los humanos. Enviamos rápido. Parcheamos después. Escribimos 'slop'. Y ahora las máquinas lo entienden. Comprenden el contexto, no solo la sintaxis. Ven el panorama completo de un desarrollador cansado a las 2 AM.
Esto es evolución. No en velocidad o precisión. En empatía. La IA está aprendiendo a ser humana. Y eso es lo más aterrador y hermoso que hemos construido hasta ahora.