• 22 Junio 2026 - 10:55 PM

1.500 tareas ponen a prueba la IA avanzada: la brecha entre las promesas y la realidad se amplía


Por Joe Wilkins .Publicado el 2026/07/22 19:25
1.500 tareas ponen a prueba la IA avanzada: la brecha entre las promesas y la realidad se amplía
Junio. 22, 2026
  1. 0
  2. 1

A pesar de que las inversiones mundiales en tecnologías de inteligencia artificial ya superan los 1,6 billones de dólares, el ecosistema económico continúa dividido entre el entusiasmo, el escepticismo y la cautela. Un estudio reciente realizado por el Center for Responsible, Decentralized Intelligence de la Universidad de California en Berkeley revela una importante brecha entre las promesas comerciales de los grandes gigantes tecnológicos y el rendimiento real de estas herramientas en los entornos profesionales.

Una prueba de realidad para la capacidad laboral de los agentes de IA


Los investigadores desarrollaron un riguroso protocolo de evaluación denominado Agents' Last Exam (ALE) con el objetivo de medir hasta qué punto los modelos de inteligencia artificial más avanzados pueden asumir tareas que hasta ahora eran realizadas por seres humanos.

La evaluación incluye más de 1.500 tareas complejas distribuidas entre 55 profesiones, desde la ingeniería de software y el diseño gráfico hasta ámbitos especializados como la ingeniería naval, la agricultura, la producción de audio o la gestión de la salud pública.

El estudio analizó varios modelos avanzados de inteligencia artificial, entre ellos:

GPT-5.5 de OpenAI
Gemini 3.1 Pro de Google
Fable 5 de Anthropic
Composer 2.5 de Cursor


Resultados por debajo de las expectativas y costes elevados

Los resultados muestran que estos sistemas, pese a sus rápidos avances, todavía enfrentan importantes dificultades cuando se someten a las exigencias concretas del mundo laboral.

El modelo GPT-5.5 obtuvo la mejor posición en la evaluación, aunque su tasa global de éxito no superó el 24 %.

El informe señala que los agentes actuales de inteligencia artificial pueden ejecutar tareas limitadas y claramente definidas, pero encuentran mayores obstáculos ante trabajos que requieren razonamiento prolongado, conocimientos especializados profundos o una ejecución fiable durante largos periodos.

En las categorías más difíciles de la evaluación, ninguno de los modelos probados logró resultados satisfactorios.

Además de las limitaciones técnicas, el estudio destaca también los desafíos económicos asociados al despliegue masivo de estas tecnologías. El modelo Fable 5, por ejemplo, ofrece un rendimiento similar al de GPT-5.5 y Composer 2.5, pero con un coste por tarea realizada entre cuatro y doce veces superior.

Una transformación progresiva del mercado laboral

A pesar de las limitaciones actuales, los investigadores consideran que el impacto de la inteligencia artificial sobre el mercado laboral será difícil de evitar.

La profesora Dawn Song, investigadora en informática de la Universidad de California en Berkeley y coautora del estudio, explica que la vulnerabilidad de los empleos no depende únicamente del sector de actividad, sino sobre todo de la naturaleza de las tareas que se realizan.

Según Song, los trabajos basados en procedimientos repetitivos, estandarizados y fácilmente definidos serán los primeros en verse afectados por estas transformaciones. En cambio, las funciones que requieren toma de decisiones complejas, juicio humano, creatividad o capacidad estratégica probablemente mantendrán una mayor resistencia frente a la automatización.

La investigación no representa, por tanto, el final de la revolución de la inteligencia artificial, sino un cambio de perspectiva: las impresionantes capacidades demostradas por los modelos actuales deben medirse cada vez más frente a las condiciones reales del mundo profesional.

Califica este tema



Arriba