El lanzamiento de GPT-6 Astra, presentado por OpenAI el 3 de septiembre, ha marcado un punto de inflexión en la industria tecnológica. Jensen Huang, figura clave en el sector, afirmó que la AGI ha llegado; sin embargo, esta declaración carece de una definición técnica consensuada y de evidencia empírica que la respalde, lo que ha provocado críticas inmediatas.
Gary Marcus, científico cognitivo y profesor emérito de la Universidad de Nueva York, ha sido uno de los principales detractores de esta narrativa. En su blog, Marcus argumentó que proclamar la existencia de la AGI sin un marco conceptual claro solo "enturbia" el debate. Según el investigador, Astra aún no cumple con las definiciones convencionales de una inteligencia artificial de propósito general, ya que, aunque destaca en áreas como la programación, carece de las capacidades generalizadas comparables a la inteligencia humana. Asimismo, cuestionó la validez de los benchmarks utilizados para sustentar tales afirmaciones.
En cuanto a sus capacidades técnicas, OpenAI destaca que Astra representa un avance significativo frente a los modelos tradicionales de ChatGPT. El sistema está diseñado para ejecutar flujos de trabajo complejos de principio a fin, incluyendo la creación de documentos, hojas de cálculo y presentaciones, adaptándose a cambios en los requisitos del usuario en tiempo real. La compañía reporta resultados destacados en pruebas de rendimiento, alcanzando un 98% en FrontierMath Tier 4, un 99.9% en ARC-AGI-3 y un 100% en ExploitBench.
Debido a su autonomía, OpenAI ha clasificado a Astra en el nivel "Crítico" de ciberseguridad dentro de su Preparedness Framework. El modelo tiene la capacidad de identificar vulnerabilidades de seguridad desconocidas y desarrollar métodos para explotarlas de forma autónoma. Ante estos riesgos, la empresa ha implementado mecanismos de monitoreo reforzados, que incluyen la posibilidad de pausar conversaciones para una revisión humana si el sistema interpreta incorrectamente las instrucciones.


