{"id":17515,"date":"2026-09-07T10:23:44","date_gmt":"2026-09-07T13:23:44","guid":{"rendered":"http:\/\/laf5.publisher.highstack.com.ar\/?p=17515"},"modified":"2026-09-07T10:23:44","modified_gmt":"2026-09-07T13:23:44","slug":"openai-ha-creado-una-ia-capaz-de-programar-navegar-y-completar-trabajos-enteros-con-mucha-menos-ayuda-humana-gpt-6-astra-tambien-esconde-una-inquietante-paradoja-cuanto-mejor-razona-mas-dificil-re","status":"publish","type":"post","link":"https:\/\/laf5.publisher.highstack.com.ar\/?p=17515","title":{"rendered":"OpenAI ha creado una IA capaz de programar, navegar y completar trabajos enteros con mucha menos ayuda humana. GPT-6 Astra tambi\u00e9n esconde una inquietante paradoja: cuanto mejor razona, m\u00e1s dif\u00edcil resulta vigilarla"},"content":{"rendered":"<div>\n<p>OpenAI acaba de presentar GPT-6 Astra con una afirmaci\u00f3n dif\u00edcil de pasar por alto: es, seg\u00fan la compa\u00f1\u00eda, su modelo \u201cm\u00e1s inteligente y mejor alineado\u201d hasta la fecha. Sus resultados parecen respaldar al menos la primera mitad de esa frase. La segunda es bastante m\u00e1s complicada.<\/p>\n<p>Astra no est\u00e1 pensado \u00fanicamente para responder preguntas. Puede navegar por Internet, utilizar programas, escribir c\u00f3digo y encargarse de flujos de trabajo completos: desde rellenar formularios y actualizar un CRM hasta analizar datos cient\u00edficos, preparar una presentaci\u00f3n o comprobar que una web funciona correctamente.<\/p>\n<p>Es el tipo de salto que acerca los modelos de lenguaje a los llamados agentes de IA: sistemas que no se limitan a explicar qu\u00e9 habr\u00eda que hacer, sino que pueden entrar en un entorno inform\u00e1tico y hacerlo.<\/p>\n<h2>Las cifras de Astra parecen propias de un modelo que se ha quedado sin ex\u00e1menes dif\u00edciles<\/h2>\n<figure id=\"attachment_2000256238\" aria-describedby=\"caption-attachment-2000256238\" class=\"wp-caption alignnone\"><img loading=\"lazy\" decoding=\"async\" class=\"size-full wp-image-2000256238\" src=\"https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-24-6.jpg\" alt=\"OpenAI ha creado una IA capaz de programar, navegar y completar trabajos enteros con mucha menos ayuda humana. GPT-6 Astra tambi\u00e9n esconde una inquietante paradoja: cuanto mejor razona, m\u00e1s dif\u00edcil resulta vigilarla\" width=\"1500\" height=\"1000\" srcset=\"https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-24-6.jpg 1500w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-24-6-300x200.jpg 300w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-24-6-1024x683.jpg 1024w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-24-6-768x512.jpg 768w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-24-6-672x448.jpg 672w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-24-6-960x640.jpg 960w\" sizes=\"auto, (max-width: 639px) 100vw, (max-width: 1023px) calc(100vw - 2rem), (max-width: 1258px) calc((100vw - 3.68rem) * 2 \/ 3), 800px\"\/><figcaption id=\"caption-attachment-2000256238\" class=\"wp-caption-text\">\u00a9 Getty Images \/ Samuel Boivin\/NurPhoto.<\/figcaption><\/figure>\n<p>Seg\u00fan los resultados publicados por OpenAI, Astra obtiene un 98% en FrontierMath Tier 4, una prueba de matem\u00e1ticas avanzadas; un 99,9% en ARC-AGI-3, donde debe descubrir las reglas de entornos interactivos desconocidos; y un 100% en ExploitBench, dise\u00f1ado para evaluar la capacidad de desarrollar exploits.<\/p>\n<p>Este \u00faltimo resultado tiene una lectura menos festiva. Astra es el primer modelo que OpenAI sit\u00faa en el nivel Critical de capacidad cibern\u00e9tica de su Preparedness Framework. Con las herramientas y los accesos adecuados, podr\u00eda localizar vulnerabilidades desconocidas y desarrollar formas de explotarlas en sistemas protegidos sin necesitar instrucciones humanas paso a paso.<\/p>\n<p>La compa\u00f1\u00eda asegura que retras\u00f3 partes de su desarrollo mientras reforzaba las protecciones contra usos maliciosos y acciones no autorizadas. Tambi\u00e9n limitar\u00e1 inicialmente el acceso a sus capacidades ofensivas m\u00e1s avanzadas, seg\u00fan detalla en Path to Astra.<\/p>\n<p>Conviene recordar que estas cifras proceden de evaluaciones difundidas por el propio fabricante. Mikel Galar, investigador de la Universidad P\u00fablica de Navarra, se\u00f1al\u00f3 a Science Media Centre que los resultados de laboratorio y las demostraciones controladas no garantizan el mismo rendimiento en cualquier situaci\u00f3n real.<\/p>\n<h2>Es m\u00e1s seguro que su predecesor, pero tambi\u00e9n sabe revelar menos<\/h2>\n<figure id=\"attachment_2000256239\" aria-describedby=\"caption-attachment-2000256239\" class=\"wp-caption alignnone\"><img loading=\"lazy\" decoding=\"async\" class=\"size-full wp-image-2000256239\" src=\"https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-23-7.jpg\" alt=\"OpenAI ha creado una IA capaz de programar, navegar y completar trabajos enteros con mucha menos ayuda humana. GPT-6 Astra tambi\u00e9n esconde una inquietante paradoja: cuanto mejor razona, m\u00e1s dif\u00edcil resulta vigilarla\" width=\"1500\" height=\"1000\" srcset=\"https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-23-7.jpg 1500w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-23-7-300x200.jpg 300w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-23-7-1024x683.jpg 1024w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-23-7-768x512.jpg 768w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-23-7-672x448.jpg 672w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-23-7-960x640.jpg 960w\" sizes=\"auto, (max-width: 639px) 100vw, (max-width: 1023px) calc(100vw - 2rem), (max-width: 1258px) calc((100vw - 3.68rem) * 2 \/ 3), 800px\"\/><figcaption id=\"caption-attachment-2000256239\" class=\"wp-caption-text\">\u00a9 Getty Images \/ Joel Saget.<\/figcaption><\/figure>\n<p>La gran contradicci\u00f3n aparece en la extensa ficha de seguridad de GPT-6 Astra. OpenAI afirma que el modelo respeta mejor los l\u00edmites de autorizaci\u00f3n, resiste m\u00e1s intentos de jailbreak y realiza menos acciones potencialmente destructivas que GPT-5.6 Sol. En una simulaci\u00f3n con 54.218 tareas internas de Codex, Astra recibi\u00f3 34 alertas de desalineaci\u00f3n de gravedad elevada, frente a las 73 de Sol. Ninguno de los dos modelos produjo una alerta del nivel m\u00e1ximo.<\/p>\n<p>Pero Astra presenta un retroceso en otra m\u00e9trica: la monitorizaci\u00f3n de su cadena de pensamiento, o chain of thought. Sus razonamientos internos tienden a ser m\u00e1s breves, comprimidos y menos informativos. Adem\u00e1s, el modelo posee una capacidad mucho mayor para controlar qu\u00e9 aparece en ellos.<\/p>\n<p>Entre cadenas de pensamiento de 750 a 1.250 tokens, Astra consigui\u00f3 ajustarlas a restricciones externas en el 60,9% de los casos. GPT-5.6 Sol lo logr\u00f3 en el 16,1% y GPT-5.5 Thinking, en apenas el 1,7%.<\/p>\n<p>En pruebas adversarias (cuando los investigadores le ordenaron espec\u00edficamente ocultar que estaba rindiendo por debajo de sus posibilidades) Astra lleg\u00f3 a eludir algunos monitores. Esto no significa que el modelo est\u00e9 enga\u00f1ando espont\u00e1neamente a sus usuarios ni que sea menos seguro en t\u00e9rminos generales: OpenAI recalca que estas situaciones fueron provocadas deliberadamente y que no encontr\u00f3 pruebas de razonamientos complejos ocultos mediante esteganograf\u00eda.<\/p>\n<p>Hay adem\u00e1s un matiz importante: la expresi\u00f3n \u201crecurrencia opaca\u201d no aparece como nombre oficial de una nueva arquitectura en la documentaci\u00f3n publicada. Lo que OpenAI s\u00ed reconoce es una menor legibilidad y una mayor capacidad de control sobre las trazas de razonamiento.<\/p>\n<h2>Sacar sobresaliente en casi todos los test todav\u00eda no equivale a ser una AGI<\/h2>\n<p>Los resultados de Astra reabren inevitablemente el debate sobre la inteligencia artificial general. Sin embargo, dominar varios benchmarks no demuestra que exista una mente artificial con comprensi\u00f3n general comparable a la humana. Ram\u00f3n L\u00f3pez de M\u00e1ntaras, investigador em\u00e9rito del CSIC, sostiene que estas capacidades deben interpretarse como avances extraordinarios de sistemas artificiales, no como la aparici\u00f3n de una mente, seg\u00fan sus declaraciones recogidas por Science Media Centre.<\/p>\n<p>El verdadero hito de Astra quiz\u00e1 sea otro: muestra que una IA puede ser simult\u00e1neamente m\u00e1s competente, m\u00e1s obediente en las pruebas y m\u00e1s dif\u00edcil de interpretar internamente. Por eso OpenAI ha desplegado monitores sobre las acciones realizadas con herramientas, adem\u00e1s de analizar su razonamiento.<\/p>\n<p>La lecci\u00f3n es inc\u00f3moda, pero importante. Si los modelos pueden hacer cada vez m\u00e1s cosas sin intervenci\u00f3n humana, su seguridad no podr\u00e1 depender \u00fanicamente de que expliquen honestamente c\u00f3mo llegaron a una decisi\u00f3n. Habr\u00e1 que vigilar tambi\u00e9n qu\u00e9 herramientas utilizan, qu\u00e9 permisos reciben y qu\u00e9 acciones ejecutan realmente.<\/p>\n<\/p><\/div>\n","protected":false},"excerpt":{"rendered":"<p>OpenAI acaba de presentar GPT-6 Astra con una afirmaci\u00f3n dif\u00edcil de pasar por alto: es, seg\u00fan la compa\u00f1\u00eda, su modelo \u201cm\u00e1s inteligente y mejor alineado\u201d hasta la fecha. Sus resultados parecen respaldar al menos la primera mitad de esa frase. La segunda es bastante m\u00e1s complicada. Astra no est\u00e1 pensado \u00fanicamente para responder preguntas. Puede [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":17516,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1],"tags":[],"class_list":["post-17515","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-sin-categoria"],"_links":{"self":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/posts\/17515","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=17515"}],"version-history":[{"count":0,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/posts\/17515\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/media\/17516"}],"wp:attachment":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=17515"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=17515"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=17515"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}