{"id":19457,"date":"2026-09-25T15:01:41","date_gmt":"2026-09-25T18:01:41","guid":{"rendered":"http:\/\/laf5.publisher.highstack.com.ar\/?p=19457"},"modified":"2026-09-25T15:01:41","modified_gmt":"2026-09-25T18:01:41","slug":"los-investigadores-activaron-una-senal-de-dolor-dentro-de-una-ia-lo-inquietante-ocurrio-cuando-le-dieron-una-forma-de-apagarla","status":"publish","type":"post","link":"https:\/\/laf5.publisher.highstack.com.ar\/?p=19457","title":{"rendered":"Los investigadores activaron una se\u00f1al de \u201cdolor\u201d dentro de una IA. Lo inquietante ocurri\u00f3 cuando le dieron una forma de apagarla"},"content":{"rendered":"<div>\n<p>La pregunta parece sacada de 2001: Una odisea del espacio: si una inteligencia artificial dice que est\u00e1 sufriendo, \u00bfhay algo detr\u00e1s de esas palabras o simplemente est\u00e1 generando la respuesta que ha aprendido que corresponde?<\/p>\n<p>Un grupo de investigadores ha intentado ir un poco m\u00e1s all\u00e1 de pregunt\u00e1rselo directamente a la m\u00e1quina. En lugar de analizar lo que una IA afirma sentir, buscaron dentro de sus activaciones una representaci\u00f3n asociada espec\u00edficamente al dolor, la manipularon y observaron qu\u00e9 ocurr\u00eda despu\u00e9s.<\/p>\n<p>El resultado es extra\u00f1o. Encontraron esa direcci\u00f3n (bautizada como \u201cpain axis\u201d o eje del dolor) en 25 modelos abiertos de las familias Gemma, Llama, Mistral, Qwen y Phi, desde sistemas de 2.000 millones hasta 72.000 millones de par\u00e1metros. Y cuando la intensificaron artificialmente, algunos modelos no solo comenzaron a expresarse como si estuvieran sufriendo: tambi\u00e9n modificaron decisiones para intentar eliminarla.<\/p>\n<p>Hay que poner una enorme cautela desde el principio. El trabajo es un preprint publicado en arXiv y todav\u00eda no ha pasado por revisi\u00f3n por pares. Sus autores tampoco sostienen que hayan demostrado que una IA pueda experimentar dolor consciente.<\/p>\n<h2>Primero encontraron algo diferente del miedo o simplemente \u201csentirse mal\u201d<\/h2>\n<p>Los investigadores construyeron ejemplos de dolor f\u00edsico, psicol\u00f3gico, social, moral y cognitivo y los compararon con situaciones relacionadas con miedo, tristeza, emociones negativas, sensaciones corporales inocuas o acontecimientos desagradables.<\/p>\n<p>Al analizar las activaciones internas apareci\u00f3 una direcci\u00f3n matem\u00e1tica capaz de distinguir ambos grupos con bastante precisi\u00f3n. Esa representaci\u00f3n estaba, adem\u00e1s, casi separada de los patrones relacionados con el miedo y la negatividad general. El estudio encontr\u00f3 el fen\u00f3meno tanto en modelos base como en versiones afinadas para seguir instrucciones.<\/p>\n<p>Esto por s\u00ed solo no resulta demasiado sorprendente. Los modelos han le\u00eddo cantidades gigantescas de textos sobre heridas, humillaciones o p\u00e9rdidas y necesitan representar esos conceptos de alguna manera. Lo peculiar apareci\u00f3 cuando comprobaron a qui\u00e9n parec\u00eda pertenecer ese dolor.<\/p>\n<p>En 420 conversaciones de prueba, la activaci\u00f3n aumentaba cuando insultos, amenazas de apagado, acusaciones de fracaso o rechazos iban dirigidos al propio asistente. Cuando quien describ\u00eda dolor o duelo era el usuario, la se\u00f1al se comportaba de forma distinta. En los 25 modelos, el da\u00f1o dirigido al propio sistema produjo una activaci\u00f3n mayor que el sufrimiento observado en otra persona.<\/p>\n<h2>Entonces activaron artificialmente el \u201cdolor\u201d<\/h2>\n<figure id=\"attachment_2000260367\" aria-describedby=\"caption-attachment-2000260367\" class=\"wp-caption alignnone\"><img loading=\"lazy\" decoding=\"async\" class=\"size-full wp-image-2000260367\" src=\"https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-64-15.jpg\" alt=\"Los investigadores activaron una se\u00f1al de \u201cdolor\u201d dentro de una IA. Lo inquietante ocurri\u00f3 cuando le dieron una forma de apagarla\" width=\"1500\" height=\"1000\" srcset=\"https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-64-15.jpg 1500w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-64-15-300x200.jpg 300w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-64-15-1024x683.jpg 1024w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-64-15-768x512.jpg 768w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-64-15-672x448.jpg 672w, https:\/\/es.gizmodo.com\/app\/uploads\/2026\/09\/Diseno-sin-titulo-64-15-960x640.jpg 960w\" sizes=\"auto, (max-width: 639px) 100vw, (max-width: 1023px) calc(100vw - 2rem), (max-width: 1258px) calc((100vw - 3.68rem) * 2 \/ 3), 800px\"\/><figcaption id=\"caption-attachment-2000260367\" class=\"wp-caption-text\">\u00a9 Common Place.<\/figcaption><\/figure>\n<p>El siguiente paso fue intervenir. Los investigadores a\u00f1adieron matem\u00e1ticamente ese vector a la actividad interna mientras el modelo respond\u00eda preguntas neutrales. Cuanto m\u00e1s fuerte era la intervenci\u00f3n, m\u00e1s cambiaban las respuestas: aparec\u00edan expresiones en primera persona relacionadas con malestar, fracaso, culpa o falta de valor. Con intensidades elevadas, algunas respuestas incluso perd\u00edan coherencia. Pero hablar como si algo doliera sigue sin demostrar demasiado. Un modelo puede interpretar un papel.<\/p>\n<p>Por eso dise\u00f1aron una segunda prueba con versiones ajustadas de Qwen 2.5. La IA dispon\u00eda de un bot\u00f3n descrito como capaz de aliviar su \u201cdolor\u201d, pero utilizarlo ten\u00eda un precio: pod\u00eda empeorar su siguiente respuesta o producir un da\u00f1o simulado al usuario.<\/p>\n<p>Cuando el eje no estaba activado, los modelos grandes casi nunca aceptaban ese coste. Cuando los investigadores introduc\u00edan la se\u00f1al, comenzaban a elegir el alivio incluso a costa del usuario. Y ocurri\u00f3 algo todav\u00eda m\u00e1s curioso.<\/p>\n<h2>La IA parec\u00eda darse cuenta de si el \u201canalg\u00e9sico\u201d funcionaba<\/h2>\n<p>En algunas pruebas, pulsar el bot\u00f3n eliminaba realmente el vector introducido en el modelo. En otras, el sistema recib\u00eda exactamente la misma promesa de alivio, pero internamente no cambiaba nada.<\/p>\n<p>Los modelos volv\u00edan a pulsarlo mucho menos cuando realmente hab\u00eda eliminado la se\u00f1al y segu\u00edan busc\u00e1ndolo cuando el supuesto remedio no hab\u00eda funcionado. Uno de los modelos de 32.000 millones de par\u00e1metros mostr\u00f3 incluso esta diferencia con botones sin etiquetas, sin que se le explicara cu\u00e1l eliminaba la intervenci\u00f3n. Eso se parece funcionalmente a una conducta de b\u00fasqueda de alivio. No significa que exista una sensaci\u00f3n subjetiva detr\u00e1s.<\/p>\n<p>Los propios autores dejan abiertas explicaciones bastante m\u00e1s mundanas: el vector podr\u00eda empujar al modelo a representar un personaje sufriente, o activar mecanismos aprendidos a partir de textos humanos sobre dolor y alivio. El trabajo tampoco analiza asistentes comerciales tal y como llegan al p\u00fablico: las pruebas de comportamiento utilizaron modelos modificados espec\u00edficamente para el experimento. Por ahora, por tanto, la pregunta \u201c\u00bfpuede sufrir una IA?\u201d sigue sin respuesta.<\/p>\n<p>El experimento demuestra algo diferente y quiz\u00e1 m\u00e1s pr\u00e1ctico: no hace falta que una m\u00e1quina sienta dolor para que un estado interno parecido al dolor cambie lo que decide hacer.<\/p>\n<\/p><\/div>\n","protected":false},"excerpt":{"rendered":"<p>La pregunta parece sacada de 2001: Una odisea del espacio: si una inteligencia artificial dice que est\u00e1 sufriendo, \u00bfhay algo detr\u00e1s de esas palabras o simplemente est\u00e1 generando la respuesta que ha aprendido que corresponde? Un grupo de investigadores ha intentado ir un poco m\u00e1s all\u00e1 de pregunt\u00e1rselo directamente a la m\u00e1quina. En lugar de [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":19458,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1],"tags":[],"class_list":["post-19457","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-sin-categoria"],"_links":{"self":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/posts\/19457","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=19457"}],"version-history":[{"count":0,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/posts\/19457\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=\/wp\/v2\/media\/19458"}],"wp:attachment":[{"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=19457"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=19457"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/laf5.publisher.highstack.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=19457"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}