<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>TransformaciónDigital on Carles Abarca</title><link>https://carlesabarca.com/es/tags/transformaci%C3%B3ndigital/</link><description>Recent content in TransformaciónDigital on Carles Abarca</description><generator>Hugo -- gohugo.io</generator><language>es</language><copyright>© 2026 Carles Abarca</copyright><lastBuildDate>Mon, 14 Sep 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://carlesabarca.com/es/tags/transformaci%C3%B3ndigital/index.xml" rel="self" type="application/rss+xml"/><item><title>La inteligencia artificial avanza. La responsabilidad sigue siendo nuestra</title><link>https://carlesabarca.com/es/posts/ai-revocable-autonomy/</link><pubDate>Mon, 14 Sep 2026 00:00:00 +0000</pubDate><guid>https://carlesabarca.com/es/posts/ai-revocable-autonomy/</guid><description>No existe un interruptor mundial para la IA. La respuesta debe incluir autonomía revocable, fusibles independientes y supervisión de los agentes que ejecutan tareas críticas.</description><content:encoded>&lt;p&gt;El 8 de septiembre, Jacob Coxon anunció su salida de Anthropic tras haber trabajado también en OpenAI. Su advertencia vinculaba la carrera hacia sistemas más avanzados con riesgos para la humanidad antes de terminar la década.&lt;sup id="fnref:1"&gt;&lt;a href="#fn:1" class="footnote-ref" role="doc-noteref"&gt;1&lt;/a&gt;&lt;/sup&gt;&lt;/p&gt;
&lt;p&gt;No creo que debamos trivializar estas alertas. Pero tampoco confundir una advertencia con un calendario demostrado de nuestra extinción.&lt;/p&gt;
&lt;p&gt;Mi preocupación es que el debate termine atrapado entre dos posiciones igualmente insuficientes: detenerlo todo o continuar como si nada pudiera salir mal.&lt;/p&gt;
&lt;p&gt;Creo que necesitamos una tercera conversación. No solo sobre hasta dónde puede llegar la inteligencia artificial, sino sobre hasta dónde estamos dispuestos a dejarla actuar.&lt;/p&gt;

&lt;h2 class="relative group"&gt;El mundo no termina en Silicon Valley
 &lt;div id="el-mundo-no-termina-en-silicon-valley" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#el-mundo-no-termina-en-silicon-valley" aria-label="Ancla"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;p&gt;Una pausa occidental no sería, por sí sola, una pausa mundial.&lt;/p&gt;
&lt;p&gt;China no es un espectador a la espera de lo que decidan las empresas estadounidenses. Familias como Qwen forman parte del ecosistema de modelos con pesos disponibles para descarga y despliegue.&lt;sup id="fnref:2"&gt;&lt;a href="#fn:2" class="footnote-ref" role="doc-noteref"&gt;2&lt;/a&gt;&lt;/sup&gt; No hace falta atribuirles un primer puesto absoluto —que exigiría especificar la métrica y la fecha— para reconocer que una estrategia centrada exclusivamente en unos pocos laboratorios estadounidenses deja fuera actores relevantes.&lt;/p&gt;
&lt;p&gt;Tampoco sería justo afirmar que la preocupación por la seguridad es exclusivamente occidental. Científicos chinos han participado en los diálogos internacionales sobre riesgos extremos de IA, incluidos los celebrados en Pekín y Shanghái.&lt;sup id="fnref:3"&gt;&lt;a href="#fn:3" class="footnote-ref" role="doc-noteref"&gt;3&lt;/a&gt;&lt;/sup&gt; La línea divisoria no separa simplemente a un Occidente preocupado de una China indiferente.&lt;/p&gt;
&lt;p&gt;Mi argumento es otro: no considero realista basar nuestra seguridad en que todos los competidores, gobiernos y desarrolladores decidan detenerse al mismo tiempo y mantengan indefinidamente ese acuerdo.&lt;/p&gt;
&lt;p&gt;Eso no convierte la regulación en inútil. Los gobiernos deben intervenir, exigir garantías y cooperar. Pero gobernar el desarrollo no es lo mismo que disponer de un interruptor mundial.&lt;/p&gt;
&lt;p&gt;Y reconocer los límites de una moratoria unilateral no puede convertirse en una excusa para desplegar cualquier cosa. La competencia no elimina la responsabilidad.&lt;/p&gt;

&lt;h2 class="relative group"&gt;Capacidad no es autoridad
 &lt;div id="capacidad-no-es-autoridad" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#capacidad-no-es-autoridad" aria-label="Ancla"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;p&gt;Que una IA pueda tomar una decisión no significa que debamos concederle el derecho a tomarla.&lt;/p&gt;
&lt;p&gt;Esta distinción debería estar en el centro del debate.&lt;/p&gt;
&lt;p&gt;Imaginemos una IA que prepara una transferencia. Podemos autorizarla a proponerla, a ejecutarla dentro de límites concretos o a operar sin aprobación. El modelo puede ser el mismo; la autoridad concedida es muy distinta.&lt;/p&gt;
&lt;p&gt;Lo mismo ocurre con un agente que modifica software. Sugerir un cambio, probarlo en un entorno aislado y desplegarlo directamente en producción son tres decisiones de gobierno diferentes.&lt;/p&gt;
&lt;p&gt;No deberíamos presentar esa escalera como una progresión obligatoria. Más capacidad no tiene por qué significar más autonomía en todos los contextos.&lt;/p&gt;
&lt;p&gt;La sociedad debe decidir qué delega. Pero responsabilidad compartida no significa responsabilidad idéntica: quien diseña, comercializa, integra o autoriza un sistema tiene obligaciones proporcionales al poder que ejerce. El ciudadano no puede cargar con aquello que no puede observar ni controlar.&lt;/p&gt;

&lt;h2 class="relative group"&gt;Autonomía revocable
 &lt;div id="autonomía-revocable" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#autonom%c3%ada-revocable" aria-label="Ancla"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;p&gt;Propongo un principio sencillo: &lt;strong&gt;la autonomía concedida a una IA debe ser limitada, verificable y revocable&lt;/strong&gt;.&lt;/p&gt;
&lt;p&gt;Eso exige fusibles. No una frase dentro de un prompt que diga «detente si algo va mal», sino mecanismos que permitan impedir nuevas acciones sin depender de que el modelo obedezca.&lt;/p&gt;
&lt;p&gt;Mi propuesta es diseñarlos en varias capas:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;Permisos mínimos y temporales.&lt;/strong&gt; El agente recibe los accesos necesarios para la tarea, no una autoridad general que pueda ampliar por iniciativa propia.&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Controles antes de ejecutar.&lt;/strong&gt; Una pasarela independiente comprueba recursos, límites y autorizaciones antes de permitir operaciones sensibles.&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Suspensión efectiva.&lt;/strong&gt; La organización puede revocar credenciales, aislar conexiones y cancelar trabajos pendientes, incluidas las tareas delegadas a otros agentes.&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Continuidad operativa.&lt;/strong&gt; Existe una alternativa probada para mantener el servicio en un estado seguro cuando el agente deja de operar.&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;No es una promesa de revertir cualquier daño. Detener un sistema no recupera automáticamente datos filtrados ni deshace decisiones irreversibles. Por eso importa intervenir antes de la acción, no solo investigar después.&lt;/p&gt;
&lt;p&gt;El NIST ya contempla mecanismos de desactivación y alternativas de contingencia en su marco de gestión del riesgo.&lt;sup id="fnref:4"&gt;&lt;a href="#fn:4" class="footnote-ref" role="doc-noteref"&gt;4&lt;/a&gt;&lt;/sup&gt; Mi propuesta es convertir esa capacidad de retirada en una condición explícita para conceder autonomía en tareas críticas.&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;Si una institución ya no sabe funcionar sin su IA, su capacidad de desconectarla puede ser más teórica que real.&lt;/strong&gt;&lt;/p&gt;

&lt;h2 class="relative group"&gt;¿Necesitamos una policía de la IA?
 &lt;div id="necesitamos-una-policía-de-la-ia" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#necesitamos-una-polic%c3%ada-de-la-ia" aria-label="Ancla"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;p&gt;Creo que parte de la supervisión debería poder realizarla otra IA: modelos especializados en vigilar a los agentes que ejecutan tareas críticas y detectar cuándo actúan fuera de su mandato.&lt;/p&gt;
&lt;p&gt;La investigación en &lt;em&gt;AI control&lt;/em&gt; ya estudia modelos supervisores, incluidos modelos menos capaces pero considerados más fiables que el ejecutor.&lt;sup id="fnref:5"&gt;&lt;a href="#fn:5" class="footnote-ref" role="doc-noteref"&gt;5&lt;/a&gt;&lt;/sup&gt; Eso no demuestra que exista una policía infalible. Sí ofrece un punto de partida técnico para discutirla.&lt;/p&gt;
&lt;p&gt;La arquitectura que propongo separa tres funciones: una IA ejecuta, otra supervisa y un mecanismo independiente aplica los límites.&lt;/p&gt;
&lt;p&gt;El supervisor observaría las operaciones previstas y sus resultados. Podría señalar anomalías, solicitar revisión o activar una suspensión predefinida. Pero no debería asumir la tarea del agente vigilado, concederse nuevos permisos ni modificar las reglas de control.&lt;/p&gt;
&lt;p&gt;Su mandato estricto tendría que estar inscrito en sus accesos y en su interfaz, no solamente en sus instrucciones. Poder de veto acotado, no autoridad general.&lt;/p&gt;
&lt;p&gt;Y no hablaría de «rebeldía» como si necesitáramos demostrar una intención. Para bloquear una operación basta con que vulnere el mandato autorizado, aunque la causa sea un error, una instrucción maliciosa o una mala interpretación.&lt;/p&gt;

&lt;h2 class="relative group"&gt;El vigilante también necesita límites
 &lt;div id="el-vigilante-también-necesita-límites" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#el-vigilante-tambi%c3%a9n-necesita-l%c3%admites" aria-label="Ancla"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;p&gt;La pregunta inevitable es quién vigila al vigilante.&lt;/p&gt;
&lt;p&gt;No resolvería el problema añadiendo una cadena infinita de supervisores. Lo cerraría con separación de funciones, controles externos a los modelos, registros protegidos y responsables humanos identificables.&lt;/p&gt;
&lt;p&gt;La investigación SLEIGHT-Bench de Anthropic documenta puntos ciegos en monitores de IA y presenta la supervisión como una capa de defensa, no como una solución autosuficiente.&lt;sup id="fnref:6"&gt;&lt;a href="#fn:6" class="footnote-ref" role="doc-noteref"&gt;6&lt;/a&gt;&lt;/sup&gt; Conviene recordar esa limitación antes de confundir vigilancia automatizada con seguridad garantizada.&lt;/p&gt;
&lt;p&gt;Propondría probar estos sistemas mediante simulacros: intentos de eludir los controles, fallos del supervisor y activaciones injustificadas. Una policía que no detecta infracciones falla; una que paraliza constantemente el servicio también.&lt;/p&gt;
&lt;p&gt;En un entorno crítico, apagar no siempre debería significar cortar todo de golpe. El objetivo tendría que ser alcanzar un estado seguro, con un procedimiento definido para intervenir y reanudar la operación.&lt;/p&gt;
&lt;p&gt;Esta policía tampoco sería un permiso para perseguir modelos ajenos por internet. Su jurisdicción serían los sistemas que una organización está autorizada a supervisar. Y sus facultades deberían poder auditarse y revocarse.&lt;/p&gt;

&lt;h2 class="relative group"&gt;El progreso no exige renunciar al control
 &lt;div id="el-progreso-no-exige-renunciar-al-control" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#el-progreso-no-exige-renunciar-al-control" aria-label="Ancla"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;p&gt;No presento estos fusibles como una respuesta completa al riesgo existencial. Tampoco sustituyen la investigación en seguridad, la cooperación internacional o las obligaciones de los desarrolladores.&lt;/p&gt;
&lt;p&gt;Los planteo como algo que deberíamos exigir incluso sin estar de acuerdo sobre la probabilidad de una catástrofe: capacidad efectiva de limitar y retirar la autoridad concedida.&lt;/p&gt;
&lt;p&gt;No creo que ningún gobierno pueda garantizar por sí solo el fin de la evolución mundial de la IA. Sí creo que cada institución debe responder por cómo la incorpora, qué le permite hacer y cómo interviene cuando se desvía.&lt;/p&gt;
&lt;p&gt;Podemos delegar tareas. Podemos utilizar IA para ayudarnos a supervisar otras IA. Lo que no debemos delegar es la responsabilidad de establecer los límites.&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;El progreso de la inteligencia artificial no debe confundirse con nuestra renuncia a decidir.&lt;/strong&gt;&lt;/p&gt;

&lt;h2 class="relative group"&gt;Fuentes y contexto
 &lt;div id="fuentes-y-contexto" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#fuentes-y-contexto" aria-label="Ancla"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;div class="footnotes" role="doc-endnotes"&gt;
&lt;hr&gt;
&lt;ol&gt;
&lt;li id="fn:1"&gt;
&lt;p&gt;Associated Press, Kaitlyn Huamani, «Anthropic researcher resigns with warning about the dangers of AI development», 9 de septiembre de 2026. Declaraciones atribuidas a Coxon; no constituyen una predicción consensuada. &lt;a href="https://apnews.com/article/2ed549e07f2f941600a135070487d83d" target="_blank" rel="noreferrer"&gt;https://apnews.com/article/2ed549e07f2f941600a135070487d83d&lt;/a&gt;&amp;#160;&lt;a href="#fnref:1" class="footnote-backref" role="doc-backlink"&gt;&amp;#x21a9;&amp;#xfe0e;&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li id="fn:2"&gt;
&lt;p&gt;Qwen, repositorio oficial de la organización en Hugging Face. Se utiliza como evidencia de disponibilidad de modelos, no como clasificación global de potencia o popularidad. &lt;a href="https://huggingface.co/Qwen" target="_blank" rel="noreferrer"&gt;https://huggingface.co/Qwen&lt;/a&gt;&amp;#160;&lt;a href="#fnref:2" class="footnote-backref" role="doc-backlink"&gt;&amp;#x21a9;&amp;#xfe0e;&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li id="fn:3"&gt;
&lt;p&gt;International Dialogues on AI Safety, encuentros y declaraciones de Pekín (2024) y Shanghái (2025). &lt;a href="https://idais.ai/dialogues/" target="_blank" rel="noreferrer"&gt;https://idais.ai/dialogues/&lt;/a&gt;&amp;#160;&lt;a href="#fnref:3" class="footnote-backref" role="doc-backlink"&gt;&amp;#x21a9;&amp;#xfe0e;&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li id="fn:4"&gt;
&lt;p&gt;NIST, AI Risk Management Framework Playbook, sección Manage. &lt;a href="https://airc.nist.gov/airmf-resources/playbook/manage/" target="_blank" rel="noreferrer"&gt;https://airc.nist.gov/airmf-resources/playbook/manage/&lt;/a&gt;&amp;#160;&lt;a href="#fnref:4" class="footnote-backref" role="doc-backlink"&gt;&amp;#x21a9;&amp;#xfe0e;&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li id="fn:5"&gt;
&lt;p&gt;Anthropic, «Recommendations for Technical AI Safety Research Directions», sección AI control y trusted monitoring, 2025. &lt;a href="https://red.anthropic.com/2025/recommended-directions/" target="_blank" rel="noreferrer"&gt;https://red.anthropic.com/2025/recommended-directions/&lt;/a&gt;&amp;#160;&lt;a href="#fnref:5" class="footnote-backref" role="doc-backlink"&gt;&amp;#x21a9;&amp;#xfe0e;&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li id="fn:6"&gt;
&lt;p&gt;Najt et al., «SLEIGHT-Bench: Finding Blind Spots in AI Monitors», 19 de mayo de 2026. &lt;a href="https://alignment.anthropic.com/2026/sleight-bench/" target="_blank" rel="noreferrer"&gt;https://alignment.anthropic.com/2026/sleight-bench/&lt;/a&gt;&amp;#160;&lt;a href="#fnref:6" class="footnote-backref" role="doc-backlink"&gt;&amp;#x21a9;&amp;#xfe0e;&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ol&gt;
&lt;/div&gt;</content:encoded><media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://carlesabarca.com/posts/ai-revocable-autonomy/featured.png"/></item></channel></rss>