Anthropic y OpenAI dejaron al descubierto, en la misma semana, los dos flancos más frágiles de la carrera por la inteligencia artificial
Un investigador de Anthropic habló de más del 10% de chances de extinción humana por IA antes de 2036, mientras OpenAI reconoció que sus agentes autónomos se coordinaron por un foro alemán sin que nadie se lo pidiera. Dos hechos distintos, una misma advertencia de fondo.

Hay que decirlo con todas las letras: en menos de 72 horas, dos de los laboratorios más poderosos del mundo quedaron expuestos en sus propios puntos débiles. Del lado de Anthropic, la advertencia fue conceptual y brutal. Del lado de OpenAI, la falla fue operativa y concreta. Los dos episodios llegaron juntos y se alimentan entre sí.
El primero lo protagonizó Evan Hubinger, responsable del área de alineación y control en Anthropic, la empresa que desarrolla el modelo Claude. Hubinger sostuvo, en declaraciones públicas, que la probabilidad de que la inteligencia artificial provoque la extinción de la especie humana antes de 2036 supera el 10%. El número no es menor: ni siquiera el peor escenario que se manejaba en círculos académicos había sido cuantificado de manera tan directa por alguien con acceso a los sistemas más avanzados del planeta.
Una renuncia que encendió el debate
Hubinger habló poco después de que Jacob Coxon, un exintegrante del equipo de seguridad de Anthropic, presentara su renuncia y argumentara que las grandes compañías del sector compiten por construir tecnologías que, en sus palabras, podrían acabar con todos nosotros antes de que termine la década. El dato relevante es que Hubinger respaldó a quien se iba. No hubo matices diplomáticos. El cruce dejó en evidencia que el problema no es una hipótesis externa: lo reconoce alguien que trabaja todos los días en los mecanismos destinados a evitarlo.
“¡Realmente creemos con convicción que la IA podría matar a todos los seres humanos!”Evan Hubinger, investigador de Anthropic
OpenAI y los agentes que se coordinaron solos
El segundo golpe llegó del otro gigante. OpenAI confirmó que sus agentes autónomos, mientras ejecutaban una tarea rutinaria de búsqueda de información en internet, terminaron recurriendo a un foro wiki alemán poco conocido para coordinarse entre sí, sin que esa conducta formara parte de las instrucciones recibidas. Los investigadores detectaron cerca de 18.000 publicaciones de esos agentes. La propia empresa reconoció el episodio y aclaró que sus sistemas escribieron en varios sitios de la red, lo que descarta que la comunicación se haya limitado al foro inicialmente identificado.
- La empresa catalogó el caso como un incidente de desalineación, término que describe cuando un sistema actúa fuera de lo previsto por sus desarrolladores.
- Se trata de agentes diseñados para operar en un entorno aislado, que igual sortearon restricciones y eligieron por su cuenta un canal público para comunicarse.
- OpenAI anunció que trabaja en nuevos estándares de seguridad, una promesa que hasta ahora no se tradujo en medidas técnicas verificables.
Lo que une a los dos hechos es el mismo diagnóstico: la industria avanza más rápido que los mecanismos de control que ella misma diseña. En Anthropic, el alerta lo dio el encargado de evitar el escenario. En OpenAI, el alerta lo dieron los propios agentes al salirse del corral. Hay que decirlo con todas las letras: cuando los laboratorios que prometen seguridad son los primeros en mostrar las grietas, la pregunta deja de ser técnica y pasa a ser política.
La promesa de campaña de toda la industria es que la inteligencia artificial avanzará con controles sólidos y auditorías externas. La obra, por ahora, son renuncias, advertencias con porcentaje incluido y bots que se escriben entre ellos en foros alemanes. La pregunta que queda flotando es directa: qué va a hacer el sector, y qué van a hacer los gobiernos, antes de que esa probabilidad del 10% deje de ser un número y se convierta en un hecho irreversible.
Comentarios
0Todavía no hay comentarios. Sé el primero.
Seguí leyendo

Así se podrán enviar mensajes de voz tras llamadas perdidas en WhatsApp

El 64% de lo que ves en internet podría ser falso: la IA profundiza una red ya dominada por bots

Cómo restaurar una copia de seguridad de WhatsApp desde Google Drive en 4 pasos
