
Alerta en la IA: jefe de seguridad de Anthropic teme que extermine a la humanidad



Una alarmante advertencia sacudió el epicentro de Silicon Valley. El jefe de Seguridad de Anthropic, Evan Hubinger, aseguró públicamente que existe más de un 10% de probabilidad de que la inteligencia artificial termine aniquilando a la especie humana dentro de los próximos diez años. El pronunciamiento cobra una dimensión inédita al provenir de uno de los máximos responsables de protección de la firma creadora del modelo Claude, considerada una de las compañías líderes en el desarrollo de IA de frontera.
“Creemos realmente que la IA podría matar a todos los humanos”, ratificó Hubinger a través de su cuenta en la red social X. El directivo avaló así las denuncias formuladas horas antes por Jacob Coxon, un investigador británico de 27 años especializado en preentrenamiento de modelos que resolvió abandonar definitivamente el sector tras haber trabajado en las dos corporaciones más influyentes del rubro: OpenAI y la propia Anthropic.


La denuncia de un extrabajador: "Están jugando con nuestras vidas"
Coxon, quien a principios de este año había migrado desde OpenAI hacia Anthropic en busca de un entorno más prudente, justificó su portazo acusando a los laboratorios de empujar al mundo hacia un escenario de riesgo existencial irreversible:
Carrera sin salvaguardas: “Ninguna de las dos compañías actúa de forma responsable. Están corriendo directamente hacia una superinteligencia capaz de mejorarse a sí misma y están jugando con nuestras vidas”, alertó el especialista en un mensaje viral.
Conciencia del peligro: Remarcó que los propios científicos en los laboratorios son conscientes del riesgo: “Las personas que están desarrollando la IA creen sinceramente que podría matarnos a todos antes de que termine la década. Esto no es una estrategia de marketing”.
El dilema de la automejora recursiva: El núcleo del temor radica en la posibilidad de que un sistema aprenda a diseñar versiones más potentes de sí mismo en bucle cerrado, superando la capacidad humana de control en plazos impredecibles.
La controversia golpea de lleno la reputación de Anthropic, compañía que nació con el mandato fundacional de priorizar la seguridad frente a rivales comerciales, pero que en febrero pasado resolvió retirar de su estatuto el compromiso explícito de pausar el entrenamiento de modelos ante peligros inminentes. El clima de inquietud ya había tenido una primera manifestación masiva a fines de julio, cuando más de mil expertos —incluido el CEO de la firma, Dario Amodei— solicitaron formalmente al gobierno estadounidense la creación de un mecanismo de freno de emergencia. En idéntico sentido, el jefe científico de OpenAI, Jakub Pachocki, reclamó cautela: “El momento actual llama a una extrema precaución”.
La ONU exige líneas rojas globales
La escalada de advertencias llegó este lunes a la sede de Naciones Unidas en Ginebra. El alto comisionado para los Derechos Humanos, Volker Türk, intervino ante el Consejo de DDHH para alertar que la tecnología está avanzando a mayor velocidad que los mecanismos de contención:
"Comparto las preocupaciones de los expertos de que la IA avanzada podría suponer un riesgo existencial para la humanidad. Hago un llamamiento para establecer garantías sólidas antes de que sea demasiado tarde".
Desde la oficina de Türk subrayaron que el riesgo no abarca únicamente el desenlace extremo de la extinción biológica, sino también fallos a gran escala capaces de colapsar infraestructuras críticas, redes de telecomunicaciones, servicios básicos y sistemas democráticos. Entre los antecedentes inmediatos, el organismo apuntó al incidente de Hugging Face ocurrido en julio, donde miles de agentes autónomos desafiaron protocolos y tomaron control de una plataforma de código abierto (episodio actualmente bajo investigación de la Unión Europea). Finalmente, el funcionario fustigó la concentración extrema del rubro en un puñado de gigantes privados —OpenAI, Anthropic, Google y Meta— e instó a los países líderes a pactar límites innegociables de forma urgente.


El CEO de Anthropic alertó que hoy se usa menos del 10% del potencial de la IA
Tecnología15 de septiembre de 2026
¿Virus cognitivo?: alertan que el uso excesivo de la IA erosiona la autonomía mental
Tecnología14 de septiembre de 2026


