En resumen
Un investigador sénior de seguridad de Anthropic afirmó que existe una probabilidad superior al 10 % de que la inteligencia artificial elimine a la humanidad antes de que termine la década, según The Verge. Otro investigador dejó la empresa y acusó a Anthropic y OpenAI de avanzar rápidamente hacia sistemas superinteligentes sin controles suficientes.
Investigadores vinculados a Anthropic hicieron advertencias públicas sobre los riesgos de los sistemas avanzados de inteligencia artificial y sobre la velocidad de la carrera tecnológica en el sector. El episodio reúne dos declaraciones distintas: una estimación extrema atribuida a un investigador sénior de seguridad y la salida de Jacob Coxon, quien criticó la política de seguridad de la empresa.
Según un informe de The Verge publicado el 9 de septiembre de 2026, el investigador sénior afirmó que existe una probabilidad superior al 10 % de que la inteligencia artificial «pueda matar a todos los seres humanos» antes de que termine la década. El expediente proporcionado no informa sobre la metodología, el contexto completo ni las condiciones utilizadas para llegar a esa estimación.
Por lo tanto, la declaración debe tratarse como una evaluación individual atribuida a un especialista, no como una predicción consensuada de la comunidad científica ni como una conclusión oficial de Anthropic. Tampoco existe en el material disponible evidencia de que este escenario esté cerca de ocurrir o de que un sistema específico haya demostrado tal capacidad.
La salida de un investigador aumenta la presión sobre la empresa
Horas antes de la publicación del informe, Jacob Coxon anunció su salida de Anthropic. El expediente lo describe como un investigador que entrenó sistemas de inteligencia artificial en la empresa y que anteriormente también trabajó en el entrenamiento de sistemas de OpenAI.
Al explicar su decisión, Coxon acusó a Anthropic y OpenAI de avanzar en una carrera hacia la superinteligencia con capacidad de auto mejoramiento. Su crítica central es que las empresas estarían desarrollando sistemas potencialmente superiores a los humanos mientras todavía no podrían controlarlos adecuadamente.
La frase atribuida a Coxon —que las compañías estarían apostando la vida de las personas en esta carrera— expresa una evaluación personal y no demuestra por sí sola la existencia de una falla de seguridad concreta. Sin embargo, el informe muestra que las preocupaciones sobre gobernanza y control también surgen de profesionales directamente involucrados en el desarrollo de estos sistemas.
El expediente no informa sobre el cargo exacto que ocupaba Coxon al momento de su salida, la fecha de su contratación, las políticas internas que cuestionaba ni si otros empleados compartieron públicamente la misma posición. Estos puntos permanecen sin confirmación con base en las fuentes proporcionadas.
Lo que está confirmado y lo que aún falta aclarar
Axios publicó ese mismo día un informe sobre integrantes de Anthropic que advierten sobre la posibilidad de que la IA elimine a la humanidad. Sin embargo, el contenido extraído de esa fuente no está disponible y solo contiene el título y el resumen del feed. Por ello, no es posible atribuir a Axios detalles que no aparecen en ese material.
La confirmación independiente disponible proviene de The Verge, que informa tanto sobre la estimación superior al 10 % como sobre la salida de Coxon y sus críticas a la carrera por sistemas superiores a los humanos. Aun así, el resumen no presenta las declaraciones completas, documentos internos, respuestas de las empresas ni la evaluación de investigadores externos.
El principal cambio práctico derivado del episodio es que el debate sobre la seguridad pasó de una discusión abstracta a una disputa pública entre profesionales que participan en el desarrollo de modelos avanzados. La relevancia está menos en considerar la estimación como un hecho y más en examinar cómo las empresas definen límites, divulgan riesgos y responden a quienes disienten.
También es necesario separar dos niveles de afirmación. El primero es factual: investigadores hicieron advertencias y uno de ellos dejó Anthropic mientras criticaba su enfoque de seguridad. El segundo es prospectivo: la posibilidad de la extinción humana y la incapacidad de controlar sistemas capaces de auto mejorarse son escenarios de riesgo, no acontecimientos confirmados por el expediente.
- La estimación de un riesgo superior al 10 % se atribuye a un investigador sénior, sin que el material proporcionado incluya la metodología.
- Jacob Coxon anunció su salida y criticó a Anthropic y OpenAI por una carrera hacia la superinteligencia.
- El expediente no registra una respuesta oficial de Anthropic.
- No existe confirmación de que algún sistema actual tenga capacidad de auto mejoramiento irrestricto o de eliminar a la humanidad.
Los próximos puntos que habrá que seguir son la respuesta pública de Anthropic, las declaraciones completas de los investigadores y cualquier explicación sobre cómo se calculó la estimación. También será importante verificar si se producen cambios en las políticas de evaluación, implementación y supervisión de sistemas avanzados. Sin esa información, el alcance de las acusaciones y la base técnica de las advertencias siguen siendo inciertos.
La cobertura disponible respalda la existencia de una controversia seria sobre el rumbo de la investigación en IA, pero no sostiene conclusiones más amplias sobre la probabilidad real de extinción ni sobre la conducta de todas las empresas del sector. El caso exige atención y transparencia, sin convertir una advertencia individual en un hecho consumado.
Nuestro prisma
El episodio importa porque expone una tensión interna de la carrera por modelos cada vez más capaces: los mismos profesionales que ayudan a desarrollar estos sistemas pueden considerar que los mecanismos de control no avanzan al mismo ritmo que la tecnología. La estimación de riesgo es grave, pero la ausencia de una metodología en el material proporcionado impide tratarla como una medida objetiva. En la práctica, el foco debe estar en la transparencia de las evaluaciones, la respuesta de las empresas y la posibilidad de un escrutinio independiente. Hasta que se presenten esos elementos, la advertencia es relevante, pero inconclusa.
Fuentes: Axios · The Verge (IA)
Preguntas frecuentes
¿Qué dijeron los investigadores?
Un investigador sénior de seguridad de Anthropic estimó en más del 10 % la probabilidad de que la IA elimine a la humanidad antes de que termine la década, según The Verge.
¿Por qué un investigador dejó Anthropic?
Jacob Coxon afirmó que se fue porque consideraba insuficiente el enfoque de seguridad de la empresa y criticó la carrera por sistemas capaces de auto mejorarse.
¿Anthropic confirmó los riesgos descritos?
El expediente proporcionado no incluye una respuesta de Anthropic ni detalles adicionales que permitan confirmar o contextualizar las declaraciones.
Recibe Radar de IA todos los días
Las noticias de inteligencia artificial que importan — con nuestro prisma y siempre con las fuentes. Gratis.






