Jacob Coxon renunció a Anthropic y acusó a la empresa y a OpenAI de participar en una carrera irresponsable hacia sistemas de IA con capacidades superiores. El investigador de preentrenamiento afirmó que los laboratorios están asumiendo riesgos con la vida de las personas. Anthropic no anunció cambios en sus modelos o servicios vinculados con su salida.
Coxon comunicó en X que también abandonará el sector de la IA. Según su propio relato, dedicó los últimos tres años a investigación de preentrenamiento en OpenAI y Anthropic, un área centrada en la etapa inicial en que los modelos procesan grandes conjuntos de datos para adquirir capacidades generales.
El investigador sostuvo que ambas compañías avanzan hacia lo que describió como una superinteligencia capaz de mejorar sus propias capacidades. También afirmó que desarrolladores del sector creen que sistemas futuros podrían provocar una catástrofe humana antes del final de la década. Esa advertencia expresa su evaluación personal y no constituye un resultado científico demostrado.
Los medios consultados indicaron que Anthropic no había emitido una respuesta corporativa específica sobre la renuncia. La compañía mantiene, sin embargo, una política pública que relaciona determinados niveles de capacidad con salvaguardas más exigentes.
Las acusaciones de Coxon y la política de Anthropic
Coxon afirmó que dentro de Anthropic existe conocimiento de los riesgos, pero que la empresa continúa desarrollando modelos porque desconfía de que otros laboratorios actúen responsablemente. Esta descripción corresponde al exempleado y no a una posición reconocida por la compañía.
Su propuesta combina coordinación entre laboratorios y gobiernos con posibles restricciones temporales al aumento de capacidades. Coxon admitió que detener una competencia internacional podría requerir medidas costosas, incluida una prohibición temporal de seguir mejorando los modelos.

El planteamiento se suma a otras propuestas para restringir la superinteligencia artificial en EEUU. En este caso, la diferencia es que la advertencia procede de un investigador que trabajó directamente en el preentrenamiento de sistemas de OpenAI y Anthropic.
Anthropic mantiene la versión 3.4 de su Responsible Scaling Policy, un marco voluntario que establece umbrales de capacidad y salvaguardas asociadas. La política contempla que la empresa pueda pausar el desarrollo cuando considere que corresponde, pero no equivale a una regulación externa ni garantiza que todos los riesgos técnicos estén resueltos.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
La respuesta de Evan Hubinger y los límites de su estimación
Evan Hubinger, responsable de ciencia de alineación en Anthropic, respondió públicamente que compartía la preocupación central de Coxon. La alineación reúne técnicas destinadas a mantener el comportamiento de sistemas avanzados dentro de objetivos y límites definidos por sus desarrolladores.
Hubinger asignó personalmente una probabilidad superior al 10% a un escenario de extinción humana dentro de una década. La cifra es una estimación subjetiva del investigador: no representa una previsión corporativa de Anthropic, una medición científica ni una probabilidad consensuada entre especialistas.
También declaró que Anthropic todavía no dispone de un plan para resolver la alineación de una eventual superinteligencia y que, según su evaluación, la empresa no está claramente encaminada a conseguirlo. Sus palabras describen el estado del problema desde su perspectiva profesional, no la ausencia total de controles internos.
La Responsible Scaling Policy cubre la evaluación de capacidades y la adopción progresiva de salvaguardas, mientras que las declaraciones de Coxon y Hubinger cuestionan si esas medidas bastarían frente a sistemas futuros capaces de ampliar sus capacidades. Anthropic no había detallado públicamente medidas adicionales ni un calendario de cambios en respuesta a la renuncia.


