● Jacob Coxon, investigador británico de 27 años, renunció a Anthropic este martes 8 de septiembre y dejó una acusación directa contra dos de las empresas que lideran la carrera de la inteligencia artificial: sostuvo que Anthropic y OpenAI avanzan hacia sistemas capaces de mejorarse a sí mismos sin contar todavía con garantías suficientes para mantenerlos bajo control.
● Coxon trabajó durante unos tres años en investigación de preentrenamiento entre OpenAI y Anthropic. Había pasado a esta última compañía en julio y, al anunciar su salida, afirmó que ambas empresas están corriendo hacia una “superinteligencia capaz de mejorarse a sí misma” mientras sus propios investigadores contemplan escenarios en los que esa tecnología podría provocar una catástrofe global.
● La advertencia tomó otra dimensión cuando Evan Hubinger, uno de los responsables de investigación en alineamiento de Anthropic, respaldó públicamente parte del planteo. Hubinger dijo que personalmente asigna una probabilidad superior al 10% a que una futura inteligencia artificial termine causando la muerte de toda la humanidad dentro de la próxima década.
● Hubinger también reconoció un punto clave: Anthropic todavía no tiene un plan para resolver el alineamiento de una eventual superinteligencia y, según escribió, tampoco está claramente encaminada a conseguirlo. “Alineamiento” es el área que busca lograr que sistemas cada vez más capaces mantengan objetivos y comportamientos compatibles con las intenciones y límites definidos por los humanos.
● La aclaración es central para no deformar la advertencia: Hubinger no dijo que la inteligencia artificial disponible hoy tenga más de 10% de probabilidades de exterminar a la humanidad. Señaló que considera bajo el riesgo de los modelos actuales y que su preocupación está puesta en una posible superinteligencia surgida mediante automejora recursiva, con sistemas participando cada vez más en el desarrollo de sus propios sucesores.
● Samuel Marks, otro investigador de seguridad de Anthropic, también respaldó públicamente la preocupación general y afirmó que dentro de la industria hay desarrolladores que consideran posibles escenarios de extinción humana u otras consecuencias catastróficas. Anthropic, mientras tanto, continúa investigando técnicas de supervisión, evaluación y control para modelos más avanzados, pero reconoce que el problema de alinear una superinteligencia aún no está resuelto.
📲 Sumate ya a nuestro canal de WhatsApp y no te pierdas nada








