El hombre que puso en hora el reloj
Daniel Kokotajlo redactó los escenarios en OpenAI y se marchó cuando dejó de creer en el relato de seguridad de la empresa. Dos horas sobre el setenta por ciento, una fecha que no deja de moverse y dos millones de dólares que al final pudo conservar.
El vídeo solo se carga desde YouTube después de su clic. Antes no se establece ninguna conexión.
El episodio 2 preguntaba si la inteligencia artificial se puede rentabilizar. El episodio 3 pregunta qué ocurre si funciona. Daniel Kokotajlo redactaba previsiones en OpenAI hasta que se marchó en 2024. Su frase de apertura explica por qué esta conversación de más de dos horas no tiene un solo momento ligero: es posible que esté naciendo una nueva especie que acabe dominando el mundo, dice, con un setenta por ciento de probabilidades de que todo salga terriblemente mal. Vídeo desde 0:00:07
El testigoQuién habla — y qué ha visto
Kokotajlo se incorporó a OpenAI en 2022, en el equipo de gobernanza. Su trabajo consistía en medir el progreso y redactar escenarios, el germen interno de lo que más tarde se conocería públicamente como AI 2027. No era un ingeniero que entrenara modelos. Era quien debía dejar por escrito hacia dónde apuntaban las curvas. Vídeo desde 0:00:26
Lo que lo desgastó no fue la tecnología, sino la distancia entre lo que se dice y lo que se hace. El relato de seguridad de los grandes laboratorios, sostiene, funciona más como justificación a posteriori que como freno real. Cita correos surgidos del litigio entre Elon Musk y OpenAI en los que los fundadores escribían en 2017 que una de las razones para crear la empresa era el temor a que Demis Hassabis pudiera convertirse, gracias a una IA general, en una suerte de dictador. Vídeo desde 0:12:33 Su regla para juzgar a los líderes del sector es tajante: se juzga a las personas por sus actos, no por sus palabras. Vídeo desde 0:13:21
Hay una escena que queda grabada. Tras el éxito de ChatGPT se celebró una reunión general, y el entonces jefe de investigación, Ilya Sutskever, resumió el ambiente en una frase: concentrémonos en la misión, tenemos que construir la IA general. Vídeo desde 0:16:38 Kokotajlo dimitió en 2024. Vídeo desde 0:14:49
Los dos millonesLo que promete el título — y lo que él dice en realidad
El título del vídeo promete una historia de soborno: dos millones de dólares por guardar silencio. En apenas un minuto, el propio Kokotajlo lo desmonta. Cuando Bartlett repite la cifra, lo interrumpe: al final pudo quedarse con el dinero. Vídeo desde 0:17:25
Lo que ocurrió fue otra cosa. Los papeles de su salida incluían una cláusula que le prohibía de por vida criticar a la empresa, y una segunda que le prohibía siquiera mencionar la primera. Para una organización nacida para beneficiar a toda la humanidad, le pareció llamativo. Quien no firmaba perdía su participación accionarial. En su caso, eso equivalía a cerca del ochenta por ciento del patrimonio familiar. Él y su esposa lo hablaron, consultaron con abogados, y no firmó. Vídeo desde 0:18:25
Después el asunto salió a la luz, empleados empezaron a preguntar internamente, y la empresa retiró la cláusula: olvídenlo, conservan su participación. Vídeo desde 0:18:58 La dirección afirmó después que no sabía nada al respecto. Él no se lo cree. Vídeo desde 0:19:10
El resultado: la renuncia fue real y estaba pensada para costarle caro. Pero el dinero no lo perdió. Quien se quede con el título al pie de la letra no ha visto la conversación.
La cifraSetenta por ciento — y lo que no significa
El setenta por ciento es una estimación personal, no una medición. No equivale a «setenta por ciento de extinción», sino a una gran catástrofe que puede incluir tanto la pérdida de control como la toma del poder por un grupo muy reducido. Bartlett le opone otra cifra: un líder del sector habla de un siete por ciento. La respuesta de Kokotajlo es la imagen más contundente de toda la conversación: si hubiera cien botones sobre una mesa y diez de ellos acabaran con el mundo, nadie hablaría de un riesgo pequeño. Vídeo desde 0:41:37
Ese es el verdadero argumento, y no depende de su porcentaje concreto. Incluso quien se queda con el siete por ciento sigue hablando de un riesgo que en ningún otro sector económico se permitiría asumir.
El calendario2027, 2028, 2030: una fecha que se desplaza
Su estimación media actual para el momento en que los sistemas superen en todo a los mejores humanos se sitúa en 2029. Vídeo desde 0:03:20 Añade que también podría tardar bastante más. Lo más llamativo es cuántas veces se ha retrasado ya esa fecha: de 2027 a 2028, y luego a 2030. Vídeo desde 0:23:24 Ahora, dice, desde los laboratorios le aconsejan volver a moverla hacia atrás.
El escenario AI 2027 nunca fue una predicción, sino un recorrido calculado mes a mes, con dos desenlaces posibles: la carrera, en la que los sistemas acaban dejando de obedecer, y la desaceleración, en la que el control se mantiene pero el poder termina concentrado en muy pocas manos. Vídeo desde 0:25:19 Bartlett insiste en saber cuál de esos documentos llegó a leer el vicepresidente. Vídeo desde 0:24:07
Un escenario convence precisamente porque es concreto. Y ahí está también su debilidad: cada etapa tiene que cumplirse más o menos como se describe, o la cadena se rompe. Que sus autores hayan retrasado varias veces sus propias estimaciones medias habla bien de su honestidad, y mal del dramatismo del año que aparece en el título.
La estrategiaPor qué los laboratorios se automatizan primero a sí mismos
El plan de las grandes empresas, tal como él lo expone, es sencillo. Primero se automatiza la programación, luego toda la actividad investigadora: ideas, evaluación, comunicación. Al final del camino hay un laboratorio que ya no necesita empleados humanos, porque un ejército de copias de un mismo modelo entrena a la siguiente generación. El jefe de Anthropic lo llama un país de genios dentro de un centro de datos; Kokotajlo cree que «ejército» es la palabra más exacta, porque todas esas copias pertenecen a un único dueño. Vídeo desde 0:06:40
Y lo respalda con la única cifra realmente medida de toda la noche: en 2020, los modelos más grandes tenían alrededor de 175.000 millones de parámetros. Vídeo desde 0:34:51 Hoy esa magnitud ronda los diez billones. Vídeo desde 0:31:52 Dos órdenes de magnitud en seis años.
El empleoPor qué la ola llega tarde — y de golpe
Aquí contradice la expectativa más extendida. En su escenario, el desempleo masivo no llega al principio, sino al final, después de 2028. La razón es la misma de antes: los laboratorios automatizan primero su propia investigación, no la economía en general. Por eso, durante mucho tiempo apenas se nota nada visible, y luego ocurre casi todo de golpe. Vídeo desde 0:57:22
Para el debate a este lado del Atlántico, es el punto más incómodo de la conversación. Quien hoy señala unas cifras de empleo estables para dar tranquilidad está midiendo, según esta lógica, exactamente lo que no debería.
Plan AEl escenario alternativo que él mismo considera poco probable
La segunda mitad de la conversación gira en torno a lo que él opone a todo esto: AI 2040. La idea no es impedir la superinteligencia, sino retrasarla diez años, mediante regulación, obligaciones de transparencia y un acuerdo verificable entre Estados Unidos y China. Vídeo desde 1:00:28 En su cronología, en 2031 una máquina realiza ya una quinta parte del trabajo intelectual Vídeo desde 1:22:11; en 2033 hay sesenta millones de sistemas funcionando a cien veces la velocidad humana Vídeo desde 1:25:21; y las ganancias se reparten como un dividendo ciudadano: unos 25.000 dólares al año por persona al comienzo. Vídeo desde 1:26:20 El freno no se suelta hasta 2040. Vídeo desde 1:30:37
La respuesta más honesta de la noche llega cuando Bartlett le pregunta cuál de sus cinco planes considera más probable. No es el plan A. Es el plan en el que todo sigue igual que hasta ahora. Vídeo desde 1:05:39
El botónCómo termina la conversación
Bartlett le plantea un experimento mental: un botón que detendría para siempre el desarrollo en la frontera tecnológica. Kokotajlo se revuelve visiblemente incómodo. Ante una pausa temporal, lo pulsaría sin dudar. Ante una definitiva, duda, y al final no lo pulsa, porque considera que el beneficio potencial es demasiado grande como para arrebatárselo a la humanidad para siempre. Vídeo desde 1:46:29
Su mensaje final es más modesto de lo que sugiere el título. No es demasiado tarde, dice; si lo fuera, no estaría aquí, sino con su familia. Vídeo desde 1:57:29 Lo que pide a quienes escuchan no es una revuelta, sino lo contrario de mirar hacia otro lado: informarse, formarse una opinión y preguntar a los candidatos al respecto. Vídeo desde 1:59:14
La contrapruebaLo que no hay que darle por bueno sin más
Tres cosas forman parte de un balance honesto. Primero, la cifra del setenta por ciento es una opinión, no una medición; otras personas bien informadas la sitúan en el diez o el veinte por ciento, y no existe consenso experto. Segundo, la afirmación de que dentro de los laboratorios se cree en plazos aún más cortos no puede verificarse desde fuera, y quien se toma en serio la seguridad tiende, de todos modos, a hablar antes con él que con otros. Tercero, de «muy poderoso» no se deriva automáticamente su propuesta política; un acuerdo verificable entre dos grandes potencias sobre una tecnología que nace en centros de datos nunca ha funcionado bien históricamente.
Lo que todo esto no toca: su salida, las cláusulas, las curvas y la pregunta de quién decide sobre una tecnología capaz de construir a sus propios sucesores.
ContextoQué significa esto para Europa
El cálculo de Kokotajlo es un cálculo americano, y su contrapropuesta también lo es: el plan A habla de Washington y Pekín. En dos horas, Europa no aparece ni una sola vez. No es mala intención, sino una descripción del terreno. Las decisiones sobre sistemas que acabarán en administraciones, hospitales y fábricas de aquí se toman en dos lugares donde a nadie le importa Europa.
El segundo punto tiene que ver con el momento del control. Su plan exige pruebas antes de entrenar un sistema, no una vez que ya está en el mercado. Justo ahí termina el alcance de las normas europeas, centradas en el producto acabado. Quien participe en este debate aquí debería conocer esa distinción, porque de ella depende que los organismos supervisores lleguen a ver algo.
Y en tercer lugar, el empleo. Su tesis de que durante mucho tiempo apenas pasa nada y luego ocurre todo de golpe se traduce de forma distinta en un mercado laboral con convenios colectivos, expedientes de regulación temporal y largos plazos de preaviso que en el estadounidense. Más lento en el impacto, más difícil de corregir. Ambas cosas deberían formar parte de cualquier planificación que se haga hoy para los próximos cinco años.
Resumen y contexto de kipode.de. El texto es propio; las afirmaciones remiten al original mediante marca de tiempo. El vídeo procede de The Diary of a CEO y se integra a través del reproductor oficial de YouTube. No es una traducción oficial ni existe vínculo con el pódcast.
Lo que se dice allí, legible aquí.
Transatlantik es la sección de kipode.de dedicada a los debates estadounidenses sobre inteligencia artificial. Escuchamos las conversaciones enteras, las resumimos con nuestras palabras y añadimos marcas de tiempo al original para que cada afirmación pueda comprobarse.
Al final va la pregunta que allí nadie hace: ¿qué significa esto para nosotros, en Europa? Cada episodio está en alemán, inglés, francés y español.