Andrej Karpathy, el influyente investigador eslovaco-canadiense en IA de 39 años y uno de los 11 cofundadores originales de OpenAIy exjefe de la división de inteligencia artificial de Tesla, anunció el martes 19 de mayo que se unirá al laboratorio rival Anthropic.
Como Karpatía publicado desde su cuenta en la red social X: «Actualización personal: me uní a Anthropic. Creo que los próximos años en la frontera de los LLM serán especialmente formativos. Estoy muy emocionado de unirme al equipo aquí y volver a I+D. Sigo siendo un apasionado de la educación y planeo reanudar mi trabajo en ella a tiempo».
El actual jefe de capacitación previa de Anthropic, Nicholas Joseph, también ex alumno de OpenAI, agregó más contexto al nuevo rol de Karpathy en Anthropic en una publicación propia en X, escribiendo: «¡Estoy emocionado de darle la bienvenida a Andrej al equipo de Pretraining! Formará un equipo centrado en utilizar a Claude para acelerar la investigación previa al entrenamiento. No se me ocurre nadie mejor preparado para hacerlo. ¡Estoy deseando ver lo que construimos juntos!».
Un portavoz de Anthropic confirmó a VentureBeat por correo electrónico que Karpathy formará un equipo centrado en utilizar Claude, el modelo de IA cada vez más popular de Anthropic, para acelerar la investigación previa al entrenamiento. Esto acercaría a Anthropic aún más hacia el objetivo general de investigación de IA de muchos en todo el mundo de desarrollar «superación personal recursiva,» es decir, IA que es capaz de entrenar a sus sucesores o mejorarse a sí misma con una intervención humana cada vez menor o, en última instancia, nula.
El anuncio se produjo el mismo día del inicio de la conferencia anual de desarrolladores de E/S de la empresa rival de tecnología centrada en la IA, Google, en su ciudad sede de Mountain View, California, cuando se esperaban muchos nuevos lanzamientos y anuncios.
La histórica historia de Karpathy
Karpathy es ampliamente conocido por abarcar tres partes del auge moderno de la IA: investigación académica, implementación de grandes empresas y educación en línea.
Su propio sitio web Lo describe como un investigador y educador de IA que fue miembro fundador de OpenAI, luego se desempeñó como Director de IA en Tesla y ayudó a crear el primer curso de aprendizaje profundo de Stanford, CS231n.
El anuncio de lanzamiento de OpenAI en diciembre de 2015 también incluyó a Karpathy entre los miembros fundadores del grupo.
En Tesla, donde trabajó de 2017 a 2022, Karpathy dirigió el equipo de visión por computadora de Autopilot y dice que su equipo manejó el etiquetado de datos interno, el entrenamiento de redes neuronales y la implementación en el chip de inferencia personalizado de Tesla.
Luego regresó a OpenAI de 2023 a 2024, donde su sitio web dice que creó un equipo centrado en el entrenamiento medio y la generación de datos sintéticos, una experiencia directamente relevante para el rol de preentrenamiento informado de Anthropic.
El trabajo académico de Karpathy comenzó en Stanford, donde obtuvo su doctorado con Fei-Fei Li y se centró en redes neuronales para la visión por computadora, el procesamiento del lenguaje natural y la intersección de ambos.
También realizó prácticas en Google Brain, Google Research y DeepMind, según su sitio web. Su educación incluye una maestría de la Universidad de Columbia Británica y una licenciatura de la Universidad de Toronto, donde obtuvo una doble especialización en informática y física.
¿Qué será de la investigación de código abierto de Karpathy y su compromiso con la educación en IA?
Desde que dejó OpenAI en 2024, Karpathy se ha convertido en uno de los educadores públicos de IA más visibles, y publica vídeos técnicos y para audiencia general sobre grandes modelos de lenguaje y redes neuronales.
También lanzó Eureka Labs en julio de 2024 como una escuela “nativa de IA”; su primer producto, LLM101nse describe como un curso de nivel universitario que guía a los estudiantes a través del entrenamiento de su propio sistema de IA.
Actuando por su cuenta como agente libre durante los últimos dos años, Karpathy también ha ayudado a impulsar la investigación de IA de código abierto con productos y estándares que incluyen investigación automáticaun investigador automatizado impulsado por un LLM que puede ejecutar múltiples hipótesis y experimentos simultáneamente, y el Base de conocimientos de LLMun sistema autónomo de almacenamiento de memoria y contexto para agentes de IA en una especie de biblioteca en constante crecimiento diseñada para que puedan acceder.
La gran pregunta es qué pasa con estos y los esfuerzos de Karpathy en materia de IA de código abierto en general cuando se une a Anthropic, un laboratorio que ha apoyado el código abierto a través del lanzamiento de su estándar técnico Model Context Protocol (MCP), pero que también ha enviado modelos y arneses de IA principalmente propietarios (como Claude y Claude Code).
Basado en la última declaración en su publicación de anuncio en X – «Sigo siendo un apasionado de la educación y planeo retomar mi trabajo en ella a tiempo» – parece que al menos sus contribuciones al esfuerzo escolar nativo de IA se detendrán mientras profundiza en Anthropic.
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.













































































