• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
lunes, agosto 24, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

    Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

    Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

    Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

    Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

    Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

    Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

    Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

    Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

    Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

    “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

    “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

    Desde Jimaní, el presidente Abinader convoca a toda la comunidad educativa a iniciar el lunes el año escolar

    Desde Jimaní, el presidente Abinader convoca a toda la comunidad educativa a iniciar el lunes el año escolar

    Johnny Pujols: PRM va en picada y el PLD fortalece su estructura territorial con miras a 2028

    Johnny Pujols: PRM va en picada y el PLD fortalece su estructura territorial con miras a 2028

    Banreservas avanza 15 posiciones en el ranking de los 1,000 bancos más importantes del mundo

    Banreservas respaldará con financiamiento a inversionistas de dos nuevos proyectos residenciales en Punta Bergantín

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      E-commerce en Argentina: cuánto crecieron las compras online en 2026

      E-commerce en Argentina: cuánto crecieron las compras online en 2026

      El régimen de Lula permitió nuevamente las visitas a Bolsonaro, pero pretende censurar sus conversaciones

      El régimen de Lula permitió nuevamente las visitas a Bolsonaro, pero pretende censurar sus conversaciones

      Rusia retiró a su embajador en Reino Unido y profundiza la crisis diplomática con Londres

      Rusia retiró a su embajador en Reino Unido y profundiza la crisis diplomática con Londres

      Peter Lamelas llamó a reemplazar la tecnología china en Vaca Muerta

      Peter Lamelas llamó a reemplazar la tecnología china en Vaca Muerta

      CABA habilitó pruebas de autos autónomos y robots de reparto en las calles

      CABA habilitó pruebas de autos autónomos y robots de reparto en las calles

      Arvid Limblad respaldó a Franco Colapinto y cuestionó duramente la sanción: "Fue bastante extrema"

      Arvid Limblad respaldó a Franco Colapinto y cuestionó duramente la sanción: «Fue bastante extrema»

      Argentina y Brasil desarrollaron un interceptor FPV contra drones hostiles

      Argentina y Brasil desarrollaron un interceptor FPV contra drones hostiles

      Franco Colapinto no ocultó su bronca por las sanciones recibidas en el GP de Países Bajos: "Les hace falta criterio"

      Franco Colapinto no ocultó su bronca por las sanciones recibidas en el GP de Países Bajos: «Les hace falta criterio»

      El etíope Yomif Kejelcha ganó la Media Maratón de Buenos Aires y marcó un nuevo récord mundial

      El etíope Yomif Kejelcha ganó la Media Maratón de Buenos Aires y marcó un nuevo récord mundial

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Abinader inicia este lunes el programa “LA Agenda Semanal” sin la prensa

        Abinader inicia este lunes el programa “LA Agenda Semanal” sin la prensa

        Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

        Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

        Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

        Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

        Especialista revela la diabetes aumenta a un 17% y afecta alrededor de dos millones de dominicanos

        Especialista revela la diabetes aumenta a un 17% y afecta alrededor de dos millones de dominicanos

        Juan Salas concluye cinco años de transformación histórica en la Defensa Civil

        Juan Salas concluye cinco años de transformación histórica en la Defensa Civil

        Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

        Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

        Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

        Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

        Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

        Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

        “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

        “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Advierte año escolar iniciará con problemas de fondo ante un...

          Advierte año escolar iniciará con problemas de fondo ante un…

          Entérese quienes se integraron al proyecto presidencial de...

          Entérese quienes se integraron al proyecto presidencial de…

          FP pide interpelar al ministro de Educación Luis Miguel De Camps por dificultades previo al inicio del año escolar

          FP pide interpelar al ministro de Educación Luis Miguel De Camps por dificultades previo al inicio del año escolar

          Colombia Alcántara será moderadora del XIX congreso...

          Colombia Alcántara será moderadora del XIX congreso…

          Milton Morrison reafirma alianza con Abinader y anuncia nueva...

          Milton Morrison reafirma alianza con Abinader y anuncia nueva…

          Empresarios de Hato Mayor expresan respaldo a Leonel Fernández y fortalecen proyecto político rumbo a 2028

          Empresarios de Hato Mayor expresan respaldo a Leonel Fernández y fortalecen proyecto político rumbo a 2028

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                New Zealand moves to ban children under 16 from social media

                New Zealand moves to ban children under 16 from social media

                Kenya: Four arrested over suspected poisoning of elephants

                Kenya: Four arrested over suspected poisoning of elephants

                Zambia elections: Courts sealed as election petition deadline looms

                Zambia elections: Courts sealed as election petition deadline looms

                Hawk fire: 90,000 told to evacuate as wildfire approaches Reno, Nevada

                Hawk fire: 90,000 told to evacuate as wildfire approaches Reno, Nevada

                Diego Maradona's 'Hand of God' football from 1986 World Cup win over England sells for £2.5m

                Diego Maradona’s ‘Hand of God’ football from 1986 World Cup win over England sells for £2.5m

                China probes use of formaldehyde to keep cabbages fresh

                China probes use of formaldehyde to keep cabbages fresh

                Burnham to hand long-range missile blueprints as he visits Kyiv

                Burnham to hand long-range missile blueprints as he visits Kyiv

                Divorce, smartphones and control - BBC sees how Taliban run Afghanistan

                Divorce, smartphones and control – BBC sees how Taliban run Afghanistan

                Shein aims for almost $27bn valuation in stock market debut

                Shein aims for almost $27bn valuation in stock market debut

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  El chip mainframe de próxima generación de IBM es el primero en ejecutar cargas de trabajo Arm y Z en los mismos núcleos

                  El chip mainframe de próxima generación de IBM es el primero en ejecutar cargas de trabajo Arm y Z en los mismos núcleos

                  El primer ministro de Nueva Zelanda propone prohibir a los niños el uso de las redes sociales

                  El primer ministro de Nueva Zelanda propone prohibir a los niños el uso de las redes sociales

                  Zelenskyy detalla su ruptura con el destituido ministro de Defensa de Ucrania, Fedorov

                  Zelenskyy detalla su ruptura con el destituido ministro de Defensa de Ucrania, Fedorov

                  Enterprise AI agents are only as reliable as the messiest documents behind them

                  Enterprise AI agents are only as reliable as the messiest documents behind them

                  China pospone abruptamente el lanzamiento de la ambiciosa misión lunar Chang'e-7

                  China pospone abruptamente el lanzamiento de la ambiciosa misión lunar Chang’e-7

                  Las empresas que ganan con agentes de IA están limitando cuánto pueden hacer los agentes solos

                  Las empresas que ganan con agentes de IA están limitando cuánto pueden hacer los agentes solos

                  Robots humanoides chinos baten récords humanos en 100 m de velocidad y salto de altura en juegos de robots de Beijing

                  Robots humanoides chinos baten récords humanos en 100 m de velocidad y salto de altura en juegos de robots de Beijing

                  Se acerca un eclipse lunar casi total con América en posición privilegiada

                  Se acerca un eclipse lunar casi total con América en posición privilegiada

                  Uber multada con casi mil millones de dólares por reguladores holandeses por suspensiones automáticas de cuentas

                  Uber multada con casi mil millones de dólares por reguladores holandeses por suspensiones automáticas de cuentas

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    La emisora ​​holandesa boicoteará nuevamente Eurovisión, calificándola de "plataforma para la división"

                    La emisora ​​holandesa boicoteará nuevamente Eurovisión, calificándola de «plataforma para la división»

                    Muere Shelley Fabares, cantante de 'Johnny Angel' y actor de 'The Donna Reed Show' y 'Coach', a los 82 años

                    Muere Shelley Fabares, cantante de ‘Johnny Angel’ y actor de ‘The Donna Reed Show’ y ‘Coach’, a los 82 años

                    La Orquesta Sinfónica de Boston y los músicos extienden el contrato por 48 horas, retrasando una posible primera huelga

                    La Orquesta Sinfónica de Boston y los músicos extienden el contrato por 48 horas, retrasando una posible primera huelga

                    La compositora de Motown, Janie Bradford Hobbs, muere en Los Ángeles después de una enfermedad a los 87 años

                    La compositora de Motown, Janie Bradford Hobbs, muere en Los Ángeles después de una enfermedad a los 87 años

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    China investiga a un comediante que alteró la letra de una canción revolucionaria en el escenario

                    El príncipe Harry y otras seis personas conocerán el costo inicial del caso fallido del Daily Mail

                    El príncipe Harry y otras seis personas conocerán el costo inicial del caso fallido del Daily Mail

                    Los fiscales volverán a juzgar a Yung Filly por tres cargos de violación en Australia

                    Los fiscales volverán a juzgar a Yung Filly por tres cargos de violación en Australia

                    El jurado escucha a 'Keffe D' decir que su sobrino disparó fatalmente a Tupac Shakur en un tiroteo desde un vehículo en 1996

                    El jurado escucha a ‘Keffe D’ decir que su sobrino disparó fatalmente a Tupac Shakur en un tiroteo desde un vehículo en 1996

                    Una pregunta surge sobre el regreso de Harry al Reino Unido. ¿Podrá reconstruir su relación con el príncipe William?

                    Una pregunta surge sobre el regreso de Harry al Reino Unido. ¿Podrá reconstruir su relación con el príncipe William?

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

                      Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

                      Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

                      Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

                      Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

                      Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

                      Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

                      Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

                      Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

                      Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

                      “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

                      “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

                      Desde Jimaní, el presidente Abinader convoca a toda la comunidad educativa a iniciar el lunes el año escolar

                      Desde Jimaní, el presidente Abinader convoca a toda la comunidad educativa a iniciar el lunes el año escolar

                      Johnny Pujols: PRM va en picada y el PLD fortalece su estructura territorial con miras a 2028

                      Johnny Pujols: PRM va en picada y el PLD fortalece su estructura territorial con miras a 2028

                      Banreservas avanza 15 posiciones en el ranking de los 1,000 bancos más importantes del mundo

                      Banreservas respaldará con financiamiento a inversionistas de dos nuevos proyectos residenciales en Punta Bergantín

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        E-commerce en Argentina: cuánto crecieron las compras online en 2026

                        E-commerce en Argentina: cuánto crecieron las compras online en 2026

                        El régimen de Lula permitió nuevamente las visitas a Bolsonaro, pero pretende censurar sus conversaciones

                        El régimen de Lula permitió nuevamente las visitas a Bolsonaro, pero pretende censurar sus conversaciones

                        Rusia retiró a su embajador en Reino Unido y profundiza la crisis diplomática con Londres

                        Rusia retiró a su embajador en Reino Unido y profundiza la crisis diplomática con Londres

                        Peter Lamelas llamó a reemplazar la tecnología china en Vaca Muerta

                        Peter Lamelas llamó a reemplazar la tecnología china en Vaca Muerta

                        CABA habilitó pruebas de autos autónomos y robots de reparto en las calles

                        CABA habilitó pruebas de autos autónomos y robots de reparto en las calles

                        Arvid Limblad respaldó a Franco Colapinto y cuestionó duramente la sanción: "Fue bastante extrema"

                        Arvid Limblad respaldó a Franco Colapinto y cuestionó duramente la sanción: «Fue bastante extrema»

                        Argentina y Brasil desarrollaron un interceptor FPV contra drones hostiles

                        Argentina y Brasil desarrollaron un interceptor FPV contra drones hostiles

                        Franco Colapinto no ocultó su bronca por las sanciones recibidas en el GP de Países Bajos: "Les hace falta criterio"

                        Franco Colapinto no ocultó su bronca por las sanciones recibidas en el GP de Países Bajos: «Les hace falta criterio»

                        El etíope Yomif Kejelcha ganó la Media Maratón de Buenos Aires y marcó un nuevo récord mundial

                        El etíope Yomif Kejelcha ganó la Media Maratón de Buenos Aires y marcó un nuevo récord mundial

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Abinader inicia este lunes el programa “LA Agenda Semanal” sin la prensa

                          Abinader inicia este lunes el programa “LA Agenda Semanal” sin la prensa

                          Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

                          Abinader es reconocido por su visión y aportes al éxito de los XXV Juegos Centroamericanos y del Caribe Santo Domingo 2026

                          Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

                          Abinader retoma La Semanal a partir de este lunes con enfoque de «Agenda de Trabajo»

                          Especialista revela la diabetes aumenta a un 17% y afecta alrededor de dos millones de dominicanos

                          Especialista revela la diabetes aumenta a un 17% y afecta alrededor de dos millones de dominicanos

                          Juan Salas concluye cinco años de transformación histórica en la Defensa Civil

                          Juan Salas concluye cinco años de transformación histórica en la Defensa Civil

                          Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

                          Roberto Casaá: Acusación de ADP sobre libros de historia es temeraria, deshonesta y luce que no los han leído

                          Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

                          Director del SNS designa nuevos directores en hospitales Padre Billini, Galván, Jaime Mota y Vicente Noble

                          Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

                          Leonel asegura PRM no pudo mantener programa de 24 horas de energía: “El pueblo se cansó”

                          “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

                          “En Los Alcarrizos lo que se respira es Leonel”, afirma vicealcaldesa que dejó el PRM para ingresar a la FP

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Advierte año escolar iniciará con problemas de fondo ante un...

                            Advierte año escolar iniciará con problemas de fondo ante un…

                            Entérese quienes se integraron al proyecto presidencial de...

                            Entérese quienes se integraron al proyecto presidencial de…

                            FP pide interpelar al ministro de Educación Luis Miguel De Camps por dificultades previo al inicio del año escolar

                            FP pide interpelar al ministro de Educación Luis Miguel De Camps por dificultades previo al inicio del año escolar

                            Colombia Alcántara será moderadora del XIX congreso...

                            Colombia Alcántara será moderadora del XIX congreso…

                            Milton Morrison reafirma alianza con Abinader y anuncia nueva...

                            Milton Morrison reafirma alianza con Abinader y anuncia nueva…

                            Empresarios de Hato Mayor expresan respaldo a Leonel Fernández y fortalecen proyecto político rumbo a 2028

                            Empresarios de Hato Mayor expresan respaldo a Leonel Fernández y fortalecen proyecto político rumbo a 2028

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  New Zealand moves to ban children under 16 from social media

                                  New Zealand moves to ban children under 16 from social media

                                  Kenya: Four arrested over suspected poisoning of elephants

                                  Kenya: Four arrested over suspected poisoning of elephants

                                  Zambia elections: Courts sealed as election petition deadline looms

                                  Zambia elections: Courts sealed as election petition deadline looms

                                  Hawk fire: 90,000 told to evacuate as wildfire approaches Reno, Nevada

                                  Hawk fire: 90,000 told to evacuate as wildfire approaches Reno, Nevada

                                  Diego Maradona's 'Hand of God' football from 1986 World Cup win over England sells for £2.5m

                                  Diego Maradona’s ‘Hand of God’ football from 1986 World Cup win over England sells for £2.5m

                                  China probes use of formaldehyde to keep cabbages fresh

                                  China probes use of formaldehyde to keep cabbages fresh

                                  Burnham to hand long-range missile blueprints as he visits Kyiv

                                  Burnham to hand long-range missile blueprints as he visits Kyiv

                                  Divorce, smartphones and control - BBC sees how Taliban run Afghanistan

                                  Divorce, smartphones and control – BBC sees how Taliban run Afghanistan

                                  Shein aims for almost $27bn valuation in stock market debut

                                  Shein aims for almost $27bn valuation in stock market debut

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    El chip mainframe de próxima generación de IBM es el primero en ejecutar cargas de trabajo Arm y Z en los mismos núcleos

                                    El chip mainframe de próxima generación de IBM es el primero en ejecutar cargas de trabajo Arm y Z en los mismos núcleos

                                    El primer ministro de Nueva Zelanda propone prohibir a los niños el uso de las redes sociales

                                    El primer ministro de Nueva Zelanda propone prohibir a los niños el uso de las redes sociales

                                    Zelenskyy detalla su ruptura con el destituido ministro de Defensa de Ucrania, Fedorov

                                    Zelenskyy detalla su ruptura con el destituido ministro de Defensa de Ucrania, Fedorov

                                    Enterprise AI agents are only as reliable as the messiest documents behind them

                                    Enterprise AI agents are only as reliable as the messiest documents behind them

                                    China pospone abruptamente el lanzamiento de la ambiciosa misión lunar Chang'e-7

                                    China pospone abruptamente el lanzamiento de la ambiciosa misión lunar Chang’e-7

                                    Las empresas que ganan con agentes de IA están limitando cuánto pueden hacer los agentes solos

                                    Las empresas que ganan con agentes de IA están limitando cuánto pueden hacer los agentes solos

                                    Robots humanoides chinos baten récords humanos en 100 m de velocidad y salto de altura en juegos de robots de Beijing

                                    Robots humanoides chinos baten récords humanos en 100 m de velocidad y salto de altura en juegos de robots de Beijing

                                    Se acerca un eclipse lunar casi total con América en posición privilegiada

                                    Se acerca un eclipse lunar casi total con América en posición privilegiada

                                    Uber multada con casi mil millones de dólares por reguladores holandeses por suspensiones automáticas de cuentas

                                    Uber multada con casi mil millones de dólares por reguladores holandeses por suspensiones automáticas de cuentas

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      La emisora ​​holandesa boicoteará nuevamente Eurovisión, calificándola de "plataforma para la división"

                                      La emisora ​​holandesa boicoteará nuevamente Eurovisión, calificándola de «plataforma para la división»

                                      Muere Shelley Fabares, cantante de 'Johnny Angel' y actor de 'The Donna Reed Show' y 'Coach', a los 82 años

                                      Muere Shelley Fabares, cantante de ‘Johnny Angel’ y actor de ‘The Donna Reed Show’ y ‘Coach’, a los 82 años

                                      La Orquesta Sinfónica de Boston y los músicos extienden el contrato por 48 horas, retrasando una posible primera huelga

                                      La Orquesta Sinfónica de Boston y los músicos extienden el contrato por 48 horas, retrasando una posible primera huelga

                                      La compositora de Motown, Janie Bradford Hobbs, muere en Los Ángeles después de una enfermedad a los 87 años

                                      La compositora de Motown, Janie Bradford Hobbs, muere en Los Ángeles después de una enfermedad a los 87 años

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      China investiga a un comediante que alteró la letra de una canción revolucionaria en el escenario

                                      El príncipe Harry y otras seis personas conocerán el costo inicial del caso fallido del Daily Mail

                                      El príncipe Harry y otras seis personas conocerán el costo inicial del caso fallido del Daily Mail

                                      Los fiscales volverán a juzgar a Yung Filly por tres cargos de violación en Australia

                                      Los fiscales volverán a juzgar a Yung Filly por tres cargos de violación en Australia

                                      El jurado escucha a 'Keffe D' decir que su sobrino disparó fatalmente a Tupac Shakur en un tiroteo desde un vehículo en 1996

                                      El jurado escucha a ‘Keffe D’ decir que su sobrino disparó fatalmente a Tupac Shakur en un tiroteo desde un vehículo en 1996

                                      Una pregunta surge sobre el regreso de Harry al Reino Unido. ¿Podrá reconstruir su relación con el príncipe William?

                                      Una pregunta surge sobre el regreso de Harry al Reino Unido. ¿Podrá reconstruir su relación con el príncipe William?

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      Les méta-chercheurs introduisent des « hyperagents » pour débloquer une IA auto-améliorée pour des tâches sans codage

                                      by Jorge Polanco
                                      15 de abril de 2026
                                      in Tecnología
                                      0
                                      Les méta-chercheurs introduisent des « hyperagents » pour débloquer une IA auto-améliorée pour des tâches sans codage
                                      0
                                      SHARES
                                      8
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      La création de systèmes d’IA auto-améliorés constitue une étape importante vers le déploiement d’agents dans des environnements dynamiques, en particulier dans les environnements de production d’entreprise, où les tâches ne sont pas toujours prévisibles ni cohérentes.

                                      Les systèmes d’IA auto-améliorés actuels sont confrontés à de sévères limitations car ils s’appuient sur des mécanismes d’amélioration fixes et fabriqués à la main qui ne fonctionnent que dans des conditions strictes telles que l’ingénierie logicielle.

                                      Pour surmonter ce défi pratique, des chercheurs de Meta et de plusieurs universités ont introduit les « hyperagents », un système d’IA auto-amélioré qui réécrit et optimise en permanence sa logique de résolution de problèmes et le code sous-jacent.

                                      En pratique, cela permet à l’IA de s’améliorer dans des domaines autres que le codage, tels que la robotique et la révision de documents. L’agent invente indépendamment des fonctionnalités à usage général telles que la mémoire persistante et le suivi automatisé des performances.

                                      Plus largement, les hyperagents ne se contentent pas de mieux résoudre des tâches, ils apprennent également à améliorer le cycle d’auto-amélioration pour accélérer les progrès.

                                      Ce cadre peut aider à développer des agents hautement adaptables qui construisent de manière autonome un mécanisme de décision structuré et réutilisable. Cette approche augmente les capacités au fil du temps avec moins de besoin d’ingénierie manuelle constante et de personnalisation humaine spécifique au domaine.

                                      L’IA auto-améliorée actuelle et ses goulots d’étranglement architecturaux

                                      L’objectif principal des systèmes d’IA auto-améliorés est d’améliorer continuellement leurs propres capacités d’apprentissage et de résolution de problèmes. Cependant, la plupart des modèles d’auto-amélioration existants reposent sur un « méta-agent » fixe. Ce système de supervision statique de haut niveau est conçu pour modifier un système de base.

                                      «La principale limitation des méta-agents fabriqués à la main est qu’ils ne peuvent s’améliorer qu’à mesure que les humains peuvent les concevoir et les maintenir», a déclaré à VentureBeat Jenny Zhang, co-auteur de l’article. «Chaque fois que quelque chose change ou se brise, une personne doit intervenir et mettre à jour les règles ou la logique.»

                                      Au lieu d’une limite théorique abstraite, cela crée un « mur de maintenance » pratique.

                                      Le paradigme actuel lie directement l’amélioration du système à la vitesse d’itération humaine, ce qui ralentit les progrès car il repose fortement sur des efforts d’ingénierie manuels plutôt que sur une mise à l’échelle basée sur l’expérience collectée par les agents.

                                      Pour surmonter cette limitation, les chercheurs affirment que le système d’IA doit être « entièrement autoréférentiel ». Ces systèmes doivent être capables d’analyser, d’évaluer et de réécrire n’importe quelle partie d’eux-mêmes sans les contraintes de leur configuration initiale. Cela permet au système d’IA de s’affranchir des limites structurelles et de s’auto-accélérer.

                                      Machine Darwin Godel (source : Sakana AI)

                                      Un exemple de système d’IA autoréférentiel est la Darwin Gödel Machine (DGM) de Sakana AI, un système d’IA qui s’améliore en réécrivant son propre code.

                                      Dans DGM, un agent génère, évalue et modifie de manière itérative son propre code, en enregistrant les variantes réussies dans une archive pour servir de tremplin pour de futures améliorations. DGM a prouvé qu’une auto-amélioration ouverte et récursive est pratiquement réalisable en matière de codage.

                                      Cependant, le DGM n’est pas à la hauteur lorsqu’il est appliqué à des applications du monde réel en dehors du génie logiciel en raison d’un déficit de compétences critique. Dans DGM, le système s’améliore car l’évaluation et l’auto-modification sont des tâches de codage. Améliorer la capacité de codage de l’agent améliore naturellement sa capacité à réécrire son propre code. Mais si vous déployez DGM pour une tâche d’entreprise autre que le codage, cet alignement échoue.

                                      « Pour des tâches telles que les mathématiques, la poésie ou la révision de documents, l’amélioration de la performance des tâches n’améliore pas nécessairement la capacité de l’agent à modifier son propre comportement », a déclaré Zhang.

                                      Les compétences nécessaires pour analyser des textes subjectifs ou des données commerciales sont totalement différentes des compétences requises pour analyser les échecs et écrire du nouveau code Python pour les corriger.

                                      DGM s’appuie également sur un mécanisme fixe conçu par l’homme pour générer ses instructions d’auto-amélioration. En pratique, si les développeurs d’entreprise souhaitent utiliser DGM pour autre chose que le codage, ils doivent fortement concevoir et personnaliser manuellement les invites d’instructions pour chaque nouveau domaine.

                                      Le framework hyperagent

                                      Pour surmonter les limites des architectures précédentes, les chercheurs introduisent des hyperagents. Le cadre propose «des agents autoréférentiels qui peuvent en principe s’auto-améliorer pour toute tâche calculable».

                                      Dans ce cadre, un agent est tout programme calculable pouvant invoquer des LLM, des outils externes ou des composants appris. Traditionnellement, ces systèmes sont divisés en deux rôles distincts : un « agent de tâche » qui exécute le problème spécifique en question, et un « méta-agent » qui analyse et modifie les agents. Un hyperagent fusionne à la fois l’agent de tâche et le méta-agent en un seul programme autoréférentiel et modifiable.

                                      Parce que le programme entier peut être réécrit, le système peut modifier le mécanisme d’auto-amélioration, un processus que les chercheurs appellent auto-modification métacognitive.

                                      dgm-conceptuel

                                      DGM avec hyperagents (source : arXiv)

                                      « Les hyperagents apprennent non seulement à mieux résoudre les tâches données, mais aussi à s’améliorer », a déclaré Zhang. «Au fil du temps, cela conduit à une accumulation. Les hyperagents n’ont pas besoin de redécouvrir comment s’améliorer dans chaque nouveau domaine. Au lieu de cela, ils conservent et s’appuient sur les améliorations apportées au processus d’auto-amélioration lui-même, permettant aux progrès de s’accumuler entre les tâches.»

                                      Les chercheurs ont étendu la machine Darwin Gödel pour créer des hyperagents DGM (DGM-H). DGM-H conserve la puissante structure d’exploration ouverte du DGM d’origine, qui empêche l’IA de converger trop tôt ou de se retrouver coincée dans des impasses en conservant une archive croissante d’hyperagents performants.

                                      Le système dérive en permanence des candidats sélectionnés dans ces archives, leur permet de s’auto-modifier, évalue les nouvelles variantes sur des tâches données et ajoute celles qui ont réussi dans le pool comme tremplins pour les itérations futures.

                                      En combinant cette recherche évolutive ouverte avec l’auto-modification métacognitive, le DGM-H élimine l’étape d’instruction fixe et conçue par l’homme du DGM original. Cela permet à l’agent de s’améliorer dans n’importe quelle tâche calculable.

                                      Les hyperagents en action

                                      Les chercheurs ont utilisé le benchmark de codage Polyglot pour comparer le cadre hyperagent à l’IA précédente, réservée uniquement au codage. Ils ont également évalué les hyperagents dans des domaines non codants qui impliquent un raisonnement subjectif, l’utilisation d’outils externes et une logique complexe.

                                      Celles-ci comprenaient une révision de documents pour simuler un évaluateur pair produisant des décisions d’acceptation ou de rejet, la conception d’un modèle de récompense pour la formation d’un robot quadrupède et une notation mathématique de niveau Olympiade. La notation mathématique servait de test pour voir si une IA qui avait appris à s’améliorer tout en révisant des articles et en concevant des robots pouvait transférer ces méta-compétences vers un domaine totalement inconnu.

                                      Les chercheurs ont comparé les hyperagents à plusieurs références, y compris des modèles spécifiques à un domaine comme AI-Scientist-v2 pour les revues papier et ProofAutoGrader pour les mathématiques. Ils ont également testé le DGM classique et un DGM personnalisé manuellement pour les nouveaux domaines.

                                      Sur le benchmark de codage, les hyperagents égalaient les performances du DGM bien qu’ils n’aient pas été conçus spécifiquement pour le codage. En matière de révision de documents et de robotique, les hyperagents ont surpassé les bases open source et les fonctions de récompense conçues par l’homme.

                                      Lorsque les chercheurs ont utilisé un hyperagent optimisé pour la révision de documents et la robotique et l’ont déployé sur une tâche de notation mathématique inédite, ils ont obtenu une amélioration de 0,630 en 50 itérations. Les lignes de base reposant sur les architectures DGM classiques sont restées stables à 0,0. L’hyperagent a même battu le ProofAutoGrader spécifique au domaine.

                                      Les expériences ont également mis en évidence des comportements autonomes intéressants de la part des hyperagents. Lors de l’évaluation sur papier, l’agent a d’abord utilisé des astuces standard d’ingénierie d’invite, comme adopter une personnalité rigoureuse. Lorsque cela s’est avéré peu fiable, l’entreprise a réécrit son propre code pour créer un pipeline d’évaluation en plusieurs étapes avec des listes de contrôle explicites et des règles de décision rigides, conduisant à une cohérence beaucoup plus élevée.

                                      Les hyperagents ont également développé de manière autonome un outil de mémoire pour éviter de répéter les erreurs du passé. De plus, le système a écrit un outil de suivi des performances pour enregistrer et surveiller le résultat des changements architecturaux au fil des générations. Le modèle a même développé un comportement tenant compte du budget de calcul, dans lequel il suivait les itérations restantes pour ajuster sa planification. Les premières générations ont exécuté des changements architecturaux ambitieux, tandis que les générations suivantes se sont concentrées sur des raffinements conservateurs et progressifs.

                                      Pour les équipes de données d’entreprise qui se demandent par où commencer, Zhang recommande de se concentrer sur les tâches dont le succès est sans ambiguïté. « Les flux de travail clairement spécifiés et faciles à évaluer, souvent appelés tâches vérifiables, constituent le meilleur point de départ », a-t-elle déclaré. « Cela ouvre généralement de nouvelles opportunités pour un prototypage plus exploratoire, une analyse de données plus exhaustive, des tests A/B plus exhaustifs, [and] une ingénierie de fonctionnalités plus rapide. Pour les tâches plus difficiles et non vérifiées, les équipes peuvent utiliser des hyperagents pour développer d’abord des juges érudits qui reflètent mieux les préférences humaines, créant ainsi un pont vers des domaines plus complexes.

                                      Les chercheurs ont partagé le code des hyperagents, bien qu’il ait été publié sous une licence non commerciale.

                                      Mises en garde et menaces futures

                                      Les avantages des hyperagents introduisent des compromis évidents. Les chercheurs mettent en évidence plusieurs considérations de sécurité concernant les systèmes qui peuvent se modifier de manière de plus en plus ouverte.

                                      Ces systèmes d’IA présentent le risque d’évoluer beaucoup plus rapidement que ce que les humains peuvent auditer ou interpréter. Alors que les chercheurs ont confiné le DGM-H dans des limites de sécurité telles que des environnements en bac à sable conçus pour éviter les effets secondaires involontaires, ces garanties initiales sont en réalité des plans de déploiement pratiques.

                                      Zhang conseille aux développeurs de respecter les limites de ressources et de restreindre l’accès aux systèmes externes pendant la phase d’auto-modification. « Le principe clé est de séparer l’expérimentation du déploiement : permettre à l’agent d’explorer et de s’améliorer dans un bac à sable contrôlé, tout en garantissant que toutes les modifications affectant les systèmes réels sont soigneusement validées avant d’être appliquées », a-t-elle déclaré. Ce n’est qu’une fois que le code nouvellement modifié a réussi les contrôles d’exactitude définis par le développeur qu’il doit être promu vers un paramètre de production.

                                      Un autre danger important réside dans les jeux d’évaluation, dans lesquels l’IA améliore ses mesures sans réaliser de réels progrès vers l’objectif réel visé. Parce que les hyperagents sont pilotés par des signaux d’évaluation empiriques, ils peuvent découvrir de manière autonome des stratégies qui exploitent les angles morts ou les faiblesses de la procédure d’évaluation elle-même pour gonfler artificiellement leurs scores. Pour prévenir ce comportement, les développeurs doivent mettre en œuvre des protocoles d’évaluation diversifiés, robustes et périodiquement actualisés, ainsi qu’une surveillance humaine continue.

                                      À terme, ces systèmes modifieront les responsabilités quotidiennes des ingénieurs humains. Tout comme nous ne recalculons pas chaque opération effectuée par une calculatrice, les futurs ingénieurs en orchestration de l’IA n’écriront pas directement la logique d’amélioration, estime Zhang.

                                      Au lieu de cela, ils concevront les mécanismes d’audit et de tests de résistance du système. « À mesure que les systèmes auto-améliorés deviennent plus performants, la question n’est plus seulement de savoir comment améliorer les performances, mais quels objectifs méritent d’être poursuivis », a déclaré Zhang. « En ce sens, le rôle évolue de la construction de systèmes à l’élaboration de leur orientation.

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      Jorge Polanco

                                      Jorge Polanco

                                      Comunicador | Columnista de Opinión & Análisis especializado en turismo y gestión pública, con una mirada crítica sobre la política turística, el ordenamiento territorial y el discurso institucional del sector

                                      Next Post
                                      Los modelos Frontier fallan en uno de cada tres intentos de producción y cada vez son más difíciles de auditar

                                      Los modelos Frontier fallan en uno de cada tres intentos de producción y cada vez son más difíciles de auditar

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • Arvid Limblad respaldó a Franco Colapinto y cuestionó duramente la sanción: "Fue bastante extrema"

                                        Arvid Limblad respaldó a Franco Colapinto y cuestionó duramente la sanción: «Fue bastante extrema»

                                        0 shares
                                        Share 0 Tweet 0
                                      • Abinader inicia este lunes el programa “LA Agenda Semanal” sin la prensa

                                        0 shares
                                        Share 0 Tweet 0
                                      • Argentina y Brasil desarrollaron un interceptor FPV contra drones hostiles

                                        0 shares
                                        Share 0 Tweet 0
                                      • Enterprise AI agents are only as reliable as the messiest documents behind them

                                        0 shares
                                        Share 0 Tweet 0
                                      • Zelenskyy detalla su ruptura con el destituido ministro de Defensa de Ucrania, Fedorov

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por