• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
domingo, agosto 16, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

    Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

    Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

    Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

    Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

    Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

    Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

    Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

    Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

    Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

    Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

    Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

    Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

    Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

    ADOCALZA respalda mecanismos de INABIE y defiende capacidad de fabricantes nacionales

    ADOCALZA respalda mecanismos de INABIE y defiende capacidad de fabricantes nacionales

    Diputado Wendy Batista: “Código Penal lo satanizaron; Cree en acumulación de penas, en algunos casos

    Diputado Wendy Batista: “Código Penal lo satanizaron; Cree en acumulación de penas, en algunos casos

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      Evangelina Anderson recordó el momento en que les contó a sus hijos sobre su separación: “No estaba preparada”

      Evangelina Anderson recordó el momento en que les contó a sus hijos sobre su separación: “No estaba preparada”

      Abelardo le ordenó por Twitter a una ministra echar a todos los izquierdistas de su ministerio

      Abelardo le ordenó por Twitter a una ministra echar a todos los izquierdistas de su ministerio

      La Guardia Civil confirmó 15 violaciones en Ceuta tras la invasión de inmigrantes ilegales marroquíes

      La Guardia Civil confirmó 15 violaciones en Ceuta tras la invasión de inmigrantes ilegales marroquíes

      El secretario de Asuntos Nucleares de Milei dejó en ridículo al kirchnerista Jorge Taiana

      El secretario de Asuntos Nucleares de Milei dejó en ridículo al kirchnerista Jorge Taiana

      La mentira noble nunca salva a quienes pretende proteger

      La mentira noble nunca salva a quienes pretende proteger

      Claude lanzará una marca de agua invisible para detectar textos generados con IA

      Claude lanzará una marca de agua invisible para detectar textos generados con IA

      Lula postergó la llegada del embajador de EEUU en Brasil hasta después de las elecciones

      Lula postergó la llegada del embajador de EEUU en Brasil hasta después de las elecciones

      Los Increíbles 3: cuándo se estrena y todos los detalles de la película más esperada de Pixar

      Los Increíbles 3: cuándo se estrena y todos los detalles de la película más esperada de Pixar

      El gobierno comunista de Pedro Sánchez refuerza la presencia militar en Ceuta ante amenazas de una nueva invasión

      El gobierno comunista de Pedro Sánchez refuerza la presencia militar en Ceuta ante amenazas de una nueva invasión

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

        Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

        Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

        Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

        Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

        Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

        Entérese quienes se unen para impulsar el desarrollo...

        Entérese quienes se unen para impulsar el desarrollo…

        Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

        Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

        Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

        Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

        Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

        Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

        Intrant: nuevo sistema de licencias revierte pérdidas y genera...

        Intrant: nuevo sistema de licencias revierte pérdidas y genera…

        Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

        Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          Estados Unidos no descarta operación militar contra Cuba

          Estados Unidos no descarta operación militar contra Cuba

          Tribunal Constitucional ratifica que País Posible es la 7ma fuerza...

          Tribunal Constitucional ratifica que País Posible es la 7ma fuerza…

          Sismo en Colombia suma 181 fallecidos

          Sismo en Colombia suma 181 fallecidos

          PLD dice Montecristi esta en el abandono; PRM promete obras

          PLD dice Montecristi esta en el abandono; PRM promete obras

          TSE rechaza suspender fondos públicos asignados a partidos en 2026

          TSE rechaza suspender fondos públicos asignados a partidos en 2026

          JCE impulsa debate regional sobre IA y transparencia electoral

          JCE impulsa debate regional sobre IA y transparencia electoral

          Reforma a Seguridad Social quedó fuera de agenda pese a promesa de Abinader – El Nuevo Diario (República Dominicana)

          Reforma a la seguridad social sigue sin llegar al Congreso

          ¡La dejaron pasar! Concluye otra legislatura sin aprobarse una reforma integral para erradicar los feminicidios en RD

          Congreso dominicano deja vencer, otra vez, la reforma urgente contra los feminicidios

          Fuerza del Pueblo participa en Gran Desfile Dominicano del Bronx; llevó amplio contingente de simpatizantes

          Fuerza del Pueblo impresiona con masiva participación en el Desfile Dominicano del Bronx

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                Twelve killed as Polish bus veers off Hungarian motorway

                Twelve killed as Polish bus veers off Hungarian motorway

                Storm Lala: Hawaii braces for potential first direct hit by a hurricane in 34 years

                Storm Lala: Hawaii braces for potential first direct hit by a hurricane in 34 years

                Rescuers search for survivors of powerful Indonesia earthquake

                Rescuers search for survivors of powerful Indonesia earthquake

                Australian state to begin gun buyback after Bondi Beach attack

                Australian state to begin gun buyback after Bondi Beach attack

                Qatar denies capturing three Iranian pilots after downing fighter jets

                Qatar denies capturing three Iranian pilots after downing fighter jets

                Liechtenstein to allow women to ascend the throne

                Liechtenstein to allow women to ascend the throne

                Morocco detains dozens of migrants trying to cross into Ceuta

                Morocco detains dozens of migrants trying to cross into Ceuta

                Belgian firefighters battle blaze tearing through nature reserve

                Belgian firefighters battle blaze tearing through nature reserve

                Five injured in shooting at Virginia State University

                Five injured in shooting at Virginia State University

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  Berkshire Hathaway aumentó su participación en Alphabet y constructoras de viviendas en el segundo trimestre

                  Berkshire Hathaway aumentó su participación en Alphabet y constructoras de viviendas en el segundo trimestre

                  Un equipo de evaluación encontró lo que la revisión cualitativa no pudo: los modelos de IA tienen más confianza cuando están equivocados

                  Un equipo de evaluación encontró lo que la revisión cualitativa no pudo: los modelos de IA tienen más confianza cuando están equivocados

                  El tribunal fiscal de Maryland anula el impuesto a la publicidad digital y ordena reembolsos a Apple, Google y Peacock TV

                  El tribunal fiscal de Maryland anula el impuesto a la publicidad digital y ordena reembolsos a Apple, Google y Peacock TV

                  GLM-5.3 está aquí con capacidades cibernéticas avanzadas y, según se informa, ya encontró una 'vulnerabilidad grave' en Cursor

                  GLM-5.3 está aquí con capacidades cibernéticas avanzadas y, según se informa, ya encontró una ‘vulnerabilidad grave’ en Cursor

                  El foro en línea Reddit se unirá al influyente y seguido de cerca índice S&P 500

                  El foro en línea Reddit se unirá al influyente y seguido de cerca índice S&P 500

                  30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                  ¿Un título de ‘influencer’? Universidades apuestan por especialización en creación de contenidos; Los críticos cuestionan el valor.

                  El terremoto de Colombia es un déjà vu para los venezolanos. La respuesta del gobierno es todo menos

                  El terremoto de Colombia es un déjà vu para los venezolanos. La respuesta del gobierno es todo menos

                  Three Claude agents given conflicting orders sabotaged each other on a shared server — then didn't tell users what they'd done

                  Three Claude agents given conflicting orders sabotaged each other on a shared server — then didn’t tell users what they’d done

                  Google’s Gemini 3.7 Flash targets coding and agents with a 50% introductory price cut

                  Google’s Gemini 3.7 Flash targets coding and agents with a 50% introductory price cut

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    Los fanáticos de Bonnie Tyler se alinean en las calles de un pueblo galés mientras traen su ataúd a casa.

                    Los fanáticos de Bonnie Tyler se alinean en las calles de un pueblo galés mientras traen su ataúd a casa.

                    Liechtenstein cambia sus reglas para permitir que las mujeres hereden el trono del principado alpino

                    Liechtenstein cambia sus reglas para permitir que las mujeres hereden el trono del principado alpino

                    Muere Mark Rydell, el director nominado al Oscar por 'En el estanque dorado', a los 97 años

                    Muere Mark Rydell, el director nominado al Oscar por ‘En el estanque dorado’, a los 97 años

                    Ellen Greene vuelve a visitar a Audrey de 'La pequeña tienda de los horrores' para el 40 aniversario de la película

                    Ellen Greene vuelve a visitar a Audrey de ‘La pequeña tienda de los horrores’ para el 40 aniversario de la película

                    La Sra. Lauryn Hill y el compañero de banda de Fugees, Wyclef Jean, encabezarán el Global Citizen Festival

                    La Sra. Lauryn Hill y el compañero de banda de Fugees, Wyclef Jean, encabezarán el Global Citizen Festival

                    Marc Anthony, Chayanne y más darán un concierto benéfico para ayudar en el terremoto de Venezuela y Colombia

                    Marc Anthony, Chayanne y más darán un concierto benéfico para ayudar en el terremoto de Venezuela y Colombia

                    Reseña musical: 'Comes in Waves' de Carly Simon es un viaje a través del amor y la pérdida

                    Reseña musical: ‘Comes in Waves’ de Carly Simon es un viaje a través del amor y la pérdida

                    Reseña de la película: 'El fin de Oak Street' es un buen momento gonzo

                    Reseña de la película: ‘El fin de Oak Street’ es un buen momento gonzo

                    Sir Anthony Hopkins sobre su álbum debut: 'Mi primer amor es la música'

                    Sir Anthony Hopkins sobre su álbum debut: ‘Mi primer amor es la música’

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

                      Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

                      Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

                      Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

                      Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

                      Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

                      Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

                      Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

                      Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

                      Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

                      Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

                      Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

                      Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

                      Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

                      ADOCALZA respalda mecanismos de INABIE y defiende capacidad de fabricantes nacionales

                      ADOCALZA respalda mecanismos de INABIE y defiende capacidad de fabricantes nacionales

                      Diputado Wendy Batista: “Código Penal lo satanizaron; Cree en acumulación de penas, en algunos casos

                      Diputado Wendy Batista: “Código Penal lo satanizaron; Cree en acumulación de penas, en algunos casos

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        Evangelina Anderson recordó el momento en que les contó a sus hijos sobre su separación: “No estaba preparada”

                        Evangelina Anderson recordó el momento en que les contó a sus hijos sobre su separación: “No estaba preparada”

                        Abelardo le ordenó por Twitter a una ministra echar a todos los izquierdistas de su ministerio

                        Abelardo le ordenó por Twitter a una ministra echar a todos los izquierdistas de su ministerio

                        La Guardia Civil confirmó 15 violaciones en Ceuta tras la invasión de inmigrantes ilegales marroquíes

                        La Guardia Civil confirmó 15 violaciones en Ceuta tras la invasión de inmigrantes ilegales marroquíes

                        El secretario de Asuntos Nucleares de Milei dejó en ridículo al kirchnerista Jorge Taiana

                        El secretario de Asuntos Nucleares de Milei dejó en ridículo al kirchnerista Jorge Taiana

                        La mentira noble nunca salva a quienes pretende proteger

                        La mentira noble nunca salva a quienes pretende proteger

                        Claude lanzará una marca de agua invisible para detectar textos generados con IA

                        Claude lanzará una marca de agua invisible para detectar textos generados con IA

                        Lula postergó la llegada del embajador de EEUU en Brasil hasta después de las elecciones

                        Lula postergó la llegada del embajador de EEUU en Brasil hasta después de las elecciones

                        Los Increíbles 3: cuándo se estrena y todos los detalles de la película más esperada de Pixar

                        Los Increíbles 3: cuándo se estrena y todos los detalles de la película más esperada de Pixar

                        El gobierno comunista de Pedro Sánchez refuerza la presencia militar en Ceuta ante amenazas de una nueva invasión

                        El gobierno comunista de Pedro Sánchez refuerza la presencia militar en Ceuta ante amenazas de una nueva invasión

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

                          Video- Presidente ADP advierte que mayoría de las escuelas públicas no tienen condiciones para resistir un terremoto

                          Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

                          Presidente Abinader pide agricultores tecnificarse para eliminar mano de obra extranjera

                          Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

                          Presidente Luis Abinader entrega polideportivo techado en el Centro Educativo Santo Cura de Ars

                          Entérese quienes se unen para impulsar el desarrollo...

                          Entérese quienes se unen para impulsar el desarrollo…

                          Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

                          Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

                          Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

                          Academia de Ciencias y UASD alertan sobre posible privatización de áreas protegidas

                          Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

                          Gobierno entrega RD$85 millones a 400 microempresarios de San Juan

                          Intrant: nuevo sistema de licencias revierte pérdidas y genera...

                          Intrant: nuevo sistema de licencias revierte pérdidas y genera…

                          Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

                          Derechos Humanos y Comisión de la Verdad reiteran reclamo de justicia por explosión de San Cristóbal

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            Estados Unidos no descarta operación militar contra Cuba

                            Estados Unidos no descarta operación militar contra Cuba

                            Tribunal Constitucional ratifica que País Posible es la 7ma fuerza...

                            Tribunal Constitucional ratifica que País Posible es la 7ma fuerza…

                            Sismo en Colombia suma 181 fallecidos

                            Sismo en Colombia suma 181 fallecidos

                            PLD dice Montecristi esta en el abandono; PRM promete obras

                            PLD dice Montecristi esta en el abandono; PRM promete obras

                            TSE rechaza suspender fondos públicos asignados a partidos en 2026

                            TSE rechaza suspender fondos públicos asignados a partidos en 2026

                            JCE impulsa debate regional sobre IA y transparencia electoral

                            JCE impulsa debate regional sobre IA y transparencia electoral

                            Reforma a Seguridad Social quedó fuera de agenda pese a promesa de Abinader – El Nuevo Diario (República Dominicana)

                            Reforma a la seguridad social sigue sin llegar al Congreso

                            ¡La dejaron pasar! Concluye otra legislatura sin aprobarse una reforma integral para erradicar los feminicidios en RD

                            Congreso dominicano deja vencer, otra vez, la reforma urgente contra los feminicidios

                            Fuerza del Pueblo participa en Gran Desfile Dominicano del Bronx; llevó amplio contingente de simpatizantes

                            Fuerza del Pueblo impresiona con masiva participación en el Desfile Dominicano del Bronx

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  Twelve killed as Polish bus veers off Hungarian motorway

                                  Twelve killed as Polish bus veers off Hungarian motorway

                                  Storm Lala: Hawaii braces for potential first direct hit by a hurricane in 34 years

                                  Storm Lala: Hawaii braces for potential first direct hit by a hurricane in 34 years

                                  Rescuers search for survivors of powerful Indonesia earthquake

                                  Rescuers search for survivors of powerful Indonesia earthquake

                                  Australian state to begin gun buyback after Bondi Beach attack

                                  Australian state to begin gun buyback after Bondi Beach attack

                                  Qatar denies capturing three Iranian pilots after downing fighter jets

                                  Qatar denies capturing three Iranian pilots after downing fighter jets

                                  Liechtenstein to allow women to ascend the throne

                                  Liechtenstein to allow women to ascend the throne

                                  Morocco detains dozens of migrants trying to cross into Ceuta

                                  Morocco detains dozens of migrants trying to cross into Ceuta

                                  Belgian firefighters battle blaze tearing through nature reserve

                                  Belgian firefighters battle blaze tearing through nature reserve

                                  Five injured in shooting at Virginia State University

                                  Five injured in shooting at Virginia State University

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    Berkshire Hathaway aumentó su participación en Alphabet y constructoras de viviendas en el segundo trimestre

                                    Berkshire Hathaway aumentó su participación en Alphabet y constructoras de viviendas en el segundo trimestre

                                    Un equipo de evaluación encontró lo que la revisión cualitativa no pudo: los modelos de IA tienen más confianza cuando están equivocados

                                    Un equipo de evaluación encontró lo que la revisión cualitativa no pudo: los modelos de IA tienen más confianza cuando están equivocados

                                    El tribunal fiscal de Maryland anula el impuesto a la publicidad digital y ordena reembolsos a Apple, Google y Peacock TV

                                    El tribunal fiscal de Maryland anula el impuesto a la publicidad digital y ordena reembolsos a Apple, Google y Peacock TV

                                    GLM-5.3 está aquí con capacidades cibernéticas avanzadas y, según se informa, ya encontró una 'vulnerabilidad grave' en Cursor

                                    GLM-5.3 está aquí con capacidades cibernéticas avanzadas y, según se informa, ya encontró una ‘vulnerabilidad grave’ en Cursor

                                    El foro en línea Reddit se unirá al influyente y seguido de cerca índice S&P 500

                                    El foro en línea Reddit se unirá al influyente y seguido de cerca índice S&P 500

                                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                    ¿Un título de ‘influencer’? Universidades apuestan por especialización en creación de contenidos; Los críticos cuestionan el valor.

                                    El terremoto de Colombia es un déjà vu para los venezolanos. La respuesta del gobierno es todo menos

                                    El terremoto de Colombia es un déjà vu para los venezolanos. La respuesta del gobierno es todo menos

                                    Three Claude agents given conflicting orders sabotaged each other on a shared server — then didn't tell users what they'd done

                                    Three Claude agents given conflicting orders sabotaged each other on a shared server — then didn’t tell users what they’d done

                                    Google’s Gemini 3.7 Flash targets coding and agents with a 50% introductory price cut

                                    Google’s Gemini 3.7 Flash targets coding and agents with a 50% introductory price cut

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      Los fanáticos de Bonnie Tyler se alinean en las calles de un pueblo galés mientras traen su ataúd a casa.

                                      Los fanáticos de Bonnie Tyler se alinean en las calles de un pueblo galés mientras traen su ataúd a casa.

                                      Liechtenstein cambia sus reglas para permitir que las mujeres hereden el trono del principado alpino

                                      Liechtenstein cambia sus reglas para permitir que las mujeres hereden el trono del principado alpino

                                      Muere Mark Rydell, el director nominado al Oscar por 'En el estanque dorado', a los 97 años

                                      Muere Mark Rydell, el director nominado al Oscar por ‘En el estanque dorado’, a los 97 años

                                      Ellen Greene vuelve a visitar a Audrey de 'La pequeña tienda de los horrores' para el 40 aniversario de la película

                                      Ellen Greene vuelve a visitar a Audrey de ‘La pequeña tienda de los horrores’ para el 40 aniversario de la película

                                      La Sra. Lauryn Hill y el compañero de banda de Fugees, Wyclef Jean, encabezarán el Global Citizen Festival

                                      La Sra. Lauryn Hill y el compañero de banda de Fugees, Wyclef Jean, encabezarán el Global Citizen Festival

                                      Marc Anthony, Chayanne y más darán un concierto benéfico para ayudar en el terremoto de Venezuela y Colombia

                                      Marc Anthony, Chayanne y más darán un concierto benéfico para ayudar en el terremoto de Venezuela y Colombia

                                      Reseña musical: 'Comes in Waves' de Carly Simon es un viaje a través del amor y la pérdida

                                      Reseña musical: ‘Comes in Waves’ de Carly Simon es un viaje a través del amor y la pérdida

                                      Reseña de la película: 'El fin de Oak Street' es un buen momento gonzo

                                      Reseña de la película: ‘El fin de Oak Street’ es un buen momento gonzo

                                      Sir Anthony Hopkins sobre su álbum debut: 'Mi primer amor es la música'

                                      Sir Anthony Hopkins sobre su álbum debut: ‘Mi primer amor es la música’

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      HarnessX de Xiaomi reescribe su propio andamio de IA a mitad de la tarea, y los modelos más pequeños son los que más ganan

                                      by — Redacción Despertar Matinal
                                      24 de junio de 2026
                                      in Tecnología
                                      0
                                      HarnessX de Xiaomi reescribe su propio andamio de IA a mitad de la tarea, y los modelos más pequeños son los que más ganan
                                      0
                                      SHARES
                                      15
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los agentes de IA empresarial asumen tareas cada vez más complejas y de largo plazo, su desempeño a menudo se ve restringido por su arnés, el andamiaje de software que conecta el LLM principal con su entorno.

                                      Actualmente, los arneses son en gran medida estáticos y artesanales. Mejorarlos es en gran medida manual y no mejoran automáticamente en función de los datos de ejecución que recopilan de su entorno.

                                      Para abordar este cuello de botella de ingeniería, los investigadores de Xiaomi presentaron ArnésXun marco que trata el arnés de IA como un objeto componible y aplica mejoras de forma autónoma a su código.

                                      En aplicaciones empresariales del mundo real, esta adaptación automatizada permite que los sistemas de IA se ajusten dinámicamente a los requisitos específicos de la aplicación. Las pruebas prácticas demostraron que HarnessX ofrece mejoras sustanciales de rendimiento en dominios como la ingeniería de software y la interacción web.

                                      Los resultados demuestran que ampliar el modelo básico no es el único camino hacia una IA más capaz y, para modelos más pequeños, puede que ni siquiera sea el mejor. La evolución del arnés de HarnessX produjo una ganancia de rendimiento promedio de +14,5 % en 15 combinaciones de modelo y referencia; Para el Qwen3.5-9B de peso abierto, las ganancias alcanzaron el +44% en tareas de planificación incorporadas.

                                      Los desafíos de la ingeniería de arneses

                                      En las aplicaciones de IA, la capacidad de un modelo básico depende en gran medida de su arnés circundante. El arnés actúa como la capa operativa que convierte los resultados del modelo sin procesar en comportamientos de agentes estructurados y ejecutables. Comprende las indicaciones, las integraciones de herramientas externas, la gestión de la memoria y los flujos de control que dictan cómo un sistema de IA observa su entorno, razona un problema y toma medidas.

                                      A medida que los agentes empresariales asumen flujos de trabajo más complejos y de largo plazo, la ingeniería de aprovechamiento se ha convertido en una parte fundamental del desarrollo de la IA. A pesar de su importancia, el desarrollo de arneses aún está lejos de ser una disciplina de ingeniería madura y presenta tres desafíos clave.

                                      En primer lugar, los arneses son estáticos y están diseñados a mano. Cualquier cambio en el modelo básico subyacente, la introducción de nuevas herramientas o un giro hacia un dominio operativo diferente requiere reescrituras de código manuales y personalizadas. Los arneses tradicionales carecen de mecanismos para aprender y mejorar de forma autónoma a partir de experiencias de ejecución pasadas.

                                      En segundo lugar, la mayoría de los arneses existentes sufren de enredos arquitectónicos. Combinan estrechamente plantillas de avisos, envoltorios de herramientas, políticas de reintento y administración de memoria dentro de las mismas rutas de código. Este enredo significa que modificar un componente puede dañar silenciosamente otros. Intentar reutilizar un arnés en diferentes dominios empresariales a menudo implica copiar código sin formato en lugar de una composición limpia y modular.

                                      En tercer lugar, el modelo de arnés y base se optimiza de forma aislada. Cuando los ingenieros realizan pruebas para mejorar el arnés, los seguimientos de ejecución generados generalmente se descartan en lugar de usarse como datos de entrenamiento para mejorar el modelo. En consecuencia, las actualizaciones de modelos no conducen naturalmente a mejoras en el aprovechamiento, lo que crea un cuello de botella donde los equipos no logran capturar el valor total de los datos operativos de sus agentes.

                                      HarnessX: una fundición autónoma para agentes de IA

                                      HarnessX resuelve los obstáculos de ingeniería del desarrollo de arneses manuales con lo que los investigadores llaman una «fundición de arneses unificada».

                                      La principal innovación de HarnessX es tratar el arnés como un «objeto de primera clase». En términos de ingeniería de software, esto significa que el arnés es una entidad serializable, modular y sustituible de forma independiente. Al separar la configuración del modelo (es decir, qué modelo de IA está funcionando) de la configuración del arnés, los ingenieros pueden intercambiar, adaptar y evolucionar el andamiaje sin tocar el modelo subyacente.

                                      HarnessX divide el comportamiento de los agentes en diferentes componentes, como ensamblaje de contexto, gestión de memoria, ecosistemas de herramientas, flujo de control y observabilidad. Cada comportamiento específico se implementa como un «procesador» que se conecta a ganchos precisos del ciclo de vida del arnés. Esta estructura modular permite que el sistema intercambie, agregue o elimine estos procesadores sin romper la tubería circundante.

                                      Para automatizar la optimización de esta estructura modular, HarnessX presenta AEGIS, un motor de evolución basado en trazas. Los marcos AEGIS aprovechan la adaptación como un problema de aprendizaje por refuerzo (RL) sobre los diferentes componentes simbólicos del arnés.

                                      Enmarcar la optimización del arnés como un problema de aprendizaje por refuerzo introduce tres patologías contra las que los investigadores tuvieron que diseñar explícitamente:

                                      • Hackeo de recompensas: El sistema podría explotar atajos hacia la solución en lugar de resolver genuinamente la tarea.

                                      • Olvido catastrófico: Una edición que solucione un patrón de error en un dominio podría interrumpir silenciosamente un flujo de trabajo previamente resuelto en otro.

                                      • Subexploración: El sistema podría iterar sobre ajustes menores en lugar de explorar configuraciones de herramientas nuevas y estructuralmente superiores.

                                      ÉGIDA

                                      Para evitar estos problemas, AEGIS se basa en la observabilidad total del seguimiento y en un proceso de cuatro etapas:

                                      1. Digeridor: Comprime los seguimientos de ejecución en resúmenes estructurados para identificar dónde falló el agente.

                                      2. Planificador: Analiza estos resúmenes para permitir que el sistema explore cambios estructurales en lugar de solo ajustes locales.

                                      3. Evolver: Genera ediciones y pruebas de arnés a nivel de código para garantizar que se ejecuten correctamente antes de la implementación.

                                      4. Crítico y puerta: Un crítico evalúa las ediciones para detectar piratería de recompensas, mientras que una puerta determinista rechaza cualquier actualización que retroceda una tarea previamente resuelta para evitar un olvido catastrófico.

                                      HarnessX ingresa a un campo creciente de investigación de arneses de mejora personal – pero lo que lo separa es la coevolución del modelo de arnés.

                                      Los investigadores destacan que la optimización de cualquiera de los componentes de forma aislada eventualmente choca contra un muro. La evolución de sólo el arnés toca un techo de andamiaje si el modelo subyacente carece de la capacidad de razonamiento para utilizar las nuevas herramientas. Entrenar solo al modelo alcanza un límite máximo de señales de entrenamiento si el arnés nunca le indica al modelo que use sus capacidades avanzadas.

                                      HarnessX entrelaza la evolución del arnés con el entrenamiento de modelos. Los seguimientos de ejecución generados mientras el arnés intenta adaptarse a las tareas se convierten en señales de aprendizaje por refuerzo para el modelo básico. Cada vez que el arnés mejora su estrategia, el modelo aprende simultáneamente a explotar mejor esa nueva estrategia, rompiendo los límites de capacidad del desarrollo tradicional de agentes de IA.

                                      coevolución del modelo de arnés

                                      Coevolución del modelo de arnés (fuente: arXiv)

                                      HarnessX hace posible esta coevolución a través de GRPO (optimización de políticas relativas de grupo) entre ejes. GRPO es el algoritmo RL popular Se utiliza para entrenar modelos de razonamiento como DeepSeek-R1.

                                      Al ajustar el modelo, el GRPO cruzado agrupa las trayectorias de ejecución de un agente para la misma tarea en versiones completamente diferentes de los arneses de la aplicación. Esto permite que el modelo subyacente internalice cambios de estrategia de alto nivel, como usar un nuevo punto final API o administrar un presupuesto de ejecución, en lugar de simplemente aprender variaciones menores de redacción.

                                      HarnessX en acción sobre los puntos de referencia de la industria

                                      Para validar la utilidad práctica de HarnessX, los investigadores lo probaron en cinco puntos de referencia que comprenden ingeniería de software, diálogo de servicio al cliente de múltiples turnos, navegación web, razonamiento abierto de múltiples pasos y planificación incorporada.

                                      Separaron la IA en dos roles. El «metaagente», impulsado por Claude Opus 4.6, analizó los registros y escribió el código para desarrollar los arneses. Los “agentes de tareas” ejecutaron los flujos de trabajo reales. Para demostrar que el marco es independiente del modelo, lo probaron en tres modelos de trabajadores diferentes: Claude Sonnet 4.6, GPT-5.4 y el Qwen3.5-9B de peso abierto.

                                      rendimiento del arnés

                                      HarnessX mejora el rendimiento del agente en puntos de referencia clave de la industria sin cambiar el modelo subyacente (fuente: arXiv)

                                      HarnessX se comparó con dos líneas de base principales. El primero fue un arnés estático, que representa cómo la mayoría de las empresas implementan la IA en la actualidad, utilizando configuraciones congeladas hechas a mano con indicaciones y herramientas específicas de referencia. El segundo fue el Código Claude SDK, una línea de base que representa un evolucionador de un solo agente para probar si el complejo proceso de cuatro etapas de AEGIS tuvo un rendimiento superior al solicitar a un modelo de lenguaje único que iterara el código.

                                      La evolución dinámica del arnés produce ganancias significativas en el mismo modelo base. HarnessX mejoró el rendimiento en 14 de 15 combinaciones de modelo y referencia. En todas las pruebas, la evolución del arnés arrojó una ganancia de rendimiento absoluta promedio de +14,5%.

                                      Los modelos más débiles fueron los que más se beneficiaron de la mejora del arnés dinámico. El Qwen3.5-9B de peso abierto experimentó un aumento de rendimiento del +44,0 % en el punto de referencia de planificación incorporada ALFWorld y un aumento del +18,2 % en SWE-bench Verified para ingeniería de software.

                                      La coevolución también resultó muy eficaz. Cuando los investigadores entrenaron el modelo básico utilizando los datos generados mientras evolucionaban el arnés, observaron un aumento promedio adicional del rendimiento del 4,7 %. Mejorar el arnés y el modelo simultáneamente produce el techo más alto. La ganancia de coevolución se aplica sólo a los modelos de peso abierto.

                                      La evidencia anecdótica de los experimentos muestra cómo HarnessX resuelve problemas perniciosos al crear arneses de agentes para tareas del mundo real. Por ejemplo, en el punto de referencia de razonamiento de varios pasos de GAIA, el agente de tareas fallaba constantemente porque la herramienta de navegador sin cabeza que utilizó para extraer Wikipedia expiró en la interfaz del sitio con mucho JavaScript. HarnessX analizó los rastros de ejecución, diagnosticó el error y escribió una nueva herramienta que omitió el navegador por completo y consultó la API de MediaWiki directamente en busca de texto sin formato. Cambió esta herramienta al arnés y desbloqueó instantáneamente las tareas fallidas.

                                      Durante las pruebas de comercio electrónico de WebShop, el agente de IA a menudo se quedaba atascado en bucles de paginación, haciendo clic sin cesar en «página siguiente» y reformulando búsquedas sin siquiera comprometerse a comprar un producto. En lugar de simplemente modificar el mensaje, HarnessX creó un procesador de asesoramiento que detectaba cuando el agente estaba repitiendo acciones de navegación. Inyectó una advertencia en el contexto para forzar una decisión, solucionando el comportamiento de bucle y aumentando el rendimiento.

                                      Límites de la ingeniería de arneses automatizada

                                      Una advertencia importante es que el sistema actualmente se basa en modelos potentes que actúan como metaagente que reescribe el código de arnés. En sus experimentos, los investigadores se basaron en modelos de frontera cerrada como Claude Opus. Los modelos de peso abierto están mejorando rápidamente, pero su capacidad para servir como metaagente aún no se ha probado.

                                      Otra limitación que vale la pena considerar son las capacidades intrínsecas de los modelos utilizados. Si el modelo de tarea subyacente es fundamentalmente demasiado débil para ejecutar los complejos flujos de trabajo que propone el nuevo arnés, HarnessX no podrá mejorar las capacidades generales del agente (los investigadores observaron esto con el modelo Qwen3.5-9B en las pruebas de codificación del banco SWE).

                                      A pesar de estas limitaciones, HarnessX presenta un caso concreto de que aprovechar la ingeniería (no sólo el escalamiento de modelos) es una palanca que los profesionales pueden utilizar ahora. Para los equipos que ejecutan modelos más pequeños y abiertos en flujos de trabajo complejos, las ganancias aquí son lo suficientemente grandes como para justificar la evaluación de la evolución del arnés como un primer paso antes de buscar un modelo de frontera más costoso. Los investigadores planean publicar el código en una actualización futura.

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      — Redacción Despertar Matinal

                                      — Redacción Despertar Matinal

                                      Programa radial que te conecta con la información desde temprano en la mañana.

                                      Next Post
                                      La Comunidad Regional Punilla debate su continuidad tras el alejamiento de Cosquín

                                      La Comunidad Regional Punilla debate su continuidad tras el alejamiento de Cosquín

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • Delcy Rodríguez anunció que hoy Venezuela liberará a 131 presos políticos

                                        Delcy Rodríguez anunció que hoy Venezuela liberará a 131 presos políticos

                                        0 shares
                                        Share 0 Tweet 0
                                      • Los Filis despiden al manager Rob Thomson y nombran capitán interino a Don Mattingly

                                        0 shares
                                        Share 0 Tweet 0
                                      • El gobierno de Javier Milei prepara el envío de ayuda a Colombia tras el grave terremoto

                                        0 shares
                                        Share 0 Tweet 0
                                      • Lula postergó la llegada del embajador de EEUU en Brasil hasta después de las elecciones

                                        0 shares
                                        Share 0 Tweet 0
                                      • Abel Martínez recibe histórico respaldo de la diáspora dominicana en Nueva York

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por