• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
miércoles, septiembre 2, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

    Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

    DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

    DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

    Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

    Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

    Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

    Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

    Leidy Laura Fernández responde a Gustavo Sánchez: “Leonel Fernández está más vivo que nunca y trabajando”

    Leidy Laura Fernández responde a Gustavo Sánchez: “Leonel Fernández está más vivo que nunca y trabajando”

    Vaguada asociada a remanentes de Dolly provocará fuertes aguaceros este martes, según Indomet

    Vaguada asociada a remanentes de Dolly provocará fuertes aguaceros este martes, según Indomet

    «Estamos en momentos muy difíciles»; director de INAPA llama a racionar el agua

    «Estamos en momentos muy difíciles»; director de INAPA llama a racionar el agua

    RD Vial ha destinado más de RD$70 mil millones a obras viales desde 2021

    RD Vial ha destinado más de RD$70 mil millones a obras viales desde 2021

    Gobierno proyecta eliminar semáforos en principales accesos al Gran Santo Domingo

    Gobierno proyecta eliminar semáforos en principales accesos al Gran Santo Domingo

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      ChatGPT Astra: cómo es el nuevo modelo de OpenAI que puede explotar fallas informáticas

      ChatGPT Astra: cómo es el nuevo modelo de OpenAI que puede explotar fallas informáticas

      Cuenta DNI: quiénes pueden acceder al reintegro de hasta $360.000

      Cuenta DNI: quiénes pueden acceder al reintegro de hasta $360.000

      El régimen comunista de Daniel Ortega aprobó la reforma que veta a la oposición en las elecciones de Nicaragua

      El régimen comunista de Daniel Ortega aprobó la reforma que veta a la oposición en las elecciones de Nicaragua

      Jordania interceptó numerosos misiles lanzados desde Irán que se dirigían hacia una base de EEUU

      Jordania interceptó numerosos misiles lanzados desde Irán que se dirigían hacia una base de EEUU

      ANSES hoy: quiénes cobran este miércoles 2 de septiembre

      ANSES hoy: quiénes cobran este miércoles 2 de septiembre

      Alexandre de Moraes es investigado por intervenir en un contrato millonario entre el estudio de su esposa y Banco Master

      Alexandre de Moraes es investigado por intervenir en un contrato millonario entre el estudio de su esposa y Banco Master

      Flavio Bolsonaro respaldó a un candidato presidencial sancionado por un juez cercano a Lula

      Flavio Bolsonaro respaldó a un candidato presidencial sancionado por un juez cercano a Lula

      Rodolfo D’Onofrio pidió que los clubes "no le tengan miedo" a cuestionar al Chiqui Tapia

      Rodolfo D’Onofrio pidió que los clubes «no le tengan miedo» a cuestionar al Chiqui Tapia

      Atlético de Madrid acelera por Nicolás Tagliafico en el cierre del mercado de pases

      Atlético de Madrid acelera por Nicolás Tagliafico en el cierre del mercado de pases

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Convocan a jóvenes bachilleres para 1000 plazas laborales de aspirantes a agentes de VTP

        Convocan a jóvenes bachilleres para 1000 plazas laborales de aspirantes a agentes de VTP

        Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

        Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

        DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

        DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

        Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

        Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

        Defensor del Pueblo publica Diagnóstico Integral sobre Desapariciones No Voluntarias en el país

        Defensor del Pueblo publica Diagnóstico Integral sobre Desapariciones No Voluntarias en el país

        Idoppril destaca avances en servicios y atención en SDE tras...

        Idoppril destaca avances en servicios y atención en SDE tras…

        Milton Ray Guevara exhorta al presidente de RD y del CNM a no dejarse presionar ante escogencia presidente de SCJ

        Milton Ray Guevara exhorta al presidente de RD y del CNM a no dejarse presionar ante escogencia presidente de SCJ

        Indomet informa continuarán los aguaceros de moderados a fuertes este martes

        Indomet informa continuarán los aguaceros de moderados a fuertes este martes

        Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

        Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

          Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

          ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

          ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

          Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

          Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

          Antonio Marte juramenta nuevas estructuras fortalecen PPG

          Antonio Marte juramenta nuevas estructuras fortalecen PPG

          Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

          Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

          Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

          Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                Tiger Woods changes plea, gets five-year driving ban

                Tiger Woods changes plea, gets five-year driving ban

                Odisha: Why Dara Singh, murderer of Christian missionary Graham Staines and his sons, may walk free in India

                Odisha: Why Dara Singh, murderer of Christian missionary Graham Staines and his sons, may walk free in India

                Bus crash kills 22 on Egypt's Red Sea coast

                Bus crash kills 22 on Egypt’s Red Sea coast

                Guinea-Bissau referendum approves new constitution that expands president's powers

                Guinea-Bissau referendum approves new constitution that expands president’s powers

                South Korea: Disabled care home head jailed for sexually assaulting residents

                South Korea: Disabled care home head jailed for sexually assaulting residents

                BBC travels inside occupied Lebanon as officials say Israel is expanding positions

                BBC travels inside occupied Lebanon as officials say Israel is expanding positions

                Hong Kong: Jailed activist Joshua Wong pleads guilty to foreign collusion under National Security Law

                Hong Kong: Jailed activist Joshua Wong pleads guilty to foreign collusion under National Security Law

                Ariana Grande completes tour and steps back from public life

                Ariana Grande completes tour and steps back from public life

                Jurors in Lindsay Clancy trial deadlocked but judge asks them to keep trying

                Jurors in Lindsay Clancy trial deadlocked but judge asks them to keep trying

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  El auge de la IA calienta el mercado inmobiliario del Área de la Bahía

                  El auge de la IA calienta el mercado inmobiliario del Área de la Bahía

                  Siria estaba construyendo un reactor nuclear en Deir el-Zour bajo Assad, informa la ONU

                  Siria estaba construyendo un reactor nuclear en Deir el-Zour bajo Assad, informa la ONU

                  El calentamiento global superará el límite, dice la ONU en un informe que traza el camino para volver a estar por debajo de la zona de peligro

                  El calentamiento global superará el límite, dice la ONU en un informe que traza el camino para volver a estar por debajo de la zona de peligro

                  Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más

                  Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más

                  Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más

                  Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más.

                  Cerrar la brecha de recuperación de un asistente de Azure OpenAI no requirió una nueva plataforma de identidad. Se necesitó un filtro y un asistente más estrecho.

                  Cerrar la brecha de recuperación de un asistente de Azure OpenAI no requirió una nueva plataforma de identidad. Se necesitó un filtro y un asistente más estrecho.

                  Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads

                  Anthropic’s Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads

                  Sus archivos permanecen en su sitio: la IA híbrida de Perplexity mantiene los datos confidenciales fuera de la nube

                  Sus archivos permanecen en su sitio: la IA híbrida de Perplexity mantiene los datos confidenciales fuera de la nube

                  La IA está redefiniendo la fuerza laboral y la mayoría de los modelos de planificación no están listos

                  La IA está redefiniendo la fuerza laboral y la mayoría de los modelos de planificación no están listos

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                    Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

                      Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

                      DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

                      DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

                      Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

                      Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

                      Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

                      Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

                      Leidy Laura Fernández responde a Gustavo Sánchez: “Leonel Fernández está más vivo que nunca y trabajando”

                      Leidy Laura Fernández responde a Gustavo Sánchez: “Leonel Fernández está más vivo que nunca y trabajando”

                      Vaguada asociada a remanentes de Dolly provocará fuertes aguaceros este martes, según Indomet

                      Vaguada asociada a remanentes de Dolly provocará fuertes aguaceros este martes, según Indomet

                      «Estamos en momentos muy difíciles»; director de INAPA llama a racionar el agua

                      «Estamos en momentos muy difíciles»; director de INAPA llama a racionar el agua

                      RD Vial ha destinado más de RD$70 mil millones a obras viales desde 2021

                      RD Vial ha destinado más de RD$70 mil millones a obras viales desde 2021

                      Gobierno proyecta eliminar semáforos en principales accesos al Gran Santo Domingo

                      Gobierno proyecta eliminar semáforos en principales accesos al Gran Santo Domingo

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        ChatGPT Astra: cómo es el nuevo modelo de OpenAI que puede explotar fallas informáticas

                        ChatGPT Astra: cómo es el nuevo modelo de OpenAI que puede explotar fallas informáticas

                        Cuenta DNI: quiénes pueden acceder al reintegro de hasta $360.000

                        Cuenta DNI: quiénes pueden acceder al reintegro de hasta $360.000

                        El régimen comunista de Daniel Ortega aprobó la reforma que veta a la oposición en las elecciones de Nicaragua

                        El régimen comunista de Daniel Ortega aprobó la reforma que veta a la oposición en las elecciones de Nicaragua

                        Jordania interceptó numerosos misiles lanzados desde Irán que se dirigían hacia una base de EEUU

                        Jordania interceptó numerosos misiles lanzados desde Irán que se dirigían hacia una base de EEUU

                        ANSES hoy: quiénes cobran este miércoles 2 de septiembre

                        ANSES hoy: quiénes cobran este miércoles 2 de septiembre

                        Alexandre de Moraes es investigado por intervenir en un contrato millonario entre el estudio de su esposa y Banco Master

                        Alexandre de Moraes es investigado por intervenir en un contrato millonario entre el estudio de su esposa y Banco Master

                        Flavio Bolsonaro respaldó a un candidato presidencial sancionado por un juez cercano a Lula

                        Flavio Bolsonaro respaldó a un candidato presidencial sancionado por un juez cercano a Lula

                        Rodolfo D’Onofrio pidió que los clubes "no le tengan miedo" a cuestionar al Chiqui Tapia

                        Rodolfo D’Onofrio pidió que los clubes «no le tengan miedo» a cuestionar al Chiqui Tapia

                        Atlético de Madrid acelera por Nicolás Tagliafico en el cierre del mercado de pases

                        Atlético de Madrid acelera por Nicolás Tagliafico en el cierre del mercado de pases

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Convocan a jóvenes bachilleres para 1000 plazas laborales de aspirantes a agentes de VTP

                          Convocan a jóvenes bachilleres para 1000 plazas laborales de aspirantes a agentes de VTP

                          Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

                          Ministerio Público solicita prisión para dos imputados de maltratar a niños en el local de una fundación

                          DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

                          DIDA informa que evita afiliados paguen más de RD$18.5 millones en cobros médicos considerados improcedentes

                          Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

                          Director de Aduanas aclara sobre tráfico de mercancías hacia Haití

                          Defensor del Pueblo publica Diagnóstico Integral sobre Desapariciones No Voluntarias en el país

                          Defensor del Pueblo publica Diagnóstico Integral sobre Desapariciones No Voluntarias en el país

                          Idoppril destaca avances en servicios y atención en SDE tras...

                          Idoppril destaca avances en servicios y atención en SDE tras…

                          Milton Ray Guevara exhorta al presidente de RD y del CNM a no dejarse presionar ante escogencia presidente de SCJ

                          Milton Ray Guevara exhorta al presidente de RD y del CNM a no dejarse presionar ante escogencia presidente de SCJ

                          Indomet informa continuarán los aguaceros de moderados a fuertes este martes

                          Indomet informa continuarán los aguaceros de moderados a fuertes este martes

                          Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

                          Richard Medina: “Crisis económica golpea al pueblo; Lo privado pierde 33 mil empleos; el público subió 35 mil”

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

                            Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

                            ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

                            ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

                            Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

                            Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

                            Antonio Marte juramenta nuevas estructuras fortalecen PPG

                            Antonio Marte juramenta nuevas estructuras fortalecen PPG

                            Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

                            Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

                            Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

                            Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  Tiger Woods changes plea, gets five-year driving ban

                                  Tiger Woods changes plea, gets five-year driving ban

                                  Odisha: Why Dara Singh, murderer of Christian missionary Graham Staines and his sons, may walk free in India

                                  Odisha: Why Dara Singh, murderer of Christian missionary Graham Staines and his sons, may walk free in India

                                  Bus crash kills 22 on Egypt's Red Sea coast

                                  Bus crash kills 22 on Egypt’s Red Sea coast

                                  Guinea-Bissau referendum approves new constitution that expands president's powers

                                  Guinea-Bissau referendum approves new constitution that expands president’s powers

                                  South Korea: Disabled care home head jailed for sexually assaulting residents

                                  South Korea: Disabled care home head jailed for sexually assaulting residents

                                  BBC travels inside occupied Lebanon as officials say Israel is expanding positions

                                  BBC travels inside occupied Lebanon as officials say Israel is expanding positions

                                  Hong Kong: Jailed activist Joshua Wong pleads guilty to foreign collusion under National Security Law

                                  Hong Kong: Jailed activist Joshua Wong pleads guilty to foreign collusion under National Security Law

                                  Ariana Grande completes tour and steps back from public life

                                  Ariana Grande completes tour and steps back from public life

                                  Jurors in Lindsay Clancy trial deadlocked but judge asks them to keep trying

                                  Jurors in Lindsay Clancy trial deadlocked but judge asks them to keep trying

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    El auge de la IA calienta el mercado inmobiliario del Área de la Bahía

                                    El auge de la IA calienta el mercado inmobiliario del Área de la Bahía

                                    Siria estaba construyendo un reactor nuclear en Deir el-Zour bajo Assad, informa la ONU

                                    Siria estaba construyendo un reactor nuclear en Deir el-Zour bajo Assad, informa la ONU

                                    El calentamiento global superará el límite, dice la ONU en un informe que traza el camino para volver a estar por debajo de la zona de peligro

                                    El calentamiento global superará el límite, dice la ONU en un informe que traza el camino para volver a estar por debajo de la zona de peligro

                                    Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más

                                    Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más

                                    Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más

                                    Los modelos de frontera pueden recuperar hasta el 65% de los hechos que no pueden recordar directamente, simplemente pensando más.

                                    Cerrar la brecha de recuperación de un asistente de Azure OpenAI no requirió una nueva plataforma de identidad. Se necesitó un filtro y un asistente más estrecho.

                                    Cerrar la brecha de recuperación de un asistente de Azure OpenAI no requirió una nueva plataforma de identidad. Se necesitó un filtro y un asistente más estrecho.

                                    Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads

                                    Anthropic’s Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads

                                    Sus archivos permanecen en su sitio: la IA híbrida de Perplexity mantiene los datos confidenciales fuera de la nube

                                    Sus archivos permanecen en su sitio: la IA híbrida de Perplexity mantiene los datos confidenciales fuera de la nube

                                    La IA está redefiniendo la fuerza laboral y la mayoría de los modelos de planificación no están listos

                                    La IA está redefiniendo la fuerza laboral y la mayoría de los modelos de planificación no están listos

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      El nuevo marco de IA de Alibaba omite la carga de todas las herramientas y reduce el uso de tokens de agente en un 99 %

                                      by — Redacción Despertar Matinal
                                      2 de julio de 2026
                                      in Tecnología
                                      0
                                      El nuevo marco de IA de Alibaba omite la carga de todas las herramientas y reduce el uso de tokens de agente en un 99 %
                                      0
                                      SHARES
                                      13
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los sistemas de IA empresarial escalan para manejar flujos de trabajo complejos, los profesionales enfrentan el desafío de dirigir las subtareas a las herramientas y habilidades adecuadas. Los agentes pueden tener cientos de herramientas y habilidades y confundirse sobre cuál usar en cada paso de un flujo de trabajo.

                                      Para abordar este desafío, los investigadores de Alibaba desarrollaron HabilidadTejedorun marco que crea un gráfico de ejecución para una tarea determinada y elige las habilidades adecuadas para cada uno de los nodos. También presentan la descomposición consciente de las habilidades (SAD), una técnica novedosa que utiliza un circuito de retroalimentación para permitir al agente buscar y examinar candidatos a herramientas relevantes de forma iterativa. Este enfoque compositivo y mecanismo de bucle de retroalimentación distinguen a SkillWeaver de otros marcos de enrutamiento de herramientas que eligen herramientas de una sola vez.

                                      SkillWeaver se relaciona con aplicaciones de inteligencia artificial del mundo real donde los agentes orquestan de forma autónoma ecosistemas de múltiples herramientas, como el Protocolo de contexto modelo (MCP), para ejecutar operaciones comerciales de varios pasos, como descargar conjuntos de datos, transformar información y crear informes visuales.

                                      En la práctica, los experimentos de los investigadores con SkillWeaver muestran que la implementación de este enfoque de recuperación y enrutamiento aumenta significativamente la precisión y reduce el consumo de tokens en más del 99 % en comparación con exponer ingenuamente a los agentes a una biblioteca de herramientas completa.

                                      Para los profesionales que crean agentes de IA, la conclusión principal es que la granularidad de la descomposición de tareas es el mayor obstáculo para la recuperación precisa de herramientas.

                                      El desafío del enrutamiento de habilidades

                                      Las habilidades son un patrón clave en las arquitecturas modernas de agentes LLM. Una habilidad es una especificación de herramienta modular y reutilizable que utiliza documentación estructurada en lenguaje natural.

                                      A medida que los agentes empresariales se integran con ecosistemas de herramientas masivos, dirigir con precisión las consultas de los usuarios hacia las habilidades adecuadas se convierte en una tarea difícil. Exponer una biblioteca completa a un LLM para encontrar la herramienta adecuada es muy ineficiente, supera rápidamente los límites del contexto y consume cientos de miles de tokens.

                                      La mayoría de los marcos de uso de herramientas actuales intentan resolver esto mediante la recuperación de API, la comparación de documentación o estructuras jerárquicas que tratan el enrutamiento estrictamente como una selección de una sola habilidad o un problema por paso.

                                      Sin embargo, este paradigma de habilidad única es insuficiente para entornos empresariales porque las consultas del mundo real son inherentemente compositivas. Una solicitud comercial estándar como «Descargar el conjunto de datos, transformarlo y crear informes visuales» no se puede cumplir con una sola herramienta. Requiere desglosar el mensaje y secuenciar un cliente API, un procesador de datos y una herramienta de visualización en un plan de ejecución cohesivo de varios pasos.

                                      Cómo funcionan SkillWeaver y SAD

                                      Para abordar esto, los investigadores enmarcan el problema de manejar tareas complejas que requieren múltiples habilidades como «enrutamiento de habilidades compositivas». Dado un mensaje de usuario complejo y una vasta biblioteca de herramientas, un agente debe descubrir simultáneamente cómo dividir la solicitud en una secuencia de subtareas atómicas, cómo asignar cada subtarea a la mejor habilidad disponible y cómo componer esas habilidades en un plan ejecutable.

                                      SkillWeaver organiza este proceso a través de tres etapas distintas: descomponer, recuperar y componer. En la primera etapa, un LLM actúa como un descomponedor de tareas, dividiendo la consulta compleja del usuario en una secuencia de subtareas, cada una de las cuales requiere una habilidad. Una vez que las subtareas están claramente definidas, el sistema utiliza un modelo de integración para comparar cada subtarea con la biblioteca de habilidades y obtener una lista corta de las principales herramientas candidatas para cada paso.

                                      En la etapa final, un planificador evalúa a los candidatos recuperados en función de qué tan bien trabajan juntos. Comprueba la compatibilidad entre habilidades para garantizar que los resultados de una herramienta fluyan naturalmente hacia las entradas de la siguiente. Luego crea un plan de ejecución final como un gráfico acíclico dirigido (DAG) que traza las dependencias para que las tareas independientes puedan ejecutarse potencialmente en paralelo.

                                      Por ejemplo, considere un usuario que le pide a un agente de IA que «descargue el conjunto de datos, lo transforme y cree informes visuales». En la etapa de descomposición, el LLM del descomponedor lo divide en tres subtareas distintas: descargar el conjunto de datos, transformar los datos y crear los informes.

                                      En la etapa de recuperación, el sistema busca en la biblioteca y encuentra candidatos como «api-client» o «http-fetch» para la tarea uno, «csv-parser» o «etl-pipeline» para la tarea dos, y así sucesivamente. Finalmente, la etapa de redacción evalúa estas opciones, selecciona la combinación específica de «api-client», «csv-parser» y «chart-gen» que son más compatibles y las conecta en un flujo de trabajo final listo para ejecutar.

                                      Un desafío clave de este proceso es que los LLM a menudo producen descripciones de pasos genéricas que no coinciden con el vocabulario técnico específico de las habilidades reales disponibles en la biblioteca. Para solucionar este problema, SkillWeaver presenta la descomposición iterativa consciente de las habilidades (SAD), un novedoso circuito de retroalimentación. SAD funciona haciendo que el LLM redacte un plan inicial, realizando una búsqueda preliminar para encontrar habilidades que coincidan vagamente y luego reintroduciendo esas habilidades recuperadas en el LLM como sugerencias. Esto permite al LLM reescribir su descomposición para que la granularidad y el vocabulario se alineen perfectamente con las herramientas reales que existen.

                                      SkillWeaver en acción

                                      Para evaluar el rendimiento de SkillWeaver en escenarios empresariales realistas, los investigadores crearon un punto de referencia personalizado llamado CompSkillBench. Consta de 300 consultas de varios pasos de diferentes niveles de dificultad. Para reflejar entornos del mundo real, utilizaron una biblioteca de 2209 habilidades del mundo real obtenidas del ecosistema público de MCP, que cubre 24 categorías funcionales como infraestructura de nube, finanzas y bases de datos.

                                      Para el motor central, los investigadores utilizaron principalmente un modelo liviano de 7 mil millones de parámetros (Qwen2.5-7B-Instruct) para la descomposición de tareas, junto con un recuperador de búsqueda semántica estándar (MiniLM con un índice FAISS) para encontrar las herramientas. SkillWeaver se evaluó con tres configuraciones principales: un método «LLM-Direct» de fuerza bruta en el que insertaron todos los nombres de las herramientas en el mensaje de un modelo grande, una descomposición básica basada en LLM sin SAD y un bucle de agente estilo ReAct.

                                      Los experimentos indican que la descomposición de tareas es el principal cuello de botella. El comportamiento estándar de LLM se queda corto cuando se trata de bibliotecas de herramientas grandes, pero el ciclo de retroalimentación SAD mueve drásticamente la aguja. En la configuración básica, el modelo 7B logró una precisión de descomposición (es decir, predecir el número correcto de pasos) solo el 51,0% de las veces. Al activar el circuito de retroalimentación SAD, la precisión saltó al 67,7% (con el modelo Qwen-Max más grande, la precisión alcanzó el 92%). En tareas «difíciles» que requieren de cuatro a cinco habilidades distintas, SAD mejoró la precisión en un 50%.

                                      Resultados de SkillWeaver

                                      En comparación con el enfoque ingenuo, SkillWeaver reduce el consumo de tokens en más del 99 % (fuente: arXiv)

                                      Un hallazgo fascinante fue que los modelos más grandes pueden funcionar peor cuando no están guiados. Cuando se probó en la configuración básica, un modelo más grande de 14 mil millones de parámetros vio su precisión caer por debajo de la precisión del modelo 7B porque tendía a sobredescomponer las tareas en pasos microscópicos e innecesarios. Una vez que se introdujo SAD, las sugerencias de herramientas recuperadas anclaron el modelo a la realidad y aumentaron su precisión. Esto sugiere que alinear a un agente con el vocabulario de herramientas específicas suele tener más impacto que pagar por un LLM más grande y costoso.

                                      Otra conclusión importante son los ahorros simbólicos. La línea de base de LLM-Direct, que utilizó el modelo Qwen-Max muy grande, mostró que falla la introducción de todas las herramientas en el indicador de un modelo grande. A pesar de las capacidades de desglose de tareas casi perfectas, el modelo masivo solo recuperó la categoría de herramienta correcta el 21,1% de las veces cuando estaba inundado de opciones de herramientas. El enfoque de recuperación y enrutamiento dirigido de SkillWeaver superó ampliamente esto en precisión, al tiempo que redujo el consumo de la ventana de contexto de aproximadamente 884 000 tokens a aproximadamente 1160 tokens por consulta, una reducción del 99,9 %. Para los profesionales, esto se traduce directamente en costos de API drásticamente más bajos y tiempos de respuesta más rápidos.

                                      Finalmente, la línea de base tradicional de ReAct falló por completo, logrando una precisión de descomposición del 0%. Su bucle colapsa naturalmente los planes de varios pasos en acciones aisladas en lugar de trazar explícitamente una secuencia cohesiva y de múltiples herramientas.

                                      Consideraciones para desarrolladores

                                      Si bien los investigadores aún no han publicado el código fuente de SkillWeaver, su trabajo se basó en herramientas disponibles en el mercado que pueden reproducirse fácilmente.

                                      La descomposición consciente de las habilidades (SAD), que es la innovación clave en el corazón del marco, es un bucle inteligente de recuperación e ingeniería rápida. Los autores han compartido las plantillas de mensajes en su artículo y los desarrolladores pueden implementarlas ellos mismos con bastante facilidad utilizando bibliotecas de orquestación estándar como LangChain, LlamaIndex o incluso scripts de Python sin formato.

                                      En cuanto al componente de recuperación, los autores construyeron el marco central utilizando todo-MiniLM-L6-v2un modelo de integración de código abierto. Descubrieron que cambiar un codificador comercial ligeramente más potente (BGE-base-es-v1.5) aumentó inmediatamente la precisión sin ningún ajuste. Si bien un bicodificador disponible en el mercado es excelente para incluir una herramienta relevante entre los 10 mejores candidatos casi el 70% de las veces, tiene dificultades para clasificar consistentemente la herramienta perfecta exactamente en el número uno, y lo logra solo alrededor del 37% de las veces. Para cerrar esta brecha, los equipos probablemente necesitarán implementar un codificador cruzado secundario o un reclasificador basado en LLM para reordenar a los 10 candidatos principales.

                                      Un requisito de preparación inicial es vectorizar la biblioteca de herramientas y crear un índice FAISS por adelantado. En la práctica, este es un obstáculo insignificante. Incorporar e indexar las 2209 habilidades en el punto de referencia tomó apenas 15 segundos. Una vez creadas, la recuperación de herramientas del índice agrega menos de 15 milisegundos de latencia por consulta. Para entornos empresariales, sincronizar el índice de herramientas es un trabajo trivial en segundo plano.

                                      Una limitación actual de SkillWeaver es la falta de recuperación de errores. Si bien SkillWeaver traza con éxito un DAG compatible para su ejecución, el estudio piloto de los autores reveló los desafíos de las cadenas de herramientas de varios pasos. Por ejemplo, si una llamada API falla en el paso dos, toda la cadena se rompe. La contribución principal del artículo se limita a la fase de enrutamiento y planificación. Para una verdadera implementación de producción, los profesionales deben crear sus propios mecanismos de recuperación, respaldo y reintento de errores además de la etapa de redacción para manejar los tiempos de espera de API del mundo real o resultados con formato incorrecto.

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      — Redacción Despertar Matinal

                                      — Redacción Despertar Matinal

                                      Programa radial que te conecta con la información desde temprano en la mañana.

                                      Next Post
                                      El criminal Pipo recibió un millón de dólares por matar Villavicencio,

                                      El criminal Pipo recibió un millón de dólares por matar Villavicencio,

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • Jurors in Lindsay Clancy trial deadlocked but judge asks them to keep trying

                                        Jurors in Lindsay Clancy trial deadlocked but judge asks them to keep trying

                                        0 shares
                                        Share 0 Tweet 0
                                      • Convocan a jóvenes bachilleres para 1000 plazas laborales de aspirantes a agentes de VTP

                                        0 shares
                                        Share 0 Tweet 0
                                      • La Orquesta Sinfónica de Boston y los músicos acuerdan un acuerdo de tres años que evita una posible huelga

                                        0 shares
                                        Share 0 Tweet 0
                                      • China endurece su ley de movilización nacional: podrá requisar recursos y controlar sectores clave

                                        0 shares
                                        Share 0 Tweet 0
                                      • Rodolfo D’Onofrio pidió que los clubes «no le tengan miedo» a cuestionar al Chiqui Tapia

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por