• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
viernes, septiembre 4, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

    Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

    Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

    Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

    Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

    Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

    FP Santiago: apagones y facturas revelan fracaso del PRM

    FP Santiago: apagones y facturas revelan fracaso del PRM

    Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

    Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

    AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

    AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

    Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

    Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

    Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

    Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

    Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

    Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

      El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

      Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

      Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

      Malvinas sin guerra | La Derecha Diario

      Malvinas sin guerra | La Derecha Diario

      El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

      El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

      HBO Max: la lista completa de estrenos de series y películas en septiembre

      HBO Max: la lista completa de estrenos de series y películas en septiembre

      En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

      En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

      Pablo Quirno tras la cadena nacional de Milei: "La causa Malvinas está arriba de todo"

      Pablo Quirno tras la cadena nacional de Milei: «La causa Malvinas está arriba de todo»

      Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

      Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

      Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

      Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

        Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

        Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

        Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

        Banco BHD fortalece sus canales digitales con nuevas...

        Banco BHD fortalece sus canales digitales con nuevas…

        Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

        Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

        FP Santiago: apagones y facturas revelan fracaso del PRM

        FP Santiago: apagones y facturas revelan fracaso del PRM

        Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

        Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

        AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

        AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

        Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

        Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

        República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

        República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

          Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

          ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

          ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

          Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

          Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

          Antonio Marte juramenta nuevas estructuras fortalecen PPG

          Antonio Marte juramenta nuevas estructuras fortalecen PPG

          Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

          Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

          Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

          Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                Russian drone hits Ukranian security headquarters, Zelensky says

                Russian drone hits Ukranian security headquarters, Zelensky says

                Trump's peace envoys to visit Moscow and Kyiv - reports say

                Trump’s peace envoys to visit Moscow and Kyiv – reports say

                Uganda's King Oyo death: Body of world's youngest traditional monarch returns amid succession row

                Uganda’s King Oyo death: Body of world’s youngest traditional monarch returns amid succession row

                Falkland Islands: UK support 'unwavering' after Argentina restates claims

                Falkland Islands: UK support ‘unwavering’ after Argentina restates claims

                US diesel prices hit an all-time-high

                US diesel prices hit an all-time-high

                How could US-Iran conflict end? Three experts give their views

                How could US-Iran conflict end? Three experts give their views

                Steve Irwin's family celebrates 'superhero' dad, 20 years after shock death

                Steve Irwin’s family celebrates ‘superhero’ dad, 20 years after shock death

                Argentine leader says oil firms working off Falklands face sanctions

                Argentine leader says oil firms working off Falklands face sanctions

                Volkswagen board approves plan to cut another 50,000 jobs

                Volkswagen board approves plan to cut another 50,000 jobs

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                  El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                  El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                  El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                  Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                  Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                  'Welcome to the AGI era': OpenAI launches GPT-6 Astra

                  ‘Welcome to the AGI era’: OpenAI launches GPT-6 Astra

                  Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                  Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                  30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                  Científicos que estudian la leche de cucaracha y sonarse la nariz ganan premios Ig Nobel por ciencia peculiar

                  Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                  Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                  Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                  Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                  Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                  Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                    Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                      Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                      Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                      Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                      Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                      Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                      FP Santiago: apagones y facturas revelan fracaso del PRM

                      FP Santiago: apagones y facturas revelan fracaso del PRM

                      Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                      Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                      AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                      AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                      Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                      Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                      Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

                      Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

                      Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

                      Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

                        El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

                        Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

                        Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

                        Malvinas sin guerra | La Derecha Diario

                        Malvinas sin guerra | La Derecha Diario

                        El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

                        El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

                        HBO Max: la lista completa de estrenos de series y películas en septiembre

                        HBO Max: la lista completa de estrenos de series y películas en septiembre

                        En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

                        En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

                        Pablo Quirno tras la cadena nacional de Milei: "La causa Malvinas está arriba de todo"

                        Pablo Quirno tras la cadena nacional de Milei: «La causa Malvinas está arriba de todo»

                        Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

                        Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

                        Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

                        Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                          Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                          Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                          Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                          Banco BHD fortalece sus canales digitales con nuevas...

                          Banco BHD fortalece sus canales digitales con nuevas…

                          Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                          Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                          FP Santiago: apagones y facturas revelan fracaso del PRM

                          FP Santiago: apagones y facturas revelan fracaso del PRM

                          Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                          Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                          AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                          AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                          Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                          Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                          República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

                          República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

                            Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

                            ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

                            ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

                            Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

                            Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

                            Antonio Marte juramenta nuevas estructuras fortalecen PPG

                            Antonio Marte juramenta nuevas estructuras fortalecen PPG

                            Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

                            Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

                            Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

                            Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  Russian drone hits Ukranian security headquarters, Zelensky says

                                  Russian drone hits Ukranian security headquarters, Zelensky says

                                  Trump's peace envoys to visit Moscow and Kyiv - reports say

                                  Trump’s peace envoys to visit Moscow and Kyiv – reports say

                                  Uganda's King Oyo death: Body of world's youngest traditional monarch returns amid succession row

                                  Uganda’s King Oyo death: Body of world’s youngest traditional monarch returns amid succession row

                                  Falkland Islands: UK support 'unwavering' after Argentina restates claims

                                  Falkland Islands: UK support ‘unwavering’ after Argentina restates claims

                                  US diesel prices hit an all-time-high

                                  US diesel prices hit an all-time-high

                                  How could US-Iran conflict end? Three experts give their views

                                  How could US-Iran conflict end? Three experts give their views

                                  Steve Irwin's family celebrates 'superhero' dad, 20 years after shock death

                                  Steve Irwin’s family celebrates ‘superhero’ dad, 20 years after shock death

                                  Argentine leader says oil firms working off Falklands face sanctions

                                  Argentine leader says oil firms working off Falklands face sanctions

                                  Volkswagen board approves plan to cut another 50,000 jobs

                                  Volkswagen board approves plan to cut another 50,000 jobs

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                                    El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                                    El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                                    El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                                    Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                                    Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                                    'Welcome to the AGI era': OpenAI launches GPT-6 Astra

                                    ‘Welcome to the AGI era’: OpenAI launches GPT-6 Astra

                                    Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                                    Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                    Científicos que estudian la leche de cucaracha y sonarse la nariz ganan premios Ig Nobel por ciencia peculiar

                                    Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                                    Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                                    Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                                    Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                                    Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                                    Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      SkillOpt open source de Microsoft met automatiquement à niveau les compétences des agents IA sans toucher aux pondérations des modèles

                                      by Jorge Polanco
                                      11 de junio de 2026
                                      in Tecnología
                                      0
                                      SkillOpt de código abierto de Microsoft actualiza automáticamente las habilidades de los agentes de IA sin tocar los pesos del modelo
                                      0
                                      SHARES
                                      5
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Les compétences des agents sont devenues un élément important des applications d’IA du monde réel, fournissant un mécanisme (un ensemble d’instructions enregistrées dans un dossier de fichiers de démarques textuelles (.md), généralement) permettant aux modèles de s’adapter aux cas d’utilisation spécifiques de l’entreprise et aux flux de travail complexes.

                                      Cependant, l’optimisation de ces compétences est un processus lent et défectueux, car elles ne peuvent pas être formées de la même manière que les paramètres du modèle d’IA sous-jacent. Au lieu de cela, les utilisateurs doivent généralement les mettre à jour manuellement en retapant les instructions dans chaque fichier, en jouant à un « jeu de devinettes » quant aux changements qui pourraient améliorer les performances de l’IA agentique et réduire les erreurs.

                                      SkillOpt, un nouveau framework open source (sous licence MIT) développé par Microsoft, fait mieux : il introduit un optimiseur conçu pour les compétences des agents, transformant le document .md des compétences de l’agent en un objet pouvant être entraîné qui évolue en fonction des commentaires sur les performances.

                                      Il utilise une optimisation de type apprentissage en profondeur pour permettre à l’IA d’explorer systématiquement les modifications apportées au document et de trouver la meilleure combinaison d’instructions. Plus important encore, il réalise cette adaptation procédurale sans apporter de modifications aux pondérations du modèle sous-jacent.

                                      Selon diverses références du secteur, SkillOpt surpasse les références existantes, améliorant considérablement la précision de modèles tels que GPT-5.5 et Qwen. Le résultat est un ensemble d’artefacts de compétences compacts et transférables qui permettent aux agents d’IA de s’adapter sans effort à de nouveaux domaines.

                                      Le défi de l’optimisation des compétences des agents

                                      Les compétences des agents regroupent les connaissances procédurales dans des spécifications en langage naturel, notamment les heuristiques de domaine, les politiques d’utilisation des outils, les contraintes de sortie et les modes de défaillance connus. Ces compétences fournissent une interface externe permettant aux agents de s’adapter aux flux de travail complexes de l’entreprise. En pratique, les compétences des agents sont stockées sous forme de documents texte et insérées dans le contexte de l’agent avant exécution.

                                      L’un des principaux avantages des compétences est qu’elles personnalisent le comportement du modèle sous-jacent sans modifier ses pondérations. Cependant, le document de compétences lui-même doit être peaufiné et optimisé pour obtenir les meilleures performances de l’agent.

                                      Alors que l’apprentissage profond repose sur des contrôles mathématiques stricts pour la stabilité, l’ingénierie humaine repose souvent sur des essais et des erreurs. Lorsque l’on tente de mettre à jour automatiquement un document de compétences en fonction des commentaires, le manque de discipline mathématique rend le texte très volatil.

                                      Yifan Yang, Senior Research SDE chez Microsoft Research Asia, a déclaré à VentureBeat que le problème n’est pas d’apporter des changements, mais de s’assurer que ces changements sont mathématiquement valables.

                                      «Le point de rupture n’est pas de savoir si une équipe peut modifier une compétence, c’est qu’elle ne peut pas garantir que le changement constitue une amélioration», a déclaré Yang. «Trois modes d’échec se reproduisent : pas de contrôle de la taille des pas, donc les compétences dérivent ; pas de validation, donc un correctif qui se lit comme raisonnable est écrit et peut faire régresser silencieusement les performances ; et pas de mémoire négative, donc la même modification échouée continue de revenir.»

                                      Pour illustrer la facilité avec laquelle les performances peuvent chuter lorsque les modifications ne sont pas validées mathématiquement, Yang a noté qu ‘»une réécriture non verrouillée a fait passer GPT-5.5 sur SpreadsheetBench de 41,8 à 41,1″.

                                      Selon Yang, ces modes de défaillance sont amplifiés dans les flux de travail en plusieurs étapes « parce que c’est là que les modèles frontières sont les plus faibles. Pas sur le raisonnement, mais sur la discipline procédurale : format, auto-vérification, politique des outils ».

                                      Avant SkillOpt, les compétences des agents étaient principalement fabriquées à la main, générées en une seule fois ou évoluaient via des pipelines d’auto-révision peu contrôlés qui ne pouvaient pas s’améliorer de manière fiable sous l’effet des commentaires.

                                      Les méthodes d’optimisation d’invite telles que TextGrad et GEPA traitent les artefacts de langage comme des objets optimisables et utilisent le retour de trajectoire pour faire évoluer les invites, mais elles se concentrent sur des configurations à invite unique plutôt que de générer des artefacts de compétences persistants et réutilisables.

                                      Parallèlement, les méthodes d’évolution et de découverte des compétences telles qu’EvoSkill et Trace2Skill convertissent les expériences d’exécution d’agents en leçons de trajectoire pour affiner les dossiers de compétences, créer des bibliothèques spécifiques à un domaine ou effectuer une recherche évolutive.

                                      Aucun d’entre eux n’applique de contrôles de type apprentissage profond, tels que les taux d’apprentissage, les portes de validation et l’élan, qui sont nécessaires à la formation continue d’un document de compétences unique et compact.

                                      Importer une discipline mathématique dans un texte

                                      SkillOpt optimise un document texte via une boucle itérative de proposition et de test qui sépare le modèle exécutant les tâches du modèle optimisant la compétence. Le processus se déroule en plusieurs étapes :

                                      • SkillOpt commence par un document de compétences initial et un modèle cible gelé (ou harnais), où le modèle cible exécute un lot de tâches pour générer des trajectoires d’exécution qui servent de preuve pour l’étape en cours.

                                      • Un modèle d’optimisation hors ligne analyse ces trajectoires, séparant les succès des échecs en mini-lots. L’examen d’un mini-lot aide le modèle à identifier les erreurs de procédure systématiques plutôt que les anomalies ponctuelles. Sur la base de ces modèles, l’optimiseur propose des modifications structurelles d’ajout, de suppression ou de remplacement au document de compétences.

                                      • Les modifications proposées sont examinées pour filtrer les doublons ou les contradictions, et l’optimiseur classe ensuite ces modifications candidates en fonction de leur utilité attendue.

                                      • Plutôt que d’appliquer toutes les modifications proposées, SkillOpt découpe la liste en fonction d’un budget d’édition maximum pour cette étape, générant ainsi une compétence de candidat.

                                      • La compétence du candidat est évaluée sur un ensemble de validation retenu à l’aide du modèle cible. Si le candidat améliore la note de validation, celle-ci est acceptée et devient la nouvelle compétence actuelle. En cas d’échec, les modifications sont rejetées et envoyées vers un tampon de modification rejetée, fournissant un retour négatif afin que l’optimiseur sache qu’il ne doit pas répéter cette erreur.

                                      SkillOpt aborde directement le problème du traitement du texte comme un objet pouvant être entraîné en important des concepts mathématiques issus de l’apprentissage profond. Les créateurs notent que « l’analogie du deep learning est opérationnelle plutôt que décorative », aidant le framework à éviter les problèmes d’instabilité associés à d’autres techniques d’optimisation.

                                      Pipeline SkillOpt

                                      Cadre SkillOpt (source : arXiv)

                                      Le budget d’édition agit comme un taux d’apprentissage. En limitant le nombre de modifications pouvant être appliquées simultanément, on évite que la version de compétence ne s’éloigne trop de son état précédent, préservant ainsi la continuité tout en permettant l’acquisition de nouvelles procédures.

                                      Tout comme la vérification de la perte de validation dans le deep learning, les exemples stricts retenus garantissent que les modifications de texte apparemment plausibles ne sont conservées que si elles améliorent mathématiquement les performances réelles de l’agent lors de la répartition de validation.

                                      À la fin d’une époque, SkillOpt effectue une mise à jour lente en comparant les tâches des compétences de l’époque précédente et actuelle. Cela agit comme un terme d’élan, faisant avancer les leçons procédurales durables et à long terme tout en les isolant des modifications rapides et par étapes.

                                      SkillOpt en action

                                      Pour évaluer la technique dans la pratique, les chercheurs ont testé SkillOpt sur différents modèles, allant des modèles frontières à grande échelle comme GPT-5.5 aux plus petits modèles fermés et ouverts, notamment GPT-5.4-mini et Qwen3.5-4B. Ils ont également déployé leurs compétences au sein de différents harnais d’exécution, en utilisant le chat simple ainsi que des harnais de codage complexes comme le Codex CLI et Claude Code.

                                      L’évaluation a porté sur diverses références de l’industrie, notamment la réponse à des questions en un seul tour, la génération de code à plusieurs tours impliquant l’utilisation d’outils et le raisonnement multimodal de documents. SkillOpt a été mesuré par rapport à plusieurs références allant d’un paramètre par défaut sans compétence aux compétences écrites par l’homme et aux compétences générées en une seule fois par LLM. Il a également été comparé à des méthodes avancées d’optimisation rapide et d’évolution des compétences, en particulier Trace2Skill, TextGrad, GEPA et EvoSkill.

                                      SkillOpt a dominé dans tous les domaines, se révélant très efficace sur les 52 combinaisons évaluées de modèle, de référence et de harnais. Il s’est avéré particulièrement efficace avec les modèles frontières, offrant une amélioration absolue moyenne de +23,5 points par rapport à la référence sans compétence sur GPT-5.5. De plus, SkillOpt a surpassé une base de référence oracle hypothétique qui sélectionne la meilleure méthode concurrente pour chaque problème.

                                      Les petits modèles cibles ont enregistré d’immenses gains relatifs, prouvant qu’un fichier texte compact peut fournir des connaissances procédurales qui manquent aux petits modèles en termes de poids. Par exemple, GPT-5.4-nano a presque doublé son score en matière d’assurance qualité des documents multimodaux et a triplé son score en matière d’interaction incarnée et de prise de décision séquentielle.

                                      Ces références académiques correspondent aux problèmes critiques de l’entreprise. Les modèles Zero-shot hallucinent souvent lors du formatage ou ne parviennent pas à utiliser correctement les outils dans des scénarios en plusieurs étapes. Yang a expliqué que les gains de performance les plus importants se sont produits dans les opérations que les entreprises ont toujours eu du mal à automatiser de manière fiable.

                                      «Extraction de données documentaires… chiffres exacts à partir de contrats, factures et formulaires – automatisation des comptes fournisseurs, réclamations, conformité», a déclaré Yang. «Ce qui s’améliore, c’est la fiabilité : un formatage précis, une auto-vérification, des résultats vérifiables. Et les gains proviennent de la procédure d’apprentissage, et non de la mémorisation des réponses.»

                                      Pour les professionnels de l’entreprise, la véritable valeur de SkillOpt réside dans sa portabilité, son efficacité et sa compatibilité avec l’infrastructure existante. Les expériences confirment que le cadre est indépendant du harnais. En plus du chat de base, la même boucle d’optimisation a été intégrée avec succès dans des environnements d’exécution basés sur des outils tels que Codex CLI et Claude Code, avec des gains significatifs par rapport aux références du secteur.

                                      Les développeurs peuvent former une compétence à l’aide d’une boucle d’exécution et la déployer dans une autre. Par exemple, une compétence de feuille de calcul entièrement formée dans la boucle Codex a été déplacée directement dans Claude Code et a généré un gain de +59,7 points par rapport à la base de référence native de Claude Code sans aucun autre changement.

                                      Les artefacts SkillOpt sont également transférés proprement à travers les échelles du modèle. Une compétence optimisée pour GPT-5.4 a été déployée sur les plus petits modèles GPT-5.4-mini et GPT-5.4-nano avec des gains positifs, prouvant que les procédures apprises codent des flux de travail réutilisables plutôt que d’exploiter simplement les bizarreries de l’architecture d’un modèle spécifique.

                                      Enfin, le cadre est très efficace en ce qui concerne l’utilisation des jetons et l’immobilier de la fenêtre contextuelle. Dans tous les benchmarks, les compétences finales déployées n’ont jamais dépassé 2 000 tokens, avec une longueur médiane d’environ 920 tokens. Il en résulte des artefacts hautement lisibles et vérifiables qu’un praticien humain peut examiner et gérer en quelques minutes.

                                      Stratégies de mise en œuvre et « piège » de l’entreprise

                                      Pour les responsables technologiques d’entreprise, l’adoption d’un nouveau cadre nécessite d’en comprendre les frais généraux et les limites. Bien que le document de recherche indique que les jetons de formation peuvent atteindre jusqu’à 210 millions pour les références académiques, la réalité des cas d’utilisation quotidienne en entreprise est beaucoup plus légère. Le nombre élevé de jetons lors des tests était en grande partie dû à la réévaluation d’ensembles de tests massifs retenus.

                                      «Le véritable travail initial est le vérificateur et une division représentative. L’optimiseur est léger; le faisceau d’évaluation est l’endroit où va l’ingénierie», a déclaré Yang. Il a ajouté que pour une utilisation quotidienne, «dans des cadres communautaires comme GBrain, où les mises à jour SkillOpt s’exécutent sur Claude Sonnet, la formation d’une compétence pour une seule tâche ne coûte en moyenne que 1 à 5 dollars». Ce coût d’optimisation est un frais unique qui est entièrement amorti lors du déploiement.

                                      Cependant, le cadre nécessite des conditions spécifiques pour fonctionner efficacement, à savoir quelques dizaines d’exemples représentatifs et un signal de retour notable. Les équipes doivent éviter d’appliquer SkillOpt à des tâches ouvertes ou subjectives. «En l’absence d’un évaluateur automatique propre, vous devez concevoir un évaluateur basé sur un humain ou un modèle et surveiller sa stabilité», a déclaré Yang.

                                      SkillOpt s’intègre également facilement aux piles d’orchestration existantes, supprimant ainsi un obstacle majeur à l’adoption. Par exemple, les développeurs utilisant déjà des compilateurs de pipeline peuvent exécuter les deux systèmes de manière harmonieuse. «DSpy est une couche différente et complémentaire», a déclaré Yang. «Il compile les pipelines LM déclaratifs et optimise la structure du programme ; SkillOpt optimise l’état des compétences externes qu’un agent gelé charge. Vous pouvez les exécuter ensemble.»

                                      Pour l’avenir, les développeurs open source planifient déjà SkillOpt pour qu’il s’exécute périodiquement sur les trajectoires passées de leurs agents, créant ainsi un petit écosystème de plugins d’agent de code auto-optimisés. Cette boucle de rétroaction continue représente un changement important dans la façon dont les systèmes d’IA s’adaptent.

                                      « La version précieuse de l’auto-amélioration est qu’un agent découvre de manière autonome des connaissances pour améliorer son propre comportement et l’expérience utilisateur, sous vérification et audit », a déclaré Yang. «Les compétences constituent la première étape la plus rapide, la moins chère et la plus réversible, et le même état d’esprit incite les agents à s’optimiser eux-mêmes, jusqu’à atteindre leur propre poids.»

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      Jorge Polanco

                                      Jorge Polanco

                                      Comunicador | Columnista de Opinión & Análisis especializado en turismo y gestión pública, con una mirada crítica sobre la política turística, el ordenamiento territorial y el discurso institucional del sector

                                      Next Post
                                      Atento Scaloni: un jugador de Bolivia reveló las claves para enfrentar a Argelia

                                      Atento Scaloni: un jugador de Bolivia reveló las claves para enfrentar a Argelia

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • Josefina Reynoso: “PN paga 118 mil millones por alquiler hotel;; El pueblo está indefenso; Policías compran uniformes por 4,500”

                                        Josefina Reynoso: “PN paga 118 mil millones por alquiler hotel;; El pueblo está indefenso; Policías compran uniformes por 4,500”

                                        0 shares
                                        Share 0 Tweet 0
                                      • LTX-2.5 can generate a 10-second AI video from an image in just 6.8 seconds on Nvidia superchips — and it’s open weights

                                        0 shares
                                        Share 0 Tweet 0
                                      • Pianista surcoreano se recrea tras sufrir un derrame cerebral

                                        0 shares
                                        Share 0 Tweet 0
                                      • Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                        0 shares
                                        Share 0 Tweet 0
                                      • Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por