• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
sábado, septiembre 26, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

    Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

    Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

    Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

    Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

    Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

    Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

    Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

    Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

    Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

    Presidente Abinader y gobernadora Hochul fortalecen cooperación entre República Dominicana y Nueva York en gestión de emergencias y protección de infraestructuras

    Presidente Abinader y gobernadora Hochul fortalecen cooperación entre República Dominicana y Nueva York en gestión de emergencias y protección de infraestructuras

    Diez de los 23 médicos imputados en el caso Senasa 2.0 admiten los hechos; dicen están avergonzados

    Diez de los 23 médicos imputados en el caso Senasa 2.0 admiten los hechos; dicen están avergonzados

    Presidente Abinader es reconocido con la Insignia de Oro, el más alto honor de Americas Society

    Presidente Abinader es reconocido con la Insignia de Oro, el más alto honor de Americas Society

    Hombres de confianza de Julian Oro Duro mataron a su esposa y lo hirieron de gravedad

    Hombres de confianza de Julian Oro Duro mataron a su esposa y lo hirieron de gravedad

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      El juez que condenó a cuatro periodistas en Formosa es un militante peronista de Gildo Insfrán

      El juez que condenó a cuatro periodistas en Formosa es un militante peronista de Gildo Insfrán

      El kirchnerista Esteban Lamothe confirmó su casamiento con Débora Nishimoto

      El kirchnerista Esteban Lamothe confirmó su casamiento con Débora Nishimoto

      Éxtasis: en Mar del Plata bandidos estaban a los tiros en un cortejo fúnebre, llegó la policía y secuestraron 42 motos

      Éxtasis: en Mar del Plata bandidos estaban a los tiros en un cortejo fúnebre, llegó la policía y secuestraron 42 motos

      El régimen de Lula prohibió las apuestas online y el Brasileirao puso en duda la continuidad del fútbol en Brasil

      El régimen de Lula prohibió las apuestas online y el Brasileirao puso en duda la continuidad del fútbol en Brasil

      La región de Tigray vuelve a los combates y una alianza rebelde amenaza al gobierno de Etiopía

      La región de Tigray vuelve a los combates y una alianza rebelde amenaza al gobierno de Etiopía

      Ofelia Fernández cobra $18 millones como “directora creativa” del CFI conducido por el hermano de Esteban Lamothe

      Ofelia Fernández cobra $18 millones como “directora creativa” del CFI conducido por el hermano de Esteban Lamothe

      Natalio Mema, Ministro de Gobierno de Mendoza: "Javier Milei era lo que hacía falta"

      Natalio Mema, Ministro de Gobierno de Mendoza: «Javier Milei era lo que hacía falta»

      OpenAI reconoció que agentes de IA publicaron en internet 53 imágenes aportadas por usuarios

      OpenAI reconoció que agentes de IA publicaron en internet 53 imágenes aportadas por usuarios

      "Venganza en la prisión" encabeza el top 10 de películas más vistas en Netflix Argentina

      «Venganza en la prisión» encabeza el top 10 de películas más vistas en Netflix Argentina

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Wilson Camacho dice 13 imputados admiten hechos en audiencia del caso Senasa

        Wilson Camacho dice 13 imputados admiten hechos en audiencia del caso Senasa

        Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

        Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

        AP Cine-RD celebra su Primer Encuentro de Productores para...

        AP Cine-RD celebra su Primer Encuentro de Productores para…

        Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

        Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

        CCLP y Hospital de Herrera fortalecen atención domiciliaria...

        CCLP y Hospital de Herrera fortalecen atención domiciliaria…

        Víctor Gómez Pin analiza los límites de la física cuántica y la...

        Víctor Gómez Pin analiza los límites de la física cuántica y la…

        Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

        Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

        Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

        Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

        Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

        Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          PRD endurece oposición al Gobierno e impulsa concertación...

          PRD endurece oposición al Gobierno e impulsa concertación…

          Francisco Javier García denuncia “cacería” contra sus seguidores y cuestiona retiro de 523 mil personas del padrón del PLD

          Francisco Javier García denuncia “cacería” contra sus seguidores y cuestiona retiro de 523 mil personas del padrón del PLD

          (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

          (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

          Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

          Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

          Exministro de Haciendas advierte fuga de ahorros en dólares si...

          Exministro de Haciendas advierte fuga de ahorros en dólares si…

          Robert Polanco revela respaldo a David Collado y descarta...

          Robert Polanco revela respaldo a David Collado y descarta…

          TSE dispone suspensión provisional celebración VII Convención...

          TSE dispone suspensión provisional celebración VII Convención…

          Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

          Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

          Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

          Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                Piden ampliar presencia de la JCE en el Medio Oeste de EE. UU.

                Piden ampliar presencia de la JCE en el Medio Oeste de EE. UU.

                Estos son los cinco hombres de mayor confianza de De la Espriella

                Estos son los cinco hombres de mayor confianza de De la Espriella

                Duelo de limusinas entre Bestia’ de Trump y Bandera Roja’ de Xi

                Duelo de limusinas entre Bestia’ de Trump y Bandera Roja’ de Xi

                Leonel afirma que la Fuerza del Pueblo se posiciona como una alternativa ante la “frustración” actual de la sociedad

                Leonel afirma que la Fuerza del Pueblo se posiciona como una alternativa ante la “frustración” actual de la sociedad

                Meloni limita al 30% los alumnos por aula que no sepan italiano

                Meloni limita al 30% los alumnos por aula que no sepan italiano

                El PAM gana elecciones marcadas por la abstención en Marruecos

                El PAM gana elecciones marcadas por la abstención en Marruecos

                Periodistas de CNN, MS NOW y Politico entran en la Casa Blanca

                Periodistas de CNN, MS NOW y Politico entran en la Casa Blanca

                Huracán Georges, el más devastador tras David

                Huracán Georges, el más devastador tras David

                Nikauly De La Mota presenta los lineamientos

                Nikauly De La Mota presenta los lineamientos

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  Un jurado de Nuevo México declara a Facebook responsable de engañar a los usuarios sobre la protección de la privacidad

                  Un jurado de Nuevo México declara a Facebook responsable de engañar a los usuarios sobre la protección de la privacidad

                  Nave espacial privada regresa a la Tierra después de no poder rescatar el viejo telescopio de la NASA

                  Nave espacial privada regresa a la Tierra después de no poder rescatar el viejo telescopio de la NASA

                  La UE promete defender su postura contra X después de que Estados Unidos respalde una impugnación judicial de Elon Musk

                  La UE promete defender su postura contra X después de que Estados Unidos respalde una impugnación judicial de Elon Musk

                  A 40 días de las elecciones intermedias, los funcionarios electorales dicen que el nuevo plan cibernético de EE. UU. llega demasiado tarde

                  A 40 días de las elecciones intermedias, los funcionarios electorales dicen que el nuevo plan cibernético de EE. UU. llega demasiado tarde

                  Ha sido una intensa temporada de huracanes en el Pacífico y aún queda mucho camino por recorrer

                  Ha sido una intensa temporada de huracanes en el Pacífico y aún queda mucho camino por recorrer

                  Las empresas automotrices chinas avanzan en la tecnología de vehículos eléctricos y logran una carga ultrarrápida en cinco minutos

                  Las empresas automotrices chinas avanzan en la tecnología de vehículos eléctricos y logran una carga ultrarrápida en cinco minutos

                  Los hacks autónomos de IA plantean cuestiones espinosas sobre la responsabilidad legal

                  Los hacks autónomos de IA plantean cuestiones espinosas sobre la responsabilidad legal

                  Panel de la FDA respalda el primer análisis de sangre para cáncer de Grail

                  Panel de la FDA respalda el primer análisis de sangre para cáncer de Grail

                  Líderes tecnológicos a la ONU: Por el bien de la humanidad, controlen la tecnología de inteligencia artificial que creamos

                  Líderes tecnológicos a la ONU: Por el bien de la humanidad, controlen la tecnología de inteligencia artificial que creamos

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                    Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

                      Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

                      Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

                      Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

                      Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

                      Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

                      Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

                      Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

                      Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

                      Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

                      Presidente Abinader y gobernadora Hochul fortalecen cooperación entre República Dominicana y Nueva York en gestión de emergencias y protección de infraestructuras

                      Presidente Abinader y gobernadora Hochul fortalecen cooperación entre República Dominicana y Nueva York en gestión de emergencias y protección de infraestructuras

                      Diez de los 23 médicos imputados en el caso Senasa 2.0 admiten los hechos; dicen están avergonzados

                      Diez de los 23 médicos imputados en el caso Senasa 2.0 admiten los hechos; dicen están avergonzados

                      Presidente Abinader es reconocido con la Insignia de Oro, el más alto honor de Americas Society

                      Presidente Abinader es reconocido con la Insignia de Oro, el más alto honor de Americas Society

                      Hombres de confianza de Julian Oro Duro mataron a su esposa y lo hirieron de gravedad

                      Hombres de confianza de Julian Oro Duro mataron a su esposa y lo hirieron de gravedad

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        El juez que condenó a cuatro periodistas en Formosa es un militante peronista de Gildo Insfrán

                        El juez que condenó a cuatro periodistas en Formosa es un militante peronista de Gildo Insfrán

                        El kirchnerista Esteban Lamothe confirmó su casamiento con Débora Nishimoto

                        El kirchnerista Esteban Lamothe confirmó su casamiento con Débora Nishimoto

                        Éxtasis: en Mar del Plata bandidos estaban a los tiros en un cortejo fúnebre, llegó la policía y secuestraron 42 motos

                        Éxtasis: en Mar del Plata bandidos estaban a los tiros en un cortejo fúnebre, llegó la policía y secuestraron 42 motos

                        El régimen de Lula prohibió las apuestas online y el Brasileirao puso en duda la continuidad del fútbol en Brasil

                        El régimen de Lula prohibió las apuestas online y el Brasileirao puso en duda la continuidad del fútbol en Brasil

                        La región de Tigray vuelve a los combates y una alianza rebelde amenaza al gobierno de Etiopía

                        La región de Tigray vuelve a los combates y una alianza rebelde amenaza al gobierno de Etiopía

                        Ofelia Fernández cobra $18 millones como “directora creativa” del CFI conducido por el hermano de Esteban Lamothe

                        Ofelia Fernández cobra $18 millones como “directora creativa” del CFI conducido por el hermano de Esteban Lamothe

                        Natalio Mema, Ministro de Gobierno de Mendoza: "Javier Milei era lo que hacía falta"

                        Natalio Mema, Ministro de Gobierno de Mendoza: «Javier Milei era lo que hacía falta»

                        OpenAI reconoció que agentes de IA publicaron en internet 53 imágenes aportadas por usuarios

                        OpenAI reconoció que agentes de IA publicaron en internet 53 imágenes aportadas por usuarios

                        "Venganza en la prisión" encabeza el top 10 de películas más vistas en Netflix Argentina

                        «Venganza en la prisión» encabeza el top 10 de películas más vistas en Netflix Argentina

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Wilson Camacho dice 13 imputados admiten hechos en audiencia del caso Senasa

                          Wilson Camacho dice 13 imputados admiten hechos en audiencia del caso Senasa

                          Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

                          Alejandrina responde a Francisco Javier: Asegura la CONAP no tiene candidato

                          AP Cine-RD celebra su Primer Encuentro de Productores para...

                          AP Cine-RD celebra su Primer Encuentro de Productores para…

                          Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

                          Gobierno aumenta nueva vez los precios de las gasolinas y el gasoil

                          CCLP y Hospital de Herrera fortalecen atención domiciliaria...

                          CCLP y Hospital de Herrera fortalecen atención domiciliaria…

                          Víctor Gómez Pin analiza los límites de la física cuántica y la...

                          Víctor Gómez Pin analiza los límites de la física cuántica y la…

                          Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

                          Presidente Abinader anuncia 300 becas para jóvenes dominicanos residentes en Nueva York

                          Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

                          Leonel afirma en NY que FP se posiciona como la alternativa ante la “frustración” de la sociedad dominicana

                          Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

                          Presidente Abinader se reúne con diáspora dominicana en Brooklyn y agradece sus aportes al desarrollo de RD

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            PRD endurece oposición al Gobierno e impulsa concertación...

                            PRD endurece oposición al Gobierno e impulsa concertación…

                            Francisco Javier García denuncia “cacería” contra sus seguidores y cuestiona retiro de 523 mil personas del padrón del PLD

                            Francisco Javier García denuncia “cacería” contra sus seguidores y cuestiona retiro de 523 mil personas del padrón del PLD

                            (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

                            (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

                            Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

                            Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

                            Exministro de Haciendas advierte fuga de ahorros en dólares si...

                            Exministro de Haciendas advierte fuga de ahorros en dólares si…

                            Robert Polanco revela respaldo a David Collado y descarta...

                            Robert Polanco revela respaldo a David Collado y descarta…

                            TSE dispone suspensión provisional celebración VII Convención...

                            TSE dispone suspensión provisional celebración VII Convención…

                            Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

                            Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

                            Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

                            Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  Piden ampliar presencia de la JCE en el Medio Oeste de EE. UU.

                                  Piden ampliar presencia de la JCE en el Medio Oeste de EE. UU.

                                  Estos son los cinco hombres de mayor confianza de De la Espriella

                                  Estos son los cinco hombres de mayor confianza de De la Espriella

                                  Duelo de limusinas entre Bestia’ de Trump y Bandera Roja’ de Xi

                                  Duelo de limusinas entre Bestia’ de Trump y Bandera Roja’ de Xi

                                  Leonel afirma que la Fuerza del Pueblo se posiciona como una alternativa ante la “frustración” actual de la sociedad

                                  Leonel afirma que la Fuerza del Pueblo se posiciona como una alternativa ante la “frustración” actual de la sociedad

                                  Meloni limita al 30% los alumnos por aula que no sepan italiano

                                  Meloni limita al 30% los alumnos por aula que no sepan italiano

                                  El PAM gana elecciones marcadas por la abstención en Marruecos

                                  El PAM gana elecciones marcadas por la abstención en Marruecos

                                  Periodistas de CNN, MS NOW y Politico entran en la Casa Blanca

                                  Periodistas de CNN, MS NOW y Politico entran en la Casa Blanca

                                  Huracán Georges, el más devastador tras David

                                  Huracán Georges, el más devastador tras David

                                  Nikauly De La Mota presenta los lineamientos

                                  Nikauly De La Mota presenta los lineamientos

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    Un jurado de Nuevo México declara a Facebook responsable de engañar a los usuarios sobre la protección de la privacidad

                                    Un jurado de Nuevo México declara a Facebook responsable de engañar a los usuarios sobre la protección de la privacidad

                                    Nave espacial privada regresa a la Tierra después de no poder rescatar el viejo telescopio de la NASA

                                    Nave espacial privada regresa a la Tierra después de no poder rescatar el viejo telescopio de la NASA

                                    La UE promete defender su postura contra X después de que Estados Unidos respalde una impugnación judicial de Elon Musk

                                    La UE promete defender su postura contra X después de que Estados Unidos respalde una impugnación judicial de Elon Musk

                                    A 40 días de las elecciones intermedias, los funcionarios electorales dicen que el nuevo plan cibernético de EE. UU. llega demasiado tarde

                                    A 40 días de las elecciones intermedias, los funcionarios electorales dicen que el nuevo plan cibernético de EE. UU. llega demasiado tarde

                                    Ha sido una intensa temporada de huracanes en el Pacífico y aún queda mucho camino por recorrer

                                    Ha sido una intensa temporada de huracanes en el Pacífico y aún queda mucho camino por recorrer

                                    Las empresas automotrices chinas avanzan en la tecnología de vehículos eléctricos y logran una carga ultrarrápida en cinco minutos

                                    Las empresas automotrices chinas avanzan en la tecnología de vehículos eléctricos y logran una carga ultrarrápida en cinco minutos

                                    Los hacks autónomos de IA plantean cuestiones espinosas sobre la responsabilidad legal

                                    Los hacks autónomos de IA plantean cuestiones espinosas sobre la responsabilidad legal

                                    Panel de la FDA respalda el primer análisis de sangre para cáncer de Grail

                                    Panel de la FDA respalda el primer análisis de sangre para cáncer de Grail

                                    Líderes tecnológicos a la ONU: Por el bien de la humanidad, controlen la tecnología de inteligencia artificial que creamos

                                    Líderes tecnológicos a la ONU: Por el bien de la humanidad, controlen la tecnología de inteligencia artificial que creamos

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      Los modelos de Frontier AI no solo eliminan el contenido del documento: lo reescriben y los errores son casi imposibles de detectar.

                                      by Jorge Polanco
                                      13 de mayo de 2026
                                      in Tecnología
                                      0
                                      Los modelos de Frontier AI no solo eliminan el contenido del documento: lo reescriben y los errores son casi imposibles de detectar.
                                      0
                                      SHARES
                                      16
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      A medida que los grandes modelos de lenguaje se vuelven más capaces, los usuarios se sienten tentados a delegar tareas de conocimiento donde los modelos procesan documentos en su nombre y proporcionan los resultados finales. Pero, ¿qué tan bien puede confiar en que el modelo se mantendrá fiel al contenido de sus documentos cuando tiene que revisarlos durante múltiples ciclos?

                                      Un nuevo estudio realizado por investigadores de Microsoft muestra que los grandes modelos de lenguaje corrompen silenciosamente los documentos en los que trabajan introduciendo errores. Los investigadores desarrollaron un punto de referencia que simula flujos de trabajo autónomos de varios pasos en 52 dominios profesionales, utilizando un método que mide automáticamente el grado de degradación del contenido a lo largo del tiempo.

                                      Sus hallazgos muestran que incluso los modelos de límites de primer nivel corrompen en promedio el 25% del contenido del documento al final de estos flujos de trabajo. Y proporcionar a los modelos herramientas de agentes o documentos de distracción realistas en realidad degrada su rendimiento.

                                      Esto sirve como advertencia: aunque existe una presión creciente para automatizar el trabajo del conocimiento, los modelos lingüísticos actuales no son del todo fiables para estas tareas.

                                      La mecánica del trabajo delegado

                                      El estudio de Microsoft se centra en el «trabajo delegado», un paradigma emergente en el que los usuarios permiten a los LLM completar tareas de conocimiento en su nombre mediante el análisis y la edición de documentos.

                                      Un ejemplo destacado de este paradigma es la codificación por vibración, en la que un usuario delega el desarrollo de software y la edición de código a una IA. Pero los flujos de trabajo delegados van mucho más allá de la programación y se extienden a otras áreas. En contabilidad, por ejemplo, un usuario puede proporcionar un libro de contabilidad denso y pedirle al modelo que divida el documento en archivos separados organizados por categorías de gastos específicas.

                                      Dado que los usuarios pueden carecer del tiempo o la experiencia especializada para revisar manualmente cada cambio que implementa la IA, la delegación a menudo depende de la confianza. Los usuarios esperan que el modelo complete fielmente las tareas sin introducir errores no controlados, eliminaciones no autorizadas o alucinaciones en los documentos.

                                      Para medir qué tan confiables pueden ser los sistemas de IA en flujos de trabajo delegados extensos e iterativos, los investigadores desarrollaron el punto de referencia DELEGATE-52. El punto de referencia se compone de 310 entornos de trabajo que cubren 52 campos profesionales diversos, incluida la contabilidad financiera, la ingeniería de software, la cristalografía y la notación musical.

                                      Ejemplo de tarea DELEGATE-52 (fuente: arXiv)

                                      Cada entorno de trabajo se basa en documentos de texto semilla reales que van desde 2000 a 5000 tokens. Además del documento inicial, los entornos incluyen de cinco a diez tareas de edición complejas y no triviales.

                                      La puntuación de un proceso de edición complejo y de varios pasos normalmente requiere una costosa revisión humana. DELEGATE-52 soluciona este problema utilizando un método de simulación de «relé de ida y vuelta» que evalúa las respuestas sin requerir soluciones de referencia anotadas por humanos. El enfoque está inspirado en la técnica de retrotraducción utilizada en la evaluación de la traducción automática, donde se pide a un modelo de IA que traduzca un documento de un idioma a otro y viceversa para ver qué tan perfectamente reproduce la versión original.

                                      Como resultado, cada tarea de edición en DELEGATE-52 está diseñada para ser completamente reversible, combinando una instrucción directa con su inversa precisa. Por ejemplo, una instrucción para dividir el libro mayor en archivos separados por categoría de gastos se combina con una instrucción para fusionar todos los archivos de categorías en un solo libro mayor.

                                      En comentarios proporcionados a VentureBeat, Philippe Laban, investigador principal de Microsoft Research y coautor del artículo, aclaró que esto no es simplemente una prueba de si una IA puede presionar «deshacer». Dado que no se puede obligar a los trabajadores humanos a “olvidar” instantáneamente una tarea que acaban de completar, esta evaluación de ida y vuelta es particularmente adecuada para la IA. Al iniciar una nueva sesión de conversación, los investigadores obligan al modelo a intentar la tarea opuesta de forma completamente independiente.

                                      Los modelos de sus experimentos «no saben si una tarea es un paso hacia adelante o hacia atrás y no conocen el diseño general del experimento», explicó Laban. «Simplemente intentan realizar cada tarea lo más minuciosamente posible, en cada paso del camino».

                                      Relé de ida y vuelta DELEGATE-52

                                      Ejemplo de tarea de retransmisión de ida y vuelta (fuente: arXiv)

                                      Estas tareas de ida y vuelta se encadenan en un relevo continuo para simular flujos de trabajo a largo plazo que abarcan 20 interacciones consecutivas. Para hacer que el entorno sea más realista, el punto de referencia introduce archivos distractores en el contexto de cada tarea. Estos contienen entre 8.000 y 12.000 fichas de documentos temáticos pero completamente irrelevantes. Las distracciones miden si la IA puede mantener el enfoque o si se confunde y extrae datos incorrectos.

                                      Prueba de modelos de límites en el relé

                                      Para comprender cómo las diferentes arquitecturas y escalas manejan el trabajo delegado, los investigadores probaron 19 modelos de lenguaje diferentes de OpenAI, Anthropic, Google, Mistral, xAI y Moonshot. El experimento principal sometió estos modelos a una simulación de 20 interacciones de edición consecutivas.

                                      En todos los modelos combinados, los documentos sufrieron una degradación promedio del 50% al final de la simulación. Incluso los mejores modelos de frontera del experimento, en particular Gemini 3.1 Pro, Claude 4.6 Opus y GPT 5.4, corrompieron en promedio el 25% del contenido del documento.

                                      De 52 campos profesionales, Python fue el único donde la mayoría de los modelos alcanzaron el estado «listo» con una puntuación del 98% o más. Las plantillas destacan en tareas programáticas, pero tienen dificultades con el lenguaje natural y áreas específicas como ficción, estados de resultados o recetas. El modelo superior, Gemini 3.1 Pro, fue calificado como listo para trabajo delegado en sólo 11 de 52 áreas.

                                      delegado-52 resultados

                                      Todos los modelos tienen dificultades con las tareas de delegación (fuente: arXiv)

                                      Curiosamente, la corrupción no fue causada por la muerte de mil cortes donde los modelos acumulan lentamente pequeños errores. En cambio, alrededor del 80% de la degradación total es causada por fallas críticas raras pero masivas, que son interacciones únicas durante las cuales un modelo pierde repentinamente al menos el 10% del contenido del documento. Los modelos de límites no son necesariamente mejores para evitar pequeños errores. Simplemente posponen estos fracasos catastróficos para ciclos posteriores.

                                      Otra observación importante es que cuando los modelos más débiles fallan, su degradación se debe principalmente a la eliminación de contenido. Sin embargo, cuando los modelos de límites fallan, corrompen activamente el contenido existente. El texto sigue ahí, pero ha sido sutilmente distorsionado o alucinado, lo que hace mucho más difícil para un supervisor humano detectar el error.

                                      Curiosamente, darle a los modelos un arnés agente con herramientas genéricas para la ejecución de código y acceso de lectura/escritura a archivos en realidad degradó su rendimiento, agregando en promedio un 6% más de degradación. Laban explicó que el fracaso radica en confiar en herramientas genéricas en lugar de herramientas de dominio específico.

                                      «Los modelos no tienen la capacidad de escribir programas eficientes sobre la marcha que puedan manipular archivos en varios dominios sin errores», señaló. «Cuando no pueden hacer algo mediante programación, recurren a leer y reescribir archivos completos, lo cual es menos eficiente y más propenso a errores». La solución para los desarrolladores es crear herramientas de alcance limitado (como funciones específicas para calcular o mover entradas en archivos .ledger) para mantener a los agentes encaminados.

                                      La degradación también aumenta a medida que los documentos se vuelven más grandes o se agregan más archivos que distraen al espacio de trabajo. Para los equipos empresariales que invierten mucho en generación de recuperación aumentada (RAG), estos documentos que distraen sirven como una advertencia directa del costo compuesto de un entorno desordenado. Si bien una ventana emergente ruidosa puede provocar una caída mínima del rendimiento del 1 % después de solo dos interacciones, esta degradación se agrava hasta una caída masiva del 2 al 8 % en una simulación larga.

                                      «Para la comunidad de recuperación: los oleoductos RAG deben evaluarse en flujos de trabajo de múltiples etapas, no solo con criterios de recuperación de una sola ronda», dijo Laban. «Las mediciones de una sola vuelta subestiman sistemáticamente los daños de una recuperación imprecisa».

                                      Verificación de la realidad para el negocio autónomo

                                      Los resultados del benchmark DELEGATE-52 ofrecen una verificación crítica de la realidad del revuelo actual en torno a los agentes de IA totalmente autónomos.

                                      El diseño de referencia también implica una restricción práctica: debido a que los modelos pueden mantener un registro limpio durante varias etapas antes de una falla catastrófica repentina, se requiere una revisión humana incremental, no una sola verificación final. Laban recomienda crear aplicaciones de IA en torno a tareas breves y transparentes en lugar de agentes complejos a largo plazo. Esto conserva la implicación de la acción sin que el escritor proporcione la prescripción.

                                      Para las organizaciones que hoy buscan implementar de forma segura agentes autónomos, la metodología DELEGATE-52 proporciona un modelo práctico para probar canales de datos internos. Laban explicó que «… un equipo empresarial que desee adoptar este marco debe crear tres componentes: (a) un conjunto de tareas de edición reversibles representativas de sus flujos de trabajo, (b) un analizador que convierte sus documentos de dominio en una representación estructurada y (c) una función de similitud que compara dos representaciones analizadas. » Los equipos ni siquiera necesitan crear analizadores desde cero. El equipo de investigación de Microsoft reutilizó con éxito las bibliotecas de análisis existentes para 30 de los 52 dominios probados.

                                      Laban es optimista sobre el ritmo de mejora. «El progreso es real y rápido. Si analizamos únicamente la familia GPT, los modelos pasan de obtener una puntuación inferior al 20% a alrededor del 70% en 18 meses», afirmó Laban. «Si esta trayectoria continúa, los modelos pronto podrán alcanzar puntuaciones saturadas en DELEGATE-52».

                                      Sin embargo, Laban advirtió que DELEGATE-52 es intencionalmente pequeño en comparación con entornos empresariales masivos. Incluso si los modelos básicos inevitablemente dominan este punto de referencia, la larga e infinita cola de flujos de trabajo y datos empresariales únicos significa que las organizaciones seguirán necesitando invertir en herramientas personalizadas y específicas de dominio para garantizar la confiabilidad de sus agentes autónomos.

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      Jorge Polanco

                                      Jorge Polanco

                                      Comunicador | Columnista de Opinión & Análisis especializado en turismo y gestión pública, con una mirada crítica sobre la política turística, el ordenamiento territorial y el discurso institucional del sector

                                      Next Post
                                      Kylian Mbappé defendió las políticas de extrema izquierda impulsadas por Emmanuel Macron

                                      Kylian Mbappé defendió las políticas de extrema izquierda impulsadas por Emmanuel Macron

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • The agent evaluation gap: Enterprise AI organizations have a reality-alignment problem, not a coverage problem — and most are shipping to production anyway

                                        Agentic security: Enterprises enforce agent permissions two-thirds of the time — and isolate high-risk agents less than one in five

                                        0 shares
                                        Share 0 Tweet 0
                                      • Ofelia Fernández cobra $18 millones como “directora creativa” del CFI conducido por el hermano de Esteban Lamothe

                                        0 shares
                                        Share 0 Tweet 0
                                      • AP Cine-RD celebra su Primer Encuentro de Productores para…

                                        0 shares
                                        Share 0 Tweet 0
                                      • «Venganza en la prisión» encabeza el top 10 de películas más vistas en Netflix Argentina

                                        0 shares
                                        Share 0 Tweet 0
                                      • Natalio Mema, Ministro de Gobierno de Mendoza: «Javier Milei era lo que hacía falta»

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por