• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
jueves, septiembre 17, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

    Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

    Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

    Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

    Exprocurador general Jean Alain Rodríguez denuncia “manipulación” en informe de Participación Ciudadana

    Suprema Corte ratifica condena a Jean Alain Rodríguez por daños al periodista Marino Zapete

    Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

    Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

    Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

    Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

    Euclides Sánchez: “Habrían mafias en el gobierno con licitaciones; Oposición debe unirse para municipales; LF tiene hoy 43 %

    Euclides Sánchez: “Habrían mafias en el gobierno con licitaciones; Oposición debe unirse para municipales; LF tiene hoy 43 %

    Gobierno invierte más de RD$450 millones en reparación de 5.8 km de carretera, en Jamao al Norte

    Gobierno invierte más de RD$450 millones en reparación de 5.8 km de carretera, en Jamao al Norte

    Presidente de ANDECLIP propone fondo para cubrir emergencias de pacientes sin seguro

    Presidente de ANDECLIP propone fondo para cubrir emergencias de pacientes sin seguro

    FP: otro fracaso del PRM; prometieron 20,000 nuevos policías y aumento neto apenas llega a 2,509 en 5 años

    FP: otro fracaso del PRM; prometieron 20,000 nuevos policías y aumento neto apenas llega a 2,509 en 5 años

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      La Unión Europea endureció su postura frente a China por el creciente déficit comercial

      La Unión Europea endureció su postura frente a China por el creciente déficit comercial

      El presidente de Líbano quiere alcanzar un pacto de seguridad con Israel para acabar con Hezbolá

      El presidente de Líbano quiere alcanzar un pacto de seguridad con Israel para acabar con Hezbolá

      El impuestazo que Daniel Passerini intenta reflotar pese al freno de la Corte Suprema

      El impuestazo que Daniel Passerini intenta reflotar pese al freno de la Corte Suprema

      Inversiones: Netflix Argentina anuncia ocho nuevas producciones locales que arrancan en 2026

      Inversiones: Netflix Argentina anuncia ocho nuevas producciones locales que arrancan en 2026

      Llaryora reconoció a los docentes por los resultados alcanzados por Córdoba en las pruebas PISA

      Llaryora reconoció a los docentes por los resultados alcanzados por Córdoba en las pruebas PISA

      Argentina podría alcanzar un nuevo récord de producción de gas después de 22 años

      Argentina podría alcanzar un nuevo récord de producción de gas después de 22 años

      El Gobierno de Milei proyecta crecimiento, superávit fiscal y baja de impuestos para 2027

      El Gobierno de Milei proyecta crecimiento, superávit fiscal y baja de impuestos para 2027

      Passerini participó en un acto junto a Kicillof y ya no esconde su identificación kirchnerista

      Passerini participó en un acto junto a Kicillof y ya no esconde su identificación kirchnerista

      Argentina en los Juegos Suramericanos Santa Fe 2026 hoy: medallas, resultados y agenda del miércoles 16

      Argentina en los Juegos Suramericanos Santa Fe 2026 hoy: medallas, resultados y agenda del miércoles 16

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

        Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

        Observatorio de Áreas Protegidas alerta sobre una emergencia por incendios forestales en República Dominicana

        Observatorio de Áreas Protegidas alerta sobre una emergencia por incendios forestales en República Dominicana

        Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

        Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

        Exprocurador general Jean Alain Rodríguez denuncia “manipulación” en informe de Participación Ciudadana

        Suprema Corte ratifica condena a Jean Alain Rodríguez por daños al periodista Marino Zapete

        Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

        Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

        Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

        Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

        El Niño pone a prueba la seguridad hídrica de República Dominicana y obliga a repensar la gestión del agua

        El Niño pone a prueba la seguridad hídrica de República Dominicana y obliga a repensar la gestión del agua

        Belkys Cuello fortalece representación dominicana en el sector...

        Belkys Cuello fortalece representación dominicana en el sector…

        Sepsis puede convertir una infección común en una emergencia médica

        Sepsis puede convertir una infección común en una emergencia médica

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

          Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

          Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

          Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

          Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

          Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

          ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

          ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

          Fuerza del Pueblo cuestiona resultados del programa social...

          Fuerza del Pueblo cuestiona resultados del programa social…

          Rafael Alburquerque advierte que endeudarse para comer revela la difícil realidad económica de las familias dominicanas

          Rafael Alburquerque advierte que endeudarse para comer revela la difícil realidad económica de las familias dominicanas

          SAN JUAN: Presidente provincial de la Fuerza del Pueblo calificó como un rotundo éxito la reciente visita del expresidente Leonel Fernandez

          SAN JUAN: Presidente provincial de la Fuerza del Pueblo calificó como un rotundo éxito la reciente visita del expresidente Leonel Fernandez

          Kelvin Faña asegura Luis Abinader ha salido más inteligente...

          Kelvin Faña asegura Luis Abinader ha salido más inteligente…

          Consulta del PLD avanza con transparencia, imparcialidad...

          Consulta del PLD avanza con transparencia, imparcialidad…

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                Kempton Park killings: Ninth woman's body found in South Africa's Dawn Park

                Kempton Park killings: Ninth woman’s body found in South Africa’s Dawn Park

                EU announces plan to restrict social media access for children

                EU announces plan to restrict social media access for children

                Australia immigration crackdown: visas for international students and backpackers targeted

                Australia immigration crackdown: visas for international students and backpackers targeted

                Russia's elections will have few surprises, but for the Kremlin they matter

                Russia’s elections will have few surprises, but for the Kremlin they matter

                Austin Tice: Assad regime planned US journalist's kidnap for weeks, BBC finds

                Austin Tice: Assad regime planned US journalist’s kidnap for weeks, BBC finds

                Snapchat 'willing to implement' daily time limits for children, boss tells BBC

                Snapchat ‘willing to implement’ daily time limits for children, boss tells BBC

                US interest rates raised for first time in three years

                US interest rates raised for first time in three years

                Putin llama a los rusos a votar en las elecciones legislativas para contribuir a la victoria de Rusia

                Putin llama a los rusos a votar en las elecciones legislativas para contribuir a la victoria de Rusia

                De las urnas a las redes: jóvenes de Brasil candidatos alternativos

                De las urnas a las redes: jóvenes de Brasil candidatos alternativos

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  Una estrategia global de seguridad de la IA depende de la cooperación entre Estados Unidos y China. Cada uno ve al otro como el problema.

                  Una estrategia global de seguridad de la IA depende de la cooperación entre Estados Unidos y China. Cada uno ve al otro como el problema.

                  Zuckerberg distancia a Meta de los llamados a un enfoque coordinado ante la desaceleración de la IA

                  Zuckerberg distancia a Meta de los llamados a un enfoque coordinado ante la desaceleración de la IA

                  Los satélites muestran que la Tierra perdió más de 12 billones de toneladas de hielo de Groenlandia y la Antártida en 47 años

                  Los satélites muestran que la Tierra perdió más de 12 billones de toneladas de hielo de Groenlandia y la Antártida en 47 años

                  El jefe de la UE propone prohibir en todo el bloque las redes sociales para niños menores de 13 años

                  El jefe de la UE propone prohibir en todo el bloque las redes sociales para niños menores de 13 años

                  Los rivales de la IA llegaron a un acuerdo poco común en materia de seguridad. Ponerlo en práctica es más difícil.

                  Los rivales de la IA llegaron a un acuerdo poco común en materia de seguridad. Ponerlo en práctica es más difícil.

                  Mientras el mundo debate los riesgos de la IA, China cierra la brecha tecnológica con Estados Unidos

                  Mientras el mundo debate los riesgos de la IA, China cierra la brecha tecnológica con Estados Unidos

                  La Fundación Gates advierte que la IA podría ampliar la desigualdad; promete mil millones de dólares para ampliar el acceso

                  La Fundación Gates advierte que la IA podría ampliar la desigualdad; promete mil millones de dólares para ampliar el acceso

                  Trump califica los riesgos de IA como un "engaño" y dice que existe una "conspiración ENFERMA" contra la IA y los centros de datos

                  Trump califica los riesgos de IA como un «engaño» y dice que existe una «conspiración ENFERMA» contra la IA y los centros de datos

                  Microsoft se compromete a implementar amplias reglas de privacidad de IA para estudiantes

                  Microsoft se compromete a implementar amplias reglas de privacidad de IA para estudiantes

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                    Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

                      Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

                      Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

                      Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

                      Exprocurador general Jean Alain Rodríguez denuncia “manipulación” en informe de Participación Ciudadana

                      Suprema Corte ratifica condena a Jean Alain Rodríguez por daños al periodista Marino Zapete

                      Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

                      Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

                      Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

                      Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

                      Euclides Sánchez: “Habrían mafias en el gobierno con licitaciones; Oposición debe unirse para municipales; LF tiene hoy 43 %

                      Euclides Sánchez: “Habrían mafias en el gobierno con licitaciones; Oposición debe unirse para municipales; LF tiene hoy 43 %

                      Gobierno invierte más de RD$450 millones en reparación de 5.8 km de carretera, en Jamao al Norte

                      Gobierno invierte más de RD$450 millones en reparación de 5.8 km de carretera, en Jamao al Norte

                      Presidente de ANDECLIP propone fondo para cubrir emergencias de pacientes sin seguro

                      Presidente de ANDECLIP propone fondo para cubrir emergencias de pacientes sin seguro

                      FP: otro fracaso del PRM; prometieron 20,000 nuevos policías y aumento neto apenas llega a 2,509 en 5 años

                      FP: otro fracaso del PRM; prometieron 20,000 nuevos policías y aumento neto apenas llega a 2,509 en 5 años

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        La Unión Europea endureció su postura frente a China por el creciente déficit comercial

                        La Unión Europea endureció su postura frente a China por el creciente déficit comercial

                        El presidente de Líbano quiere alcanzar un pacto de seguridad con Israel para acabar con Hezbolá

                        El presidente de Líbano quiere alcanzar un pacto de seguridad con Israel para acabar con Hezbolá

                        El impuestazo que Daniel Passerini intenta reflotar pese al freno de la Corte Suprema

                        El impuestazo que Daniel Passerini intenta reflotar pese al freno de la Corte Suprema

                        Inversiones: Netflix Argentina anuncia ocho nuevas producciones locales que arrancan en 2026

                        Inversiones: Netflix Argentina anuncia ocho nuevas producciones locales que arrancan en 2026

                        Llaryora reconoció a los docentes por los resultados alcanzados por Córdoba en las pruebas PISA

                        Llaryora reconoció a los docentes por los resultados alcanzados por Córdoba en las pruebas PISA

                        Argentina podría alcanzar un nuevo récord de producción de gas después de 22 años

                        Argentina podría alcanzar un nuevo récord de producción de gas después de 22 años

                        El Gobierno de Milei proyecta crecimiento, superávit fiscal y baja de impuestos para 2027

                        El Gobierno de Milei proyecta crecimiento, superávit fiscal y baja de impuestos para 2027

                        Passerini participó en un acto junto a Kicillof y ya no esconde su identificación kirchnerista

                        Passerini participó en un acto junto a Kicillof y ya no esconde su identificación kirchnerista

                        Argentina en los Juegos Suramericanos Santa Fe 2026 hoy: medallas, resultados y agenda del miércoles 16

                        Argentina en los Juegos Suramericanos Santa Fe 2026 hoy: medallas, resultados y agenda del miércoles 16

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

                          Policía abate a dos miembros bandas «Los Fantamas» acusados dar muerte a Diddy Glow

                          Observatorio de Áreas Protegidas alerta sobre una emergencia por incendios forestales en República Dominicana

                          Observatorio de Áreas Protegidas alerta sobre una emergencia por incendios forestales en República Dominicana

                          Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

                          Vicepresidenta Raquel Peña supervisa construcción del Hospital Traumatológico Luis L. Bogaert en Mao

                          Exprocurador general Jean Alain Rodríguez denuncia “manipulación” en informe de Participación Ciudadana

                          Suprema Corte ratifica condena a Jean Alain Rodríguez por daños al periodista Marino Zapete

                          Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

                          Fuerza del Pueblo solicita a Estados Unidos trato especial para el arroz dominicano

                          Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

                          Ramón Raposo: “Hay que sacar al PRM de Palacio; servicios públicos, inseguridad e inflación acaban a RD”

                          El Niño pone a prueba la seguridad hídrica de República Dominicana y obliga a repensar la gestión del agua

                          El Niño pone a prueba la seguridad hídrica de República Dominicana y obliga a repensar la gestión del agua

                          Belkys Cuello fortalece representación dominicana en el sector...

                          Belkys Cuello fortalece representación dominicana en el sector…

                          Sepsis puede convertir una infección común en una emergencia médica

                          Sepsis puede convertir una infección común en una emergencia médica

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

                            Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

                            Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

                            Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

                            Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

                            Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

                            ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

                            ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

                            Fuerza del Pueblo cuestiona resultados del programa social...

                            Fuerza del Pueblo cuestiona resultados del programa social…

                            Rafael Alburquerque advierte que endeudarse para comer revela la difícil realidad económica de las familias dominicanas

                            Rafael Alburquerque advierte que endeudarse para comer revela la difícil realidad económica de las familias dominicanas

                            SAN JUAN: Presidente provincial de la Fuerza del Pueblo calificó como un rotundo éxito la reciente visita del expresidente Leonel Fernandez

                            SAN JUAN: Presidente provincial de la Fuerza del Pueblo calificó como un rotundo éxito la reciente visita del expresidente Leonel Fernandez

                            Kelvin Faña asegura Luis Abinader ha salido más inteligente...

                            Kelvin Faña asegura Luis Abinader ha salido más inteligente…

                            Consulta del PLD avanza con transparencia, imparcialidad...

                            Consulta del PLD avanza con transparencia, imparcialidad…

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  Kempton Park killings: Ninth woman's body found in South Africa's Dawn Park

                                  Kempton Park killings: Ninth woman’s body found in South Africa’s Dawn Park

                                  EU announces plan to restrict social media access for children

                                  EU announces plan to restrict social media access for children

                                  Australia immigration crackdown: visas for international students and backpackers targeted

                                  Australia immigration crackdown: visas for international students and backpackers targeted

                                  Russia's elections will have few surprises, but for the Kremlin they matter

                                  Russia’s elections will have few surprises, but for the Kremlin they matter

                                  Austin Tice: Assad regime planned US journalist's kidnap for weeks, BBC finds

                                  Austin Tice: Assad regime planned US journalist’s kidnap for weeks, BBC finds

                                  Snapchat 'willing to implement' daily time limits for children, boss tells BBC

                                  Snapchat ‘willing to implement’ daily time limits for children, boss tells BBC

                                  US interest rates raised for first time in three years

                                  US interest rates raised for first time in three years

                                  Putin llama a los rusos a votar en las elecciones legislativas para contribuir a la victoria de Rusia

                                  Putin llama a los rusos a votar en las elecciones legislativas para contribuir a la victoria de Rusia

                                  De las urnas a las redes: jóvenes de Brasil candidatos alternativos

                                  De las urnas a las redes: jóvenes de Brasil candidatos alternativos

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    Una estrategia global de seguridad de la IA depende de la cooperación entre Estados Unidos y China. Cada uno ve al otro como el problema.

                                    Una estrategia global de seguridad de la IA depende de la cooperación entre Estados Unidos y China. Cada uno ve al otro como el problema.

                                    Zuckerberg distancia a Meta de los llamados a un enfoque coordinado ante la desaceleración de la IA

                                    Zuckerberg distancia a Meta de los llamados a un enfoque coordinado ante la desaceleración de la IA

                                    Los satélites muestran que la Tierra perdió más de 12 billones de toneladas de hielo de Groenlandia y la Antártida en 47 años

                                    Los satélites muestran que la Tierra perdió más de 12 billones de toneladas de hielo de Groenlandia y la Antártida en 47 años

                                    El jefe de la UE propone prohibir en todo el bloque las redes sociales para niños menores de 13 años

                                    El jefe de la UE propone prohibir en todo el bloque las redes sociales para niños menores de 13 años

                                    Los rivales de la IA llegaron a un acuerdo poco común en materia de seguridad. Ponerlo en práctica es más difícil.

                                    Los rivales de la IA llegaron a un acuerdo poco común en materia de seguridad. Ponerlo en práctica es más difícil.

                                    Mientras el mundo debate los riesgos de la IA, China cierra la brecha tecnológica con Estados Unidos

                                    Mientras el mundo debate los riesgos de la IA, China cierra la brecha tecnológica con Estados Unidos

                                    La Fundación Gates advierte que la IA podría ampliar la desigualdad; promete mil millones de dólares para ampliar el acceso

                                    La Fundación Gates advierte que la IA podría ampliar la desigualdad; promete mil millones de dólares para ampliar el acceso

                                    Trump califica los riesgos de IA como un "engaño" y dice que existe una "conspiración ENFERMA" contra la IA y los centros de datos

                                    Trump califica los riesgos de IA como un «engaño» y dice que existe una «conspiración ENFERMA» contra la IA y los centros de datos

                                    Microsoft se compromete a implementar amplias reglas de privacidad de IA para estudiantes

                                    Microsoft se compromete a implementar amplias reglas de privacidad de IA para estudiantes

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      Las empresas que utilizan múltiples modelos de IA subestiman las tasas de fracaso en 2,25 veces

                                      by — Redacción Despertar Matinal
                                      9 de julio de 2026
                                      in Tecnología
                                      0
                                      Las empresas que utilizan múltiples modelos de IA subestiman las tasas de fracaso en 2,25 veces
                                      0
                                      SHARES
                                      7
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Un equipo que dirige consultas a través de un especialista en codificación, un especialista en lógica y un modelo generalista asume que cada uno cubrirá los puntos ciegos de los demás. Un nuevo estudio La evaluación de 67 modelos de frontera de 21 proveedores muestra que la suposición es matemáticamente errónea, y la falla tiene un nombre: el techo de co-fracaso.

                                      La suposición funciona así: siempre que dos modelos no fallen con exactamente las mismas indicaciones, se supone que combinarlos crea una red de seguridad contra fallas.

                                      El verdadero límite de la orquestación no es la frecuencia con la que los modelos no están de acuerdo, sino el porcentaje de indicaciones en las que cada modelo del grupo da la respuesta incorrecta a la vez. Al ignorar el techo de co-fracaso, las empresas están construyendo una infraestructura de enrutamiento compleja y costosa para perseguir ganancias de desempeño que no existen. Afortunadamente, los desarrolladores pueden usar esta misma matemática para crear una prueba gratuita que determine exactamente cuándo la orquestación multimodelo realmente dará sus frutos.

                                      Los costos ocultos de la estrategia multimodelo

                                      Para orquestar múltiples modelos de lenguaje, los desarrolladores suelen confiar en tres arquitecturas. enrutadores modelo actúan como policías de tránsito, enviando consultas complejas a modelos costosos y consultas simples a modelos más baratos. Las cascadas envían todos los mensajes a un modelo económico primero y solo escalan a un modelo premium si el sistema inicial indica poca confianza. Finalmente, enfoques como Mezcla de agentes (MoA) fusionan múltiples modelos haciéndoles la misma pregunta y generando una respuesta sintetizada a partir de sus resultados combinados.

                                      Estas arquitecturas introducen un «precio sombra» a los costos de inferencia. Cada vez que un equipo de desarrollo implementa un enrutador o una cascada, paga una prima en latencia adicional del sistema, mantenimiento complejo de la infraestructura y mayores riesgos de gobernanza en múltiples proveedores de API.

                                      Para justificar estos costos operativos, los ingenieros se basan en la «correlación de errores por pares» para seleccionar su grupo de modelos. Imagine que un desarrollador tiene el Modelo A, que escribe excelente Python pero falla en SQL, y el Modelo B, que escribe excelente SQL pero falla en Python. Debido a que fallan en diferentes tipos de indicaciones, su correlación de error por pares es baja. El desarrollador supone que al colocar una capa de enrutamiento frente a ellos, han creado un sistema compuesto que rara vez falla en la codificación.

                                      Según el estudio, combinar diversos modelos basándose en una baja correlación puede perjudicar el rendimiento si los modelos no son igualmente capaces: cuando se vota entre modelos diversos pero desiguales, los más débiles a menudo se unen y superan en votos al más inteligente.

                                      Josef Chen, autor del artículo, dijo a VentureBeat que en sus experimentos, «la votación por mayoría ingenua en modelos desiguales tuvo una ganancia media negativa (menos 10 puntos en nuestra combinación dura): los miembros diversos pero más débiles superan en votos al fuerte». El consejo práctico para los desarrolladores es «combinar sólo modelos dentro de una banda de calidad equivalente». Si no puede igualar la calidad, tome la base de un solo modelo y gaste su presupuesto en el mejor modelo disponible.

                                      El documento proporciona un punto brillante para este enfoque con respecto a las arquitecturas MoA. Al crear conjuntos, los equipos suelen utilizar «Self-MoA», donde consultan el mismo modelo premium varias veces para generar una respuesta sintetizada. Los investigadores descubrieron que, con una calidad equivalente, construir un conjunto diverso de modelos con baja correlación por pares supera a una configuración Self-MoA de alta correlación.

                                      Sin embargo, cuando los equipos utilizan esa misma métrica de correlación por pares para predecir la precisión absoluta de su sistema general, las matemáticas fallan.

                                      «Así que los equipos pagan los gastos generales de orquestación por adelantado (latencia, complejidad, operaciones de múltiples proveedores) asumiendo que un dividendo de diversidad llega más tarde», dijo Chen. «Por lo general, no es así, porque los mejores modelos actuales concuerdan y, peor aún, fallan en las mismas preguntas… el mensaje simplemente transmite poca señal sobre qué modelo será el correcto cuando la frontera no esté de acuerdo».

                                      Por qué fallan las matemáticas: el techo de cofracaso

                                      El hallazgo principal del estudio se centra en una métrica llamada «tasa de co-fracaso», el nombre formal para el escenario totalmente equivocado descrito anteriormente. Ningún enrutador, sistema de votación o cascada podrá alcanzar una precisión superior al límite que impone.

                                      El conjunto de codificación, lógica y generalismo muestra una baja correlación por pares en las indicaciones de rutina; rara vez fallan juntos. Pero el techo del co-fracaso representa el oscuro y altamente complejo caso límite que supera los límites de las arquitecturas de IA actuales. Si un mensaje es tan difícil que los tres modelos alucinan o fallan, no importa cuán inteligentemente el enrutador distribuya la tarea. Toda la piscina se borra de una vez.

                                      Los investigadores probaron su grupo de 67 modelos, que incluía GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, en el punto de referencia matemático abierto MATH-500. Basados ​​en la correlación estándar por pares, los modelos estadísticos predijeron que todo el grupo desaparecería simultáneamente en sólo el 2,3% de las preguntas. En realidad, la tasa de co-fracaso fue del 5,2%.

                                      Estudio de 67 LLM líderes en entornos de múltiples LLM (fuente: arXiv)

                                      Las métricas de correlación estándar subestimaron la tasa de fracaso aproximadamente 2,25 veces. El culpable no es sólo una dificultad independiente, sino un punto de falla compartido.

                                      «El impulsor es lo que llamamos un átomo de modo común: una porción de consultas en las que todo el mercado falla en conjunto, que ninguna estadística por pares puede detectar», dijo Chen. «Agregar un modelo número 20 a su piscina no compra cobertura de cola. La cola se comparte».

                                      Los investigadores también encontraron que el formato de la tarea desencadena directamente el fracaso conjunto. Cuando tomaron preguntas científicas de nivel de posgrado del punto de referencia GPQA y las cambiaron de formatos de opción múltiple a formatos de respuesta libre, la cola totalmente incorrecta se expandió al 12,7%.

                                      Sin embargo, los desarrolladores pueden diseñar alrededor del techo. «La implicación de ingeniería es incómoda: las configuraciones multimodelo compran menos exactamente donde los equipos más los quieren, en una generación abierta», dijo Chen. «En cualquier lugar donde se pueda convertir la generación en verificación o selección restringida (resultados estructurados, respuestas verificables, pruebas de ejecución), se vuelve a abrir el techo».

                                      En última instancia, los investigadores descubrieron que este límite limita las aplicaciones de IA de dos maneras distintas, según el dominio:

                                      • Entornos limitados (por ejemplo, matemáticas abiertas): La tasa de co-fracaso es alta. La tarea es demasiado difícil y todos los modelos fallan simultáneamente. Ninguna cantidad de enrutamiento puede superar la falta de capacidad subyacente.

                                      • Entornos vinculados a la realizabilidad (p. ej., ciencias de posgrado): La tasa de co-fracaso es cercana a cero, lo que significa que al menos un modelo del grupo suele saber la respuesta. Sin embargo, los modelos discrepan tan sutilmente que una capa de enrutamiento no puede elegir de manera confiable la respuesta correcta sin un oráculo omnisciente.

                                      La verificación de cordura previa a la implementación de $0

                                      Antes de dedicar horas de ingeniería a construir un enrutador, los equipos pueden calcular su límite de rendimiento absoluto de forma gratuita utilizando una fórmula matemática llamada límite de Clopper-Pearson.

                                      El límite Clopper-Pearson funciona como una calculadora del peor de los casos. Si lanza una moneda diez veces y obtiene ocho caras, no puede garantizar que la moneda salga cara el 80% de las veces para siempre. El límite toma una pequeña muestra de preguntas del examen y genera un límite matemáticamente garantizado.

                                      Aplicado a modelos de lenguaje, supongamos que un equipo prueba un grupo de cinco agentes en 50 consultas de muestra y descubre que todos fallan en solo dos preguntas. Un desarrollador podría asumir que su sistema multiagente alcanzará una precisión del 96 % en la producción. La fórmula Clopper-Pearson corrige este optimismo. Analiza el pequeño tamaño de la muestra y proporciona una garantía matemática de que la verdadera tasa de co-fracaso podría llegar al 12%.

                                      Para utilizar esto en la práctica, las empresas deben crear un conjunto de datos disponible. Una empresa de tecnología financiera, por ejemplo, podría tomar 200 tickets complejos de atención al cliente del trimestre anterior y hacer que agentes humanos escriban resoluciones perfectas que sirvan como punto de referencia. Si bien esto parece un proyecto manual pesado, los equipos de ingeniería maduros pueden automatizar todo el cálculo del techo.

                                      «La integración es trivial: es un trabajo de conteo de los registros de evaluación que los equipos ya producen», señala Chen, «por lo que se ejecuta en la misma etapa de CI que el conjunto de evaluación y se vuelve a activar cada vez que cambia el grupo de modelos o la carga de trabajo».

                                      Luego, el equipo de ingeniería compara sus modelos candidatos con estos 200 tickets una vez y registra los resultados. Cuando quieran evaluar configuraciones de múltiples modelos, pueden usar la medida de tasa de co-fallo para predecir la máxima precisión que pueden obtener del sistema sin ejecutar consultas adicionales.

                                      Una conclusión importante a la que llega el estudio es que en tareas en las que las respuestas se pueden verificar definitivamente, la combinación de modelos rara vez supera al uso del mejor modelo del mercado, a menos que el equipo posea una señal de enrutamiento a nivel de consulta excepcionalmente fuerte.

                                      En un entorno empresarial, una tarea definitivamente comprobada tiene una respuesta objetiva y de tolerancia cero. Esto incluye generar una consulta SQL que debe ejecutarse sin errores, extraer el total de una factura específica de un PDF de 50 páginas o formatear una carga útil JSON que coincida perfectamente con un esquema estricto. Para estas tareas, las empresas suelen estar mejor pagando una prima por el modelo de frontera más inteligente en lugar de combinar tres modelos más baratos y esperar que un enrutador elija la salida correcta. El estudio no probó tareas subjetivas y no calificadas, como redactar textos de marketing; los autores señalan que si estos hallazgos se mantienen fuera de sus puntos de referencia verificables sigue siendo una cuestión abierta.

                                      Debido a que esta verificación matemática es gratuita, los equipos empresariales pueden realizar un seguimiento de sus propias tasas de co-fracaso a medida que aparecen nuevos modelos.

                                      «La medición no cuesta nada, por lo que cualquier equipo puede rastrear su propia tasa de co-fracaso a través de generaciones de modelos y observar si la cola se está cerrando», dice Chen. En última instancia, «la palanca que mantienen los compradores es la heterogeneidad del modo de fracaso y la rotación del mercado, no el recuento de modelos».

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      — Redacción Despertar Matinal

                                      — Redacción Despertar Matinal

                                      Programa radial que te conecta con la información desde temprano en la mañana.

                                      Next Post
                                      El FMI apoyó la reforma de la Carta Orgánica del BCRA y destacó el rumbo económico de Milei

                                      El FMI apoyó la reforma de la Carta Orgánica del BCRA y destacó el rumbo económico de Milei

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • La ONU le exigió al Reino Unido que negocie la soberanía de Malvinas con Argentina

                                        La ONU le exigió al Reino Unido que negocie la soberanía de Malvinas con Argentina

                                        0 shares
                                        Share 0 Tweet 0
                                      • OpenAI’s Sam Altman says world ‘right to be afraid’ but ‘should trust’ AI firms

                                        0 shares
                                        Share 0 Tweet 0
                                      • El robot humanoide ‘Lightning’ bate el récord de media maratón

                                        0 shares
                                        Share 0 Tweet 0
                                      • Mientras el mundo debate los riesgos de la IA, China cierra la brecha tecnológica con Estados Unidos

                                        0 shares
                                        Share 0 Tweet 0
                                      • Olu Jacobs: Legendary Nollywood actor dies in Nigeria aged 84

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por