• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
viernes, septiembre 4, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

    Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

    Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

    Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

    Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

    Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

    FP Santiago: apagones y facturas revelan fracaso del PRM

    FP Santiago: apagones y facturas revelan fracaso del PRM

    Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

    Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

    AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

    AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

    Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

    Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

    Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

    Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

    Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

    Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

      El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

      Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

      Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

      Malvinas sin guerra | La Derecha Diario

      Malvinas sin guerra | La Derecha Diario

      El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

      El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

      HBO Max: la lista completa de estrenos de series y películas en septiembre

      HBO Max: la lista completa de estrenos de series y películas en septiembre

      En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

      En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

      Pablo Quirno tras la cadena nacional de Milei: "La causa Malvinas está arriba de todo"

      Pablo Quirno tras la cadena nacional de Milei: «La causa Malvinas está arriba de todo»

      Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

      Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

      Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

      Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

        Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

        Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

        Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

        Banco BHD fortalece sus canales digitales con nuevas...

        Banco BHD fortalece sus canales digitales con nuevas…

        Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

        Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

        FP Santiago: apagones y facturas revelan fracaso del PRM

        FP Santiago: apagones y facturas revelan fracaso del PRM

        Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

        Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

        AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

        AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

        Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

        Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

        República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

        República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

          Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

          ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

          ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

          Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

          Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

          Antonio Marte juramenta nuevas estructuras fortalecen PPG

          Antonio Marte juramenta nuevas estructuras fortalecen PPG

          Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

          Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

          Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

          Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                Europe targeted by spiralling campaign of sabotage and Russia is the chief suspect

                Europe targeted by spiralling campaign of sabotage and Russia is the chief suspect

                Russian drone hits Ukranian security headquarters, Zelensky says

                Russian drone hits Ukranian security headquarters, Zelensky says

                Trump's peace envoys to visit Moscow and Kyiv - reports say

                Trump’s peace envoys to visit Moscow and Kyiv – reports say

                Uganda's King Oyo death: Body of world's youngest traditional monarch returns amid succession row

                Uganda’s King Oyo death: Body of world’s youngest traditional monarch returns amid succession row

                Falkland Islands: UK support 'unwavering' after Argentina restates claims

                Falkland Islands: UK support ‘unwavering’ after Argentina restates claims

                US diesel prices hit an all-time-high

                US diesel prices hit an all-time-high

                How could US-Iran conflict end? Three experts give their views

                How could US-Iran conflict end? Three experts give their views

                Steve Irwin's family celebrates 'superhero' dad, 20 years after shock death

                Steve Irwin’s family celebrates ‘superhero’ dad, 20 years after shock death

                Argentine leader says oil firms working off Falklands face sanctions

                Argentine leader says oil firms working off Falklands face sanctions

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                  El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                  El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                  El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                  Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                  Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                  'Welcome to the AGI era': OpenAI launches GPT-6 Astra

                  ‘Welcome to the AGI era’: OpenAI launches GPT-6 Astra

                  Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                  Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                  30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                  Científicos que estudian la leche de cucaracha y sonarse la nariz ganan premios Ig Nobel por ciencia peculiar

                  Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                  Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                  Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                  Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                  Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                  Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                    Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                      Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                      Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                      Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                      Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                      Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                      FP Santiago: apagones y facturas revelan fracaso del PRM

                      FP Santiago: apagones y facturas revelan fracaso del PRM

                      Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                      Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                      AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                      AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                      Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                      Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                      Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

                      Aseguran auditoría de la Cámara de Cuentas no encontró irregularidades en la gestión de Roberto Fulcar al frente del MINERD

                      Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

                      Recesan juicio de fondo contra Hugo Beras, Jochi Gómez y compartes

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

                        El Gobierno de Milei destinó más de $5 billones a reforzar jubilaciones, salud y defensa

                        Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

                        Los veteranos de Malvinas apoyaron los anuncios de Milei para defender la soberanía argentina

                        Malvinas sin guerra | La Derecha Diario

                        Malvinas sin guerra | La Derecha Diario

                        El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

                        El día que Cristina Kirchner designó a una ciudadana británica en cargos clave de Seguridad y Defensa

                        HBO Max: la lista completa de estrenos de series y películas en septiembre

                        HBO Max: la lista completa de estrenos de series y películas en septiembre

                        En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

                        En qué consiste la Ley de Defensa de la Soberanía Nacional que Milei enviará al Congreso

                        Pablo Quirno tras la cadena nacional de Milei: "La causa Malvinas está arriba de todo"

                        Pablo Quirno tras la cadena nacional de Milei: «La causa Malvinas está arriba de todo»

                        Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

                        Javier Milei apuntó contra la crisis migratoria que azota al Reino Unido

                        Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

                        Qué es Sea Lion, el proyecto petrolero británico en Malvinas que Milei busca frenar

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                          Fuerza del Pueblo emplaza a la DGA a demostrar el destino de 3,900 contenedores en tránsito hacia Haití

                          Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                          Dr. Miguel Monanci: “Drama de vida o muerte; a pacientes de cáncer enfrentan dilema; 90% llegan con mal avanzado”

                          Banco BHD fortalece sus canales digitales con nuevas...

                          Banco BHD fortalece sus canales digitales con nuevas…

                          Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                          Espaillat Bencosme: la mecanización permitirá reducir costos y mejorar rentabilidad del productor

                          FP Santiago: apagones y facturas revelan fracaso del PRM

                          FP Santiago: apagones y facturas revelan fracaso del PRM

                          Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                          Procuradora General revela RD registra 62 feminicidios en lo que va de 2026; llama a reforzar prevención

                          AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                          AIRD considera nuevo Código Penal plantea reto de fortalecer cultura de cumplimiento de las empresas en RD

                          Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                          Presidente Abinader destaca reducción de la pobreza y avances sociales y económicos de República Dominicana

                          República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

                          República Dominicana y Haití desarrollan agenda de trabajo sobre temas de interés bilateral

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

                            Fuerza del Pueblo denuncia aumentan las quejas por facturación elevada y persisten los apagones

                            ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

                            ¡Leonel Fernández llega a San Juan! La Fuerza del Pueblo prepara gran acto de juramentación de nuevos miembros

                            Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

                            Dicen proyecto presidencial de Gonzalo Castillo impacta más de 40 territorios el fin de semana

                            Antonio Marte juramenta nuevas estructuras fortalecen PPG

                            Antonio Marte juramenta nuevas estructuras fortalecen PPG

                            Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

                            Leonel Fernández encabeza asambleas provinciales en despliegue nacional de la Fuerza del Pueblo

                            Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

                            Rafael Méndez “El Conde” anuncia aspiración a regidor por Fuerza del Pueblo en San Juan de la Maguana

                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Vicealcaldesa de Los Alcarrizos abandona el PRM y se juramenta en la Fuerza del Pueblo junto a más de 300 dirigentes

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Leonel afirma PRM no pudo mantener 24 horas de electricidad y la gente está cansada de apagones

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Johnny Pujols afirma PLD fortalece su estructura territorial mientras PRM va en picada

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  Europe targeted by spiralling campaign of sabotage and Russia is the chief suspect

                                  Europe targeted by spiralling campaign of sabotage and Russia is the chief suspect

                                  Russian drone hits Ukranian security headquarters, Zelensky says

                                  Russian drone hits Ukranian security headquarters, Zelensky says

                                  Trump's peace envoys to visit Moscow and Kyiv - reports say

                                  Trump’s peace envoys to visit Moscow and Kyiv – reports say

                                  Uganda's King Oyo death: Body of world's youngest traditional monarch returns amid succession row

                                  Uganda’s King Oyo death: Body of world’s youngest traditional monarch returns amid succession row

                                  Falkland Islands: UK support 'unwavering' after Argentina restates claims

                                  Falkland Islands: UK support ‘unwavering’ after Argentina restates claims

                                  US diesel prices hit an all-time-high

                                  US diesel prices hit an all-time-high

                                  How could US-Iran conflict end? Three experts give their views

                                  How could US-Iran conflict end? Three experts give their views

                                  Steve Irwin's family celebrates 'superhero' dad, 20 years after shock death

                                  Steve Irwin’s family celebrates ‘superhero’ dad, 20 years after shock death

                                  Argentine leader says oil firms working off Falklands face sanctions

                                  Argentine leader says oil firms working off Falklands face sanctions

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                                    El satélite de rescate se acerca al telescopio condenado de la NASA, incluso si no puede salvarlo

                                    El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                                    El sitio web de la Casa Blanca estrena 5 videojuegos arcade retro que promueven la agenda de Trump

                                    Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                                    Las cámaras de vigilancia de multitudes se convierten en el objetivo de la campaña de mitad de mandato mientras los votantes se resisten al poder de las empresas de tecnología

                                    'Welcome to the AGI era': OpenAI launches GPT-6 Astra

                                    ‘Welcome to the AGI era’: OpenAI launches GPT-6 Astra

                                    Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                                    Los piratas informáticos vinculados a China abrieron puertas traseras a las computadoras portátiles de los ejecutivos a través de USB, explotando una solución que las empresas tenían pero que no estaban usando.

                                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                    Científicos que estudian la leche de cucaracha y sonarse la nariz ganan premios Ig Nobel por ciencia peculiar

                                    Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                                    Meta dice que Muse Spark 1.3 tiene un rendimiento de vanguardia, pero sus mejores resultados provienen de un modelo que los desarrolladores aún no pueden utilizar ampliamente.

                                    Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                                    Un par de naves espaciales se acercan a Mercurio después de un viaje de casi una década

                                    Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                                    Microsoft AI’s MAI-Transcribe-2 undercuts OpenAI, Google and ElevenLabs on price and speed

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      La compresión de contexto finalmente funciona en producción: una nueva investigación reduce la entrada de LLM 16 veces sin afectar la precisión

                                      by — Redacción Despertar Matinal
                                      11 de junio de 2026
                                      in Tecnología
                                      0
                                      La compresión de contexto finalmente funciona en producción: una nueva investigación reduce la entrada de LLM 16 veces sin afectar la precisión
                                      0
                                      SHARES
                                      16
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Las ventanas de contexto se están convirtiendo en un cuello de botella computacional. Cuanto más tiempo se ejecuta un agente, más tokens se acumulan a partir de documentos recuperados, rastros de razonamiento e historial de conversaciones, y más memoria y computación exige el contexto creciente. La mayoría de las soluciones existentes degradan la precisión del modelo, requieren que se cargue el contexto completo antes de que comience la compresión o producen ahorros de memoria que no se traducen en aceleraciones reales en la infraestructura de servicio estándar.

                                      Un equipo de investigación de la Universidad de Nueva York, Columbia, Princeton, la Universidad de Maryland, Harvard y el Laboratorio Nacional Lawrence Livermore. publicó un artículo esta semana que propone una solución novedosa. Los investigadores introducen el concepto de modelos de lenguaje de contexto latente, o LCLM, una familia de modelos de compresión codificador-decodificador que comprimen el contexto de entrada antes de que llegue al decodificador. Los modelos son de código abierto en HuggingFace.

                                      A diferencia de los métodos de compresión de caché KV (el enfoque dominante en el campo, que aún materializa el caché KV completo antes de desalojar las entradas), los LCLM comprimen la secuencia del token de entrada antes del precarga del decodificador, por lo que las relaciones de compresión más altas reducen directamente la computación y la memoria del lado del decodificador. El documento informa que los LCLM con una compresión de 16x produjeron resultados 8,8 veces más rápidos que las líneas base de caché de KV en el punto de referencia de contexto largo de RULER.

                                      «Estos contextos en expansión consumen memoria y computación, y se están convirtiendo en un cuello de botella computacional para los LLM», dijo a VentureBeat Micah Goldblum, co-asesor principal del proyecto e investigador de la Universidad de Columbia. «Nuestro objetivo era entrenar modelos de lenguaje de extremo a extremo que puedan manejar contextos muy largos de manera eficiente y precisa. Si puedes crear un modelo de lenguaje de este tipo, todo será más barato y más rápido».

                                      Qué pueden hacer los LCLM

                                      Los LCLM permiten que los modelos procesen contextos mucho más largos de lo que sería práctico, a una fracción del costo de memoria y computación, sin la degradación de la precisión que hace que la mayoría de los métodos de compresión sean una mala compensación en la producción.

                                      Con una compresión de 4x, el documento informa una precisión del 91,76 % en el punto de referencia RULER, en comparación con el 94,41 % sin compresión alguna. Eso es menos de una caída de 3 puntos para reducir el contexto a una cuarta parte de su tamaño original. Con una compresión de 16x, donde se elimina el 93,75% de los tokens de entrada, la precisión cayó al 75,06%. Cada método de caché KV probado con la misma relación de compresión obtuvo una puntuación más baja.

                                      Las ganancias también se mantienen en entradas más cortas. En los problemas matemáticos escritos de GSM8K, donde se comprime el mensaje completo en lugar de solo los documentos recuperados, los LCLM superaron a todos los demás métodos probados, independientemente de la relación de compresión.

                                      Crédito: Trabajo de investigación sobre compresión de contexto de extremo a extremo a escala https://arxiv.org/pdf/2606.09659

                                      como fue construido

                                      La arquitectura combina un codificador de 0,6 B con un decodificador de 4 B. El codificador comprime bloques de tokens de entrada en secuencias más cortas de incrustaciones latentes. El decodificador los procesa en lugar de los tokens originales. La capacitación abarcó más de 350 mil millones de tokens.

                                      La receta de entrenamiento combina tres tipos de datos:

                                      • Datos continuos de preentrenamiento con tramos comprimidos y sin comprimir intercalados

                                      • Datos de ajuste supervisados ​​que cubren razonamiento y tareas de contexto prolongado.

                                      • Una tarea de reconstrucción auxiliar que empuja al codificador a retener detalles finos

                                      La combinación aborda una compensación que limitaba el trabajo de compresión anterior, donde preservar la precisión de la reconstrucción tenía como costo el desempeño general de la tarea.

                                      Una búsqueda de arquitectura identificó la configuración óptima. El artículo encontró que escalar el decodificador es más importante que escalar el codificador.

                                      Dónde cabe en una pila agente

                                      Un LCLM no es un concepto de investigación abstracto. Está diseñado para funcionar con una pila existente. «Simplemente puede cambiar los LCLM por cualquier LLM existente», dijo Goldblum. «Siempre que recupere datos, como documentos, y desee volcarlos en el contexto de su modelo, simplemente ejecute esos documentos primero a través del compresor del LCLM».

                                      Señaló que en el trabajo de investigación, los investigadores demostraron cómo crear agentes que descompriman selectivamente texto útil.

                                      «Piense en esto como si un ser humano hojeara el contenido antes de acercarse a los detalles relevantes», dijo Goldblum.

                                      Goldblum también advirtió que los equipos que integren el enfoque en los procesos de agentes existentes deberán ajustar sus sistemas RAG en consecuencia.

                                      «Tampoco hemos trabajado en la compresión en línea de las huellas del razonamiento», afirmó. «El enfoque ingenuo de comprimir ocasionalmente el rastro mientras se genera podría funcionar, pero eso aún está por determinarse».

                                      Qué significa esto para las empresas

                                      Las ventanas de contexto están creciendo más rápido de lo que la infraestructura de inferencia puede mantener, y las empresas ya están invirtiendo para solucionarlo. Los datos de la encuesta VB Pulse Q1 2026 de más de 100 organizaciones de empleados muestran que la intención de adopción de la recuperación híbrida se triplicó del 10,3% en enero al 33,3% en marzo. La optimización de la recuperación superó a la evaluación como la principal prioridad de inversión en marzo, alcanzando el 28,9% de los encuestados calificados.

                                      Tres cosas se destacan para los equipos que evalúan el ajuste de la producción:

                                      1. El costo de la inferencia aumenta con la longitud del contexto. Con 1 millón de tokens, la inferencia sin comprimir con métodos de caché KV estándar se queda sin memoria en una sola GPU H200. El artículo informa que los LCLM con compresión 16x permanecen dentro de los límites de la memoria en esa longitud de contexto.

                                      2. La integración del oleoducto RAG requiere ajustes. Los equipos con canales RAG existentes deberán validar el comportamiento de compresión con sus métricas de calidad de recuperación antes de implementarlo a escala.

                                      3. La compresión del rastro de razonamiento no está resuelta. Para los agentes que ejecutan largas cadenas de razonamiento, el crecimiento del contexto a partir del seguimiento es un problema independiente de la recuperación de documentos. Goldblum reconoció la brecha directamente: el enfoque ingenuo de la compresión periódica de trazas podría funcionar, pero no ha sido probado.

                                      Los modelos están disponibles en huggingface.co/latent-context y el código en github.com/LeonLixyz/LCLM.

                                      «Lo más importante que hacen nuestras arquitecturas es darle a su modelo acceso a contextos mucho más grandes, pero también desbloquean enfoques multiescala donde su modelo puede hojear grandes cantidades de texto o código súper rápido y luego solo hace zoom y lee completamente una pequeña porción del texto más útil», dijo Goldblum.

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      — Redacción Despertar Matinal

                                      — Redacción Despertar Matinal

                                      Programa radial que te conecta con la información desde temprano en la mañana.

                                      Next Post
                                      Estados Unidos monitorea la actividad china en el Mar de China Meridional en torno a un banco de arena en disputa

                                      Estados Unidos monitorea la actividad china en el Mar de China Meridional en torno a un banco de arena en disputa

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • LTX-2.5 can generate a 10-second AI video from an image in just 6.8 seconds on Nvidia superchips — and it's open weights

                                        LTX-2.5 can generate a 10-second AI video from an image in just 6.8 seconds on Nvidia superchips — and it’s open weights

                                        0 shares
                                        Share 0 Tweet 0
                                      • Josefina Reynoso: “PN paga 118 mil millones por alquiler hotel;; El pueblo está indefenso; Policías compran uniformes por 4,500”

                                        0 shares
                                        Share 0 Tweet 0
                                      • Pianista surcoreano se recrea tras sufrir un derrame cerebral

                                        0 shares
                                        Share 0 Tweet 0
                                      • Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                        0 shares
                                        Share 0 Tweet 0
                                      • Roberto Ángel Salcedo destaca avances de la cultura durante seis años de Gobierno de Abinader

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por