• Nosotros
  • Publicidad
  • Trabaja con nosotros
  • Contactos
martes, septiembre 22, 2026
  • Login
No Result
View All Result
NEWSLETTER
Despertar Matinal
  • Titulares del Día
    • All
    • En Portada
    Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

    Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

    Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

    Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

    Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

    Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

    Diputada Liz Mieses asegura que Carolina Mejía será candidata del PRM y próxima presidenta

    Diputada Liz Mieses asegura que Carolina Mejía será candidata del PRM y próxima presidenta

    Leonel Fernández juramenta nuevos miembros de la FP en Pensilvania y plantea alianza estratégica con la diáspora

    Leonel Fernández juramenta nuevos miembros de la FP en Pensilvania y plantea alianza estratégica con la diáspora

    Ministerio de Defensa gradúa cadetes especializados en operaciones tácticas en áreas urbanizadas

    Ministerio de Defensa gradúa cadetes especializados en operaciones tácticas en áreas urbanizadas

    Presidente Abinader inicia entrega oficial del Pasaporte Electrónico para dominicanos en Nueva York, Nueva Jersey y Boston

    Presidente Abinader inicia entrega oficial del Pasaporte Electrónico para dominicanos en Nueva York, Nueva Jersey y Boston

    Carolina Mejía presenta a Ricardo de los Santos como su jefe de campaña

    Carolina Mejía presenta a Ricardo de los Santos como su jefe de campaña

    Coordinador de PC prefiere jueces de SCJ permanezcan hasta su retiro y a que sean evaluados cada 7 años

    Coordinador de PC prefiere jueces de SCJ permanezcan hasta su retiro y a que sean evaluados cada 7 años

    Trending Tags

    • Mundo
      • All
      • América Latina
      • Conflictos Internacionales
      • Estados Unidos
      • Europa
      • Geopolítica
      • Haití
      • Medio Oriente
      Javier Milei participó junto a Donald Trump de la cumbre “Shield of the Americas” en Nueva York

      Javier Milei participó junto a Donald Trump de la cumbre “Shield of the Americas” en Nueva York

      El Gobierno de Milei realizó obras en la Ruta Nacional 14 y puso en valor 200 kilómetros

      El Gobierno de Milei realizó obras en la Ruta Nacional 14 y puso en valor 200 kilómetros

      Reunión de Comité Ejecutivo de la AFA: partidos en plena fecha FIFA, una nueva copa, la respuesta a River y más

      Reunión de Comité Ejecutivo de la AFA: partidos en plena fecha FIFA, una nueva copa, la respuesta a River y más

      Isack Hadjar recibió el alta médica y volverá a correr en el Gran Premio de Azerbaiyán

      Isack Hadjar recibió el alta médica y volverá a correr en el Gran Premio de Azerbaiyán

      EPEC diversifica la matriz energética con proyectos renovables e infraestructura en Córdoba

      EPEC diversifica la matriz energética con proyectos renovables e infraestructura en Córdoba

      En medio de su crisis económica, San Lorenzo analiza convocar a un concurso de acreedores

      En medio de su crisis económica, San Lorenzo analiza convocar a un concurso de acreedores

      Antisemitismo en Die Linke: gritos de “muerte a las FDI” en un acto de campaña

      Antisemitismo en Die Linke: gritos de “muerte a las FDI” en un acto de campaña

      El relato del hambre choca con la realidad

      El relato del hambre choca con la realidad

      Sofía Gonet aseguró que el hombre que amenazó a Homero Pettinato también la acosa desde hace 10 años

      Sofía Gonet aseguró que el hombre que amenazó a Homero Pettinato también la acosa desde hace 10 años

      Trending Tags

      • Nacionales
        • All
        • Bávaro Punta Cana
        • Educación
        • Gobierno
        • Infraestructura
        • Justicia
        • Obras Públicas
        • Opinión
        • Provincias
        • Seguridad Ciudadana
        • semana santa 2026
        • Sociedad
        • Transporte
        Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

        Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

        Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

        Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

        Canciller Bisonó destaca prioridades de República Dominicana...

        Canciller Bisonó destaca prioridades de República Dominicana…

        Proponen declarar el turismo de salud como prioridad nacional ...

        Proponen declarar el turismo de salud como prioridad nacional …

        Ministerio de Salud entrega 421 refrigeradoras para fortalece cadena de frío de las vacunas

        Ministerio de Salud entrega 421 refrigeradoras para fortalece cadena de frío de las vacunas

        Abogado de Julián Oro Duro pide a la Policía que evite un “intercambio de disparos” con los que mataron a la esposa del artista

        Abogado de Julián Oro Duro pide a la Policía que evite un “intercambio de disparos” con los que mataron a la esposa del artista

        Ministerio Público solicitará coerción a gastroenteróloga...

        Ministerio Público solicitará coerción a gastroenteróloga…

        Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

        Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

        Qik Pro supera un millón de compras con su tarjeta y entrega...

        Qik Pro supera un millón de compras con su tarjeta y entrega…

        Trending Tags

        • Política
          • All
          • Congreso
          • Opinión Política
          • Partidos Políticos
          • Poder Municipal
          • Transparencia y Corrupción
          (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

          (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

          Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

          Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

          Exministro de Haciendas advierte fuga de ahorros en dólares si...

          Exministro de Haciendas advierte fuga de ahorros en dólares si…

          Robert Polanco revela respaldo a David Collado y descarta...

          Robert Polanco revela respaldo a David Collado y descarta…

          TSE dispone suspensión provisional celebración VII Convención...

          TSE dispone suspensión provisional celebración VII Convención…

          Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

          Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

          Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

          Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

          Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

          Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

          ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

          ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

          Trending Tags

          • Deportes
            • All
            • Atletas Dominicanos
            • Béisbol
            DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

            Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

            30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

            Buffalo recibe a Montreal para abrir la segunda ronda

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

            Trending Tags

            • Economía
              • All
              • Combustibles
              • Energía
              • Indicadores Económicos
              • Sector Energético
              • Turismo
              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

              Aventúrate RD 2026

              Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

              El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

              El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

              Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

              Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

              Trending Tags

              • Ciencia
                • All
                • Energía
                • Innovación
                • Investigación Científica
                • Salud y Medicina
                • Tecnología Médica
                Cadenas de medios de EE.UU. suspenden la cobertura de Trump

                Cadenas de medios de EE.UU. suspenden la cobertura de Trump

                El partido opositor FMLN confirma su candidato presidencial 2027

                El partido opositor FMLN confirma su candidato presidencial 2027

                Merz promete mantener la coalición en Alemania

                Merz promete mantener la coalición en Alemania

                El Kremlin en Rusia Unida revalida la mayoría constitucional

                El Kremlin en Rusia Unida revalida la mayoría constitucional

                La urna electrónica cumple 30 años en víspera electoral de Brasil

                La urna electrónica cumple 30 años en víspera electoral de Brasil

                Los tres medios de comunicación vetados por Trump le demandan

                Los tres medios de comunicación vetados por Trump le demandan

                Gonzalo Castillo: Me pueden meter preso

                Gonzalo Castillo: Me pueden meter preso

                Charlie Mariotti Jr. cuestiona preéstamos US$1,700 MM en energía

                Charlie Mariotti Jr. cuestiona preéstamos US$1,700 MM en energía

                Bajo la visión, orden y firmeza, Carolina anuncia a Ricardo de los Santos como su jefe de campaña

                Bajo la visión, orden y firmeza, Carolina anuncia a Ricardo de los Santos como su jefe de campaña

                Trending Tags

                • Tecnología
                  • All
                  • Aplicaciones
                  • Inteligencia Artificial
                  Cumplir acuerdos anteriores entre Estados Unidos y China es un trabajo en progreso a medida que Trump y Xi se reencuentran

                  Cumplir acuerdos anteriores entre Estados Unidos y China es un trabajo en progreso a medida que Trump y Xi se reencuentran

                  El juez no impedirá que la administración Trump le dé a SpaceX acres de refugio para la vida silvestre

                  El juez no impedirá que la administración Trump le dé a SpaceX acres de refugio para la vida silvestre

                  La Fundación Gates lanza una coalición para obtener conjuntos de datos lingüísticos más representativos para la IA

                  La Fundación Gates lanza una coalición para obtener conjuntos de datos lingüísticos más representativos para la IA

                  Google recibe una multa de 463 millones de dólares por violar la norma de datos de ubicación de la UE

                  Google recibe una multa de 463 millones de dólares por violar la norma de datos de ubicación de la UE

                  Bessent: Estados Unidos propone un sistema de alerta de incidentes mediante IA en conversaciones con China

                  Bessent: Estados Unidos propone un sistema de alerta de incidentes mediante IA en conversaciones con China

                  China y Estados Unidos compiten por el dominio de la IA, pero comparten preocupaciones sobre la seguridad

                  China y Estados Unidos compiten por el dominio de la IA, pero comparten preocupaciones sobre la seguridad

                  La demanda dice que Anthropic, OpenAI, SpaceXAI y Google llegaron a un acuerdo ilegal sobre la desaceleración de la IA

                  La demanda dice que Anthropic, OpenAI, SpaceXAI y Google llegaron a un acuerdo ilegal sobre la desaceleración de la IA

                  El controlador de tráfico aéreo del Reino Unido culpa a una falla de software de milisegundos por las cancelaciones de vuelos

                  El controlador de tráfico aéreo del Reino Unido culpa a una falla de software de milisegundos por las cancelaciones de vuelos

                  Anthropic dice que su modelo Claude está ayudando a construir la próxima versión de sí mismo

                  Anthropic dice que su modelo Claude está ayudando a construir la próxima versión de sí mismo

                  Trending Tags

                  • Entretenimiento
                    • All
                    • Cine y Series
                    • Cultura Digital
                    • Cultura Popular
                    • Gastronomía
                    • Música
                    Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                    Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                    30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                    Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                    Trending Tags

                    • Titulares del Día
                      • All
                      • En Portada
                      Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

                      Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

                      Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

                      Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

                      Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

                      Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

                      Diputada Liz Mieses asegura que Carolina Mejía será candidata del PRM y próxima presidenta

                      Diputada Liz Mieses asegura que Carolina Mejía será candidata del PRM y próxima presidenta

                      Leonel Fernández juramenta nuevos miembros de la FP en Pensilvania y plantea alianza estratégica con la diáspora

                      Leonel Fernández juramenta nuevos miembros de la FP en Pensilvania y plantea alianza estratégica con la diáspora

                      Ministerio de Defensa gradúa cadetes especializados en operaciones tácticas en áreas urbanizadas

                      Ministerio de Defensa gradúa cadetes especializados en operaciones tácticas en áreas urbanizadas

                      Presidente Abinader inicia entrega oficial del Pasaporte Electrónico para dominicanos en Nueva York, Nueva Jersey y Boston

                      Presidente Abinader inicia entrega oficial del Pasaporte Electrónico para dominicanos en Nueva York, Nueva Jersey y Boston

                      Carolina Mejía presenta a Ricardo de los Santos como su jefe de campaña

                      Carolina Mejía presenta a Ricardo de los Santos como su jefe de campaña

                      Coordinador de PC prefiere jueces de SCJ permanezcan hasta su retiro y a que sean evaluados cada 7 años

                      Coordinador de PC prefiere jueces de SCJ permanezcan hasta su retiro y a que sean evaluados cada 7 años

                      Trending Tags

                      • Mundo
                        • All
                        • América Latina
                        • Conflictos Internacionales
                        • Estados Unidos
                        • Europa
                        • Geopolítica
                        • Haití
                        • Medio Oriente
                        Javier Milei participó junto a Donald Trump de la cumbre “Shield of the Americas” en Nueva York

                        Javier Milei participó junto a Donald Trump de la cumbre “Shield of the Americas” en Nueva York

                        El Gobierno de Milei realizó obras en la Ruta Nacional 14 y puso en valor 200 kilómetros

                        El Gobierno de Milei realizó obras en la Ruta Nacional 14 y puso en valor 200 kilómetros

                        Reunión de Comité Ejecutivo de la AFA: partidos en plena fecha FIFA, una nueva copa, la respuesta a River y más

                        Reunión de Comité Ejecutivo de la AFA: partidos en plena fecha FIFA, una nueva copa, la respuesta a River y más

                        Isack Hadjar recibió el alta médica y volverá a correr en el Gran Premio de Azerbaiyán

                        Isack Hadjar recibió el alta médica y volverá a correr en el Gran Premio de Azerbaiyán

                        EPEC diversifica la matriz energética con proyectos renovables e infraestructura en Córdoba

                        EPEC diversifica la matriz energética con proyectos renovables e infraestructura en Córdoba

                        En medio de su crisis económica, San Lorenzo analiza convocar a un concurso de acreedores

                        En medio de su crisis económica, San Lorenzo analiza convocar a un concurso de acreedores

                        Antisemitismo en Die Linke: gritos de “muerte a las FDI” en un acto de campaña

                        Antisemitismo en Die Linke: gritos de “muerte a las FDI” en un acto de campaña

                        El relato del hambre choca con la realidad

                        El relato del hambre choca con la realidad

                        Sofía Gonet aseguró que el hombre que amenazó a Homero Pettinato también la acosa desde hace 10 años

                        Sofía Gonet aseguró que el hombre que amenazó a Homero Pettinato también la acosa desde hace 10 años

                        Trending Tags

                        • Nacionales
                          • All
                          • Bávaro Punta Cana
                          • Educación
                          • Gobierno
                          • Infraestructura
                          • Justicia
                          • Obras Públicas
                          • Opinión
                          • Provincias
                          • Seguridad Ciudadana
                          • semana santa 2026
                          • Sociedad
                          • Transporte
                          Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

                          Mercedes Carrasco: “Plan anticrisis falló; gobierno con cifras Inconsistentes; PRM abandonó el campo; inflación castiga RD”

                          Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

                          Fuerza del Pueblo propone plan integral para enfrentar sequía y garantizar agua a la población

                          Canciller Bisonó destaca prioridades de República Dominicana...

                          Canciller Bisonó destaca prioridades de República Dominicana…

                          Proponen declarar el turismo de salud como prioridad nacional ...

                          Proponen declarar el turismo de salud como prioridad nacional …

                          Ministerio de Salud entrega 421 refrigeradoras para fortalece cadena de frío de las vacunas

                          Ministerio de Salud entrega 421 refrigeradoras para fortalece cadena de frío de las vacunas

                          Abogado de Julián Oro Duro pide a la Policía que evite un “intercambio de disparos” con los que mataron a la esposa del artista

                          Abogado de Julián Oro Duro pide a la Policía que evite un “intercambio de disparos” con los que mataron a la esposa del artista

                          Ministerio Público solicitará coerción a gastroenteróloga...

                          Ministerio Público solicitará coerción a gastroenteróloga…

                          Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

                          Leonel fortalece vínculos con la diáspora y plantea una relación con RD que vaya más allá de las remesas

                          Qik Pro supera un millón de compras con su tarjeta y entrega...

                          Qik Pro supera un millón de compras con su tarjeta y entrega…

                          Trending Tags

                          • Política
                            • All
                            • Congreso
                            • Opinión Política
                            • Partidos Políticos
                            • Poder Municipal
                            • Transparencia y Corrupción
                            (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

                            (VIDEO) EN SAN JUAN: La Fuerza del Pueblo incorpora a Alejandro Tejada en un multitudinario encuentro en El Batey

                            Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

                            Gonzalo Castillo: “Me pueden meter preso, nadie va a evitar que sea presidente de la República Dominicana”

                            Exministro de Haciendas advierte fuga de ahorros en dólares si...

                            Exministro de Haciendas advierte fuga de ahorros en dólares si…

                            Robert Polanco revela respaldo a David Collado y descarta...

                            Robert Polanco revela respaldo a David Collado y descarta…

                            TSE dispone suspensión provisional celebración VII Convención...

                            TSE dispone suspensión provisional celebración VII Convención…

                            Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

                            Fuerza del Pueblo en Ocoa desmiente que seis personas fueran miembros activos del partido y juramentadas con Carolina Mejía

                            Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

                            Danilo Medina proclama en Barahona: “Ya no esperen nada de este gobierno”

                            Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

                            Luis Abinader coloca formación política, capacitación y conducta ética entre los ejes de su gestión al frente del PRM

                            ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

                            ¡El rumbo de la historia ya está decidido! Fuerza del Pueblo avanza hacia el 2028 junto a Leonel Fernández

                            Trending Tags

                            • Deportes
                              • All
                              • Atletas Dominicanos
                              • Béisbol
                              DR Open Kiteboarding Championship reúne atletas de 15 países y reafirma a Cabarete como capital del kitesurf del Caribe

                              Cabarete se corona como capital histórica del kitesurf con el DR Open Championship 2026

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              El impulso olímpico del billar recibe un impulso de los dos campeones mundiales consecutivos de China

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              La reboteadora líder de todos los tiempos de la WNBA, Tina Charles, se retira del baloncesto

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Sabalenka pide boicot si los jugadores no obtienen una mayor parte de los ingresos del Grand Slam

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Los 76ers tienen un cambio breve y luego una noche larga con una derrota aplastante en el Juego 1

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Ex empleado de Stefon Diggs subirá al estrado por segundo día en el juicio por agresión a un jugador de la NFL

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              Kansas City es la sede central de la Copa del Mundo y alberga a Inglaterra, Argentina y Holanda, además de 6 partidos.

                              30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                              Buffalo recibe a Montreal para abrir la segunda ronda

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Judge quiere una nueva tradición del Bronx: “¡Los Yankees ganan!” de Sterling. antes de la canción de Sinatra

                              Trending Tags

                              • Economía
                                • All
                                • Combustibles
                                • Energía
                                • Indicadores Económicos
                                • Sector Energético
                                • Turismo
                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aerodom anuncia nuevas rutas aéreas, pero la pregunta de fondo es quién fiscaliza la concesión

                                Aventúrate RD 2026

                                Aventúrate RD 2026 revela agenda oficial y consolida el turismo de aventura dominicano

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                WTTC: Una inversión de más de un billón de dólares en viajes y turismo es una muestra de confianza en el futuro del sector

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Una semana para crear en Samaná: Atelier Yubarta busca conectar arte, naturaleza y turismo en Cayo Levantado Resort

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Meta RD 2036: el plan turístico que el Gobierno aplaude sin fiscalización

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                Viva Resorts impulsa el turismo interno en República Dominicana con jornada exclusiva en Bayahibe

                                El ministerio de Turismo cierra con éxito festival gastronómico “Saborea el Paraíso” en Sánchez, Samaná

                                El Ministerio de Turismo celebra un exitoso cierre del festival gastronómico «Saborea el Paraíso» en Sánchez, Samaná

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                El Consejo Mundial de Viajes y Turismo (WTTC) informa la incorporación de Piñero como miembro global

                                Más allá del comercio: los efectos del arancel estadounidense sobre el turismo dominicano

                                Arancel de EE.UU. pone a prueba al turismo dominicano y al silencio oficial del gobierno

                                Trending Tags

                                • Ciencia
                                  • All
                                  • Energía
                                  • Innovación
                                  • Investigación Científica
                                  • Salud y Medicina
                                  • Tecnología Médica
                                  Cadenas de medios de EE.UU. suspenden la cobertura de Trump

                                  Cadenas de medios de EE.UU. suspenden la cobertura de Trump

                                  El partido opositor FMLN confirma su candidato presidencial 2027

                                  El partido opositor FMLN confirma su candidato presidencial 2027

                                  Merz promete mantener la coalición en Alemania

                                  Merz promete mantener la coalición en Alemania

                                  El Kremlin en Rusia Unida revalida la mayoría constitucional

                                  El Kremlin en Rusia Unida revalida la mayoría constitucional

                                  La urna electrónica cumple 30 años en víspera electoral de Brasil

                                  La urna electrónica cumple 30 años en víspera electoral de Brasil

                                  Los tres medios de comunicación vetados por Trump le demandan

                                  Los tres medios de comunicación vetados por Trump le demandan

                                  Gonzalo Castillo: Me pueden meter preso

                                  Gonzalo Castillo: Me pueden meter preso

                                  Charlie Mariotti Jr. cuestiona preéstamos US$1,700 MM en energía

                                  Charlie Mariotti Jr. cuestiona preéstamos US$1,700 MM en energía

                                  Bajo la visión, orden y firmeza, Carolina anuncia a Ricardo de los Santos como su jefe de campaña

                                  Bajo la visión, orden y firmeza, Carolina anuncia a Ricardo de los Santos como su jefe de campaña

                                  Trending Tags

                                  • Tecnología
                                    • All
                                    • Aplicaciones
                                    • Inteligencia Artificial
                                    Cumplir acuerdos anteriores entre Estados Unidos y China es un trabajo en progreso a medida que Trump y Xi se reencuentran

                                    Cumplir acuerdos anteriores entre Estados Unidos y China es un trabajo en progreso a medida que Trump y Xi se reencuentran

                                    El juez no impedirá que la administración Trump le dé a SpaceX acres de refugio para la vida silvestre

                                    El juez no impedirá que la administración Trump le dé a SpaceX acres de refugio para la vida silvestre

                                    La Fundación Gates lanza una coalición para obtener conjuntos de datos lingüísticos más representativos para la IA

                                    La Fundación Gates lanza una coalición para obtener conjuntos de datos lingüísticos más representativos para la IA

                                    Google recibe una multa de 463 millones de dólares por violar la norma de datos de ubicación de la UE

                                    Google recibe una multa de 463 millones de dólares por violar la norma de datos de ubicación de la UE

                                    Bessent: Estados Unidos propone un sistema de alerta de incidentes mediante IA en conversaciones con China

                                    Bessent: Estados Unidos propone un sistema de alerta de incidentes mediante IA en conversaciones con China

                                    China y Estados Unidos compiten por el dominio de la IA, pero comparten preocupaciones sobre la seguridad

                                    China y Estados Unidos compiten por el dominio de la IA, pero comparten preocupaciones sobre la seguridad

                                    La demanda dice que Anthropic, OpenAI, SpaceXAI y Google llegaron a un acuerdo ilegal sobre la desaceleración de la IA

                                    La demanda dice que Anthropic, OpenAI, SpaceXAI y Google llegaron a un acuerdo ilegal sobre la desaceleración de la IA

                                    El controlador de tráfico aéreo del Reino Unido culpa a una falla de software de milisegundos por las cancelaciones de vuelos

                                    El controlador de tráfico aéreo del Reino Unido culpa a una falla de software de milisegundos por las cancelaciones de vuelos

                                    Anthropic dice que su modelo Claude está ayudando a construir la próxima versión de sí mismo

                                    Anthropic dice que su modelo Claude está ayudando a construir la próxima versión de sí mismo

                                    Trending Tags

                                    • Entretenimiento
                                      • All
                                      • Cine y Series
                                      • Cultura Digital
                                      • Cultura Popular
                                      • Gastronomía
                                      • Música
                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo "un gran secreto"

                                      Celine Dion está de regreso en París, pero su primera canción sigue siendo «un gran secreto»

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      La ‘Odisea’ de Emily Wilson se convirtió en un punto de inflamación cultural. Ahora ella está retraduciendo todo.

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Editor, editor y reportero de Stars and Stripes demandan al Pentágono para impugnar sus despidos

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Muere Peter Cullen, el prolífico actor de doblaje que le dio a Optimus Prime su autoritario barítono

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Juez pregunta por qué el Kennedy Center se está moviendo tan rápido para devolver el nombre de Trump al edificio

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      Un teatro reinventa la Odisea de Homero a través de la agonía de la guerra de Ucrania

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      En el conflictivo norte de Nigeria, una animada vida nocturna convive con una policía moral e inseguridad.

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      El rapero Yung Filly regresará a Gran Bretaña antes del juicio por violación en Australia el próximo año

                                      30 pasajeros son evacuados después de que un crucero encallara en un arrecife en Fiji

                                      Los británicos tienen la oportunidad de leer las memorias de Jason Arday en las librerías del Reino Unido

                                      Trending Tags

                                      No Result
                                      View All Result
                                      Despertar Matinal
                                      No Result
                                      View All Result

                                      MeMo del MIT permite a los equipos intercambiar un mejor LLM sin volver a capacitarse, y el rendimiento aumenta un 26 %

                                      by — Redacción Despertar Matinal
                                      29 de mayo de 2026
                                      in Tecnología
                                      0
                                      MeMo del MIT permite a los equipos intercambiar un mejor LLM sin volver a capacitarse, y el rendimiento aumenta un 26 %
                                      0
                                      SHARES
                                      18
                                      VIEWS
                                      Share on FacebookShare on Twitter

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      ¡No te pierdas las noticias destacadas!

                                      Suscríbete y recibe las historias más importantes del día.

                                      Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      Tours Colombia Todo el año Tours Colombia Todo el año Tours Colombia Todo el año

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado Tour Cayo Arena Día Feriado

                                      Permitir que los LLM adquieran nuevos conocimientos después de la capacitación sigue siendo un obstáculo importante para la IA empresarial: las soluciones actuales son demasiado caras, demasiado lentas o están limitadas por los límites de la ventana de contexto.

                                      Memorándumun marco de investigadores de varias universidades, codifica nuevos conocimientos en un modelo de memoria más pequeño dedicado que opera por separado del LLM principal.

                                      La arquitectura modular funciona con modelos de código abierto y cerrado y evita la complejidad de las canalizaciones RAG y el reentrenamiento completo del modelo.

                                      Los experimentos muestran que MeMo maneja consultas complejas de manera confiable incluso cuando los canales de recuperación son ruidosos. Evita el olvido catastrófico asociado con el ajuste directo y proporciona una vía rentable para actualizaciones continuas de conocimientos.

                                      El desafío de actualizar la memoria LLM

                                      Los modelos de lenguaje grandes se congelan después del entrenamiento y su conocimiento interno permanece estático hasta que se someten a actualizaciones computacionalmente masivas posteriores.

                                      Comparación de diferentes marcos de memoria LLM (fuente: arXiv)

                                      Actualmente, los desarrolladores se basan en tres enfoques principales para integrar el conocimiento externo en un LLM, cada uno con distintos inconvenientes:

                                      Métodos no paramétricoscomo la generación aumentada de recuperación (RAG) y aprendizaje en contextorecupere documentos relevantes de una base de datos externa e insértelos directamente en el mensaje del modelo. Si bien son populares, estos métodos están limitados por el tamaño de las ventanas de contexto.

                                      Como Armando Solar-Lezama, coautor del artículo, le dijo a VentureBeat: «Las bases de datos vectoriales tienen la tarea fundamentalmente difícil de codificar la semántica completa de un fragmento de texto en un solo vector y luego hacer coincidir ese vector con una consulta, incluso cuando la relevancia del fragmento… sólo puede ser aparente en el contexto de otros fragmentos».

                                      Los investigadores señalan que la similitud semántica de las incrustaciones a menudo no se corresponde con lo que realmente requiere la consulta del usuario. El procesamiento de miles de tokens recuperados también genera una importante sobrecarga computacional y latencia de inferencia. Lo más problemático es que los sistemas RAG son muy sensibles al ruido. Los pasajes irrelevantes o mal recuperados a menudo degradan la respuesta final del modelo.

                                      Métodos paramétricosal igual que la capacitación previa continua o el ajuste fino supervisado, intentan internalizar nuevos conocimientos directamente en los pesos del LLM. La actualización de LLM modernos y masivos es prohibitivamente costosa y, por lo general, imposible para los modelos propietarios de código cerrado ocultos detrás de las API. El ajuste fino también es propenso a causar olvido catastrófico. Obligar al modelo a adaptarse a nuevos datos corporativos a menudo erosiona sus capacidades de razonamiento y barreras de seguridad previamente adquiridas.

                                      Métodos de memoria latentecomo la compresión de contexto, ofrecen un término medio. Comprimen el conocimiento en «tokens blandos» compactos o representaciones que se agregan al contexto del modelo durante la inferencia. El error fatal aquí es el «acoplamiento de representaciones». La memoria comprimida está estrictamente ligada a la arquitectura del modelo que la produjo; no se puede transferir una memoria latente entrenada en un modelo de código abierto a uno de código cerrado.

                                      Cómo funciona Memo

                                      El marco MeMo (Memoria como modelo) presenta una arquitectura modular que presenta dos componentes separados. El modelo MEMORY es un modelo de lenguaje pequeño entrenado específicamente para codificar nuevos conocimientos en sus parámetros. El modelo EXECUTIVE es un LLM congelado y listo para usar que funciona como motor de razonamiento. Cuando un usuario hace una pregunta, el modelo EJECUTIVO trata el modelo MEMORIA como un oráculo externo, emitiendo subconsultas específicas para recopilar hechos y sintetizarlos en una respuesta final.

                                      El principio central de diseño que impulsa a MeMo es el concepto de «reflejos». Las reflexiones son pares de preguntas y respuestas (QA) específicos diseñados para capturar todos los ángulos posibles de un corpus de conocimiento. En lugar de obligar a la IA a procesar un corpus de documentos masivo y no estructurado durante el entrenamiento, MeMo utiliza un modelo GENERADOR para destilar el texto sin formato en miles de pares de control de calidad específicos. Luego, el modelo MEMORY se afina en este conjunto de datos para responder preguntas utilizando solo su conocimiento paramétrico sin la necesidad de leer el contexto recuperado.

                                      Marco de notas

                                      Marco MeMo (fuente: arXiv)

                                      En el momento de la inferencia, la interacción entre los dos modelos sigue un protocolo estructurado de tres etapas:

                                      1. El modelo EJECUTIVO descompone la consulta compleja de un usuario en un conjunto de subpreguntas atómicas. El modelo MEMORIA responde a cada uno de forma independiente para establecer los hechos básicos.

                                      2. Utilizando esas pistas iniciales, el modelo EJECUTIVO emite consultas de seguimiento para limitar las entidades candidatas hasta que converja con confianza en un objetivo específico.

                                      3. Finalmente, el modelo EJECUTIVO consulta el modelo MEMORIA en busca de datos de respaldo sobre esa entidad objetivo y sintetiza los fragmentos recuperados en una respuesta coherente.

                                      Esta arquitectura fusiona las fortalezas de los tres paradigmas de memoria de IA existentes y evita sus dificultades. Aprovecha los modelos de frontera disponibles al mantener el almacenamiento de memoria separado del razonamiento, lo que garantiza la compatibilidad con modelos API cerrados y abiertos. Internaliza el conocimiento directamente en parámetros, pero aísla las actualizaciones en un modelo de MEMORIA dedicado más pequeño para proteger el motor de razonamiento. Finalmente, crea un artefacto de memoria consultable que no está vinculado a ningún modelo específico y se puede usar con diferentes familias de LLM.

                                      Manejar actualizaciones continuas de conocimientos.

                                      La gestión de la memoria de una IA requiere actualizaciones continuas a medida que cambian las políticas de la empresa y se publican nuevos informes. Normalmente, actualizar los parámetros de un modelo requiere volver a entrenarlo desde cero con los datos antiguos y nuevos combinados. A medida que crece la base de conocimientos, este costo acumulativo de reentrenamiento se vuelve inmanejable.

                                      Para manejar las actualizaciones continuas de manera eficiente, MeMo se basa en una técnica llamada «fusión de modelos». En lugar de una fase masiva de reentrenamiento conjunto, MeMo entrena un modelo MEMORY nuevo e independiente exclusivamente en los documentos recién agregados. El sistema deriva un «vector de tareas» que representa los cambios de parámetros aprendidos a partir de los datos nuevos. Luego, estas actualizaciones se fusionan matemáticamente en los pesos del modelo de MEMORIA original.

                                      Este enfoque reduce las horas de computación necesarias para mantener el sistema actualizado y al mismo tiempo evita la interferencia que provoca un olvido catastrófico.

                                      Esta eficiencia viene con una compensación: la fusión de modelos genera una caída de precisión del 11% al 19% en comparación con un reentrenamiento completo, según el modelo de razonamiento utilizado.

                                      Memo en acción

                                      Para medir la eficacia en el mundo real, el equipo de investigación evaluó MeMo comparándolo con varios puntos de referencia de la industria que requieren un razonamiento complejo y de múltiples saltos en múltiples documentos.

                                      Los investigadores utilizaron Qwen2.5-32B-Instruct como modelo GENERADOR para destilar texto sin formato en reflejos. Para el modelo de MEMORIA principal, implementaron Qwen2.5-14B-Instruct. También validaron el enfoque en modelos de parámetros más pequeños de 1 a 2 B en diferentes arquitecturas, incluida Gemma3-1B.

                                      Para el modelo de razonamiento EJECUTIVO, probaron tanto el Qwen2.5-32B de peso abierto como el Gemini 3 Flash propiedad de Google.

                                      Compararon MeMo con un límite superior de «Recuperación perfecta» (donde los documentos correctos exactos se proporcionan manualmente) y varios sistemas de recuperación avanzados, incluida la búsqueda tradicional BM25, la recuperación de vectores densos y el RAG basado en gráficos de última generación (HippoRAG2). También probaron «Cartuchos», un método reciente que carga una caché KV entrenado sobre el modelo durante la inferencia.

                                      Rendimiento de notas

                                      Rendimiento de MeMo en puntos de referencia de la industria en comparación con otras líneas de base (fuente: arXiv)

                                      MeMo dominó el razonamiento de documentos largos. Según los investigadores, en el punto de referencia NarrativeQA, MeMo logró una precisión del 53,58% junto con Gemini 3 Flash. HippoRAG2 alcanzó un máximo del 23,21%.

                                      Los sistemas empresariales con frecuencia necesitan sintetizar respuestas complejas, como atravesar marcos regulatorios superpuestos escritos de forma independiente por diferentes organismos, o consolidar conocimientos a través de una base de código masiva y documentación externa. Los sistemas RAG tradicionales fallan aquí porque alcanzan los límites de la ventana de contexto y no logran conectar conceptos que abarcan cientos de páginas. MeMo tiene éxito porque esas conexiones se asignan e internalizan dentro del modelo MEMORY durante el entrenamiento. Es «como tener un Malcolm Gladwell propio que pueda conectar la historia de los Beatles con la historia de Bill Gates para argumentar sobre la naturaleza de la experiencia», dijo Solar-Lezama.

                                      Los experimentos revelaron otra ventaja importante: actualizar el motor de razonamiento no requiere ningún reentrenamiento. Simplemente cambiar el modelo EXECUTIVE del Qwen de código abierto al Gemini 3 Flash patentado aumentó el rendimiento de MeMo en un 26,73% en NarrativeQA y un 11,90% en el punto de referencia MuSiQue. Para los profesionales, esto significa que pueden entrenar un modelo de MEMORIA de forma segura con sus datos privados y conectarlo instantáneamente a las API comerciales más recientes, actualizando continuamente la inteligencia del sistema sin incurrir en nuevos costos de capacitación.

                                      El equipo de investigación describió la integración como que no requiere configuración adicional: «El LLM base (o ejecutivo) que los equipos ya están usando en RAG se puede configurar para consultar el modelo de memoria directamente. Estas consultas se realizan en lenguaje natural, similar a enviar una solicitud de mensaje a una API, sin necesidad de configuración adicional».

                                      MeMo también maneja excepcionalmente bien los datos ruidosos. Cuando los investigadores inundaron deliberadamente el conjunto de datos con documentos irrelevantes (hasta el doble de información útil), el rendimiento de HippoRAG2 cayó un 11,55%. El rendimiento de MeMo se mantuvo relativamente estable, cayendo menos del 2%. Las bases de conocimiento empresarial suelen ser confusas, llenas de documentos duplicados y políticas obsoletas. Los sistemas RAG estándar luchan con este ruido, incorporando párrafos incorrectos al mensaje y provocando alucinaciones. Debido a que el modelo EXECUTIVE de MeMo interactúa con un oráculo sintetizado en lugar de con fragmentos de documentos sin procesar, sigue siendo muy robusto contra datos corporativos desorganizados.

                                      Limitaciones y compensaciones

                                      Para los equipos de ingeniería que buscan implementar MeMo, existen varias limitaciones clave a considerar.

                                      A diferencia de los sistemas RAG tradicionales que indexan rápidamente documentos sin procesar en una base de datos vectorial, MeMo requiere un costo de capacitación inicial para cada nuevo corpus. El proceso de generación de datos utilizado para sintetizar las reflexiones de entrenamiento es computacionalmente costoso. Por ejemplo, el equipo observó que «generar el conjunto de datos de control de calidad de reflexión completo tomó aproximadamente 240 horas de GPU en NVIDIA H200», mientras que entrenar un modelo de MEMORIA de parámetros 14B «tomó aproximadamente 180 horas de GPU H200». Como dijo Solar-Lezama, «Reducir el coste de la formación es uno de los problemas de investigación abiertos más importantes para hacer de esta técnica un caballo de batalla».

                                      Debido a que el modelo MEMORIA es una red neuronal de tamaño fijo, su capacidad para internalizar conocimiento está limitada por su capacidad de representación. Si bien los investigadores no alcanzaron un límite estricto durante su evaluación comparativa, plantean la hipótesis de que «los corpus suficientemente grandes o densos en información excederán lo que un modelo de MEMORIA de tamaño fijo puede comprimir y representar correctamente».

                                      Finalmente, debido a que MeMo sintetiza respuestas a partir de la memoria paramétrica en lugar de recuperar fragmentos de texto exactos, oscurece la procedencia de la información. Esto dificulta atribuir afirmaciones específicas a documentos originales, lo que plantea un problema de cumplimiento crítico para las aplicaciones empresariales que requieren seguimientos de auditoría estrictos.

                                      Decidir entre MeMo y RAG tradicional se reduce a una heurística de «búsqueda versus síntesis», junto con la volatilidad de los datos. Los investigadores advierten que «se preferiría el RAG tradicional cuando las respuestas se encuentran en un solo documento o cuando hay una fuente bien definida… Se preferiría MeMo cuando la tarea pasa de la búsqueda a la síntesis de una respuesta a partir de información dispersa en múltiples fragmentos». Si su corpus de conocimientos cambia rápidamente (por ejemplo, feeds diarios) y necesita citas de fuentes exactas, RAG sigue siendo la mejor opción debido al costo inicial de capacitación de MeMo. Si su corpus consiste en conocimiento de dominio generalizado que evoluciona lentamente en relación con su volumen, MeMo ofrece un razonamiento muy superior. Los equipos también pueden adoptar una arquitectura de enrutamiento híbrida en producción: enviar consultas de «búsqueda» a una base de datos vectorial estándar y consultas de «síntesis» al modelo MEMORIA.

                                      «Mirando más allá, esperaría que los modelos de memoria se convirtieran en un componente arquitectónico estándar junto con la recuperación», dijo a VentureBeat Daniela Rus, coautora del artículo y directora del Laboratorio de Ciencias de la Computación e Inteligencia Artificial (CSAIL) del MIT, «de la misma manera que el almacenamiento en caché y la indexación son componentes estándar de cualquier sistema de datos serio en la actualidad».

                                      ● Canal oficial · Gratis
                                      ¡Recibe las noticias antes que nadie!
                                      Únete a nuestro canal de WhatsApp y mantente informado al instante, sin spam.
                                      Unirme ahora →
                                      ● Noticias al instante ● Cobertura nacional ● Periodismo real Despertar Matinal
                                      — Redacción Despertar Matinal

                                      — Redacción Despertar Matinal

                                      Programa radial que te conecta con la información desde temprano en la mañana.

                                      Next Post
                                      El Gobierno de Milei enviará al Congreso una reforma de la Ley de Sociedades para modernizar el sistema

                                      El Gobierno de Milei enviará al Congreso una reforma de la Ley de Sociedades para modernizar el sistema

                                      Deja una respuesta Cancelar la respuesta

                                      Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

                                      Canal de WhatsApp

                                      WhatsApp logo WhatsApp

                                      Canal · Despertar Matinal

                                      Únete a nuestro
                                      Canal

                                      Seguir ahora

                                      El clima

                                      Canal de YouTube

                                      YouTube

                                      Canal · Despertar Matinal

                                      Mira nuestro
                                      Canal

                                      Ver ahora

                                      Escúchanos en Spotify

                                      Spotify

                                      Podcast · Despertar Matinal

                                      Escucha nuestro
                                      Podcast

                                      Escuchar ahora

                                      Noticias Populares

                                      • El partido opositor FMLN confirma su candidato presidencial 2027

                                        El partido opositor FMLN confirma su candidato presidencial 2027

                                        0 shares
                                        Share 0 Tweet 0
                                      • Consejo Nacional de la Magistratura informa 52 hombres y 38 mujeres se postulan para jueces de la SCJ

                                        0 shares
                                        Share 0 Tweet 0
                                      • Javier Milei participó junto a Donald Trump de la cumbre “Shield of the Americas” en Nueva York

                                        0 shares
                                        Share 0 Tweet 0
                                      • The US gets the worst phones

                                        0 shares
                                        Share 0 Tweet 0
                                      • Fuerza del Pueblo advierte reforma fiscal extraerá RD$50,000 millones de la economía en momento de disminución económica e inflación

                                        0 shares
                                        Share 0 Tweet 0

                                      Medio digital independiente con análisis, opinión y periodismo responsable desde República Dominicana.

                                      Secciones populares

                                      • Política
                                      • Economía & Negocios
                                      • Justicia
                                      • Turismo
                                      • Tecnología
                                      • Entretenimiento
                                      • Mundo
                                      • Cine y Series
                                      • Música
                                      • Moda

                                      Contenido

                                      • Titulares del Día
                                      • Mundo
                                      • Nacionales
                                      • Política
                                      • Deportes
                                      • Economía & Negocios
                                      • Ciencia
                                      • Entretenimiento
                                      • Podcast
                                      • Opinión
                                      • Despertar Matinal TV
                                      • Editoriales

                                      Corporativo

                                      • Sobre nosotros
                                      • Publicidad
                                      • Sala de prensa
                                      • Contacto
                                      • Política de Privacidad
                                      • Eliminación de Datos

                                      Boletines

                                      Suscríbete a nuestro boletín
                                      Recibe las noticias más importantes cada mañana.

                                      • Nosotros
                                      • Publicidad
                                      • Trabaja con nosotros
                                      • Contactos

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      No Result
                                      View All Result
                                      • Home

                                      © 2025 Despertar Matinal. Aviso Legal - comunícate con nuestra redacción y obtén más información sobre Despertar Matinal..

                                      Welcome Back!

                                      Login to your account below

                                      Forgotten Password?

                                      Retrieve your password

                                      Please enter your username or email address to reset your password.

                                      Log In

                                      Desarrollado por
                                      ►
                                      Las cookies necesarias habilitan funciones esenciales del sitio como inicios de sesión seguros y ajustes de preferencias de consentimiento. No almacenan datos personales.
                                      Ninguno
                                      ►
                                      Las cookies funcionales soportan funciones como compartir contenido en redes sociales, recopilar comentarios y habilitar herramientas de terceros.
                                      Ninguno
                                      ►
                                      Las cookies analíticas rastrean las interacciones de los visitantes, proporcionando información sobre métricas como el número de visitantes, la tasa de rebote y las fuentes de tráfico.
                                      Ninguno
                                      ►
                                      Las cookies de publicidad ofrecen anuncios personalizados basados en tus visitas anteriores y analizan la efectividad de las campañas publicitarias.
                                      Ninguno
                                      ►
                                      Las cookies no clasificadas son aquellas que estamos en proceso de clasificar, junto con los proveedores de cookies individuales.
                                      Ninguno
                                      Desarrollado por