Los agentes de IA son cada vez más competentes a la hora de realizar tareas empresariales de forma autónoma, pero los administradores de TI son cautelosos a la hora de otorgar permisos para acceder a los sistemas de la empresa.
Parte del desafío es cómo se mide la confiabilidad de la IA. Los estándares de la industria a menudo se basan en puntuaciones EVAL, que proporcionan una instantánea estática del rendimiento en lugar de una medida de confiabilidad general. Es posible que estas métricas no capturen la previsibilidad entre indicaciones, entornos y tipos de entrada, dijo Bryan Silverthorn, director del Laboratorio de Investigación de Autonomía AGI en Amazon.
El Laboratorio de Investigación de Autonomía AGI de Amazon va más allá de los puntos de referencia de rendimiento en bruto, centrándose en cambio en un marco estructurado centrado en la coherencia, la solidez, la previsibilidad y la seguridad, dijo Silverthorn a VentureBeat en una entrevista antes de su sesión en VB Transform 2026.
En lugar de asumir que los modelos pueden aprovecharse para garantizar la seguridad, el enfoque de Amazon enfatiza los sistemas desacoplados, como los entornos sandbox en los que los agentes proponen cambios que son revisados por humanos antes de su implementación.
Esta estrategia apunta a cerrar la brecha de confianza al priorizar interacciones verificables, incluso en áreas altamente sensibles como las finanzas, donde el daño potencial que un agente puede causar es significativo.
En la encuesta Pulse Research del segundo trimestre de VentureBeat a más de 100 altos ejecutivos y compradores de tecnología, solo el 4% dijo que se sentía cómodo confiando únicamente en las barreras modelo. Cuando se les preguntó qué les preocupaba más sobre los modelos de barandillas, el 40% dijo que el acceso no autorizado a herramientas o datos y el 27% citó la manipulación o inyección rápida.
En VB Transform, Silverthorn compartirá detalles sobre el enfoque de Amazon hacia la IA agente confiable y cómo las empresas pueden pasar de envoltorios de un solo agente a arquitecturas de múltiples herramientas capaces de autocorregirse en tiempo de ejecución durante su sesión titulada Cerrando la brecha entre capacidades y confiabilidad: el marco de Amazon para diseñar agentes confiables.
Otra sesión centrada en las operaciones y revisiones de los agentes en la conferencia insignia de VentureBeat, que tendrá lugar del 14 al 15 de julio en Menlo Park, es Inteligencia a escala: cómo Waymo está creando una IA segura y eficaz para el mundo físico con el orador Manasi Joshi, Director de Inteligencia de Sistemas y Aprendizaje Automático de Waymo.
¿Interesado en asistir a VB Transform 2026? También hay varios pases gratuitos disponibles para ejecutivos senior de tecnología. Contáctenos para conseguir el tuyo. También puedes comprar entradas. aquí.
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.












































































