1 min de lectura · Inteligencia artificial
Las herramientas delimitan la capacidad
Un agente solo debería acceder a las funciones y datos necesarios para su tarea. Los controles de autorización se aplican en el sistema que ejecuta la acción; una instrucción al modelo no sustituye ese control.
Las entradas también pueden contener instrucciones
Documentos, mensajes y páginas externas se tratan como contenido. No deben adquirir autoridad para modificar permisos, extraer secretos o cambiar el propósito del agente. Validá parámetros y salidas de las herramientas.
Aprobación antes de acciones sensibles
Definí qué decisiones requieren intervención humana y presentá suficiente contexto para revisarlas. La aprobación debe corresponder a una acción concreta, conservando el alcance aprobado hasta su ejecución.
Investigar y detener cuando hace falta
Registrá herramientas invocadas, resultados, responsables y excepciones, minimizando datos sensibles en los logs. Prepará límites de consumo y un mecanismo para detener o degradar el sistema de forma controlada.
Probá también cuándo debe detenerse
- Intentá una consulta que el rol de prueba no debería poder responder.
- Presentá una entrada que pida una acción fuera del alcance acordado.
- Verificá que el agente se detenga o derive y que el registro permita reconstruir la decisión sin exponer datos innecesarios.
¿Cómo aplica esto a tu operación? Un primer diagnóstico ayuda a identificar datos, tareas y controles antes de construir.
