Saltar al contenido principal

2 publicaciones etiquetados con "guardrails"

Ver Todas las Etiquetas

Un agente puede reducir su propia búsqueda web, pero nunca ampliarla

· 5 min de lectura
Rafael Fernandes
NLP Engineer & Tech Writer at WiLine
Share:
Agentes · Noticias de IA

Solo reducir, nunca ampliar

Por favor usa fuentes confiablesLas fuentes confiables son las únicas que hay

Tu agente puede buscar en la web. Escribes en el prompt: usa solo sec.gov y los grandes medios financieros. Normalmente obedece. Las veces que no lo hace son las veces en que aprendes que una línea en un prompt es una petición, no una regla.

El 19 de agosto AWS añadió filtros de sitios a la herramienta de búsqueda web en Bedrock AgentCore. Función pequeña. Pero la forma en que maneja un desacuerdo vale la pena conocerla, porque es lo que la convierte en una barrera en lugar de una nota.

Enmascara tus registros, no tus indicaciones

· 8 min de lectura
Rafael Fernandes
NLP Engineer & Tech Writer at WiLine
Share:
Privacidad · Noticias de IA

Enmascara tus registros, no tus indicaciones

Redactar antes del modeloRedactar antes de los registros

Casi cada guía de "asegura tu aplicación LLM" da el mismo consejo: antes de que una indicación llegue al modelo, elimina los datos personales de ella — intercambia nombres, correos electrónicos y números de cuenta por [REDACTED] o <PERSON>, luego llama al modelo.

Suena obviamente correcto. Yo también asumí que lo era. Luego fui y leí la investigación sobre lo que realmente hace el enmascaramiento a un modelo, y los documentos apuntan en la dirección opuesta. La versión corta: enmascara tus registros, no tus indicaciones.