Test del módulo · Semana 4

Test: Ingeniería de prompts, gobierno y APIs de los modelos

Preguntas al estilo del examen. Contesta, pulsa «Comprobar» y lee siempre la explicación, también cuando aciertes: ahí está lo que de verdad se aprende.

29 preguntasComprobadas: 0/29

1. Una aseguradora tiene doce aplicaciones que usan el mismo system prompt con la definición de rol del asistente y sus reglas de estilo. Hoy el prompt está copiado en el código de cada aplicación y cada cambio exige doce despliegues. Se pide centralizarlo, versionarlo de forma inmutable y poder cambiar la versión que usa cada aplicación sin redeplegar código. ¿Qué solución cumple los requisitos con LEAST operational overhead?

2. Un desarrollador invoca con la API Converse un prompt de Amazon Bedrock Prompt Management usando el ARN de su versión 3 como modelId, rellena las variables en promptVariables y añade inferenceConfig con temperature 0,2 para una prueba. La llamada devuelve ValidationException. ¿Qué debe hacer?

3. Un equipo encadena tres prompts con una rama condicional y un nodo de Knowledge Base. Necesita que la aplicación invoque siempre el mismo identificador estable y poder volver en segundos a la versión anterior si la nueva empeora, sin cambiar código. ¿Qué debe usar?

4. Una entidad bancaria regulada exige para sus prompts de IA generativa: revisión y aprobación antes de producción, registro de quién crea o modifica cada prompt y conservación de los prompts y respuestas intercambiados con los modelos para auditoría. ¿Qué TRES elementos cubren estos requisitos? (Elige tres)

5. Tras una modificación aparentemente menor de un prompt de extracción, el 15 % de las respuestas de producción empezaron a llegar con un JSON inválido y nadie lo detectó durante dos días. El equipo quiere evitar que vuelva a ocurrir en futuros cambios de prompt o de modelo. ¿Qué solución es la MÁS completa?

6. Antes de publicar un nuevo prompt de clasificación, un equipo quiere probar en paralelo 2.000 casos frontera (entradas vacías, textos muy largos, otros idiomas, intentos de inyección de instrucciones), reintentar los fallos transitorios y obtener un informe agregado, sin mantener servidores. ¿Qué servicio de orquestación es el más adecuado?

7. Un modelo clasifica incidencias en cinco categorías internas con nombres poco intuitivos (por ejemplo, N2-RED o N3-APP). Con una instrucción zero-shot detallada, las etiquetas son inconsistentes y a veces el modelo inventa categorías nuevas. No hay presupuesto ni datos para un fine-tuning. ¿Qué técnica de prompting es la más adecuada como siguiente paso?

8. Un asistente calcula indemnizaciones aplicando cinco reglas encadenadas (franquicia, límites anuales, coberturas excluidas, coaseguro e impuestos). Con una instrucción directa, el modelo acierta el importe solo en el 60 % de los casos de prueba. La aplicación necesita extraer el importe final de forma automática. ¿Qué cambio en el prompt es el MÁS adecuado?

9. Un sistema de facturación consume la respuesta de un modelo de Amazon Bedrock y exige que cumpla siempre un JSON Schema con campos obligatorios y enumeraciones cerradas. El equipo quiere eliminar su lógica de reintentos por JSON inválido. El modelo elegido admite structured outputs según su ficha. ¿Qué debe hacer?

10. Un equipo usa Amazon Nova Lite por coste para extraer datos de albaranes a JSON. Al intentar activar structured outputs con outputConfig en Converse recibe un error, y la ficha del modelo indica que no admite esa capacidad. No quieren cambiar de modelo. ¿Qué enfoque ofrece la mayor fiabilidad de formato con este modelo?

11. Un chatbot sin estado implementado con Amazon API Gateway y AWS Lambda pierde el hilo: cuando el usuario pregunta y en Portugal, el modelo no sabe de qué se hablaba. Además, algunas conversaciones duran horas. Se busca la solución serverless más adecuada para mantener el contexto. ¿Qué debe hacer?

12. Una operadora quiere un asistente de reclamaciones que detecte la intención del cliente (baja, avería, facturación) y que, si falta un dato obligatorio como el número de contrato, lo pida y espere la respuesta antes de invocar al modelo que redacta la resolución. ¿Qué DOS servicios cubren estas necesidades según los patrones del temario? (Elige dos)

13. Un equipo de analistas sin perfil de programador debe mantener un proceso que resume un documento, lo clasifica y, según la categoría, lo traduce o lo envía a una Knowledge Base para enriquecerlo. Los prompts deben ser componentes reutilizables y gobernados, y habrá algún paso de preprocesado en Lambda. ¿Qué solución encaja mejor?

14. En un Amazon Bedrock Flow, un nodo Condition compara la salida de un nodo Prompt con la cadena urgente para enviar el ticket por la rama prioritaria. En las pruebas, muchos tickets urgentes acaban en la rama por defecto; los logs muestran salidas como Urgente o urgente. con punto final. ¿Cuál es la mejor corrección?

15. Una startup usa hoy un modelo de Anthropic con InvokeModel y quiere comparar en producción otros proveedores disponibles en Amazon Bedrock, cambiando de modelo con el mínimo cambio de código y sin reescribir el formato de las peticiones ni el parseo de las respuestas, incluidas las llamadas a herramientas. ¿Qué debe hacer?

16. Un desarrollador intenta generar embeddings con Amazon Titan Text Embeddings V2 usando la API Converse y recibe un error. Necesita generar embeddings para 5.000 fragmentos desde una función de AWS Lambda. ¿Qué debe hacer?

17. Un asistente web usa Amazon API Gateway (REST), AWS Lambda y InvokeModel. Las respuestas tardan entre 12 y 20 segundos en generarse y los usuarios abandonan porque no ven nada hasta el final. El equipo quiere seguir usando las capacidades de API Gateway (usage plans, validación, AWS WAF). ¿Qué cambio mejora MÁS la experiencia?

18. Una aplicación móvil usa una API GraphQL de AWS AppSync. Se quiere añadir una función de resumen de documentos cuyas generaciones tardan entre 30 y 60 segundos, mostrando el texto al usuario a medida que se genera. ¿Qué diseño es el adecuado?

19. En las campañas de rebajas, una aplicación de atención al cliente recibe picos de peticiones y las llamadas a Amazon Bedrock fallan con ThrottlingException (HTTP 429). Las respuestas pueden tardar unos minutos en llegar al cliente durante los picos. ¿Qué combinación es la MÁS adecuada?

20. Un equipo define la política de reintentos de su capa de integración con Amazon Bedrock Runtime. ¿Qué DOS excepciones deben reintentarse con backoff exponencial y jitter? (Elige dos)

21. Un asistente de soporte técnico mantiene conversaciones muy largas en las que los usuarios pegan logs extensos. A partir de cierto punto, todas las llamadas a Converse de esa sesión fallan con ValidationException indicando que la entrada es demasiado larga. ¿Qué solución es la adecuada?

22. Los usuarios de un generador de informes se quejan de que algunos informes terminan a mitad de frase. En los logs, esas respuestas de Converse tienen stopReason igual a max_tokens y no hay errores. ¿Qué debe hacer el equipo?

23. Una empresa con sede en Madrid ejecuta su asistente en eu-south-2 y debe mantener el procesamiento dentro de la UE. En horas punta sufre ServiceUnavailableException ocasionales con el modelo principal. Quiere mejorar la disponibilidad sin cambios manuales durante los incidentes. ¿Qué combinación es la MÁS adecuada?

24. Varias aplicaciones internas (en AWS Lambda, contenedores de Amazon ECS y un sistema heredado en las instalaciones) deben enviar documentos para su análisis con un modelo de Amazon Bedrock. La carga es muy irregular, los resultados pueden tardar varios minutos y hay que evitar saturar las cuotas del modelo. ¿Qué arquitectura es la MÁS adecuada?

25. Una empresa ofrece a sus socios una API de generación de descripciones de productos basada en Amazon Bedrock. Quiere rechazar las peticiones mal formadas antes de gastar tokens y limitar el número de peticiones por socio según su contrato. ¿Qué funcionalidades de Amazon API Gateway debe usar?

26. Un servicio recibe peticiones de tres tipos: generación de código, preguntas legales y conversación general. Cada tipo obtiene mejores resultados con un FM especializado distinto. El tipo no viene indicado en la petición y la decisión debe quedar trazada paso a paso para auditoría. ¿Qué arquitectura implementa el enrutado dinámico por contenido?

27. Un chatbot de una universidad recibe miles de preguntas al día; la mayoría son sencillas (horarios, plazos) y unas pocas requieren razonamiento complejo. Hoy todas van a un modelo grande y caro. Se quiere reducir el coste manteniendo la calidad en las preguntas difíciles. ¿Qué DOS enfoques son adecuados? (Elige dos)

28. Un asistente de banca usa tool use con la API Converse para consultar saldos y programar transferencias mediante APIs internas. En pruebas, el modelo a veces inventa números de cuenta con formato incorrecto, y una API caída provocó un bucle de llamadas repetidas. ¿Qué TRES prácticas aumentan la fiabilidad de la integración? (Elige tres)

29. Una aplicación compuesta por Amazon API Gateway, dos funciones de AWS Lambda, una Knowledge Base y llamadas a Converse tiene una latencia p95 de 9 segundos. El equipo no sabe si el tiempo se va en la recuperación, en la generación o en la propia Lambda. ¿Qué debe usar para localizar el cuello de botella entre servicios?