Test del módulo · Semana 1
Test: Fundamentos de IA generativa y selección de modelos en Amazon Bedrock
Preguntas al estilo del examen. Contesta, pulsa «Comprobar» y lee siempre la explicación, también cuando aciertes: ahí está lo que de verdad se aprende.
1. Una aseguradora usa un modelo de Amazon Bedrock para extraer de cada parte de siniestro un JSON con fecha, matrícula e importe. Los auditores detectan que, con el mismo documento, el modelo devuelve a veces valores distintos y otras veces campos con redacción creativa. El prompt es correcto y el modelo cumple en calidad media. ¿Qué cambio aborda MEJOR el problema con el menor esfuerzo?
2. Un equipo usa la Converse API con Claude Haiku 4.5 y quiere limitar el muestreo a los 50 tokens más probables además de fijar temperature y maxTokens. El desarrollador añade "topK": 50 dentro de inferenceConfig y la llamada falla con ValidationException. ¿Cómo debe enviarse el parámetro?
3. Una aplicación genera informes en JSON con Nova Lite. En producción, un 8 % de las respuestas no se pueden parsear. Los logs muestran que en esas respuestas el campo stopReason vale max_tokens. ¿Cuál es la causa MÁS probable y la corrección adecuada?
4. Un chatbot interno con Nova Micro (ventana de 128K tokens) funciona bien al principio de cada conversación, pero en sesiones de varias horas empieza a fallar y el coste por turno no deja de crecer. La aplicación envía en cada petición el historial completo. ¿Qué combinación resuelve AMBOS síntomas con el menor impacto en la calidad? (Elige dos)
5. Un operador de telecomunicaciones debe clasificar 3 millones de mensajes de clientes al mes en 12 categorías. Cada petición tiene unos 350 tokens de entrada y 5 de salida. Los datos deben procesarse dentro de la UE. Una evaluación con 1.000 mensajes etiquetados da un 94 % de acierto con Nova Micro y un 95 % con Claude Sonnet 5; el requisito de negocio es un 92 %. ¿Qué solución es la MOST cost-effective?
6. Una empresa de logística quiere un asistente que lea fotos de albaranes y vídeos cortos de la carga en el muelle para detectar incidencias, y que responda en texto. Necesita un modelo en Amazon Bedrock accesible desde eu-central-1 con procesamiento dentro de la UE y el menor coste posible. ¿Qué modelo encaja MEJOR?
7. Un banco evalúa modelos para resumir expedientes de hipotecas en español. Antes de elegir, el arquitecto quiere un análisis sistemático de capacidades y limitaciones del modelo candidato, no solo su posición en rankings públicos. ¿Qué acciones forman parte de ese análisis? (Elige tres)
8. Una empresa ofrece a sus clientes una API de resumen de documentos. Negocia contratos con varios proveedores de modelos y quiere poder cambiar el modelo y sus parámetros (temperature, maxTokens) en minutos, con despliegue gradual y marcha atrás automática, SIN modificar ni redesplegar el código de la aplicación. ¿Qué arquitectura cumple los requisitos con el MENOR esfuerzo operativo?
9. Un equipo usa InvokeModel con cuerpos JSON específicos de Anthropic. Ahora quiere probar Amazon Nova y un modelo de Mistral sin reescribir la lógica que construye las peticiones ni la que interpreta las respuestas. ¿Qué cambio es el MÁS adecuado?
10. Una aplicación de atención al cliente en eu-central-1 usa un modelo de Bedrock bajo demanda con el ID de una sola región. En las campañas de rebajas recibe ThrottlingException aunque la media de tráfico está muy por debajo de la cuota. Los datos deben quedarse en la UE y el equipo quiere la solución con el LEAST operational overhead y sin compromisos de capacidad. ¿Qué debe hacer?
11. Una fintech orquesta con AWS Step Functions un flujo que llama a un modelo de Bedrock. Cuando el proveedor sufre una degradación, cada ejecución agota sus reintentos, tarda minutos y satura el servicio aún más. Quieren dejar de llamar al modelo durante un tiempo tras varios fallos seguidos, responder con una alternativa mientras tanto y volver a intentarlo automáticamente después. ¿Qué patrón deben implementar?
12. Un asistente de reservas debe seguir siendo útil aunque el modelo principal falle o supere su latencia objetivo. ¿Qué medidas forman parte de una estrategia de degradación elegante (graceful degradation)? (Elige dos)
13. Una empresa con sede en Irlanda quiere usar un modelo reciente de Anthropic que, según su ficha, no admite invocación on-demand con el ID del modelo en eu-west-1 dentro de bedrock-runtime. Su política exige que los datos se procesen en la UE. ¿Cómo debe invocarlo?
14. Un administrador aplica una SCP que solo permite las regiones eu-central-1 y eu-west-1 mediante la condición aws:RequestedRegion. Tras el cambio, las llamadas de una aplicación con el perfil eu.amazon.nova-micro-v1:0 empiezan a fallar con AccessDeniedException de forma intermitente. ¿Cuál es la causa MÁS probable?
15. Un equipo observa ThrottlingException en un modelo de Claude aunque la suma real de tokens de entrada y salida por minuto está muy por debajo de su cuota de TPM. Todas sus peticiones envían maxTokens = 32000, aunque las respuestas medias tienen 300 tokens. ¿Qué explica el comportamiento y cómo se corrige?
16. El departamento legal de una multinacional exige que ninguna cuenta de la organización pueda invocar un determinado modelo de terceros hasta revisar su EULA. Las cuentas tienen permisos amplios de Bedrock. ¿Qué control lo garantiza desde la primera invocación?
17. Cada noche, una editorial genera resúmenes de 40.000 artículos nuevos. Los resultados se necesitan antes de las 8:00 y no hay usuarios esperando la respuesta. Quieren reducir el coste de inferencia al máximo sin cambiar de modelo. ¿Qué opción es la MÁS adecuada?
18. Una empresa ejecuta dos cargas con el mismo modelo de Bedrock: un chat de soporte donde la latencia es crítica en horas punta, y evaluaciones automáticas de calidad que pueden tardar horas. Quiere optimizar coste y rendimiento de ambas sin compromisos de capacidad. ¿Qué configuración de service tiers encaja? (Elige dos)
19. Una aseguradora usa desde hace un año un modelo de Bedrock que acaba de pasar a estado Legacy con fecha de End-of-Life dentro de cinco meses. La aplicación tiene el modelId escrito en el código de varias funciones Lambda. ¿Qué plan reduce el riesgo de interrupción de forma MÁS completa?
20. Una empresa de software legal ha ajustado con LoRA un modelo abierto para 40 despachos, uno por cliente, sobre el mismo modelo base. Quiere servir los 40 adaptadores en SageMaker AI minimizando el número de instancias GPU y permitiendo invocar el adaptador de cada cliente. ¿Qué enfoque es el MÁS eficiente?
21. Un equipo de MLOps ajusta periódicamente un LLM de dominio y lo sirve en un endpoint de SageMaker AI. Necesitan: versionar cada modelo, exigir aprobación antes de producción, desplegar automáticamente al aprobar y volver atrás si aumentan los errores. ¿Qué combinación cumple TODOS los requisitos? (Elige tres)
22. Una startup ha ajustado fuera de AWS un modelo Llama con pesos en formato Hugging Face (safetensors). Quiere servirlo en eu-central-1 sin gestionar instancias, pagando solo cuando se usa y con escalado a cero en las horas sin tráfico. ¿Qué opción es la MÁS adecuada?
23. Una cadena hotelera quiere un asistente que responda sobre sus políticas de cancelación, tarifas y servicios. Esa información cambia varias veces por semana, las respuestas deben citar el documento de origen y el equipo es pequeño. ¿Qué enfoque de diseño es el MÁS adecuado?
24. Una aseguradora quiere automatizar la revisión de siniestros: extraer datos de formularios, comprobar la póliza en un sistema interno mediante API, decidir si faltan documentos y, según el caso, pedirlos al cliente o preparar una propuesta de pago que revisará un tramitador. El orden de los pasos depende de cada siniestro. ¿Qué patrón de integración encaja MEJOR con estos requisitos?
25. Un arquitecto debe diseñar un asistente de IA generativa para un hospital. Antes de elegir servicios, recopila requisitos. ¿Qué información determina DIRECTAMENTE la elección de la región y del tipo de perfil de inferencia?
26. La dirección de una empresa de seguros quiere saber, en tres semanas y con un presupuesto mínimo, si la IA generativa puede reducir a la mitad el tiempo de redacción de cartas de respuesta a reclamaciones. ¿Qué enfoque de prueba de concepto es el MÁS adecuado?
27. Tras una PoC con buenos resultados de calidad, el comité pide datos para decidir si pasar a producción. ¿Qué información debe incluir el informe de la PoC para demostrar rendimiento y valor de negocio? (Elige tres)
28. Una empresa tiene seis equipos construyendo aplicaciones de IA generativa en distintas cuentas. El CTO quiere que todas se revisen con los mismos criterios de buenas prácticas específicos de IA generativa, registrar los riesgos detectados, seguir un plan de mejora y guardar el estado en cada hito. ¿Qué solución cumple mejor el objetivo?
29. En una revisión con la Generative AI Lens, un agente de compras puede aprobar pedidos de cualquier importe sin intervención humana y con permisos de IAM amplios. ¿Qué principio de diseño de la lente se está incumpliendo MÁS claramente y cuál sería la corrección?
30. Una organización quiere que todos sus equipos implementen de la misma forma las aplicaciones de IA generativa en distintos escenarios (interno, clientes, lotes), reduciendo el trabajo repetido y los errores de configuración. ¿Qué enfoque crea componentes técnicos estandarizados?
31. Un hospital evalúa Amazon Bedrock. El responsable de protección de datos pregunta si los prompts con información clínica que se envían al modelo se almacenan en Bedrock o se usan para entrenar los modelos, y cómo podría conservarse un registro auditable de esas interacciones si fuera necesario. ¿Qué respuesta es correcta?