Test del módulo · Semana 6

Test: Despliegue de modelos, integración empresarial y herramientas de desarrollo

Preguntas al estilo del examen. Contesta, pulsa «Comprobar» y lee siempre la explicación, también cuando aciertes: ahí está lo que de verdad se aprende.

30 preguntasComprobadas: 0/30

1. Una aplicación interna de resúmenes recibe unas 300 peticiones al día, concentradas en horario laboral y con días sin uso. Usa un modelo de Amazon Bedrock y el equipo quiere el coste MÁS bajo sin gestionar infraestructura. ¿Qué opción de despliegue es la adecuada?

2. Una empresa ha personalizado un modelo en Amazon Bedrock con supervised fine-tuning. El tráfico será alto y constante (miles de peticiones por minuto, 24x7) y necesita un rendimiento predecible. ¿Cómo debe servir el modelo?

3. Un equipo de datos ha afinado un modelo Llama 3.1 en SageMaker AI y tiene los pesos en formato Hugging Face (safetensors) en Amazon S3. Quiere invocarlo con la misma API que el resto de modelos de Amazon Bedrock, en eu-central-1, sin gestionar instancias ni endpoints. ¿Qué debe usar?

4. Una aseguradora transcribe y analiza con un LLM propio grabaciones de llamadas. Cada petición incluye un fichero de hasta 600 MB y el procesamiento tarda entre 10 y 40 minutos. Las peticiones llegan en lotes irregulares y quieren no pagar cómputo cuando no hay trabajo. ¿Qué opción de SageMaker AI encaja?

5. Un equipo despliega un modelo abierto de 70.000 millones de parámetros en SageMaker AI. Las primeras pruebas muestran errores de memoria en la GPU y baja utilización cuando hay muchas peticiones concurrentes. ¿Qué dos medidas abordan los retos propios del despliegue de LLMs? (Elige dos.)

6. Un chatbot de atención al cliente usa un modelo grande para todas las consultas. El análisis de logs muestra que el 80 % son preguntas rutinarias (horarios, estado de pedidos) que un modelo pequeño responde bien. El negocio quiere reducir coste y latencia sin perder calidad en las consultas complejas. ¿Qué estrategia es la más adecuada?

7. Una empresa sirve en SageMaker AI doce modelos afinados distintos, cada uno con tráfico esporádico. Hoy cada modelo tiene su propio endpoint con una instancia GPU casi siempre ociosa. ¿Qué cambio reduce más el coste manteniendo el control sobre los recursos de cada modelo?

8. Un equipo usa un modelo grande de Amazon Bedrock para extraer campos de contratos con muy buena calidad, pero el coste y la latencia son demasiado altos. Tiene activado el model invocation logging con miles de peticiones y respuestas reales. Quiere un modelo más pequeño con calidad similar en esta tarea y el mínimo esfuerzo de etiquetado. ¿Qué debe hacer?

9. En 2026, un equipo que nunca ha usado AWS App Runner quiere desplegar un frontal web en contenedor que llama a Amazon Bedrock, con balanceo, escalado automático y la mínima gestión de infraestructura. ¿Qué opción es la adecuada?

10. Un proceso nocturno envía 50.000 descripciones de producto para que un FM de Amazon Bedrock las reescriba. La primera prueba generó miles de ThrottlingException y reintentos que colapsaron el sistema de origen. Los resultados se necesitan antes de las 8:00. ¿Qué arquitectura es la más adecuada? (Elige dos.)

11. Un CRM heredado no puede modificarse, pero publica un evento cada vez que se crea un ticket. La empresa quiere enriquecer cada ticket con un resumen y una clasificación generados por un FM y devolverlos al CRM por su API, con acoplamiento débil y sin tocar el CRM. ¿Qué diseño es el más adecuado?

12. Un SaaS de comercio electrónico envía un webhook cuando llega una reseña de producto. La empresa quiere clasificar el sentimiento con un FM y responder al SaaS en menos de 3 segundos para que no reintente el envío. El análisis puede tardar más. ¿Qué diseño es el más adecuado?

13. Varios equipos de una empresa usan Amazon Bedrock. Seguridad detecta que un rol de aplicación tiene bedrock:* sobre todos los recursos y que algunos equipos usan modelos no aprobados. ¿Qué dos medidas aplican mejor el mínimo privilegio y el gobierno de modelos? (Elige dos.)

14. Los empleados de una empresa acceden a una aplicación interna de IA generativa con su identidad corporativa de Microsoft Entra ID. Cada departamento solo debe consultar los documentos de su área a través de la Knowledge Base, y no se quieren crear usuarios de IAM. ¿Qué combinación es la más adecuada?

15. Un hospital debe analizar informes clínicos con un LLM, pero la normativa le obliga a que los datos no salgan de su centro de datos. Quiere usar las mismas APIs y herramientas de AWS que en la región para el resto de su plataforma. ¿Qué opción cumple?

16. Una empresa española usa Amazon Bedrock en eu-south-2. El modelo que necesita solo está disponible allí mediante perfiles de inferencia. El departamento legal exige que los datos de las peticiones se procesen dentro de la UE. ¿Qué debe configurar?

17. Una compañía eléctrica quiere que su contact center en Amazon Connect responda automáticamente por voz las preguntas frecuentes a partir de sus manuales, consulte el estado de las averías en su sistema interno y pase al agente humano los casos que no resuelva con un resumen de la conversación. ¿Qué diseño es el más adecuado?

18. Una multinacional tiene 30 equipos que quieren usar FMs. El CISO exige: un único punto de acceso, cuotas por equipo, modelos aprobados centralmente, guardrails comunes y trazabilidad de coste y uso por equipo. ¿Qué arquitectura cumple con LEAST effort para los equipos?

19. Un equipo despliega con CodePipeline una aplicación que usa un FM. Un cambio en la plantilla de prompt pasó todos los tests unitarios, pero en producción las respuestas empezaron a salir en otro idioma y sin los datos clave. ¿Qué dos mejoras del pipeline habrían evitado el incidente? (Elige dos.)

20. En un pipeline de CodePipeline, CodeBuild ejecuta los tests de una aplicación de IA generativa y una acción de CloudFormation despliega la infraestructura. Seguridad quiere minimizar el impacto de un script malicioso introducido en el repositorio. ¿Qué configuración es la más adecuada?

21. Una API REST de Amazon API Gateway con integración Lambda proxy genera informes con un FM. Algunas respuestas tardan 70 segundos y los usuarios reciben errores de timeout; además quieren ver el texto según se genera. La Lambda está escrita en Node.js. ¿Qué solución es la más adecuada?

22. Un equipo quiere devolver en streaming las respuestas de Amazon Bedrock desde una función Lambda escrita en Python detrás de una function URL. Tras configurarla, el cliente sigue recibiendo la respuesta completa de golpe. ¿Cuál es la causa más probable y la solución?

23. Una aplicación de chat necesita comunicación bidireccional en tiempo real: el usuario puede interrumpir la generación y el servidor envía tokens según los produce el modelo. ¿Qué opción de API es la más adecuada?

24. Un equipo quiere cambiar el modelo, la temperatura y la versión de la plantilla de prompt de su aplicación sin redesplegar código, validar la configuración antes de aplicarla, desplegarla de forma gradual y volver atrás automáticamente si sube la tasa de errores. ¿Qué servicio lo resuelve?

25. Un equipo quiere acelerar el desarrollo de su aplicación de IA generativa con un asistente de AWS que planifique cambios en documentos de requisitos, diseño y tareas, respete las normas del proyecto y pueda ejecutarse sin interfaz en la CI. Algunos miembros usaban los plugins de Amazon Q Developer para el IDE. ¿Qué herramienta deben adoptar?

26. Tras un despliegue, los usuarios dicen que algunas respuestas llegan cortadas y que la latencia ha subido. El equipo necesita saber qué peticiones se truncaron, cuántos tokens usaron y en qué tramo de la cadena API Gateway, Lambda y Bedrock se pierde el tiempo. ¿Qué dos herramientas usarías? (Elige dos.)

27. Una startup quiere lanzar en pocas semanas una aplicación web con un chat de IA generativa. Requisitos: inicio de sesión de usuarios, historial de conversaciones por usuario, componentes de interfaz ya hechos y definir el backend de IA de forma declarativa sin montar la API a mano. ¿Qué enfoque es el más adecuado?

28. Una gestoría recibe cada día cientos de facturas y contratos en PDF y en imagen. Quiere extraer campos estructurados según plantillas propias, validar los importes, resumir las cláusulas con un FM y enviar a revisión humana los documentos con baja confianza. ¿Qué combinación es la más adecuada?

29. Una empresa quiere que su nueva API de clasificación de incidencias sea fácil de adoptar por otros equipos, que puedan generar clientes automáticamente y que la misma definición sirva después para exponerla como herramienta a agentes. ¿Qué enfoque es el más adecuado?

30. Un área de plataforma quiere que los equipos de producto creen por sí mismos entornos de RAG ya aprobados (Knowledge Base, guardrails, logging e IAM de mínimo privilegio) sin permisos de administrador y siempre con la misma configuración. ¿Qué combinación es la más adecuada?