H-1BGreen card en trámite para este puesto

REG. 1444824

Director - Ingeniería de Infraestructura - Seguridad de Plataforma y Gestión de Ciclo de Vida

American Express Travel Related Services Company, Inc.

VERIFICADO · 54 green cards (PERM) aprobadas en los últimos 12 mesesRegistros públicos del Departamento de Trabajo de EE. UU. (DOL).

Director de Ingeniería de Infraestructura en Phoenix en American Express; empresa con 394 LCAs aprobadas en los últimos 12 meses.

Ver el empleo en el portal y postularVer planes

Cuenta gratis — el contacto y el enlace oficial del empleo están en el portal.

Descripción del empleo

Traducción automática del anuncio original del empleador.

El equipo de American Express Enterprise Cloud está buscando innovadores para ayudarnos a construir aplicaciones de clase mundial, plataformas Cloud e infraestructura apoyadas por CICD integrado, Observabilidad y capacidades de seguridad. El Director de Ingeniería de Infraestructura – Seguridad de la Plataforma y Gestión del Ciclo de Vida es responsable de liderar la estrategia, la gobernanza y la ejecución de la Plataforma como una gestión del ciclo de vida de servicios y servicios de Middleware en entornos de Private Cloud. Esta función aprovecha a Gen AI/Agentic AI para impulsar actualizaciones de plataformas totalmente automatizadas, gestión de posturas de seguridad, gestión de capacidades y resiliencia operacional para garantizar una plataforma segura, escalable, altamente disponible y compatible con aplicaciones empresariales críticas para las misiones. El Director colabora estrechamente con los equipos de Ingeniería de Plataformas, Seguridad de la Información, Arquitectura, Infraestructura, SRE, DevOps y Desarrollo de Aplicaciones para impulsar la modernización de plataformas, automatizar operaciones, reducir el riesgo tecnológico y permitir la adopción nativa de la nube a escala. Estrategia de actualización de plataforma de nube privada • Definir y ejecutar la estrategia empresarial y la hoja de ruta para la plataforma Enterprise PaaS utilizando las actualizaciones de la plataforma Redhat Openshift y Data Middleware y la gestión del ciclo de vida. • Principales actualizaciones de versiones, modernización de grupos e iniciativas de actualización de infraestructura en entornos de desarrollo, ensayo y producción. • Establecer estándares, arquitecturas de referencia y mejores prácticas para el ciclo de vida de plataforma y la gestión de seguridad. • Leverage Gen AI/Agentic AI para impulsar un oleoducto totalmente automatizado para el suministro de plataformas, actualizaciones, parche y gestión de configuración Actualizaciones " Administración de lanzamientos • Propietario de planificación de la actualización final a fin, gobernanza, evaluación de riesgos y ejecución. • Establecer procesos de preparación de actualización, marcos de validación, estrategias de retroceso y monitoreo posterior a la actualización. • Coordinar con los equipos de aplicaciones para garantizar la compatibilidad de las plataformas y minimizar la perturbación de las empresas durante las actualizaciones. • Gestionar los riesgos del ciclo de vida asociados con OpenShift, Kubernetes, sistemas operativos, middleware y infraestructura de apoyo. • Seguimiento e informe de las métricas de cumplimiento del ciclo de vida de la plataforma y la tecnología. Seguridad y cumplimiento • Establecer y mantener una fuerte postura de seguridad entre los grupos y la infraestructura de apoyo. • Gestión de vulnerabilidad de plomo, seguridad de imagen de contenedor, endurecimiento de plataformas, gestión de parches y esfuerzos de rehabilitación. • Asegurar el cumplimiento de las políticas de seguridad empresarial, los requisitos reglamentarios y las normas industriales. • Colaborar con equipos de seguridad y riesgo de información para gestionar evaluaciones de seguridad, auditorías y actividades de rehabilitación. • Gestionar las excepciones de seguridad y los procesos de aceptación de riesgos mientras se impulsan estrategias de remediación a largo plazo. Capacity " Performance Management • Planificación y pronóstico de capacidad propia para la Plataforma, incluyendo cálculo, memoria, almacenamiento y recursos de red. • Desarrollar modelos de capacidad predictiva para apoyar el crecimiento empresarial y la aplicación a bordo. • Establecer procesos de monitoreo y presentación de informes para la utilización de grupos, rendimiento y escalabilidad. • Optimize infrastructure consumption and platform efficiency while maintaining service-level objectives. • Principales iniciativas de optimización de recursos para mejorar la densidad de carga de trabajo y reducir los costos de infraestructura. Liderazgo y Gestión del Equipo • Construir y liderar ingenieros nativos de nube de alto rendimiento, administradores de Kubernetes, especialistas en seguridad y planificadores de capacidades. • Fomentar una cultura de excelencia operativa, aprendizaje continuo, innovación y responsabilidad. • Mentores líderes y expertos técnicos dentro de la organización. • impulsar iniciativas de planificación de la fuerza de trabajo, planificación de la sucesión y desarrollo de talentos. Stakeholder & Vendor Management • Servir como líder tecnológico para los servicios de plataforma Private Cloud. • Colaborar con el desarrollo de aplicaciones, arquitectura, seguridad, infraestructura y líderes empresariales para alinear las capacidades de plataforma con las prioridades organizativas. • Gestionar relaciones con proveedores clave, proveedores de servicios gestionados y socios estratégicos. • Presentar salud de plataforma, estado de actualización, postura de seguridad, riesgos y previsiones de capacidad para el liderazgo ejecutivo. • Licenciado en Ciencias de la Computación, Ingeniería o campo relacionado (Prefierno del Maestro). • 8+ años de experiencia en Ingeniería de Plataformas " Operaciones, Ingeniería de Confiabilidad del Sitio (SRE), Gestión de ciclos de vida de Plataforma con un historial comprobado de equipos líderes en la gestión de infraestructuras cloud a gran escala con enfoque en automatización, fiabilidad y resiliencia. • Experiencia práctica profunda con cualquier plataforma Kubernetes (multi-cloud preferido). • La experiencia de la construcción final a la actualización de la plataforma final y la automatización de gestión de flotas aprovechando Gen AI / Agentic AI • Fuerte experiencia con: • Infraestructura como Código (Terraform, CloudFormation, ARM) • Herramientas de automatización de infraestructuras como Ansible • Plataformas de contenedores (OpenShift/Kubernetes) • Herramientas de monitoreo (Prometeo, OTEL, LOKI) • tuberías CI/CD (Jenkins, GitHub Actions) • Tecnologías de mensajería, caché y bases de datos basadas en código abierto como Kafka, Redis, Elastic • Fuerte comprensión de las redes de nube, seguridad y arquitectura. • Experiencia en la gestión de entornos de producción a gran escala y críticos para la misión. • Certificaciones relevantes preferidas • Experiencia con prácticas y metodologías de DevOps, incluyendo tuberías CI/CD, gestión de configuración e infraestructura como código. • Experiencia con herramientas de observabilidad como Prometheus, Splunk, ELK, Dynatrace. • Fuertes habilidades analíticas y de solución de problemas, con la capacidad de resolver problemas complejos y de impulsar la resolución en un entorno de ritmo rápido. • Excelentes habilidades de comunicación y liderazgo, con la capacidad de colaborar eficazmente con equipos multifuncionales e influir en la toma de decisiones en todos los niveles de la organización. Elegibilidad para trabajar con American Express en los Estados Unidos es necesario ya que la empresa no buscará el patrocinio de visados para estas posiciones.
Ver el texto original en inglés
American Express Enterprise Cloud team is looking for innovators to help us build world-class applications, Cloud platforms and infrastructure supported by integrated CICD, Observability and security capabilities. The Director Infrastructure Engineering – Platform Security and Lifecycle Management is responsible for leading the strategy, governance, and execution of Platform as a Service and Middleware services lifecycle management across Private Cloud environments. This role leverages Gen AI/Agentic AI to drive fully automated platform upgrades, security posture management, capacity management, and operational resilience to ensure a secure, scalable, highly available, and compliant Private Cloud platform supporting mission-critical business applications. The Director partners closely with Platform Engineering, Information Security, Architecture, Infrastructure, SRE, DevOps, and Application Development teams to drive platform modernization, automate operations, reduce technology risk, and enable cloud-native adoption at scale. Private Cloud Platform Upgrade Strategy & Modernization • Define and execute the enterprise strategy and roadmap for Enterprise PaaS platform using Redhat Openshift and Data Middleware platform upgrades and lifecycle management. • Lead major version upgrades, cluster modernization, and infrastructure refresh initiatives across development, test, and production environments. • Establish standards, reference architectures, and best practices for platform lifecycle and security management. • Leverage Gen AI/Agentic AI to drive a fully automated pipeline for platform provisioning, upgrades, patching, and configuration management Upgrades & Release Management • Own end-to-end upgrade planning, governance, risk assessment, and execution. • Establish upgrade readiness processes, validation frameworks, rollback strategies, and post-upgrade monitoring. • Coordinate with application teams to ensure platform compatibility and minimize business disruption during upgrades. • Manage lifecycle risks associated with OpenShift, Kubernetes, operating systems, middleware, and supporting infrastructure. • Track and report platform currency and technology lifecycle compliance metrics. Security & Compliance • Establish and maintain a strong security posture across clusters and supporting infrastructure. • Lead vulnerability management, container image security, platform hardening, patch management, and remediation efforts. • Ensure compliance with enterprise security policies, regulatory requirements, and industry standards. • Partner with Information Security and Risk teams to manage security assessments, audits, and remediation activities. • Manage security exceptions and risk acceptance processes while driving long-term remediation strategies. Capacity & Performance Management • Own capacity planning and forecasting for Platform, including compute, memory, storage, and network resources. • Develop predictive capacity models to support business growth and application onboarding. • Establish monitoring and reporting processes for cluster utilization, performance, and scalability. • Optimize infrastructure consumption and platform efficiency while maintaining service-level objectives. • Lead resource optimization initiatives to improve workload density and reduce infrastructure costs. Leadership & Team Management • Build and lead high-performing cloud native DevOps engineers, Kubernetes administrators, security specialists, and capacity planners. • Foster a culture of operational excellence, continuous learning, innovation, and accountability. • Mentor leaders and technical experts within the organization. • Drive workforce planning, succession planning, and talent development initiatives. Stakeholder & Vendor Management • Serve as the senior technology leader for Private Cloud platform services. • Partner with application development, architecture, security, infrastructure, and business leaders to align platform capabilities with organizational priorities. • Manage relationships with key vendors, managed service providers, and strategic partners. • Present platform health, upgrade status, security posture, risks, and capacity forecasts to executive leadership. • Bachelor’s degree in Computer Science, Engineering, or related field (Master’s preferred). • 8+ years of experience in Platform Engineering & Operations, Site Reliability Engineering (SRE), Platform lifecycle management with a proven track record of leading teams in managing large-scale cloud infrastructure with a focus on automation, reliability and resilience. • Deep hands-on experience with any Kubernetes platform(multi-cloud preferred). • Experience building end to end platform upgrade and fleet management automation leveraging Gen AI / Agentic AI • Strong experience with: • Infrastructure as Code (Terraform, CloudFormation, ARM) • Infrastructure automation tools like Ansible • Container platforms (OpenShift/Kubernetes) • Monitoring tools (Prometheus, OTEL, LOKI) • CI/CD pipelines (Jenkins, GitHub Actions) • Open source based messaging, caching, and database technologies like Kafka, Redis, Elastic • Strong understanding of cloud networking, security, and architecture. • Experience managing large-scale, mission-critical production environments. • Relevant certifications preferred • Experience with DevOps practices and methodologies, including CI/CD pipelines, configuration management, and infrastructure as code. • Experience with observability tools such as Prometheus, Splunk, ELK, Dynatrace. • Strong analytical and problem-solving skills, with the ability to troubleshoot complex issues and drive resolution in a fast-paced environment. • Excellent communication and leadership skills, with the ability to effectively collaborate with cross-functional teams and influence decision-making at all levels of the organization. Employment eligibility to work with American Express in the United States is required as the company will not pursue visa sponsorship for these positions.
Ver el empleo en el portal y postularVer planes

Cuenta gratis — el contacto y el enlace oficial del empleo están en el portal.

Más empleos como este

Técnico de Escalada de TI (Nivel 2)

Salt Lake City, UT

Consultor Técnico ERP Senior

Goleta, CA

Especialista en Soporte Técnico (Nivel 1)

Holladay, UT

Consultor Técnico ERP

Goleta, CA

Arquitecto de Integración

Chicago, NY

Ingeniero de Implementación de Campo

Chicago, NY

Ver todos los empleos