Diseña y opera la infraestructura cloud con GPUs que entrena y sirve Large Data Models a escala.
Sobre NeoSpace
NeoSpace es una startup innovadora que está moldeando el futuro de la tecnología con soluciones de inteligencia artificial de vanguardia. Desarrollamos modelos de IA especializados para optimizar procesos y transformar la experiencia de nuestros clientes. Nuestro objetivo es simplificar la vida de las personas y aumentar la eficiencia de las empresas, creando productos y servicios más inteligentes y accesibles.
Qué buscamos
Buscamos una persona Especialista en Cloud con visión estratégica para participar en el diseño, la implementación y el mantenimiento de arquitecturas críticas en entornos Cloud, con experiencia en cargas de trabajo de alta complejidad.
Si entiendes que "la infraestructura es código" y te mueves con facilidad entre distintos proveedores para dar soporte a tecnologías emergentes (como la IA), esta vacante es para ti.
Responsabilidades
- Diseñar y mantener soluciones robustas que integren servicios de AWS y OCI, garantizando alta disponibilidad.
- Desarrollar, probar y versionar módulos de Terraform para un aprovisionamiento 100% automatizado.
- Implementar y gestionar entornos de alto rendimiento para procesamiento de IA, incluyendo clusters NVIDIA e interconectividad de baja latencia.
- Implementar políticas de IAM, conectividad segura (VPC/VCN Peering) y controles de cumplimiento.
- Monitorear el consumo de recursos y proponer mejoras continuas para optimizar el rendimiento y reducir costos.
- Difundir la cultura Cloud y apoyar a los equipos de desarrollo en la adopción de mejores prácticas.
Requisitos
- Experiencia sólida en servicios core de AWS (EC2, S3, RDS, Lambda, EKS) y OCI (VCN, Compartments, Compute, Storage).
- Conocimiento avanzado de Terraform (preferente), AWS CDK o CloudFormation.
- Conocimiento profundo de protocolos de red, VPNs, Direct Connect y FastConnect.
- Experiencia práctica con Docker y Kubernetes.
- Linux avanzado (troubleshooting y shell scripting) y experiencia con metodologías DevOps/SRE.
- Sólido entendimiento de seguridad en la nube (KMS, IAM, encriptación y prácticas de compliance).
- Pensamiento analítico agudo para manejar incidentes complejos con agilidad.
- Capacidad para comunicar decisiones técnicas a stakeholders de distintas áreas.
- Interés genuino en probar nuevas tecnologías e influir en la dirección de los productos internos.
Deseable
- HPC & NVIDIA: experiencia con clusters de High Performance Computing.
- CI/CD de infraestructura: implementación de pipelines de deploy (GitHub Actions, GitLab CI o Jenkins).