01Responsibilities
IaC Development
Design, develop, and maintain Infrastructure Automation using IaC principals and DevOps Skills. Develop Predictive automation using Monitoring and Observability tools.
DevOps & Cloud Infrastructure
Build and maintain CI/CD pipelines using tools such as GitHub Actions, GitLab CI, Jenkins, or CircleCI. Manage infrastructure as code (IaC) using Terraform, CloudFormation, or Ansible, Pulumi and CrossPlane. Deploy and monitor applications in cloud environments (AWS, Azure, or GCP). Set up automated monitoring, logging, and alerting (Prometheus, Grafana, ELK Stack, Datadog). Enhance system reliability, security, and scalability through automation and best practices.
Operations & Collaboration
Participate in code reviews and DevOps strategy discussions. Troubleshoot and resolve production issues with a focus on uptime and performance. Implement security best practices and assist with compliance standards. Mentor junior developers and contribute to improving development workflows.
Professional & Technical Skills:
DevOps & Automation Tools
CI/CD Pipelines: Jenkins, GitHub Actions, GitLab CI, CircleCI, Travis CI, ArgoCD Infrastructure as Code (IaC): Terraform, Ansible, AWS CloudFormation, Pulumi Configuration Management: Chef, Puppet, Ansible, SaltStack Monitoring & observability: Splunk, DataDog, Prometheus.
Cloud & Infrastructure
Cloud Platforms: AWS, Azure, Google Cloud Platform (GCP) Compute & Networking: EC2, Lambda, VPC, Load Balancers, Route 53, DNS, VPNs Storage & Databases: S3, RDS, DynamoDB, PostgreSQL, MySQL, MongoDB Containerization: Docker, Podman Container Orchestration: Kubernetes (K8s), Helm, OpenShift
System Administration & Networking
Operating Systems: Linux (Ubuntu, CentOS, Alpine), Bash scripting, basic Windows Server knowledge Networking Fundamentals: TCP/IP, DNS, SSL/TLS, HTTP/HTTPS, VPN, firewalls Security & Compliance: IAM, Secrets Management (Vault, AWS Secrets Manager), SSH, encryption, vulnerability scanning
Observability & Incident Response
Monitoring: Application and system performance metrics Alerting & Incident Management: PagerDuty, Opsgenie, Slack integrations Logging: Centralized log management (ELK, Fluentd, Splunk)
Bonus / Emerging Skills
Serverless architectures (AWS Lambda, Azure Functions) GitOps (Flux, ArgoCD) AIOps and observability automation SRE principles (Service Level Indicators/Objectives)
Cloud Observability Skills: Multi-cloud monitoring, Cloud cost optimization, Cloud performance analysis, Cloud-native troubleshooting, Cloud security observability
Tools: Azure Monitor, Azure Log Analytics, Azure Application Insights, AWS CloudWatch, AWS X-Ray, GCP Operations Suite, Datadog Cloud Monitoring, Dynatrace Cloud Automation
Skills: Network flow analysis, Packet analytics, WAN observability, SD-WAN monitoring, Network performance management, Network anomaly detection
Tools: ThousandEyes, SolarWinds NPM, Cisco AppDynamics Network Monitoring, Riverbed
Observability: SCOM, SolarWinds, Datadog Infrastructure Monitoring, Dynatrace Infrastructure, VMware Aria Operations, Turbonomic
Additional Information:
Strong problem-solving and debugging skills Collaboration with developers, QA, and IT teams Understanding agile methodologies (Scrum, Kanban) Continuous learning and adapting to new tools and cloud services Flexible to work in 24*7 environment .