Zielprofil
Gesucht wird kein klassischer Service-Desk-Agent und nicht zwingend ein z/OS Systems Programmer.
Gesucht wird ein:
Mainframe Operations Engineer / z/OS Operator mit technischem Produktionsverständnis und Entwicklungspotenzial in Richtung Advanced Mainframe Operations.
Rolle
Für den Betrieb einer geschäftskritischen IBM-Mainframe-Umgebung suchen wir Mainframe Operations Engineers mit fundierter Erfahrung im operativen z/OS-Betrieb.
Es wird nicht in einem klassischen Service Desk gearbeitet. Als Teil unseres Mainframe Operations Teams werden produktive z/OS-Systeme überwacht und gesteuert, technische Störungen analysiert und definierte Betriebsmaßnahmen eigenständig durchgeführt.
Dabei wird innerhalb klar definierter Runbooks, Betriebsverfahren und Entscheidungsgrenzen gearbeitet. Bekannte Fehlerbilder und Standardmaßnahmen werden selbständig gelöst. Komplexe oder nicht dokumentierte Situationen werden strukturiert an die zuständigen Mainframe-Spezialisten, Fachbereiche oder Hersteller übergeben.
Die Position eignet sich sowohl für erfahrene Mainframe Operatoren als auch für Mainframe Engineers, die sich in Richtung Advanced Operations weiterentwickeln möchten.
Aufgaben
Zu den Aufgaben gehören insbesondere:
• aktive Überwachung produktiver z/OS-Systeme und der zugehörigen Infrastruktur
• Bearbeitung von Monitoring Events, Alerts, WTORs, Dumps und Systemmeldungen einschließlich kontrollierter Operator Replies
• Annahme, Priorisierung, Klassifizierung und technische Erstdiagnose von Incidents anhand von Auswirkung, Dringlichkeit und Servicekritikalität
• Korrelation zusammengehöriger Alerts sowie End-to-End- und Cross-Domain-Triage zur Eingrenzung der tatsächlichen Serviceauswirkung
• Abgleich von Monitoring-, Console- und Ticketinformationen sowie Erkennen transienter gegenüber anhaltenden Störungen
• Durchführung bekannter Fehlerbehebungen und Standardmaßnahmen nach Runbook
• Bearbeitung und Durchführung standardisierter Service Requests
• Überwachung und Steuerung von Batch-Verarbeitung und JES2
• Analyse und Behandlung von Batch-Jobs, Loops und Spool-Engpässen
• Starten, Stoppen und Überwachen von Started Tasks über System Automation oder z/OS Commands
• operative Unterstützung bei Workload-Verlagerungen
• Unterstützung und Durchführung freigegebener IPL-, POR- und LPAR-Restart-/Activation-Abläufe einschließlich definierter Pre- und Post-Checks
• Überwachung von Workload, Systemperformance und Capacity-Indikatoren einschließlich CPU/zIIP sowie MSU/MIPS
• Unterstützung bei CICS-, MQ- und DB2-bezogenen Betriebsstörungen
• Durchführung definierter CICS- und MQ-Operations
• technische Unterstützung im Parallel-Sysplex- und Coupling-Facility-Umfeld
• operative Tätigkeiten an HMC und PROCOPS nach freigegebenen Verfahren, einschließlich LoadParm, Sysload und Activation Profiles
• Unterstützung bei Mainframe-Hardware- und CPC-bezogenen Betriebsaktivitäten nach freigegebenen Verfahren
• Koordination und Bearbeitung von Hersteller-Tickets
• Unterstützung bei Major und Critical Incidents einschließlich strukturierter Eskalation und Rufbereitschaftsaktivierung
• Durchführung freigegebener Change-Aktivitäten und Begleitung von Wartungsmaßnahmen einschließlich Validierung, Abbruch- und Rollback-/Backout-Verfahren
• vollständige und nachvollziehbare Dokumentation aller durchgeführten Maßnahmen im ITSM-System
• strukturierte Schichtübergabe laufender Incidents, Changes und betrieblicher Auffälligkeiten
• Koordination kontrollierter Hersteller-Remote-Support-Zugänge über PAM-/Jump-Server-Verfahren
• Pflege und Verbesserung von Runbooks, SOPs und Betriebsdokumentation
• Erkennen wiederkehrender Fehlerbilder sowie Einbringen von Verbesserungs- und Automatisierungsvorschlägen
Technischer Hintergrund
Erforderlich: Praktische Berufserfahrung im Betrieb von IBM-Mainframe-Umgebungen, Kenntnis der folgenden Technologien aus dem produktiven Einsatz:
• IBM z/OS
• JES2 und Batch Processing
• JCL
• z/OS Console Operations einschließlich WTOR-/REPLY-Handling sowie DISPLAY-/MODIFY-Kommandos
• Started Tasks und MVS Commands
• LPAR Lifecycle Operations sowie HMC/PROCOPS-Grundlagen
• LoadParm, Sysload und HMC Activation Profiles
• Monitoring, Event Handling, Alert-Korrelation und End-to-End-/Cross-Domain-Triage
• System Automation und/oder NetView einschließlich SDF-/Statusinterpretation
• TSO/ISPF und SDSF
• grundlegendes Verständnis von z/OS-Systemmeldungen, Dumps und ABENDs sowie operativer Log- und Statusanalyse
• DB2 for z/OS
• CICS
• IBM MQ for z/OS
• GDPS (Geographically Dispersed Parallel Sysplex)
• VTAM
• TCP/IP für z/OS
• RMF (Resource Measurement Facility)
• SMF (System Management Facility)
• WLM (Workload Manager) und grundlegende Capacity-/Performance-Bewertung
• CPU/zIIP, MSU/MIPS und grundlegende Interpretation von Last- und Kapazitätsverläufen
• Erfahrung mit Parallel Sysplex- und Hochverfügbarkeitsumgebungen