jobify_logo ×
  • מִשׁתַמֵשׁ
  • התחברות/הרשמה
  • עמוד הבית
  • מי אנחנו
  • מעסיקים מובילים
  • פרסום משרה חינם
  • צרו קשר
  • תנאי שימוש
  • מדיניות פרטיות
  • הצהרת נגישות
קרן עזריאלי טקסט בעברית עם סמל אינסוף social_security the_israeli_employment_service work_office המקום
jobify_logo
  • מי אנחנו
  • מעסיקים מובילים
  • פרסום משרה חינם
  • צרו קשר
דילוג לתוכן

עדיין מחפשים עבודה במנועי חיפוש? הגיע הזמן להשתדרג!

במקום לעבור לבד על אלפי מודעות, Jobify מנתחת את קורות החיים שלך ומציגה לך רק משרות שבאמת מתאימות לך.

מעל 80,000 משרות • 4,000 חדשות ביום
חינם. בלי פרסומות. בלי אותיות קטנות.

Senior AI Ops Engineer

DriveNets

DriveNets DriveNets

  • תל אביב - יפו
  • LinkedIn
LinkedIn

Senior AI Ops Engineer

DriveNets

DriveNets DriveNets

  • תל אביב - יפו
  • bag_icon מלאה, היברידית
  • coins_icon 28,000-40,000 ₪ (הערכה מבוססת AI)
    הערכה מבוססת AI ולא שכר של המעסיק
  • LinkedIn
LinkedIn


Description

Hybrid | Israel

About The Company

DriveNets is a leader in large-scale networking solutions for AI infrastructure and service providers. The company's disaggregated networking architecture transforms the economics of large-scale infrastructures while maximizing performance, utilization, and operational efficiency. Its high-performance AI fabric maximizes GPU utilization and accelerates deployments by optimizing the AI stack end-to-end, resulting in higher tokens-per-second and lower cost-per-token. DriveNets' solutions power production networks for global tier-1 operators like AT&T and Comcast, and scale multi-vendor AI infrastructures at foundation model labs, NeoClouds, and enterprises.

Responsibilities

  • Deploy and tune vLLM inference servers across customer environments on diverse GPU hardware (H100, A100, L40S, MI300X), including fully air-gapped, offline deployments.
  • Optimize inference performance end-to-end - batching, tensor/pipeline parallelism, KV-cache and prefix caching, quantization (FP16/INT8/AWQ/GPTQ), and hardware-specific tuning across NVIDIA and AMD architectures.
  • Maintain the LiteLLM gateway and Helm chart variations across Kubernetes flavors (OpenShift, EKS, AKS, GKE, bare metal).
  • Own the model lifecycle - registry, canary rollouts, upgrade/rollback playbooks, and benchmarking of new open-weight models against our security-reasoning workloads.
  • Build evaluation and regression-detection infrastructure to track finding quality, precision/recall, and cost-per-finding over time.
  • Own observability for the AI stack - self-hosted Langfuse tracing, Grafana/OTel dashboards, and alerting on latency, error rates, and GPU health.
  • Define AI infrastructure readiness for new customer deployments - GPU/driver validation, capacity planning, and standardized onboarding runbooks.

Requirements

Technical Skills

  • Hands-on experience running LLM inference at scale (vLLM or similar) in production.
  • Deep GPU knowledge - CUDA, NCCL, multi-GPU topologies, and attention-backend/quantization tuning (FlashAttention, PagedAttention, AWQ/GPTQ).
  • Strong Kubernetes and Helm experience across managed and self-hosted clusters (OpenShift, EKS, AKS, GKE, bare metal).
  • Experience with LLM gateways/routing (LiteLLM or equivalent) and observability tooling (Langfuse, Grafana, OTel, Prometheus).
  • Solid scripting/automation skills (Python) for building eval harnesses and benchmarking pipelines.
  • Familiarity with model lifecycle management - versioning, canary rollouts, and rollback strategies.

Soft Skills

  • Strong ownership mentality - comfortable being the sole owner of a critical, customer-facing system.
  • Able to work independently in constrained, air-gapped, or highly regulated environments.
  • Clear communicator who can translate infrastructure decisions into customer-facing runbooks and dashboards.
  • Structured, benchmark-driven approach to performance and cost optimization.

Nice to Have / Advantage

  • Experience with AMD GPU architectures (ROCm/MI300X) alongside NVIDIA.
  • Background in speculative decoding or advanced inference-serving research.
  • Prior experience in security-sensitive or telecom/service-provider environments.
  • Experience standing up BYOC (Bring Your Own Cloud) deployment models for enterprise customers.

If your experience is close but doesn't fulfil all requirements, please submit your application. DriveNets is on a mission to build a special company comprised of individuals with different backgrounds, perspectives, and experiences.

DriveNets is an equal opportunity employer. We do not discriminate based on upon race, religion, national origin, sexual orientation, gender identity, gender expression, age, status as a protected veteran, status as an individual with disability, or other applicable legally protected characteristics.

More About DriveNets

Based In Israel With Extended Teams Located In The US, Japan, And Romania, DriveNets Operations Cover More Than Twelve Countries Globally. Powering Production Networks For Global Tier-1 Operators, DriveNets Is a Leader In Large-scale Networking Solutions For AI Infrastructure And Service Providers. Visit Our Website To Learn More

https://drivenets.com/company/


במקום לעבור לבד על אלפי מודעות, Jobify מנתחת את קורות החיים שלך ומציגה לך רק משרות שבאמת מתאימות לך.

מעל 80,000 משרות • 4,000 חדשות ביום
חינם. בלי פרסומות. בלי אותיות קטנות.

שאלות ותשובות עבור משרת Senior AI Ops Engineer

לתפקיד Senior AI Ops Engineer ב-DriveNets נדרש ניסיון מעשי בהרצת הסקת LLM בקנה מידה גדול (vLLM או דומה) בסביבת ייצור. כמו כן, נדרש ידע מעמיק ב-GPU, כולל CUDA, NCCL, טופולוגיות מרובות GPU וכוונון קוונטיזציה, יחד עם ניסיון חזק ב-Kubernetes ו-Helm על פני אשכולות מנוהלים ומתארחים עצמית.

מהנדס Senior AI Ops Engineer ב-DriveNets אחראי על אופטימיזציה מקצה לקצה של ביצועי ההסקה, כולל אצווה, מקביליות טנסור/צינור, וקאשינג, כמו גם קוונטיזציה וכוונון ספציפי לחומרה. בנוסף, הוא מנהל את מחזור חיי המודל, כולל רישום, פריסות קנריות, ספרי הפעלה לשדרוג/שחזור ובנצ'מרקינג של מודלים חדשים מול עומסי העבודה של החברה.

עבור Senior AI Ops Engineer ב-DriveNets, כישורים רכים חיוניים כוללים מנטליות בעלות חזקה, יכולת לעבוד באופן עצמאי בסביבות מוגבלות או מוסדרות מאוד, ויכולת תקשורת ברורה לתרגום החלטות תשתית לספרי הפעלה ולוחות מחוונים מול לקוחות. גישה מובנית ומבוססת בנצ'מרקים לאופטימיזציה של ביצועים ועלויות היא גם קריטית.

לכל המשרות של Senior AI DevOps Engineer

ניתן לצפות במשרות שסימנת בכל שלב תחת התפריט הראשי בקטגוריית 'משרות שאהבתי'

המקום קרן עזריאלי טקסט בעברית עם סמל אינסוף
  • מי אנחנו
  • מעסיקים מובילים
  • צרו קשר
  • תנאי שימוש
  • מדיניות פרטיות
  • הצהרת נגישות

2026 Ⓒ ג'וביפיי - כל הזכויות שמורות

קרן עזריאלי טקסט בעברית עם סמל אינסוף social_security the_israeli_employment_service israel_innovation_authority work_office המקום
המערכת בונה את הפרופיל התעסוקתי שלך

עוד רגע...

המערכת זיהתה ששינית את הנתונים באזור האישי ומעדכנת את ההמלצות על תפקידים ומשרות בהתאם.

מצטערים, לא הצלחנו לנתח בהצלחה את הנתונים שהזנת.
אתם מוזמנים לנסות להזין שוב או להעלות קובץ קורות חיים במידה ויש לכם.
בהצלחה

הגעת להגבלה היומית של שלושה עדכונים בפרופיל האישי ביום

loader

הבקשה שלך נשלחה בהצלחה!

יש באפשרותך לשלוח בקשה לקבלת ייעוץ אישי ללא עלות מיועצת קריירה.

באפשרותך לשלוח בקשה לקבלת ייעוץ אישי ללא עלות

  • בעיה טכנית

  • סיוע בכתיבת קורות חיים או בהכנה לראיון עבודה

  • התאמה של משרות

  • אחר:

פנייתך נשלחה בהצלחה. נציג מטעם ארגון נכי צהל ייצור איתך קשר בהקדם