jobify_logo ×
  • מִשׁתַמֵשׁ
  • התחברות/הרשמה
  • עמוד הבית
  • מי אנחנו
  • מעסיקים מובילים
  • פרסום משרה חינם
  • צרו קשר
  • תנאי שימוש
  • מדיניות פרטיות
  • הצהרת נגישות
קרן עזריאלי טקסט בעברית עם סמל אינסוף social_security the_israeli_employment_service work_office המקום
jobify_logo
  • מי אנחנו
  • מעסיקים מובילים
  • פרסום משרה חינם
  • צרו קשר
דילוג לתוכן

עדיין מחפשים עבודה במנועי חיפוש? הגיע הזמן להשתדרג!

במקום לעבור לבד על אלפי מודעות, Jobify מנתחת את קורות החיים שלך ומציגה לך רק משרות שבאמת מתאימות לך.

מעל 80,000 משרות • 4,000 חדשות ביום
חינם. בלי פרסומות. בלי אותיות קטנות.

Senior AI Evaluation & Reliability Engineer (Agents & LLM Systems)

Keewano

Keewano Keewano

  • תל אביב - יפו
  • LinkedIn
LinkedIn

Senior AI Evaluation & Reliability Engineer (Agents & LLM Systems)

Keewano

Keewano Keewano

  • תל אביב - יפו
  • bag_icon מלאה
  • coins_icon 22,000-32,000 ₪ הערכה מבוססת AI ולא שכר שהתקבל מהמעסיק
    הערכה מבוססת AI ולא שכר של המעסיק
  • LinkedIn
LinkedIn


We are building Keewano AI Agent — a next-generation agentic analytics platform powered by KeewanoDB, the first real-time database optimized for AI agents at scale.

We are looking for a Senior AI Evaluation & Reliability Engineer to define and build how AI agents are measured, validated, and improved in production. This role sits at the intersection of AI systems, data, and engineering, combining evaluation research with production-grade systems.

You will design evaluation methodologies, build LLM-as-a-judge systems, and develop agent-based testing frameworks to ensure correctness, robustness, and reliability of complex multi-agent workflows operating on real-time data.

What You’ll Do
  • Design and implement evaluation frameworks for AI agents and multi-agent systems
  • Build LLM-as-a-judge pipelines to evaluate correctness, reasoning, and output quality
  • Develop agent-based evaluation systems (agents evaluating agents)
  • Define metrics, benchmarks, and methodologies for agent performance and reliability
  • Build data-driven evaluation pipelines, including synthetic and real-world datasets
  • Analyze failure modes, edge cases, and non-deterministic behaviors
  • Improve agent reliability, robustness, and consistency in production
  • Work with tools such as Google ADK, Opik, and related evaluation frameworks
  • Collaborate closely with AI, platform, and database teams to shape agent–data interaction quality
What We’re Looking For
  • 4–8+ years of experience in software engineering, AI systems, or evaluation/QA engineering
  • Strong programming skills in Python
  • Hands-on experience working with LLMs in production environments
  • Experience building evaluation systems, automation frameworks, or testing infrastructure
  • Strong understanding of prompt engineering, tool use, and agent behavior
  • Ability to think in terms of metrics, correctness, and system reliability
Strong Plus
  • Experience with LLM evaluation frameworks (Opik, LangSmith, etc.)
  • Experience with Google ADK / agent frameworks
  • Experience implementing LLM-as-a-judge or ranking systems
  • Background in data systems, analytics, or real-time pipelines
  • Experience with multi-agent systems
  • Familiarity with statistical evaluation methods or experimentation (A/B testing, scoring systems)
Why Join Us
  • Define how AI agents are evaluated and made reliable in real-world systems
  • Work on cutting-edge problems in agent reasoning, correctness, and non-determinism
  • Operate at the intersection of LLMs, data infrastructure, and production systems
  • Build foundational evaluation and reliability infrastructure for agentic systems
  • Have direct impact on the quality and trustworthiness of next-generation AI systems


במקום לעבור לבד על אלפי מודעות, Jobify מנתחת את קורות החיים שלך ומציגה לך רק משרות שבאמת מתאימות לך.

מעל 80,000 משרות • 4,000 חדשות ביום
חינם. בלי פרסומות. בלי אותיות קטנות.

שאלות ותשובות עבור משרת Senior AI Evaluation & Reliability Engineer (Agents & LLM Systems)

כמהנדס/ת בכיר/ה להערכה ואמינות של AI ב-Keewano, תהיו אמונים על הגדרה ובנייה של הדרך שבה סוכני AI נמדדים, מאומתים ומשופרים בסביבת ייצור. התפקיד משלב מחקר הערכה עם מערכות ברמת ייצור, וכולל תכנון מתודולוגיות הערכה, בניית מערכות 'LLM כשופט' ופיתוח מסגרות בדיקה מבוססות סוכנים כדי להבטיח נכונות, חוסן ואמינות של תהליכי עבודה מורכבים מרובי סוכנים הפועלים על נתונים בזמן אמת.

לתפקיד זה ב-Keewano, אנו מחפשים מועמדים עם 4-8 שנות ניסיון בפיתוח תוכנה, מערכות AI או הנדסת הערכה/QA, עם כישורי תכנות חזקים ב-Python. נדרש ניסיון מעשי בעבודה עם LLMs בסביבות ייצור, בניית מערכות הערכה, מסגרות אוטומציה או תשתית בדיקות. הבנה חזקה של הנדסת פרומפטים, שימוש בכלים והתנהגות סוכנים, ויכולת לחשוב במונחים של מדדים, נכונות ואמינות מערכת הם קריטיים. ניסיון עם Google ADK, Opik או מסגרות הערכה דומות מהווה יתרון משמעותי.

מהנדס/ת בכיר/ה להערכה ואמינות של AI תורם/ת באופן ישיר לשיפור סוכני ה-AI על ידי עיצוב ויישום מסגרות הערכה למערכות סוכני AI ומערכות מרובות סוכנים. התפקיד כולל בניית צינורות 'LLM כשופט' להערכת נכונות, היגיון ואיכות פלט, ופיתוח מערכות הערכה מבוססות סוכנים (סוכנים המעריכים סוכנים אחרים). בנוסף, התפקיד אחראי על הגדרת מדדים, אמות מידה ומתודולוגיות לביצועים ואמינות של סוכנים, ניתוח מצבי כשל ושיפור אמינות, חוסן ועקביות של סוכנים בסביבת ייצור, ובכך מבטיח את איכות ואמינות הדור הבא של מערכות AI.

לכל המשרות של AI Reliability Engineer

ניתן לצפות במשרות שסימנת בכל שלב תחת התפריט הראשי בקטגוריית 'משרות שאהבתי'

המקום קרן עזריאלי טקסט בעברית עם סמל אינסוף
  • מי אנחנו
  • מעסיקים מובילים
  • צרו קשר
  • תנאי שימוש
  • מדיניות פרטיות
  • הצהרת נגישות

2026 Ⓒ ג'וביפיי - כל הזכויות שמורות

קרן עזריאלי טקסט בעברית עם סמל אינסוף social_security the_israeli_employment_service israel_innovation_authority work_office המקום
המערכת בונה את הפרופיל התעסוקתי שלך

עוד רגע...

המערכת זיהתה ששינית את הנתונים באזור האישי ומעדכנת את ההמלצות על תפקידים ומשרות בהתאם.

מצטערים, לא הצלחנו לנתח בהצלחה את הנתונים שהזנת.
אתם מוזמנים לנסות להזין שוב או להעלות קובץ קורות חיים במידה ויש לכם.
בהצלחה

הגעת להגבלה היומית של שלושה עדכונים בפרופיל האישי ביום

loader

הבקשה שלך נשלחה בהצלחה!

יש באפשרותך לשלוח בקשה לקבלת ייעוץ אישי ללא עלות מיועצת קריירה.

באפשרותך לשלוח בקשה לקבלת ייעוץ אישי ללא עלות

  • בעיה טכנית

  • סיוע בכתיבת קורות חיים או בהכנה לראיון עבודה

  • התאמה של משרות

  • אחר:

פנייתך נשלחה בהצלחה. נציג מטעם ארגון נכי צהל ייצור איתך קשר בהקדם