אשדוד · ישראל

עמרי אלחריזי

‏System Administrator · תשתיות ואוטומציה · בדרך ל־DevOps

שלוש שנים בסביבה מבצעית — טכנאי מערכות וראש צוות טכנאים, לצד ניהול תשתיות ‏Windows ו־Linux: ‏Active Directory, ‏VMware vSphere, אחסון ארגוני ואבטחת קצה, בתמיכה במאות משתמשים תחת יעדי SLA. היום גם פיתוח Frontend במילואים, ובבית מעבדת Proxmox עם 15 שירותים ו־GPU במעבר ישיר. כמעט שש שנים במקביל של מידול והדפסת תלת־ממד לימדו אותי את אותו דבר שהתשתית מלמדת: לתכנן לסובלנות, ולצפות לכשל.

100lobehub
101ollama·gpu
102jellyfin·gpu
103overseerr
104homarr
105sonarr
106qbittorrent
107radarr
108flaresolverr
109prowlarr
110bambuddy
111bazarr
112docker
113homeassistant
114n8n
‏pve · single node · 15 LXC
U1 ניסיון מקצועי

שלוש שנים בסביבה שאסור לה ליפול

פיתוח Frontend ותשתיות · שירות מילואים

היום אפריל 2026 —
טייסת תחזוקה · פיתוח צד־לקוח במקביל להמשך התפקיד מהשירות הסדיר
  • בניית ממשקים ב־HTML ו־CSS — עיצוב מחדש של מסכים למערכת פנימית שנמצאת בשימוש יומיומי.
  • הוספת סקריפטים לאינטראקטיביות: ולידציה, זרימות עבודה קצרות יותר ופחות קליקים במשימות שחוזרות כל יום.
  • עבודה מול משתמשי קצה אמיתיים — לקחת משוב ממי שמשתמש בזה בפועל, ולתרגם אותו לשינוי בממשק.
  • במקביל: המשך אחריות על התפקיד הטכני שמילאתי בשירות הסדיר.

טכנאי מערכות · ראש צוות טכנאים · שירות סדיר

אוגוסט 2023 — אפריל 2026
טייסת תחזוקה · חיל האוויר · סביבה מבצעית רב־אתרית
  • ראש צוות טכנאים — הובלת צוות, חלוקת משימות, והכשרת טכנאים חדשים בסביבה שבה טעות עולה ביוקר.
  • טכנאי מערכת קלע דוד — תחזוקה ותפעול של מערכת מבצעית בזמינות מלאה.
  • קורס בודק — הסמכה לבדיקה ואישור תקינות של מערכות לפני החזרה לכשירות מבצעית.
  • ניהול חשבונות משתמש והרשאות ב־Active Directory, כולל אוטומציה של איפוס סיסמאות ותהליכי הענקת גישה.
  • תחזוקה ותמיכה בשרתי Windows Server 2012/2016 ובסביבות שרתי Linux.
  • ניהול והפעלה של שרתים מרוחקים דרך SSH וממשקי ניהול מבוססי web.
  • ניטור ותמיכה בסביבות וירטואליות באמצעות VMware vSphere.
  • תמיכה בתשתית אחסון ארגוני (IBM Storage) — אבחון תקלות וניהול גישה.
  • יישום וניהול מדיניות אבטחת קצה עם McAfee ePO (Trellix).
  • מתן תמיכה טכנית למאות משתמשים במספר אתרים תוך עמידה ביעדי SLA.
  • אבחון תקלות חומרה, תוכנה ורשת בסביבת זמינות גבוהה.
ותק בשירות סדיר
‏2 שנים 8 חודשים
אחריות
ראש צוות
משתמשי קצה
מאות
זמינות
High Availability
עמידה ביעדים
SLA

homelab-as-code

github.com/OmriTGM
המעבדה שלי כקוד — הקצאה, קונפיגורציה וניטור בריפו אחד

‏Terraform מקצה את הקונטיינרים ממפת דאטה אחת, ‏Ansible מגדיר אותם, ו־exporter שכתבתי מפרסם את מצבם ל־Prometheus. שלושתם ביחד כי הם סוגרים לולאה: אותה מפה שיוצרת קונטיינר היא זו שה־exporter מתייג בה מטריקות.

שכבת ניתוח
‏23 טסטים
‏CI
4 jobs · green
החלטות מתועדות
‏5 ADRs
סודות בהיסטוריה
0
TerraformAnsible PrometheusPython GitHub Actionssystemd

סיווג דואר נכנס עם מודל שרץ אצלי בבית

n8n · Ollama · self-hosted
אוטומציה בייצור על המעבדה — בלי API בתשלום, בלי דאטה שיוצא החוצה
  • ‏n8n בקונטיינר משלו מושך מיילים, שולח נושא וגוף ל־LLM מקומי על ה־RTX 3060, ומחיל תווית לפי הקטגוריה שחזרה.
  • ‏Backfill ואז מצב רציף — קודם ריצה חד־פעמית שסיווגה את הארכיון הקיים, אחריה טריגר מחזורי לכל מייל חדש.
  • עמידות לכשל — ‏retry עם השהיה, ‏batching כדי לא להטביע את ה־GPU, ו־continueOnError כדי שמייל אחד שנכשל לא יפיל את הריצה.
  • ‏Watchdog ב־cron בודק /healthz כל 5 דקות ומרים את השירות אם הוא תקוע, לצד Restart=always ב־systemd.
  • ‏OAuth בלי לחשוף פורט — ראו את התקלה על ספק הזהות למטה. זה היה החלק הקשה.
מיילים שסווגו
‏~300
עלות ל־API
‏0 ₪
פורטים חשופים
0
מצב
running
n8nOllama systemdcron OAuth2SQLite
U2 מעבדת הבית — הפרויקט האישי

‏Proxmox VE, ‏15 שירותים, ‏GPU במעבר ישיר

סביבה שבניתי מאפס ואני מתחזק בפועל: כל שירות מבודד ב־LXC משלו, גיבוי מתוזמן, ניטור SMART, ו־reverse proxy. כאן אני מנסה דברים שאי אפשר לנסות בייצור.

וירטואליזציה
Proxmox VE 9‏15 קונטיינרים · צומת יחיד
מעבד וזיכרון
12C / 46GBניצולת ~15% במנוחה
מאיץ
RTX 3060‏12GB · passthrough ל־LXC
אחסון
1.8TB + SSD‏SMART · vzdump שבועי
אינפרנס מקומי
0 tok/s‏Ollama · 9.6GB VRAM
U3 תקלות שפתרתי — סיבת שורש, לא עקיפה

מה נשבר, ואיך ירדתי לשורש

כל אחת מאלה עלתה לי שעות. זה החלק שבו באמת למדתי משהו.

GPU

המודל רץ, אבל על המעבד — ה־GPU נשאר ריק

תסמין

‏Ollama דיווח size_vram: 0 וההסקה זחלה. הכרטיס היה גלוי בקונטיינר, אז זו לא הייתה בעיית passthrough.

סיבת שורש

אי־התאמת גרסאות בין דרייבר הליבה במארח לבין ה־userland בקונטיינר. מאגר ההפצה פיגר אחרי המארח, ו־CUDA סירבה לאתחל בשקט.

תוצאה

מתקין היצרן בתוך הקונטיינר עם --no-kernel-module נעוץ לגרסת המארח.
0 → 34 tok/s

Storage

טעינת מודל של דקתיים בכל בקשה קרה

תסמין

אחרי חוסר פעילות, הבקשה הראשונה חיכתה ~125 שניות. אחרי החימום — מהיר.

סיבת שורש

מערכת הקבצים של הקונטיינר ישבה על הדיסק המכני. קריאת ‏9.6GB משקלים בטעינה קרה נחסמה ע״י ה־I/O, לא ע״י ה־GPU.

תוצאה

העברת ה־rootfs ל־local-lvm על SSD.
125s → 22s

Filesystem

העתקה של 76GB במקום קישור מיידי

תסמין

בדיקת התקינות התריעה שספריית ההורדות לא קיימת, וייבוא קבצים גדולים לקח נצח.

סיבת שורש

הנתיב נראה זהה משני הצדדים אך הצביע על נקודות עגינה שונות. ‏hardlink בין מערכות קבצים שונות בלתי אפשרי — אז המערכת נפלה חזרה להעתקה מלאה.

תוצאה

יישור נקודות העגינה לנתיב אחד בין הקונטיינרים.
copy → hardlink

Containers

עגינה שהסתירה את בסיס הנתונים של האימג׳

תסמין

השירות עלה ומיד נפל: ״בסיס הנתונים לא נמצא״ — למרות שהוא ארוז בתוך האימג׳.

סיבת שורש

‏volume ריק עוגן בדיוק על הספרייה שהכילה את בסיס הנתונים המובנה והסתיר אותו. הרגל של ״תמיד לשמר דאטה״ — במקום הלא נכון.

תוצאה

הסרת העגינה המיותרת ויצירה מחדש של הקונטיינר.
crash-loop → healthy

Identity

‏OAuth מול שירות שרץ ברשת פרטית

תסמין

ספק הזהות דחה את כתובת ההחזרה: הוא לא מקבל כתובות IP פרטיות ודורש HTTPS.

סיבת שורש

השירות בנה את כתובת ההחזרה מהשם המוגדר שלו. בנוסף, עוגיית ההתחברות הייתה קשורה למקור אחר מזה שאליו חזר ה־callback.

תוצאה

מנהור SSH כך שהממשק וה־callback ישבו על אותו מקור מקומי — בלי לחשוף פורט לאינטרנט.
0 ports exposed

U4 תלת־ממד · כמעט שש שנים

מידול והדפסה — איפה למדתי לתכנן לכשל

כמעט שש שנים, ובלי הפסקה — גם לאורך כל השירות. זה לא תחביב של ״ללחוץ הדפס״: עיקר העומק שלי הוא בצד המכונה — קונפיגורציית קושחה, כיול, וניפוי כשלים חוזרים. אותה מתודולוגיה בדיוק שאני מפעיל על שרת.

U5 כישורים

הכלים שאני עובד איתם

תשתיות

Windows Server 2012/2016Linux (Ubuntu) Active DirectoryVMware vSphere Proxmox VEIBM Storage

רשתות

TCP/IPLAN Troubleshooting SSHPuTTY

אבטחה

McAfee ePO (Trellix)Endpoint Management

קונטיינרים ואוטומציה

DockerDocker Compose PortainerBash Pythonn8n TerraformAnsible PrometheusGitHub Actions

‏Frontend

HTMLCSS JavaScriptGit

תלת־ממד

TinkercadKlipper MMUG-code
U6 לאן אני מכוון

מה אני בונה עכשיו, ולמה

בעבודה

‏Infrastructure as Code

להעביר את מה שבניתי בידיים לקוד מגורסה — כדי שהסביבה תהיה ניתנת לשחזור, לא לשחזור מהזיכרון.

בהכשרה

‏AWS Solutions Architect

אותם עקרונות — רשת, זהות, עמידות — בקנה מידה של ענן.

בכיוון

תצפיתיות ו־CI/CD

מדדים, התראות ופריסה אוטומטית. לדעת שמשהו נשבר לפני שמישהו מתלונן.

היתרון שלי

שתי הקצוות של אותה מערכת

אני מתחזק את השרת וגם כותב את הממשק שמדבר איתו. בצוות קטן זה אומר פחות העברות ידיים.

U7 השכלה ושפות

רקע

2026 · In Progress

‏DevOps Digital

מכללת איקום

2021 — 2023

הנדסאי אלקטרוניקה ומחשבים

המכללה הטכנולוגית מקיף א׳, אשדוד

התמחויות

רשתות מחשבים ומערכות תקשורת

מעבדות אלקטרוניקה · פרויקטי Arduino ו־Raspberry Pi

שפות

עברית — שפת אם · אנגלית — שוטפת

תיעוד טכני, ספקים ותמיכה באנגלית

מחפש תפקיד שבו התשתית היא העבודה

‏DevOps, ‏System Administration, ‏NOC או תשתיות IT — צוות שבו אני יכול לבנות, לשבור בסביבה מבוקרת, ולתקן עד סיבת השורש. אשמח לדבר.