בקשת מידע | תיכנות ב AI עד כמה ?
-
@יוסף-הכהן בוא נתחיל מההתחלה.
אף אחד לא הולך לקרוא את השטויות של ג׳מיני.
תכתוב בכמה מילים מה אתה רוצה.
לגבי שאלותך.
1 - אין כזה דבר מושלם. גם מתכנת הכי טוב - יהיו באגים.
2 - תוי ברמת הפרוייקט. באופן עקרוני מעטים ההצלחות של חסרי ידע.
3 - זה תלוי מה הפרוייקט, וכמה אתה מוכן לשלם.
ai כיום הוא לא חינם.
בקיצור - פרט על הפרוייקט בעצמך.
ואז נוכל לעזור לך
בהצלחה.@יוסף-הכהן בוא נתחיל מההתחלה.
אף אחד לא הולך לקרוא את השטויות של ג׳מיני.פרנציפ קראתי הכל, וגמיני מסכם בצורה נפלאה.

@יוסף-הכהן לשאלתך אם הוא ממש בלי ידע, לכאו' לא יצליח, זה התממשקות עם מגוון מערכות.
-
@יוסף-הכהן בוא נתחיל מההתחלה.
אף אחד לא הולך לקרוא את השטויות של ג׳מיני.פרנציפ קראתי הכל, וגמיני מסכם בצורה נפלאה.

@יוסף-הכהן לשאלתך אם הוא ממש בלי ידע, לכאו' לא יצליח, זה התממשקות עם מגוון מערכות.
-
שלום אני עובד לאחרונה על איזה פרויקט בעסק, ואני פניתי לכמה מתכנתים להצעת מחיר וזה היה סכום די גבוה
ומצאתי איזה חבר שיש לו ממש ידע בסיסי בתיכנות והוא טוען שנראה לו שהוא יוכל לבנות את עם AI במחיר מוזל..1 האם זה מציאותי שאפשר לבנות כזה פרויקט בAI בלי הרבה ידע ושיצא מושלם בלי באגים או שחבל על הכסף?
2 והאם זה כזה קל שגם מישהו כמוני שאין לו בכלל ידע יכול לבנות כזה דבר ?
3 איזה כלי הכי יעיל בשביל זה?
הפריקט בספוילר:
נערך ע"י ג'ימיני
מטרת העל
בניית מערכת אוטומטית מקצה לקצה שמקבלת הקלטות שיחה של נציגות, מחלצת מהן מספר משתנה של שמות (במבנה שורות דינמי), מאפשרת הזנת תשובות ידנית לכל שם, ומחזירה ללקוח הודעה קולית אחת מאוחדת (TTS) ו-SMS דרך מערכת ימות המשיח.- ארכיטקטורת זרימת הנתונים (Workflow)
[שיחה מוקלטת] ◄─── [תמלול STT] ◄─── [חילוץ שמות ב-AI]
│
▼
[שליחת קובץ מאוחד + SMS] ◄─── [הזנת תשובות ואישור] ◄─── [גוגל שיטס (שורות דינמיות)] - שלבי הפיתוח הנדרשים
שלב א': קליטת שיחה וחילוץ שמות (Ingestion & Extraction)
קלט: קובץ שמע של שיחה מוקלטת (יוזרם למערכת דרך Webhook או API של מערכת הטלפוניה).
תמלול (STT): תמלול הקובץ באמצעות מנוע ייעודי (למשל OpenAI Whisper).
חילוץ שמות בעזרת AI:
זיהוי מספר הטלפון של הלקוח ומזהה השיחה הייחודי (Call ID).
חילוץ כל השמות הפרטיים ושמות האמהות שנמסרו בשיחה (הכמות משתנה: בין שם 1 ל-8 שמות או יותר).
דגש פונטיקה: על ה-AI להפיק את השמות בפורמט מנוקד במלואו (למשל: חַנָּה או מֹשֶׁה) כדי להבטיח הגייה מדויקת בשלב ההקראה החוזרת.
️ שלב ב': בסיס הנתונים (Google Sheets - מבנה שורות דינמי)
כדי לתמוך בכמות משתנה של שמות ללא הגבלת עמודות, המערכת תייצר שורה נפרדת עבור כל שם שחולץ, כאשר השורות מקושרות באמצעות מזהה שיחה אחיד (Call ID).דוגמה למבנה הטבלה לאחר חילוץ שיחה עם 3 שמות:
מזהה שיחה (Call ID) טלפון לקוח שם (מנוקד ע"י ה-AI) תשובה (הזנה ידנית) סטטוס שורה סטטוס שליחה כללי
98765 050-1234567 מֹשֶׁה בֶּן שָׂרָה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 שָׂרָה בַּת חַנָּה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 דָּוִד בֶּן רִבְקָה [הקלד תשובה] ממתין טיוטה
תהליך העבודה של המנהל: המנהל עובר שורה-שורה ומקליד את התשובה המתאימה לכל שם.טריגר השליחה: ברגע שהמנהל מסיים להזין את כל התשובות עבור אותו Call ID, הוא משנה את הסטטוס בעמודה "סטטוס שליחה כללי" ל-"שלח" (נדרש שהשינוי יחול על כל השורות בעלות אותו מזהה, או באמצעות כפתור ייעודי/סנכרון של השורה האחרונה).
שלב ג': יצירת השמע ואיחוד הקבצים (Audio Concatenation)
כדי לחסוך בעלויות TTS (טוקנים) ולשמור על איכות שמע טבעית לחלוטין, יש לבצע תהליך הלחמה (Concatenation) בשרת:קבצי קישור קבועים (סטטיים): הקלטות קוליות מוכנות מראש שישולבו ברצף (למשל: "שלום, להלן התשובות...", "עבור השם...", "התשובה היא...").
קבצי תוכן דינמיים: יצירת קבצי שמע קצרים ב-AI (כמו ElevenLabs) רק עבור השמות המנוקדים והתשובות שנכתבו.
הלחמה בשרת: שימוש בכלי כמו FFmpeg לחיבור כל הקטעים לקובץ MP3 אחד רציף.
דרישות סאונד: החיבור יבוצע עם Crossfade קצרצר (כמה מילי-שניות) ומרווחי שקט קטנים (Room Tone) בין המשפטים למניעת אפקט של קול קטוע או רובוטי.
שלב ד': הפצה דרך "ימות המשיח" (Delivery)
ברגע שהופעל טריגר השליחה ל-Call ID ספציפי:בניית קובץ השמע המאוחד: המערכת תרכז את כל השורות של אותו Call ID ותייצר קובץ הקראה שלם (לדוגמה: "עבור משה בן שרה - [תשובה 1]... ועבור שרה בת חנה - [תשובה 2]...").
העלאה לטלפוניה: קובץ ה-MP3 המאוחד יועלה באמצעות ה-API של ימות המשיח לתיקיית ההודעות האישית של הלקוח (מזוהה לפי מספר הטלפון שלו).
צינתוק (חיוג וניתוק): שליחת פקודת API לימות המשיח לביצוע צינתוק לטלפון הלקוח כדי לסמן לו שיש הודעה מחכה.
הודעת SMS: שליחת הודעת SMS ללקוח המרכזת את התשובות הכתובות.
עדכון סטטוס: שינוי אוטומטי של עמודת "סטטוס שליחה כללי" בגוגל שיטס ל-"נשלח בהצלחה".
️ טכנולוגיות מוצעות
כלי אוטומציה / שרת: Make.com (או שרת עצמאי ב-Node.js/Python).תמלול ועיבוד שמות: OpenAI API (Whisper + GPT-4o).
מנוע קול דינמי (TTS): ElevenLabs API.
ניהול שמע: ספריית FFmpeg (לחיבור קבצי השמע).
טלפוניה וסלולר: API של ימות המשיח.
[תמלול STT]
יש לך הרבה תקציב?
כי התמלול לבד יעלה לך הרבה (בג'ימיני לפחות - יש חברות אחרות).
- ארכיטקטורת זרימת הנתונים (Workflow)
-
א. לפי דעתי AI יכול לבנות דבר מושלם באופן יחסי וגם אם תמצא באגים הוא ידע לתקן במיוחד אם בבניה אתה מבקש שיצור עם לוגים
ב.זה לא קל שתצליח לעשות לבד
ג.אני מחזיק מקלאוד אבל גם קודקס טוב לקידוד עצמו אבל לתוכנית עבודה וכו' אני חושב שגמיני הכי טוב
אני מדבר על הבנייה עצמה בנוגע לכלים בהפעלה זה כבר נושא אחר
אם אתה רוצה אני יכול לבנות בתשלום
-
שלום אני עובד לאחרונה על איזה פרויקט בעסק, ואני פניתי לכמה מתכנתים להצעת מחיר וזה היה סכום די גבוה
ומצאתי איזה חבר שיש לו ממש ידע בסיסי בתיכנות והוא טוען שנראה לו שהוא יוכל לבנות את עם AI במחיר מוזל..1 האם זה מציאותי שאפשר לבנות כזה פרויקט בAI בלי הרבה ידע ושיצא מושלם בלי באגים או שחבל על הכסף?
2 והאם זה כזה קל שגם מישהו כמוני שאין לו בכלל ידע יכול לבנות כזה דבר ?
3 איזה כלי הכי יעיל בשביל זה?
הפריקט בספוילר:
נערך ע"י ג'ימיני
מטרת העל
בניית מערכת אוטומטית מקצה לקצה שמקבלת הקלטות שיחה של נציגות, מחלצת מהן מספר משתנה של שמות (במבנה שורות דינמי), מאפשרת הזנת תשובות ידנית לכל שם, ומחזירה ללקוח הודעה קולית אחת מאוחדת (TTS) ו-SMS דרך מערכת ימות המשיח.- ארכיטקטורת זרימת הנתונים (Workflow)
[שיחה מוקלטת] ◄─── [תמלול STT] ◄─── [חילוץ שמות ב-AI]
│
▼
[שליחת קובץ מאוחד + SMS] ◄─── [הזנת תשובות ואישור] ◄─── [גוגל שיטס (שורות דינמיות)] - שלבי הפיתוח הנדרשים
שלב א': קליטת שיחה וחילוץ שמות (Ingestion & Extraction)
קלט: קובץ שמע של שיחה מוקלטת (יוזרם למערכת דרך Webhook או API של מערכת הטלפוניה).
תמלול (STT): תמלול הקובץ באמצעות מנוע ייעודי (למשל OpenAI Whisper).
חילוץ שמות בעזרת AI:
זיהוי מספר הטלפון של הלקוח ומזהה השיחה הייחודי (Call ID).
חילוץ כל השמות הפרטיים ושמות האמהות שנמסרו בשיחה (הכמות משתנה: בין שם 1 ל-8 שמות או יותר).
דגש פונטיקה: על ה-AI להפיק את השמות בפורמט מנוקד במלואו (למשל: חַנָּה או מֹשֶׁה) כדי להבטיח הגייה מדויקת בשלב ההקראה החוזרת.
️ שלב ב': בסיס הנתונים (Google Sheets - מבנה שורות דינמי)
כדי לתמוך בכמות משתנה של שמות ללא הגבלת עמודות, המערכת תייצר שורה נפרדת עבור כל שם שחולץ, כאשר השורות מקושרות באמצעות מזהה שיחה אחיד (Call ID).דוגמה למבנה הטבלה לאחר חילוץ שיחה עם 3 שמות:
מזהה שיחה (Call ID) טלפון לקוח שם (מנוקד ע"י ה-AI) תשובה (הזנה ידנית) סטטוס שורה סטטוס שליחה כללי
98765 050-1234567 מֹשֶׁה בֶּן שָׂרָה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 שָׂרָה בַּת חַנָּה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 דָּוִד בֶּן רִבְקָה [הקלד תשובה] ממתין טיוטה
תהליך העבודה של המנהל: המנהל עובר שורה-שורה ומקליד את התשובה המתאימה לכל שם.טריגר השליחה: ברגע שהמנהל מסיים להזין את כל התשובות עבור אותו Call ID, הוא משנה את הסטטוס בעמודה "סטטוס שליחה כללי" ל-"שלח" (נדרש שהשינוי יחול על כל השורות בעלות אותו מזהה, או באמצעות כפתור ייעודי/סנכרון של השורה האחרונה).
שלב ג': יצירת השמע ואיחוד הקבצים (Audio Concatenation)
כדי לחסוך בעלויות TTS (טוקנים) ולשמור על איכות שמע טבעית לחלוטין, יש לבצע תהליך הלחמה (Concatenation) בשרת:קבצי קישור קבועים (סטטיים): הקלטות קוליות מוכנות מראש שישולבו ברצף (למשל: "שלום, להלן התשובות...", "עבור השם...", "התשובה היא...").
קבצי תוכן דינמיים: יצירת קבצי שמע קצרים ב-AI (כמו ElevenLabs) רק עבור השמות המנוקדים והתשובות שנכתבו.
הלחמה בשרת: שימוש בכלי כמו FFmpeg לחיבור כל הקטעים לקובץ MP3 אחד רציף.
דרישות סאונד: החיבור יבוצע עם Crossfade קצרצר (כמה מילי-שניות) ומרווחי שקט קטנים (Room Tone) בין המשפטים למניעת אפקט של קול קטוע או רובוטי.
שלב ד': הפצה דרך "ימות המשיח" (Delivery)
ברגע שהופעל טריגר השליחה ל-Call ID ספציפי:בניית קובץ השמע המאוחד: המערכת תרכז את כל השורות של אותו Call ID ותייצר קובץ הקראה שלם (לדוגמה: "עבור משה בן שרה - [תשובה 1]... ועבור שרה בת חנה - [תשובה 2]...").
העלאה לטלפוניה: קובץ ה-MP3 המאוחד יועלה באמצעות ה-API של ימות המשיח לתיקיית ההודעות האישית של הלקוח (מזוהה לפי מספר הטלפון שלו).
צינתוק (חיוג וניתוק): שליחת פקודת API לימות המשיח לביצוע צינתוק לטלפון הלקוח כדי לסמן לו שיש הודעה מחכה.
הודעת SMS: שליחת הודעת SMS ללקוח המרכזת את התשובות הכתובות.
עדכון סטטוס: שינוי אוטומטי של עמודת "סטטוס שליחה כללי" בגוגל שיטס ל-"נשלח בהצלחה".
️ טכנולוגיות מוצעות
כלי אוטומציה / שרת: Make.com (או שרת עצמאי ב-Node.js/Python).תמלול ועיבוד שמות: OpenAI API (Whisper + GPT-4o).
מנוע קול דינמי (TTS): ElevenLabs API.
ניהול שמע: ספריית FFmpeg (לחיבור קבצי השמע).
טלפוניה וסלולר: API של ימות המשיח.
@יוסף-הכהן תלוי מה רמת הידע הבסיסי שלך אם הוא יחסית טוב אז עם קלוד קוד וקצת למידה אתה יכול לעשות הכול אם אתה רוצה תוצאות מיד ובלי לעבוד קשה אז תלך למשהו במיוחד אם אתה עם מעמד תקציבי.
- ארכיטקטורת זרימת הנתונים (Workflow)
-
[תמלול STT]
יש לך הרבה תקציב?
כי התמלול לבד יעלה לך הרבה (בג'ימיני לפחות - יש חברות אחרות).
-
@מוקד-המערכות ממש לא, מציע קלוד,
-
@מוקד-המערכות ממש לא, מציע קלוד,
@הישבשר-המלומד מי שאמרתי לך, עשה את זה ובדקתי במערכת שלו, וזה עובד טוב מאוד.
-
@הישבשר-המלומד מי שאמרתי לך, עשה את זה ובדקתי במערכת שלו, וזה עובד טוב מאוד.
@מוקד-המערכות לא סותר.
-
@מוקד-המערכות לא סותר.
@הישבשר-המלומד אז למה אתה אומר שזה לא טוב?
-
שלום אני עובד לאחרונה על איזה פרויקט בעסק, ואני פניתי לכמה מתכנתים להצעת מחיר וזה היה סכום די גבוה
ומצאתי איזה חבר שיש לו ממש ידע בסיסי בתיכנות והוא טוען שנראה לו שהוא יוכל לבנות את עם AI במחיר מוזל..1 האם זה מציאותי שאפשר לבנות כזה פרויקט בAI בלי הרבה ידע ושיצא מושלם בלי באגים או שחבל על הכסף?
2 והאם זה כזה קל שגם מישהו כמוני שאין לו בכלל ידע יכול לבנות כזה דבר ?
3 איזה כלי הכי יעיל בשביל זה?
הפריקט בספוילר:
נערך ע"י ג'ימיני
מטרת העל
בניית מערכת אוטומטית מקצה לקצה שמקבלת הקלטות שיחה של נציגות, מחלצת מהן מספר משתנה של שמות (במבנה שורות דינמי), מאפשרת הזנת תשובות ידנית לכל שם, ומחזירה ללקוח הודעה קולית אחת מאוחדת (TTS) ו-SMS דרך מערכת ימות המשיח.- ארכיטקטורת זרימת הנתונים (Workflow)
[שיחה מוקלטת] ◄─── [תמלול STT] ◄─── [חילוץ שמות ב-AI]
│
▼
[שליחת קובץ מאוחד + SMS] ◄─── [הזנת תשובות ואישור] ◄─── [גוגל שיטס (שורות דינמיות)] - שלבי הפיתוח הנדרשים
שלב א': קליטת שיחה וחילוץ שמות (Ingestion & Extraction)
קלט: קובץ שמע של שיחה מוקלטת (יוזרם למערכת דרך Webhook או API של מערכת הטלפוניה).
תמלול (STT): תמלול הקובץ באמצעות מנוע ייעודי (למשל OpenAI Whisper).
חילוץ שמות בעזרת AI:
זיהוי מספר הטלפון של הלקוח ומזהה השיחה הייחודי (Call ID).
חילוץ כל השמות הפרטיים ושמות האמהות שנמסרו בשיחה (הכמות משתנה: בין שם 1 ל-8 שמות או יותר).
דגש פונטיקה: על ה-AI להפיק את השמות בפורמט מנוקד במלואו (למשל: חַנָּה או מֹשֶׁה) כדי להבטיח הגייה מדויקת בשלב ההקראה החוזרת.
️ שלב ב': בסיס הנתונים (Google Sheets - מבנה שורות דינמי)
כדי לתמוך בכמות משתנה של שמות ללא הגבלת עמודות, המערכת תייצר שורה נפרדת עבור כל שם שחולץ, כאשר השורות מקושרות באמצעות מזהה שיחה אחיד (Call ID).דוגמה למבנה הטבלה לאחר חילוץ שיחה עם 3 שמות:
מזהה שיחה (Call ID) טלפון לקוח שם (מנוקד ע"י ה-AI) תשובה (הזנה ידנית) סטטוס שורה סטטוס שליחה כללי
98765 050-1234567 מֹשֶׁה בֶּן שָׂרָה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 שָׂרָה בַּת חַנָּה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 דָּוִד בֶּן רִבְקָה [הקלד תשובה] ממתין טיוטה
תהליך העבודה של המנהל: המנהל עובר שורה-שורה ומקליד את התשובה המתאימה לכל שם.טריגר השליחה: ברגע שהמנהל מסיים להזין את כל התשובות עבור אותו Call ID, הוא משנה את הסטטוס בעמודה "סטטוס שליחה כללי" ל-"שלח" (נדרש שהשינוי יחול על כל השורות בעלות אותו מזהה, או באמצעות כפתור ייעודי/סנכרון של השורה האחרונה).
שלב ג': יצירת השמע ואיחוד הקבצים (Audio Concatenation)
כדי לחסוך בעלויות TTS (טוקנים) ולשמור על איכות שמע טבעית לחלוטין, יש לבצע תהליך הלחמה (Concatenation) בשרת:קבצי קישור קבועים (סטטיים): הקלטות קוליות מוכנות מראש שישולבו ברצף (למשל: "שלום, להלן התשובות...", "עבור השם...", "התשובה היא...").
קבצי תוכן דינמיים: יצירת קבצי שמע קצרים ב-AI (כמו ElevenLabs) רק עבור השמות המנוקדים והתשובות שנכתבו.
הלחמה בשרת: שימוש בכלי כמו FFmpeg לחיבור כל הקטעים לקובץ MP3 אחד רציף.
דרישות סאונד: החיבור יבוצע עם Crossfade קצרצר (כמה מילי-שניות) ומרווחי שקט קטנים (Room Tone) בין המשפטים למניעת אפקט של קול קטוע או רובוטי.
שלב ד': הפצה דרך "ימות המשיח" (Delivery)
ברגע שהופעל טריגר השליחה ל-Call ID ספציפי:בניית קובץ השמע המאוחד: המערכת תרכז את כל השורות של אותו Call ID ותייצר קובץ הקראה שלם (לדוגמה: "עבור משה בן שרה - [תשובה 1]... ועבור שרה בת חנה - [תשובה 2]...").
העלאה לטלפוניה: קובץ ה-MP3 המאוחד יועלה באמצעות ה-API של ימות המשיח לתיקיית ההודעות האישית של הלקוח (מזוהה לפי מספר הטלפון שלו).
צינתוק (חיוג וניתוק): שליחת פקודת API לימות המשיח לביצוע צינתוק לטלפון הלקוח כדי לסמן לו שיש הודעה מחכה.
הודעת SMS: שליחת הודעת SMS ללקוח המרכזת את התשובות הכתובות.
עדכון סטטוס: שינוי אוטומטי של עמודת "סטטוס שליחה כללי" בגוגל שיטס ל-"נשלח בהצלחה".
️ טכנולוגיות מוצעות
כלי אוטומציה / שרת: Make.com (או שרת עצמאי ב-Node.js/Python).תמלול ועיבוד שמות: OpenAI API (Whisper + GPT-4o).
מנוע קול דינמי (TTS): ElevenLabs API.
ניהול שמע: ספריית FFmpeg (לחיבור קבצי השמע).
טלפוניה וסלולר: API של ימות המשיח.
@יוסף-הכהן אני מכיר מישהו שבנה מערכת לא פחות מורכבת מזה בAI, ללא שום ידע בתכנות
בסוף זה מאוד תלוי בבן אדם שכותב את הפרומפטים ויודע לבחור בארכיטקטורה נכונה וכו'.
אם הוא טוען שהוא יכול, שיציג לך מה שהא כבר עשה ואם זה מתקרב לסדר גודל הזה - ארכיטקטורת זרימת הנתונים (Workflow)
-
@הישבשר-המלומד אז למה אתה אומר שזה לא טוב?
@מוקד-המערכות לא אמרתי שהוא לא טוב אמרתי שמהניסיון שלי קלוד עושה עבודה ברמה אחרת...
-
@מוקד-המערכות לא אמרתי שהוא לא טוב אמרתי שמהניסיון שלי קלוד עושה עבודה ברמה אחרת...
@הישבשר-המלומד נראה לי שלא הבנת מה התכוונתי.
אני לא התכוונתי שיעשה את הפרוייקט בגרוק, אלא שיעשה STT (תמלול) בגרוק שם יש מכסה יותר גדולה.
-
@הישבשר-המלומד נראה לי שלא הבנת מה התכוונתי.
אני לא התכוונתי שיעשה את הפרוייקט בגרוק, אלא שיעשה STT (תמלול) בגרוק שם יש מכסה יותר גדולה.
@מוקד-המערכות אה אז אני לא מכיר אני מכיר מודל אופלין שיכול לרוץ על שרת אבל מודל ברמה אחרת ברמה של גימני'
-
שלום אני עובד לאחרונה על איזה פרויקט בעסק, ואני פניתי לכמה מתכנתים להצעת מחיר וזה היה סכום די גבוה
ומצאתי איזה חבר שיש לו ממש ידע בסיסי בתיכנות והוא טוען שנראה לו שהוא יוכל לבנות את עם AI במחיר מוזל..1 האם זה מציאותי שאפשר לבנות כזה פרויקט בAI בלי הרבה ידע ושיצא מושלם בלי באגים או שחבל על הכסף?
2 והאם זה כזה קל שגם מישהו כמוני שאין לו בכלל ידע יכול לבנות כזה דבר ?
3 איזה כלי הכי יעיל בשביל זה?
הפריקט בספוילר:
נערך ע"י ג'ימיני
מטרת העל
בניית מערכת אוטומטית מקצה לקצה שמקבלת הקלטות שיחה של נציגות, מחלצת מהן מספר משתנה של שמות (במבנה שורות דינמי), מאפשרת הזנת תשובות ידנית לכל שם, ומחזירה ללקוח הודעה קולית אחת מאוחדת (TTS) ו-SMS דרך מערכת ימות המשיח.- ארכיטקטורת זרימת הנתונים (Workflow)
[שיחה מוקלטת] ◄─── [תמלול STT] ◄─── [חילוץ שמות ב-AI]
│
▼
[שליחת קובץ מאוחד + SMS] ◄─── [הזנת תשובות ואישור] ◄─── [גוגל שיטס (שורות דינמיות)] - שלבי הפיתוח הנדרשים
שלב א': קליטת שיחה וחילוץ שמות (Ingestion & Extraction)
קלט: קובץ שמע של שיחה מוקלטת (יוזרם למערכת דרך Webhook או API של מערכת הטלפוניה).
תמלול (STT): תמלול הקובץ באמצעות מנוע ייעודי (למשל OpenAI Whisper).
חילוץ שמות בעזרת AI:
זיהוי מספר הטלפון של הלקוח ומזהה השיחה הייחודי (Call ID).
חילוץ כל השמות הפרטיים ושמות האמהות שנמסרו בשיחה (הכמות משתנה: בין שם 1 ל-8 שמות או יותר).
דגש פונטיקה: על ה-AI להפיק את השמות בפורמט מנוקד במלואו (למשל: חַנָּה או מֹשֶׁה) כדי להבטיח הגייה מדויקת בשלב ההקראה החוזרת.
️ שלב ב': בסיס הנתונים (Google Sheets - מבנה שורות דינמי)
כדי לתמוך בכמות משתנה של שמות ללא הגבלת עמודות, המערכת תייצר שורה נפרדת עבור כל שם שחולץ, כאשר השורות מקושרות באמצעות מזהה שיחה אחיד (Call ID).דוגמה למבנה הטבלה לאחר חילוץ שיחה עם 3 שמות:
מזהה שיחה (Call ID) טלפון לקוח שם (מנוקד ע"י ה-AI) תשובה (הזנה ידנית) סטטוס שורה סטטוס שליחה כללי
98765 050-1234567 מֹשֶׁה בֶּן שָׂרָה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 שָׂרָה בַּת חַנָּה [הקלד תשובה] ממתין טיוטה
98765 050-1234567 דָּוִד בֶּן רִבְקָה [הקלד תשובה] ממתין טיוטה
תהליך העבודה של המנהל: המנהל עובר שורה-שורה ומקליד את התשובה המתאימה לכל שם.טריגר השליחה: ברגע שהמנהל מסיים להזין את כל התשובות עבור אותו Call ID, הוא משנה את הסטטוס בעמודה "סטטוס שליחה כללי" ל-"שלח" (נדרש שהשינוי יחול על כל השורות בעלות אותו מזהה, או באמצעות כפתור ייעודי/סנכרון של השורה האחרונה).
שלב ג': יצירת השמע ואיחוד הקבצים (Audio Concatenation)
כדי לחסוך בעלויות TTS (טוקנים) ולשמור על איכות שמע טבעית לחלוטין, יש לבצע תהליך הלחמה (Concatenation) בשרת:קבצי קישור קבועים (סטטיים): הקלטות קוליות מוכנות מראש שישולבו ברצף (למשל: "שלום, להלן התשובות...", "עבור השם...", "התשובה היא...").
קבצי תוכן דינמיים: יצירת קבצי שמע קצרים ב-AI (כמו ElevenLabs) רק עבור השמות המנוקדים והתשובות שנכתבו.
הלחמה בשרת: שימוש בכלי כמו FFmpeg לחיבור כל הקטעים לקובץ MP3 אחד רציף.
דרישות סאונד: החיבור יבוצע עם Crossfade קצרצר (כמה מילי-שניות) ומרווחי שקט קטנים (Room Tone) בין המשפטים למניעת אפקט של קול קטוע או רובוטי.
שלב ד': הפצה דרך "ימות המשיח" (Delivery)
ברגע שהופעל טריגר השליחה ל-Call ID ספציפי:בניית קובץ השמע המאוחד: המערכת תרכז את כל השורות של אותו Call ID ותייצר קובץ הקראה שלם (לדוגמה: "עבור משה בן שרה - [תשובה 1]... ועבור שרה בת חנה - [תשובה 2]...").
העלאה לטלפוניה: קובץ ה-MP3 המאוחד יועלה באמצעות ה-API של ימות המשיח לתיקיית ההודעות האישית של הלקוח (מזוהה לפי מספר הטלפון שלו).
צינתוק (חיוג וניתוק): שליחת פקודת API לימות המשיח לביצוע צינתוק לטלפון הלקוח כדי לסמן לו שיש הודעה מחכה.
הודעת SMS: שליחת הודעת SMS ללקוח המרכזת את התשובות הכתובות.
עדכון סטטוס: שינוי אוטומטי של עמודת "סטטוס שליחה כללי" בגוגל שיטס ל-"נשלח בהצלחה".
️ טכנולוגיות מוצעות
כלי אוטומציה / שרת: Make.com (או שרת עצמאי ב-Node.js/Python).תמלול ועיבוד שמות: OpenAI API (Whisper + GPT-4o).
מנוע קול דינמי (TTS): ElevenLabs API.
ניהול שמע: ספריית FFmpeg (לחיבור קבצי השמע).
טלפוניה וסלולר: API של ימות המשיח.
@יוסף-הכהן אני מציע שתכניס את מה שג'מיני כתב בקלוד, ותשאל אותו עד כמה הוא מסוגל לבנות כזה פרוייקט. אני מאמין שהוא מסוגל לנתח את היכולות של עצמו ברמה סבירה. וע''פ זה תוכל לבסס את רמת ההסתמכות על AI בפרוייקט.
בהצלחה!
חבר'ה אולי בואו תעזרו לבנאדם במקום לפתוח בנושא שלו דיונים על AI סבבה? בבקשה?....
- ארכיטקטורת זרימת הנתונים (Workflow)
-
אוני לא הסברתי מספיק מה היה המטרה שלי בפוסט
אבל ברצוני להבהיר שאני שואל האם אחרי כל העלויות והכל האם לכאורה אני אקבל מוצר שיעבוד כמו שצריך , גם אם זה תוכנת רק ע"י AI ? או שאם אני רוצה מוצר שלא יעשה לי בעיות אני חייב לפנות למתכנת מומחה שיבנה לי את זה מא' עד ת' במחיר מלא ?
בקיצור השאלה אם אפשר להגיע לאותו רמה של תוצאה או שהAI עוד לא שם ? -
בקיצור השאלה אם אפשר להגיע לאותו רמה של תוצאה או שהAI עוד לא שם ?
מהתשובה של כולם, (ומעשרות מקומות בפורום) התשובה היא שכן!!!
הבעיה היא שבשביל לבצע את כל ההוראות ולהסתדר עם כל החלקים צריך בן אדם עם גישה למחשב לאתרים ואולי גם קצת ספציפית לשימוש בקוד, אם הוא טוען שהוא יכול לעשות את זה עבורך והוא אדם אחראי ונורמלי סיכוי סביר שהוא באמת יכול -
@kasnik
שאלה טובה.ברור שאחרי!
מה הגדרה של מתכנת?
אני לא כותב סי פלס פלס, וגם לא סי שארפ.
פייתון זה גם משהו?
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות