AI כותבת היסטוריה: מיפוי וקטלוג סיפורי חדשות טלוויזיה לאורך 15 שנה

6.8.2025 · 2 דקות קריאה · AI

AI כותבת היסטוריה: מיפוי וקטלוג סיפורי חדשות טלוויזיה לאורך 15 שנה

הפרויקט שאתה שואל עליו הוא יוזמה חדשנית של GDELT בשיתוף עם Internet Archive, שמטרתה ליצור אינדקס ענק, אוטומטי וממופהסיפורים של שידורי חדשות הטלוויזיה המרכזיים

הפרויקט שאתה שואל עליו הוא יוזמה חדשנית של GDELT בשיתוף עם Internet Archive, שמטרתה ליצור אינדקס ענק, אוטומטי וממופהסיפורים של שידורי חדשות הטלוויזיה המרכזיים בארה״ב במשך 15 שנים – מיולי 2010 ועד היום. במקום לקטלג ידנית (כפי שנעשה בעשורים האחרונים בארכיונים ידועים), הפרויקט עושה שימוש במודלי בינה מלאכותית (AI), בדגש על Google Gemini 2.5 Flash, כדי:

https://blog.gdeltproject.org/buildingastoryindexofadecadeoftveveningnewswithgeocodingsentimentframenarrativeanalysisinonehourfor154/

הפרויקט הדגים שאפשר לנתח כמעט 15,000 מהדורות (עם מעל 150,000 סיפורים) בפחות משעה, באופן אוטומטי לחלוטין ובעלות נמוכה מאוד. הרעיון המרכזי הוא להנגיש מחקר עומק חדשני על איך חדשות טלוויזיה בונות סיפורים, ממסגרות אירועים, מפיצות רגשות, ומתייחסות לגיאוגרפיה, במשך תקופה ארוכה – בצורה הניתנת לחיפוש, אנליזה והשוואה.

בגלל שהכל מבוסס על מודל AI ללא פיקוח ידני, יש גם אלמנט ניסויי – המטרה לבדוק כמה טוב AI מסוגל לקטלג ולמסגר ידנית חומרים מורכבים ואיך ניתן להפיק מהאינדקס תובנות חדשות.

ה”קודים” שמוזכרים במאמר (codes) הם קטעי SQL ותצורות JSON שבהם השתמשו כדי לפענח, לקטלג ולעבד את שידורי החדשות ומידע המטא־דאטה שלהם:

  1. קוד SQL
  2. תצורת JSON
  1. הוראות הגשה ותיעוד API
  2. דוגמאות פלט הסבר

כלומר המאמר מדגים כיצד מחברים בין שאילתות SQL, מכונת עיבוד אוטומטית (AI), ותצורת נתונים (JSON Schema) כדי להפוך וידאו בלתי מובנה לאינדקס חכם וניתן לחיפוש ולהשוואה.

בקיצור: זוהי מערכת אוטומטית ענקית ל״ניתוח סיפורי״ של ארכיון חדשות טלוויזיה, שמאפשרת חיפוש מעמיק וחדשני על שיח החדשות והתפתחותו לאורך זמן.