מחקר: AI לא קרוב למחקר עצמאי
מחקר חדש מערער על טענות אנתרופיק וOpenAI: סוכני AI כשלו בכתיבת מאמרי מחקר עצמאיים, למרות משאבים נרחבים.
סוכני AI, המבוססים על Claude Opus 4.8 וGPT5.6 Sol, קיבלו שישה ימים, 3,000 דולר בזיכויי API וגישה לGPU כדי לכתוב באופן עצמאי מאמרי מחקר בתחום הבינה המלאכותית. מחברי מאמרי NeurIPS מקוריים, שטרם פורסמו, דירגו את התוצאות כ'דחייה'. המחקר, שנערך בשיתוף אוניברסיטת פרינסטון וגורמים נוספים, מציג תמונה שונה מההצהרות האופטימיות של חברות AI מובילות.
ממצאים אלו חשובים במיוחד עבור חברות סטארטאפ ישראליות ועסקים קטנים ובינוניים המפתחים או משלבים AI. הם מדגישים כי למרות ההתקדמות המרשימה, עדיין יש פער משמעותי ביכולת של AI לבצע משימות מחקר מורכבות באופן אוטונומי, מה שמחייב השקעה מתמשכת בפיתוח כוח אדם אנושי מיומן בתחום.
קריאה נוספת ←