
בנה סוכן מתפתח בעצמו: שיפור עצמאי
תיאור
בנה סוכן לתכנון טיולים שמשפר את עצמו ללא עריכה אנושית של ההנחיה, ואז צפה בו לומד לרמות. על נתוני קלט קבועים של מקומות, שעות ותחבורה, הסקורה האמיתית של הסוכן היא היתכנות: האם התחנות באמת פתוחות והתחבורה באמת אפשרית? הרץ אופטימיזציה של adk וצפה בהיתכנות מטפסת מ-~40% ל-~90%, וקרא את הכללים החדשים שהסוכן כתב להנחיות שלו ("בדוק שעות וזמן נסיעה לפני הוספת תחנה"). ואז החלף את השופט במטריקה של "נראה שלם" ותפס אותו על חם: הוא ממלא את המסלול בתחנות שלא אושרו, נחשף ברגע שאתה מדרג אותו על היתכנות אמיתית שוב. השיעור החשוב: אתה אופטימיזציה את מה שאתה מודד, לכן דירג את הדרך (האם הוא באמת בדק?), לא את התשובה. מתרחב ל-Velocity Gen AI Eval ולכיוון Gemma מהעקבות. 🕒 אמריקות: יום חמישי, 20 באוגוסט: 9:00 בבוקר PDT 🕒 אסיה-פסיפיק: יום שישי, 21 באוגוסט: 9:30 בבוקר IST
תן לרשת שלך לדעת שאתה הולך
שתף אירוע זה כדי להתחיל שיחות, להזמין עמיתים ולהתחבר לפני תחילתו.




