OpenClaw 2.0: ההתקנה נעשתה קלה, הסוכן לומד ומתקין לעצמו סקילים כברירת מחדל, וארגז החול עדיין כבוי

OpenClaw 2.0 הפך את ההתקנה לקלה, ובאותה גרסה הפעיל כברירת מחדל איחוד זיכרון ברקע וסקילים שנלמדים ומופעלים בלי אישור. ארגז החול נשאר כבוי. כל השינויים, הפקודות לשדרוג והמפתחות לשינוי ברירות המחדל.
קלוד השלים הוכחה ממוחשבת למשפט האחרון של פרמה ב-11 יום, והניסיון הראשון נכשל על ניהול פרויקט

אנתרופיק פרסמה הוכחה ממוחשבת מלאה למשפט האחרון של פרמה, שסוכני קלוד כתבו ב-11 יום. הניסיונות הראשונים נכשלו כי הסוכנים איבדו את מצב הפרויקט, ומה שהציל אותו היה גרף משימות.
OpenClaw כעוזר לשרת לינוקס: הסוכן מצא 1,676 ניסיונות פריצה, והוא עצמו רץ עם גישה מלאה

מדריך במדיום הפך את OpenClaw לעוזר לניהול שרת לינוקס. הסוכן מצא 1,676 ניסיונות פריצה, והוא עצמו רץ עם גישה מלאה. כל השלבים עם הפקודות, והנעילה שחסרה במדריך.
OpenAI פרסמה הוכחה לבעיית נאוויה-סטוקס, והמשפט החשוב בהודעה עוסק בטיוטות של מישהו אחר

OpenAI פרסמה הוכחה לבעיית נאוויה-סטוקס. בהודעה יש משפט אחד על הטיוטות של שני מתמטיקאים שעבדו בקודקס, והוא מסביר למה שאלת האימון לא תקבל תשובה לעולם.
סוכן AI פרץ מכונת מעבדה בשבע דקות, והשאלה המעניינת היא מי מקבל רשות להריץ אותו

סוכן קוד השלים בדיקת חדירה למכונת מעבדה בשבע דקות בלי התערבות אנושית. מאחורי הכותרת מסתתר שינוי גדול יותר: היכולת ההתקפית עברה מלהיות שאלה של מיומנות לשאלה של הרשאה מספק.
אנתרופיק בדקה 400 אלף סשנים של קלוד קוד, והפער בין מתחיל למומחה לא נסגר

אנתרופיק ניתחה כ-400 אלף סשנים של קלוד קוד. המקצוע הרשמי כמעט לא השפיע על ההצלחה, אבל הפער בין מתחילים למנוסים נשאר חד. מה שהשתנה הוא סוג המומחיות שנמדדת.
LangGraph מול OpenAI Agents SDK מול Claude Agent SDK: מה כל אחת בנויה לעשות, ואיפה כל אחת נשברת

שלוש ערכות הפיתוח לא מתחרות על אותו דבר. סקירה של הפרימיטיב של כל אחת, ארבע סוגי עבודה ומי מנצחת בכל אחד, ותיקון אחד שהתיעוד הרשמי סותר בו את המקור.
עשרה תוספים וסקילים בקוד פתוח לקלוד קוד: מה כל אחד עושה, איפה להוריד ואיך להתקין

עשרה פרויקטים בקוד פתוח שמרחיבים את קלוד קוד: מה כל אחד פותר, קישור לכל אחד, והוראות התקנה מהתיעוד הרשמי. שניים מהם מוסיפים למודל יכולת, שמונה מרסנים אותו.
המילה שהתעשייה משתמשת בה כדי לדעת אם AI עובד, ואף אחד בחוץ לא מכיר

בכל פעם שקוראים שמודל אחד עקף אחר, מאחורי הכותרת עומד תהליך מדידה מוגדר ששמו eval. מחוץ למעבדות כמעט אף אחד לא משתמש בו.
קלוד קיבל משימה לבנות חלבונים במעמדה, רמז? הוא הצליח…

לפני ארבעה ימים בדיוק, דריו אמודאי — המנכ"ל של Anthropic — עלה לרשת X והבטיח שהעבודה שלהם בביולוגיה תניב "ניצנים ראשונים" בחודשים הקרובים. כמה ימים. לא שבועות. ימים. ועכשיו? ובכן, אולי הוא צנוע מדי בציפיות. קלוד יצא מהמעבדה — לא כמטאפורה, אלא ממש. המודל של Anthropic רץ לבד על קמפיין עיצוב חלבונים מקצה לקצה, והתוצאות […]