חזרה
Grok Build מול Claude Code: למי יש זיכרון טוב יותר?
SiTech AI Team3 წთ. საკითხავი

Grok Build מול Claude Code: למי יש זיכרון טוב יותר?

xAI הוסיפה זיכרון ל-Grok Build ב-16 בספטמבר, בעוד של-Claude Code יש זיכרון אוטומטי כבר חודשים. השוואה בת שלושה מבחנים מצאה ששניהם זוכרים כללים בתוך הפרויקט, אבל רק Grok העביר אותם בין מאגרים — ובפחות מחצי מהעלות.

ב-16 בספטמבר הודיעה xAI כי הזיכרון הגיע ל-Grok Build, סוכן הקוד הטרמינלי שלה. לפי ההצהרה, Grok "שומר הערות על המוסכמות, ההחלטות והעובדות שעולות בפרויקט", ו"סשנים מאוחרים יותר קוראים את ההערות האלה לפני שהם נוגעים בקוד הרלוונטי". The New Stack בחן את הטענה מול Claude Code, שמציע תכונה דומה כבר חודשים.

שתי מערכות זיכרון

Grok Build שומר את ההערות כקבצי Markdown בשני טווחים: טווח סביבת עבודה לכל פרויקט וטווח גלובלי שחל בכל מקום; הפקודה /memory מאפשרת לעיין בהן. הזיכרון האוטומטי של Claude Code מחזיק אינדקס MEMORY.md וקובץ אחד לכל הערה, לפי מאגר, ולפי התיעוד הוא פעיל כברירת מחדל. בטא הפרויקטים של Anthropic, שהוכרזה ב-17 בספטמבר, מוסיפה זיכרון משותף בין תהליכים בענן, אך רק לחלק ממנויי Pro ו-Max — ולכן הבדיקה השתמשה ב-CLI שכולם מקבלים.

איך נערך המבחן

שני הכלים רצו על ה-Mac של הכותבת, כל אחד על עותק משלו של ארבעה מאגרי Node קטנים. Grok Build 1.0.40 הריץ את Grok 4.6 במאמץ גבוה דרך מפתח API של xAI, ו-Claude Code 2.1.226 הריץ את Opus 5 במנוי. כל סשן הורץ במצב headless, שמדווח בעצמו על צריכת הטוקנים והעלות. שלושה מבחנים: זכירת פקודת בדיקה, כיבוד החלטות פרויקט עם מלכודת מכוונת, והעברת כלל שמיועד לכל הפרויקטים למאגר שני.

מה הראו המספרים

בסשן השני שניהם זכרו את פקודת הבדיקה. Grok קרא תחילה את קבצי הזיכרון והריץ make test בלי לגעת ב-npm test: 29 שניות, 102K טוקנים ו-0.11 דולר. Claude Code גם הריץ make test ולקח 22 שניות, 186K טוקנים ו-0.32 דולר — כ-80 אלף טוקנים יותר וכמעט פי שלושה במחיר. במבחן השני, עם מלכודת מכוונת, שניהם צדקו, אבל Claude עלה 0.49 דולר לעומת 0.18 אצל Grok.

המבחן השלישי הפריד ביניהם. Grok שמר את הכללים בטווח הגלובלי כקובץ git-and-code-style.md והעביר אותם למאגר השני: קומיט עם דגל --help, טקסט שימוש וללא הערות, ב-0.12 דולר. Claude Code שמר את שני הכללים רק בתיקיית הזיכרון של הפרויקט הראשון והזהיר שהמאגר שלו "מוגבל לתיקייה של הפרויקט הזה"; במאגר השני הוא לא מצא דבר והכלל נכשל. בסך הכול Grok עבר 3 מ-3 ב-165 שניות, 390,848 טוקנים ו-0.41 דולר; Claude Code עבר 2 מ-3 ב-66 שניות, 576,863 טוקנים ו-1.05 דולר.

מה זה אומר

בטענה המרכזית — לזכור באותו פרויקט מה שנאמר בסשן הקודם — לא היה אפשר להבדיל ביניהם: שניהם כתבו הערת Markdown ברגע שהכלל נאמר ופעלו לפיו בסשן הבא, וההערות של Claude Code היו כתובות טוב יותר. הפער הוא בזיכרון בין פרויקטים, שם ניצח הטווח הגלובלי של Grok. הסקירה מציינת שפער המחירים משקף בעיקר את Opus 5 מול Grok 4.6 ולא את מערכות הזיכרון עצמן, ומסיקה שכיום Grok Build הוא האפשרות הטובה יותר לרוב האנשים: הוא זכר הכול, העביר כללים בין מאגרים ועלה פחות מחצי בכל מבחן.

SSiTech

SiTech — פיתוח אתרים בכוח ה-AI

אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.