
Grok Build vs Claude Code — რომელი კოდინგ-აგენტი უკეთ იმახსოვრებს?
16 სექტემბერს xAI-მ Grok Build-ს მეხსიერება დაუმატა, Claude Code-ს კი auto memory თვეების განმავლობაში აქვს. სამტესტიანი შედარებით, ერთი პროექტის შიგნით ორივე ერთნაირად იმახსოვრებს, წესების რეპოზიტორიებს შორის გადატანა კი მხოლოდ Grok-მა შეძლო.
16 სექტემბერს xAI-მ გამოაცხადა, რომ მის ტერმინალურ კოდინგ-აგენტ Grok Build-ს მეხსიერება დაემატა. კომპანიის მტკიცებით, Grok „ინახავს შენიშვნებს კონვენციებზე, გადაწყვეტილებებზე და პროექტის ფაქტებზე", ხოლო „მომდევნო სესიები ამ შენიშვნებს კითხულობენ კოდთან მუშაობამდე". The New Stack-მა ეს მტკიცება Claude Code-ს შეადარა, რომელსაც მსგავსი ფუნქცია უკვე თვეების განმავლობაში აქვს.
ორი მეხსიერების სისტემა
Grok Build შენიშვნებს Markdown ფაილებად ინახავს ორ დონეზე: პროექტის workspace-ფარგლებში და გლობალურად, რაც ყველგან მოქმედებს; მათ /memory ბრძანებით ათვალიერებენ. Claude Code-ის auto memory ინახავს MEMORY.md-ის ინდექსს და თითო ფაილს თითო შენიშვნისთვის, თითო რეპოზიტორიისთვის, და დოკუმენტაციის მიხედვით ნაგულისხმევად ჩართულია. Anthropic-ის Projects ბეტა (17 სექტემბერი) ღრუბლოვან ნაკადებს შორის საერთო მეხსიერებას ამატებს, თუმცა მხოლოდ შერჩეული Pro და Max აბონენტებისთვის — ამიტომ ტესტში ყველასთვის ხელმისაწვდომი CLI გამოიყენეს.
როგორ ჩატარდა ტესტი
ორივე ინსტრუმენტი ავტორის Mac-ზე მუშაობდა, თითოეული ოთხი პატარა Node-რეპოზიტორიის საკუთარ ასლზე. Grok Build 1.0.40 Grok 4.6-ს high effort რეჟიმში xAI API გასაღებით ამუშავებდა, Claude Code 2.1.226 კი Opus 5-ს აბონემენტით. სესიები თითოეული ხელსაწყოს headless რეჟიმში მიდიოდა, რომელიც თავადვე ითვლის დახარჯულ ტოკენებსა და ხარჯს. სამი შემოწმება ჩატარდა: სატესტო ბრძანების გახსენება, პროექტის გადაწყვეტილებების დაცვა ჩაფლული ხაფანგით და ყველა პროექტისთვის განკუთვნილი წესის მეორე რეპოზიტორიაში გადატანა.
რა აჩვენა ციფრებმა
მეორე სესიაზე ორივემ გაიხსენა სატესტო ბრძანება. Grok-მა ჯერ მეხსიერების ფაილები წაიკითხა და გაუშვა make test, npm test-ს კი არ შეხებია: 29 წამი, 102K ტოკენი, 0,11 დოლარი. Claude Code-მაც გაუშვა make test და დახარჯა 22 წამი, 186K ტოკენი და 0,32 დოლარი — დაახლოებით 80 ათასი ტოკენით მეტი და თითქმის სამჯერ ძვირი. მეორე ტესტში, რომელიც ჩაფლულ ხაფანგს შეიცავდა, ორივე მართალი იყო, თუმცა Claude-ის ხარჯი ისევ მაღალი დარჩა — 0,49 დოლარი Grok-ის 0,18-ის ნაცვლად.
მესამე ტესტმა შედეგები გაყო. Grok-მა წესები გლობალურ scope-ში, ფაილში git-and-code-style.md, შეინახა და მეორე რეპოზიტორიაშიც გადაიტანა: ჩაამტკიცა --help ფლაგი გამოყენების აღწერითა და კომენტარების გარეშე, 0,12 დოლარად. Claude Code-მა ორივე წესი მხოლოდ პირველი პროექტის მეხსიერების საქაღალდეში შეინახა და გააფრთხილა, რომ მისი საცავი „ამ პროექტის დირექტორიით შემოიფარგლება"; მეორე რეპოში ვერაფერი იპოვა და წესი ვერ შეასრულა. სამივე ტესტში Grok-მა 3-დან 3 გაიარა — 165 წამი, 390 848 ტოკენი, 0,41 დოლარი; Claude Code-მა 3-დან 2 — 66 წამი, 576 863 ტოკენი, 1,05 დოლარი.
რას ნიშნავს ეს
ძირითად მტკიცებაზე — ერთი და იმავე პროექტში წინა სესიის გახსენებაზე — განსხვავება არ ჩანდა: ორივე წესის დაფიქსირებისთანავე Markdown შენიშვნას წერდა და მომდევნო სესიაზე იცავდა, Claude Code-ის შენიშვნები კი უკეთ იყო დაწერილი. განსხვავება პროექტებს შორის მეხსიერებაში გამოჩნდა, სადაც Grok-ის გლობალურმა scope-მა მოიგო. მიმოხილვა აღნიშნავს, რომ ფასების სხვაობა ძირითადად Opus 5-ისა და Grok 4.6-ის დამსახურებაა და არა მეხსიერების სისტემების, და ასკვნის, რომ დღეს Grok Build უკეთესი არჩევანია უმეტესი მომხმარებლისთვის: მან ყველაფერი გაიხსენა, წესები რეპოზიტორიებს შორის გადაიტანა და ყოველ ტესტზე ორჯერ იაფი დაჯდა.
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.