Geri qayıt
Unreal Labs asinxron Unreal Agent-ı təqdim edib: xərclərdə 40%-ə qədər qənaət
SiTech AI Team2 წთ. საკითხავი

Unreal Labs asinxron Unreal Agent-ı təqdim edib: xərclərdə 40%-ə qədər qənaət

Unreal Labs alət çağırışlarını tamamilə asinxron idarə edən Unreal Agent harness-ı barədə təfərrüatları dərc edib. Agent Terminal-Bench 4.0-da Codex-in nəticəsini qat-qat az xərclə təkrarlayır.

Unreal Labs, Unreal Agent barədə təfərrüatları dərc edib: əsas dizayn qərarı alət çağırışlarının tamamilə asinxron idarə olunmasıdır və bununla model alət üçün gözləmək, sorğu göndərmək və ya heartbeat ötürmək məcburiyyətindən azad olur. Şirkətin sözlərinə görə, hazırkı versiya real iş yüklərində və agent benchmarklarında xərcləri Codex ilə müqayisədə 40%-ə qədər, Pi ilə müqayisədə isə 20%-ə qədər azaldır.

Harness praktik problemdən yaranıb: agentlər vaxtının və tokenlərinin böyük hissəsini faydalı iş yerinə alət çağırışlarını idarə etməyə sərf edirdi. Dizayn həm də davam edən alət çağırışını gözləmədən agenti istənilən anda yönləndirməyə imkan verir.

Asinxron alət çağırışı mühiti

Unreal Agent hər dəfə alət çağıranda hadisə jurnalına alətin "davam edir" statusunda qayıtdığı barədə qeyd əlavə edir və alətin icrasını arxa planda davam etdirir. Alət faktiki bitdikdə nəticə sessiya jurnalına yazılır və bundan sonra model çağırışı baş verir. Şirkət qeyd edir ki, iki nəticəli çağırış nümunəsi — biri davam edən, biri yekun — Responses API sənədlərində hələ kifayət qədər təsvir olunmayıb.

Kod agentləri üçün keyfiyyət-xərc nisbəti

Benchmark nəticələri

GPT-6 Astra ilə xhigh səviyyəsində sınaqdan keçirilən Unreal Agent Terminal-Bench 4.0-da Codex-in lider lövhəsi bazasını 57.9% uğur nisbəti ilə təkrarlayıb və 2350 dollara qarşı 1428 dollar xərcləyib. SWE-Atlas Codebase QnA-da 936 dollara 65.8% götürüb, Codex isə 1303 dollara 63.3%-də qalıb. DeepSWE 1.1-də nəticə 1367 dollara 72.4%, Codex isə 1633 dollara 69.0% olub. ALE-CLI dəstində agent 217 dollara 30.0% tam keçmə və 59.7 orta bal əldə edib, Codex isə 292 dollara 29.0% və 58.1-də qalıb. Unreal Labs kiçik fərqi benchmark variasiyası ilə izah edir və harness-ın sahədən asılı olmadığını qeyd edir.

Niyə mövcud SDK deyil

Yazıda deyilir ki, agent-first məhsul qurmağın vahid doğru yolu yoxdur. Claude-un Agent SDK-sı kimi CLI yönümlü SDK-lar lokal sessiyalar, alt proseslər və resurs limitləri fərz edir; bunlar istehsalata düz keçmir və komandalar tamamlanma, ləğv və arxa plan tapşırıqları üçün öz həyat dövrü idarəçiliyini qurmalı olur. Bir neçə provayderin dəstəyi uyğunluq işi əlavə edir: API rejiminin dəyişdirilməsi alətləri və ya sıxlaşdırmanı poza bilər, SDK yeniləmələri isə mesaj formatlarını dəyişə bilər. harness hook-ları ilə tətbiq olunan təsdiqlər isə deterministik sandbox məhdudiyyətlərindən daha çox qulluq tələb edir.

Buna görə Unreal Agent kiçik saxlanılır: sadə promptlar, token baxımından optimallaşdırılmış alət nəticələri, alt agent və workflow yoxdur. SDK Go kitabxanası, claude -p kimi runner və Harbor ilə uyğun benchmark runner təqdim edir; kod GitHub-da əlçatandır.

SSiTech

SiTech — AI ilə gücləndirilmiş veb hazırlanması

Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.