O'rin #2 SI Agetlar — Siz uxlayotganingizda ishlaydigan dasturlar
Nous Research

Hermes Agent

Nous Research yaratgan ochiq kodli agent: u qayta ishlatiladigan ko'nikmalarni o'rganadi, dasturlash maqsadlari bajarilganini tekshiradi hamda terminal, ish stoli, veb va messenjerlarda ishlaydi. v0.19 Quicksilver shu katta g'oyani kundalik foydalanishga yaqinlashtirdi — ishga tushish tezlashdi, subagentlar ishini kuzatish mumkin bo'ldi, natijalar uzilishdan keyin ham saqlanadi va maxfiy kalitlar yaxshiroq himoyalanadi.

Yangilangan 2026-yil 4-avgust MIT Open SourceSelf-ImprovingSelf-Hosted
8.510 dan
Rasmiy veb-sayt
Eng mos

Nous Research yaratgan ochiq kodli agent: u qayta ishlatiladigan ko'nikmalarni o'rganadi, dasturlash maqsadlari bajarilganini tekshiradi hamda terminal, ish stoli, veb va messenjerlarda ishlaydi. v0.19 Quicksilver shu katta g'oyani kundalik foydalanishga yaqinlashtirdi — ishga tushish tezlashdi, subagentlar ishini kuzatish mumkin bo'ldi, natijalar uzilishdan keyin ham saqlanadi va maxfiy kalitlar yaxshiroq himoyalanadi.

Nima uchun bu eng yaxshisi

`/learn` va tekshirish mumkin bo'lgan xotiraga ega yopiq o'rganish sikli; `/goal` orqali dalil talab qiladigan yakunlash shartlari; tanlanadigan Mixture of Agents kengashlari; 60 dan ortiq ichki vosita; jonli kuzatiladigan va qayta ishga tushirishga chidamli fon subagentlari; Bitwarden hamda 1Password integratsiyasi; Nous o'lchoviga ko'ra ilk sovuq so'rovni uzatish vaqti taxminan 4,3 soniyadan 0,9 soniyaga tushgan.

E'tibor bering

Hermes sun'iy intellektga buyruqlar, fayllar, brauzer va messenjer hisoblariga juda keng kirish beradi. Aqlli tasdiqlash ortiqcha savollarni kamaytiradi, ammo u boshqa modelning hukmiga tayanadi va xavfsizlik devori emas; MoA kengashlari va ko'p subagentli ish xarajatni ham bir necha baravar oshirishi mumkin.

01

Aslida bu nima

Ko’pchilik sun’iy intellekt agentlari har dushanbani xuddi xotirasini yo’qotgandek boshlaydi. U kechagi suhbatni eslashi mumkin, ammo o’tgan hafta zo’rg’a topilgan ish usulini ishonchli tartibga aylantirishi shart emas. Hermes Agent qiziqroq va’da beradi: biror yo’l ish bersa, agent uni o’qish mumkin bo’lgan ko’nikma sifatida saqlaydi, keyin kerakli tajribani esga tushiradi va o’sib borayotgan xotirasini tekshirish uchun ochib beradi. Bu ajoyib, ammo vaqtinchalik xodimdan ko’ra har loyihadan so’ng tartibliroq bo’lib boradigan usta daftariga o’xshaydi.

Ana shu o’rganish sikli Hermes’ning asosiy farqi bo’lib qolmoqda. /learn ish oqimi, papka yoki manbani qayta ishlatiladigan amaliy bilimga aylantira oladi. /journey xotiralar orasidagi bog’lanishni ko’rsatadi, ish stoli ilovasi esa tarixni tahrirlash mumkin bo’lgan graf ko’rinishida beradi. Dasturlashda /goal yana bir tartib qo’shadi: agent g’alaba e’lon qilishdan oldin, masalan, loyiha testlari muvaffaqiyatli o’tganini isbotlashi mumkin. Bu har javobni to’g’ri qilib qo’ymaydi, lekin «bajarildi» degan so’zga chiroyli yakuniy xabardan ko’ra aniqroq ma’no beradi.

0.20 versiyasi, Herald relizi, bu g’oyani o’rnini bosmaydi. U agent tsiklini kamroq isrofgarchilikka olib keladi. Nous kompaniyasining ta’kidlashicha, u NVIDIA Nemo Relay bilan birgalikda 250 000 ta Hermes suhbatlarini o’rganib chiqqan va qimmatbaho xatolik ko’pincha bitta ulkan so’rov emas, balki ko’plab burilishlar davomida takrorlanadigan kichik oqish ekanligini aniqladi: katta sxemalar, endi foydali bo’lmagan vositalar chiqishi, deyarli mos keladigan yamoq (patch) yoki bitta harf tufayli erta taslim bo’ladigan qidiruv. Herald sxemalarni qisqartiradi, eskirgan vositalar chiqishini tozalaydi, kontekstni asta-sekin siqadi, so’nggi foydalanuvchi xabarlarini saqlab qoladi va model yangi reja o’ylab topishidan oldin vositalarga tiklanish yo’llarini beradi. Bu, ayniqsa, model tartibsiz ish oqimini o’zlashtirish uchun kamroq imkoniyatga ega bo’lgan kichikroq mahalliy model bo’lganda muhimdir.

Eng muhim o’zgarish shundaki, vositalar endi o’zlarining oddiy xatolaridan tiklanishga yordam beradi. Kesilgan terminal natijasi ko’r nuqta bo’lib qolish o’rniga faylga saqlanadi. patch allaqachon qo’llanilgan o’zgarish yoki bo’shliqlar mos kelmasligini qanday tushuntirishni biladi. Yozishlar diskda tekshiriladi. Natijasiz qidiruvlar yaqin mosliklarni qidiradi. Asboblar qo’ng’iroqlari uchun standart yuqori chegara 90 dan 500 gacha ko’tariladi, shuning uchun uzoq vazifa o’zboshimchalik bilan hisoblagich tufayli to’xtab qolish ehtimoli kamroq. Bularning hech biri Hermes-ni xatosiz qilmaydi; u oddiy mexanik xatolarni model yo’lidan olib tashlaydi. Bu zaifroq modelni “deyarli foydali” dan ishlaydigan yordamchiga aylantira oladigan aynan shunday yaxshilanishdir.

Xavfsizlik ham to’g’ri tomonga siljidi. Hermes maxfiy kalitlarni Bitwarden va 1Password’dan olishi mumkin, shuning uchun uzun ochiq environment fayliga ehtiyoj kamayadi. Aniq taqiq andozalari boshqa tekshiruvlar yumshatilganda ham tanlangan buyruqlarni to’xtatadi. Credential doirasini toraytirish, chiqishda sirlarni yashirish, umumiy fayl nazorati va so’rov hajmi chegaralari yana bir necha bo’shliqni yopadi. Lekin standart «aqlli tasdiqlash» rejimini ehtiyotkor tushuntirish kerak: ikkinchi til modeli belgilangan buyruq xavfsiz ko’rinadimi, deb qaror qiladi va uni o’zi tasdiqlashi mumkin. Bu ortiqcha so’rovlarni kamaytiradi, ammo bir modelning boshqasini tekshirishi sandbox yoki operatsion tizim ruxsati degani emas.

Herald shuningdek, Hermes-ni terminal tajribasiga o’xshab emas, balki to’g’ri joyda bog’lanishingiz mumkin bo’lgan hamkasbga o’xshatadi. U tabiiy ravishda to’xtatilishi mumkin bo’lgan oqimli suhbat ovozi, qurilmadagi uyg’onish so’zlari, Agent-to-Agent v1.0, imzolangan webhooklar, manba matni bilan tekshiriladigan iqtiboslar bilan asoslangan qidiruv, ish stoli artefaktlari va plaginlari, hamda to’xtab, qaytadan boshlash o’rniga faol navbatni qayta yo’naltirish qobiliyatini qo’shadi. Yangi buyruqlar g’ayrioddiy amaliydir: !command qobiq harakati uchun model navbatini sarflashdan qochadi, /context oynani nima to’ldirayotganini ko’rsatadi va /diff nima o’zgarganini ko’rsatadi. Claude Code va Codex uchun importerlar Hermes-ni mavjud sozlamalar bilan birga sinab ko’rish narxini pasaytiradi.

Halol xulosa o’lchangan. Herald mazmunli qobiliyat sakrashidir, chunki u bir xil agentlik ambitsiyasini arzonroq, kamroq mo’rt va boshqarishni osonlashtiradi - ayniqsa DeepSeek V4 Flash 0731 kabi model yoki boshqa mahalliy yakuniy nuqta bilan. Biz Hermes-ni 8,5 ga ko’taramiz, ammo ikkinchi o’rinni saqlab qolamiz: Nous tokendan foydalanish, kechikish va vazifa muvaffaqiyatini mustaqil taqqoslashni emas, balki g’ayrioddiy batafsil reliz muhandisligini taqdim etdi. Tekshiriladigan o’zini-o’zi takomillashtirish, tekshirilishi mumkin bo’lgan maqsadlar, mahalliy model erkinligi va chuqur orkestratsiya operatsion yukdan ustun bo’lganda Hermes-ni tanlang. Agar siz har bir ruxsat va xato uchun javobgar bo’lgan bitta sotuvchiga ega qurilmani xohlasangiz, Hermes hali ham sizdan ko’proq narsani talab qiladi.

02

Kuchli tomonlar va halol cheklovlar

Asosiy afzalliklari

  • O’rganishdan keyin qo’lda ushlasa bo’ladigan natija qoladi: Hermes muvaffaqiyatli ish usullarini o’qish va qayta ishlatish mumkin bo’lgan ko’nikmalarga aylantiradi, loyiha haqidagi bilimni sessiyalar orasida saqlaydi. /journey va ish stolidagi xotira grafigi o’rganilgan narsani ko’rishga imkon beradi, /goal esa dasturlash vazifasi tugadi deyishdan oldin test yoki boshqa dalil talab qilishi mumkin.
  • Quicksilver agentni sezilarli darajada chaqqonlashtirdi: Nous ma’lumotiga ko’ra, v0.19 da ilk sovuq so’rov yuborilgandan uni bajarishga uzatishgacha bo’lgan vaqt qariyb 4,3 soniyadan 0,9 soniyaga kamaygan. TUI’dagi bosqichma-bosqich chizish, har token bilan yangilanish, katta diff’larni virtual yuklash va ish stoli optimizatsiyasi foydalanuvchi sezadigan kutishlarni qisqartiradi.
  • Parallel ishni endi kuzatish va saqlab qolish osonroq: Fon subagentlari jonli jurnal yozadi, shu sabab ularning vosita chaqiruvlarini ish davomida tekshirish mumkin. Natijalar jarayon qayta ishga tushganda yo’qolmaydi, alohida yetkazib berish reyestri esa gateway qulaganidan keyin tayyor javobni qayta yubora oladi.
  • Keng model tanlovi murakkab boshqaruv bilan birga keladi: Hermes yirik bulut API’lari, lokal modellar, Nous Portal va OpenAI bilan mos endpoint’larda ishlaydi. MoA kengashlari uning o’ziga xos tomoni bo’lib qolgan; endi har model va rol uchun fikrlash darajasini alohida belgilash mumkin, demak qimmat maslahatchi bilan yakuniy sintezatorga bir xil budjet berish shart emas.
  • Sirlar va buyruqlarni boshqarish jiddiy yaxshilandi: Bitwarden hamda 1Password kalitlarni ochiq .env fayliga ko’chirmasdan uzata oladi. Foydalanuvchi belgilagan qat’iy taqiq qoidalari hatto erkin rejimlarda ham ishlaydi; credential doirasini toraytirish, maxfiy qiymatlarni yashirish, fayl o’qish nazorati va webhook hajm chegaralari boshqa amaliy xavflarni kamaytiradi.
  • Ish imkoniyatlari juda keng: 60 dan ortiq ichki vosita fayllar, terminal, veb-tadqiqot, brauzer avtomatizatsiyasi, media, jadval va delegatsiyani qamrab oladi. Bitta gateway 20 dan ortiq messenjerga ulanadi, profil bo’yicha yo’naltirish esa bir bot ortida ish va shaxsiy sozlamalar, xotira hamda sirlarni bir-biridan ajratadi.
  • Tizim ochiqligicha qolgan holda boshlash osonlashdi: Ish stoli o’rnatuvchilari va hermes setup --portal barcha model va vosita kalitlarini qo’lda yig’ishdan ancha qisqa yo’l beradi. Nous Portal model, veb, rasm, ovoz, brauzer va sandbox xizmatlarini bitta hisobda jamlaydi; shu bilan birga self-hosting, bevosita provayder va lokal model tanlovi saqlanib qolgan.

Haqiqiy cheklovlar

  • Aqlli tasdiqlash qulaylik beradi, lekin izolyatsiya emas: Standart smart rejimida yordamchi model kam xavfli deb topgan buyruqni avtomatik tasdiqlashi mumkin. Qat’iy taqiq qoidalari foydali, ammo Hermes’ga shell, brauzer yoki pochta kirishi berilsa, izolyatsiya, eng kam ruxsat, zaxira nusxa va muhim amallar uchun inson nazorati baribir zarur.
  • Eng kuchli tezlik raqamlari ishlab chiquvchining o’zidan: Startdagi 80 foizlik yaxshilanish va Markdown ishlovining 14 baravar tezlashishi Nous Research o’lchovlaridir. Bu mantiqli muhandislik ko’rsatkichlari, ammo v0.19 Hermes raqiblaridan ko’ra real agent vazifalarini aniqroq bajarishini ko’rsatadigan mustaqil sinovni bermaydi.
  • Tajribali foydalanuvchiga xos murakkablik yo’qolmadi: O’rnatuvchi va Portal login dastlabki soatni yengillashtiradi, lekin jiddiy ishga tushirishda provayderlar, profillar, gateway, ruxsatlar, jurnallar, yangilanishlar va ba’zan masofaviy infratuzilma bilan ishlash kerak. Juda tez rivojlanish hayratlanarli, biroq hujjat va sozlamalar ham tez o’zgaradi.
  • Parallel aql parallel xarajatga aylanishi mumkin: MoA kengashlari, yordamchi tekshiruvchilar, siqish modellari va fon subagentlari bitta so’rov uchun bir nechta model chaqiruvini bajaradi. Nous Portal to’lovni soddalashtiradi, bekor qilmaydi; budjet qo’yish, ikkinchi darajali rollarga arzonroq model tanlash va foydalanish hisobotini ko’rib turish kerak.
03

Xulosa

Hermes ro’yxatimizdagi o’zini takomillashtiruvchi agentlar orasida hamon eng dadil fikrlangan loyiha. v0.19 bu g’oya kundalik hayotda ishlashi uchun zarur, ammo ko’zga tashlanmaydigan qismlarni yaxshiladi: tezlik, kuzatuv, natijani ishonchli yetkazish, sirlar va yo’naltirish. Bu yangiroq va ijobiyroq sharhga asos bo’ladi, lekin mustaqil vazifa sinovlarisiz ball yoki o’rinni ko’tarishga emas. Hermes 8,2 ball va ikkinchi o’rinda qoladi: o’rganish jarayonini tekshirish va murakkab boshqaruvni istaydigan, tizimni ehtiyotkor yuritishga tayyor texnik foydalanuvchi uchun kuchli tanlov.

04

Ko'p so'raladigan savollar