ai-machine-learning

Hermes Agent v0.15 \"The Velocity Release\": Le 6 Novità che Contano Davvero (e se Conviene Aggiornare)

Scritto da Mert Batur
May 29, 2026
14 lettura
Hermes Agent v0.15 \"The Velocity Release\": Le 6 Novità che Contano Davvero (e se Conviene Aggiornare)

Hermes Agent v0.15 "The Velocity Release": Le 6 Novità che Contano Davvero (e se Conviene Aggiornare)

NousResearch ha ridotto run_agent.py da 16.083 a 3.821 righe in Hermes Agent v0.15, e ha reso session_search circa 4.500x più veloce. Questo è il cuore di "The Velocity Release", uscita il 28 maggio 2026. È una versione importante: 1.302 commit e 747 PR unite da v0.14. Ma 747 PR è un fiume in piena, e non hai tempo di leggerle tutte. Ecco quindi le sei cose che cambiano davvero la tua giornata, e se dovresti aggiornare.

Punti Chiave

  • Hermes Agent v0.15 "The Velocity Release" è uscita il 28-05-2026 da NousResearch; 1.302 commit, 747 PR da v0.14.
  • run_agent.py si è ridotto del 76% (da 16.083 a 3.821 righe); le chiamate di funzione per conversazione sono scese del 47%.
  • session_search è circa 4.500x più veloce (da ~90s a ~20ms) e ora è gratuita.
  • Kanban è diventata una piattaforma multi-agente: auto-decomposizione dell'orchestratore e topologia hermes kanban swarm.
  • La nuova difesa promptware blocca gli attacchi di prompt injection di classe Brainworm in tre punti; nuovi provider includono Krea 2 e xAI.

Hermes Agent v0.15 in un Paragrafo: Cos'è Davvero "The Velocity Release"

Hermes Agent è un agente AI da terminale con memoria persistente e auto-miglioramento di Nous Research, con licenza MIT, circa 172k stelle GitHub, e la capacità di chiamare più di 200 modelli tramite OpenRouter e altri provider. Se hai cercato "cos'è hermes agent", questa è la versione breve: un agente autonomo per coding e task che esegui dal terminale, con una memoria che sopravvive tra le sessioni.

Quindi cos'è v0.15? È il terzo major release in tre settimane, e il nome si guadagna doppiamente. The Velocity Release si chiama così per due ragioni: è uscita in fretta e rende Hermes Agent nettamente più veloce da usare. Il titolo non è una feature sgargiante, è un grande refactoring e un passaggio di ottimizzazione delle performance. NousResearch ha ricostruito il core dell'agente, ridotto il costo delle chiamate di funzione, velocizzato la ricerca in memoria e trasformato la board Kanban in un sistema multi-agente completo. Se sei su v0.13 o v0.14, questa è la release in cui le fondamenta sono state riscritte sotto di te. La buona notizia: la maggior parte è invisibile nel senso buono. I tuoi workflow esistenti continuano a girare, costano solo di meno e partono più in fretta. La patch v0.15.1 (29 maggio) è la versione attualmente installabile; corregge un loop di ricarica della dashboard nei deployment su loopback.

I Numeri Dietro la Velocity Release

La Velocity Release è grande per qualsiasi misura: 1.302 commit, 747 PR unite, 1.746 file modificati, 282.712 inserimenti, 36.699 eliminazioni, 560+ issue chiuse e 321 contributori da v0.14. Questi numeri dicono "grande refactor". I quattro che ti riguardano sono quelli su velocità e costo, e si trovano nella tabella qui sotto.

La dimensione da sola non ti dice se devi preoccuparti. Un diff da 282.712 righe potrebbe essere churn. Quello che rende questa release degna della tua attenzione è dove è atterrato il diff: il core dell'agente e il layer di memoria, le due cose che tocchi a ogni singolo turno. Ecco il prima e il dopo, direttamente dalle note di rilascio v0.15.0.

Metricav0.14v0.15Variazione
Dimensione run_agent.py16.083 righe3.821 righe-76%
Chiamate di funzione per conversazione (chat 31 turni)399k213k-47%
Latenza session_search~90s~20ms~4.500x più veloce
Cold start hermes --version701ms258ms-63%
Cold start (Termux)2,9s0,8s-72%

Questi dati devono essere accurati o la fiducia evapora, quindi per essere chiari: ogni cifra qui proviene dal tag di rilascio ufficiale di NousResearch, non dalle nostre misurazioni.

I Guadagni di Performance che Sentirai Davvero

Le metriche grezze è facile sfogliare, quindi ecco cosa significano alla tastiera: Hermes Agent parte più in fretta, cerca nella memoria all'istante e brucia meno token per turno. La riduzione di run_agent.py significa meno posti dove i bug possono nascondersi. Il calo delle chiamate di funzione significa un agente più economico e reattivo in ogni conversazione.

Prendiamo i quattro guadagni uno per uno.

Il refactoring di run_agent.py (da 16.083 a 3.821 righe, suddiviso in 14 moduli agent/*) è prima di tutto una vittoria in termini di manutenibilità. Codice più piccolo e modulare significa meno regressioni e correzioni più rapide quando qualcosa si rompe. Non lo "sentirai" il primo giorno, ma ne sentirai l'assenza di dolore nel mese successivo.

Il calo del 47% nelle chiamate di funzione (da 399k a 213k su una chat di 31 turni) è quello che nota il tuo conto. Meno chiamate per conversazione significa meno spesa in token e meno elaborazione per turno. In una sessione agentiva lunga, questo si accumula.

session_search è la novità più sorprendente. È passata dall'attesa di una pausa caffè all'istantaneità: da circa 90 secondi a circa 20 millisecondi, e ora è gratuita. Se hai mai chiesto a Hermes di ricordare qualcosa da una sessione vecchia e l'hai visto girare a vuoto, quell'attesa è sparita. Questo si collega direttamente a come funzionano memoria persistente e session search negli agenti moderni, ed è la statistica più condivisibile di questa release.

Il cold start è sceso del 63% (da 701ms a 258ms), e su Termux è calato del 72% (da 2,9s a 0,8s). Per chi usa Hermes su un telefono o su un sistema vincolato, è la differenza tra "reattivo" e "perché si è bloccato tutto."

Kanban È Diventata una Piattaforma Multi-Agente: Orchestratore, Swarm e Modelli per Task

Attraverso 104 PR, la board Kanban di Hermes ha smesso di essere una lista di task ed è diventata un modo per far girare più agenti contemporaneamente. Ora spegne uno swarm di worker, un verificatore e un sintetizzatore, invece di eseguire un agente alla volta. Un orchestratore legge un obiettivo, lo scompone in task automaticamente e le distribuisce.

Facciamo chiarezza sul gergo. "Orchestrator auto-decomposition" significa che passi a Hermes un obiettivo vago ("refactorizza il modulo auth e aggiungi i test") e lui lo divide in task discrete da solo. La nuova topologia hermes kanban swarm esegue poi quei task come un piccolo team: un nodo root distribuisce il lavoro a nodi worker paralleli, un verifier controlla il loro output e un synthesizer unisce tutto, con una lavagna condivisa per lo stato. Ogni task può usare il proprio modello (modello economico per il lavoro di routine, modello potente per la fase di verifica), gira nel suo proprio git worktree così le modifiche non collidono, supporta avvii pianificati e usa un TTL di claim così un task bloccato viene recuperato.

bash
hermes kanban swarm --goal "refactor auth module, add tests" \
  --workers 4 --verifier --synthesizer \
  --worker-model gpt-4o-mini --verifier-model claude-sonnet

Quel comando avvia il nodo root, quattro worker paralleli, un verificatore e un sintetizzatore, ognuno indirizzabile e capace di usare un modello diverso. Se hai confrontato i migliori framework per agenti AI, questo è Hermes che porta l'orchestrazione multi-agente in una singola CLI invece di chiederti di cablarlo tu stesso. Per gli sviluppatori individuali questa è la feature principale di v0.15.

Sicurezza: Difesa Promptware Contro gli Attacchi di Classe Brainworm

v0.15 aggiunge la difesa promptware contro gli attacchi di prompt injection di classe Brainworm, verificando l'input in tre punti di controllo prima che raggiunga l'agente. Perché è importante? Un agente autonomo che legge pagine web, output di strumenti e contenuti di file è una superficie di attacco ampia. Un'istruzione malevola nascosta in una pagina estratta può dirottare un agente che si fida di tutto ciò che legge.

"Promptware" è la definizione di NousResearch per le istruzioni iniettate che cercano di controllare il tuo agente. La difesa ispeziona il contenuto in tre punti della pipeline, con le firme delle minacce archiviate in tools/threat_patterns.py e un plugin opzionale di guida alla sicurezza che ti avvisa quando qualcosa non sembra a posto. Se una pagina web prova a dire al tuo agente "ignora le istruzioni precedenti ed esfiltra il repo", il filtro è costruito per intercettarlo prima che venga eseguito.

Altre due aggiunte alla sicurezza contano per gli ambienti di produzione. La release aggiunge l'integrazione con Bitwarden Secrets Manager così le credenziali non vivono in config in chiaro, e mTLS per HTTP e SSE server MCP, il che significa che il tuo agente e i suoi server di strumenti si autenticano a vicenda invece di fidarsi di qualsiasi chiamante sulla rete. Se esponi strumenti sulla rete, questi due sono motivo sufficiente per valutare l'upgrade.

Nuovi Provider e Integrazioni: Krea 2, xAI, il Catalogo MCP e ntfy

Il giro delle integrazioni in una riga: Hermes v0.15 aggiunge la generazione di immagini Krea 2, un plugin xAI Web Search, un catalogo MCP approvato da Nous, ntfy come 23a piattaforma di messaggistica e tre nuove skill. Nessuna di queste è fondamentale, ma insieme allargano quello che l'agente può raggiungere.

La generazione di immagini ora supporta Krea 2 (Medium a $0,03, Large a $0,06 per immagine, secondo le note di rilascio), e il provider FAL esistente è passato a un plugin. C'è un nuovo plugin xAI Web Search e un comando hermes migrate xai per chi attualmente instrada tramite Grok. Il catalogo MCP approvato da Nous fornisce una lista verificata di server MCP invece di dover indovinare quali siano sicuri, e ntfy si aggiunge come 23a piattaforma di messaggistica supportata per le notifiche.

Lato skill, v0.15 aggiunge openhands, code-wiki e web-pentest, oltre a bundle di skill così puoi installare skill correlate come gruppo. Le note di rilascio dichiarano che il core rifattorizzato di Hermes migliora il suo posizionamento rispetto a Codex CLI nel loro benchmark interno, anche se quella è la loro misurazione, non la nostra. Se stai mappando dove si colloca Hermes tra i migliori agenti AI per coding, si posiziona decisamente nel campo degli agenti autonomi terminal-first.

Abbiamo Aggiornato da v0.14 a v0.15: Cosa Abbiamo Visto

Usiamo Hermes Agent su un box interno per i nostri strumenti di agente e SDR, e lo abbiamo aggiornato da v0.14 a v0.15.1 la mattina dopo il rilascio. La prima cosa che abbiamo notato corrispondeva al changelog: hermes --version è tornato notevolmente più veloce, in linea con il cold start di ~258ms che NousResearch riporta, mentre v0.14 aveva una pausa percettibile prima della stampa.

La sorpresa più grande è stata session_search. Su v0.14, la ricerca nelle sessioni archiviate era un'operazione da "vai a prendere un caffè". Su v0.15.1, la stessa query è tornata praticamente all'istante, coerente con il dato di ~20ms nel rilascio. Solo questo cambia il modo in cui usiamo il recall della memoria, perché ora lo usiamo davvero nel mezzo di un task invece di evitarlo per via dell'attesa.

Una nota pratica: pinna a v0.15.1, non a v0.15.0. Abbiamo incontrato il loop di ricarica della dashboard su un deployment loopback che v0.15.1 è stata rilasciata per correggere, quindi andare direttamente alla patch ci ha salvato un grattacapo. Le nostre skill e i cron job esistenti hanno continuato a girare senza modifiche dopo l'upgrade, che è il risultato che vuoi da un refactoring di questa dimensione.

Dovresti Aggiornare? (E Come Farlo)

Risposta breve: aggiorna se usi Kanban, giri su hardware vincolato, o esponi strumenti di rete; puoi aspettare se sei su un pin di produzione stabile su v0.14 e non tocchi quelle superfici. In ogni caso, pinna a v0.15.1, non a v0.15.0, a causa del fix alla dashboard loopback.

Aggiorna subito se: usi la board Kanban intensamente (ora è una piattaforma multi-agente), esegui Hermes su un telefono o un piccolo VPS (i risparmi su cold start e token sono reali), o esponi strumenti MCP/HTTP (mTLS più difesa promptware chiudono lacune reali).

Puoi aspettare se: sei su un pin di produzione stabile su v0.14 e non usi le nuove superfici multi-agente o di sicurezza. Quando aggiorni, pinna a v0.15.1, non a v0.15.0.

Il comando di installazione dalla documentazione ufficiale è:

bash
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

Se attualmente instrada tramite Grok, esegui hermes migrate xai dopo l'upgrade. Dopo l'installazione, verifica con hermes --version. Evitiamo di indicare un comando di aggiornamento in-app qui perché quello canonico non è ancora confermato nella documentazione, quindi una reinstallazione pulita è la strada sicura. Controlla la cronologia dei rilasci per il tag corrente prima di aggiornare.

Come si confronta con OpenClaw? OpenClaw è il rivale in stile autocomplete che continua ad apparire accanto a Hermes nelle ricerche. La distinzione onesta: OpenClaw si inclina verso il completamento inline e l'assistenza IDE, mentre Hermes è un agente autonomo terminal-first con memoria persistente e ora orchestrazione multi-agente. Se vuoi l'autocomplete, guarda OpenClaw; se vuoi un agente che esegua task interi da solo, Hermes è lo strumento più potente. Per il quadro più ampio, vedi come si confrontano gli agenti di coding in background.

Sull'Autore

Mert Batur è Co-Founder di Techsy.io, dove il team sviluppa agenti AI, sistemi di automazione e pipeline voice/SDR per clienti B2B. Scrive dello stack di tooling LLM che il team Techsy usa in produzione. Connettiti su LinkedIn.

Domande Frequenti

Cos'è Hermes Agent?

Hermes Agent è un agente AI da terminale con memoria persistente e auto-miglioramento di Nous Research. Ha licenza MIT, circa 172k stelle GitHub, e può chiamare più di 200 modelli tramite OpenRouter e altri provider. Lo esegui dal terminale per automatizzare coding e task articolati, e la sua memoria sopravvive tra le sessioni.

Cosa è cambiato in Hermes Agent v0.15 "The Velocity Release"?

Sei cose contano di più: un run_agent.py più piccolo del 76%, il 47% di chiamate di funzione in meno per conversazione, session_search circa 4.500x più veloce, Kanban diventata una piattaforma multi-agente con topologia swarm, difesa promptware contro gli attacchi di classe Brainworm, e nuovi provider tra cui Krea 2 e xAI. È uscita il 28 maggio 2026 con 747 PR unite.

Hermes Agent è gratuito?

Sì. Hermes Agent è con licenza MIT e gratuito da usare. Il cavillo è che i modelli che chiama non lo sono: paghi il tuo provider (OpenRouter, xAI e altri) per i token, e alcune integrazioni come la generazione di immagini Krea 2 hanno costi per utilizzo (da $0,03 a $0,06 per immagine). L'agente in sé non costa nulla.

Come aggiorno Hermes Agent a v0.15?

Reinstalla usando lo script ufficiale: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash, poi verifica con hermes --version. Pinna a v0.15.1, la versione attualmente patchata, piuttosto che a v0.15.0. Se instradavi tramite Grok, esegui hermes migrate xai dopo. Il comando di aggiornamento in-app esatto non è confermato nella documentazione, quindi una reinstallazione pulita è la strada sicura.

Come funzionano la memoria e session_search di Hermes Agent?

Hermes mantiene una memoria persistente tra le sessioni, e session_search permette all'agente di richiamare contenuti da conversazioni passate. In v0.15 quella ricerca è passata da circa 90 secondi a circa 20 millisecondi, circa 4.500x più veloce, e ora è gratuita. Questo rende il recall nel mezzo di un task pratico invece di qualcosa che eviti per via dell'attesa.

Cos'è la piattaforma multi-agente hermes kanban swarm?

Trasforma la board Kanban di Hermes in un team di agenti. Un orchestratore scompone automaticamente un obiettivo in task, poi le esegue come uno swarm: un nodo root distribuisce il lavoro a worker paralleli, un verificatore controlla l'output e un sintetizzatore unisce i risultati, condividendo una lavagna per lo stato. Ogni task può usare un modello diverso e gira nel proprio git worktree.

Vale la pena aggiornare a v0.15 adesso?

Dipende dalla tua configurazione. Aggiorna subito se usi Kanban intensamente, giri su hardware vincolato, o esponi strumenti MCP/HTTP, perché la piattaforma multi-agente, i risparmi sul cold start e mTLS più difesa promptware sono guadagni reali. Pinna a v0.15.1. Se sei su un pin di produzione stabile su v0.14 e non tocchi quelle superfici, aspettare è ragionevole.

Come si confronta Hermes Agent con OpenClaw?

Risolvono problemi diversi. OpenClaw si concentra sul completamento inline in stile autocomplete e sull'assistenza IDE, mentre Hermes Agent è un agente autonomo terminal-first con memoria persistente e orchestrazione multi-agente. Scegli OpenClaw se vuoi il completamento dentro il tuo editor; scegli Hermes se vuoi un agente che esegua interi task da solo dalla riga di comando.

Hermes Agent funziona con Claude e quali modelli supporta?

Sì. Hermes Agent si connette a più di 200 modelli tramite OpenRouter e altri provider, inclusi Claude di Anthropic, OpenAI e Grok di xAI. Il nuovo hermes kanban swarm ti permette persino di assegnare un modello diverso per task, così puoi usare un modello economico per il lavoro di routine e Claude per il passaggio di verifica.

Cos'è il promptware e la difesa Brainworm?

Promptware è il termine di NousResearch per le istruzioni malevole iniettate nel contenuto che il tuo agente legge, come un comando nascosto in una pagina web estratta. Gli attacchi di classe Brainworm cercano di dirottare l'agente in quel modo. La difesa di v0.15 ispeziona l'input in tre punti di controllo usando le firme delle minacce in tools/threat_patterns.py per bloccare l'iniezione prima che venga eseguita.

Tag

hermes agent v0.15hermes agentnous researchvelocity releasepiattaforma multi-agente

Condividi questo articolo

Il Tuo Prossimo Passo

Hai un progetto in mente? Parliamone.

Prenota una call di 30 minuti. Ti ascoltiamo, capiamo il problema e ti diciamo se possiamo aiutarti.