account_tree AI

Cos'è un harness AI: il ciclo agente-strumenti-permessi

calendar_today personTeam EGSOFT schedule5 min di lettura

Il problema: un LLM non può "fare" nulla da solo

Un modello linguistico, da solo, sa solo una cosa: prevedere il prossimo pezzo di testo dato un contesto. Non può leggere un file, eseguire un comando o navigare un sito. Per trasformarlo in un assistente capace di compiere azioni reali — scrivere codice, gestire un server, cercare informazioni — serve un livello software intermedio che i tecnici chiamano harness (letteralmente "imbracatura"): il programma che riceve le richieste dell'utente, le passa al modello insieme al contesto necessario, interpreta la risposta e la traduce in azioni concrete sul sistema.

Il ciclo agente: pensa, agisci, osserva

Un harness AI moderno funziona a cicli. Ad ogni passaggio, il modello riceve la conversazione fino a quel momento più l'elenco degli strumenti disponibili (ad esempio "leggi file", "esegui comando", "cerca sul web"), ciascuno con una descrizione precisa di cosa fa e quali parametri accetta. Il modello decide se rispondere direttamente oppure richiedere l'uso di uno strumento, specificando i parametri in un formato strutturato (tipicamente JSON). L'harness intercetta questa richiesta, la esegue davvero sul sistema, e restituisce il risultato al modello come nuovo contesto. Il ciclo si ripete finché il modello non ha abbastanza informazioni per fornire una risposta finale.

Il livello dei permessi

Dare a un modello linguistico la possibilità di eseguire comandi reali è potente ma rischioso: un errore di interpretazione, o un input malevolo nascosto in un documento che il modello sta leggendo, potrebbe portare a un'azione indesiderata. Per questo un harness ben progettato include un livello di permessi: alcune azioni (leggere un file, cercare informazioni) vengono eseguite senza chiedere conferma, mentre altre più delicate o irreversibili (cancellare file, inviare messaggi, modificare configurazioni di produzione) richiedono un'approvazione esplicita dell'utente prima di procedere. Le implementazioni più mature aggiungono anche un sandboxing dell'esecuzione, limiti di tempo e di risorse, e un log dettagliato di ogni azione compiuta.

Gestire il contesto

Un'altra sfida tecnica dell'harness è la gestione della finestra di contesto: la quantità di testo che il modello può "vedere" contemporaneamente è limitata. Man mano che una sessione di lavoro si allunga — file letti, comandi eseguiti, risultati intermedi — l'harness deve decidere cosa mantenere in memoria attiva e cosa riassumere o scartare, per evitare di superare il limite senza perdere le informazioni davvero rilevanti per il compito in corso.

Perché è utile capirlo

Capire questo meccanismo aiuta a usare meglio qualsiasi assistente AI agentico: sapere che ogni azione passa attraverso un ciclo di richiesta-esecuzione-osservazione spiega perché a volte un modello "si ferma a chiedere conferma", perché può bloccarsi su compiti troppo lunghi, e perché la qualità delle descrizioni degli strumenti disponibili influisce direttamente sulla qualità delle decisioni che il modello prende.

account_treeAltri articoli su AI grid_viewTutti gli articoli
Scrivici su WhatsApp