Passa al contenuto principale

Che cos'è il tool calling?

Il tool calling è il processo di invocazione di uno strumento esterno per completare un'attività. Esplora ogni passaggio, dalla selezione di uno strumento all'elaborazione della sua risposta.

di Staff di Databricks

  • Il tool calling è il meccanismo che consente ai modelli AI di interagire con strumenti esterni, API e sistemi, trasformando i chatbot di base in agenti AI in grado di compiere azioni nel mondo reale.
  • Il processo segue un ciclo strutturato: il modello riconosce quando è necessario uno strumento, seleziona quello corretto, crea una richiesta, elabora la risposta e fornisce un risultato all'utente.
  • Databricks Agent Bricks offre una piattaforma governata per la creazione di agenti di tool calling basati su dati aziendali, con supporto nativo per il Model Context Protocol (MCP) e la governance di Unity Catalog.

Il tool calling è la capacità di un modello AI di interagire con strumenti esterni, API o sistemi per eseguire azioni e recuperare informazioni che vanno oltre le capacità autonome del modello. Invece di affidarsi esclusivamente alle conoscenze integrate nei suoi dati di addestramento, un modello con funzionalità di tool calling è in grado di riconoscere quando la richiesta di un utente richiede un aiuto esterno, selezionare lo strumento appropriato e strutturare una richiesta per completare il lavoro.

Questa è la funzionalità che distingue un chatbot statico da un agente AI funzionale. Senza il tool calling, un modello linguistico di grandi dimensioni può solo generare testo in base ai pattern appresi durante l'addestramento. Grazie ad esso, lo stesso modello può controllare l'inventario in tempo reale, interrogare un database, inviare un'e-mail, eseguire codice o chiamare un'API di terze parti. Il tool calling dà le mani ai modelli AI.

Perché il tool calling è importante per gli agenti AI

Gli agenti AI sono sistemi in grado di percepire l'ambiente circostante, prendere decisioni e agire per raggiungere determinati obiettivi. Il tool calling è ciò che rende possibile la parte dell'"agire". Un agente che non può chiamare strumenti è limitato alla semplice conversazione. Un agente in grado di chiamare strumenti diventa un collaboratore attivo.

Il passaggio dall'AI generativa all'AI agentica

L'AI generativa produce testi, immagini e codice. L'AI agentica va oltre, pianificando flussi di lavoro multifase, utilizzando strumenti per eseguire ogni passaggio e adattandosi in base ai risultati. Il tool calling rappresenta il ponte tra questi due paradigmi. È il meccanismo attraverso il quale un modello AI smette di descrivere ciò che si potrebbe fare e inizia a farlo concretamente.

Perché suscita l'interesse delle aziende

I vantaggi per il business sono evidenti. Secondo Gartner, il 40% delle applicazioni aziendali integrerà agenti AI specifici per determinati task entro la fine del 2026, rispetto a meno del 5% nel 2025. Questa crescita dipende dall'affidabilità del tool calling. Se un agente non può interrogare in modo affidabile un CRM, aggiornare un record o avviare un flusso di lavoro a valle, non può offrire un valore di livello enterprise.

Il tool calling cambia anche il modo in cui i team pensano all'automazione. Invece di creare integrazioni rigide e basate su regole per ogni possibile flusso di lavoro, le organizzazioni possono distribuire agenti AI che selezionano e richiamano dinamicamente gli strumenti giusti in base al contesto. Ciò rende i sistemi più flessibili e riduce il sovraccarico ingegneristico legato alla manutenzione di fragili connessioni punto a punto.

Come funziona il tool calling dell'AI?

Il tool calling segue un ciclo strutturato. Il modello non esegue direttamente gli strumenti. Al contrario, genera richieste strutturate che vengono soddisfatte da un livello applicativo, per poi incorporare i risultati nella sua risposta. Ecco come funziona il processo passo dopo passo.

Passo 1. Riconoscere quando è necessario uno strumento

Il processo inizia quando un utente invia una richiesta a cui il modello non può rispondere solo con i suoi dati di addestramento. Se un utente chiede "Qual è la capitale della Francia?", il modello risponde direttamente. Se un utente chiede "Quali sono stati i nostri dati di vendita del Q2?", il modello riconosce che deve interrogare una fonte di dati esterna.

Questo riconoscimento dipende dall'addestramento del modello. I modelli che supportano il tool calling sono stati ottimizzati tramite fine-tuning per identificare quando una query esula dai limiti delle loro conoscenze e quando uno strumento disponibile potrebbe essere d'aiuto. Il modello valuta l'intento dell'utente rispetto all' elenco di strumenti a cui gli è stato consentito l'accesso.

Passo 2. Scegliere lo strumento giusto

Una volta stabilito che è necessario uno strumento, il modello seleziona quello più appropriato dal set a sua disposizione. Ciascun strumento viene descritto al modello tramite uno schema che include il nome dello strumento, la sua funzione e i parametri che accetta. Il modello confronta la richiesta dell'utente con queste descrizioni per scegliere lo strumento corretto.

Ad esempio, se un agente ha accesso sia a un'API meteo sia a uno strumento di query del database, e l'utente chiede informazioni sulle previsioni di domani, il modello seleziona l'API meteo. Se l'utente chiede informazioni sulle entrate del mese scorso, seleziona lo strumento di query del database.

Passo 3. Creazione e invio della richiesta

Dopo aver selezionato uno strumento, il modello genera un output strutturato, in genere in formato JSON, che specifica quale strumento chiamare e quali argomenti passare. Il modello non esegue direttamente questa chiamata: produce la richiesta e il livello applicativo ne gestisce l'esecuzione.

Passo 4. Ricezione ed elaborazione della risposta

Lo strumento esterno esegue la richiesta e restituisce un risultato. Potrebbe trattarsi del payload di dati di un database, della conferma del completamento di un'azione, di un messaggio di errore o di qualsiasi altra risposta strutturata. Il livello applicativo ritrasmette questo risultato al modello come contesto per generare la risposta finale.

Passo 5. Fornitura della risposta o esecuzione di un'azione

Una volta ottenuta la risposta dello strumento, il modello sintetizza una risposta in linguaggio naturale per l'utente. Se l'utente ha richiesto i dati di vendita del Q2, il modello potrebbe rispondere: "Le vendite del Q2 2026 in Nord America sono state pari a 14,3 milioni di dollari, in crescita del 12% rispetto al Q1". Il modello combina i dati grezzi dello strumento con le sue capacità linguistiche per produrre una risposta chiara e contestualizzata.

In alcuni casi, il risultato non è una risposta conversazionale ma un'azione eseguita, come un'e-mail inviata, un record del database aggiornato o un flusso di lavoro avviato. Il modello conferma l'azione all'utente.

Passo 6. Iterazione e perfezionamento del risultato

Il tool calling non si limita sempre a un singolo passaggio. Le richieste complesse possono richiedere più chiamate di strumenti in sequenza. Ad un agente a cui viene chiesto di "preparare un riepilogo delle prestazioni dell'ultimo trimestre e inviarlo via e-mail al team di leadership" potrebbe prima interrogare un database per ottenere le metriche sulle prestazioni, poi chiamare uno strumento di esecuzione del codice per generare un grafico e infine richiamare un'API e-mail per inviare il riepilogo.

In ogni fase, il modello valuta se dispone di informazioni sufficienti per procedere o se sono necessarie ulteriori chiamate di strumenti. Questo ciclo iterativo è ciò che rende i sistemi AI agentici in grado di gestire flussi di lavoro multifase.

Tipologie comuni di tool calling

Il tool calling non segue un unico pattern. Casi d'uso diversi richiedono tipi diversi di strumenti, ciascuno con uno scopo preciso nel flusso di lavoro di un agente.

Ricerca e recupero delle informazioni

Il tipo più comune di tool calling prevede il recupero di dati che il modello non possiede. Ciò include l'interrogazione di database, la ricerca in repository di documenti, la chiamata di API di ricerca o il recupero di informazioni in tempo reale come prezzi delle azioni, dati meteo o notizie. La Retrieval-Augmented Generation (RAG) è una forma specifica di questo pattern in cui il modello interroga una knowledge base per basare le sue risposte su dati verificati.

Esecuzione del codice

Alcuni task richiedono che il modello scriva ed esegua codice anziché limitarsi a generare testo. Gli strumenti di esecuzione del codice consentono agli agenti di eseguire calcoli, trasformare dati, generare visualizzazioni o eseguire script analitici. Un agente di codifica AI potrebbe scrivere una funzione Python, eseguirla in un ambiente sandbox e restituire l'output all'utente.

Automazione dei processi

Il tool calling consente agli agenti di avviare azioni in sistemi esterni. Ciò include l'invio di e-mail, la creazione di ticket in strumenti di gestione dei progetti, l'aggiornamento dei record del CRM, l'avvio di flussi di lavoro di approvazione o la pubblicazione di messaggi su piattaforme di comunicazione. Questi strumenti trasformano gli agenti in partecipanti attivi nei processi aziendali, anziché in semplici osservatori passivi.

Dispositivi smart e monitoraggio IoT

In contesti industriali e operativi, il tool calling collega gli agenti AI a sistemi fisici. Un agente potrebbe interrogare i dati dei sensori dei macchinari di produzione, regolare le impostazioni del termostato in un edificio intelligente o monitorare la telemetria dei veicoli di una flotta. Queste integrazioni estendono le capacità dell'AI dal mondo digitale a quello fisico.

Report

Il playbook sull'AI agentiva per l'enterprise

Tool calling vs. function calling

Questi due termini sono strettamente correlati e spesso usati come sinonimi, ma esiste una distinzione significativa che vale la pena comprendere.

Tool callingFunction calling
AmbitoCapacità ad ampio raggio che include API, database, esecuzione di codice, servizi esterni e qualsiasi risorsa richiamabileMeccanismo specifico in cui il modello genera argomenti per una funzione predefinita
ContestoUtilizzato nei framework di AI agentica in cui i modelli orchestrano flussi di lavoro multifase su più strumentiIntrodotto originariamente da OpenAI nel 2023 per descrivere la generazione di output strutturati per l'invocazione di funzioni
RelazioneIl concetto ombrelloUn sottoinsieme del tool calling
Uso nel settoreIl termine su cui si è allineato il settore con l'evoluzione e il potenziamento degli agenti AIAncora utilizzato in alcune documentazioni API e in contesti legacy

Il function calling è il modo in cui è iniziato il tool calling. Quando OpenAI ha introdotto per la prima volta questa funzionalità, è stata presentata come un modo per consentire ai modelli di generare argomenti strutturati per funzioni definite dagli sviluppatori. Con la maturazione dell'ecosistema e l'inizio dell'orchestrazione da parte degli agenti di workflow più complessi che coinvolgono molteplici sistemi esterni, il termine più ampio "tool calling" è diventato lo standard.

In pratica, se si sta leggendo una documentazione che parla di "function calling", sta descrivendo lo stesso meccanismo di base. Databricks supporta entrambi i termini nella sua documentazione e nelle funzionalità della piattaforma. Per un'analisi più approfondita di come viene valutato il function calling nella pratica, consulta i benchmark di function calling di Databricks .

Esempi reali di AI tool calling in azione

Il tool calling è già operativo in produzione in vari settori. Ecco alcuni esempi concreti di come le organizzazioni lo utilizzano.

Agenti del servizio clienti

Un agente del servizio clienti riceve un messaggio da un cliente che chiede informazioni sullo stato di un ordine. L'agente chiama uno strumento per interrogare il sistema di gestione degli ordini, recupera le informazioni di tracciamento e risponde con una stima di consegna. Se il cliente desidera modificare l'indirizzo di spedizione, l'agente chiama uno strumento di aggiornamento per modificare il record. Ogni interazione con gli strumenti è governata e verificabile attraverso piattaforme come Unity Catalog , che applica controlli di accesso e mantiene la lineage dalle azioni dell'agente ai dati di origine.

Workflow di analisi dei dati

Un analista chiede a un agente AI di confrontare le entrate di questo trimestre tra le varie aree geografiche. L'agente chiama uno strumento di query SQL per estrarre i dati dal lakehouse, chiama uno strumento di esecuzione del codice per calcolare i tassi di crescita e generare un grafico, quindi restituisce un riepilogo formattato. Ciò che avrebbe richiesto a un analista 30 minuti di query manuali e lavoro su fogli di calcolo avviene in un unico scambio conversazionale.

Operazioni IT e monitoraggio

Un team di operation distribuisce un agente che monitora lo stato dell'infrastruttura. Quando l'utilizzo della CPU di un server supera una soglia, l'agente chiama uno strumento di diagnostica per raccogliere i log di sistema, chiama uno strumento di avviso per notificare l'ingegnere reperibile e chiama uno strumento di remediation per scalare automaticamente le risorse. L'agente gestisce il workflow di prima risposta senza intervento umano.

Ricerca aziendale e gestione della conoscenza

Un dipendente chiede a un assistente AI interno informazioni sulla politica aziendale per il congedo parentale. L'agente chiama uno strumento di recupero per cercare nella knowledge base delle risorse umane (HR), trova il documento relativo alla policy e restituisce una risposta concisa con un link al documento completo. Questo pattern sostituisce la comune esperienza di ricerca all'interno di una rete intranet e di lettura di più pagine per trovare una risposta specifica.

Inizia a creare agenti AI con il tool calling su Databricks

Databricks offre una piattaforma completa per creare, distribuire e governare agenti di tool calling tramite Agent Bricks. Secondo Databricks, le organizzazioni hanno già creato oltre 100.000 agenti sulla piattaforma, elaborando più di un milione di miliardi di token all'anno.

In che modo Databricks supporta il tool calling

Agent Bricks supporta nativamente il Model Context Protocol (MCP), lo standard aperto emergente per l'integrazione degli strumenti. Questo offre agli agenti un accesso sicuro ad API, database e applicazioni SaaS attraverso un'interfaccia standardizzata. Gli strumenti MCP possono essere individuati e condivisi all'interno di un'organizzazione tramite un catalogo integrato, con ogni integrazione visibile, autorizzata e verificabile tramite Unity Catalog.

Gli sviluppatori possono connettere gli agenti agli strumenti in diversi modi:

  • Server MCP gestiti per le origini dati Databricks
  • Server MCP esterni registrati come servizi MCP controllati
  • Funzioni di Unity Catalog per logica personalizzata e strumenti specifici per i task
  • Strumenti personalizzati creati con l'SDK Agent basato su Python

L'SDK Agent gestisce l'esecuzione degli strumenti, il function calling, i workflow multifase e la gestione dello stato della conversazione. Gli sviluppatori definiscono quali strumenti l'agente può utilizzare e come deve comportarsi nelle conversazioni a più turni.

Per iniziare

Per i team che esplorano il tool calling per la prima volta, l'AI Playground offre un ambiente sandbox no-code in cui è possibile selezionare un LLM, aggiungere strumenti e testare il comportamento dell'agente prima di esportarlo in codice. Agent Bricks supporta i più diffusi framework di orchestrazione per agenti, tra cui LangGraph, CrewAI, Agno, Claude Code SDK e gli SDK Agent di OpenAI, consentendo ai team di sviluppare con i framework che già conoscono.

La governance è integrata fin dall'inizio. La governance degli agenti e dei dati viene gestita direttamente in Unity Catalog, con controlli di accesso basati sui ruoli applicati a modelli, strumenti e connessioni. Le policy a livello aziendale per la prevenzione del prompt injection, il rilevamento dei dati sensibili e il filtraggio dei contenuti sono configurate all'interno di un unico piano di controllo.

Per iniziare a creare e testare agenti di tool calling sui tuoi dati, esplora Agent Bricks e il framework degli strumenti per agenti di Databricks .

Domande frequenti

Cosa significa tool calling nell'ambito dell'AI?

Il tool calling è la capacità di un modello AI di richiamare strumenti esterni, API o sistemi per eseguire attività che vanno oltre la generazione di testo. Consente ai modelli di recuperare dati in tempo reale, eseguire codice e attivare azioni in applicazioni esterne.

Qual è la differenza tra tool calling e function calling?

Il function calling è un sottoinsieme del tool calling. Il function calling si riferisce specificamente a un modello che genera argomenti strutturati per una funzione predefinita. Il tool calling è il concetto più ampio che comprende il function calling insieme a integrazioni API, query di database, esecuzione di codice e altre interazioni esterne.

Come funziona il tool calling nei LLM?

Un LLM con supporto per il tool calling segue un ciclo: riconosce quando la richiesta di un utente richiede uno strumento esterno, seleziona lo strumento appropriato dal set disponibile, genera una richiesta strutturata con i parametri corretti e quindi incorpora la risposta dello strumento nella sua risposta finale. Il modello non esegue direttamente gli strumenti, ma produce un output strutturato che viene elaborato da un livello applicativo.

Qual è il miglior LLM per il tool calling?

Le prestazioni del tool calling variano in base al modello e al caso d'uso. La Berkeley Function Calling Leaderboard (BFCL) è il benchmark di riferimento più diffuso per valutare l'affidabilità del tool calling tra i vari modelli. Databricks supporta molteplici provider di LLM, inclusi i modelli di OpenAI, Anthropic, Google e Meta, consentendo ai team di selezionare e confrontare i modelli in base ai loro requisiti specifici.

Qual è la differenza tra AI tool calling e MCP?

Il tool calling è la funzionalità. L'MCP (Model Context Protocol) è un livello di standardizzazione per il modo in cui gli strumenti vengono descritti, individuati e richiamati. L'MCP fornisce un'interfaccia coerente in modo che gli agenti possano connettersi a qualsiasi strumento compatibile con MCP senza codice di integrazione personalizzato. Databricks Agent Bricks supporta nativamente l'MCP per l'accesso controllato agli strumenti.

Perché il tool calling è importante per gli agenti AI?

Senza il tool calling, gli agenti AI si limitano a generare testo in base ai dati di addestramento. Il tool calling offre agli agenti la capacità di agire: interrogare database, chiamare API, inviare messaggi, eseguire codice e attivare workflow. È il meccanismo fondamentale che trasforma un modello linguistico in un agente AI autonomo in grado di completare attività reali.

(Questo post sul blog è stato tradotto utilizzando strumenti basati sull'intelligenza artificiale) Post originale

Ricevi gli ultimi articoli nella tua casella di posta

Iscriviti al nostro blog e ricevi gli ultimi articoli direttamente nella tua casella di posta.