Come creare contenuti AI con gli strumenti di Intelligenza Artificiale Generativa in Agent Studio
Gli strumenti di Intelligenza Artificiale Generativa in Agent Studio ti permettono di creare testo, audio, immagini e video generati dall'AI all'interno di un flusso agente. Questi strumenti vengono aggiunti come nodi di elaborazione e possono usare prompt, impostazioni di Brand Voice e Brand Kit, e variabili per generare contenuti durante una conversazione o un Workflow. L'output generato viene salvato in una variabile per essere utilizzato successivamente nel flusso agente.
Questo articolo tratta gli strumenti di Intelligenza Artificiale Generativa all'interno di Agent Studio. Agent Studio è separato da AI Studio.
INDICE DEI CONTENUTI
- Cosa sono gli strumenti di IA Generativa?
- Principali vantaggi degli strumenti di IA Generativa
- Come configurare ogni strumento di IA Generativa in Agent Studio
- Configurare la Generazione di Testo
- Configurare la Generazione di Audio
- Configurare la Generazione di Immagini
- Configurare la Generazione di Video
- Usare le variabili con gli strumenti di IA Generativa
- Domande frequenti
Cosa sono gli strumenti di IA Generativa?
Gli strumenti di IA Generativa sono nodi di elaborazione che permettono a un agente di creare contenuti mentre è in esecuzione. Invece di creare manualmente ogni messaggio, immagine, file audio o video al di fuori dell'agente, questi strumenti consentono all'agente di generare contenuti in base al prompt e alla configurazione che fornisci.
Gli strumenti di IA Generativa disponibili sono:
-
Text Generation: Genera contenuto scritto come riepiloghi, risposte, descrizioni, didascalie, raccomandazioni o testo strutturato.
-
Audio Generation: Genera audio da un prompt e salva l'URL dell'audio generato in una variabile.
-
Image Generation: Genera immagini da un prompt e salva l'URL dell'immagine generata in una variabile.
-
Video Generation: Genera video da un prompt video dettagliato e salva o utilizza l'output generato in base alla configurazione impostata.
Principali vantaggi degli strumenti di IA Generativa
Gli strumenti di IA Generativa aiutano gli agenti a creare contenuti dinamici senza dover preparare manualmente ogni risposta o asset. Questo rende i flussi agente più flessibili, personalizzati e utili in Conversazioni, Campaign e automazioni.
-
Creazione automatica di contenuti: Genera testo, audio, immagini e video direttamente all'interno di un flusso agente.
-
Output generati riutilizzabili: Salva i contenuti generati dall'AI in variabili per usarli successivamente nell'agente.
-
Coerenza del brand: Usa le impostazioni di Brand Voice e Brand Kit per allineare i contenuti generati al tono e all'identità visiva del business.
-
Flussi agente flessibili: Aggiungi passaggi di generazione contenuti ovunque nel flusso in cui l'agente debba crearli.
-
Personalizzazione migliorata: Usa variabili dei passaggi precedenti per generare output più pertinenti e contestuali.
Come configurare ogni strumento di IA Generativa in Agent Studio
Gli strumenti di IA Generativa vengono aggiunti dall'agent builder come nodi di elaborazione. Aggiungere lo strumento nella parte corretta del flusso garantisce che il contenuto venga generato nel momento giusto e salvato per un uso successivo.
Per aggiungere uno strumento di IA Generativa a un agente:
- Vai su AI Agents dal menu di navigazione a sinistra.
- Apri la scheda Agent Studio.
- Seleziona l'agente che vuoi configurare.
- Nel canvas dell'agent builder, individua il nodo in cui vuoi aggiungere l'azione di IA generativa.

- Clicca su Add a processing node.
- Nel pannello Add node, vai alla sezione Generative AI.
- Seleziona lo strumento che vuoi aggiungere:
- Audio Generation
- Image Generation
- Text Generation
- Video Generation
- Configura le impostazioni del nodo nel pannello laterale.
- Clicca su Save dopo aver completato i campi obbligatori.
Lo strumento di IA Generativa selezionato viene aggiunto come passaggio di elaborazione all'interno del nodo. L'output generato può essere salvato in una variabile e utilizzato successivamente nel flusso agente.

Configurare la Generazione di Testo
Text Generation crea contenuto scritto dalle istruzioni che fornisci nel nodo. Usa questo nodo quando l'agente deve generare risposte, riepiloghi, didascalie, descrizioni, raccomandazioni, riscritture o output scritti strutturati.
Node Name
Il campo Node Name identifica il passaggio di Text Generation all'interno dell'agent builder. Questo campo è obbligatorio e ha come valore predefinito text_generation.
Rinomina il nodo quando vuoi che lo scopo del testo generato sia più facile da riconoscere in seguito, specialmente quando l'agente include più passaggi di elaborazione.
Esempi:
generate_summarycreate_responsewrite_product_description
Brand voice
Il dropdown Brand voice ti permette di applicare uno stile comunicativo salvato al testo generato.
Dal dropdown puoi:
- Selezionare None
- Scegliere una Brand Voice esistente
- Cliccare su + Add new per crearne una nuova
Lascia questo campo su None quando non è necessaria una Brand Voice specifica.
Text Prompt
Il campo Text Prompt indica all'AI quale testo generare. Questo campo è obbligatorio.
Non devi scrivere tu stesso l'output finale. Inserisci invece istruzioni che descrivano cosa l'AI deve creare, quali informazioni deve usare e come deve essere formattata la risposta. L'AI usa queste istruzioni per generare automaticamente il testo quando il nodo viene eseguito.
Un Text Prompt può istruire l'AI a:
- Riepilogare un messaggio di un contatto
- Generare una risposta
- Creare una breve didascalia
- Scrivere una risposta strutturata
- Riscrivere testo in un tono specifico
Usa il selettore di variabili all'interno del campo Text Prompt per inserire valori dinamici nel prompt. Usa la barra di ricerca per trovare rapidamente la variabile o il valore da includere.
Le categorie di variabili disponibili nel dropdown includono:
- Global Config: Inserisce valori dalla configurazione globale dell'agente.
- Input Variables: Inserisce valori passati all'agente all'avvio o all'invocazione.
- Runtime Variables: Inserisce valori creati o acquisiti mentre l'agente è in esecuzione.
- Account: Inserisce valori a livello di account.
- Custom values: Inserisce valori personalizzati salvati disponibili nell'account.
- Right now: Inserisce la data corrente o valori basati sull'ora.
- Contact: Inserisce valori specifici del contatto, come i dettagli di contatto.
Il pulsante Enhance Prompt aiuta a migliorare o espandere il prompt prima di salvare. Usa l'icona di espansione nel campo del prompt per aprire un'area di scrittura più grande per istruzioni più lunghe.
Evita prompt vaghi come "scrivi qualcosa". Descrivi invece l'obiettivo, il pubblico, il tono e il formato atteso.
Variable Name
Il campo Variable Name salva l'output di testo generato. Questo campo è obbligatorio.
Usa un nome di variabile significativo che descriva il testo generato, ad esempio:
generatedSummarygeneratedReplyproductDescription
Model
Il dropdown Model determina quale modello AI viene usato per generare il testo. Questo campo è obbligatorio.
Le opzioni di modello disponibili nell'interfaccia includono:
- gpt-4.1
- gpt-5-mini
Seleziona il modello più adatto al tipo di output che vuoi generare. Per risposte testuali generali, riepiloghi e contenuti strutturati, usa il modello predefinito o consigliato, a meno che la tua configurazione non richieda un modello diverso.
Text Length
Il campo Text Length controlla la lunghezza massima del testo generato. Questo campo è obbligatorio.
Puoi selezionare un'opzione predefinita o inserire un numero massimo di caratteri personalizzato compreso tra 5 e 20000.
Le opzioni di Text Length disponibili nell'interfaccia includono:
- Small: Genera una risposta più breve, come una risposta rapida, una didascalia o un breve riepilogo.
- Big: Genera una risposta più lunga per contenuti scritti più dettagliati.
- Custom: Ti consente di definire un numero massimo di caratteri specifico.

Configurare la Generazione di Audio
Audio Generation crea un file audio dalle istruzioni che fornisci nel nodo. Usa questo nodo quando l'agente deve produrre contenuto parlato, risposte vocali, messaggi audio o narrazioni.
Node Name
Il campo Node Name identifica il passaggio di Audio Generation nell'agent builder. Questo campo è obbligatorio e ha come valore predefinito audio_generation.
Rinomina il nodo quando vuoi che lo scopo dell'audio generato sia più facile da riconoscere in seguito.
Esempi:
generate_voice_responsecreate_audio_messageaudio_summary
Brand voice
Il dropdown Brand voice funziona allo stesso modo che per Text Generation. Usalo per applicare uno stile comunicativo salvato al prompt audio.
Dal dropdown puoi selezionare None, scegliere una Brand Voice esistente o cliccare su + Add new per crearne una nuova.
Prompt
Il campo Prompt indica all'AI quale audio generare. Questo campo è obbligatorio.
Non devi creare il file audio manualmente. Inserisci invece istruzioni che descrivano cosa l'audio deve dire o rappresentare. Puoi fornire il testo esatto da pronunciare o descrivere il tipo di contenuto audio necessario.
Un buon prompt audio può includere:
- Il messaggio parlato
- Tono
- Stile
- Ritmo
- Pubblico di riferimento
Usa il selettore di variabili all'interno del campo Prompt per inserire valori dinamici dal flusso agente, come dettagli del contatto o informazioni raccolte in precedenza.
Il pulsante Enhance Prompt aiuta a perfezionare o espandere il prompt prima di salvare. Usa l'icona di espansione nel campo Prompt per aprire un'area di scrittura più grande per istruzioni audio più lunghe.
Variable Name
Il campo Variable Name salva l'URL dell'audio generato. Questo campo è obbligatorio.
Usa un nome di variabile descrittivo, ad esempio:
generatedAudioUrlvoiceMessageUrlaudioResponseUrl
Model
Il dropdown Model determina quale modello text-to-speech genera l'audio. Questo campo è obbligatorio.
Il modello disponibile è:
- gpt-4o-mini-tts
Usa il modello selezionato a meno che la tua configurazione non richieda o renda disponibile un modello diverso.
Voice Name
Il dropdown Voice Name controlla quale voce viene usata per l'audio generato. Questo campo è obbligatorio.
Le opzioni di Voice Name disponibili includono:
- Alloy: Una voce equilibrata adatta per audio di uso generale.
- Ash: Una voce utilizzabile quando il suo tono si adatta al messaggio previsto.
- Ballad: Una voce utilizzabile per uno stile audio più fluido o espressivo.
- Coral: Una voce utilizzabile quando il suo suono corrisponde al tono del brand desiderato.
- Echo: Una voce utilizzabile per audio conversazionale o risposte parlate.
- Fable: Una voce utilizzabile per audio in stile narrativo o espressivo.
- Nova: Una voce utilizzabile per contenuto parlato chiaro e curato.
Scegli la voce che meglio corrisponde al tono previsto dell'audio, come caloroso, professionale, energico, calmo o conversazionale.

Configurare la Generazione di Immagini
Image Generation crea un'immagine dalle istruzioni che fornisci nel nodo. Usa questo nodo quando l'agente deve generare asset visivi per Campaign, contenuti social, concept di prodotto o altri casi d'uso basati su immagini.
Node Name
Il campo Node Name identifica il passaggio di Image Generation nell'agent builder. Questo campo è obbligatorio e ha come valore predefinito image_generation.
Rinomina il nodo quando vuoi che lo scopo dell'immagine generata sia più facile da riconoscere in seguito.
Esempi:
generate_product_imagecreate_social_imageimage_for_campaign
Brand voice
Il dropdown Brand voice funziona allo stesso modo che per Text Generation. Usalo quando il prompt immagine deve seguire un tono di Campaign, un pubblico o una direzione creativa specifici.
Dal dropdown puoi selezionare None, scegliere una Brand Voice esistente o cliccare su + Add new per crearne una nuova.
Design kit
Il dropdown Design kit ti permette di applicare il branding visivo salvato all'immagine generata.
Dal dropdown puoi:
- Selezionare None
- Scegliere un design kit esistente
- Cliccare su + Add new per crearne uno nuovo
Usa un Design kit quando l'immagine generata deve essere coerente con l'identità visiva del business. Questo può includere colori del brand, font, utilizzo del logo o altre preferenze visive salvate in base alla configurazione disponibile.
Image Prompt
Il campo Image Prompt indica all'AI quale immagine generare. Questo campo è obbligatorio.
Non devi creare l'immagine manualmente. Inserisci invece istruzioni che descrivano l'immagine che l'AI deve creare. Includi abbastanza dettagli affinché l'AI comprenda il soggetto, lo stile e la direzione visiva.
Un buon Image Prompt può includere:
- Soggetto
- Ambientazione
- Stile
- Colori
- Composizione
- Atmosfera
- Dettagli importanti che devono apparire nell'immagine
Esempio:
"Crea un'immagine in stile fotografico professionale di un tavolo di ristorante moderno con illuminazione calda, cibo fresco sul tavolo e un'atmosfera accogliente."
Usa il selettore di variabili all'interno del campo Image Prompt per inserire valori dal flusso agente, come il nome di un prodotto, il tema della Campaign, i dettagli del contatto o una risposta raccolta.
Il pulsante Enhance Prompt aiuta a migliorare o espandere il prompt prima di salvare. Usa l'icona di espansione nel campo Image Prompt per aprire un'area di scrittura più grande per istruzioni immagine più lunghe.
Variable Name
Il campo Variable Name salva l'URL dell'immagine generata. Questo campo è obbligatorio.
Usa un nome di variabile descrittivo, ad esempio:
generatedImageUrlcampaignImageUrlproductImageUrl
Model
Il dropdown Model determina quale modello AI di generazione immagini viene usato. Questo campo è obbligatorio.
Le opzioni di modello disponibili nell'interfaccia includono:
- GPT Image 1: Genera immagini usando il modello GPT Image.
- DALL·E 3: Genera immagini usando il modello DALL·E 3.
- Gemini 2.5 Flash Image Preview: Genera immagini usando il modello di anteprima immagini Gemini.
Seleziona il modello disponibile in base al tipo di output immagine che vuoi generare. Se è già selezionato un modello predefinito, usalo a meno che il tuo Workflow non richieda un modello diverso.
Image Size
Il dropdown Image Size controlla le dimensioni dell'immagine generata. Questo campo è obbligatorio.
Le opzioni di Image Size disponibili includono:
- 1024x1024: Crea un'immagine quadrata per asset creativi generali, thumbnail o post social.
- 1024x1792: Crea un'immagine in formato verticale per posizionamenti verticali.
- 1792x1024: Crea un'immagine in formato orizzontale per posizionamenti più ampi.
Image Quality
Il dropdown Image Quality controlla il livello di qualità dell'immagine generata. Questo campo è obbligatorio.
Le opzioni di Image Quality disponibili includono:
- Standard: Genera un output immagine di uso generale.
- Hd: Genera un output immagine di qualità superiore per asset creativi più curati.

Configurare la Generazione di Video
Video Generation crea contenuto video dalle istruzioni che fornisci nel nodo. Usa questo nodo quando l'agente deve produrre brevi video per Campaign, asset creativi, social media o altri casi d'uso visivi.
A differenza di Text, Audio e Image Generation, l'interfaccia di Video Generation mostrata qui non include un campo Variable Name. Configura le impostazioni video visibili nel pannello e verifica il comportamento dell'output nella configurazione del tuo agente.
Node Name
Il campo Node Name identifica il passaggio di Video Generation nell'agent builder. Questo campo è obbligatorio e ha come valore predefinito video_generation.
Rinomina il nodo quando vuoi che lo scopo del video generato sia più facile da riconoscere in seguito.
Esempi:
generate_promo_videocreate_product_videovideo_for_social_post
Brand voice
Il dropdown Brand voice funziona allo stesso modo che per Text Generation. Usalo quando il prompt video deve essere allineato al tono, allo stile comunicativo o alla direzione della Campaign di un business.
Dal dropdown puoi selezionare None, scegliere una Brand Voice esistente o cliccare su + Add new per crearne una nuova.
Design kit
Il dropdown Design kit funziona allo stesso modo che per Image Generation. Usalo quando il video generato deve seguire uno stile di brand o un'identità visiva specifica.
Dal dropdown puoi selezionare None, scegliere un design kit esistente o cliccare su + Add new per crearne uno nuovo.
Video prompt
Il campo Video prompt indica all'AI quale video generare. Questo campo è obbligatorio.
Non devi creare il video manualmente. Inserisci invece istruzioni che descrivano cosa deve accadere nel video e come deve apparire. Il testo segnaposto consiglia di essere specifici riguardo ad azioni, angolazioni della camera, illuminazione e stile.
Un buon Video prompt può includere:
- Soggetto
- Azione
- Scena o ambientazione
- Angolazioni della camera
- Illuminazione
- Stile visivo
- Movimento
- Atmosfera
Esempio:
"Un golden retriever che corre in un prato soleggiato, rallentatore, illuminazione cinematografica, colori caldi."
Usa il selettore di variabili all'interno del campo Video prompt per inserire valori dal flusso agente, come dettagli della Campaign, nomi di prodotti o risposte raccolte in precedenza.
Il pulsante Enhance Prompt aiuta a migliorare o espandere il prompt prima di salvare. Usa l'icona di espansione per aprire un'area di scrittura più grande per istruzioni video più lunghe.
AI Model
Il dropdown AI Model determina quale modello di generazione video viene usato. Questo campo è obbligatorio.
Le opzioni di AI Model disponibili includono:
- Veo3.1: Genera video usando il modello Veo3.1 standard.
- Veo3.1 Fast: Genera video usando l'opzione Veo3.1 più veloce.
Seleziona il modello più adatto al tipo di video che vuoi generare. Se la velocità è più importante per il tuo caso d'uso, scegli l'opzione più veloce quando disponibile. Se è già selezionato un modello predefinito, mantienilo a meno che il tuo Workflow non richieda un modello diverso.
Aspect Ratio
Il dropdown Aspect Ratio controlla la forma del video generato. Questo campo è obbligatorio.
Le opzioni di Aspect Ratio disponibili includono:
- 16:9: Crea un video orizzontale per contenuti web, video in stile YouTube, presentazioni o altri posizionamenti widescreen.
- 9:16: Crea un video verticale per contenuti social in formato breve o posizionamenti mobile-first.
Resolution
Il dropdown Resolution controlla la risoluzione di output del video generato. Questo campo è obbligatorio.
Le opzioni di Resolution disponibili includono:
- 720p: Genera il video a risoluzione 720p.
Seleziona la risoluzione disponibile in base ai requisiti di qualità e utilizzo del video. Se il campo è vuoto, seleziona una risoluzione prima di salvare.
AI Model Data Use Notice
La casella di spunta AI Model Data Use Notice spiega come i modelli AI di terze parti gestiscono i prompt e i contenuti generati per Video Generation.
La comunicazione indica che Agent Studio usa modelli AI di terze parti che possono conservare temporaneamente prompt e contenuti generati per un massimo di 30 giorni per il monitoraggio della sicurezza e la fornitura del servizio. Indica inoltre che i tuoi dati non verranno utilizzati per l'addestramento dei modelli e che la gestione dei dati varia a seconda del provider AI.
Leggila prima di salvare il nodo. Seleziona la casella di spunta per confermare la presa visione prima di continuare.
Il pulsante Save rimane disabilitato fino a quando tutti i campi obbligatori non sono stati completati e questa comunicazione non è stata confermata.

Usare le variabili con gli strumenti di IA Generativa
Le variabili aiutano gli strumenti di IA Generativa a creare output più pertinenti e a rendere disponibile il contenuto generato per i passaggi successivi. Capire la differenza tra variabili di input e variabili di output ti aiuta a configurare correttamente i prompt e a riutilizzare il contenuto generato.
Ci sono due modi comuni in cui le variabili vengono usate con gli strumenti di IA Generativa:
- Variabili di input nei prompt: Le variabili esistenti possono essere inserite nei prompt in modo che l'AI possa generare contenuti usando dettagli del contatto, risposte raccolte o output precedenti dell'agente.
- Variabili di output dal nodo: Text, Audio e Image Generation usano il campo Variable Name per salvare il nuovo output generato.
Ad esempio, un prompt può includere una variabile esistente come {{contact.first_name}} o un altro valore raccolto in precedenza nel flusso agente.
Le variabili di output generato possono includere:
- Un nodo Text Generation che salva il contenuto scritto generato
- Un nodo Audio Generation che salva un URL audio generato
- Un nodo Image Generation che salva un URL immagine generato
Usa nomi di variabili chiari e descrittivi in modo che l'output sia facilmente identificabile nei passaggi successivi.
Buoni nomi di variabili includono:
generatedReplygeneratedAudioUrlgeneratedImageUrlcampaignCaptionsummaryText
Evita nomi poco chiari che non spiegano l'output, specialmente quando l'agente contiene più passaggi di generazione AI.
Domande frequenti
D: Dove sono disponibili gli strumenti di IA Generativa?
Gli strumenti di IA Generativa sono disponibili all'interno di Agent Studio quando si aggiunge un nodo di elaborazione a un flusso agente.
D: Che tipi di contenuti possono generare questi strumenti?
Gli strumenti di IA Generativa disponibili possono generare testo, audio, immagini e video.
D: Tutti gli strumenti di IA Generativa salvano l'output in un campo Variable Name?
Text, Audio e Image Generation includono un campo Variable Name per salvare l'output generato. L'interfaccia di Video Generation mostrata qui non include un campo Variable Name.
D: Cosa fa il campo Variable Name?
Il campo Variable Name salva l'output generato in modo che possa essere referenziato successivamente nel flusso agente. Text Generation salva il testo generato, Audio Generation salva un URL audio generato e Image Generation salva un URL immagine generata.
D: Posso usare variabili all'interno di un prompt?
Sì. I campi prompt includono un selettore di variabili che ti permette di inserire valori dai passaggi precedenti, dai campi contatto o da altre variabili disponibili.
D: Devo scrivere il contenuto finale nel campo prompt?
No. Il campo prompt è dove fornisci le istruzioni su cosa l'AI deve generare. L'AI crea l'output finale di testo, audio, immagine o video quando il nodo viene eseguito.
D: A cosa serve Brand voice?
Brand voice aiuta ad allineare i contenuti generati al tono preferito del business, allo stile comunicativo e alle linee guida di messaggistica.
D: A cosa serve Design kit?
Design kit aiuta ad allineare gli output visivi, come immagini e video, all'identità visiva del business quando un kit è disponibile.
D: Perché non vedo le opzioni Brand voice o Design kit?
Potresti dover creare o aggiungere prima le opzioni di Brand voice o Design kit. I dropdown includono anche + Add new per creare una nuova opzione direttamente dalla configurazione del nodo.
D: Perché Video Generation mostra un AI Model Data Use Notice?
Video Generation usa modelli AI di terze parti. La comunicazione spiega che i prompt e i contenuti generati possono essere conservati temporaneamente per un massimo di 30 giorni per il monitoraggio della sicurezza e la fornitura del servizio, che i dati non verranno utilizzati per l'addestramento dei modelli e che la gestione dei dati varia a seconda del provider.
D: Perché il pulsante Save è disabilitato?
Il pulsante Save rimane disabilitato quando i campi obbligatori non sono completi. Per Video Generation, rimane disabilitato anche finché l'AI Model Data Use Notice non viene confermata.
Articoli correlati
Questo articolo è stato utile?