Modifiche ai modelli OpenAI - Guida ai costi e all'utilizzo
- Introduzione
- Rapporto costo/precisione
- Livelli di costo dei modelli (dal più alto al più basso)
- Convenienza
- Accuratezza
- Modelli obsoleti
- Perché vengono ritirati?
- Modelli di trascrizione
- API EndPoint di registrazione delle chiamate utilizzate
- Modelli
- Modelli di testo e analisi (Analitiche Centralino)
- Riepilogo/Sentiment API EndPoint utilizzate
- Modelli
- Modelli in tempo reale (chiamate live e agenti AI)
- Endpoint chiamate
- Modelli
- gpt-realtime-1.5
- Endpoint di testo
- Modelli
Introduzione
Questa guida illustra la gamma di modelli OpenAI disponibili, i relativi costi e le modalità di utilizzo per chiamate PBX, trascrizione, analisi e agenti AI. Gli obiettivi principali di questa guida possono essere riassunti come segue:
- Ridurre i costi operativi
- Standardizzare le impostazioni predefinite
- Rendere la selezione dei modelli prevedibile e comprensibile
Per gli utenti che desiderano confrontare i modelli OpenAI e i prezzi in modo più dettagliato, OpenAI fornisce una pagina di riferimento ufficiale: https://platform.openai.com/docs/models/
Rapporto costo/precisione
I modelli più piccoli sono più economici e meno precisi.
- “nano” < “mini” < base < versioned < pro
Questa regola vale per tutte le serie di modelli OpenAI.
Livelli di costo dei modelli (dal più alto al più basso)
Convenienza
Questi modelli sono sicuri per carichi di lavoro ad alto volume come riepiloghi delle chiamate, analisi del sentiment e note CRM.
Modello | Fascia di costo | Uso previsto |
gpt-5.4-nano | Più basso | Volumi estremamente elevati, attività semplici |
gpt-5.4-mini | Basso | Modello standard – ottimo rapporto qualità-prezzo |
gpt-5.4-mini è impostato come predefinito in quanto offre il miglior rapporto qualità/costo.
Accuratezza
These models should only be used when higher accuracy or reasoning is explicitly required.
Modello | Fascia di costo | Note |
gpt-5.4 | Alto | Sintesi avanzate, audit di controllo qualità |
Modelli obsoleti
OpenAI sta ritirando alcuni modelli per concentrare gli investimenti su architetture più recenti ed efficienti.
Riferimento: https://developers.openai.com/api/docs/deprecations
Perché vengono ritirati?
- Architettura obsoleta
- Rapporto costo/prestazioni inferiore rispetto all'attuale versione “mini”
- Meno conveniente a parità di qualità dell'output
Modelli di trascrizione
A causa di questi cambiamenti, ora esponiamo la selezione del modello in: Sistema → Integrazioni → Trascrizione → OpenAI.
Ciò consente agli amministratori di scegliere il modello di trascrizione più adatto alle loro esigenze in termini di costi e qualità.
API EndPoint di registrazione delle chiamate utilizzate
- v1/audio/transcriptions
- v1/audio/translations
Modelli
Modello | Fascia di costo | Uso previsto |
Whisper | Il più economico | Predefinito per la registrazione di chiamate in blocco |
gpt-4o-mini-transcribe | Medio | Formattazione migliore |
gpt-4o-transcribe | Superiore | Massima qualità di trascrizione |
Whisper rimane l'opzione più conveniente per la trascrizione.
Modelli di testo e analisi (Analitiche Centralino)
Riepilogo/Sentiment API EndPoint utilizzate
- v1/chat/completions
Modelli
- gpt-5.4 (Predefinito)
- gpt-5.4-mini
- gpt-5.4-nano
Modelli in tempo reale (chiamate live e agenti AI)
Puoi utilizzare i link alla voce “Prezzi” per valutare le differenze di costo tra i modelli disponibili.
Endpoint chiamate
- v1/realtime
Modelli
gpt-realtime-1.5
Endpoint di testo
- v1/responses
Modelli
- gpt-5.4-mini (predefinito)
- gpt-5.4 (alta precisione)
Ultimo aggiornamento
Questo documento è stato aggiornato il 4 giugno 2026.
