I nuovi modelli di IA vocale di OpenAI migliorano l'accuratezza della trascrizione
I modelli vocali IA di OpenAI ora puntano alla trascrizione in tempo reale e ai file audio completi. ChatGPT desktop ha recentemente ricevuto un importante aggiornamento Vocale, ma OpenAI sta anche ampliando i suoi strumenti audio per sviluppatori.
OpenAI presenta due modelli di trascrizione
OpenAI ha annunciato due modelli API chiamati GPT-Live-Transcribe e GPT-Transcribe.
GPT-Live-Transcribe si concentra sulla trascrizione a bassa latenza e in tempo reale per conversazioni dal vivo. GPT-Transcribe gestisce registrazioni completate e carichi di lavoro di elaborazione asincrona in batch.
Entrambi i modelli supportano la trascrizione sensibile al contesto. Gli sviluppatori possono fornire parole chiave, nomi, terminologia di settore e lingue attese per aiutare i modelli a comprendere una registrazione.
GPT-Live-Transcribe può anche utilizzare le trascrizioni dei turni precedenti come contesto durante una conversazione in corso.
Il contesto migliora l’accuratezza della trascrizione
Sul benchmark Context Aware ASR di OpenAI, il contesto aggiuntivo ha aumentato l’accuratezza semantica di GPT-Live-Transcribe dal 38,5% al 44,6%.
GPT-Transcribe è migliorato dal 41,6% al 45,2% sullo stesso benchmark.
OpenAI ha anche riportato i seguenti tassi di errore di trascrizione su audio reali:
- GPT-Live-Transcribe: 9,60%
- GPT-Realtime-Whisper: 11,65%
- GPT-Transcribe: 8,98%
- Whisper-1: 15,21%
Artificial Analysis ha misurato indipendentemente un tasso di errore sulle parole del 3,31% per GPT-Transcribe. OpenAI addebita $4,50 per 1.000 minuti di audio elaborato con il modello.
In altre notizie sull’IA, Microsoft ha introdotto il modello MAI-Cyber-1-Flash per rilevare le vulnerabilità di sicurezza. Anthropic ha inoltre dichiarato che non sostiene il divieto dei modelli di IA open-weight, sebbene l’azienda rimanga preoccupata per il potenziale uso improprio.
Via Neowin
Leggi la nostra pagina informativa per scoprire come puoi aiutare Windows Report a sostenere il team editoriale. Read more
User forum
0 messages