I ricercatori di Amazon hanno annunciato un nuovo modello di sintesi vocale text-to-speech, chiamato BASE TTS. Grazie alle sue dimensioni – 100.000 ore di registrazioni audio per addestrare la versione più grande da 980 milioni di parametri – il modello del colosso dell’e-commerce mostrerebbe delle “abilità emergenti”, ossia capacità che vanno al di là di ciò per cui è stato addestrato.
Il modello sarebbe in grado di gestire testi complessi in modo naturale, pronunciare in modo credibile frasi e parole lunghe e complicate, applicare la giusta enfasi emotiva e interpretare la punteggiatura.
Scopri altre Notizie in pillole sul digitale!
La classifica degli sportivi con la migliore reputazione certifica un cambiamento delle gerarchie: tennis, motori e…
Un soldato russo vivo vale più di uno morto. È una delle regole del "sistema…
L’Osservatorio Politico di Reputation Manager rileva oltre 152 mila contenuti online negli ultimi due mesi…
C'è un filo conduttore che lega le recenti maxi-acquisizioni nel panorama tech globale e il…
Il nostro CEO Andrea Barchiesi ha parlato con Mariangela Pira nel consueto appuntamento bimestrale a…
Pier Silvio Berlusconi, Andre Orcel e Carlo Messina sul podio dell'edizione di luglio 2026 del…