Visualizzazione post con etichetta SPEECH SYNTHESIS. Mostra tutti i post
Visualizzazione post con etichetta SPEECH SYNTHESIS. Mostra tutti i post

giovedì 11 gennaio 2018

Cos'è la voce artificiale? Riassunto finale

Per voce artificiale si intende un suono non prodotto dall'apparato fonatorio umano, ma da un apparecchio meccanico o elettronico in grado di ricrearlo verosimilmente.

Come è organizzato il blog?

Nella prima parte del blog l'argomento voce artificiale è stata sviluppata per scoprire quali sono i metodi per aiutare le persone e cosa crea questo suono. Si divide in quella prodotta interamente in laboratorio ricreando l'organo fonatorio e quella che, come ad esempio, viene prodotta da un laringofono oppure quella prodotta da un apparato fonatorio artificiale.

Mi sono concentrato sui problemi legati agli elementi e alla ricostruzione di organi fonatori e agli interventi che si possono fare con relativi apparecchi che hanno ridato alle persone la possibilità di parlare. Fino ai metodi alternativi del linguaggio.
La voce artificiale non si conosceva fino 1870 dove è stata fatta la prima laringectomia e solo successivamente si è evoluta sempre di più.

Come argomento centrale ho riportato i collegamenti di altre discipline che fanno uso della Voce/Sintesi vocale. Un settore oltre alla medicina e all'informatica è la musica in cui i sintetizzatori vocali sono molto usati e diffusi soprattutto nel genere Rap.

Il cinema è l'ultimo grande pilastro in cui troviamo ne troviamo un sostanziale uso, dalla voce dei robot, alla modifica della voce per la creazione di super-eroi.

Nella seconda parte del blog mi sono occupato delle sintesi vocali e i lori primi brevetti meccanici e brevetti elettronici partite dal 1780 e solo verso gli anni 30 hanno visto un radicale sviluppo fino alla NPL.

La seconda viene detta sintesi vocale, e si dividono in due insiemi:

Speech Synthesis (Text-to-speech) Il text to speech è un sistema di lettura di testi direttamente da                                                                               parte di un software che viene utilizzato dall'uso scolastico fino                                                                             alle ferrovie dello stato per le voci che annunciano l'arrivo dei                                                                                 treni.

Natural language processing Cos'è il natural language processing?  E' il processo di trattamento                                                                       automatico mediante un calcolatore elettronico delle informazioni                                                                         scritte o parlate in una lingua naturale.

Infine troviamo il Linguaggio di make up, in forma teoria, per entrare nel vivo della materia e dei linguaggi di settore con tesi di laureandi che approfondisco il discorso.

I sintetizzatori vocali hanno iniziato ad aiutare grazie alle loro capacita ai servizi statali e privati, alla scuola, e vuole entrare nell'istruzione generale come hanno intenzione di fare per wikipedia.

martedì 9 gennaio 2018

Ferrovie dello stato, GPS

Chi non ha mai sentito palare Roberto?

Già da più di 20 anni alcuni sistemi più evoluti usavano sistemi di sintesi vocali. La voce delle ferrovie dello stato "attenzione, allontanarsi dalla linea gialla!". Roberto!

Questa voce che sentiamo non arriva da una persona ma da un Text-to-speech.

Un programma che possiamo trovare on-line e fargli dire quello che vogliamo. Provalo!

Ricordati di mettere la voce di Roberto





GPS: Utilizzata anche per il sistema di navigazione. Dà informazioni vocali al guidatore per agevolarne la ricezione degli spostamenti che deve fare per arrivare a destinazione.

Cos'è un Sintetizzatore vocale?

Nel linguaggio comune per voce artificiale si intendono i sintetizzatori vocali.

La sintesi vocale è la riproduzione della voce umana!



Si divide in:

Speech Synthesis

La sintesi vocale (in inglese speech synthesis) è la tecnica per la riproduzione artificiale della voce umana. Un sistema usato per questo scopo è detto sintetizzatore vocale e può essere realizzato tramite software o via hardware. I sistemi di sintesi vocale sono noti anche come sistemi text-to-speech (TTS) per la loro possibilità di convertire il testo in parlato.


Natural Language Processing 

L'elaborazione del linguaggio naturale, detta anche NLP (dall'inglese Natural Language Processing, elaborazione lingua naturale), è il processo di trattamento automatico mediante un calcolatore elettronico delle informazioni scritte o parlate in una lingua naturale.

Questo processo è reso particolarmente difficile e complesso a causa delle caratteristiche intrinseche di ambiguità del linguaggio umano. Per questo motivo il processo di elaborazione viene suddiviso in fasi diverse, tuttavia simili a quelle che si possono incontrare nel processo di elaborazione di un linguaggio di programmazione:


  • analisi lessicale: scomposizione di un'espressione linguistica in token (in questo caso le parole)
  • analisi grammaticale: associazione delle parti del discorso a ciascuna parola nel testo
  • analisi sintattica: arrangiamento dei token in una struttura sintattica (ad albero: parse tree)
  • analisi semantica: assegnazione di un significato (semantica) alla struttura sintattica e, di conseguenza, all'espressione linguistica

Nell'analisi semantica la procedura automatica che attribuisce all'espressione linguistica un significato tra i diversi possibili è detta disambiguazione.



Cos'è la voce artificiale? Riassunto finale

Per voce artificiale si intende un suono non prodotto dall'apparato fonatorio umano, ma da un apparecchio meccanico o elettronico in gra...