Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Un elenco di frasi è un elenco di parole o frasi fornite in anticipo per migliorare il loro riconoscimento. Quando si aggiunge una frase a un elenco di frasi, aumentarne l'importanza, quindi è più probabile che il sistema lo riconosca.
Importante
L'elenco di frasi è una funzionalità di riconoscimento di runtime applicata a livello di endpoint. Funziona con:
- Trascrizione in tempo reale (Speech SDK, Speech CLI, Speech Studio)
- API di trascrizione rapida
- API di trascrizione vocale LLM
- Voice Live API
L'elenco di frasi funziona sia con gli endpoint di riconoscimento vocale di base sia con quelli personalizzati. Non richiede il training del modello e non è disponibile con la trascrizione in batch.
Gli esempi di frasi includono:
- nomi
- Posizioni geografiche
- Omonimi
- Parole o acronimi univoci per il settore o l'organizzazione di appartenenza
Gli elenchi di frasi sono semplici e contenuti:
- Just-in-time: si specifica un elenco di frasi appena prima di avviare il riconoscimento vocale, quindi non è necessario eseguire il training di un modello personalizzato.
- Contenuti: non è necessario un set di dati di grandi dimensioni. È sufficiente fornire una parola o una frase per aumentarne il riconoscimento.
È possibile usare elenchi di frasi con Speech Studio, l'SDK di Voce o l'interfaccia della riga di comando (CLI) di Voce. Sono supportati con la trascrizione in tempo reale e l'API di trascrizione rapida. L'API di trascrizione batch non supporta gli elenchi di frasi.
È possibile usare elenchi di frasi sia con endpoint di base (standard) sia con endpoint di riconoscimento vocale personalizzati. Si applica l'elenco di frasi in fase di esecuzione e non richiede l'addestramento del modello. Alcune situazioni richiedono il training di un modello personalizzato che include frasi per migliorare l'accuratezza. Ad esempio, usare la voce personalizzata nei casi seguenti:
- Nel caso di elenchi di frasi di grandi dimensioni. Un elenco non deve contenere più di 500 frasi.
Peso di importanza dell'elenco frasi
Quando si usa Speech SDK con la trascrizione in tempo reale, è possibile controllare il peso delle frasi dell'elenco di frasi rispetto al dizionario predefinito. Questa impostazione determina la quantità di influenza dell'elenco di frasi sui risultati della sintesi vocale.
Impostare il peso della lista di frasi in un intervallo compreso tra 0.0 e 2.0:
- 0.0: Disabilita l'elenco di frasi
- 1.0: Peso predefinito (influenza standard)
- 2.0: Peso massimo (influenza più alta)
Un peso maggiore aumenta la probabilità che le frasi dell'elenco vengano riconosciute rispetto alle alternative nel dizionario predefinito. Questa impostazione si applica all'elenco completo.
Provare in Speech Studio
Usare Speech Studio per testare il modo in cui un elenco di frasi migliora il riconoscimento per l'audio. Per implementare un elenco di frasi con l'applicazione in produzione, usare Speech SDK o l'interfaccia della riga di comando di Speech.
Ad esempio, supponiamo che il servizio Riconoscimento vocale debba riconoscere questa frase: "Ciao Rehaan, sono Jessie della banca Contoso."
Potresti scoprire che una frase è erroneamente riconosciuta come: "Ciao a tutti, sono Jesse della banca can’t do so".
Nello scenario precedente si vuole aggiungere "Rehaan", "Jessie" e "Contoso" all'elenco di frasi. I nomi vengono quindi riconosciuti correttamente.
Provare ora Speech Studio per vedere in che modo un elenco di frasi può migliorare l'accuratezza del riconoscimento.
Note
Potrebbe essere richiesto di selezionare la sottoscrizione Azure e la risorsa Voce e quindi confermare la fatturazione per l'area.
- Passare a Riconoscimento vocale in tempo reale in Speech Studio.
- Testare il riconoscimento vocale caricando un file audio o registrando l'audio usando un microfono. Ad esempio, selezionare Registra l'audio con un microfono e quindi pronunciare "Ciao Rehaan, sono Jessie della banca Contoso”. Selezionare quindi il pulsante rosso per interrompere la registrazione.
- Il risultato della trascrizione viene visualizzato nella casella di testo Risultati test . Se "Rehaan", "Jessie" o "Contoso" vengono riconosciuti in modo non corretto, aggiungere i termini a un elenco di frasi nel passaggio successivo.
- Selezionare Mostra opzioni avanzate, quindi attivare Elenco frasi.
- Immettere "Contoso;Jessie;Rehaan" nella casella di testo dell'elenco frasi. Separare più frasi con un punto e virgola.
- Usare di nuovo il microfono per testare nuovamente il riconoscimento. In caso contrario, seleziona la freccia Riprova accanto al file audio per registrare di nuovo l'audio. I termini "Rehaan", "Jessie" o "Contoso" devono essere riconosciuti.
Implementare l'elenco di frasi nella trascrizione in tempo reale
Usando Speech SDK, è possibile aggiungere frasi una alla volta e quindi eseguire il riconoscimento vocale.
var phraseList = PhraseListGrammar.FromRecognizer(recognizer);
phraseList.AddPhrase("Contoso");
phraseList.AddPhrase("Jessie");
phraseList.AddPhrase("Rehaan");
phraselist.SetWeight(weight);
Usando Speech SDK, è possibile aggiungere frasi una alla volta e quindi eseguire il riconoscimento vocale.
auto phraseListGrammar = PhraseListGrammar::FromRecognizer(recognizer);
phraseListGrammar->AddPhrase("Contoso");
phraseListGrammar->AddPhrase("Jessie");
phraseListGrammar->AddPhrase("Rehaan");
phraselist->SetWeight(weight);
Usando Speech SDK, è possibile aggiungere frasi una alla volta e quindi eseguire il riconoscimento vocale.
PhraseListGrammar phraseList = PhraseListGrammar.fromRecognizer(recognizer);
phraseList.addPhrase("Contoso");
phraseList.addPhrase("Jessie");
phraseList.addPhrase("Rehaan");
phraseList.setWeight(weight);
Usando Speech SDK, è possibile aggiungere frasi una alla volta e quindi eseguire il riconoscimento vocale.
const phraseList = sdk.PhraseListGrammar.fromRecognizer(recognizer);
phraseList.addPhrase("Contoso");
phraseList.addPhrase("Jessie");
phraseList.addPhrase("Rehaan");
phraseList.setWeight(weight);
Usando Speech SDK, è possibile aggiungere frasi una alla volta e quindi eseguire il riconoscimento vocale.
phrase_list_grammar = speechsdk.PhraseListGrammar.from_recognizer(reco)
phrase_list_grammar.addPhrase("Contoso")
phrase_list_grammar.addPhrase("Jessie")
phrase_list_grammar.addPhrase("Rehaan")
phraseList.setWeight(weight)
Usando Speech SDK, è possibile aggiungere frasi una alla volta e quindi eseguire il riconoscimento vocale.
phraseListGrammar, err := speech.NewPhraseListGrammarFromRecognizer(recognizer)
if err != nil {
// Handle error.
}
defer phraseListGrammar.Close()
phraseListGrammar.AddPhrase("Contoso")
phraseListGrammar.AddPhrase("Jessie")
phraseListGrammar.AddPhrase("Rehaan")
phraseListGrammar.SetWeight(weight)
Usando Speech CLI, è possibile includere un elenco di frasi direttamente nel comando o tramite un file di testo con il comando recognize.
Provare il riconoscimento da un microfono o da un file audio.
spx recognize --microphone --phrases "Contoso;Jessie;Rehaan;"
spx recognize --file "your\path\to\audio.wav" --phrases "Contoso;Jessie;Rehaan;"
È anche possibile aggiungere un elenco di frasi usando un file di testo contenente una frase per riga.
spx recognize --microphone --phrases @phrases.txt
spx recognize --file "your\path\to\audio.wav" --phrases @phrases.txt
I caratteri consentiti includono lettere e cifre specifiche delle impostazioni locali, spazi vuoti e caratteri speciali, ad esempio +, -, $, :, (, ), {, }, _, ., ?, @, \, ’, &, #, %, ^, *, `, <, >, ;, /. Il sistema rimuove altri caratteri speciali dalla frase.
Implementazione della lista di frasi nella trascrizione veloce e in LLM Speech
È possibile aggiungere un elenco di frasi Riconoscimento vocale tramite LLM mediante l'API REST del riconoscimento vocale.
curl --location 'https://YourResourceName.cognitiveservices.azure.com/speechtotext/transcriptions:transcribe?api-version=2025-10-15' \
--header 'Ocp-Apim-Subscription-Key: YourSpeechResourceKey' \
--form 'audio=@"YourAudioFile"' \
--form 'definition={
"locales": ["en-US"],
"phraseList": {
"phrases": ["Contoso", "Jessie", "Rehaan"]
}
}'
Passaggi successivi
Altre informazioni sulle opzioni per migliorare l'accuratezza del riconoscimento.