Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Si applica a:SQL Server
SSIS Integration Runtime in Azure Data Factory
È possibile aggiungere e configurare una trasformazione Raggruppamento fuzzy solo se il pacchetto include già almeno un'attività Flusso di dati e un'origine.
Per implementare una trasformazione di raggruppamento fuzzy in un flusso di dati
In SQL Server Data Tools (SSDT) aprire il progetto di Integration Services che contiene il pacchetto desiderato.
In Esplora soluzioni fare doppio clic sul pacchetto per aprirlo.
Fare clic sulla scheda Flusso di dati , quindi da Casella degli strumentitrascinare la trasformazione Raggruppamento fuzzy sull'area di progettazione.
Collegare la trasformazione Fuzzy Grouping al flusso di dati trascinando il connettore dall'origine dati o da una trasformazione precedente alla trasformazione Fuzzy Grouping.
Fare doppio clic sulla trasformazione Fuzzy Grouping.
Nella finestra di dialogo Editor della trasformazione Raggruppamento fuzzy, nella scheda Gestione connessioni, selezionare un gestore connessioni OLE DB che si connetta a un database di SQL Server.
Nota
La trasformazione richiede una connessione a un database di SQL Server per creare tabelle e indici temporanei.
Fare clic sulla scheda Colonne e, nell'elenco Colonne di input disponibili , selezionare la casella di controllo corrispondente alla colonna di input da usare per identificare righe simili nel set di dati.
Selezionare la casella di controllo nella colonna Pass Through per identificare le colonne di input da passare all'output della trasformazione. Le colonne pass-through non vengono coinvolte nel processo di identificazione delle righe duplicate.
Nota
Le colonne di input utilizzate per il raggruppamento vengono automaticamente selezionate come colonne pass-through e non possono essere deselezionate mentre sono in uso per il raggruppamento.
Facoltativamente, aggiornare i nomi delle colonne di output nella colonna Alias di output.
Facoltativamente, aggiorna i nomi delle colonne pulite nella colonna Group OutputAlias.
Nota
I nomi predefiniti delle colonne vengono ottenuti aggiungendo il suffisso "_clean" ai nomi delle colonne di input.
Facoltativamente, aggiornare il tipo di corrispondenza da utilizzare nella colonna Tipo di corrispondenza.
Nota
È necessario utilizzare la corrispondenza fuzzy almeno per una colonna.
Specificare le colonne con livello di somiglianza minimo nella colonna Somiglianza minima . Il valore deve essere compreso tra 0 e 1. Più il valore è vicino a 1, più i valori nelle colonne di input dovranno essere simili per formare un gruppo. Una somiglianza minima pari a 1 indica una corrispondenza esatta.
Facoltativamente, aggiornare i nomi delle colonne di similarità nella colonna Alias di output della similarità.
Per specificare la modalità di gestione dei numeri nei valori dei dati, aggiornare i valori nella colonna Numerali .
Per specificare la modalità con cui la trasformazione deve confrontare i dati stringa contenuti in una colonna, modificare la selezione predefinita delle opzioni di confronto nella colonna Flag di confronto .
Fare clic sulla scheda Avanzate per modificare i nomi delle colonne che la trasformazione aggiunge all'output per l'identificatore di riga univoco (_key_in), l'identificatore di riga duplicato (_key_out) e il valore di somiglianza (_score).
Facoltativamente, regolare la soglia di somiglianza spostando il cursore.
Facoltativamente, deselezionare le caselle di controllo dei delimitatori di token per ignorare i delimitatori nei dati.
Fare clic su OK.
Per salvare il pacchetto aggiornato, scegliere Salva elementi selezionati dal menu File .