Trascrizione
Trascrivi qualsiasi file video o audio, con timestamp, riconoscimento facoltativo dei parlanti e supporto per 99 lingue.
0 – 20
Sostituzioni opzionali su interi termini applicate all'SRT e al TXT generati, utili quando il riconoscitore fraintende una parola specifica (un nome, un acronimo, un termine di settore) e la scrive sempre nello stesso modo errato. Ogni chiave è la parola così come trascritta; il valore è l'ortografia corretta. Sensibile alle maiuscole; le corrispondenze devono allinearsi a parole intere. Lascia vuoto per consegnare la trascrizione esattamente come scritta dal riconoscitore.
Funziona con
-
ElevenLabs
API di Trascrizione
Richiama questa pipeline dal tuo codice. Una richiesta avvia un'esecuzione; il modello è un campo di input, non un endpoint separato.
Ottieni un token API- input
- 5
- obbligatorio
- 1
- Prezzi
- from 0.8 crediti
| Input | Tipo | predefinito | Descrizione |
|---|---|---|---|
source_asset_id | string | predefinito— | File audio o video da trascrivere. Usa l’ID della risorsa restituito dal caricamento. Consulta /docs/api/ per la procedura. |
corrections | object | predefinito{} | Sostituzioni opzionali su interi termini applicate all'SRT e al TXT generati, utili quando il riconoscitore fraintende una parola specifica (un nome, un acronimo, un termine di settore) e la scrive sempre nello stesso modo errato. Ogni chiave è la parola così come trascritta; il valore è l'ortografia corretta. Sensibile alle maiuscole; le corrispondenze devono allinearsi a parole intere. Lascia vuoto per consegnare la trascrizione esattamente come scritta dal riconoscitore. |
diarize | boolean | predefinitofalse | Indica chi sta parlando. Attiva questa opzione per interviste e registrazioni con più persone. |
language_code | enum | predefinitoauto | Lingua parlata. Lascia vuoto per rilevarla automaticamente dall’audio.auto · en · es +8autoenesptfrdehiarjakozh |
num_speakers | integer | predefinito0 | Numero di persone che prevedi di sentire. Lascia vuoto per rilevarlo automaticamente. |
Punta un qualsiasi client MCP su pipe2 e il tuo agente ottiene questi strumenti. Trova questa pipeline, legge lo stesso schema qui sopra e la esegue.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Ricette che usano questo pipeline
Vedi tutte le ricette-
Video lungo → più clip con sottotitoli, in un solo comando
Trasforma qualsiasi video lungo in N clip più brevi con sottotitoli. Trascrivi una volta sola, lascia che l'IA scelga i momenti migliori, poi taglia e sottotitola ogni clip in parallelo. Se vuoi, adatta il risultato al formato verticale (9:16) per TikTok, Reels e Shorts, quadrato (1:1) per Instagram o ritratto (4:5); la posizione dei sottotitoli si regola automaticamente.
-
Domanda del pubblico → risposta visiva animata
Trasforma la risposta approvata e la sequenza visiva in un video esplicativo verticale con voce narrante, filmati di repertorio, diagrammi temporizzati e sottotitoli sincronizzati.
Domande frequenti
Quali formati di file sono supportati?
Quanto è accurata la trascrizione?
Cos'è il rilevamento dei parlanti?
Quali lingue sono supportate?
Quanto tempo richiede?
Trascrizione di video e audio con IA
Carica un file video o audio e ottieni una trascrizione accurata con timestamp e, se vuoi, l'identificazione dei parlanti. Scarica il risultato come sottotitoli SRT o testo semplice, pronto per sottotitoli, revisione e riutilizzo.
Cosa puoi farci
- Sottotitolare video: genera l'SRT, poi incorporalo o sovrapponilo per i social
- Riutilizzare contenuti lunghi: usa la trascrizione per riassunti, idee di clip e testi per i social
- Trascrivere interviste e podcast: registrazioni multi-parlante con diarizzazione
- Accessibilità: rendi i contenuti parlati leggibili e ricercabili
- Preparazione alla traduzione: una trascrizione pulita come sorgente per voci fuori campo tradotte
Come funziona
- Carica: video o audio, in qualsiasi formato comune (MP4, MOV, MP3, WAV, M4A, FLAC)
- Scegli una lingua: oppure lascia sul rilevamento automatico
- Attiva il rilevamento dei parlanti: etichetta ogni segmento con il parlante
- Scarica: SRT con timestamp + trascrizione in testo semplice
Formati disponibili
- SRT: file di sottotitoli con timestamp accurati al millisecondo, pronto per gli editor video
- Testo semplice: trascrizione pulita e leggibile per editing, riassunto o traduzione