Saltar al contenido
Model Atlas IAcademy
Ver cursos
Familia Voz · reconocimiento (ASR)

wav2vec2-large-xlsr-53-japanese

jonatasgrosman

Familia de modelos 'wav2vec2-large-xlsr-53-japanese' publicada en Hugging Face por jonatasgrosman.

Versiones catalogadas
1
Primera versión
2 mar 2022
Última versión
2 mar 2022

Versiones

Una familia no es un modelo: cada versión tiene su propia fecha, su licencia y sus capacidades. Lo que aquí llamamos «modelo» es siempre una versión concreta.

Modelo Disponible

wav2vec2-large-xlsr-53-japanese

jonatasgrosman

Modelo publicado en Hugging Face con tarea pipeline 'automatic-speech-recognition' declarada en su ficha.

Contexto
desconocido
Entrada
audio
Salida
text
Pesos
Descargables
Voz · reconocimiento (ASR) B

IA para multimedia

Criterio de selección, no lista de la compra

Aprende a decidir entre versiones por coste, licencia, privacidad y rendimiento medido en tus propios casos, no por el titular del lanzamiento.

¿Por qué se usa aquí? Transcribir bien es un problema de idioma, acentos y ruido; los modelos abiertos y los servicios se comportan muy distinto en español.

Lo que cambia

  • De saber qué existe a saber cómo usarlo en tu trabajo.
  • Del catálogo general a una decisión con coste, licencia y privacidad justificados.
  • Prácticas y laboratorios, no solo lectura.