Saltar al contenido
Model Atlas IAcademy
Ver cursos
Familia Multimodal

donut

naver-clova-ix

Familia de modelos 'donut' publicada en Hugging Face por naver-clova-ix.

Versiones catalogadas
1
Primera versión
19 jul 2022
Última versión
19 jul 2022

Versiones

Una familia no es un modelo: cada versión tiene su propia fecha, su licencia y sus capacidades. Lo que aquí llamamos «modelo» es siempre una versión concreta.

Modelo Disponible

donut-base

naver-clova-ix

This model is meant to be fine-tuned on a downstream task, like document image classification or document parsing. See the model hub to look for fine-tuned versions on a task that interests you.

Contexto
desconocido
Entrada
image
Salida
text
Pesos
Descargables
OCR y documentos B

Fundamentos de IA aplicada

Criterio de selección, no lista de la compra

Aprende a decidir entre versiones por coste, licencia, privacidad y rendimiento medido en tus propios casos, no por el titular del lanzamiento.

¿Por qué se usa aquí? Lo multimodal se elige por la entrada que necesitas procesar, no por la lista de capacidades del folleto.

Lo que cambia

  • De saber qué existe a saber cómo usarlo en tu trabajo.
  • Del catálogo general a una decisión con coste, licencia y privacidad justificados.
  • Prácticas y laboratorios, no solo lectura.