Saltar al contenido
Model Atlas IAcademy
Ver cursos

Metodología

Cómo se construye este catálogo

Para que puedas juzgar cuánto fiarte de cada dato.

1. Principio

No confundir popularidad con capacidad, ni aplicación con modelo, ni pesos descargables con licencia libre.

El Atlas no es un ranking. Es un registro: cada afirmación tiene una fuente, una fecha y un grado de confianza a la vista.

2. Jerarquía de fuentes

  1. Documentación oficial del creador, model card o paper original.
  2. Repositorio técnico oficial y changelog.
  3. Benchmarks reproducibles independientes.
  4. Artículos técnicos acreditados.
  5. Comunidad y reseñas — siempre etiquetadas como opinión.

La lista completa de fuentes citadas, con su fecha de recuperación, está en Fuentes.

3. Grados de confianza

GradoSignificadoCómo aparece
AFuente primaria + prueba o documento técnicoCapacidad confirmada
BFuente primaria sin validación independienteCapacidad confirmada
CFuente secundaria fiable«Según fuente secundaria», con enlace
DRumor o no verificadoPendiente de verificación, fuera del índice

Solo A y B se presentan como capacidades confirmadas.

4. Lo que el Atlas no hace

  • No rellena huecos con suposiciones: si un campo no tiene fuente, aparece como desconocido.
  • No copia descripciones publicitarias y las presenta como métricas.
  • No normaliza benchmarks con protocolos o datasets distintos: los marca «no comparable».
  • No declara un «modelo nº 1» universal. Un buen resultado en inglés con una sola batería no implica superioridad en español ni en producción regulada.
  • No publica un precio sin divisa, unidad, fecha y URL de origen.

5. Caducidad

DatoSe revisa
Precios y disponibilidad de APIcada 30 días
Licenciasal cambiar el artefacto
Ficha generalcada 90 días
Lanzamientos y retiradasa diario

Pasada la fecha, el dato se marca como caducado en lugar de mostrarse como vigente.

6. Cómo entra un dato

candidate → fetched → normalized → evidence_checked → reviewed → published

Cada paso es visible: los datos son ficheros versionados y su historial de cambios es público en el repositorio. Un registro sin revisar no se indexa.

7. Cómo se compara

El comparador pone hasta cinco versiones concretas lado a lado y avisa cuando no son comparables. El coste estimado de API se calcula de forma reproducible sobre tokens de entrada, salida y caché, con la divisa, la unidad, la región y la fecha de la tarifa a la vista. La estimación de ejecución local se separa siempre de la medición real.

8. Limitaciones conocidas

  • La cobertura no es exhaustiva: el catálogo es una selección curada, no un censo.
  • La verificación es humana y tiene coste: un dato puede tardar en actualizarse aunque esté caducado.
  • El asesor es una ayuda a la decisión, no una garantía: recomienda probar con 10–30 ejemplos propios antes de comprometerse en producción.
  • Los grados de confianza describen la fuente, no la calidad del modelo.

9. Correcciones

Si detectas un dato erróneo, la corrección entra por el mismo camino que el dato original: una propuesta con su fuente. El historial conserva el valor anterior, el nuevo y la razón del cambio.

10. Consulta por programa

Todo el catálogo y el asesor están expuestos como JSON público para agentes y consumidoras programáticas: /api/catalog.json, /api/models/<id>.json y POST /api/advise. Documentación, ejemplos de curl y cómo citar, en la página para agentes y en llms.txt.