1. Principio
No confundir popularidad con capacidad, ni aplicación con modelo, ni pesos descargables con licencia libre.
El Atlas no es un ranking. Es un registro: cada afirmación tiene una fuente, una fecha y un grado de confianza a la vista.
2. Jerarquía de fuentes
- Documentación oficial del creador, model card o paper original.
- Repositorio técnico oficial y changelog.
- Benchmarks reproducibles independientes.
- Artículos técnicos acreditados.
- Comunidad y reseñas — siempre etiquetadas como opinión.
La lista completa de fuentes citadas, con su fecha de recuperación, está en Fuentes.
3. Grados de confianza
| Grado | Significado | Cómo aparece |
|---|---|---|
| A | Fuente primaria + prueba o documento técnico | Capacidad confirmada |
| B | Fuente primaria sin validación independiente | Capacidad confirmada |
| C | Fuente secundaria fiable | «Según fuente secundaria», con enlace |
| D | Rumor o no verificado | Pendiente de verificación, fuera del índice |
Solo A y B se presentan como capacidades confirmadas.
4. Lo que el Atlas no hace
- No rellena huecos con suposiciones: si un campo no tiene fuente, aparece como desconocido.
- No copia descripciones publicitarias y las presenta como métricas.
- No normaliza benchmarks con protocolos o datasets distintos: los marca «no comparable».
- No declara un «modelo nº 1» universal. Un buen resultado en inglés con una sola batería no implica superioridad en español ni en producción regulada.
- No publica un precio sin divisa, unidad, fecha y URL de origen.
5. Caducidad
| Dato | Se revisa |
|---|---|
| Precios y disponibilidad de API | cada 30 días |
| Licencias | al cambiar el artefacto |
| Ficha general | cada 90 días |
| Lanzamientos y retiradas | a diario |
Pasada la fecha, el dato se marca como caducado en lugar de mostrarse como vigente.
6. Cómo entra un dato
candidate → fetched → normalized → evidence_checked → reviewed → published
Cada paso es visible: los datos son ficheros versionados y su historial de cambios es público en el repositorio. Un registro sin revisar no se indexa.
7. Cómo se compara
El comparador pone hasta cinco versiones concretas lado a lado y avisa cuando no son comparables. El coste estimado de API se calcula de forma reproducible sobre tokens de entrada, salida y caché, con la divisa, la unidad, la región y la fecha de la tarifa a la vista. La estimación de ejecución local se separa siempre de la medición real.
8. Limitaciones conocidas
- La cobertura no es exhaustiva: el catálogo es una selección curada, no un censo.
- La verificación es humana y tiene coste: un dato puede tardar en actualizarse aunque esté caducado.
- El asesor es una ayuda a la decisión, no una garantía: recomienda probar con 10–30 ejemplos propios antes de comprometerse en producción.
- Los grados de confianza describen la fuente, no la calidad del modelo.
9. Correcciones
Si detectas un dato erróneo, la corrección entra por el mismo camino que el dato original: una propuesta con su fuente. El historial conserva el valor anterior, el nuevo y la razón del cambio.
10. Consulta por programa
Todo el catálogo y el asesor están expuestos como JSON público para agentes y consumidoras
programáticas: /api/catalog.json, /api/models/<id>.json y
POST /api/advise. Documentación, ejemplos de curl y cómo citar, en
la página para agentes y en
llms.txt.