¿De dónde salen exactamente los plazos?
De la API pública de la Erasmus+ App de la Comisión Europea, donde cada institución declara su propio calendario. Se cosecha el censo entero —6622 instituciones— y se normaliza sin retocar ninguna fecha. Lo que ves en una ficha es lo que esa universidad declaró, no una interpretación nuestra.
¿Por qué solo se publican 1.755 universidades si el censo tiene 6.622?
Porque solo 1755 (27 %) declaran alguna fecha límite. Una ficha sin fecha no tendría nada que decir, así que no se publica: preferimos un catálogo más pequeño en el que todo lo que hay sirva, a uno grande lleno de páginas vacías. Que una universidad no salga no significa que no reciba Erasmus.
¿Cómo se convierte un «15/05» en una fecha real?
Las instituciones declaran día y mes sin año, porque el plazo se repite cada curso. El sitio calcula la próxima vez que cae esa combinación desde hoy, y lo recalcula a diario. Por eso una cuenta atrás nunca se desvía más de un día, y por eso la exportación da las dos cosas por separado: el día y mes declarados, y la fecha próxima calculada.
¿Por qué algunas ciudades no tienen coste de vida?
Porque la cifra sale de respuestas de estudiantes en la Erasmus+ App, y solo se publica a partir de tres respuestas. La mediana del catálogo es de 1 respuesta por ciudad: con una sola respuesta, la "media" sería el presupuesto de una persona presentado como el de una ciudad. De 1250 ciudades del censo, 242 pasan el listón. En las demás la web dice que no lo sabe, en vez de estimarlo.
¿Qué pasa con las universidades que tienen las cuatro fechas iguales?
Hay 51 fichas cuyos cuatro trámites vencen el mismo día. Parecía un formulario mal rellenado y no lo es: al revisarlas, la mayoría son conservatorios y escuelas de arte con una única audición o convocatoria anual. La ficha lo detecta y lo dice en vez de pintar cuatro filas idénticas.
¿Se ha corregido algún dato a mano?
Solo posiciones geográficas: 5 fichas venían con coordenadas que las situaban en otro continente y están corregidas, con el cambio registrado en el código. Ninguna fecha, ningún correo y ningún importe se han tocado nunca a mano.
¿Usáis IA para generar el contenido de las fichas?
No para producir datos. Las fechas, los contactos y los importes salen del catálogo cosechado, y los textos de cada ficha se componen con esos valores. La regla del proyecto es que un modelo puede estructurar texto que ya existe, pero nunca buscar ni inventar un dato: se midió que pidiéndole buscar un catálogo se inventaba nombres plausibles, y un nombre inventado que llega a un coordinador cuesta una plaza.