Skąd dokładnie pochodzą terminy?
Z publicznego API aplikacji Erasmus+ Komisji Europejskiej, gdzie każda instytucja samodzielnie deklaruje swój harmonogram. Pobierany jest cały rejestr — 6622 instytucji — i normalizowany bez jakiejkolwiek modyfikacji dat. To, co widzisz w profilu, jest dokładną deklaracją danej uczelni, a nie naszą interpretacją.
Dlaczego publikujecie tylko 1755 uczelni, skoro w rejestrze są 6622?
Ponieważ tylko 1755 (27 %) podaje jakiekolwiek terminy graniczne. Profil bez dat nie zawierałby przydatnych informacji, więc go nie publikujemy: wolimy mniejszy katalog, w którym wszystko działa, niż olbrzymi zbiór pustych stron. Brak uczelni w katalogu nie oznacza, że nie uczestniczy ona w programie Erasmus+.
W jaki sposób zapis «15/05» staje się konkretną datą w kalendarzu?
Instytucje podają dzień i miesiąc bez roku, ponieważ dany termin powtarza się w każdym cyklu akademickim. Serwis wylicza najbliższą datę przypadania tego dnia i miesiąca względem dnia dzisiejszego i przelicza ją codziennie. Dzięki temu odliczanie czasu nigdy nie jest przesunięte o więcej niż jeden dzień, a eksport danych udostępnia obie wartości: zgłoszony dzień i miesiąc oraz wyliczoną najbliższą datę.
Dlaczego przy niektórych miastach brakuje kosztów życia?
Ponieważ kwota bazuje na ankietach wypełnianych przez studentów w aplikacji Erasmus+ i publikujemy ją dopiero od minimum trzech odpowiedzi. Mediana w katalogu wynosi 1 na miasto: przy jednej odpowiedzi «średnia» byłaby po prostu budżetem jednej osoby przedstawionym jako koszt życia w całym mieście. Spośród 1250 miast w rejestrze próg ten spełnia 242. W pozostałych przypadkach uczciwie informujemy o braku danych, zamiast zgadywać.
O co chodzi z uczelniami, które mają wszystkie cztery terminy identyczne?
Jest 51 profili, w których wszystkie cztery etapy przypadają na ten sam dzień. Z pozoru wyglądało to na błąd wypełnienia formularza, ale po weryfikacji okazało się, że większość z nich to konserwatoria i akademie sztuk pięknych z jednorazowym przesłuchaniem lub pojedynczą rekrutacją w roku. System to wykrywa i wyjaśnia sytuację, zamiast wyświetlać cztery identyczne wiersze.
Czy jakiekolwiek dane były poprawiane ręcznie?
Wyłącznie współrzędne geograficzne: 5 profili miało współrzędne umieszczające je na innym kontynencie, co zostało skorygowane z jawnym odnotowaniem w kodzie. Żadna data, żaden adres e-mail ani żadna kwota nigdy nie były modyfikowane ręcznie.
Czy używacie sztucznej inteligencji do generowania profili?
Nie do generowania faktów. Daty, kontakty i kwoty pochodzą wprost z pobranego katalogu, a teksty profili są na ich podstawie składane. Żelazną zasadą projektu jest to, że model może ustrukturyzować istniejący tekst, ale nigdy nie może wyszukiwać ani zmyślać danych: testy wykazały, że poproszony o wyszukanie katalogu model potrafił konabulować nazwy, a zmyślona nazwa przekazana koordynatorowi może kosztować utratę miejsca.