Platforma treningowa jest warta tyle, ile jej pytania. Zamiast to twierdzić, ta strona publikuje, co mierzymy w naszym banku: znalezioną wadę, jak ją poprawiliśmy, stałą kontrolę zapobiegającą jej powrotowi i to, co nie jest jeszcze na poziomie.
Każda liczba na tej stronie pochodzi z datowanego pomiaru wewnętrznego; data ostatniej weryfikacji znajduje się na dole strony.
Pokazanie liczby tworzy zobowiązanie: utrzymania jej dokładności. Właśnie dlatego to robimy. Kandydat przygotowujący selektywny konkurs zasługuje, by wiedzieć, na czym trenuje, a wskaźnik opublikowany z datą jest wart więcej niż jakikolwiek przymiotnik.
Według naszej wiedzy żadna konkurencyjna platforma nie publikuje zmierzonego wskaźnika jakości swojego banku pytań. Wolimy pokazać nasze, z wadami włącznie.
Klasyczna wada QCM, udokumentowana w badaniach nad pisaniem itemów: gdy poprawna odpowiedź jest bardziej rozbudowana niż błędne, systematyczne zaznaczanie najdłuższej opcji daje punkty bez żadnej wiedzy. Zmierzyliśmy, ile dawała ta strategia na naszych pytaniach po angielsku, moduł po module, a następnie przepisaliśmy dystraktory 690 pytań źródłowych, z pełną ponowną lekturą wiersz po wierszu.
| Moduł | Przed | Po | Losowo |
|---|---|---|---|
| Kompetencje cyfrowe | 86,5 % | 26,9 % | 25 % |
| Rozumowanie werbalne | 68,5 % | 29,3 % | 25 % |
| Wiedza o UE | 64,7 % | 30,2 % | 25 % |
Rozumowanie numeryczne, którego opcje są liczbami, nie niosło tej wady. Rezydualny wynik zmierzony 2 sierpnia 2026 w 8 głównych językach: od 22,0 % do 31,9 % zależnie od pary język/moduł, na 44 zmierzonych parach.
Poprawka bez kontroli degraduje się przy następnej partii treści. Skłonność do długości jest więc mierzona co tydzień przez automatyczną kontrolę w ciągłej integracji, na każdej parze język/moduł 8 głównych języków. Jeśli strategia najdłuższej odpowiedzi przekroczy 35 % (losowo: 25 %), kontrola robi się czerwona i blokuje: próg jest skalibrowany, by odróżnić prawdziwą wadę od szumu statystycznego.
Ten sam mechanizm ciągłej kontroli blokuje inne inwarianty treści: parytet ośmiu języków interfejsu, spójność parametrów testów z oficjalną bazą, unikalność pytań FAQ między stronami.
Publikowanie pomiarów zobowiązuje też do publikowania tego, co ujawniają. Znany stan na 4 sierpnia 2026:
Jednorazowe poprawki nie wystarczą bez zasad pisania. Obowiązują one dla każdego nowego pytania:
Otrzymuj nadchodzące ogłoszenia o konkursach i aktualizacje kalendarza.
Zapisy zostaną wkrótce otwarte.