Vai al contenuto
lurno
Verifiche e valutazione

Sette tipi di verifica. Un'unica coda di correzione.

Sceglie il tipo e le regole di erogazione, integrità, correzione, feedback e ripetizione arrivano già impostate. Tutto ciò che una persona deve correggere — verifiche, lezioni, lavori di programma — finisce in un unico posto.

In breve

Che cosa fa Lurno quando un voto deve reggere

Lurno gestisce la valutazione dall'inizio alla fine: creazione, erogazione sicura, correzione e risultati. Sceglie uno dei sette tipi di verifica — quiz, esame, esercitazione, diagnostica, survey, prova di portfolio o strumento psicometrico — e il tipo preconfigura erogazione, integrità, correzione, feedback e ripetizioni, così un esame arriva blindato e a tempo mentre un'esercitazione arriva senza limite di tempo e con tentativi illimitati senza penalità. Le domande arrivano da 19 tipi. Tutto ciò che una persona deve correggere finisce in un'unica coda che copre verifiche, lezioni e programmi, valutato con rubriche analitiche, olistiche o single-point.

Rubrica single-point
Una rubrica con una sola colonna invece di una griglia. Descrive soltanto come si presenta un lavoro adeguato per ciascun criterio, poi annota che cosa è mancato e che cosa è andato oltre. Chi corregge ha meno da cliccare, chi impara ha più da leggere. Lurno le supporta tutte e tre — analitica (criteri per livelli, con pesi), olistica (una sola scala per l'intero lavoro) e single-point.

Nessuna di queste impostazioni predefinite è fissa. Cambi qualunque impostazione su una singola verifica, oppure definisca le impostazioni predefinite della sua organizzazione per un tipo. Le policy di correzione si costruiscono da passaggi ordinati — automatico, manuale, tra pari o assistito dall'AI, ciascuno obbligatorio o cieco — e una regola di accettazione sceglie il voto: il primo, l'ultimo, il più alto, la media, l'unanimità o la decisione di un moderatore.

I sette tipi

Un tipo è un insieme di decisioni, non un'etichetta

Ognuno è una forma didattica diversa, quindi ognuno arriva con impostazioni predefinite diverse.

CapabilityTipoLimite di tempoTentativiModalità sicuraNavigazione indietroRisposte corrette
QuizCorretto automaticamente; conta il migliore dei tre tentativi.Nessuno3NoYesAlla consegna
EsameCopia e incolla bloccato, cambi di scheda registrati come eventi di integrità.60 minuti1YesNoDopo il rilascio
EsercitazioneSenza penalità; la soluzione resta nascosta finché non la rilascia lei.NessunoIllimitatiNoYesAlla consegna
DiagnosticaScopre che cosa una persona già sa. La soluzione non viene mai mostrata.Nessuno1NoNoDopo il rilascio
SurveyNessun punteggio e nessuna soluzione — feedback, raccolta dati iniziale, rilevazioni rapide.Nessuno1NoYesMai
Prova di portfolioArtefatti e traguardi con sbarramenti, consegnati per la revisione di un valutatore.NessunoIllimitatiNoYesDopo il rilascio
Strumento psicometricoValutato rispetto a scale e gruppi normativi, non con un voto in decimi.Nessuno1NoNoMai

Impostazioni predefinite, non limiti. Ogni impostazione è modificabile sulla singola verifica, e un'organizzazione può ridefinire l'intera matrice per un tipo.

Correzione

La pila da correggere, ordinata come lavora un docente

Verifiche, lezioni e lavori di programma in un unico elenco

Una pila da correggere non è ordinata in base a quale parte del prodotto l'ha generata, e nemmeno questa coda lo è. Filtri per appartenenza del lavoro, per passaggio, per correttore o per stato del ciclo di vita, e prenda il primo elemento dalla cima.

  • Assegni il punteggio item per item, con feedback scritto e una nota vocale per ogni item e complessiva.
  • Se due correttori aprono lo stesso elaborato, il secondo riceve un conflitto esplicito, non una sovrascrittura silenziosa.
  • Assegni un passaggio a un gruppo di revisori; i revisori prendono in carico, correggono e inviano. Un passaggio cieco nasconde gli altri punteggi finché non ha inserito il suo.
Come l'AI assiste la correzione
Psicometria

Testing psicometrico adattivo, e le prove che è stato equo

Lurno esegue gli strumenti psicometrici come test di misura, non come quiz. Definisce scale, sottoscale e compositi sugli item, li inverte e li pesa, importa gruppi normativi e tabelle di conversione dei punteggi, e traccia le fasce di interpretazione con il testo che il candidato legge. Il calcolo del punteggio è deterministico e versionato, quindi rieseguire una vecchia sessione restituisce la stessa risposta. Uno strumento in modalità adattiva sceglie ogni item successivo con l'item response theory e si ferma quando la misura è abbastanza precisa. Questo è testing psicometrico adattivo, non un percorso di corso adattivo.

Item response theory (IRT)
Un modo di modellare un test in cui ogni domanda porta con sé i propri numeri — quanto è difficile, con quanta nettezza separa i forti dai deboli, quanto è probabile indovinare — mentre il candidato porta una sola stima di abilità. Entrambi stanno sulla stessa scala, così il test può scegliere la domanda che gli dice di più al passo successivo e fermarsi quando la stima è abbastanza precisa.

Il lavoro sull'equità resta come registrazione, non come un report che si esporta e poi si perde. Il funzionamento differenziale degli item (Mantel-Haenszel, con dimensione dell'effetto e livello di segnalazione), le evidenze di validità, i controlli di impatto avverso rispetto alla regola dei quattro quinti e la definizione degli standard con metodo Angoff o Bookmark scrivono ciascuno una voce nel log di audit concatenato con hash.

Un limite dichiarato: i parametri IRT vengono importati, non stimati qui. Lurno è un motore di esecuzione, non uno strumento di calibrazione.

Integrità

Controlli proporzionati alla posta in gioco

Attivi dove contano, disattivi dove non contano. Un'esercitazione non ha bisogno di essere blindata.

Erogazione sicura

Schermo intero, copia e incolla bloccato, cambi di scheda registrati, tutto mescolato a ogni tentativo. Le soluzioni vengono rimosse sul server, così non arrivano mai al browser.

Eventi di integrità

Cambi di scheda, tentativi di copia, una seconda sessione simultanea, tempi sospetti — ciascuno registrato sul tentativo, insieme al tempo speso per item.

Segnalazioni di rischio

Segnala un elaborato consegnato troppo in fretta, più sessioni simultanee o uno scarso coinvolgimento. Ogni segnalazione viene presa in carico.

Controllo di scrittura AI

Esegua una scansione su un elaborato scritto e la legga accanto al lavoro. Informa la decisione di una persona; non la prende al posto suo.

Misure compensative

Tempo aggiuntivo in percentuale, più tentativi, un'esenzione, alto contrasto, caratteri più grandi, screen reader, animazioni ridotte — per singolo discente, applicati automaticamente.

Bozze di valutazione dell'AI

L'AI abbozza i punteggi di rubrica, il feedback e un voto proposto su un contesto anonimizzato. Nulla viene applicato finché una persona non lo conferma.

Domande che fanno gli acquirenti

Prima di metterci sopra un esame

Sette tipi nel flusso di creazione — quiz, esame, esercitazione, diagnostica, survey, prova di portfolio e strumento psicometrico — ciascuno con erogazione, integrità, correzione, feedback e ripetizioni già preconfigurati. I tipi di domanda sono 19, tra cui cloze, hotspot, matrice, trascinamento, caricamento di file e risposta audio.

Porti un esame che già eroga.

Una rubrica che già usa, la consegna di un portfolio, uno strumento psicometrico — lo configureremo durante la chiamata invece di mostrarle un corso di esempio.