Ir para o conteúdo
Avaliações e classificação

Sete tipos de avaliação. Uma só fila de correção.

Escolha o tipo e as regras de entrega, integridade, classificação, feedback e repetição chegam já definidas. Tudo o que uma pessoa tem de corrigir — avaliações, lições, trabalhos do programa — vai parar ao mesmo lugar.

Em resumo

O que a Lurno faz quando uma classificação tem de resistir a escrutínio

A Lurno trata da avaliação de ponta a ponta: criação, entrega segura, correção e resultados. Escolhe um de sete tipos de avaliação — questionário, exame, prática, diagnóstico, inquérito, tarefa de portefólio ou instrumento psicométrico — e o tipo pré-configura a entrega, a integridade, a classificação, o feedback e as repetições, pelo que um exame chega bloqueado e cronometrado enquanto a prática chega sem tempo limite e com tentativas ilimitadas sem penalização. As perguntas vêm de 19 tipos. Tudo o que uma pessoa tem de corrigir vai parar a uma só fila que abrange avaliações, lições e programas, pontuado face a rubricas analíticas, holísticas ou de ponto único.

Rubrica de ponto único
Uma rubrica com uma só coluna em vez de uma grelha. Descreve apenas o que é um trabalho competente em cada critério e anota depois o que ficou aquém e o que foi além. Quem corrige tem menos para clicar, os formandos têm mais para ler. A Lurno suporta as três — analítica (critérios por níveis, com pesos), holística (uma escala para o trabalho inteiro) e de ponto único.

Nenhuma dessas predefinições é fixa. Altere qualquer definição numa avaliação concreta ou defina as predefinições da sua organização para um tipo. As políticas de classificação são construídas a partir de passagens ordenadas — automática, manual, por pares ou assistida por AI, cada uma obrigatória ou cega — e uma regra de aceitação escolhe a classificação: a primeira, a última, a mais alta, a média, a unânime ou a decisão de um moderador.

Os sete tipos

Um tipo é um conjunto de decisões, não um rótulo

Cada um tem uma forma pedagógica diferente, pelo que cada um chega com predefinições diferentes.

CapabilityTipoTempo limiteTentativasModo seguroNavegação para trásRespostas corretas
QuestionárioCorreção automática; conta a melhor de três tentativas.Nenhum3NoYesAo submeter
ExameÁrea de transferência bloqueada, mudanças de separador registadas como eventos de integridade.60 minutos1YesNoApós o lançamento
PráticaSem penalização; a chave de respostas só aparece quando a libertar.NenhumIlimitadasNoYesAo submeter
DiagnósticoDescobre o que alguém já sabe. A chave de respostas nunca é mostrada.Nenhum1NoNoApós o lançamento
InquéritoSem pontuações e sem chave de respostas — opiniões, recolha inicial, sondagens rápidas.Nenhum1NoYesNunca
Tarefa de portefólioArtefactos e marcos com barreiras, submetidos para revisão por um avaliador.NenhumIlimitadasNoYesApós o lançamento
Instrumento psicométricoPontuado face a escalas e grupos normativos, e não numa nota de zero a dez.Nenhum1NoNoNunca

São predefinições, não limites. Todas as definições são editáveis numa avaliação concreta, e uma organização pode substituir toda a matriz para um tipo.

Classificação

A pilha de correção, organizada como um professor trabalha

Avaliações, lições e trabalhos do programa numa só lista

Uma pilha de correção não se organiza pela parte do produto que a gerou, e esta fila também não. Filtre pelo que o trabalho pertence, pela passagem, por quem corrige ou pelo estado do ciclo de vida, e vá tirando o próximo de cima.

  • Pontue item a item, com feedback escrito e uma nota de voz por item e no conjunto.
  • Se dois corretores abrirem a mesma submissão, o segundo recebe um conflito explícito, e não uma sobreposição silenciosa.
  • Atribua uma passagem a um conjunto de revisores; os revisores reclamam, classificam e submetem. Uma passagem cega esconde as outras pontuações até a sua estar dada.
Como a AI ajuda na correção
Psicometria

Testagem psicométrica adaptativa, e a prova de que foi justa

A Lurno executa instrumentos psicométricos como testes de medida, e não como questionários. Define escalas, subescalas e compostos sobre os itens, inverte a cotação e atribui pesos, importa grupos normativos e tabelas de conversão de pontuações, e traça bandas de interpretação com o texto que o candidato lê. A pontuação é determinista e versionada, pelo que reexecutar uma sessão antiga devolve o mesmo resultado. Um instrumento em modo adaptativo seleciona cada item seguinte por teoria de resposta ao item e para assim que a medição é suficientemente precisa. Isto é testagem psicométrica adaptativa, não um percurso de curso adaptativo.

Teoria de resposta ao item (IRT)
Uma forma de modelar um teste em que cada pergunta tem os seus próprios números — quão difícil é, com que nitidez separa os fortes dos fracos, qual a probabilidade de acerto ao acaso — enquanto o candidato tem uma única estimativa de aptidão. Ambos assentam na mesma escala, pelo que o teste pode escolher a pergunta que mais lhe diz a seguir e parar quando a estimativa for suficientemente precisa.

O trabalho de equidade fica registado, e não num relatório que se exporta e se perde. O funcionamento diferencial dos itens (Mantel-Haenszel, com dimensão do efeito e nível de sinalização), as evidências de validade, as verificações de impacto adverso face à regra dos quatro quintos e a definição de padrões por Angoff ou Bookmark escrevem, cada uma, uma entrada no registo de auditoria encadeado.

Um limite que assumimos: os parâmetros de IRT são importados, não estimados aqui. A Lurno é um motor de execução, não um estúdio de calibração.

Integridade

Verificações proporcionais ao que está em jogo

Ligadas onde importam, desligadas onde não importam. A prática não precisa de bloqueio.

Entrega segura

Ecrã inteiro, área de transferência bloqueada, mudanças de separador registadas, tudo baralhado a cada tentativa. A chave de respostas é removida no servidor, pelo que nunca chega ao browser.

Eventos de integridade

Mudanças de separador, tentativas de cópia, uma segunda sessão em simultâneo, tempos suspeitos — cada um registado na tentativa, com o tempo gasto em cada item.

Alertas de risco

Assinala uma submissão devolvida demasiado depressa, várias sessões em simultâneo ou pouco envolvimento. Cada alerta é confirmado por alguém.

Verificação de escrita por AI

Faça uma análise a uma submissão escrita e leia-a ao lado do trabalho. Informa a decisão de uma pessoa; não decide por ela.

Adaptações

Tempo extra em percentagem, mais tentativas, uma dispensa, alto contraste, letra maior, leitor de ecrã, movimento reduzido — por formando, aplicados automaticamente.

Propostas de classificação por AI

A AI redige pontuações de rubrica, feedback e uma proposta de classificação sobre um contexto anonimizado. Nada é aplicado enquanto uma pessoa não o confirmar.

Perguntas que os compradores fazem

Antes de lhe confiar um exame

Sete tipos no fluxo de criação — questionário, exame, prática, diagnóstico, inquérito, tarefa de portefólio e instrumento psicométrico — cada um pré-configurando a entrega, a integridade, a classificação, o feedback e as repetições. Existem 19 tipos de pergunta, incluindo cloze, ponto ativo, matriz, arrastar e largar, envio de ficheiro e resposta em áudio.

Traga um exame que já realiza.

Uma rubrica que já usa, um enunciado de portefólio, um instrumento psicométrico — configuramo-lo durante a chamada, em vez de lhe mostrarmos um curso de exemplo.