Sieben Prüfungstypen. Eine Bewertungswarteschlange.
Wählen Sie den Typ, und die Regeln für Auslieferung, Integrität, Bewertung, Rückmeldung und Wiederholungen sind bereits gesetzt. Alles, was ein Mensch bewerten muss — Prüfungen, Lektionen, Programmarbeiten —, landet an einem Ort.
Was Lurno tut, wenn eine Bewertung standhalten muss
Lurno deckt das Prüfen von Anfang bis Ende ab: Erstellen, sichere Auslieferung, Bewerten und Ergebnisse. Sie wählen einen von sieben Prüfungstypen — Quiz, Klausur, Übung, Diagnose, Umfrage, Portfolioaufgabe oder psychometrisches Instrument —, und der Typ konfiguriert Auslieferung, Integrität, Bewertung, Rückmeldung und Wiederholungen vor, sodass eine Klausur abgeriegelt und mit Zeitlimit ankommt, während eine Übung ohne Zeitlimit und mit unbegrenzten, straffreien Versuchen ankommt. Fragen stammen aus 19 Typen. Alles, was ein Mensch bewerten muss, landet in einer Warteschlange über Prüfungen, Lektionen und Programme hinweg, bewertet nach analytischen, holistischen oder Single-Point-Bewertungsrastern.
- Single-Point-Bewertungsraster
- Ein Bewertungsraster mit einer Spalte statt eines Gitters. Sie beschreiben je Kriterium nur, wie eine kompetente Arbeit aussieht, und notieren dann, was dahinter zurückblieb und was darüber hinausging. Bewertende klicken weniger, Lernende lesen mehr. Lurno unterstützt alle drei — analytisch (Kriterien mal Stufen, gewichtet), holistisch (eine Skala für die ganze Arbeit) und Single-Point.
Keine dieser Voreinstellungen ist festgeschrieben. Ändern Sie jede Einstellung an einer einzelnen Prüfung, oder setzen Sie für einen Typ eigene Voreinstellungen Ihrer Organisation. Bewertungsrichtlinien bestehen aus geordneten Durchgängen — automatisch, manuell, durch Peers oder AI-gestützt, jeweils verpflichtend oder blind —, und eine Annahmeregel bestimmt die Bewertung: die erste, die letzte, die höchste, den Durchschnitt, Einstimmigkeit oder die Entscheidung einer moderierenden Person.
Ein Typ ist ein Bündel von Entscheidungen, kein Etikett
Jeder ist eine andere pädagogische Form, deshalb kommt jeder mit anderen Voreinstellungen.
| Capability | Typ | Zeitlimit | Versuche | Sicherer Modus | Zurückblättern | Richtige Antworten |
|---|---|---|---|---|---|---|
| QuizAutomatisch bewertet; der höchste von drei Versuchen zählt. | Keins | 3 | No | Yes | Beim Abgeben | |
| KlausurZwischenablage gesperrt, Tabwechsel als Integritätsereignisse erfasst. | 60 Minuten | 1 | Yes | No | Nach der Freigabe | |
| ÜbungStraffrei; der Lösungsschlüssel wartet, bis Sie ihn freigeben. | Keins | Unbegrenzt | No | Yes | Beim Abgeben | |
| DiagnoseFindet heraus, was jemand bereits weiß. Der Lösungsschlüssel wird nie gezeigt. | Keins | 1 | No | No | Nach der Freigabe | |
| UmfrageKeine Punkte und kein Lösungsschlüssel — Rückmeldungen, Erhebungen, Stimmungsbilder. | Keins | 1 | No | Yes | Nie | |
| PortfolioaufgabeArtefakte und Meilenstein-Schranken, eingereicht zur Begutachtung. | Keins | Unbegrenzt | No | Yes | Nach der Freigabe | |
| Psychometrisches InstrumentAusgewertet gegen Skalen und Normgruppen, nicht als Note von zehn. | Keins | 1 | No | No | Nie |
Voreinstellungen, keine Grenzen. Jede Einstellung lässt sich an einer einzelnen Prüfung ändern, und eine Organisation kann die ganze Matrix für einen Typ überschreiben.
Der Stapel zu bewertender Arbeiten, sortiert, wie Lehrende arbeiten
Prüfungen, Lektionen und Programmarbeiten in einer Liste
Ein Stapel zu bewertender Arbeiten ist nicht danach sortiert, welcher Teil des Produkts ihn erzeugt hat, und diese Warteschlange ist es auch nicht. Filtern Sie danach, wozu die Arbeit gehört, nach Durchgang, nach bewertender Person oder nach Zustand im Lebenszyklus, und nehmen Sie das Nächste von oben.
- Aufgabe für Aufgabe bepunkten, mit schriftlicher Rückmeldung und einer Sprachnotiz je Aufgabe und insgesamt.
- Öffnen zwei Bewertende dieselbe Einreichung, bekommt die zweite Person einen klaren Konflikt und kein stilles Überschreiben.
- Weisen Sie einen Durchgang einem Pool von Prüfenden zu; sie nehmen Arbeiten an, bewerten und geben ab. Ein blinder Durchgang verbirgt die anderen Bewertungen, bis Ihre steht.
Ein zweites Augenpaar, wo es darauf ankommt
Setzen Sie eine Moderationsschwelle, und alles darüber wird vor der Freigabe für eine moderierende Person zurückgehalten. Gegen eine freigegebene Bewertung wird im Produkt Widerspruch eingelegt und nicht per E-Mail, und jedes Ergebnis durchläuft einen festen Lebenszyklus aus zwölf Zuständen.
- Widersprüche werden als Spur festgehalten — freigegeben, angefochten, geklärt, abgeschlossen — dazu ein Rückmeldungsverlauf an jedem Ergebnis.
- Fragen sind Bibliothekselemente, eine Frage kann also in mehreren Prüfungen liegen. Siehe Erstellen und die Inhaltsbibliothek.
Portfolios, Peer-Review, Kalibrierung und Gruppeneinreichungen
Arbeiten, die Wochen dauern, bekommen eine angemessene Behandlung und kein Feld zum Hochladen einer Datei.
- Portfolios: Artefakte, die über die Zeit hinzukommen, Meilensteine mit Schranken, die zu passieren sind, und eine Werkbank für Begutachtende, die jedes durch Begutachtung, Überarbeitung angefordert, angenommen oder abgelehnt führt.
- Peer-Review: anonymisierte Pools von Prüfenden mit Fristen, Bewertungen durch Peers, Einschätzungen zur Qualität der Rückmeldung und ein Abgleich, wenn Prüfende uneins sind.
- Eine Kalibrierung an Ankerantworten liefert die Beurteilerübereinstimmung, bevor das echte Bewerten beginnt. Gruppeneinreichungen tragen Beitragsgewichte je Mitglied.
Adaptives psychometrisches Testen, und der Beleg, dass es fair war
Lurno führt psychometrische Instrumente als messende Tests aus und nicht als Quiz. Sie definieren Skalen, Subskalen und Gesamtwerte über die Aufgaben, kehren sie um und gewichten sie, importieren Normgruppen und Umrechnungstabellen und ziehen Interpretationsbänder mit dem Text, den eine geprüfte Person liest. Die Auswertung ist deterministisch und versioniert, ein erneuter Lauf einer alten Sitzung liefert also dasselbe Ergebnis. Ein Instrument im adaptiven Modus wählt jede nächste Aufgabe nach der Item-Response-Theorie und hält an, sobald die Messung genau genug ist. Das ist adaptives psychometrisches Testen und kein adaptiver Kurspfad.
- Item-Response-Theorie (IRT)
- Eine Art, einen Test zu modellieren, bei der jede Frage eigene Kennwerte trägt — wie schwer sie ist, wie scharf sie Starke von Schwachen trennt, wie wahrscheinlich ein Raten ist —, während die geprüfte Person einen einzigen Fähigkeitsschätzwert trägt. Beide liegen auf derselben Skala, sodass der Test als Nächstes die Frage wählen kann, die ihm am meisten sagt, und anhalten kann, wenn der Schätzwert genau genug ist.
Die Arbeit an der Fairness wird als Datensatz gehalten und nicht als Bericht, den man exportiert und dann verliert. Differenzielles Itemfunktionieren (Mantel-Haenszel, mit Effektstärke und Warnstufe), Validitätsbelege, Prüfungen auf nachteilige Auswirkungen nach der Vier-Fünftel-Regel sowie Standardsetzung nach Angoff oder Bookmark schreiben jeweils einen Eintrag ins hash-verkettete Audit-Log.
Eine ehrliche Grenze: IRT-Parameter werden importiert, nicht hier geschätzt. Lurno ist eine Ausführungsumgebung und kein Kalibrierungsstudio.
Kontrollen im Verhältnis zum Anlass
An, wo sie zählen, aus, wo nicht. Eine Übung braucht keine Abriegelung.
Sichere Auslieferung
Vollbild, Zwischenablage gesperrt, Tabwechsel erfasst, alles je Versuch gemischt. Der Lösungsschlüssel wird auf dem Server entfernt und erreicht den Browser damit nie.
Integritätsereignisse
Tabwechsel, Kopierversuche, eine zweite gleichzeitige Sitzung, auffälliges Timing — jedes am Versuch erfasst, mit der Zeit je Aufgabe.
Warnungen bei Auffälligkeiten
Markiert eine Einreichung, die zu schnell zurückkam, mehrere gleichzeitige Sitzungen oder geringe Beteiligung. Jede Warnung wird quittiert.
Prüfung auf AI-Text
Lassen Sie eine schriftliche Einreichung prüfen und lesen Sie das Ergebnis neben der Arbeit. Es stützt die Entscheidung eines Menschen; es trifft keine.
Nachteilsausgleiche
Zusatzzeit als Prozentsatz, mehr Versuche, eine Befreiung, hoher Kontrast, größere Schrift, Screenreader, reduzierte Bewegung — je lernender Person, automatisch angewendet.
AI-Bewertungsentwürfe
Die AI entwirft Rasterwerte, Rückmeldung und eine vorgeschlagene Bewertung über anonymisierten Kontext. Nichts wird übernommen, bis ein Mensch es bestätigt.
Bevor Sie eine Klausur darauf abhalten
Bringen Sie eine Klausur mit, die Sie bereits abhalten.
Ein Bewertungsraster, das Sie bereits nutzen, eine Portfolioaufgabe, ein psychometrisches Instrument — wir richten es im Termin ein, statt Ihnen einen Beispielkurs zu zeigen.