Zum Inhalt springen
lurno
Prüfungen und Bewertung

Sieben Prüfungstypen. Eine Bewertungswarteschlange.

Wählen Sie den Typ, und die Regeln für Auslieferung, Integrität, Bewertung, Rückmeldung und Wiederholungen sind bereits gesetzt. Alles, was ein Mensch bewerten muss — Prüfungen, Lektionen, Programmarbeiten —, landet an einem Ort.

In Kürze

Was Lurno tut, wenn eine Bewertung standhalten muss

Lurno deckt das Prüfen von Anfang bis Ende ab: Erstellen, sichere Auslieferung, Bewerten und Ergebnisse. Sie wählen einen von sieben Prüfungstypen — Quiz, Klausur, Übung, Diagnose, Umfrage, Portfolioaufgabe oder psychometrisches Instrument —, und der Typ konfiguriert Auslieferung, Integrität, Bewertung, Rückmeldung und Wiederholungen vor, sodass eine Klausur abgeriegelt und mit Zeitlimit ankommt, während eine Übung ohne Zeitlimit und mit unbegrenzten, straffreien Versuchen ankommt. Fragen stammen aus 19 Typen. Alles, was ein Mensch bewerten muss, landet in einer Warteschlange über Prüfungen, Lektionen und Programme hinweg, bewertet nach analytischen, holistischen oder Single-Point-Bewertungsrastern.

Single-Point-Bewertungsraster
Ein Bewertungsraster mit einer Spalte statt eines Gitters. Sie beschreiben je Kriterium nur, wie eine kompetente Arbeit aussieht, und notieren dann, was dahinter zurückblieb und was darüber hinausging. Bewertende klicken weniger, Lernende lesen mehr. Lurno unterstützt alle drei — analytisch (Kriterien mal Stufen, gewichtet), holistisch (eine Skala für die ganze Arbeit) und Single-Point.

Keine dieser Voreinstellungen ist festgeschrieben. Ändern Sie jede Einstellung an einer einzelnen Prüfung, oder setzen Sie für einen Typ eigene Voreinstellungen Ihrer Organisation. Bewertungsrichtlinien bestehen aus geordneten Durchgängen — automatisch, manuell, durch Peers oder AI-gestützt, jeweils verpflichtend oder blind —, und eine Annahmeregel bestimmt die Bewertung: die erste, die letzte, die höchste, den Durchschnitt, Einstimmigkeit oder die Entscheidung einer moderierenden Person.

Die sieben Typen

Ein Typ ist ein Bündel von Entscheidungen, kein Etikett

Jeder ist eine andere pädagogische Form, deshalb kommt jeder mit anderen Voreinstellungen.

CapabilityTypZeitlimitVersucheSicherer ModusZurückblätternRichtige Antworten
QuizAutomatisch bewertet; der höchste von drei Versuchen zählt.Keins3NoYesBeim Abgeben
KlausurZwischenablage gesperrt, Tabwechsel als Integritätsereignisse erfasst.60 Minuten1YesNoNach der Freigabe
ÜbungStraffrei; der Lösungsschlüssel wartet, bis Sie ihn freigeben.KeinsUnbegrenztNoYesBeim Abgeben
DiagnoseFindet heraus, was jemand bereits weiß. Der Lösungsschlüssel wird nie gezeigt.Keins1NoNoNach der Freigabe
UmfrageKeine Punkte und kein Lösungsschlüssel — Rückmeldungen, Erhebungen, Stimmungsbilder.Keins1NoYesNie
PortfolioaufgabeArtefakte und Meilenstein-Schranken, eingereicht zur Begutachtung.KeinsUnbegrenztNoYesNach der Freigabe
Psychometrisches InstrumentAusgewertet gegen Skalen und Normgruppen, nicht als Note von zehn.Keins1NoNoNie

Voreinstellungen, keine Grenzen. Jede Einstellung lässt sich an einer einzelnen Prüfung ändern, und eine Organisation kann die ganze Matrix für einen Typ überschreiben.

Bewertung

Der Stapel zu bewertender Arbeiten, sortiert, wie Lehrende arbeiten

Prüfungen, Lektionen und Programmarbeiten in einer Liste

Ein Stapel zu bewertender Arbeiten ist nicht danach sortiert, welcher Teil des Produkts ihn erzeugt hat, und diese Warteschlange ist es auch nicht. Filtern Sie danach, wozu die Arbeit gehört, nach Durchgang, nach bewertender Person oder nach Zustand im Lebenszyklus, und nehmen Sie das Nächste von oben.

  • Aufgabe für Aufgabe bepunkten, mit schriftlicher Rückmeldung und einer Sprachnotiz je Aufgabe und insgesamt.
  • Öffnen zwei Bewertende dieselbe Einreichung, bekommt die zweite Person einen klaren Konflikt und kein stilles Überschreiben.
  • Weisen Sie einen Durchgang einem Pool von Prüfenden zu; sie nehmen Arbeiten an, bewerten und geben ab. Ein blinder Durchgang verbirgt die anderen Bewertungen, bis Ihre steht.
Wie die AI beim Bewerten unterstützt
Psychometrie

Adaptives psychometrisches Testen, und der Beleg, dass es fair war

Lurno führt psychometrische Instrumente als messende Tests aus und nicht als Quiz. Sie definieren Skalen, Subskalen und Gesamtwerte über die Aufgaben, kehren sie um und gewichten sie, importieren Normgruppen und Umrechnungstabellen und ziehen Interpretationsbänder mit dem Text, den eine geprüfte Person liest. Die Auswertung ist deterministisch und versioniert, ein erneuter Lauf einer alten Sitzung liefert also dasselbe Ergebnis. Ein Instrument im adaptiven Modus wählt jede nächste Aufgabe nach der Item-Response-Theorie und hält an, sobald die Messung genau genug ist. Das ist adaptives psychometrisches Testen und kein adaptiver Kurspfad.

Item-Response-Theorie (IRT)
Eine Art, einen Test zu modellieren, bei der jede Frage eigene Kennwerte trägt — wie schwer sie ist, wie scharf sie Starke von Schwachen trennt, wie wahrscheinlich ein Raten ist —, während die geprüfte Person einen einzigen Fähigkeitsschätzwert trägt. Beide liegen auf derselben Skala, sodass der Test als Nächstes die Frage wählen kann, die ihm am meisten sagt, und anhalten kann, wenn der Schätzwert genau genug ist.

Die Arbeit an der Fairness wird als Datensatz gehalten und nicht als Bericht, den man exportiert und dann verliert. Differenzielles Itemfunktionieren (Mantel-Haenszel, mit Effektstärke und Warnstufe), Validitätsbelege, Prüfungen auf nachteilige Auswirkungen nach der Vier-Fünftel-Regel sowie Standardsetzung nach Angoff oder Bookmark schreiben jeweils einen Eintrag ins hash-verkettete Audit-Log.

Eine ehrliche Grenze: IRT-Parameter werden importiert, nicht hier geschätzt. Lurno ist eine Ausführungsumgebung und kein Kalibrierungsstudio.

Integrität

Kontrollen im Verhältnis zum Anlass

An, wo sie zählen, aus, wo nicht. Eine Übung braucht keine Abriegelung.

Sichere Auslieferung

Vollbild, Zwischenablage gesperrt, Tabwechsel erfasst, alles je Versuch gemischt. Der Lösungsschlüssel wird auf dem Server entfernt und erreicht den Browser damit nie.

Integritätsereignisse

Tabwechsel, Kopierversuche, eine zweite gleichzeitige Sitzung, auffälliges Timing — jedes am Versuch erfasst, mit der Zeit je Aufgabe.

Warnungen bei Auffälligkeiten

Markiert eine Einreichung, die zu schnell zurückkam, mehrere gleichzeitige Sitzungen oder geringe Beteiligung. Jede Warnung wird quittiert.

Prüfung auf AI-Text

Lassen Sie eine schriftliche Einreichung prüfen und lesen Sie das Ergebnis neben der Arbeit. Es stützt die Entscheidung eines Menschen; es trifft keine.

Nachteilsausgleiche

Zusatzzeit als Prozentsatz, mehr Versuche, eine Befreiung, hoher Kontrast, größere Schrift, Screenreader, reduzierte Bewegung — je lernender Person, automatisch angewendet.

AI-Bewertungsentwürfe

Die AI entwirft Rasterwerte, Rückmeldung und eine vorgeschlagene Bewertung über anonymisierten Kontext. Nichts wird übernommen, bis ein Mensch es bestätigt.

Fragen, die Käufer stellen

Bevor Sie eine Klausur darauf abhalten

Sieben Typen im Anlegen-Ablauf — Quiz, Klausur, Übung, Diagnose, Umfrage, Portfolioaufgabe und psychometrisches Instrument —, die jeweils Auslieferung, Integrität, Bewertung, Rückmeldung und Wiederholungen vorkonfigurieren. Es gibt 19 Fragetypen, darunter Cloze, Hotspot, Matrix, Drag-and-drop, Dateiupload und Audioantwort.

Bringen Sie eine Klausur mit, die Sie bereits abhalten.

Ein Bewertungsraster, das Sie bereits nutzen, eine Portfolioaufgabe, ein psychometrisches Instrument — wir richten es im Termin ein, statt Ihnen einen Beispielkurs zu zeigen.