Autor: Luca Steinmetz
-

Unknown Unknowns: Was KI-Modelle nicht wissen und warum das für Ihre Rechtsabteilung relevant ist
Sie beauftragen ein KI-System mit der Prüfung eines komplexen Vertrags. Das Modell liefert eine solide Analyse: Korrekte Verweise, schlüssige Argumentation, keine offensichtlichen Fehler. Was es Ihnen aber nicht sagt: Es hat einen ganzen Regelungsbereich schlicht nicht erkannt, weil ihm das konzeptuelle Verständnis dafür fehlt. Kein Hinweis, keine Unsicherheitswarnung, kein Vorbehalt. Das ist das Problem der…
-

AI Benchmarking: Wie aussagekräftig sind die Testergebnisse wirklich?
KI-Anbieter werben mit beeindruckenden Benchmark-Ergebnissen – doch was sagen diese Werte über die tatsächliche Leistung in Ihrem Unternehmen aus? Dieser Beitrag erklärt, was AI Benchmarking ist, welche Methoden es gibt, was Benchmaxing bedeutet und warum Humanity’s Last Exam die Messlatte neu gesetzt hat. AI Benchmarking bezeichnet die systematische Messung und den Vergleich von KI-Modellen anhand standardisierter Tests. Dabei werden die Modelle mit definierten Aufgaben…
-

Von der Antwort zur Aktion – Was KI-Skills wirklich leisten
KI-Skills sollen aus einem Sprachmodell ein Werkzeug machen, das selbstständig recherchiert, prüft, rechnet und Aufgaben bearbeitet, statt nur auf einzelne Fragen zu antworten. Statt jeden Schritt vorzugeben, beschreibt man das Ziel und überlässt dem Assistenten den Weg dahin. Dieser Artikel klärt, was KI-Skills technisch sind, welche Anbieter sie heute schon einsetzen, wie Unternehmen eigene Skills bauen können und…