SANTISMM Labs

Labs

Experimente, Benchmarks, Simulatoren und interaktive Tools zur Erforschung von KI, Agenten, Robotik, Bildung, Produktivität und komplexen Systemen.

Alle Sportatlanten
BenchmarksSimulatorenRechnerKonverterLernspieleExperimente

Benchmarks

BenchmarksSnapshot · Jun 2026
KI-Agenten-Benchmarks

Ein Sättigungs-Tracker für KI-Agenten-Benchmarks: was sie messen, SOTA, Spielraum, der Abstand zum Menschen und Forschungspriorität.

Benchmarks
Wie anspruchsvoll ist jede Prüfung weltweit?

Ein interaktiver Benchmark, der das akademische Anforderungsniveau von 18 Hochschulzugangsprüfungen (PAES, PAU, IB, SAT, Gaokao, Suneung, JEE…) in 7 Dimensionen vergleicht, mit einer Weltkarte, Radardiagrammen und Ranking.

Benchmarks
PAES vs. PAU vs. IB

Ein interaktiver Benchmark, der das akademische Anforderungsniveau der chilenischen PAES, der spanischen PAU und des IB-Diploms in 6 kognitiven Dimensionen und 8 Fächern vergleicht, mit Radardiagrammen.

Simulatoren

Simulatorenv1.0 · Aug 2026
Agentic Control Sandbox

Interaktive Sandbox: Konfigurieren Sie einen Agenten auf sechs Achsen, wählen Sie eine Bedrohung aus den OWASP LLM Top 10, schalten Sie die achtzehn Kontrollen der Agentic Control Matrix ein und aus und lesen Sie die Abdeckung ab – ausgefüllte Quadranten, leer gelassene Quadranten, beantwortete Frameworks. Bewusst ohne Restrisiko-Score.

Rechner

Rechnerv1.0 · Aug 2026
Die tatsächliche Ökonomie eines KI-Agenten

Schätzen Sie die monatlichen Betriebskosten, die Kosten pro korrektem Ergebnis, Einsparungen, ROI und Break-even basierend auf Arbeitsvolumen, Token-Preisen, Tools, Wiederholungsversuchen, menschlicher Überprüfung und Nacharbeit.

Rechnerv1.0 · Aug 2026
Wie viele Evaluierungen benötige ich?

Berechnen Sie, wie viele Fälle Sie benötigen, um mindestens einen Fehler bei einem gewählten Konfidenzniveau zu erkennen und dessen Häufigkeit mit einer expliziten Marge zu schätzen.

Rechnerv1.0 · Aug 2026
Kapazität für menschliche Aufsicht

Dimensionieren Sie Überprüfungsstunden, Eskalationen, FTEs, Kosten, nachhaltiges Volumen und Backlog, bevor Sie ein KI-System in Betrieb nehmen.

Konverter

Konverterv1.0 · Aug 2026
Anwendungsfall → agentischer Vektor

Klassifizieren Sie ein System über sechs Verhaltensachsen und seine Aktionsoberflächen, schätzen Sie seine Governance-Risiko-Klasse ein, machen Sie Kontrollsignale sichtbar und finden Sie seine nächsten Nachbarn unter 24 kartierten Agenten.

Konverterv1.0 · Aug 2026
Kontroll- und Framework-Übersetzer

Verknüpfen Sie die 18 Kontrollen der Agentic Control Matrix mit dem EU AI Act, ISO 42001, NIST AI RMF, OWASP LLM Top 10 und MITRE ATLAS – mit einem expliziten Vorbehalt: Mapping ist keine Compliance.

Konverterv1.0 · Aug 2026
LLM-Kontext in verständlichen Begriffen

Konvertieren Sie Token in Wörter, Seiten, Dokumente, Lese- und Sprechminuten, die Nutzung des Kontextfensters und ungefähre Eingabekosten.

Lernspiele

Lernspielev1.0 · Aug 2026
Schließe die Lücke

Ein Lernspiel in fünf Runden: Wählen Sie unter einem begrenzten Budget die richtigen Governance-Kontrollen aus, schließen Sie die wesentlichen Lücken jedes Agenten und lernen Sie aus direkten Erklärungen.

Lernspielev1.0 · Aug 2026
Modell, Agent oder Harness?

Zwölf Fälle zur Unterscheidung zwischen der Basisfähigkeit, der Ziele verfolgenden Entität und der Infrastruktur, die Kontext, Speicher, Tools und Kontrollen verbindet.

Lernspielev1.0 · Aug 2026
Benchmark-Detektiv

Untersuchen Sie KI-Behauptungen, wählen Sie die Belege aus, die sie tatsächlich prüfen, und erkennen Sie Sättigung, Kontamination, Unsicherheit und irreführende Metriken.

Lernspielev1.0 · Aug 2026
World Exam Challenge

Ein Spiel in zwölf Runden über 18 Hochschulzugangssysteme: Vergleichen Sie das Anforderungsniveau, identifizieren Sie Länder und trennen Sie das kognitive Profil vom Selektionsdruck.

Experimente

Experimentev1.0 · Aug 2026
Homerischer Atlas

Eine probabilistische Karte der Orte, an denen die Episoden der Ilias und der Odyssee stattgefunden haben könnten – jeder Ort klassifiziert als akzeptiert, plausibel, spekulativ oder mythisch, bewertet mit 0–12 Punkten anhand einer veröffentlichten Rubrik, mit Quellen, konkurrierenden Theorien und wiederverwendbarem JSON/GeoJSON.

Experimentev1.1 · Aug 2026
Taxonomie autonomer Agenten

Eine interaktive Taxonomie, die 24 KI-Agenten – von OpenAI, Anthropic, Google, Microsoft, Amazon und SpaceXAI bis hin zur Open-Source-Spitze – als Vektoren über sechs orthogonale Achsen plus einer Aktionsoberfläche kodiert, mit einer filterbaren Tabelle, einer A×T×I-Governance-Risiko-Matrix und einer maschinenlesbaren JSON-API.

ExperimenteJun 2026
Die am stärksten von KI betroffenen Berufe

Eine interaktive Karte der 22 Berufsgruppen, die die theoretische Leistungsfähigkeit von KI mit ihrer beobachteten realen Nutzung vergleicht (Stand Juni 2026), mit einem Kategorie-Ranking, den am stärksten betroffenen Berufen und den Makrozahlen – streng wissenschaftlich belegt.

ExperimenteMundial 2026
Die Geld-Weltmeisterschaft

Welche Nationalmannschaft bei der Weltmeisterschaft 2026 über ihrem Kaderwert spielt. Ein Live-Effizienzindex – Punkte vs. €-Wert – Team für Team.

ExperimenteAtlas
World Surf Atlas

Ein interaktiver Atlas mit über 100 Weltklasse-Wellen – Wellenrichtung (links / rechts / beide), Break-Typ, Niveau und durchschnittliche Wellenhöhe von Monat zu Monat, dargestellt auf einer Weltkarte.

ExperimenteAtlas
World Ski Atlas

Über 130 Skigebiete auf einer Weltkarte – Pistenkilometer, Abfahrten nach Schwierigkeitsgrad, Schneequalität, monatlicher Schneefall, Temperatur und Sonne sowie Skipasspreise.

ExperimenteAtlas
World Bike Park Atlas

Über 40 MTB-/E-Bike-Parks mit Liftbetrieb weltweit – Strecken nach Schwierigkeitsgrad, Höhenunterschied, Kilometer, Saisonfenster und Tageskartenpreise, auf einer Weltkarte.