Forschung

Alles, was wir veröffentlichen, nach Bereichen geordnet.

Deepfake-Erkennung

Detektoren, die zeigen, wohin sie schauen und wie weit man ihren Werten trauen kann.

Publikationen

Projekte

  • xdfdet

    Code und acht trainierte EfficientNet-B4-Modelle zur Deepfake-Erkennung aus der Masterarbeit, mit regionaler Grad-CAM-Analyse und einer öffentlichen Website mit interaktiven Erkennungs- und Schätzspielen.

    Code: MIT. Gewichte: CC BY-NC 4.0 gemäß den Bedingungen von FaceForensics++.

Entscheidungsmodelle

Kleine Modelle, die Fragen auf Englisch, Türkisch und Deutsch mit kalibrierten Wahrscheinlichkeiten beantworten und auf einer Laptop-CPU laufen.

Publikationen

  • JevAlt: Technical report

    Methode, Ergebnisse auf zurückgehaltenen Testdaten und Grenzen der offenen Entscheidungsmodelle für Englisch, Türkisch und Deutsch.

    Technischer Bericht (ohne Peer-Review)

Projekte

  • JevAlt

    Drei offene Entscheidungsmodelle für Englisch, Türkisch und Deutsch. Jede Antwort enthält eine kalibrierte Wahrscheinlichkeit, und die Modelle laufen mit etwa 3 GB RAM.

  • Emberwick

    Ein mittelalterliches Dorf im Browser, in dem die JevAlt-Modelle entscheiden, wie die Bewohner auf Stürme, Feuer, Märkte und Wölfe in der Abenddämmerung reagieren.

Modelle

Datensätze

Lokale KI und offene Werkzeuge

Agenten und Werkzeuge, die auf Ihrem eigenen Rechner laufen.

Publikationen

  • Tholos-2B: Technical report

    Trainingsmethode, Tholos-Bench-Ergebnisse und Grenzen des kleinen lokalen Agentenmodells.

    Technischer Bericht (ohne Peer-Review)

Projekte

  • Tholos

    Kleine Agenten teilen sich eine lokale Arbeitsumgebung mit Tabellen, Notizen und einer Aufgabenübersicht; für jede Aktion gelten Regeln zum Erlauben, Nachfragen und Ablehnen.

  • reevesagents

    Eine lokale tmux-Arbeitsumgebung für Coding-Agenten, mit CLI, Terminaloberfläche, Weboberfläche und MCP-Server in einem npm-Paket unter Apache-2.0.

Modelle

  • Tholos-2B

    Ein 2B-Agentenmodell, auf Basis von MiniCPM5-2B mit ausgeführten Agentenabläufen feinabgestimmt und unter Apache-2.0 mit GGUF-Dateien veröffentlicht.

Datensätze

  • tholos-trajectories

    Ausgeführte Agentenabläufe, die zum Training von Tholos-2B verwendet wurden.

Spracherhalt

Eines der besten Forschungsvorhaben zum Spracherhalt mit kleinen lokalen Modellen.

Projekte

  • Eldalambë

    Ein kleines Sprachmodell, das Quenya und Sindarin liest und schreibt, auch in Tengwar-Schrift, gestützt auf ein grammatisch geprüftes Korpus, mit Werkzeugen für Übersetzung, Nachschlagen, Flexion und Tengwar-Darstellung.

    Code und Gewichte sind privat. Demo auf Einladung.

Öffentliche Benchmarks

Offene Tests und ihre Ergebnisse.

  • JevOss

    Eine offene Testumgebung für Entscheidungsmodelle mit Jev-API: Sie misst Genauigkeit, Kalibrierung der Wahrscheinlichkeiten und Fehlerfälle.

  • jevalt-bench

    Benchmark- und Live-Testergebnisse für JevAlt und die Vergleichsmodelle.

  • Tholos-Bench

    160 Szenarien für lokale Agenten, jeweils am Endzustand der Arbeitsumgebung bewertet.