Marginalien | Kolibri: Wie benchmarkt man Public Sector AI?

Aleph Alphas Modell für die Verwaltung im Check, mit unserem KI-Podcast-Host Kyra

Podcast: Forschungsimpuls – Der Wissenschaftspodcast

Erschienen: 09.10.2026
Dauer: 00:11:17

In dieser Marginalien-Folge schaue ich mir Kolibri an, das neue offene Sprachmodell von Aleph Alpha, gebaut ausdrücklich für regulierte Bereiche wie die öffentliche Verwaltung. Und zum ersten Mal bin ich dabei nicht allein: Kyra, unser neuer KI-Podcast-Host, stellt die Fragen. Transparenz vorab: Kyra ist eine KI. Ihre Stimme ist eine Katalogstimme aus einem Sprachmodell, kein Klon. Ihr Wissen über frühere Folgen stammt aus einer lokalen Datenbank mit allen Transkripten, und ihre Fragen entstehen live auf Basis eines vorher abgestimmten Briefings. Inhaltlich geht es um Aleph Alphas Comeback, um die Frage, wie souverän ein Modell ist, das mit Hilfe fremder Modelle trainiert wurde, und um den internen Verwaltungs-Benchmark, auf dem Kolibri 75 Punkte erreicht und der nicht öffentlich ist. Mein Plädoyer: ein offener Benchmark für Public Sector AI, gebaut gemeinsam mit Verwaltungswissenschaft und Verwaltungsrecht. Wer mitmachen möchte, meldet sich gern bei mir. Und: Wie findet ihr das neue Format mit Kyra? Ich freue mich über euer Feedback.


Weitere Informationen und umfangreichere Shownotes gibt es ggf. auf der Podcast-Website.

Podcast-Website: Episode "Marginalien | Kolibri: Wie benchmarkt man Public Sector AI?"

Logo Podcast "Forschungsimpuls – Der Wissenschaftspodcast"
Merken
QR-Code