VerwaltungsGPT – Use-Case Sprint: Die 2 besten Entlastungsfälle finden, 15. OktoberAnmelden

Modellunabhängig

GPT, Claude und Open Source in einer Oberfläche: wechselbar mitten im Gespräch, ohne den Verlauf zu verlieren.

Modelle
GPT 5.6 Terra Instant
GPT 5.6 Sol Thinking
Claude Opus 5
Claude Sonnet 5
Qwen 3.5
VerwaltungsGPTGPT 5.6 Terra Instant
Neue Nachricht an hermine.ai …
Deep Research

Die Modelle.

20 Modelle, Stand August 2026. Standardmodell im Chat ist GPT 5.6 Terra Instant.

OpenAI16
über Microsoft Azure AI Foundry
GPT 5.6 SolSpitzenmodell für die anspruchsvollsten Analysen
Premium
GPT 5.6 TerraAusgewogener Standard, Voreinstellung im Chat
General
GPT 5.6 LunaKostengünstig und schnell für Alltag und Automatisierung
Efficient
GPT 5.4-nanoUltraschnell für kurze Abfragen und Zusammenfassungen
Lightweight
+ 12 weitere aus den Generationen 5.1 bis 5.5
Anthropic2
über Microsoft Azure AI Foundry
Claude Opus 5Leistungsstärkstes Claude-Modell für nuanciertes Reasoning und hochwertige Texte
Premium
Claude Sonnet 5Ausgewogenes Claude-Modell für Alltag, Analyse und längere Textarbeiten
General
Open Source2
Qwen 3.5MoE-Modell mit 397B Parametern (17B aktiv), multimodales Reasoning, 201 Sprachen
Open Source
Qwen 3.6 35bKompaktes MoE-Modell mit 35B Parametern (3B aktiv), selbst gehostet in der EU
Open Source
Gut zu wissen
Admin entscheidet mitModelle lassen sich pro Account freischalten oder ausblenden
Denkdauer regelbarBei Reasoning-Modellen: Schnell, Standard oder Umfassend
Neue ModelleErscheinen in derselben Liste, ohne Umbau Ihrer Assistenten

Welches Modell
passt zu welcher Aufgabe?

Als Faustregel: im Zweifel mit dem Standardmodell anfangen und hochschalten, wenn die Antwort nicht trägt.

Bestes Default für fast alles
GPT 5.6 Terra Instant
Anspruchsvollste Aufgaben, beste Qualität
GPT 5.6 Sol ThinkingoderClaude Opus 5
Komplexe Planung und tiefe Analysen
GPT 5.6 Terra ThinkingoderGPT 5.6 Sol Thinking
Hochwertige Texte, längere Dokumente
Claude Sonnet 5oderClaude Opus 5
Übersetzungen und Reporting, günstig und schnell
GPT 5.6 Luna InstantoderGPT 5.4-mini
Klassifizierungen und kurze Abfragen
GPT 5.4-nanooderGPT 5.6 Luna Instant
Code und Logik
GPT 5.6 Sol ThinkingoderGPT 5.6 Luna Thinking
Open-Source-Anforderung, viele Sprachen
Qwen 3.5oderQwen 3.6 35b

Modellvielfalt
ohne Datenreise.

Die Auswahl ist groß, der rechtliche Rahmen bleibt derselbe: DSGVO-konform, Hosting in Deutschland und der EU, Mandantentrennung bis auf Dokumentebene.

Ein Vertrag statt fünfSie schließen einen einzigen Vertrag mit hermine.ai, der alle Modellanbieter abdeckt.
Admins steuern die AuswahlWelche Modelle im Chat erscheinen, entscheiden Sie pro Account.
Open Source als RückfallebeneFür Anforderungen ohne US-Anbieter stehen Qwen 3.5 und 3.6 bereit, selbst gehostet in der EU.
Plattform
DSGVO-konform
Datenhoheit in der EU
Ein Vertrag für alle Modelle
Modelle pro Account freischaltbar
Mandantentrennung
Open-Source-Modell verfügbar
Hosting / Deutschland & EU
Die Plattform läuft auf Servern von Hetzner in Deutschland und Finnland. GPT- und Claude-Modelle werden über Microsoft Azure AI Foundry mit europäischem Endpunkt bereitgestellt, per Auftragsverarbeitung und ohne Training mit Ihren Daten. Die Open-Source-Modelle laufen selbst gehostet bei Scaleway in Frankreich. Wer US-Anbieter ausschließen muss, deaktiviert GPT und Claude pro Account und arbeitet mit den Open-Source-Modellen. Auf Wunsch läuft die Plattform dediziert in Ihrer Cloud oder On-Premises.
Betriebsmodelle
Cloud in Deutschland / EU
Dedizierte Instanz in Ihrer Cloud
On-Premises in Ihrem Haus
Entwickelt in Deutschland · zauberware

Fragen zur
Modellauswahl.

Was in Demos und Schulungen am häufigsten gefragt wird.

Ja. Der bisherige Chat-Verlauf wird an das neue Modell übergeben. Sie können also mit einem schnellen Modell sammeln und für die Ausarbeitung hochschalten. Die Auswahl merkt sich hermine.ai für kommende Chats.

Reasoning-fähige Modelle tragen in der Liste das Badge „Denkmodus". Sie arbeiten vor der Antwort mehrere Schritte durch. Bei ihnen lässt sich zusätzlich die Denkdauer einstellen: Schnell, Standard oder Umfassend.

Welche Modelle in der Auswahl erscheinen, steuern Ihre Admins pro Account. GPT- und Claude-Modelle laufen über Microsoft Azure AI Foundry und lassen sich separat deaktivieren, dann arbeitet Ihr Account ausschließlich mit den Open-Source-Modellen.

Sie kommt in dieselbe Liste. Ihre Assistenten, Wissensdatenbanken, Prompt-Vorlagen und Werkzeuge bleiben unverändert, es ändert sich nur, welches Modell dahinter rechnet.

Drei Hebel: das Reasoning-Modell nur für den Plan nutzen und die Ausführung an ein Instant-Modell geben; den Kontext schlank halten und umfangreiche Dokumente in eine Wissensdatenbank legen; Ausgaben über Prompt-Vorlagen standardisieren, damit Nachfragen entfallen.

Sprechen wir über Ihren Anwendungsfall.

Sagen Sie uns, was Sie vorhaben. Wir zeigen Ihnen hermine.ai live.

30 Min · online · kostenlosDemo vereinbaren
Öffnen Sie unseren Kalender und suchen Sie sich einen Termin aus.