Die richtige KI. Für die richtige Aufgabe. Im richtigen Kontext.
Modellstrategie für den KI-gestützten Nachhaltigkeitsbericht der Sparkasse Fürstenfeldbruck: Microsoft-first in der Arbeitsoberfläche, Multi-Model in der Qualitätssicherung und Governance über den gesamten Daten- und Modell-Lifecycle.
Microsoft-first Governance.
Multi-Model für Qualität.
Routing statt Einheitsmodell.
Copilot und Teams bilden die sichere Enterprise-Arbeitsoberfläche. Ein Managed-AI-Layer steuert RAG, Agenten, Modellrouting und Qualität. Spezialmodelle werden nur dort eingesetzt, wo sie einen messbaren Mehrwert schaffen.
Jede Schicht hat eine klar abgegrenzte Rolle – vom Arbeitsalltag bis zur Datensouveränität.
Microsoft bildet die primäre Arbeits- und Integrationsoberfläche.
Modelle
OpenAI GPT · Claude · Gemini
Einsatz
Nicht jeder Nutzer benötigt jedes Modell. Spezialmodelle werden gezielt eingesetzt.
Einbeziehen
Mistral · Llama · Qwen · DeepSeek · Kimi · GLM
Einsatz
Mehr Datensouveränität bedeutet gleichzeitig mehr Betriebs- und Governance-Verantwortung.
Die Ampel entscheidet, welche Modelle und Umgebungen für eine Information zulässig sind.
Von der Arbeitsoberfläche bis zum Multi-Model-Router – jedes System hat eine definierte Aufgabe im Gesamtbild.
Teams · Word · Excel · Outlook · PowerPoint · SharePoint · Copilot Studio
Enterprise-Arbeitsoberfläche für den Kunden.
ChatGPT · ChatGPT Work · Codex · API
Claude · Projects · Claude Code · Skills · MCP
Sehr stark für Long-form Content und strukturierte Wissensarbeit.
Gemini · AI Studio · Deep Research
Spezial- und Benchmark-Modell, nicht primäre Arbeitsplattform.
Regel: Rechercheergebnisse nie ungeprüft als fachliche Wahrheit übernehmen. Quellen, Datum und Abruf müssen dokumentiert werden.
Multi-Model-Router für Test, Benchmarking und A/B-Vergleiche
Für Bankproduktion nur nach Prüfung von: Provider, Datenregion, Logging, Datenschutz, DPA, Subprozessoren, DORA, Informationssicherheit.
Mistral · Llama · Qwen · DeepSeek · Kimi · GLM
Open Weight ist nicht automatisch vollständig Open Source.
LongDoc ist keine einzelne Plattform, sondern eine Verarbeitungsstrategie – z. B. für ESRS, CSRD, Richtlinien, Nachhaltigkeitsberichte, Policies, Prüfberichte, Verträge, große PDF-Sammlungen.
Dokumente direkt in ein Modell mit großem Kontext geben.
Geeignet für
Dokumente indexieren und nur relevante Textstellen abrufen.
Geeignet für
Die zehn häufigsten Aufgaben im Berichtsprozess, jeweils mit Primärlösung, Alternative und Datenklasse.
| Aufgabe | Primärlösung | Alternative | Warum | Datenklasse |
|---|---|---|---|---|
| Teams / Meetings / Zusammenarbeit | Microsoft 365 Copilot | – | Native Integration ins Arbeitsumfeld | Gelb |
| Word- und PowerPoint-Bericht | Copilot + ChatGPT Work | Claude für Redaktions-QA | Officenahe Erstellung, hochwertige Zweitmeinung | Gelb |
| ESRS / CSRD / Taxonomie Research | Deep Research / Perplexity / ChatGPT Research | Gemini / Claude | Aktuelle, breite Quellenlage | Grün |
| Große PDF-Mengen | Gemini oder Claude | RAG + GPT/Claude/Gemini (Produktion) | Großer Kontext bzw. nachvollziehbare Produktion | Gelb |
| ESG-Daten extrahieren | Günstige Modelle (Luna-/Flash-/Haiku-Klasse) | – | Hohes Volumen, geringe Komplexität | Gelb |
| Komplexe Plausibilitätsprüfung | GPT Sol / Claude Opus-Klasse | Gemini Pro (Cross-Check) | Höchste Reasoning-Tiefe nötig | Gelb / Rot |
| Agenten | Copilot Studio / freigegebene Managed-AI-Plattform | OpenAI Agents, Claude Skills | Governance & Logging integriert | Gelb |
| Website / HTML / Coding | Codex | Claude Code, Gemini CLI | Spezialisiert auf Codequalität | Grün |
| Modellvergleich | OpenRouter + eigenes Eval-Set | Hugging Face | Neutraler Multi-Provider-Vergleich | Grün |
| Höchste Datensouveränität | Private Open-Weight-Modelle | – | Volle Kontrolle über Infrastruktur & Daten | Rot |
Je höher die Stufe, desto mehr Kontrolle, Logging und Freigabe sind erforderlich.
Ein Managed-AI-Layer steuert das Routing zwischen günstigen, Standard- und Frontier-Modellen.
Zentrale Steuerungsschicht für RAG, Agenten, Routing, Guardrails und Freigaben
Von DSGVO und DORA bis zur Exit-Strategie – 18 Kontrollpunkte, die die Modellstrategie absichern.
Dieselben Pflicht-Gates wie im Cloud-Strategie-Blueprint – konsistent über das gesamte Berichtssystem.
Human-in-the-Loop ist verpflichtend.
Preise ändern sich häufig – vor jeder Beschaffung gegenprüfen.
ca. 26 € / Nutzer / Monat
bei jährlicher Abrechnung, abhängig vom Vertrag
verbrauchs- / creditbasiert
Pay-as-you-go
Provider Routing / dedizierte Inference-Endpunkte
Für Claude, Gemini, Mistral, DeepSeek, Qwen u. a.: keine starren Preise, solange sie nicht aktuell verifiziert sind. Stattdessen gilt: aktuellen Listenpreis vor Beschaffung prüfen.
Tokenkosten, Arbeitszeit, Retry-Kosten, Nachbearbeitung, Fehler, Qualität, First-Pass-Freigabe, Quellenqualität und Geschwindigkeit fließen gemeinsam in die Bewertung ein.
Kosten pro erfolgreich erledigter Aufgabe
Modelle, Preise und Regulatorik verändern sich schneller als klassische IT-Strategien – drei feste Prüfrhythmen fangen das ab.
Mit identischen Testaufgaben
Drei Phasen, klar messbar, mit definierter Entscheidung am Ende.
GO / ADJUST / STOP
Für den KI-gestützten Nachhaltigkeitsbericht empfiehlt sich kein Winner-takes-all-Modell. Die robuste Lösung ist eine Microsoft-first Enterprise-Arbeitsoberfläche mit kontrollierter Multi-Model-Strategie, RAG und Quellenbeleg, kostenbasiertem Routing sowie klaren Human- und Governance-Gates.