KI-Modell wählen: Warum „das beste“ die falsche Frage ist · Arbeitsmarktguru

KI in der Praxis

Start › Blog › KI in der Praxis

KI-Modell wählen: Warum „das beste“ die falsche Frage ist

Sechs Modelle, sechs Versprechen – und in vielen Behörden und Betrieben trotzdem ein Tool für alles. Wer ein KI-Modell wählt, entscheidet nicht über Technik, sondern über Arbeitsweise. Dieser Beitrag ordnet Claude, ChatGPT, Gemini, Grok, Kimi und Copilot nach Aufgaben – mit Stand September 2026 und Blick auf öffentlichen Dienst und KMU.

AMG+

von Sven Neuenfeldt  |  9. September 2026  |  Lesezeit: 9 Min.

Sechs Puzzleteile mit den Namen von KI-Modellen, die sich zu einem Bild zusammensetzen
Welches Teil fehlt in Ihrem Team – und welches liegt doppelt auf dem Tisch? (Bild: KI-generiert)
Das Wichtigste in 60 Sekunden
  • Es gibt kein bestes KI-Modell. Es gibt das passende für Text, Bild, Sprache, Recherche oder eigene Infrastruktur.
  • Modellübersichten altern in Wochen: Drei Angaben der verbreiteten Puzzle-Grafik sind im September 2026 schon überholt.
  • Der Weg im Team: drei Kernaufgaben benennen, je einem Modell zuordnen, nach vier Wochen gemeinsam prüfen.

Warum gibt es das eine beste KI-Modell nicht?

Weil jedes dieser Modelle für eine andere Art von Arbeit gebaut wurde – und weil sich die Rangfolge alle paar Wochen verschiebt. Wer ein KI-Modell wählen will, stellt deshalb die Frage nach dem Besten in der Regel falsch. Die richtige Frage lautet: Was liegt auf meinem Schreibtisch?

Stellen Sie sich eine Sachgebietsleiterin vor, die morgens eine 80-seitige Ausschreibung prüfen, ein Erklärbild fürs Intranet erstellen und ein Schreiben ins Türkische übersetzen muss. Sie öffnet für alle drei Aufgaben denselben Chatbot. Bei einer wird sie zufrieden sein. Bei zweien wird sie nacharbeiten – und der KI die Schuld geben.

Genau hier setzt eine Grafik an, die seit Wochen durch LinkedIn und Teams-Kanäle wandert: sechs Puzzleteile, sechs Modelle, für jedes ein Steckbrief. Die Idee dahinter ist richtig. Die Details sind es teilweise nicht mehr. Die Grafik nennt Grok 4.5 – xAI hat im August 2026 bereits Grok 4.6 nachgelegt (FullStack Labs, 2026). Sie nennt Gemini 3.5 Flash als Google-Arbeitspferd – Google führt seit Juli 2026 Gemini 3.6 Flash als Nachfolger (Google AI for Developers, Changelog 2026). Und sie behauptet, Copilot arbeite im Hintergrund mit einem älteren GPT-5.2 – tatsächlich hat Microsoft am 9. Juli 2026 GPT-5.6 zum bevorzugten Modell in Word, Excel, PowerPoint und Copilot Chat gemacht (Microsoft 365 Copilot Blog, 2026).

Das ist kein Vorwurf an die Grafik. Es ist der Beleg für ihr eigentliches Problem: Wer sich an Versionsnummern orientiert, kauft eine Momentaufnahme. Wer sich an Aufgaben orientiert, trifft eine Entscheidung, die das nächste Update überlebt.

Welches Modell passt zu welcher Aufgabe?

Das hängt davon ab, was Sie tatsächlich produzieren: Text, Bilder, mehrsprachige Inhalte, Stimmungsbilder aus sozialen Medien oder eine KI, die auf eigener Hardware läuft. Die sechs Modelle aus der Grafik decken genau diese Felder ab – jedes anders.

Claude ist das Modell für lange Texte und dicke Akten. Anthropic hat am 24. Juli 2026 Opus 5 veröffentlicht, mit einem Kontextfenster von einer Million Token als Standard (Anthropic, Platform-Dokumentation 2026) – das entspricht grob einer halben Million englischer Wörter (ravnmedia, 2026). Das Modell denkt vor der Antwort nach, erstellt Word-, Excel- und PDF-Dateien und liest im Cowork-Modus Dateien vom eigenen Rechner. Nutzen Sie es für Berichte, Verträge und Konzeptpapiere. Die Grafik nennt es „die beste KI für jede Schreibaufgabe“. Ob das stimmt, entscheidet Ihr Text – nicht die Grafik.

ChatGPT ist die erste Wahl für Bilder. OpenAI hat am 8. September 2026 ChatGPT Images 2.5 freigeschaltet, mit präziserer Bearbeitung und bis zu 50 Prozent kürzerer Generierungszeit gegenüber Images 2.0 (OpenAI, 2026). Lesbare Schrift im Bild, Produktmockups, Thumbnails, Infografiken: Hier liegt die Stärke. Die Textmodelle GPT-5.6 laufen seit Juli 2026 in drei Stufen – Sol, Terra und Luna (OpenAI Help Center, 2026). Nutzen Sie ChatGPT, wenn Text und Bild in einem Arbeitsschritt zusammenkommen.

Gemini ist das Modell für Mehrsprachigkeit und für alles, was in Google-Diensten liegt. Google hat Gemini 3.5 Flash im Juni 2026 zum Standardmodell in fast 200 Ländern und 98 Sprachen erklärt (ad-hoc-news, 2026). Das Modell versteht YouTube-Links direkt und ist in Workspace und Suche eingebaut. Nutzen Sie es für Übersetzungen, die kulturelle Nuancen halten müssen, für Bürgerkommunikation in mehreren Sprachen und für Videotranskripte.

Grok ist das Modell für den Moment. Der direkte Zugriff auf X-Daten macht es zum Werkzeug für Stimmungsbilder, Trends und Breaking News. xAI hat Grok 4.5 am 8. Juli 2026 vorgestellt; die Freigabe für EU-Nutzer wurde auf Mitte Juli verschoben, vermutlich aus rechtlichen Gründen (heise, 2026). Für Behörden und Betriebe heißt das: Grok ist ein Radar, kein Sachbearbeiter. Die Datenquelle ist ein soziales Netzwerk – das passt nicht in jeden Kontext.

Kimi K3 ist das stärkste offene Modell. Moonshot AI aus Peking hat die Gewichte am 27. Juli 2026 freigegeben: 2,8 Billionen Parameter, 896 Experten, davon 16 pro Token aktiv, eine Million Token Kontext (Moonshot AI, Technical Report 2026). Offene Gewichte heißen: Sie können das Modell auf eigener Infrastruktur betreiben. Sie heißen nicht: Das ist einfach. Der Betrieb braucht Mehrknoten-GPU-Cluster (Hugging Face, 2026), und die Lizenz ist eine eigene, keine MIT-Lizenz (Layer3 Labs, 2026). Nutzen Sie Kimi, wenn Datensouveränität wichtiger ist als Komfort – und jemand den Cluster pflegt.

Copilot ist das Modell, das in vielen Verwaltungen und Betrieben längst freigeschaltet ist – und das ist sein größter Vorteil. Es läuft im Microsoft-365-Tenant, innerhalb der Datenschutz- und Compliance-Regeln, die Ihre IT ohnehin verantwortet. Seit dem 9. Juli 2026 arbeitet es mit GPT-5.6 (Microsoft, 2026). Die Schwäche: Microsoft zeigt nicht, welche GPT-5.6-Variante hinter „Quick Response“ oder „Think Deeper“ steckt (Office-Watch, 2026), und außerhalb von Office ist Copilot unflexibel. Nutzen Sie es für alles, was in Word, Excel und Outlook beginnt und dort endet. Für Aufgaben darüber hinaus brauchen Sie ein zweites Werkzeug – kein besseres.

ModellStärkeNutzen fürStand Sept. 2026
ClaudeLange Texte, Dokumente, DateienBerichte, Verträge, KonzepteOpus 5 (Juli 2026)
ChatGPTBildgenerierung, Text + BildVisuals, Mockups, ThumbnailsGPT-5.6, Images 2.5
GeminiSprachen, YouTube, WorkspaceÜbersetzung, Bürgerkommunikation3.5 / 3.6 Flash
GrokEchtzeit, X-DatenTrends, StimmungsbilderGrok 4.6 (Aug. 2026)
Kimi K3Offene Gewichte, eigener BetriebDatensouveränität, AgentenGewichte seit 27.07.2026
CopilotMicrosoft-365-IntegrationOffice-Alltag im TenantGPT-5.6 seit 09.07.2026

Was heißt das für Behörden und KMU?

Dass die Aufgabe das Modell bestimmt – und Datenschutz, Beschaffung und Transparenzpflicht den Rahmen setzen, in dem Sie wählen dürfen. Drei Dinge gehören vor jede Modellentscheidung.

Erstens die Datenklasse. Bevor jemand fragt, welches Modell besser schreibt, muss geklärt sein, welche Daten überhaupt hinein dürfen: personenbezogene Daten aus Akten nicht in eine Consumer-App, interne Vermerke nur mit Auftragsverarbeitungsvertrag. Diese Regel klingt banal. In den meisten Teams, mit denen ich arbeite, fehlt sie – und dann entscheidet der Zufall, was in welchem Chatfenster landet.

Zweitens die Kennzeichnung. Die Transparenzpflichten aus Artikel 50 der KI-Verordnung der EU gelten seit dem 2. August 2026 (Verordnung (EU) 2024/1689). Wer KI-generierte Bilder, Stimmen oder Texte veröffentlicht, muss das in bestimmten Fällen kenntlich machen. Legen Sie fest, wer bei Ihnen prüft, was gekennzeichnet werden muss – bevor der erste Newsletter mit KI-Bild rausgeht.

Kurz erklärt: Offene Gewichte

Ein Modell mit offenen Gewichten kann heruntergeladen und auf eigener Hardware betrieben werden – die Daten verlassen das Haus nicht. Der Preis dafür ist Betriebsaufwand: Rechenleistung, Fachpersonal, Wartung. Offene Gewichte sind eine Kontrollentscheidung, keine Sparentscheidung.

Quelle: Moonshot AI, Kimi K3 Technical Report, 2026; Hugging Face, 2026

Drittens die Beschaffung. Im öffentlichen Dienst ist das freigeschaltete Modell oft nicht das beste, sondern das einzige zugelassene. Dann gilt: Holen Sie aus Copilot heraus, was drin ist – und dokumentieren Sie, welche Aufgaben damit nicht gehen. Das ist das Argument für die nächste Beschaffungsrunde. Ein KMU hat mehr Freiheit und trägt mehr Verantwortung: Die Geschäftsführung entscheidet selbst, ob ein Modell aus Peking oder San Francisco die Kundendaten sieht.

Wer sich an Versionsnummern orientiert, kauft eine Momentaufnahme. Wer sich an Aufgaben orientiert, trifft eine Entscheidung. Kernsatz dieses Beitrags

Wie wählen Sie das KI-Modell im Team – ohne Tool-Zoo?

Mit einer Aufgabenliste statt einer Modellliste. Der Tool-Zoo entsteht nicht, weil Teams zu viele Modelle kennen, sondern weil niemand festgelegt hat, wofür welches gedacht ist. Drei Kernaufgaben pro Team, je ein Modell, eine Regel – mehr braucht der Start nicht.

Aus 25 Jahren Qualifizierungsarbeit weiß ich: Die Wahl des Werkzeugs ist eine Lernfrage. Wer seinem Team ein Modell vorschreibt, bekommt Anwender. Wer sein Team die Zuordnung selbst erarbeiten lässt, bekommt Mitgestaltende, die beim nächsten Versionssprung wissen, worauf es ankommt. Der Unterschied zeigt sich nicht in der ersten Woche. Er zeigt sich beim ersten Update.

Ein Muster, das in Verwaltungsteams wie in Handwerksbetrieben funktioniert: Jedes Teammitglied notiert eine Woche lang, welche Aufgaben es an eine KI gegeben hat und wie zufrieden es war. Danach ordnet das Team in einer Stunde zu. Das Ergebnis passt auf eine DIN-A4-Seite und hängt im Teamraum.

Praxis

Drei Schritte für die kommende Woche

1

Benennen Sie die drei häufigsten KI-Aufgaben Ihres Teams Nicht „Texte schreiben“, sondern konkret: Bescheide vorformulieren, Sitzungsprotokolle kürzen, Stellenanzeigen entwerfen. Je konkreter die Aufgabe, desto klarer die Modellwahl.

2

Ordnen Sie jeder Aufgabe genau ein Modell zu – und eine Datenregel Welches Modell, welche Daten dürfen rein, wer kennzeichnet. Eine Zeile pro Aufgabe. Was nicht auf die Seite passt, ist noch nicht entschieden.

3

Terminieren Sie die Überprüfung in vier Wochen Tragen Sie den Termin heute ein. Modelle ändern sich monatlich; Ihre Zuordnung darf das auch. Was keinen Termin hat, bleibt so, wie es zufällig entstanden ist.

Was Sie vermeiden sollten

Ein Modell für alles per Dienstanweisung festlegen. Das fühlt sich nach Ordnung an und erzeugt Schatten-KI: Wer mit dem vorgegebenen Werkzeug nicht weiterkommt, nimmt heimlich ein anderes – ohne Datenregel, ohne Kennzeichnung.

Nach Benchmark-Rankings kaufen. Die Ranglisten wechseln im Wochentakt, und keine davon misst, ob ein Modell Ihre Bescheide im richtigen Ton schreibt. Testen Sie mit drei echten Aufgaben aus Ihrem Alltag. Das dauert einen Nachmittag und sagt mehr als jede Tabelle.

Auf das „beste“ Modell warten. Es kommt nicht. Jede Wartezeit ist verlorene Lernzeit für Ihr Team – und die holt niemand nach, wenn das nächste Update da ist.

Fazit

Die Puzzle-Grafik hat recht mit ihrem Bild: Kein Teil ist das ganze Bild. Sie irrt nur dort, wo sie Versionsnummern als Antwort verkauft. Die Antwort liegt in Ihren Aufgaben, Ihren Daten und Ihrem Team. Wer das einmal sauber sortiert hat, wechselt Modelle so, wie er heute Formulare wechselt: ohne Drama.

Wenn Sie diese Sortierung mit Ihrem Führungsteam anlegen wollen – in einem halbtägigen Workshop, mit Ihren echten Aufgaben statt mit Folien –, dann vereinbaren wir einen Termin. Ich bringe die Methode mit. Sie bringen die Fälle mit. Bleiben Sie neuGIERig.

Sven Neuenfeldt hält sich zwei gelbe Smiley-Bälle vor die Augen
Über den Autor

Sven Neuenfeldt

Zertifizierter Professional Speaker (GSA SHB), Senior-Trainer und Berater für Arbeitsmarkt- und Qualifizierungsfragen. Seit über 25 Jahren trainiert und begleitet er Führungskräfte im öffentlichen Dienst und in KMU — bei Lernkultur, Führungsentwicklung und digitaler Transformation. Er entwickelt Qualifizierungskonzepte, hält Keynotes im deutschsprachigen Raum und bringt zusammen, was in der Praxis meist getrennt bearbeitet wird: Arbeitsmarkt, Führung und Lernen. Sein Motto: Bleiben Sie neuGIERig.

Sie haben Fragen? Ich gebe Ihnen Impulse und Antworten. Sie haben eine Herausforderung? Wir finden gemeinsam Lösungen.


Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert