Modell-Übersicht·Verfügbare KI-Modelle

Verfügbare KI-Modelle

Von GPT über Claude und Gemini bis zu Open-Source-Modellen wie Llama, Mistral und DeepSeek, wir integrieren das passende Modell für Ihren Anwendungsfall. Viele Modelle sind EU-DSGVO-konform oder auf eigener GPU-Hardware hostbar.

50+ verfügbare Modelle
EU-DSGVO konforme Optionen
Self-Hosting auf GPU-Hardware möglich
OpenAI·GPT & Sora

GPT-, Bild- und Videomodelle von OpenAI

Vom leistungsstärksten Produktionsmodell bis zu ressourcenschonenden Varianten.

GPT 5.2 Pro

Ist das leistungsstärkste Produktionsmodell der GPT-5.2-Familie von OpenAI und wird über die Responses API für Workloads mit höchsten Anforderungen an Genauigkeit, Schlussfolgern, Tool-Nutzung sowie Kontext und Durchsatz bereitgestellt. LLM · EU-DSGVO konform · Input 1.047.576 / Output 32.768 Tokens.

GPT 5.2 chat

Ist der chatoptimierte Snapshot der GPT-5.2-Familie von OpenAI (in ChatGPT als GPT-5.2 Instant bekannt) und eignet sich für interaktive Anwendungen mit Bedarf an Geschwindigkeit, langen Kontexten, multimodalen Eingaben und stabilem Dialogverhalten. LLM · EU-DSGVO konform.

GPT 5.2 Mini

Ressourcenschonende, kompakte Variante der GPT-5.2-Familie, optimiert für leichtgewichtige Anwendungen und hohe Request-Raten. LLM · EU-DSGVO konform · Input 1.047.576 / Output 32.768 Tokens.

Sora 2 Pro

Sora 2 Pro ist ein leistungsstarkes Modell zur Mediengenerierung, das aus Text oder Bildern dynamische Videos mit synchronisiertem Audio erzeugt. Bildgenerierung · EU-DSGVO konform.

Sora 2

Äußerst leistungsstarkes Modell zur Videogenerierung mit Soundeffekten, unterstützt Chat-Format. Bildgenerierung · EU-DSGVO konform.

GPT Image 1.5

GPT-Image-1.5 ist ein multimodales GPT-Modell zur Bildgenerierung aus Textprompts und präzisen Bearbeitungen von Eingabebildern gemäß Nutzeranweisungen. Bildgenerierung · EU-DSGVO konform.

GPT 4.1

Kontextoptimiertes OpenAI-Modell für umfangreiche Dokumente, tiefgehendes Research und komplexe Coding-Aufgaben. LLM · EU-DSGVO konform · Input 1.047.576 / Output 32.768 Tokens.

GPT 4.1 Mini

Optimierte, ressourcenschonende Variante von GPT-4.1, gleicher Kontextumfang wie das Originalmodell. LLM · EU-DSGVO konform.

GPT 4.1 Nano

Ressourcenschonende Mikro-Version von GPT-4.1, optimiert für leichtgewichtige Anwendungen und hohe Request-Raten. LLM · EU-DSGVO konform.

GPT 4o

Ein modernes, multimodales Spitzenmodell für Echtzeitverarbeitung von Text, Audio und Bild, das durch hohe Intelligenz und beeindruckende Leistungsfähigkeit besticht. LLM · EU-DSGVO konform · Input 128.000 / Output 16.384 Tokens.

GPT 4o Mini

Eine schnelle und kostengünstige Variante von GPT-4o, die durch exzellentes logisches Denken und Multimodalität überzeugt – perfekt für skalierbare und effiziente Anwendungen. LLM · EU-DSGVO konform.

GPT Image 1

OpenAIs fortschrittliche Engine zur Generierung und Bearbeitung von Bildern aus Text, optimiert für hohe Realismus- und Variationsvielfalt. Bildgenerierung.

GPT o3

Optimiertes Modell für strukturiertes Reasoning und die Bearbeitung komplexer, mehrstufiger Logikprozesse. LLM · Input 200.000 / Output 100.000 Tokens.

GPT o3-mini

Optimierte o3-Version mit Fokus auf Kostenersparnis und effizienter Leistung. LLM · Input 200.000 / Output 100.000 Tokens.

GPT o4-mini

Optimiertes Multimodalmodell mit hoher Verarbeitungsgeschwindigkeit, erweitertem Reasoning und Coding-Unterstützung. LLM · Input 200.000 / Output 100.000 Tokens.

GPT o4-mini-high

Optimierte High-Performance-Variante von o4-mini, speziell für umfangreiche Aufgaben und komplexe logische Prozesse. LLM · Input 200.000 / Output 100.000 Tokens.

GPT-OSS 120B

Erstes Open-Source-Modell von OpenAI, optimiert für hohe Performance und MXFP4-natives Training. LLM · Input 200.000 / Output 100.000 Tokens.

Google·Gemini, Imagen & Veo

Modelle von Google

Multimodale Sprach-, Bild- und Videomodelle mit großen Kontextfenstern.

Gemma 3 27B Instruct

Ein schlankes Multimodal-KI-Modell mit ausgezeichneter Kontextverarbeitung und umfassender Mehrsprachigkeitsunterstützung. LLM · EU-DSGVO konform · Input 128.000 / Output 16.000 Tokens.

Gemini-3-flash

Ist ein leichtgewichtiges, effizientes, multimodales Modell von Google, das für reale Anwendungen mit schnellen Antworten und geringer Latenz entwickelt wurde. LLM · EU-DSGVO konform · Input 1.000.000 / Output 62.000 Tokens.

Nano Banana Pro

Ist ein hochmodernes Modell für die visuelle Erstellung und Bearbeitung. Im Gegensatz zu rein textbasierten Modellen liegt sein Fokus auf der Transformation kreativer Konzepte in hochauflösende Bilder. Es unterstützt komplexe Workflows im Bereich Design, Marketing und digitale Kunst. Bildgenerierung · EU-DSGVO konform.

Gemini 3 Pro

Leistungsstarkes Modell für Programmierung, Mathematik und logisches Denken, mit Deep Think-Modus für mehrstufige Problemlösungen. LLM · EU-DSGVO konform · Input 1.000.000 / Output 65.000 Tokens.

Gemini 2.5 Pro

Hauptmodell für Analyse und Verarbeitung langer Kontexte (bis zu 1 Mio. Token), verfügbar in Gemini Advanced. LLM · EU-DSGVO konform.

Gemini 2.5 Flash-Lite

Kosteneffiziente Variante für Aufgaben mit minimaler Latenz. LLM · EU-DSGVO konform · Input 1.000.000 / Output 65.000 Tokens.

Gemini 2.5 Flash

Hochleistungsmodell von Google zur multimodalen Verarbeitung von Text, Bild, Audio und Video, optimiert für komplexe Analyse, Research und tiefgehendes Reasoning. LLM · EU-DSGVO konform · Input 1.000.000 / Output 32.768 Tokens.

Veo 3 Pro

Ist ein Videomodell in Produktionsqualität mit hoher Wiedergabetreue, nativem Ton und erweitertem Tooling. Videogenerierung · EU-DSGVO konform.

Imagen 4 Pro

Fortgeschrittenes Modell für generative Bild-KI, optimiert für ein ausgewogenes Verhältnis von Renderqualität und Verarbeitungsgeschwindigkeit. Bildgenerierung · EU-DSGVO konform.

Imagen 4 Ultra

Hochleistungs-Bildmodell von Google, optimiert für präzises Editing, stilistische Anpassungen und treue Umsetzung von Textvorgaben. Bildgenerierung · EU-DSGVO konform.

Imagen 4 Fast

Optimiertes Bildgenerierungsmodell, ausgelegt für hohe Geschwindigkeit und parallele Verarbeitung großer Datenmengen. Bildgenerierung · EU-DSGVO konform.

Anthropic·Claude

Claude-Modelle von Anthropic

Instruktionsoptimierte Modelle für komplexes Schlussfolgern, Programmierung und Dialoge.

Claude Sonnet 4.5

Claude Sonnet 4.5 verbessert die Fähigkeiten für praktische Computeraufgaben erheblich: Auf OSWorld stieg es von 42,2 % (Sonnet 4) auf 61,4 % an die Spitze. Die Claude for Chrome-Erweiterung nutzt diese Verbesserungen direkt. LLM · EU-DSGVO konform · Input 200.000 / Output 64.000 Tokens.

Claude Opus 4.5

Ist ein instruktionsoptimiertes Modell von Anthropic für komplexes Schlussfolgern, Programmierung und Multi-Turn-Dialoge, mit erweiterten Kontext-, Tool- und RAG-Funktionen, strukturierten Ausgaben und Sicherheitskontrollen. LLM · EU-DSGVO konform · Input 200.000 / Output 64.000 Tokens.

Claude Haiku 4.5

Schnellstes und kosteneffizientestes Modell. LLM · Input 200.000 / Output 64.000 Tokens.

Claude Opus 4

Anthropics führendes Flaggschiff-Modell für hochkomplexe Aufgaben, Funktionsaufrufe, agentische Anwendungsfälle und Code-Generierung. LLM · EU-DSGVO konform · Input 200.000 / Output 16.000 Tokens.

Claude Sonnet 4

Ein leistungsstarkes, harmonisch abgestimmtes KI-Modell für komplexes logisches Denken, professionelle Code-Erstellung und umfangreiche Analysen – multimodal mit visuellen Fähigkeiten und ideal als vielseitiges Allround-System für den täglichen Einsatz. LLM · Input 200.000 / Output 64.000 Tokens.

Claude Sonnet 3.7

Ausgewogenes Modell mit Tool-CoT, Vision und Reasoning; Vorgänger von Claude Sonnet 4. LLM · Input 200.000 / Output 8.000 Tokens.

Claude Sonnet 3.5

Ein ausgewogenes KI-Modell mit leistungsstarkem Tool-Calling, fortschrittlicher Vision und intelligenter Performance. LLM · EU-DSGVO konform · Input 200.000 / Output 8.000 Tokens.

Open Source & weitere·Llama, Mistral & Co.

Open-Source- und weitere Modelle

Viele Modelle sind auf eigener GPU-Hardware hostbar: Ihr Fachwissen bleibt im Unternehmen.

Llama 3.3 70B Instruct

Ein leistungsfähiges Open-Source-Instruktionsmodell für Dialoge, präzises Q&A und flexible Content-Generierung. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.

Llama Guard 3 8B

Open-Source-Sicherheitsfilter zur Inhaltsmoderation (toxische, illegale Inhalte usw.). LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 32.000 / Output 4.000 Tokens.

DeepSeek V3.2

DeepSeek v3.2 ist ein großes, auf Schlussfolgern ausgerichtetes Sprachmodell für lange Kontexte, Agenten-/Tool-Nutzung, fortgeschrittenes Schlussfolgern, Programmierung und Mathematik. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar.

Deepseek R1 Llama 70B

Destilliertes Open-Source-Modell DeepSeek R1 (Llama 3.3 70B als Basismodell), optimiert für Reasoning. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 64.000 Tokens.

Deepseek R1

Ein offen zugängliches Reasoning-Modell, ausgelegt für die Verarbeitung sehr großer Kontexte sowie anspruchsvolle Anwendungen in Wissenschaft, Logik und Mathematik. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar.

Mistral Large

Mistrals Spitzenmodell, entwickelt für anspruchsvolle Einsatzszenarien und professionelle Code-Erstellung. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.

Mistral Medium

Ein flexibel einsetzbares KI-Modell für umfassende Sprachverarbeitung, Software-Erstellung und anspruchsvolle logische Schlussfolgerungen. LLM · EU-DSGVO konform · Input 128.000 / Output 16.000 Tokens.

Mistral Moderation

Klassifizierungsmodell zur Unterstützung von Inhaltsmoderation und Sicherheitsbewertung. LLM · EU-DSGVO konform · Input 128.000 / Output 4.000 Tokens.

Mistral OCR

Leistungsstarkes OCR-Modell von Mistral zur effizienten und präzisen Verarbeitung von Dokumenten. OCR.

Mistral Small

Leistungsstarkes Modell für blitzschnelle, präzise Antworten und zuverlässige Funktionsaufrufe. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.

Pixtral Large

Multimodales KI-Modell für die Analyse visueller und tabellarischer Daten, Frage-Antwort-Systeme und strukturiertes Dokumentenverständnis. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.

Magistral Small

Open-Source-Modell für strukturiertes Reasoning, optimiert für langkettige logische Abläufe und vielseitige Aufgaben. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 40.000 / Output 8.000 Tokens.

Magistral Medium

Effizientes Modell mit ausgewogener Größe und Rechenleistung, optimiert für Vision-basierte Reasoning-Aufgaben und mehrstufige Logikprozesse. LLM · EU-DSGVO konform · Input 40.000 / Output 8.000 Tokens.

Magistral Large

Hochskalierbares Reasoning-Modell von Mistral, optimiert für komplexe Problemlösungen und anspruchsvolles Denken. LLM · EU-DSGVO konform · Input 128.000 / Output 16.000 Tokens.

Whisper Large v3

Bewährtes Modell für akkurate Transkription von Sprache in Text, optimiert für hohe Genauigkeit. Sprache-zu-Text · EU-DSGVO konform · Auf GPU-Hardware hostbar.

Qwen 3 235B-A22B

Apache-2.0 Mixture-of-Experts-Modell mit 22B aktiven Parametern, spezialisiert auf mehrsprachige Verarbeitung und strukturiertes Reasoning. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 32.000 / Output 8.000 Tokens.

Qwen 3 32B

Open-Source-Midrange-Modell, optimiert für Textanalyse, strukturiertes Reasoning und die Nutzung externer Tools. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 32.000 / Output 8.000 Tokens.

Sonar Pro

Großes Kontextmodell mit 200K Token, optimiert für effiziente Informationssuche, Frage-Antwort-Systeme und konsistente Antwortqualität. LLM · Input 200.000 / Output 8.000 Tokens.

Sonar Reasoning

Modell zur effizienten Bearbeitung analytischer Aufgaben, optimiert für mehrstufiges Reasoning (CoT) und nachvollziehbare Erklärungen. LLM · Input 128.000 / Output 8.000 Tokens.

Sonar Reasoning Pro

Optimierte Pro-Variante für strukturiertes Reasoning und Bearbeitung komplexer, mehrstufiger Logikketten. LLM · Input 128.000 / Output 8.000 Tokens.

Elevenlabs

Text-to-Speech-Modelle mit hoher Qualität, unterstützt multiple Sprecher und zahlreiche Sprachen für flexible Anwendungen. Sprache-zu-Text · EU-DSGVO konform.

FLUX 1.1 Kontext

Optimierte FLUX-Variante für Bildbearbeitung und -modifikation mit hoher Präzision. Bildgenerierung · EU-DSGVO konform.

FLUX 1.1 Pro

Hochpräziser Bildgenerator, proprietär, optimiert für realistische Bildgenerierung und konsistente Qualität. Bildgenerierung · EU-DSGVO konform.

FLUX 1.1 Schnell

Optimierte, ressourcenschonende Open-Source-Variante von FLUX für schnelle Bildverarbeitung. Bildgenerierung · EU-DSGVO konform · Auf GPU-Hardware hostbar.

Grok 3

KI-Assistent von xAI mit multimodaler Vision, Web-Integration, Reasoning-Fähigkeiten und aktuellem Wissensstand; Verhalten kann variabel sein. LLM · Input 128.000 / Output 8.000 Tokens.

Phi 4

Ressourcenoptimiertes Modell mit Fokus auf leistungsstarkes Reasoning, mathematische Berechnungen und schnelle Antwortzeiten. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.

Grok 4.1 Fast

KI-Assistent von xAI mit multimodaler Vision, Web-Integration, Reasoning-Fähigkeiten und aktuellem Wissensstand; Verhalten kann variabel sein. LLM · Input 2.000.000 / Output 8.000 Tokens.

Grok 4

KI-Modell mit Textmodalität (künftig Vision). Unterstützt extrem große Kontextfenster. LLM · Input 256.000 / Output 256.000 Tokens.

Grok 3 Mini

Leichtgewichtiges Modell mit reflektierenden Antworten, geeignet für logikbasierte Aufgaben. LLM · Input 131.000 / Output 8.000 Tokens.

Loslegen·Modellwahl

Welches Modell passt zu Ihrem Anwendungsfall?

Bereit für den nächsten Schritt? Entfesseln Sie das volle Potenzial Ihres Unternehmens mit smarter KI-Technologie. Wir beraten Sie, welches Modell – Cloud oder selbst-gehostet – am besten zu Ihren Anforderungen und Datenschutzvorgaben passt.