Von GPT über Claude und Gemini bis zu Open-Source-Modellen wie Llama, Mistral und DeepSeek, wir integrieren das passende Modell für Ihren Anwendungsfall. Viele Modelle sind EU-DSGVO-konform oder auf eigener GPU-Hardware hostbar.
Vom leistungsstärksten Produktionsmodell bis zu ressourcenschonenden Varianten.
Ist das leistungsstärkste Produktionsmodell der GPT-5.2-Familie von OpenAI und wird über die Responses API für Workloads mit höchsten Anforderungen an Genauigkeit, Schlussfolgern, Tool-Nutzung sowie Kontext und Durchsatz bereitgestellt. LLM · EU-DSGVO konform · Input 1.047.576 / Output 32.768 Tokens.
Ist der chatoptimierte Snapshot der GPT-5.2-Familie von OpenAI (in ChatGPT als GPT-5.2 Instant bekannt) und eignet sich für interaktive Anwendungen mit Bedarf an Geschwindigkeit, langen Kontexten, multimodalen Eingaben und stabilem Dialogverhalten. LLM · EU-DSGVO konform.
Ressourcenschonende, kompakte Variante der GPT-5.2-Familie, optimiert für leichtgewichtige Anwendungen und hohe Request-Raten. LLM · EU-DSGVO konform · Input 1.047.576 / Output 32.768 Tokens.
Sora 2 Pro ist ein leistungsstarkes Modell zur Mediengenerierung, das aus Text oder Bildern dynamische Videos mit synchronisiertem Audio erzeugt. Bildgenerierung · EU-DSGVO konform.
Äußerst leistungsstarkes Modell zur Videogenerierung mit Soundeffekten, unterstützt Chat-Format. Bildgenerierung · EU-DSGVO konform.
GPT-Image-1.5 ist ein multimodales GPT-Modell zur Bildgenerierung aus Textprompts und präzisen Bearbeitungen von Eingabebildern gemäß Nutzeranweisungen. Bildgenerierung · EU-DSGVO konform.
Kontextoptimiertes OpenAI-Modell für umfangreiche Dokumente, tiefgehendes Research und komplexe Coding-Aufgaben. LLM · EU-DSGVO konform · Input 1.047.576 / Output 32.768 Tokens.
Optimierte, ressourcenschonende Variante von GPT-4.1, gleicher Kontextumfang wie das Originalmodell. LLM · EU-DSGVO konform.
Ressourcenschonende Mikro-Version von GPT-4.1, optimiert für leichtgewichtige Anwendungen und hohe Request-Raten. LLM · EU-DSGVO konform.
Ein modernes, multimodales Spitzenmodell für Echtzeitverarbeitung von Text, Audio und Bild, das durch hohe Intelligenz und beeindruckende Leistungsfähigkeit besticht. LLM · EU-DSGVO konform · Input 128.000 / Output 16.384 Tokens.
Eine schnelle und kostengünstige Variante von GPT-4o, die durch exzellentes logisches Denken und Multimodalität überzeugt – perfekt für skalierbare und effiziente Anwendungen. LLM · EU-DSGVO konform.
OpenAIs fortschrittliche Engine zur Generierung und Bearbeitung von Bildern aus Text, optimiert für hohe Realismus- und Variationsvielfalt. Bildgenerierung.
Optimiertes Modell für strukturiertes Reasoning und die Bearbeitung komplexer, mehrstufiger Logikprozesse. LLM · Input 200.000 / Output 100.000 Tokens.
Optimierte o3-Version mit Fokus auf Kostenersparnis und effizienter Leistung. LLM · Input 200.000 / Output 100.000 Tokens.
Optimiertes Multimodalmodell mit hoher Verarbeitungsgeschwindigkeit, erweitertem Reasoning und Coding-Unterstützung. LLM · Input 200.000 / Output 100.000 Tokens.
Optimierte High-Performance-Variante von o4-mini, speziell für umfangreiche Aufgaben und komplexe logische Prozesse. LLM · Input 200.000 / Output 100.000 Tokens.
Erstes Open-Source-Modell von OpenAI, optimiert für hohe Performance und MXFP4-natives Training. LLM · Input 200.000 / Output 100.000 Tokens.
Multimodale Sprach-, Bild- und Videomodelle mit großen Kontextfenstern.
Ein schlankes Multimodal-KI-Modell mit ausgezeichneter Kontextverarbeitung und umfassender Mehrsprachigkeitsunterstützung. LLM · EU-DSGVO konform · Input 128.000 / Output 16.000 Tokens.
Ist ein leichtgewichtiges, effizientes, multimodales Modell von Google, das für reale Anwendungen mit schnellen Antworten und geringer Latenz entwickelt wurde. LLM · EU-DSGVO konform · Input 1.000.000 / Output 62.000 Tokens.
Ist ein hochmodernes Modell für die visuelle Erstellung und Bearbeitung. Im Gegensatz zu rein textbasierten Modellen liegt sein Fokus auf der Transformation kreativer Konzepte in hochauflösende Bilder. Es unterstützt komplexe Workflows im Bereich Design, Marketing und digitale Kunst. Bildgenerierung · EU-DSGVO konform.
Leistungsstarkes Modell für Programmierung, Mathematik und logisches Denken, mit Deep Think-Modus für mehrstufige Problemlösungen. LLM · EU-DSGVO konform · Input 1.000.000 / Output 65.000 Tokens.
Hauptmodell für Analyse und Verarbeitung langer Kontexte (bis zu 1 Mio. Token), verfügbar in Gemini Advanced. LLM · EU-DSGVO konform.
Kosteneffiziente Variante für Aufgaben mit minimaler Latenz. LLM · EU-DSGVO konform · Input 1.000.000 / Output 65.000 Tokens.
Hochleistungsmodell von Google zur multimodalen Verarbeitung von Text, Bild, Audio und Video, optimiert für komplexe Analyse, Research und tiefgehendes Reasoning. LLM · EU-DSGVO konform · Input 1.000.000 / Output 32.768 Tokens.
Ist ein Videomodell in Produktionsqualität mit hoher Wiedergabetreue, nativem Ton und erweitertem Tooling. Videogenerierung · EU-DSGVO konform.
Fortgeschrittenes Modell für generative Bild-KI, optimiert für ein ausgewogenes Verhältnis von Renderqualität und Verarbeitungsgeschwindigkeit. Bildgenerierung · EU-DSGVO konform.
Hochleistungs-Bildmodell von Google, optimiert für präzises Editing, stilistische Anpassungen und treue Umsetzung von Textvorgaben. Bildgenerierung · EU-DSGVO konform.
Optimiertes Bildgenerierungsmodell, ausgelegt für hohe Geschwindigkeit und parallele Verarbeitung großer Datenmengen. Bildgenerierung · EU-DSGVO konform.
Instruktionsoptimierte Modelle für komplexes Schlussfolgern, Programmierung und Dialoge.
Claude Sonnet 4.5 verbessert die Fähigkeiten für praktische Computeraufgaben erheblich: Auf OSWorld stieg es von 42,2 % (Sonnet 4) auf 61,4 % an die Spitze. Die Claude for Chrome-Erweiterung nutzt diese Verbesserungen direkt. LLM · EU-DSGVO konform · Input 200.000 / Output 64.000 Tokens.
Ist ein instruktionsoptimiertes Modell von Anthropic für komplexes Schlussfolgern, Programmierung und Multi-Turn-Dialoge, mit erweiterten Kontext-, Tool- und RAG-Funktionen, strukturierten Ausgaben und Sicherheitskontrollen. LLM · EU-DSGVO konform · Input 200.000 / Output 64.000 Tokens.
Schnellstes und kosteneffizientestes Modell. LLM · Input 200.000 / Output 64.000 Tokens.
Anthropics führendes Flaggschiff-Modell für hochkomplexe Aufgaben, Funktionsaufrufe, agentische Anwendungsfälle und Code-Generierung. LLM · EU-DSGVO konform · Input 200.000 / Output 16.000 Tokens.
Ein leistungsstarkes, harmonisch abgestimmtes KI-Modell für komplexes logisches Denken, professionelle Code-Erstellung und umfangreiche Analysen – multimodal mit visuellen Fähigkeiten und ideal als vielseitiges Allround-System für den täglichen Einsatz. LLM · Input 200.000 / Output 64.000 Tokens.
Ausgewogenes Modell mit Tool-CoT, Vision und Reasoning; Vorgänger von Claude Sonnet 4. LLM · Input 200.000 / Output 8.000 Tokens.
Ein ausgewogenes KI-Modell mit leistungsstarkem Tool-Calling, fortschrittlicher Vision und intelligenter Performance. LLM · EU-DSGVO konform · Input 200.000 / Output 8.000 Tokens.
Viele Modelle sind auf eigener GPU-Hardware hostbar: Ihr Fachwissen bleibt im Unternehmen.
Ein leistungsfähiges Open-Source-Instruktionsmodell für Dialoge, präzises Q&A und flexible Content-Generierung. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.
Open-Source-Sicherheitsfilter zur Inhaltsmoderation (toxische, illegale Inhalte usw.). LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 32.000 / Output 4.000 Tokens.
DeepSeek v3.2 ist ein großes, auf Schlussfolgern ausgerichtetes Sprachmodell für lange Kontexte, Agenten-/Tool-Nutzung, fortgeschrittenes Schlussfolgern, Programmierung und Mathematik. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar.
Destilliertes Open-Source-Modell DeepSeek R1 (Llama 3.3 70B als Basismodell), optimiert für Reasoning. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 64.000 Tokens.
Ein offen zugängliches Reasoning-Modell, ausgelegt für die Verarbeitung sehr großer Kontexte sowie anspruchsvolle Anwendungen in Wissenschaft, Logik und Mathematik. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar.
Mistrals Spitzenmodell, entwickelt für anspruchsvolle Einsatzszenarien und professionelle Code-Erstellung. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.
Ein flexibel einsetzbares KI-Modell für umfassende Sprachverarbeitung, Software-Erstellung und anspruchsvolle logische Schlussfolgerungen. LLM · EU-DSGVO konform · Input 128.000 / Output 16.000 Tokens.
Klassifizierungsmodell zur Unterstützung von Inhaltsmoderation und Sicherheitsbewertung. LLM · EU-DSGVO konform · Input 128.000 / Output 4.000 Tokens.
Leistungsstarkes OCR-Modell von Mistral zur effizienten und präzisen Verarbeitung von Dokumenten. OCR.
Leistungsstarkes Modell für blitzschnelle, präzise Antworten und zuverlässige Funktionsaufrufe. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.
Multimodales KI-Modell für die Analyse visueller und tabellarischer Daten, Frage-Antwort-Systeme und strukturiertes Dokumentenverständnis. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.
Open-Source-Modell für strukturiertes Reasoning, optimiert für langkettige logische Abläufe und vielseitige Aufgaben. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 40.000 / Output 8.000 Tokens.
Effizientes Modell mit ausgewogener Größe und Rechenleistung, optimiert für Vision-basierte Reasoning-Aufgaben und mehrstufige Logikprozesse. LLM · EU-DSGVO konform · Input 40.000 / Output 8.000 Tokens.
Hochskalierbares Reasoning-Modell von Mistral, optimiert für komplexe Problemlösungen und anspruchsvolles Denken. LLM · EU-DSGVO konform · Input 128.000 / Output 16.000 Tokens.
Bewährtes Modell für akkurate Transkription von Sprache in Text, optimiert für hohe Genauigkeit. Sprache-zu-Text · EU-DSGVO konform · Auf GPU-Hardware hostbar.
Apache-2.0 Mixture-of-Experts-Modell mit 22B aktiven Parametern, spezialisiert auf mehrsprachige Verarbeitung und strukturiertes Reasoning. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 32.000 / Output 8.000 Tokens.
Open-Source-Midrange-Modell, optimiert für Textanalyse, strukturiertes Reasoning und die Nutzung externer Tools. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 32.000 / Output 8.000 Tokens.
Großes Kontextmodell mit 200K Token, optimiert für effiziente Informationssuche, Frage-Antwort-Systeme und konsistente Antwortqualität. LLM · Input 200.000 / Output 8.000 Tokens.
Modell zur effizienten Bearbeitung analytischer Aufgaben, optimiert für mehrstufiges Reasoning (CoT) und nachvollziehbare Erklärungen. LLM · Input 128.000 / Output 8.000 Tokens.
Optimierte Pro-Variante für strukturiertes Reasoning und Bearbeitung komplexer, mehrstufiger Logikketten. LLM · Input 128.000 / Output 8.000 Tokens.
Text-to-Speech-Modelle mit hoher Qualität, unterstützt multiple Sprecher und zahlreiche Sprachen für flexible Anwendungen. Sprache-zu-Text · EU-DSGVO konform.
Optimierte FLUX-Variante für Bildbearbeitung und -modifikation mit hoher Präzision. Bildgenerierung · EU-DSGVO konform.
Hochpräziser Bildgenerator, proprietär, optimiert für realistische Bildgenerierung und konsistente Qualität. Bildgenerierung · EU-DSGVO konform.
Optimierte, ressourcenschonende Open-Source-Variante von FLUX für schnelle Bildverarbeitung. Bildgenerierung · EU-DSGVO konform · Auf GPU-Hardware hostbar.
KI-Assistent von xAI mit multimodaler Vision, Web-Integration, Reasoning-Fähigkeiten und aktuellem Wissensstand; Verhalten kann variabel sein. LLM · Input 128.000 / Output 8.000 Tokens.
Ressourcenoptimiertes Modell mit Fokus auf leistungsstarkes Reasoning, mathematische Berechnungen und schnelle Antwortzeiten. LLM · EU-DSGVO konform · Auf GPU-Hardware hostbar · Input 128.000 / Output 16.000 Tokens.
KI-Assistent von xAI mit multimodaler Vision, Web-Integration, Reasoning-Fähigkeiten und aktuellem Wissensstand; Verhalten kann variabel sein. LLM · Input 2.000.000 / Output 8.000 Tokens.
KI-Modell mit Textmodalität (künftig Vision). Unterstützt extrem große Kontextfenster. LLM · Input 256.000 / Output 256.000 Tokens.
Leichtgewichtiges Modell mit reflektierenden Antworten, geeignet für logikbasierte Aufgaben. LLM · Input 131.000 / Output 8.000 Tokens.
Bereit für den nächsten Schritt? Entfesseln Sie das volle Potenzial Ihres Unternehmens mit smarter KI-Technologie. Wir beraten Sie, welches Modell – Cloud oder selbst-gehostet – am besten zu Ihren Anforderungen und Datenschutzvorgaben passt.