Claude ist die proprietäre Sprachmodell-Familie von Anthropic mit mehreren Leistungsstufen für Text- und Bildeingaben. Fable 5 ist die höchste allgemein verfügbare Stufe.
Aktuell: Claude Fable 5, Claude Opus 5, Claude Sonnet 5, Claude Haiku 4.5
- stabil
- proprietär
- API
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Command ist Coheres Familie unternehmensorientierter Sprachmodelle mit Schwerpunkt auf RAG, Tool-Use und Mehrsprachigkeit.
Aktuell: Command A / Command A Reasoning / Vision
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Google · Vereinigtes Königreich
Gemini ist die proprietäre multimodale Modellfamilie von Google DeepMind mit Pro-, Flash- und Flash-Lite-Stufen.
Aktuell: Gemini (Pro/Flash/Flash-Lite)
- stabil
- proprietär
- API
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Google · Vereinigtes Königreich
Gemma ist die Familie offener Gewichtsmodelle von Google DeepMind mit Text-, Bild- und Audioeingabe.
Aktuell: Gemma 4 (mehrere Größen)
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Chat
- Reasoning
- Coding
- lange Dokumente
- mehrsprachig
- multimodal
GPT ist die Sprachmodell-Familie von OpenAI mit proprietären Chat- und Reasoning-Modellen sowie den offenen Gewichtsmodellen gpt-oss.
Aktuell: GPT-5.6 (Sol/Terra/Luna), gpt-oss-120b, gpt-oss-20b
- stabil
- proprietär
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Granite ist IBMs Familie offener, unternehmensorientierter Modelle unter Apache-2.0-Lizenz.
Aktuell: Granite 4.1 (3B/8B/30B)
- stabil
- Open Source
- Gewichte
- API
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Grok ist die Sprachmodell-Familie von xAI für Text- und Bildeingaben.
Aktuell: Grok 4.5
- stabil
- proprietär
- API
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Llama ist die Familie offener Gewichtsmodelle von Meta, aktuell in der nativ multimodalen Generation Llama 4.
Aktuell: Llama 4 Scout, Llama 4 Maverick
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Nemotron ist NVIDIAs Familie offener Modelle mit Schwerpunkt auf Reasoning und agentischer KI, teils auf Basis von Meta Llama.
Aktuell: Llama Nemotron (Nano/Super/Ultra)
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Amazon Nova ist eine proprietäre Familie multimodaler Foundation-Modelle, bereitgestellt über Amazon Bedrock.
Aktuell: Amazon Nova 2 (Lite/Pro/Sonic), Amazon Nova (Micro/Lite/Pro/Premier)
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Allen Institute for AI (Ai2) · USA
OLMo ist Ai2s vollständig quelloffene Sprachmodellfamilie mit offengelegten Daten, Code, Gewichten und Checkpoints.
Aktuell: OLMo 3 (7B/32B: Base/Think/Instruct)
- Gewichte verfügbar
- Open Source
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- lange Dokumente
Phi ist Microsofts Familie kompakter, quelloffener Sprachmodelle mit Fokus auf Effizienz bei kleiner Modellgröße.
Aktuell: Phi-4 (inkl. multimodal/mini/reasoning)
- Gewichte verfügbar
- Open Source
- Gewichte
- API
- lokal nutzbar
- Chat
- Reasoning
- Coding
- mehrsprachig
- multimodal
Swiss AI Initiative · Schweiz
Apertus ist ein vollständig offenes, mehrsprachiges Schweizer Sprachmodell mit offenen Gewichten, Daten und Trainingsdetails.
Aktuell: Apertus-70B / Apertus-8B
- Gewichte verfügbar
- Open Source
- Gewichte
- lokal nutzbar
Bielik ist eine von SpeakLeash und ACK Cyfronet AGH entwickelte, primär auf Polnisch ausgerichtete offene Sprachmodellfamilie.
Aktuell: Bielik-11B / Bielik-4.5B
- Gewichte verfügbar
- Open Source
- Gewichte
- lokal nutzbar
Humboldt-Universität zu Berlin · Deutschland
Boldt ist eine 2026 veröffentlichte Familie kleiner deutscher Sprachmodelle (350M–1B), von Grund auf mit stark gefilterten deutschen Daten trainiert – vollständig unter Apache 2.0.
Aktuell: Boldt-DC-350M / Boldt-DC-1B, Boldt-1B, Boldt-1B-IT-Preview (experimentell)
- Forschung
- Open Source
- Gewichte
- lokal nutzbar
Humboldt-Universität zu Berlin (Flair) · Deutschland
BübleLM ist ein deutsches 2B-Modell auf Basis von Googles Gemma 2 2B: per Trans-Tokenization auf einen deutschen SentencePiece-Tokenizer umgestellt und auf 3,5 Milliarden deutschen Tokens trainiert.
Aktuell: bueble-lm-2b
- Forschung
- offene Gewichte
- Gewichte
- lokal nutzbar
DiscoResearch · Deutschland
DiscoLeo (Llama3-German-8B) ist eine deutsche Community-Adaptation von Metas Llama 3 8B: Continued Pretraining auf 65 Milliarden deutschen Tokens, mit Base-, Instruct- und Long-Context-Varianten (Stand 2024).
Aktuell: Llama3-German-8B (Base/Instruct/32k)
- stabil
- offene Gewichte
- Gewichte
- lokal nutzbar
Fraunhofer IIS · Deutschland
ELMOD-2.7B ist ein kompaktes, von Grund auf trainiertes deutsch-englisches Sprachmodell von Fraunhofer IIS für ressourcenschonende und On-Device-Einsätze – Base und Instruct sind gated (CC BY-NC 4.0).
Aktuell: elmod-2.7b-base (gated), elmod-2.7b-it (Instruct, gated)
- Forschung
- offene Gewichte
- Gewichte
- lokal nutzbar
hessian.AI / LAION · Deutschland
LeoLM war 2023 das erste große deutsche Continued-Pretraining-Projekt: Llama-2- und Mistral-Basismodelle wurden auf deutschen Korpora weitertrainiert (7B, 13B, 70B). Historisch bedeutsam, seit Ende 2023 nicht mehr weiterentwickelt.
Aktuell: leo-hessianai-7b/-13b/-70b (+ Chat), leo-mistral-hessianai-7b (Apache 2.0)
- veraltet
- offene Gewichte
- Gewichte
- lokal nutzbar
Leibniz-Rechenzentrum (LRZ) · Deutschland
Llama-GENBA-10B ist ein Forschungsmodell einer Deutschland-geführten Kooperation von LRZ und Cerebras: Llama 3.1 8B wurde per Block Expansion auf 10B erweitert und auf Englisch, Deutsch und Bairisch weitertrainiert – Gewichte bislang nur für genehmigte Einrichtungen.
Aktuell: Llama-GENBA-10B
- Forschung
- eingeschränkte Lizenz
Universität Würzburg · Deutschland
LLäMmlein sind von Grund auf ausschließlich auf Deutsch trainierte Forschungs-Sprachmodelle (120M, 1B, 7B) mit eigenem deutschem Tokenizer – öffentliche Gewichte unter research-only RAIL-M.
Aktuell: LLaMmlein_120M / _1B / _7B (Base), LLaMmlein_1B_chat / _7B_chat (Forschungsdemos)
- Forschung
- offene Gewichte
- Gewichte
- lokal nutzbar
Mistral AI ist ein französischer Anbieter einer Modellfamilie aus generalistischen und spezialisierten Modellen, teils Open-Weight, teils proprietär.
Aktuell: Mistral Large / Medium / Small / Ministral / Codestral
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Aleph Alpha · Deutschland
Aleph Alpha Research entwickelt mit Pharia eine transparenz- und compliance-orientierte deutsche Modellfamilie mit Fokus auf europäische Sprachen (Gewichte unter Open Aleph License).
Aktuell: Pharia-1-LLM-7B-control / -control-aligned
- Gewichte verfügbar
- eingeschränkte Lizenz
- Gewichte
- API
- lokal nutzbar
VAGO solutions · Deutschland
SauerkrautLM ist eine aktive deutsche Fine-Tuning-Familie generativer Sprachmodelle: deutschsprachig optimierte Anpassungen wechselnder internationaler Basismodelle – die Lizenz folgt jeweils dem Basismodell.
Aktuell: Llama-3.1-SauerkrautLM-8b/-70b-Instruct, SauerkrautLM-v2-14b, -Nemo-12b, -gemma-2-9b u. a.
- stabil
- offene Gewichte
- Gewichte
- lokal nutzbar
SOOFI-Konsortium · Deutschland
Soofi-S-30B-A3B ist ein von Grund auf trainiertes deutsches Foundation Model (hybrides Mamba-2/Transformer-MoE) für Deutsch und Englisch – derzeit in Closed Beta mit öffentlich einsehbaren, gated Preview-Checkpoints.
Aktuell: Soofi-S-Base (30B-A3B), Soofi-S-Instruct-Preview, Soofi-S-Isar-Preview / Rhine-Preview (Reasoning)
- Beta
- eingeschränkte Lizenz
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- lange Dokumente
FAU Erlangen-Nürnberg (Forschung) · Deutschland
SteuerLLM ist ein 28B-Forschungsmodell der FAU für deutsches Steuerrecht (Mistral-Small-Basis, Block Expansion). Öffentlich verfügbar ist die Variante Open-SteuerLLM; evaluiert wird mit dem Prüfungs-Benchmark SteuerEx.
Aktuell: SteuerLLM 28B (vollständige Forschungsvariante, Gewichte nicht veröffentlicht), Open-SteuerLLM 28B (öffentliche Variante, ohne privaten Trainingsdatenanteil)
- Forschung
- offene Gewichte
- Gewichte
- lokal nutzbar
Teuken-7B ist das offene Sprachmodell des vom BMWK geförderten deutschen Konsortialprojekts OpenGPT-X und deckt alle 24 EU-Amtssprachen ab.
Aktuell: Teuken-7B-base/-instruct v0.6 (CC BY-NC 4.0), Teuken-7B-instruct-commercial-v0.4 (Apache 2.0)
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- lokal nutzbar
Aleph Alpha · Deutschland
TFree-HAT ist eine tokenizerfreie Forschungs-Modellfamilie von Aleph Alpha Research (Hierarchical Autoregressive Transformer) für Englisch und Deutsch – mit einer vollständig neu trainierten 7B-Variante und Llama-3.1-adaptierten Varianten bis 70B.
Aktuell: TFree-HAT-Pretrained-7B-Base, llama-tfree-hat-pretrained-7b-dpo (aus 7B-Base; „llama“-Präfix nur aus Lizenzgründen), Llama-3.1-8B-TFree-HAT (base/sft/dpo), Llama-3.1-70B-TFree-HAT-SFT
- Forschung
- eingeschränkte Lizenz
- Gewichte
- lokal nutzbar
Baichuan Intelligence · China
Baichuan ist die Modellfamilie von Baichuan Intelligence, deren aktuelle offene Veröffentlichungen einen Schwerpunkt auf medizinische Anwendungen legen.
Aktuell: Baichuan-M3 / M2
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- lange Dokumente
- mehrsprachig
Modellfamilie von DeepSeek mit den aktuellen V4-Modellen (Flash und Pro), historischen V3-Modellen und den auf Reasoning spezialisierten R-Modellen – Gewichte größtenteils offen unter MIT-Lizenz.
Aktuell: DeepSeek-V4-Flash (0731, API Public Beta), DeepSeek-V4-Pro
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
ByteDance / Volcano Engine · China
ByteDance bietet unter Doubao proprietäre Modelle über Volcano Engine sowie über das Seed-Team offen lizenzierte Modelle wie Seed-OSS-36B.
Aktuell: Seed-OSS-36B-Instruct
- regional eingeschränkt
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Modellfamilie von Baidu, deren ERNIE-4.5-Reihe als Text- und multimodale Modelle unter Apache 2.0 offen veröffentlicht wurde.
Aktuell: ERNIE 4.5 (0.3B bis 424B MoE)
- stabil
- Open Source
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Modellfamilie von Zhipu AI / Z.ai mit MIT-lizenzierten offenen Gewichten und Fokus auf Reasoning, Coding und Agentenanwendungen.
Aktuell: GLM-4.6
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Hunyuan ist Tencents Modellfamilie mit proprietären Cloud-Modellen und offen veröffentlichten Gewichten (z. B. das MoE-Modell Hunyuan-A13B).
Aktuell: Hunyuan-A13B-Instruct
- Gewichte verfügbar
- Source Available
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Shanghai AI Laboratory · China
InternLM ist die offene, unter Apache-2.0 lizenzierte Modellreihe des Shanghai AI Laboratory mit Reasoning-, Coding- und Long-Context-Fähigkeiten.
Aktuell: internlm3-8b-instruct
- Gewichte verfügbar
- Open Source
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- Coding
- lange Dokumente
- mehrsprachig
Modellfamilie von Moonshot AI mit Long-Context-Fähigkeiten und Fokus auf Coding, Tool-Use und agentische Aufgaben.
Aktuell: Kimi (K2-Reihe)
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
MiMo ist Xiaomis offen unter MIT-Lizenz veröffentlichte Modellreihe mit Fokus auf Reasoning, langen Kontext und agentische Aufgaben.
Aktuell: MiMo-V2.5
- Gewichte verfügbar
- Open Source
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Agenten- und coding-orientierte M-Serie von MiniMax, als MoE-Modell mit offenen Gewichten veröffentlicht.
Aktuell: MiniMax-M2
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- Agenten
Modellfamilie von Alibaba Cloud mit offenen Gewichten und proprietären Flaggschiff-APIs für Text, Reasoning, Coding und multimodale Anwendungen.
Aktuell: Qwen (Max/Plus/Flash, Omni)
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Step ist die Modellfamilie von StepFun, die effiziente MoE-Modelle mit Fokus auf Reasoning und agentische Aufgaben teils offen unter Apache-2.0 veröffentlicht.
Aktuell: Step-3.x-Flash (u.a. Step3-VL)
- Gewichte verfügbar
- Open Source
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Yi ist die offene Modellfamilie von 01.AI mit Chat-, Base- und Coder-Varianten unter Apache-2.0-Lizenz.
Aktuell: Yi-1.5 (9B/34B), Yi-Coder
- Gewichte verfügbar
- Open Source
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- Coding
- lange Dokumente
- mehrsprachig
Sber (SberDevices) · Russland
GigaChat ist die von Sber/SberDevices entwickelte KI-Modellfamilie mit Chat- und Embedding-Modellen über REST-API und Weboberfläche.
Aktuell: GigaChat (Ultra/Max/Pro/Lite)
YandexGPT ist die generative Textmodellfamilie von Yandex, bereitgestellt über Yandex Cloud bzw. Yandex AI Studio per API.
Aktuell: YandexGPT Pro 5 / Lite 5
- Chat
- lange Dokumente
- mehrsprachig
Preferred Networks · Japan
PLaMo ist die von Preferred Networks entwickelte, zweisprachig japanisch-englische Modellfamilie mit Gewichten unter der PLaMo Community License.
Aktuell: PLaMo 2 (1B/8B, VL-Varianten)
- Gewichte verfügbar
- eingeschränkte Lizenz
- Gewichte
- lokal nutzbar
- Chat
- mehrsprachig
- multimodal
tsuzumi ist ein in Japan entwickeltes, auf japanische Geschäftsdokumente spezialisiertes LLM von NTT, das effizient auf einer einzelnen GPU läuft.
Aktuell: tsuzumi 2
- stabil
- proprietär
- API
- lokal nutzbar
LG AI Research · Südkorea
EXAONE ist die von LG AI Research entwickelte Modellfamilie mit offenen Gewichten und nicht-kommerzieller Lizenz, Schwerpunkt Englisch/Koreanisch.
Aktuell: EXAONE 4.0 (32B), EXAONE Deep
- Gewichte verfügbar
- eingeschränkte Lizenz
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
HyperCLOVA X ist die von NAVER entwickelte, auf Koreanisch fokussierte Modellfamilie, deren SEED-Modelle als offene Gewichte bereitstehen.
Aktuell: HyperCLOVAX SEED (Think/Omni/Vision/Text)
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Reasoning
- mehrsprachig
- multimodal
Kanana ist die von Kakao entwickelte, auf Koreanisch optimierte Modellfamilie mit offenen Gewichten auf Hugging Face.
Aktuell: Kanana 2 / 1.5 (versch. Größen)
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Solar ist die Modellfamilie von Upstage mit per API angebotenen Solar-Pro-Modellen und offen bereitgestellten Solar-Open-Gewichten.
Aktuell: Solar Pro 2 (API), Solar Open
- stabil
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Chat
- Reasoning
- Coding
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
Sprachmodell-Familie mit Fokus auf indische Sprachen (22 indische Sprachen plus Englisch), inklusive Chat-, Übersetzungs- und Sprachmodelle.
Aktuell: Sarvam-105B, Sarvam Translate
- stabil
- Lizenz nicht verifiziert
- Gewichte
- API
- Web-App
- Chat
- Reasoning
- mehrsprachig
- lange Dokumente
HUMAIN / SDAIA (NCAI) · Saudi-Arabien
Zweisprachiges (arabisch-englisches) Sprachmodell mit Schwerpunkt auf arabischer Sprache, entwickelt im Rahmen der saudischen SDAIA/NCAI.
Aktuell: ALLaM-7B-Instruct-preview
- Preview
- Open Source
- Gewichte
- lokal nutzbar
- Web-App
Technology Innovation Institute (TII) · Vereinigte Arabische Emirate
Offene Sprachmodell-Familie aus Abu Dhabi; die Falcon-H1-Reihe ist multilingual mit dedizierter arabischer Variante.
Aktuell: Falcon-H1 (0.5B–34B), Falcon-H1 Arabic
- stabil
- offene Gewichte
- Gewichte
- lokal nutzbar
- Chat
- Reasoning
- lange Dokumente
- mehrsprachig
Inception (G42) · Vereinigte Arabische Emirate
Zweisprachige (arabisch-englische) Open-Weight-Sprachmodell-Familie mit Schwerpunkt auf arabischer Sprache.
Aktuell: Jais family (13B/30B/70B)
- stabil
- Open Source
- Gewichte
- lokal nutzbar
AI21 Labs bietet mit der Jamba-Familie hybride (Mamba-Transformer) Long-Context-Sprachmodelle für Unternehmen an.
Aktuell: AI21-Jamba-Large-1.7
- Gewichte verfügbar
- offene Gewichte
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- Tool-Nutzung
- lange Dokumente
- mehrsprachig
- Agenten
Offene, multilinguale Sprachmodell-Familie mit Schwerpunkt auf südostasiatischen Sprachen (11+ SEA-Sprachen).
Aktuell: SEA-LION v4 / v3 (Gemma-/Llama-basiert)
- stabil
- Open Source
- Gewichte
- API
- lokal nutzbar
- Web-App
- Chat
- mehrsprachig
- multimodal
- Agenten
Sprachmodell-Familie mit Spezialisierung auf Portugiesisch und brasilianische Kontexte, verfügbar über API und Web-Chat (MariTalk).
Aktuell: Sabiá 4 / Sabiá 4 Thinking / Sabiazinho 4
- stabil
- proprietär
- API
- Web-App
- Chat
- Reasoning
- Tool-Nutzung
- mehrsprachig
Auf afrikanische Sprachen ausgerichtetes offenes Kleinsprachmodell (u. a. isiZulu, Yoruba, Swahili, isiXhosa, Hausa); Lelapa betreibt zudem die Sprachplattform Vulavula.
Aktuell: InkubaLM-0.4B
- stabil
- eingeschränkte Lizenz
- Gewichte
- API
- lokal nutzbar