Groq (Inferenz-Plattform)
Auch bekannt als: GroqCloud, LPU, Language Processing Unit
Groq ist ein US-Anbieter für besonders schnelle LLM-Inferenz. Statt Grafikkarten nutzt das Unternehmen eigens entwickelte Chips: Language Processing Units (LPUs). Sie sind allein dafür gebaut, Sprachmodelle auszuführen, nicht sie zu trainieren.
Nicht zu verwechseln mit Grok, dem AI-Modell von xAI. Groq ist eine Infrastruktur-Plattform, Grok ist ein Sprachmodell.
Was die Plattform bietet
GroqCloud stellt offene Modelle per API bereit, darunter Llama von Meta, OpenAIs GPT-OSS sowie Qwen- und DeepSeek-Varianten. Geschlossene Modelle wie ChatGPT oder Claude fehlen bewusst. Ende 2025 lizenzierte Nvidia die LPU-Technologie für rund 20 Milliarden US-Dollar. GroqCloud läuft seitdem als eigenständiger Dienst weiter.
Besonderheit: Geschwindigkeit
LPUs liefern Antworten deutlich schneller als übliche GPU-Inferenz. Llama 3.3 70B erreicht auf GroqCloud rund 300–400 Token pro Sekunde. Kleinere Modelle schaffen bis zu 1.000. Das entspricht mehreren Seiten Text pro Sekunde.
Typische Einsatzzwecke
Geschwindigkeit zählt überall dort, wo Menschen auf Antworten warten: Chatbots, Sprachassistenten und AI Agents, die viele Schritte nacheinander ausführen. Je schneller jede einzelne Antwort, desto flüssiger der gesamte Workflow.
Den nächsten Schritt im kostenlosen Diagnose-Call besprechen. Termin buchen →
Stand: Juni 2026
Claude Cheat Sheet
Alle Claude-Features, Modelle und Praxis-Tipps kompakt auf einen Blick. Bilingual (DE/EN), laufend aktualisiert von netzstrategen.
Jetzt öffnenDigital Impact direkt ins Postfach
Eine Anmeldung, drei Newsletter: der AI Insights Newsletter jede Woche mit den neuesten Insights-Artikeln, der Digital Impact Longread Newsletter und das Digital Impact Update je einmal im Monat. Mit Double Opt-in und jederzeit abbestellbar.
AI Operations zum Hören
Digital-Experten wie André Hellmann, Christina D'Ilio, Christian Sattel, Sarah Stock sowie regelmäßig Gäste aus der Praxis: alle Themen rund um AI Operations als Audio für unterwegs.
So ist dieser Beitrag entstanden
- Themenwahl
- Quellenwahl
- Faktenprüfung
- Freigabe
- Recherche
- Textentwurf
- Schaubilder
- Publishing
Dieser Beitrag entstand mit AI-Unterstützung. Ideenfindung, Redaktionsplanung, inhaltliche Prüfung und Freigabe liegen beim Menschen, das Lektorat bei der AI. Die redaktionelle Verantwortung trägt André Hellmann.