QwenVL – AI Explorer
QwenVL ist Alibabas multimodales Vision-Language-Modell, das Text- und Bildeingaben verarbeiten kann. Mit 7 Milliarden Parametern bietet es starke Bildanalyse, OCR-Fähigkeiten und mehrsprachige Unterstützung. Das Open-Weight-Modell eignet sich besonders für Anwendungen mit Bildverständnis und Dokumentenanalyse.
Hersteller & Kategorie
- Hersteller
- Alibaba Cloud
- Herkunftsland
- China
- Kategorie
- Multimodal/App
Stärken
- Starke Bildanalyse
- Mehrsprachige OCR
- Open-Weight verfügbar
- Gute Dokument-Verständnis
- Kosteneffizient
Schwächen
- Höhere Halluzinationsrate bei Bildern
- Kleineres Modell als Konkurrenten
- Begrenzte Video-Unterstützung
Anwendungsfälle
- Bildanalyse und -beschreibung
- OCR und Dokumentenverarbeitung
- Visual Question Answering
- Mehrsprachige Bilderkennung
- Content Moderation
Technische Daten
- Parameter
- 7B
- Kontextfenster
- 8.192 Tokens
- Halluzinierungsrate
- 13.7%
- Güteklasse
- Etabliert
Verfügbarkeit & Lizenz
- Kostenmodell
- Freemium
- DSGVO-konform
- Teilweise
- Plattformen
- Web, API, Hugging Face, Mobile
- Deployment-Optionen
- Cloud, Self-hosted, Edge, On-Premise
- Eingabe-Modalitäten
- text, image, document
- Ausgabe-Modalitäten
- text
- Sprachen
- en, zh, de, fr, es, ja, ko, ru