Llama 3.2 11B Vision Instruct ist eine Modellversion von Meta für die Verarbeitung von Text und Bildern mit Textausgabe.
Multimodal
KI-Modelle
Tools entdecken, Modelle vergleichen, Neues verstehen.
Für deinen Alltag. Und dein Unternehmen.
Multimodal
Modelle, die je nach Angebot neben Text auch Bilder, Audio oder weitere Eingaben verarbeiten.
Llama 3.2 90B Vision Instruct ist eine Modellversion von Meta für die Verarbeitung von Text und Bildern mit Textausgabe.
Llama 4 Scout 17B 16E Instruct ist eine Modellversion von Meta für die Verarbeitung von Text und Bildern mit Textausgabe.
Llama 4 Maverick 17B 128E Instruct ist eine Modellversion von Meta für die Verarbeitung von Text und Bildern mit Textausgabe.
Gemma 3 4b IT
Gemma 3 4b IT ist eine Modellversion von Google für die Verarbeitung von Text und Bildern mit Textausgabe.
Gemma 3 12b IT
Gemma 3 12b IT ist eine Modellversion von Google für die Verarbeitung von Text und Bildern mit Textausgabe.
Gemma 3 27b IT
Gemma 3 27b IT ist eine Modellversion von Google für die Verarbeitung von Text und Bildern mit Textausgabe.
Mistral Small 3.1 24B Instruct 2503
Mistral Small 3.1 24B Instruct 2503 ist eine Modellversion von Mistral AI für die Verarbeitung von Text und Bildern mit Textausgabe.
Keine passenden Einträge
Versuche einen anderen Suchbegriff oder setze die Filter zurück.
Alle Einträge: Multimodal
Modelle, die je nach Angebot neben Text auch Bilder, Audio oder weitere Eingaben verarbeiten.
Alle KI-Modelle ansehenEin Tool ist nicht dasselbe wie ein Modell.
Ein KI-Tool ist die Anwendung, die du benutzt – zum Beispiel ein Chatbot oder ein Übersetzer. Ein KI-Modell ist die Technologie dahinter. Dasselbe Tool kann mehrere Modelle anbieten.
KI-Modelle ansehen