Llama 3.2 11B Vision Instruct
Meta · reasoning · 128K context · 1.25× credits
Meta's instruction-tuned multimodal model optimized for visual recognition, OCR, image reasoning, and document analysis.
Model ID: mixerlead-ai/meta/llama-3.2-11b-vision-instruct
Best for
- Visual reasoning
- Image captioning
- Document OCR
# Llama 3.2 11B Vision Guide\n\nLlama 3.2 11B Vision integrates high-resolution visual processing with deep language understanding across a 128K context window.