AI model capabilities
A shared vocabulary for comparing reasoning, modalities, tool use, structured output, deployment and retrieval features.
Reasoning
Models that can allocate additional compute or a dedicated reasoning mode to multi-step problems.
Explore →Vision
Models that can inspect and reason over images.
Explore →Audio input
Models that can receive audio as an input modality.
Explore →Entrada de vídeo
Aceptan vídeo directamente o mediante archivos como contexto.
Explore →Entrada PDF
Pueden recibir PDF o documentos como entrada directa en la API o plataforma.
Explore →Tool calling
Models that can request structured tool or function calls.
Explore →Structured output
Models that can produce outputs constrained by a schema or structured format.
Explore →Coding
Models with explicit capability for generating, understanding or editing software code.
Explore →Long context
Models with extended context windows for larger documents, histories or codebases.
Explore →Prompt caching
Support for reusing repeated prompt/context prefixes to reduce cost or latency.
Explore →Context caching
Soportan mecanismos de caching de contexto o tokens.
Explore →Pensamiento adaptativo
El modelo ajusta automáticamente el esfuerzo de razonamiento según la tarea.
Explore →Ejecución de código
Puede usar una herramienta nativa de ejecución de código en flujos compatibles.
Explore →Grounding web
Puede apoyarse en búsqueda o grounding web mediante herramientas nativas.
Explore →Web search
Models or products with an integrated web-search capability.
Explore →Computer use
Models capable of operating graphical user interfaces through controlled actions.
Explore →Image generation
Models that generate images from text or multimodal prompts.
Explore →Edición de imagen
Puede modificar o transformar imágenes existentes.
Explore →Multimodal
Support for more than one input or output modality.
Explore →Multilingüe
Diseñado o documentado para trabajar en múltiples idiomas.
Explore →Open weights
Model weights are available under stated licensing conditions.
Explore →Despliegue local
Puede ejecutarse fuera de una API SaaS mediante pesos o despliegue privado compatible.
Explore →Orientado a RAG
Documentado u optimizado para recuperación, citas o flujos RAG empresariales.
Explore →Traducción
Modelo o variante especializada en traducción entre idiomas.
Explore →Transcripción
Modelo especializado en convertir audio en texto.
Explore →OCR
Ability to extract or interpret text from images or scanned documents.
Explore →Estructura documental
Devuelve bloques, posiciones o estructura de documentos además del texto.
Explore →Agéntico
Orientado a flujos de varios pasos con herramientas y autonomía controlada.
Explore →Multiagente
Coordina múltiples agentes o subagentes dentro de una misma tarea.
Explore →