Taxonomy

AI model capabilities

A shared vocabulary for comparing reasoning, modalities, tool use, structured output, deployment and retrieval features.

Reasoning

Models that can allocate additional compute or a dedicated reasoning mode to multi-step problems.

Explore →

Vision

Models that can inspect and reason over images.

Explore →

Audio input

Models that can receive audio as an input modality.

Explore →

Entrada de vídeo

Aceptan vídeo directamente o mediante archivos como contexto.

Explore →

Entrada PDF

Pueden recibir PDF o documentos como entrada directa en la API o plataforma.

Explore →

Tool calling

Models that can request structured tool or function calls.

Explore →

Structured output

Models that can produce outputs constrained by a schema or structured format.

Explore →

Coding

Models with explicit capability for generating, understanding or editing software code.

Explore →

Long context

Models with extended context windows for larger documents, histories or codebases.

Explore →

Prompt caching

Support for reusing repeated prompt/context prefixes to reduce cost or latency.

Explore →

Context caching

Soportan mecanismos de caching de contexto o tokens.

Explore →

Pensamiento adaptativo

El modelo ajusta automáticamente el esfuerzo de razonamiento según la tarea.

Explore →

Ejecución de código

Puede usar una herramienta nativa de ejecución de código en flujos compatibles.

Explore →

Grounding web

Puede apoyarse en búsqueda o grounding web mediante herramientas nativas.

Explore →

Web search

Models or products with an integrated web-search capability.

Explore →

Computer use

Models capable of operating graphical user interfaces through controlled actions.

Explore →

Image generation

Models that generate images from text or multimodal prompts.

Explore →

Edición de imagen

Puede modificar o transformar imágenes existentes.

Explore →

Multimodal

Support for more than one input or output modality.

Explore →

Multilingüe

Diseñado o documentado para trabajar en múltiples idiomas.

Explore →

Open weights

Model weights are available under stated licensing conditions.

Explore →

Despliegue local

Puede ejecutarse fuera de una API SaaS mediante pesos o despliegue privado compatible.

Explore →

Orientado a RAG

Documentado u optimizado para recuperación, citas o flujos RAG empresariales.

Explore →

Traducción

Modelo o variante especializada en traducción entre idiomas.

Explore →

Transcripción

Modelo especializado en convertir audio en texto.

Explore →

OCR

Ability to extract or interpret text from images or scanned documents.

Explore →

Estructura documental

Devuelve bloques, posiciones o estructura de documentos además del texto.

Explore →

Agéntico

Orientado a flujos de varios pasos con herramientas y autonomía controlada.

Explore →

Multiagente

Coordina múltiples agentes o subagentes dentro de una misma tarea.

Explore →