Método
uso = top-k × chunk + prompt + reserva de salida.
Comprueba cuántos tokens ocupa el retrieval antes de enviar la petición al modelo.
uso = top-k × chunk + prompt + reserva de salida.
Usa el resultado como una estimación transparente de planificación. Cambia un supuesto cada vez, compara escenarios y pasa a Toolkit cuando necesites simular el sistema completo.
El reranking puede devolver menos texto del recuperado inicialmente.
Tus entradas se procesan en este navegador. Esta utilidad no necesita cuenta, base de datos ni API de IA.