IA Batch: esperar unas horas y pagar menos
No todas las peticiones a la IA tienen la misma prisa. Algunas las haces mientras escribes y necesitas la respuesta ya; otras podrías lanzarlas antes de cerrar el portátil y encontrarlas hechas al día siguiente. NovLore trata estos dos casos de forma distinta, y saber cuál es cuál ahorra créditos.
Qué es la IA Batch
La IA Batch pone tu trabajo en una cola en vez de ejecutarlo al instante. La respuesta llega al cabo de horas, no de segundos. A cambio de la espera, el procesamiento cuesta menos: la API que NovLore usa para estos trabajos —la Batch API de Claude— está tarifada a la mitad, más o menos, que la misma petición en tiempo real.
No es una versión peor del modelo. Es el mismo modelo, con una entrega diferida.
Cuándo la espera es un buen trato
El batch compensa cuando la tarea es pesada y no la estás mirando:
- generar un capítulo entero a partir de la escaleta y la biblia de la obra;
- un repaso amplio de la estructura del libro;
- trabajos en bloque que preverías dejar corriendo mientras haces otra cosa.
En todos estos casos, quedarse frente a la pantalla con la barra girando no te daba ninguna ventaja. Más vale mover el trabajo a la cola y pagarlo menos.
Cuándo sí necesitas la respuesta ya
El tiempo real sigue siendo la opción correcta cuando la latencia es justo el punto:
- el chat con Scintilla, donde razonas junto al asistente;
- la edición de un fragmento seleccionado, que haces y revisas en pocos segundos;
- la corrección al vuelo mientras escribes.
Aquí una espera de horas rompería el flujo de trabajo en vez de ayudarlo. El coste pleno es el precio de la prontitud, y en estos casos la prontitud vale.
Cómo funciona en NovLore
Mandas el trabajo a la cola, la app registra el job y te deja seguir escribiendo. A intervalos comprueba el estado; cuando el resultado está listo te espera. No tienes que mantener la página abierta ni el ordenador encendido.
La regla práctica es una sola: si no necesitas mirar a la IA mientras trabaja, mándala a batch. Si la usas para pensar, mantenla en tiempo real.
Preguntas frecuentes
¿Cuánto tengo que esperar, exactamente?
Depende de la carga. Por lo general son horas, no días. Está pensado para el trabajo que lanzas y retomas más tarde, no para algo que necesitas en la misma sesión.
¿El resultado del batch es de calidad inferior?
No. El modelo es el mismo y las instrucciones son las mismas: solo cambia el momento de la entrega. El único compromiso es el tiempo, no el texto.