KI-Batch: ein paar Stunden warten, weniger zahlen
Nicht jede Anfrage an die KI ist gleich dringend. Manche stellst du beim Schreiben und brauchst die Antwort sofort; andere könntest du vor dem Zuklappen des Laptops starten und am nächsten Tag fertig vorfinden. NovLore behandelt diese beiden Fälle unterschiedlich, und zu wissen, welcher welcher ist, spart Credits.
Was KI-Batch ist
KI-Batch stellt deinen Auftrag in eine Warteschlange, statt ihn sofort auszuführen. Die Antwort kommt nach Stunden, nicht nach Sekunden. Im Tausch gegen das Warten kostet die Verarbeitung weniger: Die API, die NovLore für diese Aufträge nutzt — Claudes Batch API — wird mit etwa der Hälfte derselben Echtzeitanfrage berechnet.
Es ist keine schlechtere Version des Modells. Es ist dasselbe Modell, mit verzögerter Auslieferung.
Wann das Warten ein guter Deal ist
Der Batch zahlt sich aus, wenn die Aufgabe schwer ist und du nicht zusiehst:
- ein ganzes Kapitel erzeugen aus dem Exposé und der Story-Bibel;
- ein breiter Durchlauf über die Struktur des Buches;
- Sammelaufträge, die du ohnehin laufen lassen würdest, während du etwas anderes tust.
In all diesen Fällen brachte dir das Sitzen vor dem Bildschirm mit drehender Anzeige keinen Vorteil. Dann kannst du die Arbeit auch in die Warteschlange schieben und weniger dafür zahlen.
Wann du die Antwort wirklich sofort brauchst
Echtzeit bleibt die richtige Wahl, wenn die Latenz genau der Punkt ist:
- der Chat mit Scintilla, wo du gemeinsam mit dem Assistenten nachdenkst;
- die Bearbeitung einer markierten Passage, die du binnen Sekunden machst und prüfst;
- die Korrektur im Vorbeigehen während des Schreibens.
Hier würde eine Wartezeit von Stunden den Arbeitsfluss brechen statt ihn zu stützen. Der volle Preis ist der Preis der Sofortigkeit, und in diesen Fällen ist sie das wert.
Wie es in NovLore funktioniert
Du schickst den Auftrag in die Warteschlange, die App speichert den Job und lässt dich weiterschreiben. In Abständen prüft sie den Status; wenn das Ergebnis fertig ist, wartet es auf dich. Du musst weder die Seite offen halten noch den Rechner anlassen.
Die Faustregel ist eine einzige: Wenn du der KI nicht bei der Arbeit zusehen musst, schick sie in den Batch. Wenn du sie zum Denken nutzt, halt sie in Echtzeit.
Häufige Fragen
Wie lange muss ich genau warten?
Das hängt von der Last ab. In der Regel sind es Stunden, nicht Tage. Es ist für Arbeit gedacht, die man startet und später wieder aufnimmt, nicht für etwas, das man in derselben Sitzung braucht.
Ist das Batch-Ergebnis von geringerer Qualität?
Nein. Das Modell ist dasselbe und die Anweisungen sind dieselben: nur der Auslieferungszeitpunkt ändert sich. Der einzige Kompromiss ist die Zeit, nicht der Text.