Ein Tab mit der KI-Zusammenfassung, einmal erzeugt und behalten
Ein gespeichertes Dokument hat jetzt einen dritten Tab neben Vorschau und Markdown: drei bis fünf Sätze darüber, was darin steht, damit Sie erkennen können, was etwas ist, ohne es zu öffnen. Das erste Öffnen erzeugt sie; danach ist erneutes Lesen kostenlos. Neu erstellen ist ein Klick, für ein Dokument, das sich seither weiterbewegt hat.
Ein Verlauf mit vierzig Dokumenten ist zunächst vierzig Namen, und ein Name sagt fast nichts über einen Bericht, den jemand anderes vor drei Wochen konvertiert hat. Vor dieser Liste steht immer dieselbe Frage — was ist das, und ist es das gesuchte —, und jeden Kandidaten zu öffnen ist die langsame Art, sie zu beantworten.
Was in dem Tab steht
Ein gespeichertes Dokument hat neben Vorschau und Markdown einen dritten Tab, KI-Zusammenfassung: drei bis fünf Sätze schlichte Prosa darüber, was das Dokument sagt. Keine Überschriften, keine Stichpunkte, keine Wiederholung des Titels — gedacht ist es als etwas, das man in zehn Sekunden liest und danach entscheidet.
Es braucht ein gespeichertes Dokument und sagt das auch, statt den Tab rätselhaft leer zu lassen: Der Text wird am Dokument abgelegt, es muss also ein Dokument geben, an dem das geschehen kann.
Einmal erzeugt
Das erste Öffnen fragt das Modell. Was zurückkommt, wird mit dem Zeitpunkt seiner Entstehung an das Dokument geschrieben, und jedes weitere Öffnen liest diese Kopie — kein zweiter Aufruf, kein Warten, keine Anrechnung. Neu erstellen ist für ein Dokument gedacht, das sich seither weiterbewegt hat, und ist das Einzige, was erneut fragt.
Das Modell ist Gemini Flash, direkt aufgerufen und nicht über ein Gateway, mit abgeschaltetem Nachdenken: Drei Sätze sind eine kleine Aufgabe, und es hat keinen Sinn, dafür die Wartezeit eines größeren Modells zu bezahlen. Gelesen werden die ersten 60.000 Zeichen der Quelle — ein Budget an Token, kein Urteil über lange Dokumente: Eine Zusammenfassung muss die Sache genau einmal gelesen haben.
Die Grenze
Zwanzig Zusammenfassungen pro Konto und Tag. Darüber hinaus kommt die Anfrage mit genau dieser Auskunft zurück und der Bitte, es morgen erneut zu versuchen; vorhandene Zusammenfassungen zu lesen bleibt davon unberührt, denn die erreichen das Modell nie. Gezählt wird pro Konto und Tag in einer eigenen Rechnung, sodass ein Schwall gewöhnlicher API-Anfragen dieses Budget nicht aufbrauchen kann.
Aus einem Programm
POST /api/v1/documents/:id/summary liefert denselben Text mit demselben Zwischenspeicher dahinter — ?force erzeugt ihn neu —, und tp summary <id> ist dasselbe aus dem CLI. Ein Assistent mit angeschlossenem Connector ruft tp_summarize_document auf, und so kann ein Chat einen Ordner voller Dokumente sortieren, ohne eines davon in das Gespräch einzufügen.
Es ist eine Zusammenfassung, kein Auszug: Ein Dokument, dessen Wert in seinen exakten Zahlen oder seiner Tabelle liegt, ist ein Dokument zum Öffnen. Dies hier ist dafür da, das zu entscheiden.
Weiter: kostenlose KI-Zusammenfasser im Vergleich und die Ausgabe eines Assistenten als Seite.