HeadlinesBriefing favicon HeadlinesBriefing.com

GPT-6 Prompt-Caching: KI schneller & günstiger

OpenAI Blog •
×

GPT-6 führt ein verbessertes Prompt-Caching-System ein, das standardmäßig höhere Cache-Trefferraten bietet und Rabatte von bis zu 90 % auf gecachte Eingabetokens gewährt. Das System wiederverwendet gemeinsame Präfixe innerhalb eines 30-Minuten-Fensters, was Latenz und Kosten für lang laufende Agentenaufgaben reduziert. Neue Tools umfassen das Prompt-Caching-Dashboard zur Überwachung der Trefferraten und ein Diagnosetool zur Analyse von Cache-Fehlschlägen durch Vergleich von Anfragen und Identifizierung von Änderungen in Modellen, Tools oder Eingaben.

Entwickler können nun explizite Cache-Breakpoints verwenden, um auszuwählen, welche Prompt-Präfixe gecacht werden sollen, und den Reasoning-Aufwand anzupassen, ohne den Cache zu brechen. Um die Cache-Stabilität zu erhalten, halten Sie Tool-Definitionen und Schemas konsistent, verwenden allowed_tools für Relevanz und fügen neue Anweisungen über Entwickler-Nachrichten hinzu, anstatt alte zu überschreiben. Vorwärmen bereitet bekannten Kontext im Voraus vor und verschiebt die Verarbeitung aus der Wartezeit des Benutzers.

Diese optionalen Steuerungen bauen auf der Standardleistung auf und ermöglichen es Entwicklern, das Caching an ihre Arbeitslast anzupassen. Beginnen Sie mit der Überwachung der Trefferraten, der Untersuchung von Fehlschlägen und der Befolgung des aktualisierten Prompt-Caching-Leitfadens oder der Verwendung von Codex zur Code-Überprüfung.