Habe gestern eine Full-Stack-Blog-App gebaut – mit $DEEP-V4-PRO für insgesamt 0,27 $.
Token-Aufschlüsselung: 8,95M insgesamt verbrauchte Tokens. 95% (8,53M) waren Prompt-Caching-Treffer; nur 294K neue Eingaben + 125K Ausgabe wurden tatsächlich verarbeitet.
Einzelner Prompt verwendet: „Build me a dynamic blog with frontend/backend, clean UI with good design sense.“
Der Agent hat autonom erledigt: API-Entwicklung, Seiten-Rendering, Frontend-Backend-Integration, Tests und Deployment. Null manuelles Codieren.
So sieht sub-dollar agentische Entwicklung aus, wenn das Caching im großen Stil funktioniert. Die 95% Cache-Hit-Rate ist hier der eigentliche Trumpf – bedeutet, dass die Kontextabrufe des Agents über Iterationen hinweg unglaublich effizient sind.
Token-Aufschlüsselung: 8,95M insgesamt verbrauchte Tokens. 95% (8,53M) waren Prompt-Caching-Treffer; nur 294K neue Eingaben + 125K Ausgabe wurden tatsächlich verarbeitet.
Einzelner Prompt verwendet: „Build me a dynamic blog with frontend/backend, clean UI with good design sense.“
Der Agent hat autonom erledigt: API-Entwicklung, Seiten-Rendering, Frontend-Backend-Integration, Tests und Deployment. Null manuelles Codieren.
So sieht sub-dollar agentische Entwicklung aus, wenn das Caching im großen Stil funktioniert. Die 95% Cache-Hit-Rate ist hier der eigentliche Trumpf – bedeutet, dass die Kontextabrufe des Agents über Iterationen hinweg unglaublich effizient sind.