AIai-costModel routing: hvorfor valget af Haiku, Sonnet eller Opus er vigtigere end dit prompt80% af AI-besparelser kommer fra at sende den rigtige forespørgsel til den rigtige model — ikke fra prompt-optimering. En praktisk guide til model routing i produktion.23. apr. 2026·7 min læsetid
AIai-costPrompt caching: den 90%-besparelse ingen taler omAnthropics ephemeral cache-rabat er mekanisk simpel, men operationelt svær. Placement-mønsteret, 1024-token grænsen og hvad der kan og ikke kan caches.23. apr. 2026·6 min læsetid