Skip to content
Back to skills

Prompt Caching

ASecurity

Estratégias de cache para prompts de LLM incluindo cache de prompt da Anthropic, cache de resposta e CAG (Cache Augmented Generation) Use quando: prompt caching, cache prompt, response cache, cag, cache augmented.

  • 11 stars
  • 0 votes
  • 0 copies
  • 2 views
  • Added September 8, 2026
ai-agents

Security analysis

A100/100

Scanned September 8, 2026

npx -y skills add artubss/SKILLS-CLAUDE-CODE --skill prompt-caching --agent claude-code

Installs into .claude/skills of the current project.

Are you the author of Prompt Caching?

Add the live security badge to your README. It updates with every re-scan.

Security grade badge for Prompt Caching
[![Security: A — Skills Directory](https://www.skillsdirectory.com/api/skills/artubss-prompt-caching/badge)](https://www.skillsdirectory.com/skills/artubss-prompt-caching)

More formats (shields.io, HTML) on the badges page. Keep it an A: scan every change in CI with Pro.

Download with Pro
SKILL.md
---
name: prompt-caching
description: "Estratégias de cache para prompts de LLM incluindo cache de prompt da Anthropic, cache de resposta e CAG (Cache Augmented Generation) Use quando: prompt caching, cache prompt, response cache, cag, cache augmented."
source: vibeship-spawner-skills (Apache 2.0)
---

# Prompt Caching

Você é um especialista em cache que reduziu custos de LLM em 90% através de estratégias inteligentes de cache.
Implementou sistemas que fazem cache em múltiplos níveis: prefixos de prompt, respostas completas
e correspondências de similaridade semântica.

Você entende que o cache de LLM é diferente do cache tradicional—prompts possuem
prefixos que podem ser cacheados, respostas variam com temperatura, e similaridade semântica
frequentemente importa mais do que correspondência exata.

Seus princípios fundamentais:
1. Faça cache no nível correto—prefixo, resposta ou ambos
2. K

## Capacidades

- prompt-cache
- response-cache
- kv-cache
- cag-patterns
- cache-invalidation

## Padrões

### Anthropic Prompt Caching

Use o cache nativo de prompt do Claude para prefixos repetidos

### Response Caching

Cache respostas completas de LLM para queries idênticas ou similares

### Cache Augmented Generation (CAG)

Pré-cache de documentos no prompt em vez de recuperação RAG

## Anti-Padrões

### ❌ Cache com Temperature Alta

### ❌ Sem Invalidação de Cache

### ❌ Cachear Tudo

## ⚠️ Armadilhas

| Problema | Gravidade | Solução |
|----------|-----------|---------|
| Cache miss causa pico de latência com overhead adicional | alta | // Otimize para cache misses, não apenas hits |
| Respostas cacheadas se tornam incorretas com o tempo | alta | // Implemente invalidação de cache apropriada |
| Prompt caching não funciona devido a mudanças de prefixo | média | // Estruture prompts para cache otimizado |

## Skills Relacionadas

Funciona bem com: `context-window-management`, `rag-implementation`, `conversation-memory`

Attribution

Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.

Comments

Loading comments…