Los precios de Claude parecen complicados hasta que entiendes 3 conceptos: tokens, cache y batch. Esta guia te da todo lo que necesitas para presupuestar y optimizar tu factura.
Que es un token
Un token es aproximadamente 4 caracteres o 3/4 de una palabra en ingles (en espanol algo mas). "Hola mundo" son ~3 tokens. 1000 tokens ≈ 750 palabras.
Anthropic cobra separadamente por tokens de input (lo que le mandas) y tokens de output (lo que responde). Output suele costar 3-5x mas que input.
Estructura de precios (relativa)
Precios aproximados por millon de tokens (revisa la web oficial para valores actuales):
| Modelo | Input | Output |
|---|---|---|
| Haiku | ~$0.80 | ~$4 |
| Sonnet | ~$3 | ~$15 |
| Opus | ~$15 | ~$75 |
Ejemplos de coste real
- Resumir un articulo de 1000 palabras con Sonnet: ~$0.006 (input: 1300 tokens, output: 200 tokens).
- Procesar 10.000 emails cortos con Haiku: ~$8-15 total.
- Refactor completo de un archivo de 500 lineas con Opus: ~$0.30-1.00.
Prompt caching: el gran ahorro
Si envias el mismo contexto en cada peticion (un manual, un CLAUDE.md, ejemplos), activa prompt caching. Ahorras hasta 90% en el coste del input repetido.
Ejemplo: un chatbot con manual de 20K tokens. Sin cache, cada mensaje cuesta como si mandaras esos 20K nuevos. Con cache, solo pagas el 10% despues de la primera vez.
Batch API
Para tareas no urgentes, envia peticiones en batch: Anthropic las procesa en un plazo de 24h a mitad de precio. Perfecto para procesar bases de datos, generar contenido a escala, categorizar historicos.
Como calcular tu presupuesto mensual
- Estima peticiones al mes.
- Promedio de tokens input y output por peticion.
- Multiplica por precio del modelo.
- Anade 30% de margen por variabilidad.
Trucos para reducir factura
- Elige el modelo correcto: si Haiku hace la tarea, no uses Sonnet.
- Cachea contexto repetido: prompt caching.
- Usa batch API para tareas no urgentes.
- Limita max_tokens: si esperas 200 palabras, no pongas 4096.
- Comprime prompts: quita palabras inutiles del prompt del sistema.
- Deduplica: no processes lo que ya procesaste ayer.
Rate limits
Cada tier tiene limites de tokens por minuto y peticiones por minuto. Si los superas, la API devuelve 429. Manejalo con exponential backoff en tu codigo.
Como monitorizar
La consola de Anthropic muestra uso diario. Puedes fijar alertas de gasto. Recomendado: dashboard interno con tokens/coste por feature de tu app.
Conclusion
El coste de Claude API es predecible si sigues 3 reglas: modelo correcto por tarea, caching cuando aplique, batch para no urgente. Muchas apps pequenas viven bien con $50-100/mes; casos avanzados pueden bajar factura un 70% con optimizacion.