¿Cuánto cuesta un asistente de IA personal en 2026?
Tres bandas de precio con la aritmética resuelta: unos 20 $ en planes de consumo, de 9 a 47 $ al mes en tokens si lo construyes, y precio fijo gestionado.
¿Cuánto cuesta un asistente de IA personal en 2026?
Un asistente de IA personal cuesta unos 20 $ al mes en un plan de consumo, aproximadamente entre 9 y 47 $ al mes solo en tokens de modelo si lo construyes tú con las tarifas de API publicadas en 2026, o una cuota fija en torno a los 55 $ en una solución gestionada de código abierto. La banda intermedia es la que sorprende, porque la factura de tokens es la parte que nadie presupuesta y la única que crece a medida que el asistente se vuelve genuinamente útil.
Todo lo que sigue es aritmética sobre precios de lista publicados, no estimaciones. Si quieres abordar la pregunta más amplia de qué estás comprando exactamente, empieza con nuestra guía sobre qué hace que un asistente de IA personal sea tuyo.
Las tres bandas de precio de un vistazo
Los asistentes personales se encuadran en tres estructuras de precio, y la estructura importa más que el número titular. Dos son predecibles y una no lo es.
| Banda | Qué pagas | Qué varía con el uso | Para quién encaja |
|---|---|---|---|
| Suscripción de consumo | Unos 20 $ al mes | Los límites de uso, no el precio | Quieres que funcione hoy y aceptas inferencia cerrada y medida |
| Hazlo tú mismo | Un servidor más una factura de tokens | Casi todo | Disfrutas de las operaciones y quieres control total |
| Solución gestionada de código abierto | Una cuota mensual fija | Nada | Quieres que el asistente sea tuyo sin tener que gestionarlo |
Las bandas uno y tres son fáciles de planificar. La banda dos es donde vive la pregunta real, así que ahí es donde va la aritmética.
Banda 1: lo que cobran realmente los planes de consumo
Los planes individuales de los asistentes más populares se agrupan en torno a los 20 $ al mes. Anthropic lista Claude Pro a 18 € al mes con facturación mensual, o 15 € con facturación anual, y ChatGPT Plus y Google AI Pro se sitúan en cifras similares.
Los niveles para usuarios avanzados suben bruscamente desde ahí. Claude Max empieza en 90 € al mes para un uso cinco o veinte veces superior al de Pro, y los puestos de equipo se listan a 18 € cada uno.
Lo que compra ese precio es capacidad, no propiedad. El modelo es cerrado, la inferencia se ejecuta en los servidores del proveedor, y lo que se mueve cuando lo usas intensamente es el límite de uso, no el precio. Para muchas personas ese es un intercambio perfectamente válido.
El problema aparece cuando el asistente deja de ser una ventana de chat y se convierte en infraestructura de la que dependes. En ese punto la pregunta cambia de «cuánto cuesta» a «qué ocurre si esto se retira, se reprecia o se restringe».
Banda 2: construirlo tú mismo y alquilar el modelo
La ruta de hacerlo uno mismo se divide en dos facturas muy distintas, y la gente suele equivocarse sobre cuál domina. El servidor es la pequeña.
Una instancia en la nube pequeña es suficiente para ejecutar un cliente de chat abierto y la orquestación que lo rodea, porque el cómputo pesado ocurre donde sea que corra el modelo. Si ese lugar es una API alojada, tu servidor es esencialmente un enrutador de mensajes.
La factura de tokens es la grande, y es la única línea que escala con cuánto usas realmente el asistente. La mayoría de las guías de costes se detienen antes de este punto, que es por qué la ruta de hacerlo uno mismo sigue describiéndose como barata.
Hay una tercera factura en horas. La configuración inicial, las actualizaciones, los fallos y las migraciones son costes reales aunque no llegue ninguna factura, y nuestra guía de configuración de OpenClaw es honesta sobre cómo es esa primera semana.
La aritmética de los tokens, resuelta
Aquí está el cálculo que nadie publica, usando la propia cifra de Meta para el tamaño de las conversaciones y las tarifas de API publicadas por Anthropic.
Meta informa de que una conversación típica con un asistente tiene 20.000 a 25.000 tokens, que es por qué su Business Agent cuesta entre 0,04 y 0,05 $ por conversación a 2,00 $ por millón de tokens. Cubrimos ese cambio de precios en Telegram frente a WhatsApp para un asistente de IA.
Toma un hábito modesto de 10 conversaciones al día con 22.500 tokens cada una:
- 225.000 tokens al día, o 6,75 millones de tokens al mes
- Divididos aproximadamente en un 90% de entrada y un 10% de salida, porque cada turno reenvía el prompt del sistema y la conversación hasta ese momento: 6,08 M de entrada, 0,68 M de salida
Aplicando las tarifas publicadas por Anthropic:
| Nivel de modelo | Entrada / salida por millón | Coste mensual en tokens |
|---|---|---|
| Haiku 4.5 | 1 $ / 5 $ | 9,45 $ |
| Sonnet 5 (introductorio) | 2 $ / 10 $ | 18,90 $ |
| Sonnet 5 (estándar) | 3 $ / 15 $ | 28,35 $ |
| Opus 5 | 5 $ / 25 $ | 47,25 $ |
Eso es con diez conversaciones al día. Triplícalo a treinta, que es lo que parece un asistente del que realmente dependes, y el uso de clase Sonnet alcanza 85 $ al mes solo en tokens, antes del servidor y antes de tus horas.
¿Soluciona el problema un nivel de modelo más barato?
En parte, y es la palanca más infrautilizada de todo el cálculo. Cambiar de nivel mueve la factura más que cualquier otra decisión individual.
A tarifas de clase Haiku, las mismas diez conversaciones al día cuestan 9,45 $ al mes, menos de la mitad de una suscripción de consumo. A tarifas de clase Opus, el uso idéntico cuesta 47,25 $, cinco veces más por exactamente las mismas conversaciones.
Así que «cuánto cuesta un asistente de IA personal» no tiene una respuesta única ni siquiera con el uso constante, porque los mismos hábitos abarcan un rango de cinco veces dependiendo únicamente de qué modelo responde.
La versión práctica es el enrutamiento: un modelo barato para la mayoría de los turnos y uno caro para las preguntas difíciles. Funciona bien, y es un sistema más que ahora posees y mantienes.
Por qué el caché de prompts no rescata el número
El caché de prompts reduce genuinamente la entrada repetida, y es la primera objeción que plantea la gente. Simplemente no encaja con la forma en que se usa un asistente personal.
El ahorro es real donde aplica. Las lecturas de caché de Sonnet 5 cuestan 0,20 $ por millón de tokens frente a 2 $ para la entrada nueva, una diferencia de diez veces en la parte más grande de la factura.
El límite es la ventana de caché, que por defecto es de cinco minutos. Un asistente personal se usa en ráfagas cortas distribuidas a lo largo de todo el día, así que el caché ayuda dentro de una sola ráfaga y no hace nada entre ellas.
Presupuesta como si la mayoría de los turnos no aprovecharan el caché, y trata cualquier ahorro como una ventaja inesperada. Asumir lo contrario es como la gente acaba con una factura tres veces mayor a su estimación.
El cambio de precio del 1 de septiembre de 2026
Aquí está el problema estructural de un asistente medido por uso, y tiene una fecha. Los 2 $ y 10 $ por millón de tokens de Sonnet 5 son precios introductorios hasta el 31 de agosto de 2026, y la tarifa estándar a partir del 1 de septiembre es de 3 $ y 15 $.
El mismo asistente, los mismos hábitos, las mismas conversaciones. La factura mensual de tokens en el ejemplo anterior pasa de 18,90 $ a 28,35 $, una subida del 50% que no elegiste y que no puedes rechazar.
Eso no es una crítica a los precios, que son públicos y están claramente indicados. Es el punto: en un plan medido, el precio de aquello de lo que dependes es decisión de otra persona, exactamente como las facturas de API impredecibles sobre las que hemos escrito antes.
El precio fijo no es más barato por definición. Mueve ese riesgo concreto fuera de tu lado de la mesa.
Banda 3: cuánto cuesta un plan gestionado con precio fijo
El plan Founder de Tessera cuesta 55 $ al mes, o 55 € en Europa, sin contador de tokens y con un límite de ritmo de 20 solicitudes por minuto. La facturación anual es de 47 $ al mes, es decir, 564 $ al año, y el precio fundador está bloqueado para los primeros 25 puestos.
Incluido en ese precio: la instalación, las actualizaciones y la monitorización, una instancia aislada en servidores en Europa con disco cifrado, y los cinco modelos abiertos. Qwen3.6-35B-A3B para chat, Whisper large-v3 para transcripción, Kokoro para síntesis de voz, más embeddings y un reranker.
Los modelos importan específicamente para la pregunta del coste. Tienen licencia Apache 2.0 y MIT, así que aquello de lo que dependes no puede ser retirado ni repreciado por debajo de ti como puede ocurrir con un modelo cerrado.
Para lo que pagan las empresas en tamaños mayores, nuestro desglose de precios de IA privada cubre el resto de la escala.
Los costes que nunca aparecen en la hoja de cálculo
Cuatro partidas faltan en casi todas las comparaciones, y juntas suelen superar a las que la gente sí cuenta.
- Voz. La transcripción y la síntesis de texto a voz son contadores separados en la mayoría de las soluciones. Si quieres enviar una nota de voz y escuchar una respuesta, presupuesta eso también.
- Memoria y almacenamiento. Los asistentes de larga duración acumulan historial, y la recuperación sobre él es otro conjunto de llamadas.
- Tus horas. Un fin de semana de configuración más una hora al mes de mantenimiento es dinero real a cualquier tarifa razonable para tu tiempo.
- Migración. Cuando un modelo cerrado queda obsoleto, reescribes los prompts y vuelves a probar el comportamiento. Ese coste llega según el calendario del proveedor.
El análisis de construir frente a comprar pone números a los dos últimos para despliegues más grandes, y la lógica escala bien hacia abajo hasta una sola persona.
¿Cuánto cuesta un asistente de IA personal al año?
Anualmente las tres bandas se separan claramente, y el rango de hacerlo uno mismo es amplio porque depende enteramente de cuánto lo uses.
| Opción | Coste anual | Notas |
|---|---|---|
| Suscripción de consumo | Unos 240 $ | Modelo cerrado, servidores del proveedor, límites de uso |
| Hazlo tú mismo, 10 conversaciones al día | Unos 340 $ en tokens | A tarifas estándar de clase Sonnet, más servidor y horas |
| Hazlo tú mismo, 30 conversaciones al día | Unos 1.020 $ en tokens | Las mismas tarifas, más servidor y horas |
| Solución gestionada de código abierto, facturación anual | 564 $ | Fijo, sin contador de tokens, pesos abiertos |
La lectura honesta es que un plan gestionado abierto cuesta más que una suscripción de consumo y menos que el uso intensivo de la ruta de hacerlo uno mismo. Lo que compras por esa diferencia son pesos abiertos y una factura que no se mueve.
Qué banda encaja contigo
Elige según cómo esperas usarlo, no por el número más pequeño de la página. Los tres casos son genuinamente distintos.
Elige un plan de consumo si quieres el modelo cerrado más potente sin ninguna configuración, tu uso es irregular, y no te importa en qué servidores se ejecuta. Esta es la respuesta correcta para la mayoría de los usos ocasionales.
Constrúyelo tú mismo si las operaciones son algo que disfrutas, quieres cambiar de modelos libremente, y tu uso es lo suficientemente bajo como para que la factura de tokens se mantenga por debajo de una suscripción de consumo. Sé honesto sobre las horas.
Elige un plan gestionado con precio fijo si el asistente se está convirtiendo en infraestructura, quieres pesos abiertos para que no pueda ser retirado, y prefieres pagar un número conocido antes que ver un contador. Para eso es Founder.
Preguntas frecuentes
¿Existe un asistente de IA personal gratuito?
Sí, en dos formas. Los proveedores ofrecen niveles gratuitos con límite en modelos cerrados, y las soluciones completamente locales no cuestan nada más que electricidad si ya tienes hardware que se ajusta al modelo. Ninguna es gratuita una vez que se pone precio a tu tiempo.
¿Por qué mi factura del asistente de IA es más alta de lo esperado?
Casi siempre porque cada turno reenvía el prompt del sistema y toda la conversación hasta ese momento, así que el coste crece con la longitud de la conversación y no con el número de mensajes que escribes.
¿Cuesta más un asistente de IA personal que ChatGPT Plus?
Con un uso ligero en un nivel de modelo barato, un asistente construido por uno mismo cuesta menos que una suscripción de 20 $. Con los volúmenes que la gente alcanza realmente una vez que funciona, cuesta varias veces más.
¿Puedo limitar cuánto cuesta un asistente de IA personal?
Solo de dos maneras. Límites de gasto fijos en la API, que detienen el asistente cuando se activan, o un plan fijo sin contador de tokens, donde el límite es el propio precio.