Contenido generado por IA: $1.40 por artículo, 4 reglas y cero penalizaciones
Así funciona un motor de contenido generado por IA que publica un artículo documentado al día por menos de $1.40 y evita el spam a escala de Google.

Mi motor de contenido generado por IA publica un artículo documentado al día por menos de $1.40 de gasto en modelos y apenas unos centavos de infraestructura. Si Google no ha fulminado el dominio por abuso de contenido a gran escala, no es por el volumen, sino por cuatro reglas estructurales.
La cifra del contenido generado por IA: un artículo documentado al día por menos de $1.40 en modelos
Este es el balance por artículo del motor que produjo este texto.
Esa cifra queda acotada por un tope estricto de $20 diarios para las seis rutinas que acceden a la base de datos. No es una recomendación. Una función mide cada llamada de pago, registra el gasto en tokens en el acumulado del día y rechaza la siguiente llamada si se alcanza el límite. El tope existe porque, en otro proyecto, una vez vi cómo un bucle de crítica descontrolado consumía $612 en una sola mañana. Con una vez basta.
El resultado del motor es un artículo investigado, respaldado por citas y editado; no una plantilla de completar huecos en la que solo cambia el nombre de la ciudad. El redactor prepara el borrador. En otra ejecución del modelo, el crítico lo revisa y señala las afirmaciones débiles. Después, una pasada de verificación contrasta las citas con las fuentes originales. Una pasada de embeddings compara el artículo terminado con todas las publicaciones anteriores para detectar duplicación semántica. Al final, una persona —yo— lo lee y lo publica.
Calcular el costo es la parte sencilla del SEO programático en 2026. El fallo caro no es la factura del modelo, sino una penalización de Google para todo el dominio que acabe con el motor en una sola actualización. Esa es la pregunta que aborda esta guía.
Por qué crear un motor de contenido en 2026 y cuál es el riesgo que acaba con casi todos
La oportunidad existe y el planteamiento no ha cambiado. El SEO programático apunta a búsquedas comerciales de cola larga con un costo marginal cercano a cero. La palabra clave principal, "programmatic seo", registra 880 búsquedas mensuales, KD 12, intención comercial y un CPC de $11.84 en DataForSEO. Su cola larga es más barata y fácil: "programmatic seo tool" tiene KD 0 y "programmatic seo examples", KD 10. Hay clústeres enteros al alcance de quien esté dispuesto a crear páginas útiles.
Lo que sí cambió es la economía del clic al otro lado. Un estudio de campo de este año mostró que los AI Overviews redujeron los clics orgánicos ~38% en promedio. El volumen sin un valor único que merezca ser citado ya no genera clics como en 2022. En 2026, aunque una página superficial se posicione para una consulta de cola larga, un AI Overview se queda con la respuesta y el usuario nunca llega al sitio.
Además está el riesgo estructural. La política de abuso de contenido a gran escala de Google apunta a páginas «producidas a escala» y creadas «principalmente para manipular los rankings» con «poco o ningún valor». Conviene leerlo con cuidado: no aparece la palabra IA. La política juzga la intención y el valor. Automatizar no es el problema; las páginas de poco valor basadas en plantillas y la publicación en avalancha sí son conductas penalizables.
La mayoría de los proyectos programáticos fracasa porque optimiza la cantidad de páginas en lugar del valor de cada una. Publicar cinco mil páginas un martes es la señal de spam más estridente posible. Publicar una página útil al día, todos los días, durante un año, es el trabajo de un medio.
El stack: cada herramienta y cada costo
La infraestructura es la parte aburrida y barata. Las rutinas se ejecutan en Cloudflare Workers. D1 es el repositorio canónico del contenido. R2 guarda snapshots con versiones para poder revertir cualquier publicación. Vectorize almacena embeddings por bloque para la comprobación de duplicados. Con el volumen de este motor, los precios de Cloudflare dejan el costo total de infraestructura por artículo en centavos de una sola cifra.
La generación utiliza Anthropic Sonnet en el ciclo de redacción, crítica y verificación de datos. El prompt del sistema para cada función es grande y estable, justo el patrón que más se beneficia del caché de prompts: después de la primera llamada dentro de una ventana, el prompt del sistema se lee con descuento.
Cada artículo lleva una portada creada con un modelo de imágenes, a un costo aproximado de $0.16. El mismo medidor que controla las llamadas a los modelos impone un límite estricto de tres imágenes en total.
DataForSEO sostiene la capa de investigación. Cada página de este motor parte de una palabra clave real, con volumen, dificultad y SERP reales. No se inventan temas ni se publican páginas nacidas de un «¿no sería interesante si...?». Si la palabra clave no existe en DFS con cifras aprovechables, el motor se niega a preparar un borrador para ella.
El cuello de botella, una vez más, es el medidor de costos. Todas las llamadas de pago pasan por una única función que registra el costo de los tokens y aplica el límite diario. Es la partida que evita otra mañana de $600. Fue lo primero que construí y sería lo último que eliminaría.
Guía de implementación: cómo montar un motor propio en una semana
Días 1–2: elige una fuente de datos propia
La fuente de datos propia es el elemento exclusivo que llevarán las páginas y que el resto de internet no tiene: una base de datos real, una API a la que se tenga acceso o un conjunto de datos creado internamente. El SEO programático sin una fuente de datos exclusiva es exactamente lo que señala la política de abuso de contenido a gran escala. Si la fuente consiste en «reescribir Wikipedia para 5,000 ciudades», hay que detenerse aquí.
Día 3: relaciona palabras clave e intención
Ejecuta en DFS el resumen de palabras clave y las búsquedas relacionadas para el clúster inicial. Descarta todo lo que tenga menos de 100 búsquedas mensuales o un KD superior a 80. Asigna cada palabra clave restante a una sola intención: informativa, comercial o transaccional. La intención determina la plantilla de página.
Día 4: diseña la plantilla de página
Una plantilla, una respuesta realmente útil en cada página. No se trata de rellenar «mejor [X] en [Y]» cambiando únicamente la ciudad. La plantilla define la estructura de las preguntas; la fuente de datos aporta algo que nadie más puede aportar.
Día 5: crea el ciclo de generación
Redacción → crítica → verificación de datos → deduplicación por embeddings. Las pasadas de crítica y verificación prácticamente duplican la factura del modelo. No son opcionales: constituyen el control de calidad que decide si el motor funciona como un medio o como una granja de spam.
Día 6: elimina duplicados con embeddings
Vectoriza cada borrador nuevo por bloques y compáralo con el corpus. Si la similitud del coseno con una publicación existente supera el umbral, el motor no publica. Deduplicación estructural, no impresiones subjetivas.
Día 7: publica uno y luego aumenta el ritmo
Publica un artículo. Mide indexación, impresiones e interacción. Después publica otro. Nunca lances todo el contenido pendiente de golpe. La propia velocidad es una señal.
La estrategia de palabras clave: la investigación de DFS que hace viable el SEO programático
Este es el procedimiento real de investigación, con "programmatic seo" como ejemplo.
El punto de partida es el resumen de palabras clave de DFS. La semilla arroja 880 de volumen / KD 12 / intención comercial / CPC de $11.84. Eso confirma que hay dinero real detrás del clúster y poca dificultad. A continuación se consultan las palabras clave relacionadas. El clúster se despliega así: "programmatic seo tool", con 170 de volumen / KD 0; "programmatic seo examples", con 50 / KD 10; y "ai seo content", con 110 / KD 49. Son tres páginas con dificultad decreciente, cada una con un enfoque viable.
Luego se consulta la SERP del término principal y se revisa el bloque People Also Ask. PAA no es decoración, sino la especificación del contenido. Las preguntas que Google muestra son las secciones que la página debe responder: si el SEO ha muerto en 2026, en qué se diferencian el SEO programático y el tradicional, cómo se crea SEO programático, cuáles son sus etapas y si Google penalizará esas páginas. Cada pregunta de la lista PAA se convierte en una sección de este artículo.
Por encima de todo está el filtro: cada página programática debe responder una consulta real mejor que los tres primeros resultados de la SERP. Si el motor no puede superar lo que ya está posicionado, debe negarse a publicar. La mayoría de los proyectos omite este filtro. Por eso fracasan tantos.
Las 4 reglas que evitan que Google acabe con el dominio
Esto es lo que los competidores de la SERP no publican: cuatro reglas estructurales, cada una vinculada con una cláusula concreta de la política contra el spam de Google.
Regla 1: valor único en cada página. Cada página debe aportar datos, análisis o una respuesta que no exista en la primera página de la SERP. La política identifica la «reformulación mediante plantillas» y el «poco o ningún valor» como patrones que descalifican el contenido. La fuente de datos propia demuestra que cada página no es una simple reformulación. Si no es posible señalar una columna de la base de datos y decir «esta página existe porque esta fila existe y es interesante», hay que eliminarla.
Regla 2: intención con intervención humana. El motor propone; una persona asume la decisión editorial. La frase decisiva de la política es «principalmente para manipular los rankings». Es una prueba de intención. Un control de revisión humana ofrece una evidencia comprensible de esa intención y, además, permite detectar el artículo que es técnicamente correcto pero, en el fondo, no sirve para nada. Una persona y una lectura antes de publicar. No es negociable.
Regla 3: disciplina en el ritmo. Hay que publicar con una cadencia creíble. En este motor, uno al día. Algunos operadores publican tres al día. Nadie que perdure publica trescientos. La velocidad es la señal de spam más evidente del índice, y el índice la detecta de inmediato. Si hay 5,000 páginas redactadas y listas, conviene publicar las primeras 30 y dejar que Google las indexe y posicione antes del siguiente lote.
Regla 4: eliminar y podar. En el día 30 se mide la interacción de cada página y se borran las que no generan nada. Un cementerio de páginas superficiales lastra todo el dominio: la política contra el spam menciona expresamente la «reputación del sitio» como algo que el contenido de poco valor puede diluir. La métrica es la tasa de conservación, no la de publicación.
El principio que une las cuatro reglas es sencillo: Google penaliza la intención y el valor, no la automatización. Un motor diseñado para aportar valor funciona estructuralmente como un medio. Uno diseñado para generar volumen funciona como una granja de spam. El sistema sabe distinguirlos. También cualquier persona que lea tres páginas del sitio.
Lo que no funcionó: la parte honesta de la atribución
Dos cosas no funcionaron como se había previsto en la primera versión del motor.
El volumen por sí solo no generó clics. Las primeras seis semanas incluyeron páginas técnicamente bien investigadas, pero sin un dato exclusivo. Después de indexarse, quedaron estancadas. Llegaron impresiones, pero no clics. El aumento del tráfico real estuvo relacionado casi por completo con las páginas que contenían una cifra, un benchmark o un análisis que la SERP aún no ofrecía. La cantidad de páginas no era la palanca; sí lo era la singularidad de cada una.
El ciclo de crítica y verificación prácticamente duplicó el costo por artículo: de unos $0.70 a los $1.40 que aparecen al inicio. Esa partida no me entusiasma, pero tampoco veo cómo eliminarla. La alternativa es publicar a escala una página que se equivoca con absoluta seguridad, y el costo de una penalización para todo el dominio no equivale a «más gasto en modelos»: equivale a cero. La aritmética resulta incómoda; la conclusión, no.
La atribución honesta tiene un límite: no puedo separar por completo la mejora del motor del trabajo simultáneo para lograr citas en motores de IA. Ambas iniciativas avanzaron en paralelo. El tráfico y la cuota de citas se movieron a la vez. Puedo afirmar que hubo correlación, pero no cuál causó cuál. Quien publique cifras de SEO programático en 2026 sin esa salvedad está vendiendo algo.
La partida que me sorprendió fue la de embeddings y deduplicación, no la generación: ahí es donde una implementación ingenua pierde dinero. La trampa consiste en volver a generar embeddings de todo el corpus en cada ejecución. Si se almacenan en caché y solo se recalculan al editar, el costo cae un orden de magnitud.
Las cifras de los días 7 y 30, y su conexión con GEO
En el día 7, el motor ya produce de manera fiable. El costo por artículo es estable y las primeras páginas están indexadas. Nada de esto constituye aún una victoria: indexarse es apenas el punto de partida.
En el día 30 se ejecuta por primera vez el ciclo de poda. Las páginas con cero impresiones y cero clics se eliminan, no se mejoran. La métrica es la tasa de conservación. Si el motor produce 30 páginas al mes y 25 sobreviven a la poda, funciona. Si sobreviven 10, la fuente de datos o la plantilla están mal, y hay que dejar de publicar hasta corregirlo.
El principio repetible es este: un motor de contenido es un problema económico —el costo por página conservada— y un problema de políticas —intención y valor—, no un problema de volumen. El costo por página redactada es la cifra fácil de optimizar. El costo por página conservada es la cifra real y siempre supera lo que sugiere la factura del modelo.
Este es el lado de la oferta. El lado de la demanda —conseguir que ChatGPT, Claude y Perplexity citen esas páginas— requiere otra guía basada en el mismo contenido. Una vez que existen páginas dignas de ser citadas, [la guía de GEO en 14 días](/blog/geo-playbook-14-days-reddit-perplexity-citations) explica cómo hacerlas visibles para los motores de IA que ahora se interponen entre la página y el lector. Cuando el tráfico por fin llega, un algoritmo bandit de IA en la landing page plantea la cuestión de la conversión. Motor, GEO y CRO: un sistema, tres problemas, en ese orden.
¿El SEO está muerto o está evolucionando en 2026?
No está muerto: cambió de precio. Los AI Overviews redujeron los clics orgánicos alrededor de un 38% en pruebas de campo, así que el volumen sin un valor único que merezca ser citado ya no resulta rentable como antes. La economía del motor deja de girar en torno a la cantidad de páginas y pasa al valor de las que se conservan; sobreviven las que aportan datos o análisis que la SERP aún no contiene.
¿Cuál es la diferencia entre el SEO programático y el SEO tradicional?
El SEO tradicional trabaja manualmente, página por página, sobre un conjunto pequeño de objetivos de alto valor. El SEO programático utiliza automatización y una fuente de datos propia para generar muchas páginas orientadas a palabras clave a la vez. La diferencia importante es si cada página generada aporta valor único o solo relleno de plantilla: el segundo patrón es el que señala la política de abuso de contenido a gran escala de Google.
¿Cómo se crea SEO programático en la práctica?
Primero se elige una fuente de datos real —una base de datos, una API o un conjunto de datos propio—; después se organizan las palabras clave por intención y dificultad en DataForSEO o una herramienta similar; se diseña una plantilla que aporte una respuesta realmente útil por página; y se ejecuta un ciclo de generación → crítica → verificación de datos → deduplicación, con un control editorial humano antes de publicar. La cadencia debe ser creíble y la poda debe hacerse en el día 30.
¿Cuáles son las etapas esenciales de un motor de contenido SEO?
Investigación de palabras clave e intención, una plantilla de página que aporte valor y esté vinculada con una fuente de datos propia, generación sometida a controles de calidad con pasadas de crítica y verificación, deduplicación basada en embeddings y, en el día 30, la poda de las páginas que no producen nada. La poda es la etapa que más proyectos omiten.
¿Google penaliza las páginas generadas mediante SEO programático?
Google penaliza las páginas creadas principalmente para manipular los rankings y que aportan poco valor; la automatización por sí sola no activa la penalización. El problema son las páginas de poco valor basadas en plantillas y la publicación en avalancha. Un motor con una fuente de datos exclusiva, revisión humana, una cadencia sensata y un ciclo periódico de poda se presenta ante el índice como un medio, no como una granja de spam.
¿Cuánto cuesta realmente un motor de contenido generado por IA por artículo?
En este pipeline: menos de $1.40 de gasto en modelos para las pasadas de redacción + crítica + verificación de datos + embeddings, unos $0.16 para generar imágenes con un límite de 3 y centavos de una sola cifra para la infraestructura de Cloudflare. Todo queda sujeto a un tope estricto de $20 diarios que rechaza llamadas cuando se agota el presupuesto.
5 sept 2026







