AvatarHype no es una plataforma de generación de avatares ni un SaaS. Es, esencialmente, un negocio de formación digital muy bien empaquetado alrededor de una idea concreta: enseñar a crear anuncios con IA utilizando servicios externos baratos y pagando por uso. Ellos mismos lo dicen explícitamente: “es una formación, no una app”.
El producto central es un curso/academia online con pago único. Hoy ofrecen tres paquetes: “Avatar Real” por 60 €, “Animados” por 45 € y un “Pack Completo” por 75 €. El paquete completo incluye unas 2 h 23 min de vídeo, 86 prompts, tres agentes configurados para ChatGPT/Claude, una biblioteca de música y efectos, documentos de “cómo se hizo”, una herramienta para quitar marcas de agua y actualizaciones futuras. El checkout se deriva a Whop, por lo que AvatarHype probablemente utiliza Whop para pagos, acceso o parte de la infraestructura comercial.
Lo interesante es que su producto real no es “hacer vídeos con IA”. Eso sería demasiado genérico y fácilmente sustituible. El producto que venden es conocimiento empaquetado: qué modelos usar, en qué orden, qué prompts utilizar, cómo mantener consistente un personaje, cómo escribir el anuncio, cómo montar los clips y cómo conseguir resultados visuales baratos.
Y ahí está la clave del negocio.
Su argumento comercial es aproximadamente este:
“No pagues HeyGen + Higgsfield + Freepik + otros servicios. Nosotros te enseñamos a ir directamente a los modelos que están debajo de esos servicios y pagar únicamente por cada generación.”
Ellos afirman que un clip de 10–15 segundos puede costar alrededor de $0,30 y que un anuncio completo de unos 45 segundos puede salir por menos de $1 en coste de generación. Incluso están promocionando actualmente un método temporal que supuestamente permite generar clips a $0,02. Esa última cifra la tomaría como coyuntural, porque ellos mismos reconocen que no saben cuánto durará.
Lo que probablemente están utilizando es alguna infraestructura que expone directamente modelos de vídeo e imagen mediante API o mediante marketplaces de inference. No revelan públicamente cuál es porque, literalmente, esa información forma parte del producto que venden. Dicen expresamente que “el modelo exacto de cada paso solo se comparte dentro”. También aclaran que no utilizan HeyGen.
Eso significa que hay una cierta ironía en el modelo: AvatarHype no posee necesariamente la tecnología que produce los vídeos. Su activo es saber dónde está, cómo utilizarla y cómo convertirla en un workflow.
Y comercialmente eso puede ser mucho más rentable que crear la tecnología.
La estructura económica aproximada del negocio es muy atractiva. Una vez producida la academia, vender una copia adicional cuesta prácticamente cero. El contenido principal tiene apenas unas pocas horas. Las actualizaciones tienen coste de producción, soporte y marketing, pero el margen bruto de un curso digital de 75 € puede ser enorme.
Ellos afirman tener actualmente alrededor de 6.900 alumnos y una valoración de aproximadamente 4,9/5. La propia página muestra 69 reseñas verificadas. También muestran capturas de compradores, resultados de campañas y comentarios en redes. Eso constituye evidencia comercial, aunque hay que hacer una distinción importante: la cifra de 6.900 alumnos es una afirmación del propio vendedor y no encontré una auditoría externa que permita confirmarla independientemente.
Si, por simple ejercicio, tomamos esos 6.900 compradores y asumimos un ticket medio de apenas 60 €, hablaríamos de:
6.900 × 60 € ≈ 414.000 €.
Si una proporción grande compra el paquete de 75 €, podría ser bastante más. Eso no significa que hayan facturado esa cifra —podría haber alumnos de etapas anteriores, promociones, bundles, descuentos, etc.— pero permite entender la escala potencial.
Y hay otro detalle que me parece más importante que las cifras: su marketing está muy bien construido.
No venden “IA”.
Venden:
“anuncios completos por menos de 1 €”.
Es una diferencia enorme.
La IA es simplemente el mecanismo.
También trabajan muy bien varios disparadores comerciales simultáneamente: ahorro frente a suscripciones, FOMO por promociones temporales, pago único, acceso de por vida, ejemplos visuales, prompts listos, herramientas secretas y actualizaciones constantes.
La landing está construida casi como un infoproducto estadounidense de direct response, pero bastante mejor ejecutado que la media: demostración → explicación → coste → casos → prueba social → producto → precio → objeciones → CTA.
Además, han convertido algo que cambia continuamente —los modelos de IA— en una ventaja competitiva. En lugar de vender un curso estático dicen: “nosotros vamos encontrando las herramientas económicas y te mantenemos actualizado”.
Eso les permite transformar una debilidad del mercado en su moat.
Pero el moat no es muy fuerte técnicamente. Cualquier competidor podría descubrir las mismas plataformas.
Su defensa está en cuatro elementos combinados: marca, comunidad, velocidad de actualización y curaduría.
Hay además un segundo negocio escondido dentro del primero: adquisición de clientes mediante sus propios anuncios creados con IA. Ellos dicen que los anuncios que ves promocionando AvatarHype se han generado utilizando el propio método. Es un mecanismo muy potente porque el anuncio funciona simultáneamente como publicidad y demostración del producto.
Eso genera un flywheel bastante elegante:
anuncios IA baratos → tráfico → venta del curso → alumnos → nuevos ejemplos/testimonios → mejor publicidad → más alumnos.
Y el coste marginal del producto permanece muy bajo.
Ahora bien: tampoco compraría sin más todo el relato de marketing.
Hay tres puntos que vigilaría.
Primero, “sin suscripciones” es algo relativo. Ellos no te cobran una mensualidad, pero sigues dependiendo de proveedores externos cuyos precios y condiciones pueden cambiar. Incluso reconocen una suscripción externa de unos $9/mes si quieres usar clonación de voz propia.
Segundo, el claim de $0,02 por clip se basa aparentemente en una oportunidad/promoción temporal. No es una ventaja estructural. Ellos mismos dicen que podría desaparecer.
Tercero, el verdadero trabajo sigue existiendo. AvatarHype deja muy claro que no existe el botón “crear anuncio”. Hay que definir ángulo, generar el guion, crear imágenes, producir clips, regenerar fallos y montar en CapCut.
Pero precisamente eso hace que el negocio me parezca más serio que muchas ofertas de IA actuales: no están pretendiendo que exista magia donde no existe.
Y ahora viene la parte que creo que puede interesarte especialmente.
El modelo de AvatarHype me parece bastante más interesante que Supercool como idea empresarial.
Supercool intenta convertirse en una capa tecnológica/orquestadora.
AvatarHype hace algo mucho más simple:
no construye los modelos;
no construye una plataforma compleja;
no compite contra OpenAI, Google, Kling, Runway, etc.;
descubre las mejores combinaciones;
las convierte en un procedimiento;
y vende el procedimiento.
Eso reduce brutalmente el riesgo tecnológico.
Y existe una variante todavía más interesante que copiar el curso: vender el resultado.
Por ejemplo:
“30 vídeos de producto con presentadores IA por 190 €.”
El cliente no necesita saber qué modelo utilizaste.
Internamente podrías tener algo similar a:
ChatGPT/Claude → estrategia y guion
generador de imagen → personaje/producto
modelo de vídeo barato → clips
modelo de voz → locución
CapCut → montaje
entrega.
Si producir un vídeo terminara costando entre $1 y $3 en generación y 10–20 minutos de trabajo, la estructura de margen sería muy distinta a una agencia audiovisual tradicional.
Y esto conecta directamente con una oportunidad que yo investigaría para GENIA: no crear “otro AvatarHype”, sino descubrir qué plataformas/modelos están utilizando realmente para conseguir esos costes.
Porque esa es la parte técnicamente interesante de todo el asunto.
Mi valoración del negocio sería aproximadamente:
Concepto comercial: 9/10.
Complejidad tecnológica: 3/10.
Margen potencial: 9/10.
Barreras de entrada: 4/10.
Marketing: 9/10.
Escalabilidad: 9/10.
Dependencia de terceros: 8/10.
En una frase: AvatarHype no vende avatares. Vende el mapa para llegar barato a las fábricas que producen los avatares.
Y ese mapa cuesta 75 €.
Creo que merece una segunda investigación bastante más interesante: identificar cuáles son esas “fábricas” que ocultan detrás del curso, comparar sus precios reales y reconstruir el workflow completo sin comprar necesariamente AvatarHype. Eso permitiría saber si el famoso “vídeo de $0,30” es reproducible y, sobre todo, si de ahí puede salir un servicio comercial propio.
Lás fábricas detrás del curso
AvatarHype parece apoyarse de forma importante en WaveSpeedAI como infraestructura de generación, combinándolo con APImart, modelos de voz/lip-sync y, en algunos casos, OpenAI/Anthropic. No están accediendo necesariamente “directamente al fabricante” en sentido estricto. Están utilizando agregadores de inferencia de bajo coste que exponen muchos modelos mediante playground y API, sin necesidad de las suscripciones de herramientas como Higgsfield o HeyGen.
Y lo más interesante: encontré una aplicación pública denominada “LA FRAGUA — AvatarHype Studio” que muestra explícitamente buena parte de ese stack.
1. El hallazgo importante: LA FRAGUA
La página se identifica como:
“AvatarHype Studio — contenido real y animado”.
Y su configuración muestra literalmente proveedores, modelos y workflows. No estoy deduciendo esto por similitud de precios: está escrito en la propia interfaz pública.
Entre otras cosas aparecen:
| Función | Proveedor/modelo |
|---|---|
| Generación principal | WaveSpeedAI |
| Segundo proveedor | APImart |
| LLM / estrategia | Anthropic |
| Imágenes alternativas | OpenAI |
| Imagen con referencia | google/nano-banana-2/edit-fast |
| Imagen maestra del personaje | Nano Banana Pro |
| Vídeo sin diálogo | bytedance/seedance-2.5/image-to-video-turbo |
| Transferencia de movimiento | wavespeed-ai/wan-2.2/animate |
| TTS | minimax/speech-02-turbo |
| Vídeo hablado / lip-sync | wavespeed-ai/infinitetalk |
| Voz alternativa/fija | ElevenLabs |
| Edición final | CapCut |
Todo eso aparece directamente en la configuración de LA FRAGUA.
Eso nos da prácticamente el esqueleto del método.
2. Qué es realmente WaveSpeedAI
WaveSpeedAI es mucho más interesante de lo que parece a primera vista.
No es un “generador de vídeos” al estilo Runway.
Es una capa de inferencia.
Tiene cientos de modelos de:
imagen → imagen
texto → imagen
imagen → vídeo
texto → vídeo
audio → vídeo
lip-sync
motion transfer
upscaling
LoRA
TTS
LLM
Y se paga por generación.
Ese es exactamente el modelo económico que AvatarHype está promocionando.
Puedes probar modelos desde el navegador mediante playground, pero además tienes acceso API. Por tanto, alguien puede empezar manualmente y posteriormente construir su propia aplicación encima.
Eso explica cómo AvatarHype puede decir:
“no necesitas nodos, código ni APIs”.
El alumno usa los playgrounds.
Pero AvatarHype puede internamente construir herramientas encima de esas APIs.
3. Encontré la explicación exacta de los famosos $0,30
Este fue uno de los datos que más me interesaba verificar.
AvatarHype dice:
10–15 segundos ≈ $0,30. AvatarHype
Pues existe actualmente en WaveSpeed un modelo que encaja prácticamente exactamente con esa cifra:
Pruna AI P-Video.
Su precio:
720p:
5 segundos → $0,10
10 segundos → $0,20
15 segundos → $0,30
1080p:
5 segundos → $0,20
10 segundos → $0,40
15 segundos → $0,60
WaveSpeed ofrece tanto text-to-video como image-to-video a ese precio. WaveSpeedAI
Esto es extremadamente significativo.
Porque AvatarHype dice:
“10–15 segundos ≈ $0,30”
y WaveSpeed vende:
“15 segundos = $0,30”.
No puedo afirmar que AvatarHype utilice P-Video para absolutamente todos los formatos.
Pero ya sabemos que WaveSpeed forma parte de su ecosistema y el precio coincide casi exactamente.
4. ¿Y el misterioso vídeo de $0,02?
Aquí hay una pequeña trampa semántica.
Actualmente WaveSpeed muestra P-Video como:
“$0.02 per run”
en la interfaz.
Pero el precio real depende de la duración:
$0,02 por segundo a 720p. WaveSpeedAI
Así que:
1 segundo = $0,02
5 segundos = $0,10
10 segundos = $0,20
15 segundos = $0,30.
AvatarHype, sin embargo, promociona temporalmente:
“10 segundos por $0,02”. AvatarHype
No encontré evidencia pública suficiente para demostrar qué promoción, truco o crédito permite esa cifra.
Por tanto, mi evaluación es:
$0,30 por clip: totalmente verificable.
$0,02 por 10 segundos: no lo daría como precio estructural.
Puede ser una promoción, crédito promocional, modelo experimental, arbitraje entre proveedores o mecanismo temporal.
De hecho AvatarHype reconoce expresamente que es temporal. AvatarHype
5. Hay incluso opciones todavía más baratas
Aquí empieza a ponerse interesante.
WaveSpeed tiene modelos que permiten generar vídeo desde:
$0,02 por segundo.
También encontramos OpenVideo:
480p → $0,02/s
720p → $0,04/s
1080p → $0,06/s.
Un vídeo de 10 segundos puede costar:
$0,20
$0,40
$0,60
respectivamente. WaveSpeedAI
Otro modelo interesante es LTX 2.3.
Un vídeo de 10 segundos cuesta aproximadamente:
480p → $0,20
720p → $0,30
1080p → $0,40.
Y genera también audio. WaveSpeedAI
Así que producir clips publicitarios por $0,20–$0,40 no es un cuento.
Es perfectamente real hoy.
6. El sistema de identidad del avatar
AvatarHype insiste mucho en su:
“hoja de identidad de 9 ángulos”.
Eso tampoco es tecnología exclusiva.
La técnica consiste básicamente en generar un character sheet 3×3 con varias perspectivas:
frontal
¾ izquierda
¾ derecha
perfil izquierdo
perfil derecho
ángulo superior
ángulo inferior
primer plano
plano más abierto.
Después esas imágenes se reutilizan como referencias.
Hay numerosas herramientas que hacen exactamente esto. Incluso servicios especializados anuncian explícitamente “9 angles from one image”. Vofy
Pero LA FRAGUA muestra algo todavía más revelador.
Dice que la imagen inicial del personaje se genera con el modelo caro, porque:
es la imagen que define la identidad del personaje.
Y después utiliza modelos más baratos para las sucesivas variaciones. La Fragua
Eso es técnicamente muy sensato.
En otras palabras:
no gastan calidad premium en todo.
Gastan calidad premium únicamente donde afecta a toda la cadena.
Ese principio tiene bastante valor.
7. Nano Banana es parte central del sistema
LA FRAGUA utiliza:
google/nano-banana-2/edit-fast
para muchas imágenes.
WaveSpeed lo cobra actualmente a:
$0,045 por imagen 2K.
Y permite hasta 14 imágenes de referencia. WaveSpeedAI
Para la imagen “maestra” del avatar, LA FRAGUA habla de Nano Banana Pro a aproximadamente $0,07. La Fragua
Tiene lógica.
Nano Banana resulta especialmente útil aquí porque puede mantener:
cara
ropa
producto
escenario
composición
mientras modifica determinadas características.
Eso reduce muchísimo el problema clásico de:
“el personaje de la toma 2 no parece el mismo de la toma 1”.
8. Pero el dato de “80 imágenes por $0,85” también es plausible
AvatarHype asegura:
80 imágenes = $0,85. AvatarHype
Eso implica:
$0,010625 por imagen.
WaveSpeed tiene actualmente bastantes modelos exactamente en esa franja:
Z-Image Base → $0,01 / imagen. WaveSpeedAI
Nucleus Image → $0,01 / imagen. WaveSpeedAI
Flux 2 Turbo → aproximadamente $0,01 / imagen. WaveSpeedAI
También existen modelos LoRA por aproximadamente $0,01. WaveSpeedAI
Por lo tanto:
80 × $0,01 = $0,80.
Con pequeñas diferencias de generación, fees o modelo:
$0,85 es completamente creíble.
Aquí AvatarHype no parece exagerar demasiado.
9. Cómo hacen que el personaje hable
Este punto me interesaba especialmente porque explica por qué no necesitan HeyGen.
LA FRAGUA lo explica explícitamente.
No generan necesariamente:
“avatar + voz + vídeo”
en un único modelo.
Hacen dos pasos:
Texto
↓
TTS
↓
audio
y luego:
imagen del personaje + audio
↓
InfiniteTalk
↓
vídeo hablado.
El TTS que aparece configurado es:
minimax/speech-02-turbo
y el modelo de vídeo hablado:
wavespeed-ai/infinitetalk. La Fragua
Esto es importante.
HeyGen te vende una experiencia integrada.
AvatarHype desmonta la experiencia en piezas.
Y al hacerlo reduce el coste.
Es exactamente el mismo principio por el que comprar las piezas de un ordenador suele ser diferente de comprar el ordenador terminado.
10. ¿Por qué InfiniteTalk y no vídeo con audio nativo?
Porque generar directamente:
“persona diciendo esta frase”
puede producir:
labios incorrectos
dientes extraños
fonemas mal sincronizados
gestos que no coinciden
voz inconsistente.
LA FRAGUA explica que utiliza TTS + lip-sync porque el audio nativo no garantiza sincronización suficientemente precisa. La Fragua
Eso me confirma algo importante:
AvatarHype no está simplemente utilizando “un generador de avatar”.
Está utilizando una cadena de producción.
Eso es mucho más robusto.
11. Cómo imitan movimientos humanos
Aquí aparece otra pieza muy potente:
Wan 2.2 Animate.
Este modelo permite hacer:
imagen del avatar
+
vídeo de una persona real realizando una acción
↓
nuevo vídeo donde el avatar reproduce:
movimiento
expresión facial
gestos
pose corporal.
WaveSpeed ofrece dos modos:
animate
y
replace. WaveSpeedAI
Precio actual:
480p → $0,04/s
720p → $0,08/s.
Por ejemplo:
30 segundos 480p → $1,20
30 segundos 720p → $2,40. WaveSpeedAI
Esto permite algo muy interesante.
Grabas tú:
tomando café
señalando un producto
caminando
abriendo una caja
haciendo determinado gesto.
Y después reemplazas visualmente al actor por el avatar.
Eso explica la frase comercial de AvatarHype:
“no es una foto moviendo los labios”.
Porque efectivamente puede existir movimiento corporal completo.
12. Incluso puedes copiar una actuación
LA FRAGUA tiene una función llamada:
“Replicar video con mi modelo”.
El procedimiento es:
vídeo de referencia
+
foto del avatar
↓
Wan Animate.
Y el nuevo avatar replica la escena. La Fragua
Aquí es donde empieza la parte comercial realmente potente.
No necesitas pedirle al modelo:
“haz que una mujer se sirva un café, luego mire a cámara y sonría”.
Puedes grabar exactamente esa actuación con cualquier persona y utilizarla como driving video.
La IA únicamente sustituye al personaje.
Eso reduce bastante la aleatoriedad.
13. El verdadero workflow de un anuncio AvatarHype
Reconstruyendo todas las piezas, un anuncio UGC realista probablemente se aproxima a esto:
FASE 1 — Estrategia
Producto
↓
Claude / ChatGPT
↓
público
↓
ángulo comercial
↓
hook
↓
guion.
AvatarHype incluso habla de sus agentes privados de estrategia y construcción de imágenes. AvatarHype
FASE 2 — Avatar
Prompt del personaje
↓
Nano Banana Pro
↓
imagen maestra
↓
character sheet / múltiples referencias.
FASE 3 — Escenas
Imagen maestra
+
prompt de situación
↓
Nano Banana 2 Edit Fast.
Generas:
en cocina
en coche
en oficina
con producto
sentado
bebiendo café
mirando móvil.
FASE 4 — Movimiento
Para planos mudos:
P-Video
LTX
Seedance
Wan
u otro I2V económico.
FASE 5 — Voz
Guion
↓
MiniMax / ElevenLabs
↓
audio.
FASE 6 — Persona hablando
Avatar
+
audio
↓
InfiniteTalk.
FASE 7 — Movimientos complejos
Avatar
+
vídeo de referencia
↓
Wan Animate.
FASE 8 — Montaje
Clips
+
voz
+
SFX
+
música
+
subtítulos
↓
CapCut.
Eso es AvatarHype, técnicamente hablando.
No hay magia.
Pero el workflow está bastante bien pensado.
14. Y esto explica por qué HeyGen deja de ser necesario
HeyGen tiene ventajas claras:
interfaz fantástica
simplicidad
avatares optimizados
consistencia
lip-sync integrado.
Pero también estás pagando:
producto
UX
infraestructura
margen
marketing
soporte
integración.
AvatarHype divide todo.
En lugar de:
HeyGen → $X/mes
haces:
imagen → $0,05
voz → céntimos
lip-sync → céntimos/dólares según duración
clips secundarios → $0,20
montaje → CapCut.
Para alguien que crea cinco vídeos al mes, la diferencia puede ser enorme.
15. El modelo que me parece especialmente interesante: P-Video
De toda esta investigación hay una herramienta que yo probaría inmediatamente.
Pruna P-Video.
Porque ofrece:
text-to-video
image-to-video
audio
720p / 1080p
seed
generación muy rápida.
WaveSpeed reporta aproximadamente 17–21 segundos de generación mediana dependiendo de modalidad. WaveSpeedAI
Y cuesta:
10 segundos 720p → $0,20.
Esto convierte la experimentación en algo completamente diferente.
Con $5 puedes generar aproximadamente:
25 vídeos de 10 segundos.
Con $20:
100 vídeos.
Ya no tienes esa sensación de:
“cada prueba está destruyendo mis créditos de Runway”.
16. Hay algo todavía más interesante: WaveSpeed tiene modelos para publicidad terminada
Encontré además un endpoint denominado:
AI Video Ads.
Le das:
retrato
nombre del producto
producto opcional
información comercial
idioma
y genera:
guion
voz
avatar
lip-sync
anuncio.
Precio publicado:
5s → $0,40
10s → $0,80
15s → $1,20. WaveSpeedAI
Eso ya se acerca directamente a:
“Generar anuncio”.
Aunque, paradójicamente, el método AvatarHype de construirlo por partes probablemente produce más control.
17. Hay una diferencia crucial entre “barato” y “bueno”
Aquí hay que poner los pies en el suelo.
Un modelo de $0,01 o $0,20 no necesariamente genera lo mismo que:
Kling 3
Veo 3.1
Seedance 2.5
Runway premium.
Por ejemplo, Seedance 2.5 Turbo en WaveSpeed empieza actualmente alrededor de $1 por generación. WaveSpeedAI
Por eso el verdadero truco no es:
“usar siempre el modelo barato”.
Es:
saber dónde puedes utilizar el barato sin que se note.
Esto me parece probablemente el conocimiento más valioso del método AvatarHype.
Para:
B-roll → barato.
Para:
transiciones → barato.
Para:
fondos → barato.
Para:
imágenes de prueba → barato.
Para:
character master → bueno.
Para:
primer plano hablando → bueno.
Para:
escena crítica → bueno.
Esa asignación inteligente del presupuesto es muchísimo más relevante que el nombre de un modelo determinado.
18. Mi reconstrucción del coste real
Supongamos un anuncio UGC de 45 segundos con:
3 planos principales
avatar
voz
algunos B-roll
edición.
Un escenario económico podría ser:
| Elemento | Coste aproximado |
|---|---|
| Avatar maestro | $0,07 |
| 5 imágenes auxiliares | $0,20–$0,25 |
| 3 clips P-Video 10s | $0,60 |
| TTS | centavos |
| 1–2 lip-sync | variable |
| CapCut | $0 marginal si ya se usa |
| Total generación | aproximadamente $1–$3 |
Por tanto, la frase de AvatarHype:
“anuncio completo por menos de $1”
es posible en una combinación muy económica.
Pero yo presupuestaría:
$2–$5 de coste técnico real por anuncio bueno, contando regeneraciones.
Porque el gran enemigo no es el precio de una generación.
Es:
“esta toma salió con seis dedos”.
Rehacer.
“Ahora la cara cambió”.
Rehacer.
“El producto tiene otra etiqueta”.
Rehacer.
Por eso nunca calcularía un negocio suponiendo una tasa de éxito del 100%.
19. El secreto no son los modelos
Esta investigación me hizo cambiar ligeramente mi opinión de AvatarHype.
Inicialmente pensé:
“están vendiendo dónde encontrar modelos baratos”.
Ahora creo que eso es solo una parte.
El verdadero producto es:
orquestación creativa manual.
Han convertido un caos de:
modelos
APIs
prompts
resoluciones
referencias
lip-sync
character consistency
edición
en una receta.
Y una receta tiene valor aunque todos los ingredientes estén en el supermercado.
20. Pero también encontré su principal debilidad
El moat tecnológico es prácticamente cero.
P-Video no es suyo.
WaveSpeed no es suyo.
Nano Banana no es suyo.
InfiniteTalk no es suyo.
Wan no es suyo.
MiniMax no es suyo.
CapCut no es suyo.
Claude tampoco.
Si mañana WaveSpeed cambia de precio o aparece algo mejor:
hay que rehacer el método.
Ellos lo saben.
Por eso venden:
actualización permanente.
Ese es su verdadero mecanismo de retención.
21. Lo que sí me parece una oportunidad empresarial
Y aquí es donde esta investigación se vuelve útil para nosotros.
Yo no copiaría AvatarHype.
Tampoco vendería un curso.
Crearía algo más interesante.
Un servicio tipo:
“Estudio de publicidad generativa”
El cliente entrega:
producto
web
logo
3 fotografías.
Y recibe:
10 anuncios UGC
10 variantes de hooks
5 presentadores
clips verticales 9:16
imágenes para Meta
versiones ES/PT
etc.
Por ejemplo:
10 vídeos → USD 150–250.
Coste tecnológico quizá:
USD 20–40.
No porque la IA sea gratis.
Sino porque la producción tradicional costaría muchísimo más.
22. Y eventualmente sí podríamos construir nuestro propio “AvatarHype operativo”
Esto es todavía más interesante.
LA FRAGUA demuestra que técnicamente no hace falta desarrollar una plataforma gigantesca.
Una aplicación podría tener:
PRODUCTO
↓
GUIÓN
↓
AVATAR
↓
GENERAR TOMAS
↓
GENERAR VOZ
↓
GENERAR VIDEO
↓
DESCARGAR.
Por debajo:
Claude/OpenAI
WaveSpeed
MiniMax
InfiniteTalk
Wan
Nano Banana.
Una pequeña interfaz podría orquestarlo.
Y ahí ya no venderíamos:
“un curso para utilizar diez plataformas”.
Venderíamos:
un operador de producción audiovisual.
Esto encaja bastante más con la dirección que hemos estado estudiando para GENIA que intentar construir otro modelo de IA desde cero.
Mi conclusión después de investigar el stack
AvatarHype no ha descubierto una tecnología secreta.
Ha descubierto algo empresarialmente mejor:
cómo comprar computación generativa al por mayor y venderla como conocimiento organizado.
Y ahora tenemos bastante localizada la cadena:
WaveSpeedAI es la pieza central más importante que yo investigaría y probaría.
Especialmente:
Nano Banana 2 → imágenes
P-Video → clips baratos
InfiniteTalk → avatar hablado
Wan 2.2 Animate → movimiento real
Seedance → planos de mayor calidad
MiniMax/ElevenLabs → voz
Claude/ChatGPT → estrategia y guion
CapCut → montaje
Lo siguiente que haría no sería seguir leyendo páginas.
Haría una prueba real.
Tomaría un producto ficticio —por ejemplo un perfume, suplemento, servicio informático o producto veterinario— y reconstruiría un anuncio UGC completo de aproximadamente 30 segundos con este stack, calculando cada generación y cada regeneración.
Ahí sabremos exactamente tres cosas que todavía ninguna página puede decirnos:
cuánto cuesta de verdad, cuánto tiempo lleva y qué calidad obtenemos.
Eso es lo que determinaría si aquí hay un negocio o simplemente una curiosidad tecnológica.
Puedo además vigilar precios y modelos de WaveSpeed, porque están cambiando muy rápido.
Hecho. Quedó configurada una vigilancia diaria de WaveSpeedAI.
Solo te avisaré cuando encuentre cambios relevantes en precios, nuevos modelos o capacidades que puedan reducir costes, mejorar la calidad o generar una oportunidad comercial. Si no hay novedades importantes, no recibirás aviso.
Hay una novedad útil para nuestro análisis de costes, aunque no es un lanzamiento de hoy: al revisar la tabla oficial actual de WaveSpeed encontré opciones más baratas de las que habíamos tomado como referencia.
La principal es Wan 2.2 I2V 480p Ultra Fast: cuesta $0,01 por segundo. Un clip de 5 s sale $0,05 y uno de 8 s, $0,08. Para B-roll, storyboards animados, pruebas y planos secundarios, esto es claramente más barato que usar P-Video a $0,02/s. Su límite es 480p y clips de 5 u 8 segundos, así que no lo usaría para la toma principal, pero sí como “modelo de descarte barato” antes de escalar calidad. WaveSpeedAI
También confirmé que Z Image Turbo está actualmente en $0,005 por imagen, no $0,01. Es decir, unas 200 imágenes por dólar. Además, el image-to-image cuesta lo mismo, lo que lo vuelve bastante útil para iterar escenas, composiciones y variantes antes de pasar a Nano Banana u otro modelo más caro. WaveSpeedAI
La contracara: la tabla oficial actual muestra Nano Banana 2 a $0,07/imagen y Nano Banana Pro a $0,14/imagen. Eso es más alto que algunas cifras que manejábamos ayer, por lo que conviene tratar los precios vistos en herramientas de terceros o endpoints específicos como variables, no como tarifa general de WaveSpeed. WaveSpeedAI
Con estos precios, el workflow económico mejora: bocetos e imágenes masivas con Z Image Turbo; clips de prueba y secundarios con Wan 2.2 Ultra Fast; y reservar Nano Banana, Seedance, Kling o similares para las tomas que realmente justifican calidad premium. Eso reduce todavía más el coste de iteración, que es donde normalmente se quema el presupuesto.