¿Qué es Wan 3.0?
Wan 3.0 es el último modelo de generación de vídeo de IA de código abierto de Alibaba, construido sobre un transformador de difusión de Mezcla de Expertos (MoE) de 27 mil millones de parámetros, con solo 14 mil millones de parámetros activos por paso de inferencia. Estuvo disponible en plataformas como Together AI a principios de abril de 2026, y se esperan pesos abiertos bajo Apache 2.0 para mediados o finales del segundo trimestre de 2026. El modelo admite conversión de texto a video, imagen a video, referencia a video con clonación de voz y edición de video basada en instrucciones.
¿Se puede probar Wan 3.0 AI de forma gratuita?
Sí. Las nuevas cuentas reciben créditos gratuitos para explorar la generación de texto a video, de imagen a video y de audio. No se requiere ningún pago para comenzar: crea tu primer clip y comprueba la calidad de primera mano.
¿Qué es la arquitectura MoE y por qué es importante?
La Mezcla de Expertos (MoE) divide el modelo en subredes especializadas (expertos), activando solo las más relevantes por pase de inferencia. Wan 3.0 escala a 60 mil millones de parámetros totales. El diseño MoE activa solo a los expertos más relevantes por pase, lo que le brinda mayor capacidad sin un costo de procesamiento proporcionalmente mayor.
¿Qué entradas acepta Wan 3.0?
Wan 3.0 acepta indicaciones de texto (para T2V), imágenes de referencia individuales o emparejadas para el control del primer y último fotograma (I2V), hasta 9 imágenes de referencia para el flujo de trabajo I2V de 9 cuadrículas, URL de audio (MP3 o WAV) para acondicionamiento de audio nativo y clips de vídeo existentes para edición basada en instrucciones. Todos los modos de entrada están disponibles a través de la misma plataforma.
¿Cómo funciona el audio nativo en Wan 3.0?
A diferencia de las herramientas que doblan el audio después de generar el vídeo, Wan 3.0 condiciona el audio durante el proceso de difusión. Usted proporciona una URL de audio de acceso público y el modelo sincroniza el movimiento de los personajes y los labios con esa pista durante la generación, lo que da como resultado una sincronización de labios precisa sin ningún paso de posprocesamiento.
¿Qué es el control del primer y último fotograma?
El control del primer y último fotograma le permite especificar la imagen inicial exacta, la imagen final exacta o ambas para un clip. Wan 3.0 luego genera todo el movimiento entre esos dos fotogramas. Esto brinda a los creadores un control preciso sobre el arco narrativo y las transiciones visuales, ideal para revelaciones de productos, cortes cinematográficos y contenido de marca.
¿Qué resoluciones y relaciones de aspecto admite Wan 3.0?
Wan 3.0 apunta a una salida 4K nativa de hasta 30 segundos por clip. Las relaciones de aspecto admitidas incluyen 16:9, 9:16 y 1:1. Todas las exportaciones son archivos MP4 sin marcas de agua.
¿Wan 3.0 es de código abierto?
Las versiones anteriores de la serie Wan (2.1 y 2.2) eran de código abierto bajo Apache 2.0. Wan 3.0 se lanzó primero a través de API en la nube (Together AI, abril de 2026), y se esperan pesos abiertos en Apache 2.0 a mediados o finales del segundo trimestre de 2026. Una vez que esté disponible, Wan 3.0 admitirá la implementación local autohospedada, incluso en GPU de consumo como RTX 4090.
¿Caducan los créditos de pago por uso?
No. Los créditos comprados a través de paquetes de recarga únicos nunca caducan. Permanecen en su cuenta indefinidamente; agregue más cuando los necesite.
¿Cuál es la política de reembolso?
Todos los nuevos planes de suscripción incluyen una garantía de devolución de dinero de 7 días. Si tiene alguna inquietud sobre un cargo de renovación, comuníquese con el soporte dentro de las 72 horas y lo revisaremos con usted directamente.