Vladyslav Didyk

NVIDIA PersonaPlex

Modelo de voz full-duplex: escucha mientras habla, con voz y rol configurables.

Agente telefónico o de kiosco de sonido natural. Hoy es un modelo de investigación, mejor como demo que para producción.

Versión de investigación, último push en marzo de 2026, necesita una GPU potente. Use Pipecat para trabajo de pago.

Código: MIT (archivo LICENSE-MIT). Pesos del modelo (nvidia/personaplex-7b-v1): NVIDIA Open Model License Agreement; la ficha del modelo también lista CC-BY-4.0 como información adicional para los pesos subyacentes de Kyutai Moshi.

Sí: el código es MIT y la ficha del modelo dice 'This model is ready for commercial use', pero los pesos están bajo la NVIDIA Open Model License aparte (con acceso restringido en Hugging Face: hay que iniciar sesión, compartir información de contacto y aceptar los términos), así que el despliegue para el cliente debe cumplir esa licencia, no solo MIT.

Necesita GPU: la ficha del modelo indica NVIDIA Ampere (A100) / Hopper (H100) como compatibles y 'NVIDIA A100 80 GB' como hardware de prueba; no se indica VRAM mínima en nada de lo que abrí (el README ofrece --cpu-offload si la memoria de la GPU no alcanza). Modelo de voz a voz de 7B basado en Moshi. Se requieren un token de Hugging Face y aceptar la licencia. Último push 2026-03-02 (lanzamiento de código de investigación, poca actividad). Condicionamiento de voz: obtenga consentimiento para la voz de cualquier persona real. No se encontró ningún producto alojado por el creador.

Los mismos compradores que Pipecat

Agente telefónico o de kiosco de sonido natural. Hoy es un modelo de investigación, mejor como demo que para producción.

ninguno encontrado

Ninguno mencionado

Catálogo