Vladyslav Didyk

NVIDIA PersonaPlex

Повнодуплексна модель мовлення: слухає, поки говорить, з настроюваними голосом і роллю.

Природно звучний агент для телефону чи кіоска. Наразі дослідницька модель, краще як демо, ніж для продакшену.

Дослідницький випуск, останній push у березні 2026, потрібен потужний GPU. Для платної роботи беріть Pipecat.

Код: MIT (файл LICENSE-MIT). Ваги моделі (nvidia/personaplex-7b-v1): NVIDIA Open Model License Agreement; картка моделі також указує CC-BY-4.0 як додаткову інформацію щодо ваг Kyutai Moshi, на яких вона базується.

Так: код під MIT, а картка моделі стверджує «This model is ready for commercial use», але ваги під окремою NVIDIA Open Model License (закриті на Hugging Face: потрібно увійти, поділитися контактними даними й прийняти умови), тож розгортання у клієнта має відповідати цій ліцензії, а не лише MIT.

Потрібен GPU: картка моделі вказує NVIDIA Ampere (A100) / Hopper (H100) як підтримувані й «NVIDIA A100 80 GB» як тестове обладнання; мінімального обсягу VRAM ніде у відкритому не вказано (README пропонує --cpu-offload, якщо пам'яті GPU не вистачає). Модель мовлення в мовлення на 7B на основі Moshi. Потрібні токен Hugging Face і прийняття ліцензії. Останній push 2026-03-02 (дослідницький випуск коду, низька активність). Кондиціонування голосу: отримуйте згоду на голос будь-якої реальної людини. Розміщеного розробником продукту не знайдено.

Ті самі покупці, що й для Pipecat

Природно звучний агент для телефону чи кіоска. Наразі дослідницька модель, краще як демо, ніж для продакшену.

не знайдено

Не названо

Каталог