AuK от Tencent: открытая модель для генерации и редактирования речи
Что опубликовано в репозитории, где находится демо и какие выводы пока рано делать.
Что произошло
Tencent-Hunyuan опубликовала AuK 9 сентября 2026 года. По описанию разработчиков, модель работает с генерацией и редактированием речи через текстовые инструкции. В репозитории представлены AuK и вариант AuK-Flash.
16 сентября авторы сообщили об уменьшении потребления памяти энкодера примерно на 7,5 GiB. Это сообщение разработчиков о конкретном изменении; оно не означает, что вся модель теперь требует всего 7,5 GiB памяти.
Где смотреть
У проекта есть код, ссылки на веса и публичное демо. Начните с официального README: там собраны установка, примеры и ограничения. Демонстрации полезны для понимания задачи, но не заменяют собственную проверку нужного языка и типа записи.
Зачем это может пригодиться
Интересный сценарий для первого знакомства — взять собственную короткую запись и проверить одно изменение. Например, посмотреть, удаётся ли отредактировать нужный фрагмент без заметного нарушения остальной речи. Для сравнения сохраните исходник и слушайте оба файла на одинаковой громкости.
Что пока не проверено
Редакция ещё не выполняла самостоятельный запуск AuK. Мы не утверждаем, что модель точно подходит для русского языка, работает на любой домашней видеокарте или выигрывает у другого сервиса. Следующий шаг — воспроизводимый тест с записью, настройками и опубликованными результатами.
Для эксперимента берите собственный голос либо запись, которую вам разрешили использовать. Перед коммерческим применением прочитайте условия кода и весов на странице проекта.