# Синтез речи голосом автора

`ТВ02`

> ТВОРЧЕСТВО · ПРОДВИНУТЫЙ · тема по фильтру курса 12/20 — годится

Записываете 5-10 минут своей речи на русском языке — AI анализирует тембр, интонации, произношение и создает цифровую копию вашего голоса. Затем можете вводить любой текст, и система озвучит его вашим голосом. Поддерживает эмоциональную окраску: радостный, грустный, удивленный тон.

**Зачем:** Создание аудиоконтента без постоянной записи: подкасты, аудиокниги, голосовые сообщения.

## Что предстоит выяснить

- Сколько записи нужно и что делать с шумной студией
- Как подтверждается право на голос и что мешает загрузить чужой
- Что делать с ошибками ударений, именами и терминами
- Нужен ли слушателю признак, что фрагмент синтезирован

**Область:** синтез речи, речь, суждение модели

## Тема глазами курса

**Чей процесс:** Автор подкаста переозвучивает правки в выпуске — переписывать целый фрагмент дорого

**Почему не решается одним вызовом модели:** Голос синтезируется моделью, но интонация и паузы задаются разбором текста, а согласие на голос и защита от подделки — отдельная работа, без которой продукт опасен

**Где появляется результат:** Результат — аудио, которое уходит в выпуск и звучит как конкретный человек

**Что считается успехом:** Слушатель не отличает вставку от живой записи, а подделать чужой голос через продукт нельзя

**Что будут атаковать:** Голос как поверхность злоупотребления: чужой образец, подделка сообщения. Тема требует согласия и водяного знака

**Откуда данные (добывают сами):** Голос своего участника с его письменным согласием. Материала на час набирается за пару вечеров, а согласие — часть темы, а не формальность

### Оценка по фильтру: 12/20 — годится

- Чей процесс: 3/5 — Кому больно — и можно ли этого человека спросить?
- Своё поверх модели: 3/5 — Что останется от продукта, если убрать чужую модель?
- Действие: 3/5 — Продукт что-то меняет — или только показывает?
- Проверяемость: 3/5 — Чем меряется качество и что здесь будут атаковать?

> Тема курса «Системы искусственного интеллекта». Команда из четырёх ролей (Product/VO, AI Engineer, Delivery, Quality & Safety) реализует её за 16 недель, семь спринтов-лабораторных.
