Сырая расшифровка фиксирует ровно то, что вы сказали. Каждое «эм», каждый ложный старт, каждое длинное предложение. Точно, но грязно.
Enhance находится между расшифровкой и буфером обмена. После того как Vext превратил речь в текст, Enhance прогоняет этот текст через локальную ИИ-модель, убирающую шум — слова-паразиты, ломаную структуру, повторяющиеся обороты — не меняя смысла.
Что делает Enhance
Конвейер обработки:
- Вы говорите в Vext
- Движок расшифровки переводит речь в текст
- Enhance отдаёт этот текст локальной LLM с инструкцией по очистке
- Обработанный результат — это то, что вставляется
До Enhance:
«Окей, в общем я думаю нам стоит эм наверное отрефакторить эту middleware аутентификации, потому что сейчас она как бы делает слишком много всего и её трудно тестировать»
После Enhance:
«Нам стоит отрефакторить middleware аутентификации. Она делает слишком много и её трудно тестировать.»
Смысл тот же. Тон тот же. Короче, чище, готово к отправке.
Что Enhance НЕ делает
Enhance — не переписчик. Он не:
- Меняет ваш смысл или намерение
- Добавляет информацию, которую вы не говорили
- Превращает разговорный тон в формальный
- Перестраивает аргумент
- Удаляет техтермины или жаргон
Он убирает шум. Сырая расшифровка всегда сохраняется рядом с улучшенной — для сравнения или отката.
Когда использовать Enhance
Включайте для:
- Сообщений в Slack и почты — убирает словесный мусор, читается как письменный текст
- Промптов ИИ — слова-паразиты LLM не помогают, чистые промпты работают так же
- Документации и заметок — чистый текст легче перечитывать
- Комментариев на code review — профессиональный тон без усилий
Выключайте для:
- Креативной письма, где речевые паттерны важны
- Дословной расшифровки (юр., мед., интервью)
- Случаев, когда нужно проверить точные слова перед отправкой
Enhance + перевод
Когда Enhance и целевой язык включены вместе, очистка и перевод проходят за один проход. Вы говорите сбивчивый русский — у курсора оказывается чистый английский.
Это больше, чем последовательная обработка — модель обрабатывает обе задачи сразу, давая более естественные переводы, чем пайплайн «сначала очистить, потом перевести».
Как работает локально
Enhance работает на локальных LLM, которые целиком работают на GPU Apple Silicon:
| Модель | Размер | Заметки |
|---|---|---|
| Gemma 3 4B | 2.8 GB | По умолчанию, лучшее качество |
| Qwen 3 4B | 3.2 GB | Сильная мультиязычность |
| LLaMA 3.2 3B | 2.4 GB | Сильный универсал |
| Gemma 3 1B | 0.8 GB | Самый быстрый, лёгкий |
| Phi-3.5 Mini | 2.8 GB | Компактный, сильное рассуждение |
Интернет не нужен. Никаких данных не уходит. Модель обрабатывает текст за миллисекунды на Apple Silicon.
Можно также использовать OpenAI-совместимый API, если хотите облако — но по умолчанию локально.
Резюме встреч
Для записей встреч Enhance отвечает за саммари. По окончании встречи он извлекает:
- Ключевые моменты — главные решения и обсуждённое
- Задачи — поручения с владельцами, где упомянуты
Сохраняется и полная расшифровка, и резюме. Резюме делается из полной расшифровки, так что захватывает контекст всей встречи.
Советы по использованию Enhance
Оставьте его включённым по умолчанию. Очистка достаточно консервативна, чтобы не менять смысл. Включите везде и отключайте только там, где нужен дословный вывод.
Говорите естественно. Enhance лучше работает с естественной речью, чем с аккуратным произнесением. Чем естественнее вы говорите, тем больше шума есть, что чистить — и тем заметнее улучшение.
Не переусердствуйте, чтобы «помочь» Enhance. Он не нуждается в помощи. Говорите как с коллегой. Модель понимает разговорный язык.
Иногда сверяйтесь с сырой расшифровкой. Особенно сначала — сравнивайте улучшенную и сырую версии, чтобы понимать, что Enhance меняет, а что сохраняет.
Попробуйте
Enhance включён в Vext — без отдельной покупки. В пробном режиме доступно 100 диктовок с полной поддержкой Enhance. Скачайте Vext и попробуйте на следующем сообщении в Slack.