Сырая расшифровка фиксирует ровно то, что вы сказали. Каждое «эм», каждый ложный старт, каждое длинное предложение. Точно, но грязно.

Enhance находится между расшифровкой и буфером обмена. После того как Vext превратил речь в текст, Enhance прогоняет этот текст через локальную ИИ-модель, убирающую шум — слова-паразиты, ломаную структуру, повторяющиеся обороты — не меняя смысла.

Что делает Enhance

Конвейер обработки:

  1. Вы говорите в Vext
  2. Движок расшифровки переводит речь в текст
  3. Enhance отдаёт этот текст локальной LLM с инструкцией по очистке
  4. Обработанный результат — это то, что вставляется

До Enhance:

«Окей, в общем я думаю нам стоит эм наверное отрефакторить эту middleware аутентификации, потому что сейчас она как бы делает слишком много всего и её трудно тестировать»

После Enhance:

«Нам стоит отрефакторить middleware аутентификации. Она делает слишком много и её трудно тестировать.»

Смысл тот же. Тон тот же. Короче, чище, готово к отправке.

Что Enhance НЕ делает

Enhance — не переписчик. Он не:

  • Меняет ваш смысл или намерение
  • Добавляет информацию, которую вы не говорили
  • Превращает разговорный тон в формальный
  • Перестраивает аргумент
  • Удаляет техтермины или жаргон

Он убирает шум. Сырая расшифровка всегда сохраняется рядом с улучшенной — для сравнения или отката.

Когда использовать Enhance

Включайте для:

  • Сообщений в Slack и почты — убирает словесный мусор, читается как письменный текст
  • Промптов ИИ — слова-паразиты LLM не помогают, чистые промпты работают так же
  • Документации и заметок — чистый текст легче перечитывать
  • Комментариев на code review — профессиональный тон без усилий

Выключайте для:

  • Креативной письма, где речевые паттерны важны
  • Дословной расшифровки (юр., мед., интервью)
  • Случаев, когда нужно проверить точные слова перед отправкой

Enhance + перевод

Когда Enhance и целевой язык включены вместе, очистка и перевод проходят за один проход. Вы говорите сбивчивый русский — у курсора оказывается чистый английский.

Это больше, чем последовательная обработка — модель обрабатывает обе задачи сразу, давая более естественные переводы, чем пайплайн «сначала очистить, потом перевести».

Как работает локально

Enhance работает на локальных LLM, которые целиком работают на GPU Apple Silicon:

Модель Размер Заметки
Gemma 3 4B 2.8 GB По умолчанию, лучшее качество
Qwen 3 4B 3.2 GB Сильная мультиязычность
LLaMA 3.2 3B 2.4 GB Сильный универсал
Gemma 3 1B 0.8 GB Самый быстрый, лёгкий
Phi-3.5 Mini 2.8 GB Компактный, сильное рассуждение

Интернет не нужен. Никаких данных не уходит. Модель обрабатывает текст за миллисекунды на Apple Silicon.

Можно также использовать OpenAI-совместимый API, если хотите облако — но по умолчанию локально.

Резюме встреч

Для записей встреч Enhance отвечает за саммари. По окончании встречи он извлекает:

  • Ключевые моменты — главные решения и обсуждённое
  • Задачи — поручения с владельцами, где упомянуты

Сохраняется и полная расшифровка, и резюме. Резюме делается из полной расшифровки, так что захватывает контекст всей встречи.

Советы по использованию Enhance

Оставьте его включённым по умолчанию. Очистка достаточно консервативна, чтобы не менять смысл. Включите везде и отключайте только там, где нужен дословный вывод.

Говорите естественно. Enhance лучше работает с естественной речью, чем с аккуратным произнесением. Чем естественнее вы говорите, тем больше шума есть, что чистить — и тем заметнее улучшение.

Не переусердствуйте, чтобы «помочь» Enhance. Он не нуждается в помощи. Говорите как с коллегой. Модель понимает разговорный язык.

Иногда сверяйтесь с сырой расшифровкой. Особенно сначала — сравнивайте улучшенную и сырую версии, чтобы понимать, что Enhance меняет, а что сохраняет.

Попробуйте

Enhance включён в Vext — без отдельной покупки. В пробном режиме доступно 100 диктовок с полной поддержкой Enhance. Скачайте Vext и попробуйте на следующем сообщении в Slack.