Голосовой режим в Codex: как включить /voice и что он умеет

Опубликовано 19.09.20267 мин чтенияБазовый
Стильный терминал для двухстороннего голосового диалога, где речь и текст синхронно перетекают.
Что узнаешь
  • Что появилось в Codex 0.155 и чем /voice отличается от старого голосового ввода
  • Как обновить Codex и включить голосовой режим через /experimental
  • Какие команды управляют разговором и что именно озвучивается
  • Где голосовой режим полезен на практике, а где лучше текст
  • Какие ограничения у экспериментальной функции и что проверить у себя
Базовый
4просмотров

17 сентября 2026 вышел стабильный Codex CLI 0.155.0, а на следующий день - исправление 0.155.1. В версии 0.155.0 появились экспериментальные голосовые разговоры с агентом в терминальном интерфейсе: задачу можно проговорить и услышать ответ. Для запуска служит команда /voice.

По умолчанию функция выключена и поддерживается не везде. Для включения открой /experimental, выбери Voice conversations и перезапусти Codex. Описание сверено с примечаниями к релизу, изменением #43581 и исходным кодом Codex 19 сентября 2026 года. Сам голосовой разговор мы не запускали: механику описываем по первоисточникам, собственного теста здесь нет.

В Telegram-канале - что нового в вайб-кодинге: инструменты, находки, ошибки. Подпишись, если тема тебе полезна.

Что появилось в Codex 0.155?

Об удалении /realtime есть закрытое обсуждение в репозитории. Версия 0.155.0 возвращает голос в терминал в новом виде: единая команда /voice с живым транскриптом, индикаторами записи и кнопками управления микрофоном.

Условия и ограничения:

  • функция экспериментальная и по умолчанию выключена;
  • работает на поддерживаемых сборках - точный список платформ OpenAI в примечаниях не называет, поддержка проверяется при запуске;
  • в описании изменения #43581 указаны локальное аудио WebRTC и сигналинг через app-server. Это само по себе не означает, что разговор остаётся только на твоей машине; точный маршрут обработки в примечаниях не расписан.

В 0.155.0 также появились живые сводки рассуждений в строке статуса, управление задачами в обзоре агентов (скрытие, архив, удаление), подтверждение запросов к MCP-серверам (подключаемым внешним инструментам) через Touch ID на Mac, настраиваемое расписание обновлений фоновой службы и получение учётных данных Amazon Bedrock из внешних команд. А 0.155.1 - точечное исправление: у новых локальных сессий сводки рассуждений снова выключены по умолчанию, потому что часть провайдеров отклоняла такие запросы.

Как обновить Codex до 0.155?

Сначала проверь установленную версию:

bash
codex --version

Если версия ниже 0.155.0, обновляй тем же способом, каким ставил:

bash
# Если ставил через npm
npm update -g @openai/codex

# Если ставил через Homebrew
brew upgrade --cask codex

Если ставил официальным скриптом с сайта, повтори его:

bash
# macOS или Linux
curl -fsSL https://chatgpt.com/codex/install.sh | sh

На Windows - тот же установщик PowerShell, что и при первой установке. Если Codex у тебя ещё не стоит или непонятно, как войти из России, начни с нашего гайда Codex от OpenAI: что это, как установить и доступ из России.

Как включить голосовой режим?

Порядок действий:

  1. В запущенном Codex набери /experimental.
  2. В списке экспериментальных функций найди Voice conversations (описание пункта: «Talk with Codex using /voice») и включи её.
  3. Полностью выйди из Codex и запусти заново. В анонсе функции сказано: «Restart Codex after enabling, then use /voice».
  4. Набери /voice - начнётся голосовой разговор.

Понадобится микрофон и разрешение операционной системы на его использование. На Mac система спросит доступ при первом запуске записи, на Windows и Linux проверь, что микрофон выбран устройством по умолчанию. Если пункта Voice conversations в /experimental нет, скорее всего, твоя сборка функцию не поддерживает - обновись до последней версии и проверь ещё раз.

Что умеет голосовой разговор?

По описанию изменения #43581 в репозитории разговор устроен так:

  • Транскрипт в реальном времени. Твои слова и ответы агента появляются на экране по мере произнесения, видны статус разговора и уровни звука микрофона и динамика. Текст не теряется при переключении между диалогами.
  • Озвучивается не всё. Голосом произносятся финальные ответы агента в голосовом разговоре. Рассуждения и промежуточные комментарии скрыты. Ответы, которые пришли текстом, голосом не дублируются.
  • Управление без мыши. /voice mute выключает микрофон (сочетание клавиш для этого настраивается), /voice stop завершает разговор.
  • Ограничение записи в логи. Текст озвученного и данные событий голосовой сессии убрали из receipt- и debug-логов.

Звук обрабатывается сервисом OpenAI. Не передавай в голосовом разговоре чувствительные сведения - клиентские данные или цифры, которые не должны покидать твою машину.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 22–24 сентября  ·  2 000 ₽
Записаться →

Где голосовой режим полезен, а где лучше текст?

Несколько сценариев для /voice:

  • Надиктовать задачу целиком. Если диктовать тебе быстрее, чем печатать, так можно передать длинный контекст: предысторию, что уже пробовали, куда не ходить. Это тот же приём, что и надиктовка задач в других инструментах, теперь внутри самого Codex.
  • Спросить по ходу. Пока агент работает, можно спросить вслух «что сейчас делаешь?» или «почему выбрал этот вариант?», не переключаясь на клавиатуру.
  • Обсудить план до кода. Проговорить вслух три варианта решения и услышать их разбор - это формат живого обсуждения.

Точные команды, пути к файлам, фрагменты кода и сообщения об ошибках надёжнее вставить текстом. Если тебе нужна только быстрая диктовка без разговора, локальный вариант вроде Whisper решает это бесплатно и без отправки звука наружу; мы разбирали такой вариант в статье про бесплатный голосовой ввод через Whisper.

Какие ограничения и что проверить у себя?

Перед использованием проверь ограничения:

  • Экспериментальный статус. В примечаниях к релизу это сказано прямо. Команды и поведение могут поменяться; если что-то работает не так, сверяйся с примечаниями к свежей версии.
  • Не все сборки. OpenAI использует формулировку «supported builds», но список платформ в примечаниях к релизу не публикует - поддержка определяется при запуске. Если пункта в /experimental нет, проверь версию и поддержку функции твоей сборкой.
  • Тарифы не раскрыты. Какие подписки ChatGPT дают доступ к голосовым разговорам, в примечаниях к релизу не сказано. Если /voice у тебя не стартует при включённой функции, проверь доступность по документации твоего тарифа.
  • Звук уходит наружу. Разговор не остаётся только на твоей машине; точный маршрут обработки OpenAI в примечаниях не расписывает. В описании реализации указаны локальное аудио WebRTC и сигналинг через app-server. Прежде чем обсуждать рабочие данные, проверь, допустима ли их передача.
  • Включение по умолчанию в 0.156. В коде уже есть изменение, которое переводит голосовые разговоры из экспериментальных в стабильные и включает по умолчанию; оно вошло в предварительные сборки 0.156.0-alpha, но не в стабильный 0.155. Когда выйдет 0.156, отдельное включение через /experimental, судя по коду, больше не понадобится.

Если выбираешь между терминальными агентами, голос - только один из критериев. Общее сравнение возможностей - в обзоре Codex или Claude Code.

Короткий итог

Codex 0.155.0 принёс голосовые разговоры с агентом в терминал: режим включается через /experimental, после перезапуска работает команда /voice, управление - /voice mute и /voice stop. Агент говорит вслух только финальные ответы в голосовом разговоре, рассуждения скрыты, на экране идёт живой транскрипт. Функция экспериментальная и поддерживается не на каждой сборке, звук при этом покидает твою машину; в предварительных сборках линейки 0.156 режим уже переводят в стабильный по умолчанию. Обновись командой для своего способа установки, включи и проверь на своей задаче.

Источники

Полная схема вайб-кодинга за три вечера: ИИ-клон + Второй мозг + Контекст-инжиниринг. Записи эфиров в личном кабинете, доступ 30 дней.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 22–24 сентября  ·  2 000 ₽
Записаться →

Новые материалы - дайджестом, без спама

Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

Была инструкция полезна?
Артемий Миллер
Автор
Артемий Миллер
Предприниматель и вайб-кодер

Артемий Миллер - предприниматель и вайб-кодер. Бывший программист, собирает продукты исключительно вместе с ИИ-агентами, без найма разработчиков.

Связанные инструкции

Память Grok Build между сессиями: как включить и что агент записывает

У Grok Build есть память между сессиями: агент ведёт заметки о проекте в Markdown-файлах и подставляет подходящие записи в новые сессии. Функция экспериментальная и по умолчанию выключена. По официальной документации объясняем, как включить память, что записывается и как посмотреть и удалить заметки.

8 мин

Kimi Code: что это, официальный сайт и как установить на Windows и macOS

17 сентября 2026 Moonshot AI выпустил desktop-версию Kimi Code и новую основную версию CLI 2.0. Что это за инструмент, где официальный сайт, как установить его на Windows и macOS и сколько стоит работа с ним.

8 мин

Claude Code 2.1.268: запреты deny молча не работали - что починили и что проверить у себя

10 и 11 сентября 2026 года в Claude Code исправили ошибки в разрешениях: симлинки, строки с env -C и eval, правила с «!» и запись через tee. Заодно /mcp перестал показывать секреты из конфигов. Что изменилось, как обновиться и проверить свои запреты простым тестом.

8 мин

Как открыть сайт поисковым роботам ChatGPT, Claude и Perplexity

Как настроить доступ к сайту для ИИ-ассистентов: чем поисковый робот отличается от обучающего, точные имена роботов ChatGPT, Claude и Perplexity, пример robots.txt по шагам и ограничения настройки.

10 мин

Связанные термины